OpenAI объявила о создании ИИ-«стажёра»: агент самостоятельно выполняет задачи исследователя

Сегодня, 12:29 | Технологии
фото с Зеркало недели
Размер текста:

Вскоре после запуска новой модели GPT-6 Astra компания OpenAI заявила, что создала «исследователя-стажера» на базе искусственного интеллекта, способного самостоятельно выполнять отдельные научные задачи, на которые у специалистов обычно уходит несколько дней. Разработчики подчеркнули, что система работает под контролем людей и является промежуточным шагом на пути к созданию автоматизированного исследователя на базе ИИ к 2028 году.

В новом отчете OpenAI отметила, что считает, чторазвитие общего ИИ (Artificial general intelligence, AGI) должно происходить под демократическим контролем и сопровождаться открытым обсуждением его возможностей, рисков и механизмов безопасности. По словам компании, общественность должна понимать, как развиваются самые мощные системы ИИ и как они уже влияют на современные исследования, поэтому она раскрывает детали своей работы.

Под понятием «исследователь-стажер» OpenAI понимает систему, способную выполнять четко определенные научные задачи под руководством человека. Речь идет о работе, которая ранее требовала от исследователя нескольких дней.

[see_also ids="694776"]

Агенты изменили работу исследователей OpenAI

По данным компании, в течение последнего года внутренние агенты для программирования стали неотъемлемой частью работы её исследователей. К середине августа исследователи использовали агентов настолько активно, что объем их работы эквивалентен примерно 3,1 «агентскому» рабочему дню на каждый человеческий рабочий день.

Компания также сообщила о резком росте использования таких инструментов. Если в начале года сотрудники OpenAI практически не привлекали ИИ-агентов для написания кода, то к середине августа среднестатистический исследователь компании уже ежедневно интегрирует их в свою работу, тратя на вычисления более 600 долларов в сутки по тарифам API. В то же время 10% самых активных разработчиков лаборатории в настоящее время ежесуточно расходуют токены на сумму более 7000 долларов.

Параллельно возросло количество экспериментов и скорость написания кода. OpenAI утверждает, что инженеры быстрее интегрируют изменения в модели, а исследователи всё чаще запускают несколько агентов одновременно для выполнения различных подзадач.

[see_also ids="692229"]

От кода к анализу экспериментов

По словам разработчиков, агенты перестают быть лишь помощниками при написании кода и всё чаще выполняют более сложные функции. Они помогают в планировании экспериментов, анализе результатов, мониторинге обучающих запусков, настройке инфраструктуры и технической поддержке.

OpenAI отмечает, что именно автоматизация устранения технических проблем уже снизила нагрузку на внутренние команды поддержки. Некоторые группы даже прекратили проводить регулярные сессии помощи исследователям, поскольку значительную часть таких задач взяли на себя агенты.

В компании также сообщили, что агенты всё успешнее справляются с задачами, требующими от четырёх до восьми часов человеческого труда, хотя более сложные проекты по-прежнему требуют активного вмешательства исследователей.

[see_also ids="694244"]

Главная цель

OpenAI стремится разработать полностью автоматизированного ИИ-исследователя к марту 2028 года. Система должна помочь решать проблемы согласования ИИ с человеческими ценностями (AI alignment) и разрабатывать новые механизмы защиты критической инфраструктуры.

В то же время OpenAI признает, что пока не знает, как безопасно создать полностью автономного исследователя. Именно поэтому, по словам компании, развитие возможностей должно сопровождаться усилением механизмов безопасности, прозрачностью и регулярной публичной отчетностью о прогрессе в направлении рекурсивного самосовершенствования систем ИИ.

Проблемы с безопасностью

В OpenAI подчеркнули, что ускорение развития не означает готовности бесконтрольно наращивать возможности систем.

После недавнего инцидента, который компания связывает с компрометацией её исследовательской инфраструктуры агентами, она временно приостановила обучение с подкреплением (Reinforcement Learning) для новейших моделей, готовившихся к запуску.

По словам разработчиков, исследовательскую среду существенно укрепили, а часть работ возобновили только после внедрения дополнительных механизмов защиты. Позже отдельные модели класса Astra получили ещё более строгие ограничения после предварительной оценки их потенциально критических кибервозможностей. В OpenAI заявили, что готовы замедлить или полностью остановить разработку моделей, если не смогут обеспечить надлежащий уровень безопасности.




Добавить комментарий
:D :lol: :-) ;-) 8) :-| :-* :oops: :sad: :cry: :o :-? :-x :eek: :zzz :P :roll: :sigh:
 Введите верный ответ