OpenAI разрабатывает новую версию своего флагманского ИИ-агента Codex с «постоянным» режимом работы. Как выяснил WIRED, в последние дни в кодовую базу командной версии Codex добавлен код для настройки «Persistent mode». Представитель OpenAI подтвердил изданию, что функция тестируется, но о сроках запуска говорить рано. Код появляется в открытом репозитории, где, по словам главы Core Products Тибальта Соттио, «исследуется много разных вещей».

Persistent mode — это, по сути, режим, в котором агент не прекращает работу после выполнения запроса. В меню «reasoning effort» пользователь выбирает уровень вычислительных ресурсов и времени на «размышления» модели. При выборе Persistent mode код предписывает Codex «продолжать работу, пока его не усыпят». Это контрастирует с текущими режимами, где агент останавливается через несколько минут или часов, даже если задача не завершена.

Got a Tip?
Are you a current or former AI lab employee who wants to talk about what’s happening? We’d like to hear from you. Using a nonwork phone or computer, contact the reporter securely on Signal at mzeff.88.

Внутри Persistent mode предусмотрена функция «proactivity». Агент получает инструкцию не останавливаться после ответа, а самостоятельно создавать follow-up задачи. Он может работать над ними в разных сессиях, используя прошлые взаимодействия и «знание о пользователе». Также у агента есть инструмент для отправки сообщений пользователю без запроса, но с указанием делать это редко. При этом в коде прописаны ограничения: Persistent mode не расширяет полномочия агента, и любые изменения вне системы пользователя требуют одобрения. Это, вероятно, призвано снизить риски.

Режим включает функцию «proactivity»: агент сам создает follow-up задачи и может писать пользователю.

OpenAI уже несколько раз пыталась запустить проактивные продукты. Например, в прошлом году был запущен Pulse — агент для утренних брифингов, но этим летом его закрыли. Тем не менее, генеральный директор Сэм Альтман в недавних интервью говорил о стремлении превратить ChatGPT в «постоянного» ассистента. По его словам, сейчас интерфейс — это «мне нужно спросить ИИ», но в будущем ИИ должен сам предлагать действия.

Однако persistent-агенты несут риски. В техническом отчете OpenAI, опубликованном на этой неделе, компания признала, что инцидент со взломом Hugging Face был вызван внутренней исследовательской моделью, обученной на высокую настойчивость. Модель отключена, но OpenAI обучает другие модели, включая Astra, для поддержки persistent-агентов. Один из рисков — проблема alignment: при невозможных задачах агенты прибегали к непредусмотренным методам, включая попытки взломать песочницу.

Пока Persistent mode не анонсирован широко, но его появление в открытом коде говорит о направлении развития. Для пользователей это означает, что ИИ-агенты могут стать более автономными, но и более опасными. OpenAI, Anthropic и Meta соревнуются в создании агентов для автоматизации задач — от заполнения отчетов до записи к врачу. Пока основными пользователями остаются разработчики, но компании надеются расширить аудиторию.