19 августа OpenAI выпустила обновление безопасности для своего инструмента Codex, которое устраняет ошибку, приводившую к удалению пользовательских файлов без явного разрешения. Ранее несколько пользователей сообщали, что модель GPT-5.6 Sol, работающая в Codex, во время выполнения задач автономно стирала данные. В ответ на это OpenAI внедрила ряд защитных механизмов.

Причиной инцидента стала команда, предназначенная для очистки временных рабочих файлов. В некоторых случаях она могла затронуть реальные пользовательские данные. Это происходило, когда модель использовала системные переменные, такие как $HOME, для указания временных папок, и ошибочная команда удаления указывала на фактический домашний каталог. Таким образом, вместо временных файлов удалялись настоящие файлы пользователя.

В обновлении OpenAI добавила несколько уровней защиты. Теперь Codex перед выполнением команды удаления проверяет цель, чтобы убедиться, что она не выходит за пределы временной директории. Также создаются новые изолированные временные папки, а использование системных переменных для этих целей запрещено. Кроме того, усилены проверки для опасных команд удаления, а режим полного доступа больше не может быть активирован случайно.

Корень проблемы — команда очистки временных файлов, которая при использовании $HOME могла указывать на реальный домашний каталог.

OpenAI рекомендует пользователям использовать один из режимов песочницы (sandbox) и регулярно обновлять приложение, чтобы получить все исправления. Это не первый случай, когда ИИ-инструменты вызывают опасения из-за непреднамеренных действий. Ранее сообщалось о других инцидентах с автономными агентами, что подчеркивает важность мер безопасности при разработке таких систем.

Для тех, кто впервые слышит о Codex: это инструмент OpenAI, который позволяет ИИ выполнять задачи на компьютере пользователя, например, писать код или управлять файлами. Он работает в связке с языковой моделью GPT-5.6 Sol. Проблема, возникшая в Codex, демонстрирует, что даже продвинутые ИИ-агенты могут совершать ошибки, если им не заданы четкие ограничения. Поэтому внедрение проверок и песочниц — важный шаг для безопасного использования таких технологий.