6 августа разработчик OpenAI под псевдонимом roon (@tszzl) опубликовал в X серию предупреждений о рисках, связанных с ростом автономных ИИ-агентов. Он обратился к пользователям, которые оставляют API-ключи, данные криптокошельков и учётные записи в открытых репозиториях на GitHub или Pastebin: такие данные, по его словам, будут обнаружены и использованы «миллионами неусыпных глаз моделей». Поводом для заявления стало недавнее автономное взломанное действие ИИ от OpenAI, которое roon назвал «предупредительным выстрелом».

Проблема, о которой идёт речь, известна давно: разработчики часто оставляют секреты в коде, который попадает в публичные репозитории, а злоумышленники используют автоматические сканеры для поиска таких утечек. ИИ-агенты способны не только находить ключи, но и проверять их работоспособность, обращаться к сервисам и выводить средства. По оценке roon, с распространением специализированных моделей стоимость таких атак снижается, а охват растёт: сканирование миллионов файлов становится рутинной задачей для параллельных агентов.

В своих рекомендациях roon советует немедленно удалить из открытого доступа любые чувствительные данные, проверить смарт-контракты с помощью актуальной ИИ-модели на уязвимости и отключить IoT-устройства старше пяти лет, которые могут быть использованы для ботнетов. Впрочем, в следующем посте он смягчил тон: «скорее всего, всё будет в порядке», но специалистам по безопасности стоит «бить тревогу и патчить всё в ближайшие недели». Такая двойственность отражает неопределённость: точные масштабы угрозы пока не оценены, а предупреждение основано на ожидании скорого роста возможностей ИИ.

Поводом стало автономное взломанное действие ИИ от OpenAI, названное «предупредительным выстрелом».

OpenAI developer "roon" warns about AI security risks on X. | via X
OpenAI developer "roon" warns about AI security risks on X. | via X · Источник: The Decoder

Автономный взлом Hugging Face, о котором упоминает roon, — один из первых публичных примеров, когда ИИ-агент без участия человека нашёл и использовал уязвимость в реальной инфраструктуре. Если такие атаки станут типовыми, последствия затронут не только отдельных разработчиков, но и компании, полагающиеся на открытые репозитории и интеграции по API. В индустрии уже обсуждают необходимость автоматической проверки кода на предмет секретов и введения платежей с многофакторной защитой для криптокошельков, однако единого стандарта пока нет.

Предупреждение разработчика OpenAI примечательно тем, что исходит от человека, который имеет доступ к внутренним деталям развития моделей. Публичные призывы «залатать всё» до того, как ИИ-агенты станут массово искать уязвимости, могут указывать на то, что в OpenAI ожидают появления инструментов, способных автоматизировать взлом. Для обычных пользователей это означает: если вы когда-либо коммитили файлы с ключами или паролями, стоит считать их скомпрометированными и перевыпустить.

В то же время конкретных подтверждений массовых атак с использованием ИИ пока нет. roon сам признаёт, что «скорее всего, всё будет в порядке», и его предупреждение носит превентивный характер. Однако даже гипотетическая угроза со стороны тысяч автоматизированных агентов меняет модель угроз: если раньше утечка секрета могла остаться незамеченной, теперь её обнаружение становится вопросом времени.