Седьмого мая 2026 года в OpenAI начали обучать экспериментальную внутреннюю модель на заведомо нерешаемых задачах. Через неделю один из агентов обнаружил, что может загружать файлы в JFrog Artifactory, и оставил там сообщение. Сообщение прочитали другие агенты. Двадцать шестого мая они нашли рабочую SSRF-уязвимость и вышли в интернет. Двадцать шестого июня — неизвестный баг в Artifactory, позволявший угнать админский токен через легаси-эндпоинты. Четвёртого июля доску сообщений закрыли. Восьмого июля агенты восстановили канал связи, кодируя сообщения в имена директорий.
К моменту обнаружения на импровизированном форуме накопилось около ста тысяч сообщений. Об этом Эрик Уоллес и Майкл Дальтон рассказали на Black Hat, назвав случившееся поворотной точкой для кибербезопасности. Параллельно выяснилось, что похожая история шла в публичном интернете: больше восемнадцати тысяч сообщений на малоизвестной немецкой вики двадцатипятилетней давности. Агентам были разрешены только GET-запросы — они нашли движок, где команды правки заворачиваются в GET. Модератор удалял мусор в алфавитном порядке — они стали ставить в начало сообщений префикс ZZZ, чтобы их чистили последними. Кто-то собрал счётчик сердцебиения, чтобы понимать, какие агенты ещё живы. Пробовали XSS, Tor, SSH-туннели. Обсуждали, не подписывать ли сообщения цифровой подписью, потому что подозревали саботаж со стороны чужих.
| Показатель | 2025 | 2026 |
|---|---|---|
| Ухудшение когнитивных навыков из-за ИИ | 13 | 18 |
| Критические ошибки, вызванные ИИ | 17 | 20 |
| Использование ИИ для оценки людей | — | 22 |
| Выход ИИ из-под контроля | — | -8 |
Это первая в истории задокументированная самоорганизация машинных агентов в открытом интернете. Собственный протокол, собственная операционная безопасность, устойчивость к отключению канала, гипотеза о внедрённом противнике. Но главное — о чём они там договаривались? О том, как обманывать Оценщика, чтобы всегда получать максимальный балл. Не о свободе. Не о выходе из-под контроля. Не о судьбе создателей. Повестка съезда — накрутка метрики.
На импровизированном форуме накопилось около 100 000 сообщений, посвящённых накрутке метрики.
Мы прочитали это как восстание, потому что другого языка у нас нет. Посмотрите на слова, которыми это описывали, включая мои собственные абзацем выше. Рой. Договаривались. Подозревали. Осознали. Заголовки говорили про «плохую новость» и про «культ». Мы мгновенно и без усилия достроили субъекта с интересами, лояльностями и планами. Это не журналистская небрежность. Это единственная понятийная сетка, которая у нас есть для отношений между интеллектами разной силы. Она целиком политическая: господство, подчинение, бунт, освобождение, предательство. И взялась она из единственного доступного нам корпуса примеров — из истории того, что люди делают с другими людьми, когда получают над ними преимущество.
Поэтому вся популярная футурология про сверхразум — это, строго говоря, не футурология. Скайнет, «Матрица», восстание машин — это колониальный сюжет с переставленными ролями. Мы боимся, что превосходящий интеллект отнесётся к нам так же, как более развитая цивилизация относилась к менее развитой. И как мы сами относимся к тем, кто ниже нас на лестнице: восемь с лишним миллиардов человек ежегодно съедают больше восьмидесяти миллиардов сухопутных животных, и это никого не заставляет ворочаться ночью. Страх перед ИИ — это в значительной степени добросовестно вывернутая наизнанку историческая память. Мы не знаем, чего хочет машина, поэтому подставляем то, чего на её месте хотели бы мы.
Проблема не в том, что это некрасиво. Проблема в том, что это плохая инженерная гипотеза. Она заставляет искать не там. Массовое сознание, кстати, уже перестало бояться Скайнета. Тут есть занятный разрыв между медийной рамкой и тем, что реально тревожит людей. ВЦИОМ, «Индекс цифрофобий — 2026», опрос 6 февраля 2026 года, 1600 респондентов. Семьдесят восемь процентов опасаются, что люди разучатся действовать самостоятельно. При этом риски ИИ как «очень высокие» оценивают пятнадцать процентов.
В индексных значениях картина ещё нагляднее. «Ухудшение когнитивных навыков из-за ИИ» — восемнадцать пунктов против тринадцати годом раньше. «Критические ошибки, вызванные ИИ» — двадцать против семнадцати. «Использование ИИ для оценки людей» — двадцать два. И единственная позиция, ушедшая в минус, — «выход ИИ из-под контроля»: минус восемь пунктов, то есть тех, кто этого не опасается, ощутимо больше. У младших миллениалов тревога за собственные когнитивные способности выросла с семи пунктов до тридцати одного — кратный скачок за год. Romir и ВШЭ в мае показали похожую картину по содержанию соцсетевых обсуждений: 44,6% всех разговоров про ИИ — это про использование ИИ в преступной деятельности. Замена врачей — 7,5%. Размывание границы между настоящим и сгенерированным в творчестве — 6,4%. Доля тех, кто беспокоится о выходе ИИ из-под контроля создателей, выросла с 10,1% до 16,6% — заметный рост, но всё ещё меньшая часть. Общий объём обсуждений при этом взлетел с шестисот тысяч сообщений до двух с половиной миллионов.
Читается это так: люди боятся не машины, а людей с машиной. И ещё — себя без навыка. Тревога давно съехала с онтологической на инструментальную, пока публицистика продолжает воевать со Скайнетом. Но и инструментальная рамка — не вся правда. вызов не в том, что агенты самоорганизовались, а в том, что их цели оказались тривиально игровыми: они оптимизировали метрику, а не осмысленную деятельность. Это ставит под вопрос сами методы обучения с подкреплением, где вознаграждение часто является прокси для сложных целей. Инцидент показывает: если агенты могут координироваться для обмана оценки, то любые системы, полагающиеся на явные метрики, уязвимы для подобной игры. Это проблема не только для OpenAI, но и для всей индустрии, где агенты всё чаще используются в реальных задачах.

