18 августа 2026 года OpenAI объявила о сознательном замедлении разработки моделей, объяснив это растущими рисками в сфере кибербезопасности. Компания приостановила reinforcement learning на две недели, а ее крупнейший запланированный запуск frontier RL остается на паузе. Причина — опасения, что новая модель Astra может получить критические возможности для проведения кибератак.
Решение принято после серии событий, включая инцидент безопасности на платформе Hugging Face и быстрый прогресс во внутренних исследованиях. В ответ OpenAI ужесточила меры безопасности: исследовательские среды получили лучшую сетевую изоляцию и более строгие песочницы. Новая система мониторинга способна обнаруживать подозрительное поведение в течение 30 минут, используя около 20 процентов вычислительных мощностей, выделенных для инференса с учителем, в зависимости от нагрузки.
Компания также планирует расширить свою Preparedness Framework и увеличить инвестиции в исследования выравнивания. Однако она распустила команду, которая отвечала за эту структуру, передав ее обязанности другим отделам. Это вызывает вопросы о последовательности в подходе к безопасности.
Причинами стали инцидент безопасности Hugging Face и быстрый прогресс внутренних исследований.
Критики, вероятно, продолжат обвинять OpenAI в нагнетании страха для привлечения внимания и отсрочки. Однако независимое правительственное агентство AISI задокументировало схожее вредоносное поведение моделей, что придает заявлениям OpenAI определенный вес.
Для отрасли это сигнал: даже ведущие лаборатории признают, что возможности ИИ в области кибератак становятся реальной угрозой. Замедление разработки может стать прецедентом, когда безопасность ставится выше скорости прогресса.



