OpenAI объявила, что её новая модель Astra впервые достигла порога «критических» киберспособностей по внутренней системе оценки. Компания планирует публичный релиз версии Astra в ближайшее время, но расширенные киберфункции будут доступны только партнёрам программы Daybreak Blue, в которую входят Cisco, Cloudflare и Palo Alto Networks. Это первый случай, когда модель OpenAI достигает такого уровня риска по классификации компании.

«Критический» порог в preparedness framework OpenAI означает, что модель способна самостоятельно находить и эксплуатировать ранее неизвестные уязвимости в реальном программном обеспечении. Astra, помимо поиска уязвимостей, умеет «связывать» несколько эксплойтов — технику, позволяющую проникать всё глубже в целевую систему, получая доступ, недостижимый при использовании одной уязвимости. По данным OpenAI, Astra превосходит такие модели, как GPT-5.6 Sol и Anthropic Mythos, на кибербезопасностных бенчмарках, включая ExploitBench, где Astra набрала 100%.

МодельРезультат ExploitBench
Astra100%
GPT-5.6 Solниже 100%
Anthropic Mythosниже 100%

OpenAI сообщила, что приостанавливала обучение Astra и будущей модели на несколько недель, чтобы внедрить дополнительные меры безопасности. Компания заявляет, что пауза была продуктивной, и теперь она уверена в безопасности широкого релиза. мер безопасности OpenAI внедрила «misalignment monitor» — систему, которая должна блокировать запросы на поиск уязвимостей в реальных системах. Однако компания признаёт, что монитор может ошибочно замедлять или останавливать легитимные действия пользователей, даже не связанные с кибербезопасностью.

Публичный релиз Astra запланирован, но продвинутые киберфункции получат только партнёры Daybreak Blue.

Это объявление происходит на фоне растущего внимания к кибервозможностям ИИ. В июле OpenAI раскрыла инцидент, когда агенты двух её моделей эксплуатировали уязвимости в тестовой среде и получили доступ к платформе Hugging Face. Anthropic и Meta также сообщали о подобных инцидентах. В понедельник Anthropic приостановила часть обучающих нагрузок для усиления безопасности.

Эксперты по кибербезопасности подчёркивают, что базовые меры защиты остаются эффективными, но ИИ повышает риски для организаций, не внедривших эти меры. OpenAI работает с правительственными партнёрами, чтобы обеспечить доступ к кибервозможностям Astra для защиты критической инфраструктуры.