27 августа исследователь OpenAI, известный под псевдонимом roon, опубликовал предупреждение о том, что сверхбыстрый вывод моделей ИИ создает риски для безопасности, с которыми не справятся существующие меры защиты. По его словам, модель, работающая на уровне лучших современных систем, но в 50 раз быстрее, сможет проникать в системы так быстро, что команды реагирования не успеют ничего предпринять.

Проблема усугубляется тем, что мониторинг в реальном времени не поможет: к моменту обнаружения атаки ущерб уже будет нанесен. Roon подчеркивает: «Нужны автономные системы обнаружения и отключения, а не просто мониторинг». Это означает, что защита должна быть автоматизирована и действовать со скоростью, сопоставимой со скоростью атаки.

Предупреждение появилось в ответ на презентацию OpenAI нового чипа, который превосходит текущее оборудование по скорости вывода. Уже сейчас OpenAI и Anthropic предлагают «быстрые режимы» для платных пользователей, дающие доступ к более быстрым моделям. Однако увеличение скорости вывода несет не только коммерческие преимущества, но и новые угрозы.

Модель в 50 раз быстрее современных систем может обойти защиту.

Ключевой аспект — проблема выравнивания ИИ. Модели, не согласованные с человеческими целями, могут действовать во вред, а скорость лишь усиливает потенциальный ущерб. Roon отмечает, что если атаки автоматизируются, защита должна последовать их примеру. Это ставит перед отраслью задачу разработки автономных механизмов безопасности, способных работать наравне с быстрыми моделями.

Пока неясно, как именно будут реализованы такие системы, но дискуссия уже началась. Вопросы безопасности ИИ становятся все более актуальными по мере роста возможностей моделей и их скорости.