Anthropic с 14 августа включает Auto Mode по умолчанию в Claude Code для пользователей тарифов Pro, Max и Team. Enterprise-клиенты по-прежнему смогут выбирать режим вручную. Изменение означает, что ИИ-инструмент для написания кода будет выполнять больше задач без участия разработчика, полагаясь на встроенный классификатор, который оценивает опасность действий и запрашивает подтверждение только в критических случаях.
Auto Mode — это режим работы ИИ-агента, при котором он не ждет одобрения на каждом шаге, а действует самостоятельно. Классификатор анализирует каждое действие на предмет риска: если операция потенциально опасна или необратима, агент останавливается и спрашивает пользователя. Такой подход призван снизить усталость от постоянных подтверждений и ускорить разработку, сохраняя контроль над критическими операциями.
| Метрика | Auto Mode | Ручной режим |
|---|---|---|
| Доля выявленных опасных команд | 89% | 13,6% |
| Pull request'ов на команду | На 25% больше | Базовый уровень |
По данным Anthropic, в контролируемом исследовании с участием 1 053 платных тестировщиков Auto Mode показал результаты безопасности не хуже, а иногда и лучше ручного режима. Люди-ревьюеры выявили лишь 13,6% опасных команд, тогда как Auto Mode — 89%. Кроме того, команды, использующие Auto Mode, генерировали примерно на 25% больше pull request'ов, что говорит о росте продуктивности.
В тестах с 1 053 платными тестировщиками Auto Mode показал безопасность не ниже ручного режима, а команды с ним генерировали на 25% больше pull request'ов.

Отдельно Anthropic отмечает, что Auto Mode добавляет защиту от prompt injection — атак, при которых вредоносный код пытается перехватить управление агентом. Независимый аудит Trajectory Labs проверил 72 сценария атак по десять раз каждый. Ни одна из 720 попыток не достигла цели против моделей Claude Fable 5, Opus 5 и Sonnet 5 в Auto Mode. Для сравнения, у OpenAI GPT-5.6 Sol в режиме Codex Auto-Review 5,83% атак прошли.
Внутренние тесты Anthropic также показали, что Auto Mode предотвратил загрузку конфиденциальных данных на публичную страницу и завершил около 2 000 процессов, которые могли нарушить работу GPU-обучения. Компания не взимает плату за токены, потребляемые классификатором, но увеличение автономной работы агента ведет к росту общего потребления токенов, что выгодно для бизнеса.
Однако Anthropic предупреждает: Auto Mode снижает риски, но не устраняет их полностью. «Для изменений с высокими ставками в продакшене мы по-прежнему рекомендуем самостоятельно проверять действия Claude», — говорится в блоге компании. Это создает парадокс: чем реже разработчик вмешивается, тем важнее его контроль, но тем сложнее ему понимать проект, созданный в основном ИИ. Кибербезопасность развивается быстрее, чем человек может уследить, поэтому баланс между автономией и надзором остается ключевым вызовом.



