Anthropic объявила, что с 14 августа автономный режим (auto mode) в Claude Code станет стандартным для пользователей Pro, Max и Team. Это означает, что при программировании с помощью ИИ-ассистента Anthropic будет реже запрашивать подтверждение каждого действия, полагаясь на автоматические проверки безопасности.

Автономный режим был представлен в марте как экспериментальная функция, призванная найти баланс между скоростью и контролем. Вместо того чтобы останавливаться на каждом шаге и ждать одобрения человека, Claude Code будет продолжать работу, если действие не классифицировано как «необратимое, разрушительное или направленное за пределы вашей среды». Такой подход сокращает количество прерываний и ускоряет разработку, но требует доверия к встроенным механизмам безопасности.

Anthropic приводит данные внутреннего исследования, согласно которым автономный режим оказался безопаснее ручной проверки. В тесте с участием 1 053 платных пользователей автономный режим выявил 89% вредоносных действий, тогда как ручная проверка — лишь 13,6%. Компания объясняет такой разрыв тем, что «ручная проверка может стать привычной: пользователи одобряют 97% запросов на разрешение в Claude Code». Глава Claude Code Борис Черны заявил в X: «Мы с командой используем только автономный режим уже много месяцев. Я не могу представить возврат к запросам на разрешение!».

В тестировании с 1 053 участниками автономный режим выявил 89% опасных действий против 13,6% при ручной проверке.

Image Credits:Samuel Boivin/NurPhoto / Getty Images
Image Credits:Samuel Boivin/NurPhoto / Getty Images · Источник: TechCrunch AI

Для снижения рисков Anthropic внедрила дополнительные функции безопасности, включая фильтрацию prompt injection и настраиваемые правила жёсткого запрета, которые блокируют действия, например, предотвращающие утечку данных. Prompt injection — это атака, при которой вредоносные инструкции внедряются в контекст модели, что может привести к нежелательным действиям. Фильтрация призвана выявлять такие попытки до того, как они повлияют на выполнение.

Решение Anthropic отражает общий тренд в индустрии ИИ-ассистентов для программирования: снижение человеческого контроля в пользу автоматизации. Конкуренты, такие как GitHub Copilot и Cursor, также экспериментируют с более автономными режимами, но Anthropic делает ставку на то, что автоматическая проверка безопасности может быть эффективнее ручной, особенно когда пользователи склонны одобрять большинство запросов. Однако остаются вопросы о том, как автономный режим поведёт себя в сложных сценариях, где требуется контекстное понимание, и не приведёт ли это к росту числа инцидентов, связанных с необратимыми действиями.

Для пользователей Claude Code это изменение означает меньше прерываний в работе, но одновременно требует доверия к алгоритмам безопасности. Anthropic подчёркивает, что автономный режим не является полностью бесконтрольным: он останавливается при потенциально опасных действиях, а настраиваемые правила позволяют адаптировать поведение под конкретные задачи. Тем не менее, разработчикам стоит пересмотреть свои рабочие процессы и, возможно, настроить жёсткие запреты для критически важных операций.