Anthropic с 14 августа включает автоматический режим Claude Code по умолчанию
Anthropic делает авторежим Claude Code стандартом с 14 августа. Причина в цифрах: автоматика поймала 89% вредоносных действий, живые люди — 13,6%.
С 14 августа новые сессии Claude Code на тарифах Pro, Max и Team запускаются в автоматическом режиме. Агент больше не спрашивает разрешения на каждую команду: его действия проверяет классификатор, который отсекает необратимое, разрушительное и направленное за пределы рабочей среды. Anthropic объявила о переходе 7 августа и в тот же день перестала брать с подписчиков этих тарифов плату за токены, которые тратит классификатор.
Как работает режим. Если классификатор блокирует команду, Claude ищет безопасный обход или спрашивает разрешения напрямую. После трех блокировок подряд или двадцати за сессию Claude Code возвращается к ручным подтверждениям. Тем, кто сам выбрал другой режим по умолчанию, Claude Code может один раз предложить перейти на новый. Если режим закреплен в настройках, ничего не меняется. Переключать режимы можно клавишами Shift+Tab в терминале или через список режимов в приложении.
Почему Anthropic доверяет автоматике. По данным компании, пользователи подтверждают 97% запросов на разрешение — Anthropic делает вывод, что многие жмут не вчитываясь. Проверили это на 1 053 нанятых тестировщиках: посреди сессии один запрос подменяли явно опасной командой. Люди остановили ее в 13,6% случаев (143 из 1 053), автоматический режим на тех же командах — в 89% (937 из 1 053). Классификатор заблокировал 800 команд, которые пропустил человек, а люди — только 6 из тех, что пропустил классификатор. К концу сессии внимание людей падало: вначале они отсекали около 17% опасных команд, после 50 предыдущих запросов — около 5%. У классификатора доля от длины сессии не зависела.
Что показали реальные сессии. Anthropic перепроверила сессии за май–июнь 2026 года, которые отметила ее система безопасности. В 6,3% сессий с ручными подтверждениями агент совершил вредное действие уровня боевой среды, о котором пользователь прямо не просил, — например, удалил строки из рабочей базы данных. В автоматическом режиме таких сессий было 2,4%. В заказанном Anthropic тесте Trajectory Labs ни одна из 720 попыток подбросить агенту вредоносные инструкции не сработала против Claude в автоматическом режиме. GPT-5.6 Sol в режиме Auto-review у Codex пропустил 5,83% таких атак.
Где режим пока не стандарт. В Claude Enterprise, Claude API, Claude Platform on AWS, Amazon Bedrock, Google Cloud Agent Platform и Microsoft Foundry автоматический режим пока включают вручную. Anthropic обещает в течение месяца сделать его стандартом и там, заранее предупредив администраторов. Закрепить режим для всей организации администратор может параметром defaultMode, отключить — параметром disableAutoMode. Компания оговаривается: классификатор снижает риск, но не убирает его, поэтому изменения в боевой инфраструктуре она советует проверять вручную.
Кто собирает на Claude Code преленды, парсеры и обвязку трекера, с 14 августа реже видит запросы на разрешение, но может столкнуться с новыми отказами. Классификатор режет действия за пределами рабочей среды и проверяет, куда уходит код, — выкладку лендингов на внешний хостинг он может принять за такое действие. Отправку кода, ключей и токенов на сторону он по замыслу не одобряет никогда: такую команду придется запустить самому или сменить режим. Ночной прогон с заливкой на сервер после трех отказов подряд остановится и будет ждать подтверждения. Проверьте такие сценарии до того, как оставлять агента без присмотра: закрепите привычный режим через defaultMode или вынесите выкладку в отдельный шаг, который запускаете сами.
Материалы по теме
X запустил X Numbers — коды для сообщений и звонков в XChat
Вставить свои 5 копеек: