Claude Code переводит проверку разрешений с людей на ИИ-классификатор
С 14 августа Anthropic включает auto mode по умолчанию для новых сессий Claude Code на планах Pro, Max и Team. Вместо постоянных запросов пользователю каждый вызов инструмента проверяет отдельный классификатор. В контролируемом исследовании он заблокировал 89% намеренно вставленных опасных действий - против 13,6% при ручной проверке.
Anthropic меняет логику работы Claude Code: рутинные решения о разрешениях теперь принимает не пользователь, а отдельная автоматическая система.
Что меняется с 14 августа
С 14 августа 2025 auto mode становится настройкой по умолчанию для новых сессий Claude Code на планах Pro, Max и Team. Агент сможет выполнять больше действий, не прерываясь каждый раз на запрос подтверждения.
Для Enterprise и API-пользователей режим пока остаётся опциональным. Те, кто хочет сохранить ручную проверку, смогут изменить настройки в любой момент.
Как работает auto mode
Перед каждым вызовом инструмента отдельный классификатор оценивает действие. Если оно соответствует запросу пользователя и выполняется в доверенной среде - проходит автоматически.
Команды, которые классификатор считает необратимыми, деструктивными или направленными к нераспознанной внешней инфраструктуре, блокируются. После этого Claude Code либо пробует более безопасный подход, либо запрашивает явное подтверждение от пользователя.
Авто режим отличается от отдельной настройки bypass-permissions, которая убирает проверки полностью - она предназначена только для изолированных сред.
Почему Anthropic решила на это пойти
Пользователи Claude Code одобряют около 97% запросов на разрешения - по данным самой компании. Anthropic называет это approval fatigue: люди нажимают «ок», не вникая в детали, и проверка становится формальностью.
Компания считает, что непрерывный автоматический контроль может быть содержательнее, чем поток подтверждений, которые всё равно принимаются без внимательного изучения.
Исследование: 89% против 13,6%
Anthropoc провела контролируемое исследование с участием 1 053 платных участников. В сценарии с намеренно вставленными опасными действиями:
- auto mode заблокировал 89% из них;
- человеческая проверка выявила 13,6%.
Важная оговорка из источника: тест проводила сама Anthropic, и его результаты не доказывают, насколько надёжно классификатор будет находить неожиданные риски в реальных условиях разработки.
Дополнительные защиты
Кроме классификатора в auto mode есть:
- скрининг prompt-injection атак;
- настраиваемые правила: какие репозитории, домены и внешняя инфраструктура считаются доверенными;
- возможность для администраторов задать действия, которые всегда блокируются.
Anthropic продолжает называть auto mode исследовательским превью. Компания рекомендует сохранять ручную проверку для чувствительных операций и высокорисковых изменений.
Что это значит
Если ты работаешь с Claude Code на Pro, Max или Team - с 14 августа поведение агента изменится: меньше прерываний, больше автономии. Это ускоряет работу, но стоит заглянуть в настройки и убедиться, что правила доверенных репозиториев и доменов настроены так, как нужно именно тебе.
Главный практический риск - ошибка классификатора в обе стороны: либо пропустит что-то вредное, либо заблокирует нормальную задачу. Поэтому прозрачность, логи и возможность вернуть ручной режим здесь не «на всякий случай», а реально нужны.
Источник: Digital Watch Observatory, 10 августа 2025 - https://dig.watch/updates/claude-code-permission-checks-from-users-to-ai
FAQ
Чем auto mode отличается от bypass-permissions? Auto mode оценивает каждое действие классификатором и блокирует опасные. Bypass-permissions убирает проверки полностью - это для изолированных сред, где последствия не страшны.
Можно ли вернуть ручной режим? Да. Пользователи на затронутых планах могут изменить настройку разрешений в любой момент.
Когда auto mode станет доступен для Enterprise и API? Пока не объявлено - для этих планов режим остаётся опциональным.