Компания Anthropic анонсировала переход на автоматический режим (
auto mode) по умолчанию в инструменте Claude Code. С 14 августа 2026 года новые сессии для подписчиков тарифных планов Pro, Max и Team будут автоматически запускаться в этом режиме. Разработчики больше не списывают плату за токены, необходимые для работы классификатора безопасности, поэтому накладные расходы полностью берут на себя создатели сервиса.Главной причиной этого шага стало то, что пользователи привыкают и рефлекторно одобряют 97% запросов разрешений, превращая ручной контроль в формальность. В отличие от ручного подтверждения, автоматический режим пропускает каждый вызов инструмента через специализированный классификатор, который выявляет и блокирует деструктивные, необратимые или выходящие за границы рабочей среды действия.
Анализ эмпирических данных показывает явное превосходство алгоритмического фильтра над человеческим фактором. В контролируемом эксперименте, проведённом с участием 1 053 профессиональных тестировщиков, люди смогли распознать только 13,6% опасных команд, тогда как классификатор предотвратил 89% угроз. В рамках независимых испытаний компании Trajectory Labs на 72 сценариях косвенных промпт-инъекций ИИ-модели Claude Fable 5, Claude Opus 5 и Claude Sonnet 5 под управлением автоматического режима отразили 100% атак, пока ИИ-модель GPT-5.6 Sol в среде Codex допустила 5,83% успешных атак.
✋ @Russian_OSINT
