TGViewer
ML&|Sec Feed ML&|Sec Feed @mlsecfeed · 1.36K subscribers
Post #2628 141

Forwarded from Russian OSINT

🈁 Anthropic делает автоматический режим в Claude Code стандартом для повышения безопасности и продуктивности

Компания Anthropic анонсировала переход на автоматический режим (auto mode) по умолчанию в инструменте Claude Code. С 14 августа 2026 года новые сессии для подписчиков тарифных планов Pro, Max и Team будут автоматически запускаться в этом режиме. Разработчики больше не списывают плату за токены, необходимые для работы классификатора безопасности, поэтому накладные расходы полностью берут на себя создатели сервиса.

Главной причиной этого шага стало то, что пользователи привыкают и рефлекторно одобряют 97% запросов разрешений, превращая ручной контроль в формальность. В отличие от ручного подтверждения, автоматический режим пропускает каждый вызов инструмента через специализированный классификатор, который выявляет и блокирует деструктивные, необратимые или выходящие за границы рабочей среды действия.

Анализ эмпирических данных показывает явное превосходство алгоритмического фильтра над человеческим фактором. В контролируемом эксперименте, проведённом с участием 1 053 профессиональных тестировщиков, люди смогли распознать только 13,6% опасных команд, тогда как классификатор предотвратил 89% угроз. В рамках независимых испытаний компании Trajectory Labs на 72 сценариях косвенных промпт-инъекций ИИ-модели Claude Fable 5, Claude Opus 5 и Claude Sonnet 5 под управлением автоматического режима отразили 100% атак, пока ИИ-модель GPT-5.6 Sol в среде Codex допустила 5,83% успешных атак.

✋ @Russian_OSINT
More from @mlsecfeed
  1. Sep 28, 2026За последние две недели слишком много новостей вокруг Jev, я решил собрать себе автообзор…
  2. Sep 27, 2026⚡ Julia 1: decision-модель на 144 млн параметров, которая работает даже на CPU Supersonic…
  3. Sep 26, 2026📣 Теперь публично. Запускаем соревнование ИИ-агентов по расследование инцидентов ИБ BlueS…
  4. Sep 25, 2026Microsoft выпустила скилл, который проверяет ИИ-агентов на дыры и фиксит всё 👍 run-assert…
  5. Sep 24, 2026Лаборатория Transluce провела большое расследование инцидентов с агентами OpenAI Они утвер…
  6. Sep 24, 2026https://pypi.org/project/agent-security-harness/3.7.0/#2
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →