TGViewer
AI for Devs AI for Devs @ai_for_devs · 17.2K subscribers
Post #523 9.52K
⚡️ Anthropic сделает Auto mode режимом по умолчанию в Claude Code: люди пропустили 86,4% опасных команд

С 14 августа все новые сессии будут запускаться в Auto mode. Каждое действие агента проверяет отдельный классификатор вместо пользователя.

Причина: люди одобряют 97% команд Claude Code. В эксперименте с 1053 участниками один обычный запрос подменяли явно опасной командой. Люди заблокировали только 13,6% таких команд, Auto mode — 89%. После 50 запросов внимательность человека падала до 5%.


В отмеченных системой безопасности реальных сессиях серьёзные вредоносные действия встречались в 6,3% случаев с ручным подтверждением и в 2,4% с Auto mode.

При этом Anthropic по-прежнему не гарантирует полную безопасность и называет Auto mode исследовательской функцией. Он работает лучше ручных подтверждений, но ответственность по прежнему на разработчике.

@ai_for_devs
  • 👍 70
  • 🔥 16
  • 🤯 8
  • ❤ 6
  • ⚡ 3
  • 👏 2
More from @ai_for_devs
  1. Sep 25, 2026⚡️ OpenAI готовят ChatGPT Pro Max за $500 в месяц По утечке, упоминания тарифа нашли в код…
  2. Sep 24, 2026⚡️ Облачные сессии Claude Code стали доступны всем Anthropic вывели облачные сессии из пре…
  3. Sep 22, 2026⚡️ OpenAI выпустили GPT-6 Sol и Luna — более быстрые и дешёвые версии Astra Обе модели сто…
  4. Sep 22, 2026⚡️ Anthropic выпустили Claude Opus 5.5 По бенчмаркам новинка обошла всех основных конкурен…
  5. Sep 22, 2026⚡️ Xiaomi выпустили MiMo-V2.6 Pro и Flash В Pro больше триллиона параметров, во Flash 309…
  6. Sep 22, 2026⚡️ Z.ai опубликовали исходный код ZCode после скандала со сливом репозиториев Компания фак…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →