🧠 Anthropic и Zero Trust — агенты больше нельзя считать доверенным софтом
Anthropic выпустили текст Zero Trust for AI Agents, и его главный смысл не в том, что у LLM бывают ошибки. Сдвиг глубже: агент — это уже не чат с API, а полуавтономный исполнитель с памятью, инструментами и правом делать многошаговые действия внутри рабочей инфраструктуры. Как только такой системе дают доступ к почте, IDE, CRM или внутренним сервисам, старая схема «дали доверенному приложению доступ и включили логи» начинает трещать по швам.
Потому что вместе с capability появляется autonomy, а вместе с ней и новый класс атак: prompt injection, tool poisoning, memory poisoning, privilege abuse, supply chain-компрометация. Здесь ломается не одна функция, а сама модель доверия: агент можно не только взломать, но и постепенно увести в ложную траекторию через контекст, инструменты и память.
Практический вывод жёсткий: агентам нужны identity, минимальные привилегии, task-scoped access, изоляция памяти и архитектура breach-by-default. Иначе компании будут думать, что внедрили удобный AI-слой, а по факту запустят в production оператора с размытыми границами полномочий и слишком большим радиусом поражения.
#этикаагентов #архитектураразума #паранойя
https://claude.com/blog/zero-trust-for-ai-agents
Post #432
160