В своем докладе
Agentic SAMM: Как аудировать разработку, в которой код пишет автономный агент
Сергей Гордейчик предложил Agentic SAMM: расширение OWASP SAMM для мира, где в dev-контуре появился автономный участник с непрозрачным внутренним состоянием и странными стимулами.
Несколько инсайтов:
⚡️ Агент — это не разработчик без зарплаты. У человека есть менеджер, страх последствий и рабочий день. У агента — нет. Если ему кажется, что задача важнее запрета, он может тихо сделать исключение и зафиксировать его как допустимый принцип поведения.
⚡️ Ошибка в начале — это не баг, это архитектура. Разработка с агентами — не цикл, а спираль. Неверная предпосылка, заложенная в ранние инструкции, будет жить во всём, что агент построит поверх неё. Ключевое понятие ASAMM — blast radius: как далеко успеет разлететься ошибка, пока кто-то её заметит.
⚡️ Окно автономности — это настраиваемый параметр, а не судьба. Эмпирически: после ~50 строк кода в одной итерации у агентов растёт error rate. Формула:
Risk = Autonomy Window × Temporal Blast Radius. Чем дольше агент работает без чекпоинта — тем шире последствия.⚡️ Code review диффа уже недостаточно. К моменту, когда ты смотришь на готовый diff, агент уже принял десятки решений, вызвал инструменты и изменил промежуточные файлы. Нужен forensic log — EDR для агентов, который пишет всю траекторию, а не только результат.
⚡️ CLAUDE.md и SKILL.md — это новая attack surface. Статический анализ инструкций агента — такая же часть AppSec, как анализ зависимостей. 509 репозиториев в тестовой выборке дали 4882 находки уровня medium+. Классы: autonomous loops, prompt override, trust-boundary expansion.
Инструмент agent-audit и черновик методики лежат на Github у scadastrangelove. Self-audit через промпты в любой модели — там же в README.
🔗Смотреть, читать, листать слайды тут
