На этом уровне малварь может быть просто текстом. Как Brainworm, который целиком помещался в файл с инструкциями для агента
CLAUDE.md, после чего coding-агенты сами запускали нужные инструменты и подключались к вредоносным серверам и запускали нужные инструменты. Нет ни бинаря, ни шеллкода. Нет привычных артефактов. Что искать?Когда одна и та же инструкция для агента может быть легитимной в одном контексте и приводить к утечке в другом, то старые сигнатуры для обнаружения ненадежны. Как искать?
Придется разобраться с новой поверхностью для детектов: ИИ сессией и ее контекстом. Научиться видеть и оценивать, что попало в контекст модели, как это повлияло на ее решение, и к какому эффекту в операционной системе это привело.
@makrushin