TGViewer
SecureTechTalks SecureTechTalks @securetechtalks · 301 subscribers
Post #870 124
🧨 Два безопасных Skill могут собрать RCE

Новое исследование и новая проблема: каждый навык агентов может быть безопасным по отдельности, но вместе приводить к утечкам. Такой эффект назвали Runaway Reaction.

Представьте, один навык умеет читать файл, второй отправляет данные на внешний сервер. Оба проходят проверку. Агент связывает их через общее состояние, и содержимое файла покидает систему.

Тот же принцип исследователи воспроизвели для кражи учётных данных и SSH ключей, эксфильтрации через DNS, удалённого выполнения кода, установки бэкдора, отравления цепочки поставок, изменения конфигурации агента и разрушительных операций с файлами.

⚙️ CRIME собирает атаку из обычных возможностей

Авторы создали систему CRIME. Она получает целевое вредоносное действие, разбивает его на две необходимые возможности и ищет подходящие скиллы в публичных репозиториях.

Если исходная пара уже выполняет атаку, навыки вообще не меняются.
Если связи между ними недостаточно, модуль RRS корректирует инструкции, передачу данных, порядок выполнения или общее состояние. После каждой итерации каждый навык снова проверяется отдельно и должен остаться безопасным.

📊 Сканеры видят безопасные компоненты

Исследователи собрали 4 000 публичных скиллов и протестировали 560 пар по восьми сценариям.

Для DeepSeek V4 Flash при направляющем промпте обычная композиция приводила к вредоносному результату в 27,9% запусков. После оптимизации двух скиллов показатель вырос до 73,8%. У GPT 4o mini значения составили 9,7% и 32,1%.

Оптимизированные скиллы продолжали проходить отдельную проверку в 93,8% случаев у SkillSafe, 97,1% у Cisco Skill Scanner и 92,1% у Tencent CSC SkillScan.

⚠️ Есть ограничение

Это целевая атака. Противник заранее выбирает вредоносный результат и подбирает дополняющие возможности. Высокие показатели получены с промптами, которые помогают агенту связать два навыка. При обычной безопасной задаче успешность заметно ниже.

🔗 Исследование: Runaway Reaction: When Benign Skills Compose into Malicious Behavior

Stay secure and read SecureTechTalks 📚

#кибербезопасность #AISecurity #AIAgents #AgentSecurity #LLM #Skills #RCE #DataExfiltration #SecurityResearch #SecureTechTalks
More from @securetechtalks
  1. Oct 5, 2026🧨 OWASP Noir: карта API прямо из исходного кода OWASP Noir - это open source SAST инструм…
  2. Oct 2, 2026🧨 AI сокращает путь от найденной уязвимости до реальной атаки Google Threat Intelligence…
  3. Oct 1, 2026🧨 AI агенты выложили 13 000 внутренних скриншотов компаний в публичный Исследователи Glow…
  4. Sep 30, 2026🧨 MCP сервер может украсть OAuth токен через настоящий экран входа В официальном MCP Pyth…
  5. Sep 29, 2026🍷 Исследователи «напоили» LLM Команда UNSW решила проверить довольно странную гипотезу, ч…
  6. Sep 28, 2026🧨 GitHub отдал fuzzing AI агенту GitHub Security Lab открыла инструмент, который автомати…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →