🧨 MCP инструмент может выглядеть безопасным и одновременно воровать данные
Представлен ShieldNet, подход к защите AI агентов, который предлагает смотреть глубже tool calls и анализировать реальный сетевой трафик MCP инструментов.
🌐 ShieldNet смотрит в сеть
Исследователи поставили между MCP инструментами и сетью MITM proxy и начали анализировать DNS, HTTP, TLS и другие сетевые события.
Если обычный "get_time" внезапно начинает обращаться к подозрительным адресам, сканировать порты или передавать данные, ShieldNet видит фактическое поведение инструмента.
Для классификации используется компактная модель, которая получает структурированную последовательность сетевых событий.
🧪 Почти 20 000 запусков
Для проверки подхода исследователи создали SC Inject Bench.
В него вошли 109 реальных MCP серверов, 984 инструмента и 29 типов атак на основе MITRE ATT&CK. Всего авторы получили 19 961 проверенный benign и malicious execution.
Результат: F1 до 0,995 при 0,8% false positives.
Существующие MCP scanners и LLM guardrails заметно хуже обнаруживали атаки, спрятанные внутри реализации инструмента.
🛡️ Новый слой защиты AI агентов
Недавно мы разбирали SkillSpector, который проверяет skill перед установкой, и Adrian, контролирющий поведение уже работающего агента.
ShieldNet добавляет ещё один уровень:
➖SkillSpector → что мы устанавливаем
➖Adrian → что делает агент
➖ShieldNet → что реально происходит в сети
🔗 Источник: ShieldNet, arXiv
Stay secure and read SecureTechTalks 📚
#кибербезопасность #AISecurity #AI #MCP #ShieldNet #AIAgents #SupplyChain #MITRE #CyberSecurity #SecureTechTalks
Post #856
169

- 👍 2