TGViewer
ML&|Sec Feed ML&|Sec Feed @mlsecfeed · 1.38K subscribers
Post #2797 42

Forwarded from Makrushin

Когнитивные артефакты для поиска ИИ-малвари

Для поиска ИИ-малвари традиционные индикаторы дополняются новым набором признаков:
* промпты и тексты для jailbreak и обмана ИИ-анализаторов
* LLM API-эндпоинты
* префиксы API-ключей
* строки с синтаксисом tool call
* упоминания компонентов инференса (Ollama, llama.cpp, vLLM и прочее)
* следы импортов ИИ-фреймворков
* строковые признаки агентской оркестрации.

На основе этого набора исследователи предложили трехуровневую модель детекта. На первом “примитивном” уровне анализируются доступные агентские примитивы (например, LLM-запросы и ответы, вызовы тулов через MCP, работа агента напрямую с операционной системой и сетью). На втором уровне проводится оценка их комбинаций и поведения агента на основе анализа входящего контекста, цепочки рассуждения, принятого решения, критичности используемого инструмента и ценности данных, к которым получен доступ. На третьем уровне цепочка действий сопоставляется с подтверждёнными признаками известных семейств ИИ-малвари.

Так что YARA-правила никуда не пропадают, а пополняются новыми индикаторами.

@makrushin
More from @mlsecfeed
  1. Oct 10, 2026Mensarium — self-hosted обвязка для AI-агента: ставите Core на сервер или ноутбук, подключ…
  2. Oct 10, 2026Progressive Disclosure для MCP/API - экономия токенов в ~99% Я вчера писал про 12 итерацию…
  3. Oct 9, 2026Research-first-builder — заставьте вашего агента по программированию обосновать архитектур…
  4. Oct 9, 2026Post #2792
  5. Oct 7, 2026🔥 Первый день Форума «Цифровые решения» — работаем Мы представили два руководства по безо…
  6. Oct 6, 2026https://huggingface.co/spaces/AlexWortega/openjev чат а го накидаем лайков жеска, я чет за…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →