TGViewer
AI Attacks AI Attacks @aiattacks · 1.01K subscribers
Post #384 180
фреймворк для обеспечения безопасности взаимодействия агента и инструмента посредством проверки перед допуском и авторизации во время выполнения с учетом задач. ToolGuardian использует прогрессивную характеристику для преобразования данных в структурированные факты: описания отражают заявленные намерения, трассировка системных вызовов — грубое поведение, имитация выполнения — наблюдаемые эффекты, а анализ исходного кода — скрытое поведение. Ключевой особенностью ToolGuardian является декларативный уровень политики на основе Answer Set Programming (ASP), который позволяет явно рассуждать о возможностях, эффектах, контексте задачи и ее составе.

https://arxiv.org/abs/2607.21835
arXiv.org ToolGuardian: Declarative Security for AI Agent-Tool Interactions LLM agents increasingly rely on external tools, expanding capability while creating a new security boundary: third-party tools may appear benign at the interface level while embedding unsafe...
More from @aiattacks
  1. Sep 27, 2026Post #471
  2. Sep 26, 2026ИИ-агент OpenAI получил доступ к внутренним данным портала медицинского страхования Австра…
  3. Sep 24, 2026ИИ-агенты взломали 27 компаний и украли данные 600 тысяч банковских карт Всего за 5 дней з…
  4. Sep 21, 2026Исследователи из компании Hacktron, специализирующейся на кибербезопасности, использовали…
  5. Sep 21, 2026Как выбирать проекты на гитхабе, когда все вайбкодят. Статья, конечно, слоп. Но в основном…
  6. Sep 21, 2026PentestChain — десятиэтапную автоматизированную систему тестирования на проникновение, кот…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →