Агентам предложили поставить общий шлюз перед каждым действием
Исследователи из Китая и Гонконга представили OpenAgentFlow — архитектуру, которая проверяет действия разных AI-агентов непосредственно перед выполнением.
GUI-клики, API-запросы и tool calls преобразуются в единый AgentEvent: кто действует, куда, с какими параметрами и откуда пришли данные. Затем общий Policy Enforcement Point решает, разрешать операцию или блокировать.
Это позволяет увидеть угрозу, незаметную на отдельных шагах. Например, один агент читает номер из Contacts, второй записывает его в Calendar, а третий отправляет событие по почте. Каждое действие выглядит нормальным, но вся цепочка создаёт утечку.
Политики хранятся во внешнем control plane, поэтому новое правило применяется сразу ко всем агентам без изменения моделей, промптов и инструментов.
В тесте из 300 сценариев система показала 94% точности и заблокировала 95,3% атак. P99 детерминированной проверки составил меньше 0,5 мс.
Для тебя вывод простой: безопасность агентной системы лучше ставить на границе выполнения, а не размазывать по промптам отдельных агентов.
Пока это Android-прототип. Обфускация чувствительных данных всё ещё обходит часть проверок, а похожие на секреты безобидные значения иногда блокируются.
Исследование OpenAgentFlow от 14 августа 2026 года
#aiagents #agentsecurity #runtimepolicy #controlplane #multiagent #llmsecurity
@data_engi
Post #1310
162