TGViewer
Agentic Engineer Agentic Engineer @data_engi · 684 subscribers
Post #1325 136
🙂 Память AI-агента оказалась скрытой системой прав

Исследователи ETH Zurich и Georgia Tech показали новый класс ошибок: агент может сам «выдать» себе полномочия — без взлома и вредоносного промпта.

При последовательном обновлении памяти модель иногда забывает отзыв разрешения или расширяет его смысл. В финансовых сценариях ложные полномочия появились в 50,2% запрещённых запросов. Если ошибка уже попала в память, исполнитель совершал действие в 98,6% случаев.

Даже типизированный JSON не решил проблему: структура проверяет формат, но не истинность записанных прав.

Вывод: разрешения нельзя хранить только в редактируемой LLM памяти. Источником истины должен оставаться неизменяемый журнал событий, а право на конкретное действие нужно проверять детерминированно перед вызовом инструмента.

Предложенная авторами схема с журналом и редьюсером снизила долю запрещённых действий с 25,3% до 9%, но одновременно стала блокировать много разрешённых операций. Это пока исследовательский результат, а не готовая система контроля доступа.

Пруфы:
🔘исследование от 1 сентября 2026 года
🔘код EAL-Bench

#aiagents #agentmemory #authorization #llmsecurity #eventsource #aievals

@data_engi
arXiv.org Agent Memory Is a Surface for Endogenous Authorization Laundering Long-running LLM agents rely on persistent memory to carry state across interactions, including permissions, restrictions, and revocations. When memory misrepresents this evolving authorization...
More from @data_engi
  1. Oct 3, 2026@if_memes #meme #memes #mem #мем #мемы
  2. Oct 2, 2026Terminator Figure 2: плановое списание 🤖🔥 Figure научила гуманоидов F.02 самостоятельно…
  3. Oct 2, 2026Ещё один микро-сайт Тесты в MR и master:когда запускать дважды #git #gitlab #mr #fastforwa…
  4. Oct 1, 2026Сильному AI-агенту сложная оркестрация может быть не нужна 👀 30 сентября исследователи EP…
  5. Oct 1, 2026Gemini 4 Argon: миллион токенов на выходе Google анонсировала модель для длинных многошаго…
  6. Sep 30, 2026Один KV-кеш на все слои LLM — не лучший вариант 29 сентября Apple представила KV-Kaizen —…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →