TGViewer
ML&|Sec Feed ML&|Sec Feed @mlsecfeed · 1.37K subscribers
Post #2499 167

Forwarded from Анализ данных (Data analysis)

🗞️ В статье Google DeepMind “Intelligent AI Delegation” есть хороший разбор того, как правильно отдавать задачи AI.

Речь не о том, чтобы просто написать модели «сделай это» и надеяться на удачу.

Авторы предлагают смотреть на делегирование как на цепочку решений:

стоит ли вообще отдавать задачу AI, как её объяснить, какой уровень полномочий дать и как потом проверить результат.

Сейчас многие системы держатся на жёстких правилах, которые ломаются при неожиданных сбоях. Исследователи предлагают более гибкий подход: динамический рынок, где агенты могут «торговаться» за задачи через smart contracts.

Чтобы это работало безопасно, нужны строгий мониторинг и криптографические доказательства: система должна подтверждать корректность работы, не раскрывая приватные данные.

Вместо простых рейтингов агенты смогут использовать проверяемые цифровые сертификаты, которые показывают их реальные навыки.


Делегирование должно быть живым процессом- полномочия и ответственность могут меняться по ходу работы. Если ситуация изменилась или агент ошибся, система должна не разваливаться, а уметь передать задачу дальше, откатиться или включить запасной сценарий.

Отдельно важна тема доверия.

Фреймворк оценивает сложность задачи и прошлые результаты агента. Это помогает избежать двух ошибок:

* over-delegating - когда AI дают задачу, к которой он ещё не готов
* under-delegating, когда человек делает всё сам, хотя AI мог спокойно справиться

Результат тоже нельзя принимать на веру.

Система должна проверять ответ, учитывать уверенность агента и заранее иметь план, если он ошибётся. Для реальных рабочих процессов это критично: одна слепо принятая ошибка может потянуть за собой цепочку проблем.

Авторы также разбирают сценарий, где один AI-агент передаёт задачу другому. В таком случае система должна отслеживать, кто отвечает за результат, какие полномочия переданы и где находится контроль.

arxiv.org/abs/2602.11865
More from @mlsecfeed
  1. Sep 28, 2026Nvidia представила платформу безопасности с открытым исходным кодом, призванную предотврат…
  2. Sep 28, 2026За последние две недели слишком много новостей вокруг Jev, я решил собрать себе автообзор…
  3. Sep 27, 2026⚡ Julia 1: decision-модель на 144 млн параметров, которая работает даже на CPU Supersonic…
  4. Sep 26, 2026📣 Теперь публично. Запускаем соревнование ИИ-агентов по расследование инцидентов ИБ BlueS…
  5. Sep 25, 2026Microsoft выпустила скилл, который проверяет ИИ-агентов на дыры и фиксит всё 👍 run-assert…
  6. Sep 24, 2026Лаборатория Transluce провела большое расследование инцидентов с агентами OpenAI Они утвер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →