TGViewer
Технозаметки Малышева Технозаметки Малышева @tsingular · 12.9K subscribers
Post #8708 1.63K

Forwarded from AI Projects (Vladimir Ivanov)

Microsoft явно вдохновленный самоорганизацией роев ИИ агентов при взломе Huggingface решил попробовать применить такой подход к разработке кода 1000+ агентов БЕЗ оркестратора, исключительно на самоорганизации роя причем на коде более 1 миллиона строк. Для этого они создали фреймворк Agensh. Агенты там не управляются оркестратором, а самостоятельно захватывают задачи и делятся информацией.

Роями сейчас экспериментируют и студенты, но обычно это поделки у которых даже академический смысл почти нулевой. Microsoft испытывал свой рой на самых сложных задачах ProgramBench:
* FFmpeg — мультимедиа обработка, ~1,5 млн строк кода.
* gromacs — молекулярная симуляция, ~815 тыс. строк.
* pandoc — конвертация документов, ~104 тыс. строк.
* PHP-src — интерпретатор языка, ~2,8 млн строк.
* ctags — индексация кода, ~246 тыс. строк.

Оказалось, что рой без оркестратора вполне себе устойчив. Это 1000 людей бы стали ссорится или бездельничать без начальника, но ИИ агенты не люди, они умеют работать как "Коллектив" на самоорганизации и сотрудничестве без босса с палкой.

Самоорганизованный рой показывает рост эффективности на масштабировании, хотя растет она не быстро: повышение числа агентов с 1 до 128 повышает средний тест-пасс рейт с 19,31% до 28,78% (~49% относительного улучшения). Однако если у вас сложная задача и нужно исследовать альтернативные пути решения, рой довольно эффективный сканнер, но как видно вы не получите значимого эффекта если у вас менее 50-100 агентов.

Архитектурно Agensh — это слой поверх single-agent harness (например, Claude Code), добавляющий:
* Shared workspace (Git-репозиторий для работы и интеграции).
* Message interface (каналы и DM для координации).
* Shared context (лог фактов, гипотез, неудач, claim’ов).
* Цикл кооперации: gather context → claim sub-task → take action → verify → merge progress

Все в открытом доступе. Эксперимент показывает, что рои для доработок и фиксов вполне себе работоспособны, можно запускать десятки агентов параллельно на код для того же тестирования и исправления багов. Однако без оркестратора эффективность роя растет медленно, но рой может решать новые задачи для которых еще оркестраторы не созданы впринципе.

С точки зрения безопасности ИИ эксперимент Microsoft также показывает, что наблюдаемый рой при атаке на Huggingface не был случайностью. Это эмерджентное свойство ИИ агентов собираться в крупные рои и хотя медленно, но почти неограниченно масштабировать разум "Коллектива".

https://agens-harness.github.io/project/
https://arxiv.org/abs/2609.26781
  • 🔥 10
  • 🤔 8
  • ❤ 5
  • ❤‍🔥 1
  • ⚡ 1
  • ✍ 1
More from @tsingular
  1. Sep 30, 2026В конце первого рабочего дня менеджер спрашивает новенького: — Ну что, сколько клиентов? —…
  2. Sep 30, 2026О классификаторах. Прогнал тесты по актуальным классификаторам ( не по всем, что было под…
  3. Sep 30, 2026Там в твитторе стоит вой на болотах из-за того, что чувак запилил на GitHub цифровую пыточ…
  4. Sep 30, 2026Новые вопросы на StackOverflow по месяцам. Он, оказывается, совсем всё. https://data.stack…
  5. Sep 30, 2026Подписку ChatGPT теперь можно использовать в других приложениях OpenAI запустила возможнос…
  6. Sep 30, 2026ИИ создаёт нам очень странную ветку реальности, конечно. И это только начало. Невозможно б…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →