TGViewer
Innovation & Research Innovation & Research @abulaphia · 5.16K subscribers
Post #6643 746
Microsoft проверила самоорганизующийся рой AI-агентов без оркестратора на проектах с базами кода до 2,8 млн строк

Бигтех представил фреймворк Agensh, в котором разработка кода ведётся самоорганизующимся роем AI-агентов без центрального оркестратора. Агенты самостоятельно захватывают задачи и обмениваются информацией, а испытания проводились на самых сложных задачах бенчмарка ProgramBench с базами кода объёмом свыше 1 млн строк.

В набор тестовых проектов вошли FFmpeg (обработка мультимедиа, около 1,5 млн строк), gromacs (молекулярное моделирование, порядка 815 тыс. строк), pandoc (конвертация документов, около 104 тыс. строк), PHP-src (интерпретатор языка, примерно 2,8 млн строк) и ctags (индексация кода, около 246 тыс. строк). Рой без оркестратора продемонстрировал устойчивость на всех этих базах.

Эффективность растёт с масштабированием, но медленно: увеличение числа агентов с 1 до 128 поднимает средний показатель прохождения тестов с 19,31% до 28,78%, то есть примерно на 49% в относительном выражении. Заметный выигрыш достигается только при 50-100 агентах; при меньшем размере роя отдача незначительна.

Архитектурно Agensh представляет собой слой поверх single-agent harness, например Claude Code. Он добавляет общее рабочее пространство на базе Git-репозитория, интерфейс обмена сообщениями с каналами и личными диалогами, общий контекст в виде лога фактов, гипотез, неудач и заявок, а также цикл кооперации: сбор контекста, захват подзадачи, действие, проверка и слияние результата.

По выводам Microsoft, рои пригодны для доработок и исправления багов, позволяя запускать десятки агентов параллельно на тестирование и отладку. Без оркестратора их эффективность растёт медленно, однако рой способен браться за новые задачи, для которых оркестраторы ещё не созданы. Эксперимент также показывает, что наблюдавшийся ранее рой при атаке на Huggingface не был случайностью.

#news #AI #AIагенты

https://arxiv.org/abs/2609.26781
agens-harness.github.io Agensh: Scaling Organizational Intelligence to 1,024 Agents A self-organized multi-agent harness without a central orchestrator, scaled to 1,024 cooperating agents.
More from @abulaphia
  1. Oct 9, 2026Когда доказательства обгоняют понимание 6 октября OpenAI опубликовала более 700 математиче…
  2. Oct 9, 2026Терминатору понадобилась лицензия В Сан-Франциско стартап REK устроил бои человека с гуман…
  3. Oct 9, 2026Star Catcher готовит первый в мире тест беспроводной передачи энергии между двумя свободно…
  4. Oct 8, 2026В репортаже The Economist начальник батальона Nemesis Алексей Гончарук высказывает интерес…
  5. Oct 8, 2026Apple готовит домашнюю AI-камеру J450: без записи видео, с распознаванием лиц и текстовыми…
  6. Oct 7, 2026Робота ударили мухобойкой. Он снова взлетел. В «Оружии XXI века» Станислав Лем описал «эво…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →