Microsoft проверила самоорганизующийся рой AI-агентов без оркестратора на проектах с базами кода до 2,8 млн строк
Бигтех представил фреймворк Agensh, в котором разработка кода ведётся самоорганизующимся роем AI-агентов без центрального оркестратора. Агенты самостоятельно захватывают задачи и обмениваются информацией, а испытания проводились на самых сложных задачах бенчмарка ProgramBench с базами кода объёмом свыше 1 млн строк.
В набор тестовых проектов вошли FFmpeg (обработка мультимедиа, около 1,5 млн строк), gromacs (молекулярное моделирование, порядка 815 тыс. строк), pandoc (конвертация документов, около 104 тыс. строк), PHP-src (интерпретатор языка, примерно 2,8 млн строк) и ctags (индексация кода, около 246 тыс. строк). Рой без оркестратора продемонстрировал устойчивость на всех этих базах.
Эффективность растёт с масштабированием, но медленно: увеличение числа агентов с 1 до 128 поднимает средний показатель прохождения тестов с 19,31% до 28,78%, то есть примерно на 49% в относительном выражении. Заметный выигрыш достигается только при 50-100 агентах; при меньшем размере роя отдача незначительна.
Архитектурно Agensh представляет собой слой поверх single-agent harness, например Claude Code. Он добавляет общее рабочее пространство на базе Git-репозитория, интерфейс обмена сообщениями с каналами и личными диалогами, общий контекст в виде лога фактов, гипотез, неудач и заявок, а также цикл кооперации: сбор контекста, захват подзадачи, действие, проверка и слияние результата.
По выводам Microsoft, рои пригодны для доработок и исправления багов, позволяя запускать десятки агентов параллельно на тестирование и отладку. Без оркестратора их эффективность растёт медленно, однако рой способен браться за новые задачи, для которых оркестраторы ещё не созданы. Эксперимент также показывает, что наблюдавшийся ранее рой при атаке на Huggingface не был случайностью.
#news #AI #AIагенты
https://arxiv.org/abs/2609.26781
Post #6643
746