На прошлой неделе вышел Dynamic Workflows в Claude Code. Естественно, я сразу пошел пробовать на реальном проекте.
Я собрал 22 агента в один workflow, чтобы они ревьюили наш код. Десять минут, миллион токенов, красивый отчёт. И уверенное «одобрено» на коде, в котором сидел реальный баг.
А потом запустил одного агента, который просто прочитал весь проект. Три минуты. Баг найден, задача завёрнута.
Самое обидное даже не это. Один из тех 22 агентов баг нашёл. Поднял флаг. А проверяющий агент, чья работа перепроверять чужие находки, полез искать подтверждение в изменённых файлах, не нашёл (потому что доказательство лежало в соседнем файле, который никто не трогал) и спокойно выкинул находку. Двадцать два агента, и среди них нашёлся один умный, которого заткнул один дурак с неправильной инструкцией.
Это был второй из трёх заходов, которые я сделал, когда тестировал Dynamic Workflows в Claude Code на нашем реальном проекте Family Cinema. Первый заход был на искусственном примере, третий, после того как я починил workflow. И он показал самое главное: workflow нашёл баги, которые одиночный агент пропустил. Но стоил в 15 раз больше. И при это пропустил баги, которые смог найти одиночный агент.
Написал про этот эксперимент большую статью на Хабре: три захода, шесть прогонов, четыре миллиона токенов, таблицы, схемы и конкретные выводы о том, когда многоагентные workflow имеют смысл, а когда это просто дорогой способ получить красивый отчёт.
https://habr.com/ru/articles/1041858/
P.S. По рекомендации читателя опубликовал также на Medium
Post #45
235

- 🔥 4