Бывают сценарии использования кодинг агентов, когда мы дублируем одни и те же паттерны: исследуй логи через субагентов, сгенерируй варианты, разбей задачу на куски и запусти по агенту на каждый и т д. Короче это и есть то же самое, что Anthropic назвали воркфлоу.
Сегодня у Тарика в X вышел большой гайд по dynamic workflows, где он объясняет, какие задачи лучше всего заходят для воркфлоу.
Как только я начал их тестировать, стал замечать, что воркфлоу у меня уже были зашиты в скиллах.
🛠 Мой скилл Вордстата уже содержал воркфлоу
Раньше, чтобы скилл обладал предсказуемым поведением, приходилось прописывать инструкции именно в нем.
Вот например такой кусок кода из моего скилла для маркетологов — поиск упущенного спроса через Вордстат.
Берёт десятки рекламных групп, каждую сегментирует отдельно (чтобы фразы из разных групп не смешивались), в конце собирает сводный отчёт.
Я это раскидывал по субагентам через скилл — а это ровно воркфлоу: разбить на группы, проанализировать, свести результат, а сегментацию пусть проверяет скептически ориентированный агент-ревьювер.
К слову именно этот кусок скилла у меня ломался при запуске через маленькие модели вроде OSS 120b. А сейчас я понимаю — это должен был быть отдельный харнес (воркфлоу). Если бы запуском руководила отдельная обвязка, то можно было бы проверять дефицит в том числе маленькими моделями.
📋 Какие задачи заходят в формат динамических воркфлоу
Тарик разложил шесть паттернов (схема). Вот они на офисных задачах:
— Classify-And-Act — тут примитивная задача классификации, просто оркестратором выступит не агент, а скрипт, который гарантирует следование.
— Fanout-And-Synthesize — разбить на независимые куски, пройтись параллельно, в конце собрать один отчет.
— Adversarial Verification — один агент делает, другой проверяет по чек-листу. Допустим вычитать отчёт или презентацию перед отправкой: факты, цифры, формулировки, агенты с отдельными ориентациями справятся лучше одного.
— Generate-And-Filter — генерим много вариантов, потом фильтр по критерию и без повторов. У меня сюда + предыдущий кейс c Adversarial Verification ложатся темы для промостраниц.
— Tournament — попарные сравнения надёжнее оценок по шкале. Тут правда точнее было бы делать сравнения батчами — так как в попарных могут копиться шумы. Писал про это на хабре и в канале.
— Loop Until Done— повторять, пока не выполнено условие. Вычитывать документ, пока не иссякнут правки; копать данные, пока отчет не прошел валидацию.
🚀 Что ожидать и как затестить
Пока формат динамических воркфлоу поддерживается только в Claude Code, запускается через
ultracode или явный запрос написать workflow. Дальше воркфлоу запускается просто как слеш-команда. Хочется верить, что механика станет стандартом в том числе и для других платформ. К слову скилл с ревью через кодекс — тоже должен стать воркфлоу.
💎 Ваш воркфлоу — это та задача, алгоритм решения которой вы объясняли агенту больше одного раза.
Расскажите в комментариях, какие воркфлоу уже тестировали у себя?
----
Поляков считает — AI, код и кейсы
