Занимаюсь разработкой AI-агентов и рассказываю про это вам.
Чатик: https://t.me/aostrikov_agents_chat
С рекламой сразу в /dev/null
Личка: @aostrikov
Post #198
1.85K
Ребят, нужна небольшая прожарка 😐
(готовьтесь, много текста)
По поводу будущей архитектуры наших продуктовых агентов. Мы немного начинали штормить в чатике, но можно обсудить отдельным постом.
Уже полгода наша команда пилит агентов для разных этапов воронки водителя: привлечение, работа с активными и возвращение после оттока. На каждом этапе свой агент с большим промптом и примерно 10-15 тулами во внутренние сервисы.
Агент регистрации знает всё про этот этап и помогает людям, которые ещё не были водителями. Агент возвращения отвечает на вопросы про заработок и рассказывает, что изменилось, пока человек не катал.
У каждого есть эвалы и слои промпта под разные страны. Качество диалогов измеряем оффлайн и следим, чтобы оно не падало. Агенты просыпаются по внешним триггерам: связка «триггер → агент → страна» определяет, кто пойдёт общаться с водителем.
Пока всё работает, но проблемки уже начинаются.
Плохое будущее
Тулы и промпты сейчас сильно пересекаются. Например, расчёт заработка нужен всем трём агентам: спросить про деньги может любой водитель. В промптах нет чёткого разделения по темам, между странами они совпадают на 40–60%, но тюним мы их независимо.
Боюсь, через несколько месяцев получим адский месс: агенты повторяют друг друга на 80%, всё переплетено, поддерживать невозможно. Плюс тулов станет на пару десятков больше, пу пу пу…
Хорошее будущее, первый вариант
Год назад я бы без раздумий сделал оркестратора и 10 сабагентов. Один отвечает за заработок, другой знает приложение, третий умеет общаться с техподдержкой. Так закрываем все важные темы для водителя.
Оркестратор разбивает запрос, отправляет части сабагентам и собирает ответ. У каждого сабагента свой промпт, тулы и эвалы под его область.
Особых минусов пока не вижу. Разве что придётся постоянно решать, куда класть новые умения и когда заводить ещё одного сабагента. Например субсидии и бонусы - это заработок или программа лояльности?
Но сейчас середина 2026-го, и кажется, есть более каноничный способ.
Хорошее будущее, второй вариант
Один агент и 30-40 скиллов. В количестве себя не ограничиваем, вложенные структуры не плодим - держим плоский список.
В промпте оставляем базу: роль, цель и формат общения. Глубокие знания и разбор конкретных ситуаций уносим в скиллы. Эвалы всех агентов объединяем.
Очень простая схема для работы как по внутренним триггерам, так и по началу диалога от лица водителя по любой рандомной теме.
На прошлой неделе решили идти этим путём. Сначала сольём двух агентов, а если эксперимент удастся - вольем и третьего.
Где будет жопа? Чего мы не видим?
Пока кажется, что расход токенов снизится: вместо цикла оркестратора и сабагентов - выбор скилла и работа по сценарию. Контексты у нас почти пустые: несколько минут общения, потом пауза на пару дней. В новый диалог подтягиваем лишь историю прошлого, факты из памяти и нужные скиллы.
Новые фичи тоже должно быть проще добавлять: легче решить, расширить текущий скилл или написать новый.
Но есть опасения. Возможно, повесимся тюнить эвалы: добавим 25-й скилл, и начнёт разваливаться то, что отлично работало с 24. Возможно, с ростом числа скиллов модели начнут галлюцинировать, даже самые мощные, к которым у нас есть доступ.
Про аналитику еще были сомнения - раньше перформанс можно было мерить по разным агентам, а теперь придется переходить на анализ по триггерам/сегментам аудитории.
Ну и главное: рассказывать, что мы пишем десяток агентов, куда более секси, чем говорить, что пишем одного 😁
Если точно понимаете, что решение ошибочное и скоро нас всех уволят, не держите в себе!
(готовьтесь, много текста)
По поводу будущей архитектуры наших продуктовых агентов. Мы немного начинали штормить в чатике, но можно обсудить отдельным постом.
Уже полгода наша команда пилит агентов для разных этапов воронки водителя: привлечение, работа с активными и возвращение после оттока. На каждом этапе свой агент с большим промптом и примерно 10-15 тулами во внутренние сервисы.
Агент регистрации знает всё про этот этап и помогает людям, которые ещё не были водителями. Агент возвращения отвечает на вопросы про заработок и рассказывает, что изменилось, пока человек не катал.
У каждого есть эвалы и слои промпта под разные страны. Качество диалогов измеряем оффлайн и следим, чтобы оно не падало. Агенты просыпаются по внешним триггерам: связка «триггер → агент → страна» определяет, кто пойдёт общаться с водителем.
Пока всё работает, но проблемки уже начинаются.
Плохое будущее
Тулы и промпты сейчас сильно пересекаются. Например, расчёт заработка нужен всем трём агентам: спросить про деньги может любой водитель. В промптах нет чёткого разделения по темам, между странами они совпадают на 40–60%, но тюним мы их независимо.
Боюсь, через несколько месяцев получим адский месс: агенты повторяют друг друга на 80%, всё переплетено, поддерживать невозможно. Плюс тулов станет на пару десятков больше, пу пу пу…
Хорошее будущее, первый вариант
Год назад я бы без раздумий сделал оркестратора и 10 сабагентов. Один отвечает за заработок, другой знает приложение, третий умеет общаться с техподдержкой. Так закрываем все важные темы для водителя.
Оркестратор разбивает запрос, отправляет части сабагентам и собирает ответ. У каждого сабагента свой промпт, тулы и эвалы под его область.
Особых минусов пока не вижу. Разве что придётся постоянно решать, куда класть новые умения и когда заводить ещё одного сабагента. Например субсидии и бонусы - это заработок или программа лояльности?
Но сейчас середина 2026-го, и кажется, есть более каноничный способ.
Хорошее будущее, второй вариант
Один агент и 30-40 скиллов. В количестве себя не ограничиваем, вложенные структуры не плодим - держим плоский список.
В промпте оставляем базу: роль, цель и формат общения. Глубокие знания и разбор конкретных ситуаций уносим в скиллы. Эвалы всех агентов объединяем.
Очень простая схема для работы как по внутренним триггерам, так и по началу диалога от лица водителя по любой рандомной теме.
На прошлой неделе решили идти этим путём. Сначала сольём двух агентов, а если эксперимент удастся - вольем и третьего.
Где будет жопа? Чего мы не видим?
Пока кажется, что расход токенов снизится: вместо цикла оркестратора и сабагентов - выбор скилла и работа по сценарию. Контексты у нас почти пустые: несколько минут общения, потом пауза на пару дней. В новый диалог подтягиваем лишь историю прошлого, факты из памяти и нужные скиллы.
Новые фичи тоже должно быть проще добавлять: легче решить, расширить текущий скилл или написать новый.
Но есть опасения. Возможно, повесимся тюнить эвалы: добавим 25-й скилл, и начнёт разваливаться то, что отлично работало с 24. Возможно, с ростом числа скиллов модели начнут галлюцинировать, даже самые мощные, к которым у нас есть доступ.
Про аналитику еще были сомнения - раньше перформанс можно было мерить по разным агентам, а теперь придется переходить на анализ по триггерам/сегментам аудитории.
Ну и главное: рассказывать, что мы пишем десяток агентов, куда более секси, чем говорить, что пишем одного 😁
Если точно понимаете, что решение ошибочное и скоро нас всех уволят, не держите в себе!
- 🔥 24
- ❤ 11
- 🤯 3
- 👾 2








