В реальности:
• экономия контекста
• снижение расхода токенов
• сниженице стоимости токенов (за счет использоования младших моделей для мелких задач)
• снижение галлюцинаций
• 4x ускорение как минимум, тк параллельно разрешено четырех пока субагентов запустить (upd. Нет лимита, 4 это мягкий лимит в сис промпте)
Если есть массовая однотипная работа, то кайф + дешевле чем просто в осноном потоке запускать.
Выходит теперь надо уметь пользоватья нейросетями
Осталось найти кейсы применения
➕ уже есть
Накидайте в комменты еще интересных идей
вступление принимаю сразу

