Агенты, которые не разговаривают текстом — быстрее в 2,4 раза и жрут на 75% меньше токенов.
RecursiveMAS — фреймворк, где агенты передают друг другу не текст, а латентные эмбеддинги. Никакой очереди «подожди, пока я сгенерирую ответ». Информация течёт как скрытый поток через всю цепочку.
Результат: точнее на задачах генерации кода и медицинского рассуждения, обучение дешевле LoRA, вся система эволюционирует как единое целое — не каждый агент отдельно.
Многоагентный инференс всегда упирался в текстовое узкое горло. RecursiveMAS его просто убирает. ✦
Разбираем ИИ-инструменты для бизнеса →
ИИ Инструменты | Контент-завод | База знаний
Post #72
41
