Улучшать нужно не модель, а интерфейс агента
Когда LLM-агент плохо справляется с задачей, первая реакция обычно очевидна: дообучить модель, поменять промпт, взять LLM помощнее.
Но в детерминированных средах проблема часто находится не внутри модели, а между моделью и окружением — в runtime-интерфейсе, через который агент наблюдает, принимает решения и действует.
Авторы предлагают Life-Harness — обёртку над моделью, которая анализирует тренировочные траектории, находит повторяющиеся сбои и превращает их в переиспользуемые паттерны управления агентом. В результате метод дал в среднем +88,5% относительного прироста.
В обзоре разбираю, как устроен Life-Harness и почему для агентов иногда важнее проектировать обвязку вокруг модели, чем бесконечно улучшать саму модель.
📜 Полный обзор
Post #167
149