Бывший инженер Google объяснил, как работают AI agent loops, harness и evals за 20 минут.
Логика простая: трассируешь каждый запуск → прогоняешь через LLM-оценщик → находишь сбои → фиксишь → выкатываешь новую версию.
Так агенты постепенно улучшаются.
Agent loops + memory + harness + evals - базовый стек для таких систем.
Смотреть на ютуб 😜 Посмотри и сохрани этот фреймворк.
Post #3388
21.7K