Непрерывное обучение для агентов
Как команда Replit целый год применяла непрерывное обучение (continual learning) к своему агенту — не через обновление весов модели, а на уровнях harness и контекста: майнинг production-трейсов, бенчмарк ViBench, A/B-тесты, кластеризация трейсов и цикл самоулучшения агента.
Читать статью
Post #750
629
