🤖 Продовых AI-агентов редко отпускают дальше десяти шагов
IBM изучила 20 реальных внедрений и опросила 306 разработчиков из 26 отраслей. Выяснилось, что 68% агентов выполняют не более десяти шагов до вмешательства человека.
При этом 70% команд используют готовые модели с промптами вместо дообучения, а 74% всё ещё оценивают качество в основном вручную. Главная проблема — не способности модели, а стабильность её поведения.
Если ты строишь агента для production, полезнее сначала ограничить цикл, продумать передачу человеку и автоматизировать проверки — а не усложнять оркестрацию.
Исследование IBM Research для ICML 2026
#ai #aiagents #production #llm #reliability #evaluation
@data_engi
Post #1214
137