🖥 ИИ-агенты уверенно выглядят на коротких тестах, но на длинных цепочках начинают сыпаться — в эксперименте Microsoft AI модели с почти 100% успеха на 2–4 шагах к 16 шагам падали до 0–33%.
Главная проблема — ошибки накапливаются, а сокращение контекста только ухудшает ситуацию.
Post #2030
5