Что меняется, когда ИИ учится на собственном опыте
Обычно ИИ-агенту дают одну и ту же схему работы на все случаи, но новая идея в том, чтобы он учился перестраивать её по ходу дела.
Исследователи предлагают способ, при котором система запоминает, что у неё сработало, а что нет, и потом использует этот опыт в похожих задачах. Она может менять не только слова в запросе, но и сам порядок действий: что показать модели, когда дать ей доступ к инструментам, как хранить полезные выводы и как оформить ответ. Получается не жёсткая настройка на все времена, а более живая схема, которая подстраивается под конкретный случай.
В этом обзоре разбираем, как ИИ учится на собственных запусках, что именно он меняет в своей работе и почему такой подход может дать агентам больше гибкости без лишних подсказок извне.
📜 Полный обзор
Post #188
86