Теперь все носятся с RSI, речь пойдет о Google и китайском Zhipu
На этой неделе Google DeepMind и университеты показали исследование Dream-RSI о рекурсивном самоулучшении агентов.
Где ИИ-агент может опираться на историю своих прошлых попыток и улучшать стратегию поиска лучших решений, а затем повторять цикл.
А вчера китайский Zhipu описал другой короткий цикл, как GLM-5.3 через ИИ-агента помогал поднимать инференс GLM-5.3-Flash на своих ускорителях.
Эти 2 примера ещё не настоящее рекурсивное самоулучшение(RSI).
Но они показывают одно направление - модель остаётся той же, меняется обвязка.
Post #13415
1.75K