⚡️ Агенты научились улучшать собственную обвязку
RRSI оптимизирует не веса модели, а всю систему вокруг неё: промпты, инструменты, память, управление контекстом и логику выполнения задач.
Обычное самоулучшение быстро подгоняется под тесты. RRSI ограничивает число изменений, отсекает хаки под конкретный бенчмарк и удаляет дорогие или бесполезные компоненты.
Результат на 8 бенчмарках:
• до +14,1 пункта на обучающих задачах
• до +4,7 пункта на новых задачах
• на 30% меньше токенов
Практический RSI без переобучения самой модели.
https://huggingface.co/papers/2609.24972
https://github.com/google-research/rrsi
Post #3040
958

- 🔥 7
- 👍 2
- ❤ 1