Большая новость в мире ИИ.
Google показала систему, которая способна к рекурсивному самоулучшению, правда, не за счёт изменения весов самой модели.
Исследователи Google и DeepMind представили Dream-RSI - систему, в которой ИИ-агент учится эффективнее исследовать задачи.
Механика выглядит так: агент анализирует свои предыдущие попытки, затем дёшево тестирует тысячи альтернативных стратегий и выбирает более эффективные подходы для следующего раунда.
На задачах по разработке алгоритмов, математической оптимизации и созданию GPU-ядер система смогла сохранять или повышать качество результатов, одновременно существенно снижая стоимость поиска.
В одном из экспериментов количество вызовов агента удалось сократить в 162 раза.
И здесь самое интересное:
улучшается не сама модель, а стратегия, с помощью которой она исследует пространство решений.
То есть ИИ становится лучше не потому, что его переобучили, а потому, что он научился эффективнее искать способы решения задач.
Исследование Dream-RSI на arXiv
Post #1400
208

- ❤ 6
- 🔥 1