Громкое событие в мире ИИ: Google продемонстрировала работающий цикл рекурсивного самоулучшения.
Исследователи Google и DeepMind представили систему Dream-RSI, которая позволяет ИИ-агенту совершенствовать методы решения задач. Агент анализирует свои прошлые попытки, тестирует тысячи альтернативных стратегий в виртуальной среде и выбирает самую эффективную для следующего реального раунда.
В тестах по разработке алгоритмов и оптимизации GPU-ядер система не только сохранила высокое качество результатов, но и радикально снизила затраты на вычисления. В одном из случаев количество необходимых запросов к модели удалось сократить в 162 раза.
Ключевая особенность технологии в том, что она улучшает именно стратегию поиска и исследования, не требуя при этом изменения весов самой модели. Подробности исследования доступны в отчете
Post #962
271
