TGViewer
Технозаметки Малышева Технозаметки Малышева @tsingular · 12.8K subscribers
Post #8682 1.38K

Forwarded from Machinelearning

📌 Dream-RSI: агент улучшает стратегию поиска решений на основе прошлых запусков

Google опубликовала Dream-RSI - надстройку над агентами, которые ищут решения перебором: пишут код, прогоняют его через оценщик и дорабатывают лучшие варианты.

Концепт управляет стратегией исследования, решая, какие варианты развивать, сколько попыток запускать параллельно и когда остановиться. Модель, агент и оценщик при этом не меняются, самосовершенствуется только код стратегии.

🟡Механика

Каждый запуск сохраняется как дерево попыток, где узел хранит версию решения, диагностику и оценку.

Это дерево используется как симулятор - альтернативная стратегия проходит по записанным ветвям в другом порядке, с другой параллельностью и другими точками остановки, а результаты берутся из записей без новых вызовов агента.

Отдельный агент на базе языковой модели несколько раз переписывает код стратегии, каждую версию прогоняют по всем накопленным деревьям, и в следующий раунд уходит лучшая.

Оценка складывается из лучшего найденного результата, штрафа за число попыток и бонуса за параллельность. Прежняя стратегия тоже участвует в отборе, поэтому на записях прошлых запусков новая версия по оценке не уступает старой.

🟡Тесты

В задаче ускорения решателя Lasso версия на Gemini 3.1 Pro снизила среднее время работы на шести отложенных наборах данных с 3587 до 2931 мс и потратила 317 вызовов агента вместо 550.

В математических задачах результат смешанный: в задаче сумм и разностей 1,145427 против 1,143975 у SimpleTES, в упаковке кругов ничья, в неравенстве автокорреляции результат хуже собственной базы.

В третьей серии агент ускорял операции нейросетей на видеокарте из набора KernelBench. Для сети VGG16 и слоя нормализации LayerNorm Dream-RSI достиг той же скорости, что и база, за в 2,43 и 1,79 раза меньшее число попыток.

Для двух связок свёртки с делением и с выбором максимума он при том же числе попыток нашёл код быстрее базового в 2,09 и 1,44 раза.

Пока доступны только статья и страница проекта с интерактивной демонстрацией. 

Код и скрипты
 для воспроизведения Google обещает выложить позже.




🟡Страница проекта
🟡Техотчет
🟡Демо
🖥GitHub


@ai_machinelearning_big_data

#AI #ML #RSI #Agents #DreamRSI #Google
  • 🆒 4
  • 🔥 3
  • ❤ 2
  • ⚡ 1
More from @tsingular
  1. Sep 28, 2026а вот кстати вопрос, если Соннет 5.5 прыгнул на первую ступеньку к Опусу 5.5, то до какого…
  2. Sep 28, 2026В рейтинге AA Intelligence Index четыре из пяти самых умных моделей теперь от Claude. Мало…
  3. Sep 28, 2026Jev не нужен! NVIDIA с учёными из университета, который с прошлого года запрещено упоминат…
  4. Sep 28, 2026Мертвые заговорили! Полный Kling 4.0 выходит в октябре, а Kling 4.0 Flash уже бахнули для…
  5. Sep 28, 2026Anthropic выпустила Claude Sonnet 5.5 — новую модель с упором на код, агентные задачи и по…
  6. Sep 28, 2026Народ продолжает наводить красоту с Opus 5.5 встречайте голографические карты в стиле Dark…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →