TGViewer
RnD ML Team RnD ML Team @rndml_team · 4.17K subscribers
Post #459 2.41K
🧩 STARM: Открытый фреймворк для рекурсивных reasoning-моделей от AI Forever

Наша команда R&D NLP представила STARM — open-source фреймворк для обучения рекурсивных reasoning-моделей.

📌 TLDR
STARM — фреймворк для рекурсивных моделей, способных к многошаговым рассуждениям. Мы нашли оптимальную архитектуру, стабилизировали обучение и получили SOTA на алгоритмических бенчмарках. На выходе единая модель для всех задач + поддержка test-time scaling.

🧠 Зачем?
Рекурсивные модели, когда один блок применяется многократно, теоретически эффективнее трансформеров для алгоритмических задач, но на практике страдали от нестабильности и плохой воспроизводимости. STARM пытается решить эти проблемы.

⚙️ Что внутри
— Системный поиск лучшей конфигурации рекурсивного блока (нормализация, residual, gating)
— Стабилизация обучения: gradient clipping, adaptive LR, curriculum по глубине
— Единая архитектура для сортировки, графов, арифметики и символических задач
— Test-time scaling: можно увеличить число шагов рекурсии при инференсе без дообучения

📊 Результаты
— 94.2% accuracy на алгоритмических задачах — новый SOTA
— Спец. трансформеры: 89.1%, open-source LLM: 76.3%
— При увеличении шагов рекурсии 4 → 32 точность растёт на +7.4%
— Сходимость в 2 раза быстрее, дисперсия результатов ↓40%

🖥 GitHub
📄 Хабр

💚Авторы работы
Инесса Фёдорова @notn3ss
Юлиана Шахвалиева @YulianaShakhvalievaa

Будем признательны за лайки на Хабре! 🙏
#reasoning #opensource
GitHub GitHub - ai-forever/STARM: Recursive architecture for algorithmic tasks that repeatedly applies a single computational block. STARM… Recursive architecture for algorithmic tasks that repeatedly applies a single computational block. STARM outperforms models with larger parameter counts on Arithmetic, Conway's Game of Life...
  • ❤ 12
  • 👍 12
  • 🔥 9
  • 👏 1
More from @rndml_team
  1. Oct 2, 2026⚡️ FRIDA-Decisions: роутинг, гардрейлы и интенты по русскому тексту за ≈30 мс На хайпе наш…
  2. Oct 2, 2026📌 10 докладов AI RnD Day в одном посте 🎙 Где это видано, где это слыхано: управляемые Fu…
  3. Oct 1, 2026🧠 Долгосрочная омнимодальная память Нужный факт может остаться в старом диалоге, быть на…
  4. Sep 30, 2026🔎 Агент SMITH для поиска: маленькая модель ищет, большая — отвечает На AI RnD Day Артём С…
  5. Sep 29, 2026🔎 Модель говорит по-русски. А понимает? Пять новых линеек бенчмарков На AI RnD Day наша у…
  6. Sep 28, 2026🎬 Как дать VLM понять длинное видео и не потерять смысл 5 минут видео при одном кадре в с…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →