TGViewer
Machine learning Interview Machine learning Interview @machinelearning_interview · 30.3K subscribers
Post #2814 4.84K
Модель на 3B параметров внезапно показывает результаты уровня серьёзных reasoning-систем.

VibeThinker-3B набирает:

* 94.3 на AIME26
* 80.2 Pass@1 на LiveCodeBench v6
* 96.1% на unseen LeetCode contests

Основа - Qwen2.5-Coder. Сверху добавили сильный post-training:

* curriculum SFT
* multi-domain RL
* offline self-distillation
* финальный RL-based instruct stage

Её просто очень плотно дообучили на проверяемых задачах, где результат можно объективно оценить: решена задача или нет, прошёл тест или нет, ответ правильный или нет.

Фронтирные модели всё ещё нужны для

https://arxiv.org/abs/2606.16140
  • 👍 19
  • ❤ 10
  • 🤣 6
  • 🔥 5
More from @machinelearning_interview
  1. Sep 23, 2026⚡️ Агенты научились улучшать собственную обвязку RRSI оптимизирует не веса модели, а всю с…
  2. Sep 22, 2026Сразу три новых флагмана в гонке ИИ За несколько недель рынок получил GPT-6 Astra, Grok 4.…
  3. Sep 22, 2026🌟 Samsone: открытые аудиоязыковые модели для смартфонов Samsung опубликовали Samsone - се…
  4. Sep 22, 2026🚀 Claude Opus 5.5 — новый флагман Anthropic Anthropic обновила свою самую мощную модель.…
  5. Sep 22, 2026В субботу, 17 октября, Москва станет точкой притяжения для всех специалистов в области Rec…
  6. Sep 22, 2026Теренс Тао: «ИИ катком проходит по всей математике. Нам нужно замедлиться. Темп безумный».…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →