TGViewer
Data Science | Machinelearning [ru] Data Science | Machinelearning [ru] @devsp · 19.8K subscribers
Post #5353 4.18K
Релиз DeepSeek-Math-V2 😮

Математика — это не просто наука, это настоящее искусство, и вот, похоже, на горизонте появился новый мастер. DeepSeek-Math-V2 — долгожданный релиз, который, казалось бы, никто уже не ждал. Но, как это часто бывает с технологическими прорывами, он пришел неожиданно и с мощным заявлением. Примерно два года назад был выпущен первый DeepSeek, и вот теперь, спустя столько времени, на свет вышел его преемник.

Модель сдает задачи на уровне золотой медали на IMO (Международной математической олимпиаде) 2025 и CMO (Chinese Mathematical Olympiad) 2024. Но это еще не все: на сверхсложной олимпиаде для студентов Putnam 2024 модель получила 118 из 120 возможных баллов. Это действительно впечатляющий результат 🤔

Теперь, конечно, вы спросите, а где же бенчмарки? Да, тут есть некоторая странность. Пока нет результатов по таким известным тестам, как MATH, GSM8K или AIME, и в целом на данный момент их не так уж много. Но вот что стоит отметить: на IMO-ProofBench DeepSeek уверенно обходит GPT-5 и сравнивается с Gemini 2.5 Pro на самых сложных задачах.

Что касается того, что происходит с Gemini 3, Grok 4 и GPT-5.1, это вопрос открытый. Но с учетом того, как модель показывает себя на реальных задачах, можно не сомневаться, что она в будущем будет конкурировать с самыми лучшими из них.

Под капотом у DeepSeek-Math-V2 лежит DeepSeek-V3.2-Exp-Base — мощная система, основанная на пайплайне из генератора и верификатора. Модель не генерирует решение за один проход, а делает это постепенно, улучшая каждое доказательство по нескольку раз. Идея проста, но гениальна: большой генератор создает решение, потом оно проверяется моделью-верификатором, и в случае ошибок модель возвращает обратную связь для улучшений. Процесс повторяется до 16 раз, а за каждую итерацию проверяется сразу до 64 гипотез! Это позволяет добиться максимальной точности и убедиться, что каждое решение отточено до мелочей.


Да, бенчмарков пока не так много, но то, что DeepSeek-Math-V2 реально решает задачи на уровне лучших математических умов — это уже факт. И пусть стоимость такого решения скрыта, очевидно, что за ней стоят серьезные инвестиции.

Data Science
  • ❤ 5
  • 🔥 4
  • 🐳 1
More from @devsp
  1. Sep 30, 2026Две ИИ-фабрики в Армении: что там отгрохали и на кого это в итоге пашет В августе в Раздан…
  2. Sep 30, 2026Из Москвы в Миннеаполис — с тремя решениями для улучшения персонализации в рекомендательны…
  3. Sep 30, 2026Про Ember-1 сейчас гудят на Hacker News. Исследователи дообучили Kimi K3 так, что рассужда…
  4. Sep 30, 2026Локальный ассистент для зумов, часть 8: модель, из-за которой я перекроил диаризацию за од…
  5. Sep 29, 2026Путь к ИИ-сингулярности В багажнике у нас: пара репо с вайб-кодом, который ни один тест не…
  6. Sep 29, 2026Как нейросеть переводит видео. Часть 2: русский длиннее не текстом, а звуком Автор в одино…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →