TGViewer
Айра Монгуш — AI, tech & math Айра Монгуш — AI, tech & math @airamongush · 984 subscribers
Post #186 1.94K
В математике и AI сейчас происходит невероятный поворот. (Правда, думаю до сингулярности еще несколько менее доступных проблем тысячелетия остались). Сорри за англ.цитаты, их много.

Примерно 12 месяцев два математика, Tristan Buckmaster, профессор математики в NYU, и Levent Alpöge, математик из Anthropic, в свободное время работали над задачами вокруг уравнений Эйлера/Навье-Стокса, (НС ниже) Причем это не была работа Anthropic, они занимались этим в свободное время.

Они развивали направление Diego Córdoba и Luis Martínez-Zoroa и получили очень сильный результат: «finite-time blowup for forced 3D Euler”. В процессе они сами активно использовали AI, включая Claude и Codex, а доказательства формализовывали в Lean, а Terence Tao назвал их результат выдающимся.

И вот дальше начинается самое интересное.

В Twitter появляется виральный пост, что Anthropic якобы близок к решению двух проблем тысячелетия. Слух был неправильным: Buckmaster и Alpöge не решили две задачи тысячелетия, и вообще это была не работа Anthropic. Но OpenAI сразу взяли это на вооружение. И вот это уже не обвинение Buckmaster, а буквально написано самой OpenAI.

28 августа OpenAI начала обучать новую внутреннюю модель с очень сильными результатами по математике. 1 сентября они услышали слух про две якобы решенные задачи и решили запустить новую модель на все оставшиеся задачи тысячелетия.

Сначала около 100 агентов примерно 50 часов работали над более простой задачей и получили свой результат для unforced Euler.

После этого OpenAI решила, что НС выглядит наиболее перспективной целью, сняла агентов с остальных задач и направила ресурсы туда. Причем агентам дали полученное ими решение Эйлера как инпут для дальнейшей работы.

И дальше масштаб становится просто грандиозным. Группа, которая в итоге получила результат НС, включала порядка 10 000 одновременно работающих агентов.
На НС они отправили 2,7 миллиона сообщений и сгенерировали около 130 миллиардов токенов. Вся кампания по математическим задачам съела около 300 миллиардов токенов.

Через 88 часов, 5 сентября, система получила решение. Еще 17 часов ушло на формализацию и проверку в Lean. По данным WSJ, вычисления стоили миллионы долларов.

То есть компания услышала слух, что какие-то математики приблизились к очень большому результату, и буквально через несколько дней направила в эту область много компьюта.

Но это даже не самая стремная часть истории.

По версии Buckmaster, когда Sébastien Bubeck, руководящий математическим направлением OpenAI, уже знал об их работе, у них состоялись разговоры. И Buckmaster описывает совершенно дикую ситуацию. По его словам, ему предложили два варианта.

Первый: они с Alpöge публикуют свой результат по Эйлеру, а OpenAI вечером публикует решение НС.

Второй: после публикации Buckmaster один, уже без Alpöge, пишет paper с результатом НС и указывает, что доказательство получила внутренняя модель OpenAI. Buckmaster утверждает, что Bubeck дважды настаивал на исключении Alpöge из авторства, причем отдельно говорил, что все было бы гораздо проще, если бы Levent не работал в Anthropic.

Buckmaster отказался. И сказал, что если OpenAI опубликует результат таким образом, он публично расскажет, что произошло.

По его словам, ответ был: “Why would you ruin your career?”

Они это сказали не аспиранту, которого можно напугать потерянной карьерой, а профессору математики NYU, который много лет занимается именно этой задачей.

Bubeck эту версию оспаривает. Он говорит, что обвинения ложные, что обсуждение было попыткой нормально скоординировать публикации и что он не пытался лишить Alpöge авторства его собственной работы.

Но дальше возникает еще один, на мой взгляд, гораздо более фундаментальный вопрос.

Buckmaster и Alpöge сами использовали Codex во время работы над этой неопубликованной математикой. По словам Buckmaster, они складывали туда драфты практически всего проекта.

Поэтому Buckmaster прямо спросил OpenAI: была ли их внутренняя модель обучена на этих сессиях или имела к ним доступ?
  • ❤ 12
  • 😱 10
  • 🔥 3
  • 👍 2
More from @airamongush
  1. Sep 17, 2026Атмосфера на кампусах сегодня: phd студенты бегают по коридорам и кричат, что гипотеза Ход…
  2. Sep 16, 2026photo post
  3. Sep 16, 2026Тувинская и якутская клавиатуры добавлены в iOS 27 Для новичков в канале — я основательниц…
  4. Sep 14, 20266. AGI и RSI это разные вещи, и приравнивать их значит путать цель со средством. RSI это м…
  5. Sep 14, 2026В июле 2025 года METR провела рандомизированный контролируемый эксперимент: 16 опытных раз…
  6. Sep 14, 2026b) Оценки фронтиер-лабораторий 2025 и 2026 годов огромны. OpenAI 2 октября 2025 года завер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →