В математике и AI сейчас происходит невероятный поворот. (Правда, думаю до сингулярности еще несколько менее доступных проблем тысячелетия остались). Сорри за англ.цитаты, их много.
Примерно 12 месяцев два математика, Tristan Buckmaster, профессор математики в NYU, и Levent Alpöge, математик из Anthropic, в свободное время работали над задачами вокруг уравнений Эйлера/Навье-Стокса, (НС ниже) Причем это не была работа Anthropic, они занимались этим в свободное время.
Они развивали направление Diego Córdoba и Luis Martínez-Zoroa и получили очень сильный результат: «finite-time blowup for forced 3D Euler”. В процессе они сами активно использовали AI, включая Claude и Codex, а доказательства формализовывали в Lean, а Terence Tao назвал их результат выдающимся.
И вот дальше начинается самое интересное.
В Twitter появляется виральный пост, что Anthropic якобы близок к решению двух проблем тысячелетия. Слух был неправильным: Buckmaster и Alpöge не решили две задачи тысячелетия, и вообще это была не работа Anthropic. Но OpenAI сразу взяли это на вооружение. И вот это уже не обвинение Buckmaster, а буквально написано самой OpenAI.
28 августа OpenAI начала обучать новую внутреннюю модель с очень сильными результатами по математике. 1 сентября они услышали слух про две якобы решенные задачи и решили запустить новую модель на все оставшиеся задачи тысячелетия.
Сначала около 100 агентов примерно 50 часов работали над более простой задачей и получили свой результат для unforced Euler.
После этого OpenAI решила, что НС выглядит наиболее перспективной целью, сняла агентов с остальных задач и направила ресурсы туда. Причем агентам дали полученное ими решение Эйлера как инпут для дальнейшей работы.
И дальше масштаб становится просто грандиозным. Группа, которая в итоге получила результат НС, включала порядка 10 000 одновременно работающих агентов.
На НС они отправили 2,7 миллиона сообщений и сгенерировали около 130 миллиардов токенов. Вся кампания по математическим задачам съела около 300 миллиардов токенов.
Через 88 часов, 5 сентября, система получила решение. Еще 17 часов ушло на формализацию и проверку в Lean. По данным WSJ, вычисления стоили миллионы долларов.
То есть компания услышала слух, что какие-то математики приблизились к очень большому результату, и буквально через несколько дней направила в эту область много компьюта.
Но это даже не самая стремная часть истории.
По версии Buckmaster, когда Sébastien Bubeck, руководящий математическим направлением OpenAI, уже знал об их работе, у них состоялись разговоры. И Buckmaster описывает совершенно дикую ситуацию. По его словам, ему предложили два варианта.
Первый: они с Alpöge публикуют свой результат по Эйлеру, а OpenAI вечером публикует решение НС.
Второй: после публикации Buckmaster один, уже без Alpöge, пишет paper с результатом НС и указывает, что доказательство получила внутренняя модель OpenAI. Buckmaster утверждает, что Bubeck дважды настаивал на исключении Alpöge из авторства, причем отдельно говорил, что все было бы гораздо проще, если бы Levent не работал в Anthropic.
Buckmaster отказался. И сказал, что если OpenAI опубликует результат таким образом, он публично расскажет, что произошло.
По его словам, ответ был: “Why would you ruin your career?”
Они это сказали не аспиранту, которого можно напугать потерянной карьерой, а профессору математики NYU, который много лет занимается именно этой задачей.
Bubeck эту версию оспаривает. Он говорит, что обвинения ложные, что обсуждение было попыткой нормально скоординировать публикации и что он не пытался лишить Alpöge авторства его собственной работы.
Но дальше возникает еще один, на мой взгляд, гораздо более фундаментальный вопрос.
Buckmaster и Alpöge сами использовали Codex во время работы над этой неопубликованной математикой. По словам Buckmaster, они складывали туда драфты практически всего проекта.
Поэтому Buckmaster прямо спросил OpenAI: была ли их внутренняя модель обучена на этих сессиях или имела к ним доступ?
Post #186
1.94K
- ❤ 12
- 😱 10
- 🔥 3
- 👍 2