Мимо новости о том, как AI-модели решили задачу тысячелетия из списка Clay Institute, пройти было сложно. Но очень хотелось, потому что это весьма далёкая от меня математика, и по сути мне сказать здесь особо нечего, а разбирать скандалы о приоритете, кажется, особого смысла нет.
Тем не менее, когда с вопросами пришли журналисты, стало ясно, что не отвертеться. Что ж, попробую объяснить, что произошло, и высказать своё мнение о том, что всё это значит для нас и для математики в целом. План такой: сначала опишу произошедшее так, как я это понимаю, а потом отвечу на прямые вопросы (раз уж они этот пост мотивировали) и в частности выскажу своё личное мнение.
Бонусом появился ещё один раздел: пока я отвечал на вопросы и писал пост, 25 филдсовских лауреатов выпустили обращение по поводу последних результатов LLM в математике. О нём мы тоже поговорим.
Пост по ссылке, он большой, ниже только развёрнутое оглавление, а читать надо на сайте:
Уравнения Навье-Стокса: кто виноват и что делать
1. Что произошло, простыми словами.
— Задача. Вопрос тысячелетия не о том, как течёт вода, а о том, может ли гладкое течение за конечное время "сломаться", разогнаться до бесконечной скорости.
— Что доказали модели OpenAI. Утверждения C и D Феффермана: для любой вязкости существует гладкая внешняя сила, доводящая жидкость до разрыва. И отдельно, менее заметно для прессы, но, возможно, важнее: разрыв для уравнений Эйлера вообще без силы.
— Механизм решения (насколько я понял, я не специалист). Идея испанских математиков Кордобы и Мартинес-Сороа: взрывать поле слой за слоем, следя, чтобы невязка (она же сила) оставалась гладкой. Бакмастер и Альпёге с помощью Claude и Codex довели её до уравнений Эйлера, OpenAI — до Навье-Стокса.
— Статус. Оба доказательства проверены в Lean, но до премии Клэя по правилам ещё публикация, два года и признание сообщества.
— Как это делали AI-модели. Два математика — год работы; OpenAI — 10 000 агентов, 130 млрд токенов и 88 часов.
— Конфликт. Что произошло между Бакмастером и Бубеком, и почему я думаю, что это банальная мискоммуникация, а не настоящие угрозы.
— Логи сессий в Codex. Как "we cannot rule out" превратилось в признание вины, почему я в это не верю, что OpenAI сказала потом, а также параллельный случай Андреаса Тома с несофическими группами.
Явно скажу, что использовать личные чаты для таких целей было бы неэтично, даже если формально легально.
2. Ответы на вопросы журналистов.
— Насколько это резонансно? Очень, но главная сенсация — не результат, а то, как он получен: "момент Deep Blue против Каспарова".
— Кто достоин премии? Премия и заслуга — разные вещи. Если делить, то между Кордобой, Мартинес-Сороа, Бакмастером и Альпёге, причём первые двое, насколько я понимаю, важнее.
— Прорыв или промышленный шпионаж? Услышать слух и запустить агентов — не шпионаж. А использовать чужие логи — плохо, но я не верю, что это делали.
— Прорыв в науке или борьба корпораций? И то, и другое; а главное — фазовый переход в математике, к которому социальные механизмы науки не готовы.
— Полноценное достижение или "просто вычисления"? Конечно, полноценное: будь агенты людьми, они были бы претендентами на премию.
— Ждать ли решения других задач тысячелетия? Неизвестно, но прогресс не замедляется.
— Изменит ли AI жизнь всех людей? Уже изменил; остаётся только вопрос, изменит ли апокалиптически или всего лишь очень серьёзно.
3. Обращение филдсовских лауреатов.
С посылками письма не согласиться трудно, а вот вывода я не понимаю: по сути, математики пишут, что существование непонятного доказательства может как-то помешать достичь человеческого понимания?
Между посылками и заключением есть непроговорённый шаг (видимо, про мотивацию), и обсуждать стоит именно его.
4. Заключение.
Но самое интересное для меня — один график из поста OpenAI: их внутренняя модель уже сильно лучше Astra, по крайней мере в математике.
А если способности к математике становятся сверхчеловеческими, то и к AI-исследованиям.
А если к AI-исследованиям, то, очевидно, ко всему…
Такие дела.
#ai #blog #longreads #math
Post #2029
1.97K




- ❤ 28
- 👍 12
- 🤔 3
- 🔥 2
- 🤯 1