Ты математик. Ты смотришь на задачу из Книги Коуровки, которую советские коллеги сформулировали в Новосибирске в 1965 году. Поколения лучших алгебраистов планеты её не решили. Ты открываешь систему DeepMind и вводишь условие. Система возвращает доказательство через несколько часов. Марк Лакенби, профессор Оксфорда, проверяет его вручную и подтверждает: задача 21.10 закрыта. Впервые за 60 лет.
DeepMind представил систему AI co-mathematician: мультиагентный ансамбль, в котором координирующий агент управляет специализированными потоками: поиском литературы, написанием кода, проверкой доказательств. Система идёт дальше проверки известных шагов: она генерирует новые математические стратегии, формулирует гипотезы, проверяет их через формальные верификаторы и откатывается если доказательство рассыпается. Результат на FrontierMath Tier 4, самых сложных олимпийских задачах, где ответ требует недель работы эксперта: 48% против 19% у Gemini 2.5 Pro.
Главное отличие от предыдущих систем: AI co-mathematician работает как исследователь. Строит цепочки умозаключений, фиксирует промежуточные результаты, исправляет ошибки по ходу. Внутренний бенчмарк DeepMind показал 87% на задачах уровня PhD.
Задача 21.10 из Книги Коуровки: первое независимо подтверждённое решение открытой математической проблемы, которую система нашла сама, без человека-соавтора.
Фактура:
+Задача 21.10 из Книги Коуровки (Kourovka Notebook) открыта с 1965 года: международный список нерешённых проблем теории групп, который советские математики начали вести в Новосибирске.
++ AI co-mathematician набрал 48% на FrontierMath Tier 4, категории задач, которые требуют нескольких недель работы эксперта-математика; для сравнения Gemini 2.5 Pro набирает 19%.
+++ Система устроена как ансамбль: координирующий агент управляет специализированными субагентами для поиска, кодирования и формальной верификации доказательств.
++++ 87% на внутреннем бенчмарке DeepMind уровня PhD: система превосходит уровень аспирантуры по большинству разделов чистой математики.
+++++ Профессор Оксфорда Марк Лакенби подтвердил корректность доказательства задачи 21.10 независимой ручной проверкой: стандарт публикации в рецензируемом журнале.
И что?
Математика: строгий формальный язык с верифицируемыми доказательствами. AI co-mathematician показал, что мультиагентный ансамбль с верификатором работает в самых жёстких условиях.
Следующий шаг: применение той же архитектуры к областям с формальными языками. Если ты строишь систему для юридической аргументации, финансового моделирования или инженерного расчёта, посмотри на паттерн координирующий агент + специализированные субагенты + формальный верификатор до конца Q2: именно он станет стандартом для задач, где ошибка недопустима.
🚨Нам 3.14здец:
60 лет назад математики в Новосибирске записали задачу в книгу, чтобы коллеги по всему миру могли работать над ней поколениями. Краудсорсинг человеческого интеллекта: самые острые умы планеты коллективно двигали границу знания. AI co-mathematician закрыл одну из этих задач за несколько часов. 9/10: первый задокументированный случай когда ИИ решил задачу, которую человечество не могло решить коллективными усилиями 60 лет. Граница между «ИИ как инструмент» и «ИИ как исследователь» исчезла в одной из самых строгих интеллектуальных дисциплин. Математика была последним бастионом «это точно требует человеческого разума». Этот бастион взят.
Это только один из материалов ежегодного дайджеста который выходит каждый будний день.
Именно в этом выпуске было:
🔭 Почему ИИ нашёл 118 планет в архиве NASA, который люди просматривали 4 года?
🎙️ Что изменится, когда ИИ научится слушать тебя пока говорит сам?
И ещё +5 новостей: Isomorphic Labs привлёк $2,1 млрд на разработку лекарств через ИИ, Греция вписывает ИИ в Конституцию, Baidu выпустил ERNIE 5.1 за 6% стоимости конкурентов, OpenRouter запустил умный роутинг кодинг-задач, SoftBank строит батареи без риска пожара для AI-датацентров.
Post #2332
3.14K

- 👍 5