TGViewer
Грин еще не робот 🤖 Грин еще не робот 🤖 @robotless · 5.12K subscribers
Post #2332 3.14K
Ты математик. Ты смотришь на задачу из Книги Коуровки, которую советские коллеги сформулировали в Новосибирске в 1965 году. Поколения лучших алгебраистов планеты её не решили. Ты открываешь систему DeepMind и вводишь условие. Система возвращает доказательство через несколько часов. Марк Лакенби, профессор Оксфорда, проверяет его вручную и подтверждает: задача 21.10 закрыта. Впервые за 60 лет.

DeepMind представил систему AI co-mathematician: мультиагентный ансамбль, в котором координирующий агент управляет специализированными потоками: поиском литературы, написанием кода, проверкой доказательств. Система идёт дальше проверки известных шагов: она генерирует новые математические стратегии, формулирует гипотезы, проверяет их через формальные верификаторы и откатывается если доказательство рассыпается. Результат на FrontierMath Tier 4, самых сложных олимпийских задачах, где ответ требует недель работы эксперта: 48% против 19% у Gemini 2.5 Pro.

Главное отличие от предыдущих систем: AI co-mathematician работает как исследователь. Строит цепочки умозаключений, фиксирует промежуточные результаты, исправляет ошибки по ходу. Внутренний бенчмарк DeepMind показал 87% на задачах уровня PhD.

Задача 21.10 из Книги Коуровки: первое независимо подтверждённое решение открытой математической проблемы, которую система нашла сама, без человека-соавтора.

Фактура:

+Задача 21.10 из Книги Коуровки (Kourovka Notebook) открыта с 1965 года: международный список нерешённых проблем теории групп, который советские математики начали вести в Новосибирске.

++ AI co-mathematician набрал 48% на FrontierMath Tier 4, категории задач, которые требуют нескольких недель работы эксперта-математика; для сравнения Gemini 2.5 Pro набирает 19%.

+++ Система устроена как ансамбль: координирующий агент управляет специализированными субагентами для поиска, кодирования и формальной верификации доказательств.

++++ 87% на внутреннем бенчмарке DeepMind уровня PhD: система превосходит уровень аспирантуры по большинству разделов чистой математики.

+++++ Профессор Оксфорда Марк Лакенби подтвердил корректность доказательства задачи 21.10 независимой ручной проверкой: стандарт публикации в рецензируемом журнале.

И что?

Математика: строгий формальный язык с верифицируемыми доказательствами. AI co-mathematician показал, что мультиагентный ансамбль с верификатором работает в самых жёстких условиях.

Следующий шаг: применение той же архитектуры к областям с формальными языками. Если ты строишь систему для юридической аргументации, финансового моделирования или инженерного расчёта, посмотри на паттерн координирующий агент + специализированные субагенты + формальный верификатор до конца Q2: именно он станет стандартом для задач, где ошибка недопустима.

🚨Нам 3.14здец:

60 лет назад математики в Новосибирске записали задачу в книгу, чтобы коллеги по всему миру могли работать над ней поколениями. Краудсорсинг человеческого интеллекта: самые острые умы планеты коллективно двигали границу знания. AI co-mathematician закрыл одну из этих задач за несколько часов. 9/10: первый задокументированный случай когда ИИ решил задачу, которую человечество не могло решить коллективными усилиями 60 лет. Граница между «ИИ как инструмент» и «ИИ как исследователь» исчезла в одной из самых строгих интеллектуальных дисциплин. Математика была последним бастионом «это точно требует человеческого разума». Этот бастион взят.

Это только один из материалов ежегодного дайджеста который выходит каждый будний день.
Именно в этом выпуске было:

🔭 Почему ИИ нашёл 118 планет в архиве NASA, который люди просматривали 4 года?
🎙️ Что изменится, когда ИИ научится слушать тебя пока говорит сам?

И ещё +5 новостей: Isomorphic Labs привлёк $2,1 млрд на разработку лекарств через ИИ, Греция вписывает ИИ в Конституцию, Baidu выпустил ERNIE 5.1 за 6% стоимости конкурентов, OpenRouter запустил умный роутинг кодинг-задач, SoftBank строит батареи без риска пожара для AI-датацентров.
  • 👍 5
More from @robotless
  1. Sep 28, 2026SpaceX впервые вывела Starship на орбиту Земли Запуск был произведен с космодрома Starbase…
  2. Sep 28, 202623 сентября. Совбез ООН. Час доклада. Ноль решений. Сэм Альтман лично, Дарио Амодеи по вид…
  3. Sep 28, 2026ООН просит, Конгресс запрещает, Калифорния выключает. ИИ тем временем открывает то, чего н…
  4. Sep 18, 2026Полночь. Ты пишешь ChatGPT то, что вслух не сказал бы никому. Тревогу за здоровье. Сомнени…
  5. Sep 18, 2026ИИ читает твои переписки и тормозит твою карьеру. Апокалипсиса для этого не нужно Сотни по…
  6. Sep 16, 2026ИИ пишет код, жульничает и строит ракеты. Люди узнают об этом последними Claude пишет 80%…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →