TGViewer
FlowAltex FlowAltex @flowaltex · 553 subscribers
Post #1853 291
Задачи Эрдеша решаются все быстрее? Топы были правы?

Постепенные закрепы того о чем ранее сказали топы включая Виснер-Гросса продолжаются. Преодолев важную часть пути типа оценок METR специализированный ИИ+ человек (в контексте статьи - опытный увлеченный любитель математики + инструменты ИИ) все лучше показывают себя за пределами бенчмарков. Задача Эрдeша 397 решена gpt 5.2 pro + Harmonic за 15 минут.

кос - AGI, эмерджентность, balanceofpower, cfAI, творческое разрушение, циклынтп

https://github.com/teorth/erdosproblems/wiki/AI-contributions-to-Erd%C5%91s-problems

От «низко висящих фруктов» к новым открытиям: Долгое время ИИ лишь находил существующие решения в архивах. В конце 2025 — начале 2026 года модели (такие как Aristotle и GPT-5.2) начали решать задачи, которые ранее не имели известных человеческих решений (например, проблемы №124, №728 и №729).

Формализация как золотой стандарт: Традиционные нейросети склонны к галлюцинациям в математике. Самый надежный метод сегодня — связка LLM + Lean (язык формальных доказательств). ИИ пишет код на Lean, а компилятор проверяет его на 100% корректность.

Гибридный подход: Лучшие результаты достигаются, когда человек задает «скелет» доказательства или неформальную идею, а ИИ заполняет технические детали и проверяет их в системе Lean.

Лидерство специализированных моделей: Общие модели (ChatGPT, Claude) хороши для поиска идей, но в «чистой математике» их обходят специализированные агенты (Aristotle), обученные поиску в пространстве доказательств.

Для научных прорывов и новых доказательств: На текущий момент лидер — Aristotle (Harmonic стартап кофаундер В.Тенев из Робингуда) благодаря его специализации на формальной верификации и высокой степени автономности.

Для совместной работы и поиска идей: Связка GPT-5.2 + Lean. Модель предлагает стратегию, а Lean подтверждает её корректность.

Для студентов и обучения: Wolfram Alpha и Photomath остаются лидерами в решении прикладных задач, но они не предназначены для доказательства сложных теорем.


Очередная задача Эрдeша решена gpt 5.2 pro + Harmonic за 15 минут:

https://x.com/neelsomani/status/2010215162146607128

Победа на выходных: доказательство, которое я представил для задачи Эрдeша № 397, было принято Теренсом Тао. Доказательство было сгенерировано с помощью GPT 5.2 Pro и формализовано с помощью Harmonic. Многие открытые задачи ждут, пока кто-нибудь предложит ChatGPT их решить.

https://x.com/neelsomani/status/2010241419693436951

Пробовал другие модели, но только GPT 5.2 Pro справился. Я провожу исследования по вопросам логики и интерпретируемости, чтобы масштабировать эти усилия, было бы здорово связаться с вами.

Сколько времени потребовалось для решения задачи 5.2? Примерно 15 минут

Решение https://www.erdosproblems.com/forum/thread/397

https://x.com/HarmonicMath/status/2009419827031801884

Математика переживает крупнейшую трансформацию за последние столетия, и мы пока находимся на начальном этапе.

https://x.com/AISafetyMemes/status/2010342603246670014

Три математические задачи, не решавшиеся десятилетиями, были решены за последние несколько дней.
More from @flowaltex
  1. Sep 16, 2026Перельман, эмерджентность и OpenAI - вечный спор о "новых знаниях" в эпоху успешного успех…
  2. Sep 15, 2026photo post
  3. Sep 15, 2026Краткий пересказ последних новостей из жизни ИИ брадков В курилке сидят на корточках ИИбра…
  4. Sep 14, 2026Даже если случайно вышло что Апостолы были крайне разностороними людьми из всех сословий -…
  5. Sep 13, 2026А на каких анти инфлюенсеров (не в смысле просто хейтеров инфлов, а в смысле "иной" иерарх…
  6. Sep 13, 2026Вринципе Антропик советует "канонический Партизанский маркетинг"😆 Учимся у лучших!😆😆😆…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →