Задачи Эрдеша решаются все быстрее? Топы были правы?
Постепенные закрепы того о чем ранее сказали топы включая Виснер-Гросса продолжаются. Преодолев важную часть пути типа оценок METR специализированный ИИ+ человек (в контексте статьи - опытный увлеченный любитель математики + инструменты ИИ) все лучше показывают себя за пределами бенчмарков. Задача Эрдeша 397 решена gpt 5.2 pro + Harmonic за 15 минут.
кос - AGI, эмерджентность, balanceofpower, cfAI, творческое разрушение, циклынтп
https://github.com/teorth/erdosproblems/wiki/AI-contributions-to-Erd%C5%91s-problems
От «низко висящих фруктов» к новым открытиям: Долгое время ИИ лишь находил существующие решения в архивах. В конце 2025 — начале 2026 года модели (такие как Aristotle и GPT-5.2) начали решать задачи, которые ранее не имели известных человеческих решений (например, проблемы №124, №728 и №729).
Формализация как золотой стандарт: Традиционные нейросети склонны к галлюцинациям в математике. Самый надежный метод сегодня — связка LLM + Lean (язык формальных доказательств). ИИ пишет код на Lean, а компилятор проверяет его на 100% корректность.
Гибридный подход: Лучшие результаты достигаются, когда человек задает «скелет» доказательства или неформальную идею, а ИИ заполняет технические детали и проверяет их в системе Lean.
Лидерство специализированных моделей: Общие модели (ChatGPT, Claude) хороши для поиска идей, но в «чистой математике» их обходят специализированные агенты (Aristotle), обученные поиску в пространстве доказательств.
Для научных прорывов и новых доказательств: На текущий момент лидер — Aristotle (Harmonic стартап кофаундер В.Тенев из Робингуда) благодаря его специализации на формальной верификации и высокой степени автономности.
Для совместной работы и поиска идей: Связка GPT-5.2 + Lean. Модель предлагает стратегию, а Lean подтверждает её корректность.
Для студентов и обучения: Wolfram Alpha и Photomath остаются лидерами в решении прикладных задач, но они не предназначены для доказательства сложных теорем.
Очередная задача Эрдeша решена gpt 5.2 pro + Harmonic за 15 минут:
https://x.com/neelsomani/status/2010215162146607128
Победа на выходных: доказательство, которое я представил для задачи Эрдeша № 397, было принято Теренсом Тао. Доказательство было сгенерировано с помощью GPT 5.2 Pro и формализовано с помощью Harmonic. Многие открытые задачи ждут, пока кто-нибудь предложит ChatGPT их решить.
https://x.com/neelsomani/status/2010241419693436951
Пробовал другие модели, но только GPT 5.2 Pro справился. Я провожу исследования по вопросам логики и интерпретируемости, чтобы масштабировать эти усилия, было бы здорово связаться с вами.
Сколько времени потребовалось для решения задачи 5.2? Примерно 15 минут
Решение https://www.erdosproblems.com/forum/thread/397
https://x.com/HarmonicMath/status/2009419827031801884
Математика переживает крупнейшую трансформацию за последние столетия, и мы пока находимся на начальном этапе.
https://x.com/AISafetyMemes/status/2010342603246670014
Три математические задачи, не решавшиеся десятилетиями, были решены за последние несколько дней.
Post #1853
291