TGViewer
человек наук человек наук @chelovek_nauk · 6.27K subscribers
Post #993 5K
В последнее время в моём информационном пузыре всплывают любопытные новости: большие языковые модели помогают двигать прогресс в математике. Довольно громко прогремели новости о том, что модели от Google и OpenAI взяли золотые медали на олимпиаде по математике. Это сильно впечатляет, но всё же имеет мало отношения к науке: обычно учёные долго копают одну большую задачу, а не решают на время очень хорошо сформулированные проблемы, для которых точно существует решение. Могут ли БЯМ помочь настоящим учёным?

Похоже, что да. Вот на что я наткнулся лишь за последний месяц:

🤖 GPT 5 Pro улучшила оценку параметра в одной из задач выпуклой оптимизации. Модель прочитала текст статьи и предложила следующий шаг, который прежде не был сделан никем другим. Правда, люди очень быстро нашли ещё лучший результат, но интересен сам факт: модель предложила новое, хорошее и математически корректное решение. Это заняло всего лишь 20 минут на генерацию и ещё примерно столько же на проверку учёным правильности доказательства

🤖 Вдохновившись этим результатом, учёные из области теории вероятностей применили GPT 5 (не «про» версию, эта модель хуже) к одной из хорошо знакомым им проблем, пока не имеющим решения. Нерешённым не из-за сложности, а потому что руки не доходили. GPT делала ошибки, но в процессе общения и споров таки пришла к новым корректным результатам. Учёные заключают, что это похоже на общение с юным студентом. Но также рассуждают, что такие модели могут наполнить область большим количеством новых, но не особенно глубоких результатов, а также лишить кожаных настоящих студентов возможности набить шишки, решая проблемы самостоятельно

🤖 GPT 5 Pro нашла контрпример к одной из открытых задач в булевой алгебре

🤖 GPT 5 Pro внимательно посмотрела на скриншот с открытой задачей и сказала, что её решили уже 20 лет назад

Последнее особенно интересно: даже если модели не могут создавать новую математику, они могут быть чрезвычайно полезны в поиске связанных задач. Быть может, о вашей проблеме уже думали в Советском Союзе 60 лет назад или в Китае на прошлой неделе, вот только вам как учёному из Австралии это не известно. Или учёные из разных областей решают одну и ту же задачу, используя разную терминологию. БЯМ превосходно запоминают данные и могут найти такие связи. И кроме того, похоже способны генерировать новые результаты

И это лишь первые шаги: пару лет назад было сложно представить даже хорошие результаты на олимпиадных задачах

#математика@chelovek_nauk #программирование@chelovek_nauk
Substack DeepMind and OpenAI achieve IMO Gold. What does it all mean? What we know, what we would like to know, and what it may take years to know
  • ❤ 50
  • 🔥 12
  • 👍 4
  • 👏 1
  • 🙏 1
More from @chelovek_nauk
  1. Sep 15, 2026Нужен коллективный разум для решения следующей задачки Дано: в одной научной лаборатории к…
  2. Sep 13, 2026Ожидание: тебя заменил ИИ, обученный на всех знаниях человечества Реальность: твою работу…
  3. Sep 13, 2026А теперь к по-настоящему важным новостям. Учёные недавно загрузили в открытый доступ конне…
  4. Sep 12, 2026Коллеги, мы сейчас пытаемся заставить ллм продвигать математику. В нашем проекте CayleyPy…
  5. Sep 9, 2026Ещё раз оцените скорость прогресса: - Июль 2025 – ИИ берёт золотые медали в международной…
  6. Sep 9, 2026Случилось то, к чему всё закономерно шло в последнее время – при помощи ИИ был получен про…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →