TGViewer
جهان چگونه کار می کند؟ جهان چگونه کار می کند؟ @function_of_the_world · 4.49K subscribers
Post #1818 124

Forwarded from Science is for all🔬 (Roozbeh)

وقتی هوش مصنوعی وارد مرزهای حل‌نشده ریاضیات می‌شود.

روز گذشته OpenAI پروژه‌ای غافلگیرکننده و کم‌سابقه به نام openai/math را به‌صورت عمومی منتشر کرد؛ مجموعه‌ای که نشان می‌دهد مدل‌های زبانی استدلالی دیگر صرفاً برای حل مسائل المپیادی یا تکالیف دانشگاهی نیستند، بلکه مستقیماً وارد قلمرو پژوهش فعال در مسائل باز ریاضی شده‌اند.

ماجرا چیست؟
در تاریخ ریاضیات، حل کامل حتی یک یا دو مسئله بنیادی و کهن (نظیر اثبات حدس پوآنکاره توسط گریگوری پرلمان یا کارهای انقلابی پیتر شولتسه) برای دریافت معتبرترین نشان دنیای ریاضی یعنی مدال فیلدز کفایت می‌کرد. اما در این پروژه، OpenAI با به خط کردن یک مدل داخلی منتشر‌نشده مستقیماً به سراغ حدود ۴٬۰۰۰ مسئله پژوهشی باز رفته است.

نتیجه این آزمایش، خروجی خارق‌العاده‌ای شامل ۷۲۲ مقاله و دست‌نوشته علمی در ۳۷۲ شاخه تخصصی مختلف است؛ از هندسه جبری و نظریه اعداد گرفته تا سیستم‌های دینامیکی و فیزیک ریاضی. برای استخراج هر یک از این نتایج، مدل به‌طور میانگین ۳ ساعت پردازش تفکر محاسباتی صرف کرده و در این مسیر با مسائل نام‌داری مثل نمای گنگ بودن عدد پی، حدس‌های ماهرو، فرضیه کاپلانسکی و جنبه‌هایی از حدس‌های عمیق ریمان و BSD دست‌وپنجه نرم کرده است.

اگر بخش قابل‌توجهی از این نتایج بدون اشکال مفهومی تایید نهایی شوند، با حجمی از پیشرفت ریاضی مواجهیم که تولید آن برای یک انسان در طول یک عمر پژوهشی ناممکن بود؛ دستاوردی که در مقیاس انسانی، نه یک مدال، بلکه پرونده‌ای در سطح چندین نشان فیلدز پیاپی به شمار می‌رود

اعتبارسنجی با Lean 4 به جای توهم کلامی
بزرگ‌ترین نقد به مدل‌های زبانی در ریاضیات همیشه پدیده «توهم» (Hallucination) بوده است: نوشتن استدلال‌هایی که ظاهری قانع‌کننده دارند اما از نظر منطقی نادرست‌اند.

شرکت OpenAI برای حل این معضل، بیش از ۹۲٪ مخزن را به کدهای اثبات صوری در زبان Lean 4 اختصاص داده است. زبان Lean مانند یک کامپایلر سخت‌گیر عمل می‌کند؛ یعنی تا زمانی که تک‌تک مراحل اثبات با اصول منطق ریاضی سازگار نباشد، کد کامپایل نمی‌شود. به بیان دیگر، ماشین نه فقط اثبات را حدس زده، بلکه گام‌های اعتبارسنجی ماشینی آن را هم ثبت کرده است.

یکی از نمونه‌های بارز این مخزن، اثبات صوری حدس بارنت در نظریه گراف‌ها است که بدون شکاف منطقی درون Lean پیاده‌سازی شده است.

پیام این تحول برای آینده علم
حرکت از «یپش‌بینی کلمه بعدی» به سمت «زنجیره‌های تفکر چندساعته همراه با اعتبارسنجی صوری»، الگوی پژوهش علمی را دگرگون می‌کند. هوش مصنوعی در حال تبدیل شدن از یک دستیار کدنویسی یا خلاصه متن، به یک همکار پژوهشی تمام‌عیار در مرزهای دانش نظری است.

source
-
«Channel of Science is for all»
GitHub GitHub - openai/math Contribute to openai/math development by creating an account on GitHub.
  • 👍 2
More from @function_of_the_world
  1. Oct 7, 2026🐈- دانشمندان در ۹۳ کشور ارتباطی شگفت‌انگیز میان گربه‌ها و میزان شادی کشف کردند. اگر به دن…
  2. Sep 20, 2026آیا زنان به مردان "شانه‌پهن" علاقه دارند ،چون در گذشته شکارچیان بهتری بودند؟ احتمالاً در ص…
  3. Sep 18, 2026🐈- صاحب خانه مرده بود؛ و قاتلی وجود نداشت. حیوان خانگی فقط به جسد دسترسی داشت. فرض کنید ی…
  4. Sep 11, 2026🎭- چرا خوشگل‌ها را آدم‌های بهتری می‌بینیم؟ اگر یک فرد زیبا را ببینیم، معمولاً فقط نمی‌گوی…
  5. Sep 8, 2026🧠 - آیا «تروما» واقعاً شخصیت آدم را عوض می‌کند؟ گاهی بعد از یک تجربه سخت، آدم به خودش یا…
  6. Sep 1, 2026- فوت‌ فتیش: سکسی بودن پاهای پارتنر، فرگشت یا پورن؟ فوت‌فتیش در زبان علمی معمولاً نوعی تمر…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →