وقتی هوش مصنوعی وارد مرزهای حلنشده ریاضیات میشود.
روز گذشته OpenAI پروژهای غافلگیرکننده و کمسابقه به نام openai/math را بهصورت عمومی منتشر کرد؛ مجموعهای که نشان میدهد مدلهای زبانی استدلالی دیگر صرفاً برای حل مسائل المپیادی یا تکالیف دانشگاهی نیستند، بلکه مستقیماً وارد قلمرو پژوهش فعال در مسائل باز ریاضی شدهاند.
ماجرا چیست؟
در تاریخ ریاضیات، حل کامل حتی یک یا دو مسئله بنیادی و کهن (نظیر اثبات حدس پوآنکاره توسط گریگوری پرلمان یا کارهای انقلابی پیتر شولتسه) برای دریافت معتبرترین نشان دنیای ریاضی یعنی مدال فیلدز کفایت میکرد. اما در این پروژه، OpenAI با به خط کردن یک مدل داخلی منتشرنشده مستقیماً به سراغ حدود ۴٬۰۰۰ مسئله پژوهشی باز رفته است.
نتیجه این آزمایش، خروجی خارقالعادهای شامل ۷۲۲ مقاله و دستنوشته علمی در ۳۷۲ شاخه تخصصی مختلف است؛ از هندسه جبری و نظریه اعداد گرفته تا سیستمهای دینامیکی و فیزیک ریاضی. برای استخراج هر یک از این نتایج، مدل بهطور میانگین ۳ ساعت پردازش تفکر محاسباتی صرف کرده و در این مسیر با مسائل نامداری مثل نمای گنگ بودن عدد پی، حدسهای ماهرو، فرضیه کاپلانسکی و جنبههایی از حدسهای عمیق ریمان و BSD دستوپنجه نرم کرده است.
اگر بخش قابلتوجهی از این نتایج بدون اشکال مفهومی تایید نهایی شوند، با حجمی از پیشرفت ریاضی مواجهیم که تولید آن برای یک انسان در طول یک عمر پژوهشی ناممکن بود؛ دستاوردی که در مقیاس انسانی، نه یک مدال، بلکه پروندهای در سطح چندین نشان فیلدز پیاپی به شمار میرود
اعتبارسنجی با Lean 4 به جای توهم کلامی
بزرگترین نقد به مدلهای زبانی در ریاضیات همیشه پدیده «توهم» (Hallucination) بوده است: نوشتن استدلالهایی که ظاهری قانعکننده دارند اما از نظر منطقی نادرستاند.
شرکت OpenAI برای حل این معضل، بیش از ۹۲٪ مخزن را به کدهای اثبات صوری در زبان Lean 4 اختصاص داده است. زبان Lean مانند یک کامپایلر سختگیر عمل میکند؛ یعنی تا زمانی که تکتک مراحل اثبات با اصول منطق ریاضی سازگار نباشد، کد کامپایل نمیشود. به بیان دیگر، ماشین نه فقط اثبات را حدس زده، بلکه گامهای اعتبارسنجی ماشینی آن را هم ثبت کرده است.
یکی از نمونههای بارز این مخزن، اثبات صوری حدس بارنت در نظریه گرافها است که بدون شکاف منطقی درون Lean پیادهسازی شده است.
پیام این تحول برای آینده علم
حرکت از «یپشبینی کلمه بعدی» به سمت «زنجیرههای تفکر چندساعته همراه با اعتبارسنجی صوری»، الگوی پژوهش علمی را دگرگون میکند. هوش مصنوعی در حال تبدیل شدن از یک دستیار کدنویسی یا خلاصه متن، به یک همکار پژوهشی تمامعیار در مرزهای دانش نظری است.
source
-
«Channel of Science is for all»
Post #1818
124
Forwarded from Science is for all🔬 (Roozbeh)
- 👍 2