شرکت OpenAI از دستیابی به یک پیشرفت چشمگیر در توانایی استدلال مدلهای زبانی خودش در حل مسائل پیچیده ریاضی خبر داده؛ موفقیتی که میتونه یکی از جدیترین گامها در مسیر رسیدن به هوش مصنوعی عمومی (AGI) تلقی بشه. مدل آزمایشی OpenAI موفق شده در رقابت رسمی المپیاد جهانی ریاضی ۲۰۲۵، پنج مسئله از شش مسئله اصلی رو حل کنه و با کسب ۳۵ امتیاز از مجموع ۴۲، به سطح مدال طلا برسه. این اولینباریه که یک مدل هوش مصنوعی به چنین سطحی در یکی از دشوارترین آزمونهای ریاضی جهان میرسه. تمام پاسخها به زبان طبیعی نوشته شدن، هیچ ابزاری استفاده نشده و داوری هم بهصورت ناشناس توسط مدالآوران سابق IMO انجام شده.
نکته مهم اینجاست که برخلاف مدلهایی مثل AlphaGeometry که بهطور خاص برای ریاضی طراحی شدن، مدل OpenAI یه مدل عمومی برای استدلال و زبان محسوب میشه و از هیچ روش مهندسیشدهای برای حل این مسائل استفاده نکرده. به گفته الکساندر وی، سرپرست تیم تحقیقاتی این پروژه، این دستاورد نتیجه بهکارگیری تکنیکهای جدید در یادگیری تقویتی عمومی و افزایش توان محاسباتی در زمان اجراست. نوآم براون، یکی دیگه از پژوهشگرهای OpenAI، هم تأیید کرده که این مدل بر پایه روشهایی آزمایشی ساخته شده و هنوز جای زیادی برای ارتقاء داره.
جری توورک، پژوهشگر دیگه OpenAI، گفته که این مدل هیچ آموزش اختصاصی برای IMO ندیده و تنها روی مدل پایه عمومی شرکت آموزش بیشتری دیده. او این موفقیت رو یه «پیشرفت واقعی تحقیقاتی» توصیف کرده که توسط تیم وی انجام شده و احتمال داده که نسخهای از این مدل تا پایان سال منتشر بشه. به گفته توورک، همین سیستم یادگیری تقویتی، پشت چندتا از اعلامهای اخیر OpenAI هم بوده؛ از جمله ایجنت جدید ChatGPT و مدلی که توی یک رقابت برنامهنویسی نزدیکترین نتیجه رو به انسانها گرفته.
زمان انتشار این خبر هم قابل توجهه. چند روز قبل، پلتفرم MathArena گزارش داده بود که مدلهای زبانی معروف مثل Gemini 2.5 Pro، Grok-4، DeepSeek-R1 و حتی مدلهای o3 و o4-mini متعلق به خود OpenAI، عملکرد بسیار ضعیفی در حل مسائل IMO داشتن و حتی به آستانه مدال برنز هم نرسیدن. این مدلها در آزمونها پر از خطاهای منطقی، راهحلهای ناقص و حتی قضایای ساختگی بودن. در مقایسه با این نتایج، دستاورد OpenAI یه پاسخ مستقیم و پرقدرت به محدودیتهای فعلی مدلهای زبانیه.
OpenAI فعلاً برنامهای برای انتشار عمومی این مدل نداره و تأکید کرده که این یه پروژه تحقیقاتیه، نه یه محصول نهایی. با این حال، نوآم براون گفته که این فناوری در آینده میتونه به محصول تبدیل بشه و با توجه به سرعت پیشرفت، نسخههای بعدی حتی فراتر از این هم خواهند رفت. به گفته اون، این نتایج حتی برای کارکنان خود OpenAI هم غافلگیرکننده بوده و میتونن نقطه عطفی باشن که خیلیها انتظارش رو تا چند سال دیگه داشتن.
@aipulse24
Post #552
2.52K


- 🔥 26
- ❤ 2
- 👍 2