TGViewer
AI Pulse AI Pulse @aipulse24 · 3.33K subscribers
Post #552 2.52K
شرکت OpenAI از دستیابی به یک پیشرفت چشمگیر در توانایی استدلال مدل‌های زبانی خودش در حل مسائل پیچیده ریاضی خبر داده؛ موفقیتی که می‌تونه یکی از جدی‌ترین گام‌ها در مسیر رسیدن به هوش مصنوعی عمومی (AGI) تلقی بشه. مدل آزمایشی OpenAI موفق شده در رقابت رسمی المپیاد جهانی ریاضی ۲۰۲۵، پنج مسئله از شش مسئله اصلی رو حل کنه و با کسب ۳۵ امتیاز از مجموع ۴۲، به سطح مدال طلا برسه. این اولین‌باریه که یک مدل هوش مصنوعی به چنین سطحی در یکی از دشوارترین آزمون‌های ریاضی جهان می‌رسه. تمام پاسخ‌ها به زبان طبیعی نوشته شدن، هیچ ابزاری استفاده نشده و داوری هم به‌صورت ناشناس توسط مدال‌آوران سابق IMO انجام شده.

نکته مهم اینجاست که برخلاف مدل‌هایی مثل AlphaGeometry که به‌طور خاص برای ریاضی طراحی شدن، مدل OpenAI یه مدل عمومی برای استدلال و زبان محسوب می‌شه و از هیچ روش مهندسی‌شده‌ای برای حل این مسائل استفاده نکرده. به گفته الکساندر وی، سرپرست تیم تحقیقاتی این پروژه، این دستاورد نتیجه به‌کارگیری تکنیک‌های جدید در یادگیری تقویتی عمومی و افزایش توان محاسباتی در زمان اجراست. نوآم براون، یکی دیگه از پژوهشگرهای OpenAI، هم تأیید کرده که این مدل بر پایه روش‌هایی آزمایشی ساخته شده و هنوز جای زیادی برای ارتقاء داره.

جری توورک، پژوهشگر دیگه OpenAI، گفته که این مدل هیچ آموزش اختصاصی برای IMO ندیده و تنها روی مدل پایه عمومی شرکت آموزش بیشتری دیده. او این موفقیت رو یه «پیشرفت واقعی تحقیقاتی» توصیف کرده که توسط تیم وی انجام شده و احتمال داده که نسخه‌ای از این مدل تا پایان سال منتشر بشه. به گفته توورک، همین سیستم یادگیری تقویتی، پشت چندتا از اعلام‌های اخیر OpenAI هم بوده؛ از جمله ایجنت جدید ChatGPT و مدلی که توی یک رقابت برنامه‌نویسی نزدیک‌ترین نتیجه رو به انسان‌ها گرفته.

زمان انتشار این خبر هم قابل توجهه. چند روز قبل، پلتفرم MathArena گزارش داده بود که مدل‌های زبانی معروف مثل Gemini 2.5 Pro، Grok-4، DeepSeek-R1 و حتی مدل‌های o3 و o4-mini متعلق به خود OpenAI، عملکرد بسیار ضعیفی در حل مسائل IMO داشتن و حتی به آستانه مدال برنز هم نرسیدن. این مدل‌ها در آزمون‌ها پر از خطاهای منطقی، راه‌حل‌های ناقص و حتی قضایای ساختگی بودن. در مقایسه با این نتایج، دستاورد OpenAI یه پاسخ مستقیم و پرقدرت به محدودیت‌های فعلی مدل‌های زبانیه.

‏OpenAI فعلاً برنامه‌ای برای انتشار عمومی این مدل نداره و تأکید کرده که این یه پروژه تحقیقاتی‌ه، نه یه محصول نهایی. با این حال، نوآم براون گفته که این فناوری در آینده می‌تونه به محصول تبدیل بشه و با توجه به سرعت پیشرفت، نسخه‌های بعدی حتی فراتر از این هم خواهند رفت. به گفته اون، این نتایج حتی برای کارکنان خود OpenAI هم غافلگیرکننده بوده و می‌تونن نقطه عطفی باشن که خیلی‌ها انتظارش رو تا چند سال دیگه داشتن.

@aipulse24
  • 🔥 26
  • ❤ 2
  • 👍 2
More from @aipulse24
  1. Dec 28, 2025امار امسال کانال با تشکر ویژه از اسپانسر اصلی ما کانال تک تیوب:)) و محمد با پست های فوق ال…
  2. Dec 21, 2025کافیه 🎁 رو توی یک چت جدید توی ChatGPT وارد کنید (بدون هیچ متنی) تا به صورت اتوماتیک بعد ا…
  3. Dec 11, 2025گوگل به‌تازگی از یک مرورگر آزمایشی و متفاوت به نام «دیسکو» (Disco) رونمایی کرده که قرار نی…
  4. Nov 27, 2025بلک فارست لبز به تازگی از خانواده جدید مدل‌های تصویرساز خودش یعنی Flux 2 رونمایی کرده که پ…
  5. Nov 20, 2025تصویر ساخته شده توسط یکی از اعضای کانال. تکست رندرینگ و consistency مدل شگفت انگیزه. @aipu…
  6. Nov 20, 2025مدل جدید Nano Banana Pro به گوگل اسلایدز هم رسیده و الان میتونید ازش بخواید تا اسلاید هاتو…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →