تیمی از محققان اپل در یک مقاله نشون دادن که مدلهای معروف هوش مصنوعی مثل Claude Thinking، o3-mini و DeepSeek R1 اصلاً چیزی به اسم استدلال منطقی واقعی (reasoning) ندارن.
چی کار کردن؟
برخلاف شرکتهایی که مدام با تستهای ریاضی قدرت مدلها رو نمایش میدن، اپل صدها مسئله کاملاً جدید و طراحینشده قبلی رو مطرح کرده — مسائلی که مشابهش تو دیتای آموزشی مدلها وجود نداره.
نتیجه؟
دقت مدلها توی حل مسائل پیچیده تقریباً به صفر رسیده.
حتی وقتی راهنمایی مرحلهبهمرحله هم داده شده، باز هم هیچکدوم از مدلها نتونستن از پس حل مسائل پیچیده بر بیان ولی برای مسائل متوسط رو به پایین عملکرد قابل قبولی داشتن.
در واقع هرچی مسئله سختتر شده، مدلها کمتر “فکر کردن” و دقتشون بیشتر افت کرده.
اپل پرسیده: اگه این مدلها واقعاً قدرت تفکر دارن، چرا وقتی قدرت محاسباتی بیشتری بهشون میدیم، ضعیفتر عمل میکنن؟
این مقاله، حرفهای افرادی مثل زاکربرگ و سم آلتمن که مدعی هستن به مرز AGI رسیدیم رو کامل زیر سوال میبره.
در نهایت به اسم محققین دقت کنید، ۴ نفر از ۶ نفرشون ایرانین🫶🏻
🆔 @IranCoderz | 👩💻🧑💻
Post #4959
1.67K

- ❤ 32
- 🔥 5
- 😁 1