TGViewer
IranCoderz IranCoderz @irancoderz · 2.46K subscribers
Post #4959 1.67K
تیمی از محققان اپل در یک مقاله نشون دادن که مدل‌های معروف هوش مصنوعی مثل Claude Thinking، o3-mini و DeepSeek R1 اصلاً چیزی به اسم استدلال منطقی واقعی (reasoning) ندارن.

چی کار کردن؟
برخلاف شرکت‌هایی که مدام با تست‌های ریاضی قدرت مدل‌ها رو نمایش می‌دن، اپل صدها مسئله کاملاً جدید و طراحی‌نشده قبلی رو مطرح کرده — مسائلی که مشابهش تو دیتای آموزشی مدل‌ها وجود نداره.

نتیجه؟
دقت مدل‌ها توی حل مسائل پیچیده تقریباً به صفر رسیده.
حتی وقتی راهنمایی مرحله‌به‌مرحله هم داده شده، باز هم هیچ‌کدوم از مدل‌ها نتونستن از پس حل مسائل پیچیده بر بیان ولی برای مسائل متوسط ر‌و به پایین عملکرد قابل قبولی داشتن.

در واقع هرچی مسئله سخت‌تر شده، مدل‌ها کمتر “فکر کردن” و دقتشون بیشتر افت کرده.

اپل پرسیده: اگه این مدل‌ها واقعاً قدرت تفکر دارن، چرا وقتی قدرت محاسباتی بیشتری بهشون می‌دیم، ضعیف‌تر عمل می‌کنن؟

این مقاله، حرف‌های افرادی مثل زاکربرگ و سم آلتمن که مدعی هستن به مرز AGI رسیدیم رو کامل زیر سوال می‌بره.

در نهایت به اسم محققین دقت کنید، ۴ نفر از ۶ نفرشون ایرانین🫶🏻

🆔 @IranCoderz | 👩‍💻🧑‍💻
  • ❤ 32
  • 🔥 5
  • 😁 1
More from @irancoderz
  1. Oct 4, 2026‏همه‌مون یه روز برای آخرین بار توی یه فایل پایتون نوشتیم def بدون اینکه بدونیم آخرین ب…
  2. Oct 1, 2026معاون وزیر ارتباطات خیلی جدی برداشته گفته چون استارلینک فراگیر شده و قابلیت کنترل توسط حکو…
  3. Sep 30, 2026رفتار مارکت فعلی با برنامه‌نویس‌های جویای کار: 🚀@IranCoderz 👨‍💻
  4. Sep 29, 2026دقیقا بعد از معرفی dots، مهندس XAi پست گذاشت که برید dot.com رو سرچ کنید و وقتی واردش می‌ش…
  5. Sep 29, 2026سرعت پیشرفت و آپدیت‌ دادن مدل‌ها جوری شده که با اومدنشون هیچی کلی استارتاپ بر پایه هوش‌مصن…
  6. Sep 29, 2026پلن 500 دلاری: - دارای کمترین لیمیت - دسترسی به حالت Ultra Fast مدل‌ها(همین امشب معرفی شد…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →