💡همانطور که یان لیکان* باور دارد ، مدلهای زبانی بزرگ (LLMها) فعلا نمیتونند المپیاد جدید ریاضی رو شکست بدهند.
🔷 یه مطالعه جدید به اسم «اثبات یا بلوف؟ بررسی عملکرد LLMها در المپیاد ریاضی آمریکا ۲۰۲۵» نشون میده که حتی بهترین مدلهای هوش مصنوعی توی سوالات جدید المپیاد کمتر از %5 نمره گرفتن ( با اینکه توی سوالات قدیمی که قبلاً "دیده بودن" یا روشون آموزش دیده بودن، عملکرد خوبی داشتند).
💡نتیجه چیه؟ این مدلها بیشتر به حفظ کردن تکیه دارن تا استدلال واقعی. برای کارهای تکراری یا آشنا خوبن، ولی هنوز نباید بهشون لقب "ابرهوشمند" بدیم. انگار این مدلها فعلا بیشتر برای شناسایی الگو خوب هستند تا درک واقعی و استدلال
*
لیکان کسی هست که شبکههای عصبی کانولوشنی یا همون CNNها رو به دنیا معرفی کرد (یه مدل انقلابی که مغز کامپیوترها رو به چشمی هوشمند تبدیل کرد!). الان هم استاد دانشگاه نیویورک و مدیر ارشد هوش مصنوعی توی شرکت متا (فیسبوک سابق) هست.🔘لینک مقاله
https://arxiv.org/abs/2503.21934
🏢 آکادمی آنلاین مهندسی پزشکی و هوش مصنوعی
@Onlinebme