همه منتظر مدل های قوی ترن ولی یه نفر با یه Agent Layer روی دیپ سیک 4 تونسته توی بنچمارک ها از Fable 5 جلو بزنه!
بدون هیچ تغییری در وزنهای مدل، فقط خطاهای موجود در فرآیند فکر کردن (Thinking Process) اصلاح شدن؛ تغییرات کوچک باعث جهش بزرگی در کیفیت استدلال شده.
مشکل از کنترل زمان اجرا (Inference-Time Control) بوده.
مدل در واقع قدرتش رو به خاطر کنترل ضعیف هنگام اجرا هدر میداده.
@Linuxor
Post #4931
9.79K
