TGViewer
AI Engineers AI Engineers @llmengineers · 2.62K subscribers
Post #349 1.58K
مدل VibeThinker-3B با ادعای شکست دادن غول‌هایی مثل Gemini 3 Pro و DeepSeek توی ریاضی و کدنویسی، دوباره بحث "فشرده‌سازی استدلال" رو داغ کرده. حرف اصلیشون اینه که برای Reasoning برخلافِ دانش عمومی (Knowledge)، لزوماً به صدها میلیارد پارامتر نیاز نداریم و میشه منطق رو توی یه هسته ۳ میلیاردی جا داد.

توی پایپ‌لاین post-training از یه استراتژی به اسم Spectrum-to-Signal استفاده کردن که با RL سنگین و SFT مرحله‌بندی شده، مدل رو روی تسک‌های Verifiable (اونایی که جواب قطعی دارن) متمرکز می‌کنه. عددها روی AIME و LiveCodeBench خیره‌کننده‌ست، ولی طبق معمول نباید فریب بنچمارک رو خورد.

واقعیت اینه که این مدل‌ها معمولاً برای بنچمارک بهینه (Benchmax) میشن و توی سناریوهای واقعی یا دچار Overthinking میشن یا کلاً گیج می‌زنن. با این حال، اگه این فرضیه که استدلال یه قابلیت چگال و قابل فشرده‌سازیه واقعاً در عمل ثابت بشه، مسیر توسعه SLMها کلاً عوض میشه.

Source: https://arxiv.org/abs/2606.16140

🛠 Join @LLMEngineers Community
arXiv.org VibeThinker-3B: Exploring the Frontier of Verifiable Reasoning in... This technical report introduces VibeThinker-3B, a compact dense model with 3B parameters developed to investigate how far verifiable reasoning can be pushed within a strictly small-model regime....
  • 👍 11
  • ❤ 1
More from @llmengineers
  1. Oct 8, 2026از نظر کاربرد Decision Modelها , قضیه دیگه فقط چند Demo نیست و چند الگوی مشخص واقعاً وارد…
  2. Oct 8, 2026کمتر از یک ماه از معرفی Jev گذشته و چیزی که اول شبیه یه مدل خاص برای «تصمیم‌گیری بدون تولی…
  3. Oct 7, 2026جدا از موج Decision Modelها، چند خبر فنی این هفته هست که برای AI Engineerها واقعاً ارزش دن…
  4. Oct 7, 2026photo post
  5. Oct 7, 2026چند روز اخیر پر از خبر AI بود، ولی وقتی تکراری‌ها، لیک‌ها و تغییرات کم‌اهمیت رو کنار بذاری…
  6. Sep 30, 2026جمنای ۴ معرفی شد !
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →