TGViewer
AI Engineers AI Engineers @llmengineers · 2.62K subscribers
Post #318 2.67K
AI Engineers Photo
۱. پادشاهی روی کارت گرافیک‌های گیمینگ (Qwen3.5-35B-A3B)
این مدل به نظرم جذاب‌ترین بخش این ریلیز هست. معماری Mixture of Experts (MoE) اینجا شاهکار کرده.
• نکته فنی: مدل سایز کلی 35B داره اما فقط حدود 3B پارامتر در لحظه (Active) فعال میشن.
• کاربرد عملی: یعنی شما دانش یه مدل 35B رو دارید، اما سرعت Inference و تاخیر (Latency) در حد یه مدل 3B هست.
• سخت‌افزار: این مدل راحت روی ۲۴ گیگ VRAM (مثل RTX 3090/4090) حتی با Quantization سبک بالا میاد. توی جدول MMLU-Pro نمره 84.5 گرفته که از GPT-5 mini (نسخه کلوزد) بالاتره. برای Agent هایی که روی لوکال ران می‌شن، این بهترین گزینست.

۲. مدل Dense برای کدنویسی (Qwen3.5-27B)
چرا وقتی MoE هست، هنوز Dense می‌سازن؟ جواب تو پایداریه.
• مدل 27B Dense توی بنچمارک SWE-bench Verified نمره 72.4 رو گرفته که از نسخه 35B MoE (با نمره 71.0) بالاتره.
• تجربه من: برای تسک‌های Coding و Reasoning طولانی که Context Switching زیاد دارن، مدل‌های Dense هنوز Stableتر عمل می‌کنن و کمتر دچار Hallucination توی لاجیک‌های تو در تو میشن. اگه سیستم تک GPU دارید و کارتون فقط کده، این گزینه منطقی‌تریه.

۳. هیولای ورک‌استیشن (Qwen3.5-122B-A10B)
این مدل عملاً Bridge بین مدل‌های لوکال و Frontier Models (مثل Claude Sonnet 4.5) هست.
• با 122B پارامتر و 10B اکتیو، نیاز به ستاپ Multi-GPU داره (مثلاً دو تا A6000 یا ۴ تا 3090/4090).
• توی GPQA Diamond نمره 86.6 رو زده که تنه به تنه مدل‌های اختصاصی میزنه. برای کارهای Multimodal سنگین و Vision Reasoning پیچیده، این مدل الان سقفِ Open-Weights محسوب میشه.

۴. مقایسه با رقبا (GPT-5 mini & Claude)
طبق چارت‌ها، Qwen 3.5 توی اکثر بنچمارک‌ها (HMMT, MMMU) داره با فاصله کمی از Claude Sonnet 4.5 و GPT-oss-120b حرکت می‌کنه و گاهی جلو میزنه.
• نکته ترسناک: فاصله بین مدل‌های Open و Closed (پولی) به حداقل رسیده. الان دیگه "دسترسی به مدل" مزیت نیست، "نحوه استفاده و Fine-tune" مزیت رقابتیه.

جمع‌بندی فنی:
به نظر من، دوران طلایی Local Agents شروع شده. وقتی می‌تونید روی لپ‌تاپ یا یه سرور خونگی مدلی ران کنید که Reasoning در سطح GPT-4o پارسال رو با سرعت ۱۰ برابر بهتون میده، یعنی معماری نرم‌افزارها باید عوض بشه. تمرکزتون رو بذارید روی Orchestration و Tool-use، چون خود مدل دیگه Bottleneck نیست.

اگه سیستم خونگی قوی دارید، نسخه 35B-A3B رو حتما تست کنید؛ تعادل عجیبی بین سرعت و شعور داره.

🛠 Join @LLMEngineers Community
  • 🔥 6
More from @llmengineers
  1. Oct 8, 2026از نظر کاربرد Decision Modelها , قضیه دیگه فقط چند Demo نیست و چند الگوی مشخص واقعاً وارد…
  2. Oct 8, 2026کمتر از یک ماه از معرفی Jev گذشته و چیزی که اول شبیه یه مدل خاص برای «تصمیم‌گیری بدون تولی…
  3. Oct 7, 2026جدا از موج Decision Modelها، چند خبر فنی این هفته هست که برای AI Engineerها واقعاً ارزش دن…
  4. Oct 7, 2026photo post
  5. Oct 7, 2026چند روز اخیر پر از خبر AI بود، ولی وقتی تکراری‌ها، لیک‌ها و تغییرات کم‌اهمیت رو کنار بذاری…
  6. Sep 30, 2026جمنای ۴ معرفی شد !
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →