معرفی سری Qwen 3.5 Medium
اگه دنبال اجرای مدلهای سطح بالا روی سیستم خودتون هستید و از حجمهای عجیبوغریب خسته شدید، تیم Qwen دیروز سری جدید Medium رو ریلیز کرد که بازی رو عوض کرده. شعار این سری "هوش بیشتر، محاسبات کمتر" هست و تمرکز کاملاً رفته روی معماری بهینه، کیفیت دیتا و RL سنگین برای ایجنتها.
نکته جذاب ماجرا اینه که این مدلها صرفاً متنی نیستن؛ به صورت Native قابلیتهای Multimodal (تصویر و ویدیو) دارن و قابلیت Thinking Modeداخلشون تعبیه شده که میتونید روشن یا خاموشش کنید.
مدلهای اصلی این خانواده:
مدل Qwen3.5-35B-A3B (MoE):
ستارهی این ریلیز. کلاً ۳۵ میلیارد پارامتر داره اما برای هر توکن فقط ۳ میلیاردش فعال میشه.
به نظر من این مدل "Value King" جدید دنیای اپنسورسه. روی یه سیستم با ۲۴ گیگ رم (یا مکبوک) به راحتی اجرا میشه و طبق بنچمارکها، مدل قبلی و غولپیکر Qwen3-235B رو شکست میده. خوراکِ کارهای لوکال و سیستمهای با منابع محدوده.
مدل Qwen3.5-122B-A10B (MoE):
پل ارتباطی به مدلهای Frontier. با ۱۲۲ میلیارد پارامتر (۱۰ میلیارد فعال)، فاصلهی کمی با مدلهای بسته مثل GPT-5-mini داره، مخصوصاً توی سناریوهای پیچیده Agentic و Reasoning. اگر ستاپ Multi-GPU دارید، این گزینه برای پروداکشن عالیه.
مدل Qwen3.5-27B (Dense):
یه مدل کلاسیک و متراکم (Non-MoE). توی کارهای کدنویسی و Long-Context عملکرد عجیب و غریبی داره و گاهی حتی برادران MoE خودش رو هم میزنه. چون Dense هست، پایداری بیشتری توی Instruction Following داره.
چرا این ریلیز مهمه؟
همه مدلها لایسنس Apache 2.0 دارن، تا ۱ میلیون توکن Context رو ساپورت میکنن و توی بنچمارکهای Coding و Agentic، مدلهای Closed-source مثل GPT-5-mini و Claude-Sonnet-4.5 رو به چالش کشیدن (و جاهایی شکست دادن). جامعه کاربری خیلی سریع براشون GGUF ساخته و روی ابزارهایی مثل vLLM و Llama.cpp بالا میان.
اگر توسعهدهنده هستید، الان وقتشه که کلاسترها رو بیخیال بشید و روی Edge Deviceها هوش واقعی رو تست کنید.
📃 لینک مدلها در هاگینگفیس:
https://huggingface.co/collections/Qwen/qwen35
🛠 Join @LLMEngineers Community
Post #315
1.53K
- ❤ 10
- 👍 4