متا وزنهای Muse Glimmer رو بهصورت آزاد منتشر کرد... یه مدل ۳۰ میلیاردی متراکم (Dense) که برخلاف لاما، با لایسنس Apache 2.0 اومده. یعنی محدودیت استفاده تجاری نداره و کاملاً بازه.
این مدل رو برای چت کردن ساده نساختن، هدف اصلیش «ایجنتها» هستن. یعنی مدل رو طوری آموزش دادن که بتونه برای یه کار چندمرحلهای برنامهریزی کنه، از ابزارهای مختلف استفاده کنه و اگه جایی مسیر رو اشتباه رفت، خودش رو اصلاح کنه. در واقع این مدل رو از دل مدل قویترشون یعنی Muse Spark بیرون کشیدن (Distill کردن) تا رفتارهای هوشمندانه رو توی سایز کوچکتر داشته باشه.
از نظر فنی، معماری مدل ترکیبی از متن و تصویره. یه بخش ۲۸ میلیاردی برای متن و یه بخش ۱.۸ میلیاردی هم برای تحلیل تصویر (Perception Encoder) داره. این یعنی میتونه اسکرینشات، نمودار یا فایلهای PDF رو مستقیم بررسی کنه. ظرفیت حافظهاش هم حدود ۱۳۱ هزار توکن هست که برای خوندن مستندات طولانی یا لاگهای حجیم سیستم عالیه.
برای ما که دنبال اجرای مدل روی سیستم خودمون هستیم، متا یه حرکت خوب زده: بهینهسازی مصرف رم گرافیک. اگه از نسخههای فشردهشده (۴ بیتی) استفاده کنی، بخش زبانی مدل زیر ۲۰ گیگابایت فضا میگیره. یعنی روی یه کارت RTX 3090 یا 4090 که ۲۴ گیگ رم دارن، راحت اجرا میشه و هنوز فضا برای پردازش تصویر و حافظه موقت متن باقی میمونه. جالب اینجاست که طبق تستهای خودشون، این فشردهسازی فقط حدود ۱ درصد روی دقت مدل اثر منفی گذاشته.
یه تکنیک باحال به اسم DFlash هم اعمال کردن که یه جور حدسزدن کلمات بعدی توسط یه مدل خیلی کوچکتره (Speculative Decoding). اینجوری سرعت خروجی گرفتن روی گرافیکهای جدید مثل 5090 تا ۳ برابر بیشتر میشه؛ روی مکهای سری M4 و M5 هم بین ۱.۵ تا ۱.۸ برابر سرعت رو بالا میبره.
توی بنچمارکها، Glimmer برای کارهای ایجنتی و منطقی (مثل MCP Atlas یا GAIA2) از مدلهای همردهاش مثل Gemma 4 یا Qwen 3.6 27B بهتر عمل کرده. اما یه نکته وجود داره: اگه فقط برای «کد زدن» خالص میخوایدش، Qwen هنوز توی تستهای تخصصی برنامهنویسی امتیازهای بالاتری داره. در واقع Glimmer یه مدل «همهکاره» برای ایجنتهاست، نه فقط یه ابزار کدنویسی.
خبر مهمتر اینه که مدل اصلی و غولپیکرشون، یعنی Muse Spark 1.2 با کانتکست ۱ میلیونی هم قراره بهزودی وزنهاش باز بشه.
فعلاً Glimmer برای پروژههای محلی مثل Hermes یا دستیارهای شخصی که قراره روی سیستم خودمون بمونن، بهترین گزینه ۳۰ میلیاردی فعلیه.
https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
https://huggingface.co/meta-models/Muse-Glimmer-30B
https://huggingface.co/blog/muse-glimmer
🛠 Join @LLMEngineers Community
Post #467
3.07K
AI Engineers Game on …
- 🔥 6
- ❤ 2