TGViewer
AI Engineers AI Engineers @llmengineers · 2.62K subscribers
Post #467 3.07K
AI Engineers Game on …
متا وزن‌های Muse Glimmer رو به‌صورت آزاد منتشر کرد... یه مدل ۳۰ میلیاردی متراکم (Dense) که برخلاف لاما، با لایسنس Apache 2.0 اومده. یعنی محدودیت استفاده تجاری نداره و کاملاً بازه.

این مدل رو برای چت کردن ساده نساختن، هدف اصلیش «ایجنت‌ها» هستن. یعنی مدل رو طوری آموزش دادن که بتونه برای یه کار چندمرحله‌ای برنامه‌ریزی کنه، از ابزارهای مختلف استفاده کنه و اگه جایی مسیر رو اشتباه رفت، خودش رو اصلاح کنه. در واقع این مدل رو از دل مدل قوی‌ترشون یعنی Muse Spark بیرون کشیدن (Distill کردن) تا رفتارهای هوشمندانه رو توی سایز کوچک‌تر داشته باشه.

از نظر فنی، معماری مدل ترکیبی از متن و تصویره. یه بخش ۲۸ میلیاردی برای متن و یه بخش ۱.۸ میلیاردی هم برای تحلیل تصویر (Perception Encoder) داره. این یعنی می‌تونه اسکرین‌شات، نمودار یا فایل‌های PDF رو مستقیم بررسی کنه. ظرفیت حافظه‌اش هم حدود ۱۳۱ هزار توکن هست که برای خوندن مستندات طولانی یا لاگ‌های حجیم سیستم عالیه.

برای ما که دنبال اجرای مدل روی سیستم خودمون هستیم، متا یه حرکت خوب زده: بهینه‌سازی مصرف رم گرافیک. اگه از نسخه‌های فشرده‌شده (۴ بیتی) استفاده کنی، بخش زبانی مدل زیر ۲۰ گیگابایت فضا می‌گیره. یعنی روی یه کارت RTX 3090 یا 4090 که ۲۴ گیگ رم دارن، راحت اجرا می‌شه و هنوز فضا برای پردازش تصویر و حافظه موقت متن باقی می‌مونه. جالب اینجاست که طبق تست‌های خودشون، این فشرده‌سازی فقط حدود ۱ درصد روی دقت مدل اثر منفی گذاشته.

یه تکنیک باحال به اسم DFlash هم اعمال کردن که یه جور حدس‌زدن کلمات بعدی توسط یه مدل خیلی کوچک‌تره (Speculative Decoding). اینجوری سرعت خروجی گرفتن روی گرافیک‌های جدید مثل 5090 تا ۳ برابر بیشتر می‌شه؛ روی مک‌های سری M4 و M5 هم بین ۱.۵ تا ۱.۸ برابر سرعت رو بالا می‌بره.

توی بنچمارک‌ها، Glimmer برای کارهای ایجنتی و منطقی (مثل MCP Atlas یا GAIA2) از مدل‌های هم‌رده‌اش مثل Gemma 4 یا Qwen 3.6 27B بهتر عمل کرده. اما یه نکته وجود داره: اگه فقط برای «کد زدن» خالص می‌خوایدش، Qwen هنوز توی تست‌های تخصصی برنامه‌نویسی امتیازهای بالاتری داره. در واقع Glimmer یه مدل «همه‌کاره» برای ایجنت‌هاست، نه فقط یه ابزار کدنویسی.

خبر مهم‌تر اینه که مدل اصلی و غول‌پیکرشون، یعنی Muse Spark 1.2 با کانتکست ۱ میلیونی هم قراره به‌زودی وزن‌هاش باز بشه.
فعلاً Glimmer برای پروژه‌های محلی مثل Hermes یا دستیارهای شخصی که قراره روی سیستم خودمون بمونن، بهترین گزینه ۳۰ میلیاردی فعلیه.


https://research.meta.ai/blog/introducing-muse-glimmer-open-agentic-model
https://huggingface.co/meta-models/Muse-Glimmer-30B
https://huggingface.co/blog/muse-glimmer

🛠 Join @LLMEngineers Community
  • 🔥 6
  • ❤ 2
More from @llmengineers
  1. Oct 8, 2026از نظر کاربرد Decision Modelها , قضیه دیگه فقط چند Demo نیست و چند الگوی مشخص واقعاً وارد…
  2. Oct 8, 2026کمتر از یک ماه از معرفی Jev گذشته و چیزی که اول شبیه یه مدل خاص برای «تصمیم‌گیری بدون تولی…
  3. Oct 7, 2026جدا از موج Decision Modelها، چند خبر فنی این هفته هست که برای AI Engineerها واقعاً ارزش دن…
  4. Oct 7, 2026photo post
  5. Oct 7, 2026چند روز اخیر پر از خبر AI بود، ولی وقتی تکراری‌ها، لیک‌ها و تغییرات کم‌اهمیت رو کنار بذاری…
  6. Sep 30, 2026جمنای ۴ معرفی شد !
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →