TGViewer
AI Engineers AI Engineers @llmengineers · 2.62K subscribers
Post #340 1.49K
بعد از حدود ۹ ماه استفاده از مدل‌های Qwen 3 و Qwen 3.5 نسخه 4B روی سیستمم، بالاخره تصمیم گرفتم یه تکونی به ستاپ محلی بدم. الان چند وقتی هست که مدل Gemma 4 E4B نسخه 6-bit رو به عنوان مدل پیش‌فرض روی ویندوز با کارت گرافیک RTX 3060 (نسخه ۶ گیگابایتی) بالا آوردم (با LM Studio )

کوانت Q6 این مدل روی سخت‌افزارهای با VRAM محدود مثل gpu من واقعاً نرم و بی‌دردسر اجرا میشه. توی کارهای روتین، چت‌های معمولی و حتی فرستادن کدهای ساده بش (Bash) کار رو تمیز درمیاره. یکی از نکات جالبش لحن طبیعی‌تری هست که توی خروجی‌های متنی مناسب برای TTS تولید می‌کنه. برای کسایی که روی رزبری پای یا مینی‌پی‌سی هم بالا آوردنش بازخوردها مثبت بوده؛ یعنی مصرف منابعش نسبت به کیفیتی که میده واقعاً بهینه‌ست.

ضعف‌های مدل هم دقیقاً از جایی شروع میشه که یادت میره این کلاً یه مدل کوچیکه. توی ردیت خیلیا شاکی بودن که برای تسک‌های استدلالی سنگین یا خلاصه کردن متون طولانی خروجی متوسطی میده که خب طبیعیه. به نظر من بزرگ‌ترین ضعفش توی سیستم‌های ایجنتی و ابزارهای توسعه مثل Continue.dev یا کارهای نیازمند به Tool Calling عمیقه؛ کلاً ساختار خروجی رو اون‌قدر پایدار نگه نمی‌داره که بشه توی کارهای حساس بهش تکیه کرد. برای پروژه‌های لوکال ایجنتی Qwen 27b انتخاب منطقی‌تریه (که البته gpu بهتریم میخواد).

🛠 Join @LLMEngineers Community
  • 👍 10
More from @llmengineers
  1. Oct 8, 2026از نظر کاربرد Decision Modelها , قضیه دیگه فقط چند Demo نیست و چند الگوی مشخص واقعاً وارد…
  2. Oct 8, 2026کمتر از یک ماه از معرفی Jev گذشته و چیزی که اول شبیه یه مدل خاص برای «تصمیم‌گیری بدون تولی…
  3. Oct 7, 2026جدا از موج Decision Modelها، چند خبر فنی این هفته هست که برای AI Engineerها واقعاً ارزش دن…
  4. Oct 7, 2026photo post
  5. Oct 7, 2026چند روز اخیر پر از خبر AI بود، ولی وقتی تکراری‌ها، لیک‌ها و تغییرات کم‌اهمیت رو کنار بذاری…
  6. Sep 30, 2026جمنای ۴ معرفی شد !
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →