یه fine-tune قوی روی Gemma 4 12B که تمرکزش روی کدنویسی + استفاده از ابزار + کارهای چندمرحلهای (agentic) هست.
📊 عملکرد روی بنچمارک ایجنتیک (tau2-bench telecom):
➡️ تقریباً ۳.۵ برابر بهتر از مدل پایه در تسکهای ایجنتیک (۵۵ به جای ۱۵ در بنچ مارک)
مدل پایه معمولاً توی تسکهای چندمرحلهای زود تسلیم میشه و کار رو به انسان واگذار میکنه. این مدل یاد گرفته مثل یه دولوپر واقعی عمل کنه:
read → reason → act → verifyیعنی اول state رو بررسی میکنه، بعد تشخیص میده، بعد fix میزنه، و در نهایت نتیجه رو verify میکنه — بدون hallucinate کردن مسیرها یا توابع ناموجود.
📦 سایزهای GGUF موجود:
- Q3_K_M → 5.7 GB (مناسب GPU های 8GB)
- Q4_K_M → 6.87 GB ✅ پیشنهادی
- Q6_K → 9.11 GB
- Q8_0 → 11.8 GB
⚡ اجرا با Ollama:
ollama run hf.co/yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF:Q4_K_M
🔗 https://huggingface.co/yuxinlu1/gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF