🚀 موج جدید مدلهای هوش مصنوعی متنباز (فوریه تا آوریل ۲۰۲۶)
در این دو ماه، شرکتهای بزرگ جهان مدلهای قدرتمند متنباز زیادی منتشر کردند. خلاصه لیست:
✅ Gemma 4 (Google DeepMind - ۲ آوریل)
سایزها: ۲.۳B تا ۳۱B
زمینه ۲۵۶K
چندوجهی
لایسنس Apache-2.0
قوی در استدلال عمومی و چندرسانهای
✅ Qwen 3.6 Series (Alibaba - آوریل)
سایزها: ۲۷B Dense و ۳۵B MoE
بنچمارک MMLU-Pro تا ۸۶.۲٪
سرعت بالا با int4
پشتیبانی از تصویر
✅ DeepSeek V4 (DeepSeek AI - ۲۴ آوریل)
سایز V4-Pro: ۱.۶T (۴۹B فعال)
سایز V4-Flash: ۲۸۴B (۱۳B فعال)
زمینه ۱ میلیون توکن
بسیار قوی در کدنویسی و استدلال پیچیده
لایسنس MIT
✅ Kimi K2.6 (Moonshot AI - ۲۰ آوریل)
سایز ۱T (۳۲B فعال) MoE
زمینه ۲۵۶k
عالی در استدلال و کدنویسی
جامعه: «نزدیکترین مدل متنباز به Claude 4.5»
✅ MiniMax M2.5 (۱۲ فوریه)
سایز ۲۲۹B (۱۰B فعال) MoE
سرعت بالا و هزینه خیلی کم
بهترین عملکرد در عاملهای هوشمند و SWE-Bench (۸۰.۲٪)
✅ GLM-5 / GLM-5.1 (Zhipu AI - فوریه و مارس)
سایز ۷۴۴B (۴۰B فعال)
زمینه ۲۰۰k
قوی در کدنویسی و کارهای agentic
لایسنس MIT
✅ Nemotron-Cascade 2 (NVIDIA - ۱۹ مارس)
سایز ۳۰B (۳B فعال) MoE
زمینه ۱M
مدال طلا در IMO و IOI
بنچمارک LiveCodeBench ۸۷.۲٪
---
خلاصه عملکرد:
- بهترین استدلال عمومی: Qwen 3.6-27B و Gemma 4-31B
- بهترین کدنویسی: MiniMax M2.5 و Nemotron-Cascade 2
- قویترین مدلهای بزرگ: DeepSeek V4-Pro و Kimi K2.6
- بهترین برای اجرا محلی و سرعت: Gemma و Qwen 3.6-MoE
همه مدلها وزنهای باز روی Hugging Face دارند و اکثرشان تحت لایسنس Apache یا MIT هستند (استفاده تجاری آزاد).
Post #320
3.48K
- ❤ 8