شرکت DeepSeek مدل جدید DeepSeek-V4.1-Flash رو معرفی کرده؛ مدلی که میتونه متن و تصویر رو پردازش کنه و تا یک میلیون Token رو در یک Context نگه داره.
🔸این قابلیت برای Agentهایی که با اطلاعات و تاریخچههای طولانی کار میکنن، کاربردیه.
📌نکته مهم اینه که با وجود اندازه بزرگ مدل، در هر مرحله فقط بخش کوچکی از اون فعال میشه. DeepSeek میگه فضای موردنیاز برای بخش دائمی KV Cache در این مدل به حدود یک هشتم DeepSeek-V4-Flash رسیده.
✅طبق نتایج منتشرشده توسط DeepSeek، عملکرد مدل در چند Benchmark اینطور بوده:
• در آزمون Terminal-Bench 2.1 امتیاز ۹۰.۶٪ رو گرفته
• در آزمون DeepSWE حدود ۷۴.۲٪ از مسئلهها رو حل کرده
• در آزمون CyberGym به امتیاز ۸۸.۱٪ رسیده
وزنهای مدل هم با MIT License منتشر شدن و توسعهدهندهها میتونن اون رو اجرا کنن یا برای نیاز خودشون تغییر بدن.
البته این Benchmarkها رو خود DeepSeek منتشر کرده و برای مقایسه قطعی، باید منتظر ارزیابیهای مستقل بیشتری بمونیم.
🤖 GenX؛ برای توسعهدهندگانی که آینده رو میسازن
✅ Telegram | ✅ twitter | Linkedin |✅ Instagram
Post #369
545
