دیپ سیک یه حرکتی زده فردا بعد از ظهر سهام انویدیا میریزه، موتور دقیقِ پشت مدلهاش رو منتشر کرده، اسمش DeepGEMM هست، DeepGEMM باعث میشه بخش محاسبات سنگین مدلهای DeepSeek روی GPU سریعتر و کمهزینهتر اجرا بشه؛ مخصوصاً در کارهایی مثل ضرب ماتریسی و مدلهای MoE که بخش خیلی مهمی از هزینه و زمان اجرای مدل رو تشکیل میدن. این خیلی برای شرکت های داخلی که دارن LLM شخصی ران میکنن مفیده چون میتونن هزینه های GPU شون رو تا 2.7 برابر کمتر کنن.
@Linuxor
Post #5574
3.88K