گوگل یه متد ارائه داده در رابطه با LLM ها که خیلی سر و صدا کرده تو این دو روز. با این متد بدون کاهش کیفیت خروجی مدل میشه مصرف ram رو تا 6 برابر کمتر و سرعت رو تا 8 برابر بیشتر کرد.
مقاله رو که باز کنی جالب تر میشه و میبینی هر 4 تا نویسندهش ایرانی هستن!
* MrGolden_1 *
🚀@IranCoderz 👨💻
Post #5167
1.62K

- ❤ 10
- 🔥 6
- 😭 3
- 👎 2
- 😁 1
- 🏆 1