🔖 Вышел ультимативный гайд по локальному запуску LLM — посвящается всем, кто хочет максимально ускорить модели на своём компе через llama.cpp.
Внутри — как выбрать железо, настроить ОС, управлять VRAM/RAM, работать с KV-кэшем, повысить скорость инференса на обычных ПК и многое другое.
В закладки — тут.
@notboring_tech
Post #4236
7.46K

- ❤🔥 23
- 👍 11
- 🔥 8
- 😁 3
- 🎉 3