Увидел интересный репозиторий Unsloth, который делает установку, настройку и обучение LLM очень френдли через обычный дашборд.
Выбор моделей небольшой, но из интересного у них есть гайд, как подключить локальную модель к Codex и Claude Code, может, кто не знал, что так можно)
Также вышла новая открытая модель от Google - Gemma 4, которая уже доступна в этом репозитории и, конечно, на Hugging Face.
Модель уже заняла 3 место среди открытых текстовых моделей на Arena AI.
Требования для запуска:
Gemma-4-E2B и E4B работают с 5 ГБ VRAM (4-бит) или 15 ГБ (полная 16-битная точность).
Gemma-4-26B-A4B работает с 18 ГБ (4-бит) или 28 ГБ (8-бит).
Gemma-4-31B требует 20 ГБ (4-бит) или 34 ГБ (8-бит).
Не думаю, что у многих есть такие видеокарты, но в облаке интересно потестировать с крабом.
Чат | Канал
Post #153
2.37K


- 👍 8
- ❤ 3
- 🔥 1