Вышел Grug-12B
Это экспериментальный open-source fine-tune на базе Gemma 4 12B IT.
Идея простая - заставить модель «думать» короче, но не терять качество ответа.
Grug обучали на compact-reasoning стиле: меньше воды, меньше лишних шагов, больше плотности в рассуждении.
По заявлению автора, модель генерирует примерно на 69.8% меньше reasoning-токенов и остаётся близко к базовой Gemma 4. На небольшом локальном math-eval она снизила среднее число generated tokens с 228.5 до 68.9.
Главный плюс: быстрее ответы и меньше забитого контекста.
huggingface.co/kai-os/Grug-12B
Post #5411
4.96K

- ❤ 17
- 👍 3