🚨 NVIDIA выложила на Hugging Face квантизированную Gemma 4 31B
- NVFP4 сжимает веса в ~4 раза без заметной потери качества
- 99.7% от baseline на GPQA (75.46% vs 75.71%)
- Контекст до 256K
- Мультимодальность: текст, изображения, видео
- vLLM-ready + оптимизация под Blackwell
По железу:
- веса: ~16–21 GB VRAM
- нормальный запуск: от 24 GB
- полный 256K контекст: комфортно от 32 GB
31B-модель уровня frontier, которую наконец можно гонять локально на топовом consumer GPU, а не только в облаке
Попробовать: https://huggingface.co/nvidia/Gemma-4-31B-IT-NVFP4
🎯Полезные Мл-ресурсы 🚀 Max
@data_analysis_ml
Post #4929
8.65K

- 🔥 26
- 👍 6
- ❤ 5