Новая 432B-модель под MIT-лицензией. Она стала на 40% меньше, чем GigaChat 3.1 Ultra, но при этом прибавила в коде, математике, агентных задачах и генерации.
➡️ Что важно:
— гибридная архитектура MLA + GatedDeltaNet
— меньше KV-кеш, больше контекста в той же памяти
— throughput под нагрузкой +20%
— ускорение генерации до 2,2 раза
— FP8 на всём обучении
— новый этап online RL после SFT и DPO
✅ По результатам:
— Base обходит DeepSeek V3.2 Exp Base и V4 Flash Base на наборе general / math / code-бенчмарков
— Instruct сопоставима с DeepSeek V3.2, будучи меньше
— win-rate против GigaChat 3.1 Ultra — 75,9%, против GPT-5 — 68,7%
🔗 Ссылка на HuggingFace
🐸 Библиотека ИИ для айтишников
#neuro_flash