У модели оставили глубокое reasoning-поведение, но почистили самый неприятный баг: зацикливание при greedy decoding упало с 6.7% до 0%.
Также вернули MTP head, поправили identity-behavior и сохранили 1M context через YaRN.
По сути, v2 - это более стабильный Qwythos: не «новая магия», а hygiene release, где модель меньше ломается в реальном использовании.
Из заметного:
-
MMLU CoT - 83.8%-
GSM8K - 93.6%-
ARC-Challenge - 96.4%-
GPQA-diamond - 49.0%-
HumanEval pass@1 - 77.4%Лицензия - Apache-2.0.
Модель построена вокруг Qwen3.5-9B и рассчитана на long-context reasoning, код, анализ и локальные эксперименты.
https://huggingface.co/empero-ai/Qwythos-9B-v2
