TGViewer
Анализ данных (Data analysis) Анализ данных (Data analysis) @data_analysis_ml · 50.7K subscribers
Post #5448 4.91K
Qwythos-9B-v2 вышел, и это скорее не апгрейд ради бенчмарков, а фикс главной боли

У модели оставили глубокое reasoning-поведение, но почистили самый неприятный баг: зацикливание при greedy decoding упало с 6.7% до 0%.

Также вернули MTP head, поправили identity-behavior и сохранили 1M context через YaRN.

По сути, v2 - это более стабильный Qwythos: не «новая магия», а hygiene release, где модель меньше ломается в реальном использовании.

Из заметного:

- MMLU CoT - 83.8%
- GSM8K - 93.6%
- ARC-Challenge - 96.4%
- GPQA-diamond - 49.0%
- HumanEval pass@1 - 77.4%

Лицензия - Apache-2.0.

Модель построена вокруг Qwen3.5-9B и рассчитана на long-context reasoning, код, анализ и локальные эксперименты.

https://huggingface.co/empero-ai/Qwythos-9B-v2
  • ❤ 6
  • 👍 6
  • 😁 4
  • 🔥 3
More from @data_analysis_ml
  1. Sep 26, 2026🚨 Claude признали риском для нацбезопасности США и выкинули из военной цепочки поставок А…
  2. Sep 25, 2026Opus 5.5 пишет код, Fable подсказывает: в Claude Code появился советник Если основная моде…
  3. Sep 25, 2026Xiaomi MiMo-V2.6-Pro вышла в лидеры среди моделей с открытыми весами по индексу Artificial…
  4. Sep 25, 2026🤖 Как AI может работать с данными из 1С — и что для этого действительно нужно? 1 октября…
  5. Sep 25, 2026🔥 DeepSeek Harness получил официальную desktop-версию Теперь DeepSeek Harness можно запус…
  6. Sep 25, 2026🧹 Opus 5.5 пора избавить от «магии промптов» Разработчик Anthropic поделился полезным при…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →