TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2895 1.89K
Swift-Qwen3.8-27B от UkisAI это та же Qwen3.8-27B, только думает вдвое короче. LoRA-адаптер срезает медианную длину рассуждений на 58% при потере меньше 1% качества, на практике это ускорение в 1,95 раза. На LiveCodeBench v6 результат даже вырос с 76,8 до 81,6 при экономии токенов в 24%, а вот AIME 2026 просел с 98,7 до 94,0.

Рецепт такой: авторы нашли токены-маркеры, которые запускают у Qwen переобдумывание, и дообучили модель со штрафом за них. Экономия держится на всех уровнях reasoning_effort, от low до xhigh.

Лицензия своя: бесплатно для любого использования, пока годовая выручка меньше $1 млн, выше нужна корпоративная. GGUF для llama.cpp лежит отдельно, его уже скачали 55 тысяч раз. На видео параллельный прогон задачи из LiveCodeBench: база против Swift.

@neuro_channel
  • ❤ 3
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токен…
  5. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  6. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →