TGViewer
Нейроканал Нейроканал @neuro_channel · 11.7K subscribers
Post #2904 1.63K
Qwen выложила Qwen3.8-Omni-Flash: на вход текст, картинки, звук и видео, контекст 1M токенов. Час звука на входе подешевел больше чем на 98% относительно прошлой Qwen3.5-Omni-Plus, час звука с видео на 93%. По аудио модель обходит Gemini 3.8 Flash, по связке звука с видео идёт вровень.

Интереснее всего, как она смотрит длинное видео. Раньше запись прогонялась от начала до конца, даже если ответ лежит в паре минут. Теперь агент сам решает, какие куски посмотреть и послушать, и подбирается к ответу в несколько заходов от грубого к точному. На OmniVideoBench точность выросла с 63,4 до 67,8, а расход токенов упал со 145 736 до 79 117.

Весов нет, модель живёт только в API. Зато открыли Qwen-MM-Plugins, набор, который добавляет звук и видео в готовые агентные харнессы, и Qwen-Live Harness под реалтайм-версию, он ставится командой npm install -g qwen-live-harness. Попробовать можно на платформе Qwen.

@neuro_channel
  • ❤ 4
  • ✍ 3
  • 🎉 3
More from @neuro_channel
  1. Sep 20, 2026Tencent выложила WeVisDoc, модели на 2 и 4 млрд параметров, которые превращают снимок стра…
  2. Sep 19, 2026StepFun выпустила Step 5 Preview, и Artificial Analysis уже её замерили: 44 балла в индекс…
  3. Sep 19, 2026На следующей неделе ожидается сразу несколько крупных релизов. Расскажу про самые интересн…
  4. Sep 18, 2026PrismML выпустила Ternary Bonsai 2 27B: тернарное сжатие теперь сделано поверх Qwen3.8 27B…
  5. Sep 17, 2026Стелс-модель Union Alpha раскрылась: это Pareto 26.9 от компании The Unbiased Company. Вче…
  6. Sep 17, 2026Ещё были слухи, что сегодня GPT-6 Sol выложат, якобы она и быстрая и недорогая и умная поч…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →