Post #35922
1.76K
Qwen 发布全新 Qwen3.8‑Omni‑Flash:首款原生 omni‑modal、具备“感知→推理→工具执行”闭环的 agent 模型,能同时理解音视频并编排多步工作流(如自动剪辑 Vlog、短视频翻译、影片摘要);支持 1M 令牌长上下文、在 OmniVideoBench 用 51.8% 更少令牌定位关键片段、较 Qwen3.5‑Omni‑Plus 视频输入成本降约 89%,在 WildClawBench‑MM 与 UniClawBench 上平均领先 +19.5 点;同时开源 Qwen‑MM‑Plugins,便于把模型接入现有 agent 生态,适合需要长视频理解与可执行工作的生产化场景。
- ❤ 2