千问发布Qwen-Audio-3.1五款语音模型 支持实时交互
【CNMO科技消息】9月23日,千问正式发布Qwen-Audio-3.1系列语音大模型,覆盖语音识别、语音合成和实时语音交互三大核心模型,并新增音频创作模型TTS-Next和音频理解模型ASR-Next。千问其中,Qwen-Audio-3.1-ASR主打语音识别与文本整理,支持30种语言和16种中文方言,首字响应时间约160毫秒,可实现边说边转写。该模型还加入原生转写润色能力,能够自动去除语气词与
刘单涵婧 | ai.cnmo.com • Sep 23, 2026
Post #7346
1
