Qwen-Audio-3.0-TTS 实时语音合成发布
通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型。更新涵盖更广语言覆盖、更自然指令控制、更精细标签控制,以及对模糊参考音频的鲁棒性。
模型分两个版本:Flash 面向实时交互,首包延迟约 300ms;Plus 面向高质量生成,自然度和音色还原更佳。
#GitHub #开源 #QwenAudio #语音合成 #通义实验室
@GitHubTrendingHub
Post #382
29
GI GitHub开源观察|开源项目·热门仓库·开发者 @githubtrendinghub · 657 subscribers