阶跃星辰发布 Step Audio 3 语音模型系列
语音大模型的竞争正从"把文字念出来"转向"理解声音、组织声音"。阶跃星辰今日发布 Step Audio 3 系列,一次推出五个模型:Realtime、ASR、TTS、Gen、Music,覆盖实时对话、语音识别、合成、生成与音乐方向。
其中最受关注的是 Step Audio 3 Realtime,在 Artificial Analysis 的 Conversational Dynamics 榜单上以 98.9% 的综合得分排名第一。该榜单衡量的是语音模型在真实对话场景中的综合表现,对做实时语音交互应用的开发者有直接参考价值。
🔗 原文:oschina.net/news/502502/step-audio-3
Post #1182
21