Awake (@zachary.lee)阶跃发布 StepAudio 3 系列语音大模型,拿下多个全球第一 中发帖

今日阶跃正式发布 StepAudio3 系列模型,包括 StepAudio3Realtime、StepAudio3ASR、StepAudio3TTS、StepAudio3Gen 和 StepAudio3Music,其中多款模型在 Artificial Analysis 榜单中位列全球第一。以上五款模型,目前均已上线阶跃星辰开放平台。 
官方称,StepAudio 3 系列分别面向几类核心场景:真人级语音生成、完整音频内容生成、实时语音交互、复杂场景语音理解和音乐创作。 
模型官方详细介绍如下: 
StepAudio 3 Realtime:不仅“能打断”,更能理解、思考和行动 
今天,越来越多 Realtime 语音产品已经支持全双工、打断和低延迟交互。真正拉开体验差距的,不只是“能不能同时听和说”,而是模型能否在一场持续发生的对话中,边听边理解、判断何时接话,同时完成推理和任务执行。 
S...
 
 
Back to Top