新模型
2026-09-15
阶跃星辰发布 StepAudio 3 语音大模型矩阵,一次推出五款模型
阶跃星辰发布 StepAudio 3 语音大模型矩阵,一次推出五款模型
发生了什么
9月15日,国内大模型公司阶跃星辰发布 StepAudio 3 系列语音大模型,一口气推出五款,覆盖"听、说、唱、做音效"全链路:
- Realtime:实时全双工语音对话,能一边听一边回、中途打断也不乱;
- ASR:语音识别转文字;
- TTS:真人级语音合成;
- Gen:音效生成(人声、环境音、配乐一把抓);
- Music:支持 ABC 记谱法多轮交互创作音乐。
据官方披露,Realtime 在 Artificial Analysis 的对话动态榜综合得分 98.9% 居全球第一,语音推理准确率 99.7%;ASR 非流式词错误率仅 1.7%。五款模型均已上线阶跃开放平台。
对我有什么用
过去要做一款像样的语音产品,得分别接识别、合成、对话好几个模型,还得自己拼"打断""音色"等细节。StepAudio 3 把这一整套打包成一套统一语音底座,而且实时对话榜单位列第一,意味着中小团队不用从头造轮子,也能做出响应自然、能打断、会创作的语音应用。
我可以怎么做
- 想做语音助手 / 智能客服 / 有声内容的个人或小团队:可以直接调阶跃开放平台的 Realtime 和 TTS,做会聊天的播客、会配音的短视频、会接单的语音机器人。
- 做音乐 / 短视频配乐:用 Music 模型按记谱法多轮改稿,或用 Gen 生成环境音和人声,降低素材成本。
- 普通用户暂时用不到原模型,但搭载它的 App(语音陪伴、配音工具等)会更快更好用。
温馨提醒
- 模型已上线开放平台,具体调用价格、免费额度以阶跃官方为准;商用注意并发和合规。
- 语音合成涉及声音权与肖像权,用真人音色或模仿他人说话前确认授权,避免侵权。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法