新模型 2026-09-15

阶跃星辰发布 StepAudio 3 语音大模型矩阵,一次推出五款模型

阶跃星辰发布 StepAudio 3 语音大模型矩阵,一次推出五款模型

发生了什么

9月15日,国内大模型公司阶跃星辰发布 StepAudio 3 系列语音大模型,一口气推出五款,覆盖"听、说、唱、做音效"全链路:

  • Realtime:实时全双工语音对话,能一边听一边回、中途打断也不乱;
  • ASR:语音识别转文字;
  • TTS:真人级语音合成;
  • Gen:音效生成(人声、环境音、配乐一把抓);
  • Music:支持 ABC 记谱法多轮交互创作音乐。

据官方披露,Realtime 在 Artificial Analysis 的对话动态榜综合得分 98.9% 居全球第一,语音推理准确率 99.7%;ASR 非流式词错误率仅 1.7%。五款模型均已上线阶跃开放平台。

对我有什么用

过去要做一款像样的语音产品,得分别接识别、合成、对话好几个模型,还得自己拼"打断""音色"等细节。StepAudio 3 把这一整套打包成一套统一语音底座,而且实时对话榜单位列第一,意味着中小团队不用从头造轮子,也能做出响应自然、能打断、会创作的语音应用。

我可以怎么做

  • 想做语音助手 / 智能客服 / 有声内容的个人或小团队:可以直接调阶跃开放平台的 Realtime 和 TTS,做会聊天的播客、会配音的短视频、会接单的语音机器人。
  • 做音乐 / 短视频配乐:用 Music 模型按记谱法多轮改稿,或用 Gen 生成环境音和人声,降低素材成本。
  • 普通用户暂时用不到原模型,但搭载它的 App(语音陪伴、配音工具等)会更快更好用。

温馨提醒

  • 模型已上线开放平台,具体调用价格、免费额度以阶跃官方为准;商用注意并发和合规。
  • 语音合成涉及声音权与肖像权,用真人音色或模仿他人说话前确认授权,避免侵权。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发