新模型
2026-09-23
阿里发布 Qwen-Audio-3.1 语音大模型,语音识别价格大降
阿里发布 Qwen-Audio-3.1 语音大模型,语音识别价格大降
一句话说清:阿里一口气出了 5 款“会听会说的 AI 模型”,把语音转文字的价格打下来约 95%,做字幕、记会议再也不贵。
发生了什么
9 月 23 日,阿里发布 Qwen-Audio-3.1 系列语音大模型,包含 5 款不同定位的模型,覆盖语音识别(ASR)、语音合成(TTS)、声音理解等能力。官方把语音识别的调用价格下调约 95%,意味着同样一小时录音的转写成本几乎只剩原来的零头。
对我有什么用
- 开会、上课、访谈的录音,几秒钟就变文字稿,再也不用自己慢慢听写。
- 给视频加字幕、把播客转成文章,成本大幅降低,个人也能用得起。
- 想做“语音助手”“有声内容”的小项目,现在有了便宜好用的底座。
我可以怎么做
- 打开阿里云百炼平台(bailian.cloud.aliyun.com)或通义 App。
- 在“模型广场”里找到 Qwen-Audio 相关的语音模型。
- 上传一段录音或输入文字,点“生成”就能看到转写或合成结果。
温馨提醒
- 免费额度有限,量大了还是要按量付费,先小范围试再批量用。
- 涉及隐私的录音(如内部会议)注意平台的数据使用条款,敏感内容别随便上传。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法