新模型 2026-09-23

阿里发布 Qwen-Audio-3.1 语音大模型,语音识别价格大降

阿里发布 Qwen-Audio-3.1 语音大模型,语音识别价格大降

一句话说清:阿里一口气出了 5 款“会听会说的 AI 模型”,把语音转文字的价格打下来约 95%,做字幕、记会议再也不贵。

发生了什么

9 月 23 日,阿里发布 Qwen-Audio-3.1 系列语音大模型,包含 5 款不同定位的模型,覆盖语音识别(ASR)、语音合成(TTS)、声音理解等能力。官方把语音识别的调用价格下调约 95%,意味着同样一小时录音的转写成本几乎只剩原来的零头。

对我有什么用

  • 开会、上课、访谈的录音,几秒钟就变文字稿,再也不用自己慢慢听写。
  • 给视频加字幕、把播客转成文章,成本大幅降低,个人也能用得起。
  • 想做“语音助手”“有声内容”的小项目,现在有了便宜好用的底座。

我可以怎么做

  1. 打开阿里云百炼平台(bailian.cloud.aliyun.com)或通义 App。
  2. 在“模型广场”里找到 Qwen-Audio 相关的语音模型。
  3. 上传一段录音或输入文字,点“生成”就能看到转写或合成结果。

温馨提醒

  • 免费额度有限,量大了还是要按量付费,先小范围试再批量用。
  • 涉及隐私的录音(如内部会议)注意平台的数据使用条款,敏感内容别随便上传。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发