老谭电商
26-09-26 10:35 微博认证:微博2018十大影响力互联网科技大V 科技博主 微博原创视频博主

阿里Qwen-Audio-3.1发布,语音模型成本砍掉七成
9月23日云栖大会,阿里把语音模型一口气放了出来。
Qwen-Audio-3.1一次推出五款:ASR、TTS、Realtime,再加两款Next升级版。
数字很直接:TTS成本降70%,实时对话降85%,识别降95%。API已经上架千问平台。
这意味着什么?
过去做语音客服、实时翻译、智能录音,最烧钱的就是通话时长和识别调用。成本砍掉一大截,原来算不过账的场景,现在能跑了。
我做新媒体这些年,团队最头疼的就是把长视频、长会议转成文字再剪。识别一降95%成本,这类活儿的门槛直接塌下来,小团队也能玩了。
但降价从来不是终点。
阿里这波是把语音栈当基础设施在铺——先让大家都用得起,再用规模换生态。谁先卡住开发者的语音入口,谁就捏住了下一代应用的喉咙。
降价不是终点,是发令枪。语音能力一旦便宜到可以随便用,竞争就从“谁的模型强”转到“谁把语音用出了新场景”。中小团队最该盯的,是那些过去因为成本不敢碰的语音产品。
你最希望语音模型帮你在哪件事上省时间?

发布于 江苏