徽视点
26-07-20 17:05 微博认证:安徽商报社徽视点官方微博

#千问发布语音合成大模型#【#千问QwenAudio3.0TTS7夺冠全球榜单#】 7月 20 日消息,阿里千问今日发布语音合成大模型 Qwen-Audio-3.0-TTS,包含面向实时交互的 Flash 版本(首包延时 300ms 级别)和面向高质量生成的 Plus 版本。
官方表示,新模型在细粒度标签控制、freestyle 指令遵循、多语种与方言覆盖以及复杂声学鲁棒性等方面实现系统性提升,让合成语音从“能说话”走向“会表达”。在全球第三方权威榜单 Artificial Analysis,Qwen-Audio-3.0-TTS-Plus 斩获冠军。(IT之家)