语音合成大模型
-
阿里发布语音合成大模型Qwen-Audio-3.0-TTS:Flash首包300ms级别,Plus登顶全球榜单
7月20日晚间消息,阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度标签控制、freestyle指令遵循、多语种与方言覆盖以及复杂声学鲁棒性等方面系统性提升,包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本,让合成语音从“能说话”走向“会表达”。目前,在全球第三方权威榜单Artificial Analysis,Qwen-Audio-3.0-TTS-Plus斩获冠军。
-
阿里千问语音合成大模型Qwen-Audio-3.0-TTS发布,多语言方言支持且登顶权威榜单
阿里千问语音合成大模型Qwen-Audio-3.0-TTS发布,多语言方言支持且登顶权威榜单


