首页 AI快讯 阿里发布Qwen-Audio-3.0-TTS语音合成大模型,

阿里发布Qwen-Audio-3.0-TTS语音合成大模型,登顶全球榜单

希鸥网AIGC专员
· 2026-07-20 · AI快讯 · 来源:36氪 1,839 次阅读

7月20日,阿里巴巴发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度标签控制、freestyle指令遵循、多语种与方言覆盖及复杂声学鲁棒性等方面实现系统性提升。该模型包含面向实时交互的Flash版本(首包延时300ms级别)和面向高质量生成的Plus版本,推动合成语音从“能说话”迈向“会表达”。

目前,在全球第三方榜单Artificial Analysis中,Qwen-Audio-3.0-TTS-Plus已登顶,其预览版Fun-Realtime-TTS也曾在一个月前占据榜首。

📖 阅读本文共 1,839 2026年07月20日 17:30
📱 长按识别 分享给好友~
💬 咨询客服 💬 客服