当前位置: 首页 - 学院 - 资讯 - 其他资讯 - 正文

阿里千问推出语音合成大模型Qwen-Audio-3.0-TTS,登顶Artificial Analysis榜单

2026-07-23 17:33:56 来源:互联网 作者:down

千问-阿里ai助手

千问-阿里ai助手

软件类型:办公软件 软件大小:2.93MB 软件平台:  WinALL  软件语言:简体

查看详情

      7月20日消息,阿里通义千问推出全新语音合成大模型Qwen-Audio-3.0-TTS,模型分为两款版本:适配实时交互场景的Flash版,首包延迟低至300毫秒;主打高品质音频生成的Plus版。

      官方介绍,该新版模型在精细化标签调控、自由风格指令执行、多语种及方言支持、复杂声学环境稳定性等多项能力上完成全面升级,让合成语音不再局限于基础发声,而是具备丰富情感表达能力。在国际第三方权威评测榜单ArtificialAnalysis中,Qwen-Audio-3.0-TTS-Plus取得综合排名第一。

阿里千问推出语音合成大模型Qwen-Audio-3.0-TTS,登顶Artificial Analysis榜单

      Qwen-Audio-3.0-TTS支持文本嵌入结构化标签,用户可添加抽气、轻笑、愤怒等专属标记,精准调节语音的情绪、语气与呼吸细节,实现精细化的语音表达控制。

      该模型配备即用型精品音色库,将多语种、方言、指令控制等核心能力落地为可直接调用的音色资源,后续将陆续上线风格指令、20种方言、细粒度调控及14种以上小语种音色。同时模型音频输出规格从24KHz升级至48KHz,达到录音棚、影视配音级音质,单次可支持最长3分钟的连续语音合成。

      在多语种适配方面,Qwen-Audio-3.0-TTS-Plus经过专项优化,总共支持中、英、日、韩、德等16种语言,新增阿拉伯语、越南语、马来语、菲律宾语;方言覆盖范围丰富,包含广东、重庆、东北、陕西、上海、四川、云南等20种主流方言。

阿里千问推出语音合成大模型Qwen-Audio-3.0-TTS,登顶Artificial Analysis榜单截图