不只说得对,还说得像,阿里语音合成大模型能力得分全球第一

2026-09-28 13:04:05
来源:潮新闻
分享
文章提及标的

9月28日,在全球权威AI评测平台Artificial Analysis的语音排行榜(Controlled Voice Arena)上,阿里巴巴(BABA)最近发布的语音大模型Qwen-Audio-3.1-TTS以1177的Elo评分位列全球第一。

榜单一览(受访者供图)

Qwen-Audio-3.1-TTS是阿里新一代语音合成大模型,支持多语种及方言合成。该模型能够让同一音色在不同语言之间自然迁移,用一种声音自然讲出多种语言。相比传统语音合成主要关注字音是否正确,Qwen-Audio-3.1-TTS更强调声音是否符合具体内容和使用场景。用户可通过指令控制情绪、语速和表达方式,让合成语音不只“说得对”,也能“说得像”。

此次登顶的是阿里在2026云栖大会发布的Qwen-Audio-3.1系列中的TTS模型,该系列还包括语音转写(ASR)和实时语音交互(Realtime)两类模型,三大模型的API服务均已上架千问AI平台。此外,阿里语音团队开源的多款模型如Qwen-Audio-Agent、CosyVoice在 GitHub 上累计获得了数万星标,深受海内外开发者关注。

目前,Qwen-Audio全线语音模型价格均已下调,最高降幅达95%,为开发者和企业的广泛语音应用大幅节省成本。

免责声明:风险提示:本文内容仅供参考,不代表同花顺观点。同花顺各类信息服务基于人工智能算法,如有出入请以证监会指定上市公司信息披露平台为准。如有投资者据此操作,风险自担,同花顺对此不承担任何责任。
homeBack返回首页
不良信息举报与个人信息保护咨询专线:10100571违法和不良信息涉企侵权举报涉算法推荐举报专区涉青少年不良信息举报专区

浙江同花顺互联信息技术有限公司版权所有

网站备案号:浙ICP备18032105号
证券投资咨询服务提供:浙江同花顺云软件有限公司 (中国证监会核发证书编号:ZX0050)
AIME