18:34量子位@梦晨阿里发布Qwen-Audio-3.0-TTS,在Global TTS Benchmark中位列第一。该模型支持20种中文方言合成,覆盖吴语、粤语、闽语等方言区。通过细粒度标签控制情感、语调、语速,实现高表现力语音生成。在MOS评分和自然度测试中超越GPT-4o等主流模型。AI模型Qwen-Audio-3.0-TTS阿里语音合成推荐理由:阿里出了个超强语音模型,能说20种方言,情感语调都能调,榜单第一,快去试试合成效果。原文稍后读已读值得跟进有用关注 Qwen-Audio-3.0-TTS
16:57IT之家(博客/媒体)阿里千问发布语音合成大模型Qwen-Audio-3.0-TTS,包含Flash(首包延时300ms级别)和Plus两个版本。在Artificial Analysis全球榜单中,Qwen-Audio-3.0-TTS-Plus位列第一。模型支持在文本嵌入[gasp]、[giggles]等结构化标签精细控制语气情绪。覆盖中、英、日、韩、德等16种语言及20种方言,音频输出提升至48KHz,单次合成可达3分钟。AI模型Qwen-Audio-3.0-TTS阿里千问语音合成推荐理由:阿里千问新语音模型能通过标签控制语气情绪,支持16种语言和20种方言,48KHz音质,试试让语音笑或生气。原文稍后读已读值得跟进有用关注 Qwen-Audio-3.0-TTS