通义千问发布Qwen-Audio-3.0-TTS,登顶TTS排行榜

Qwen · @Alibaba_Qwen · X·2026-07-23 20:33·45天前
AI 导读

阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS,提供Flash(实时交互)和Plus(高质量生成)两个版本。新功能包括细粒度内联标签控制(如[whisper]、[angry])、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的长文本。该模型目前在Artificial Analysis TTS排行榜上排名第一。

Qwen@Alibaba_Qwen
精选
79AI 编辑部评分,满分 100

通义千问发布Qwen-Audio-3.0-TTS,登顶TTS排行榜

2026-07-23 20:33· 45天前
AI 导读

阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS,提供Flash(实时交互)和Plus(高质量生成)两个版本。新功能包括细粒度内联标签控制(如[whisper]、[angry])、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的长文本。该模型目前在Artificial Analysis TTS排行榜上排名第一。

推荐理由

TTS 模型终于学会控制情感和语调了,Qwen 这次把自然语言提示和细粒度标签一起放进去,做语音助手的可以直接从‘能说话’跳进‘有性格’。

正文 · AI 翻译

推出 Qwen-Audio-3.0-TTS。

我们最新的文本转语音模型,提供两个版本: • Flash:实时交互 • Plus:高质量生成

新特性: • 细粒度内联标签控制--【低语】、【愤怒】、【呼吸声】 和 【笑声】 • 自由风格的自然语言控制--"读慢一点,像讲睡前故事一样" • 支持 16 种语言 • 即使参考音频有噪音,也能输出干净语音 • 一次生成长文本最长可达 3 分钟

目前在 Artificial Analysis TTS 排行榜上排名第一。

博客:https://funaudiollm.github.io/qwen-audio-3.0-tts/ API:https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide