# 通义千问发布Qwen-Audio-3.0-TTS，登顶TTS排行榜

- 来源：Qwen (@Alibaba_Qwen)
- 发布时间：2026-07-23 20:33
- AIHOT 分数：79
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmrxihn0u00e7ro4jy78efqxq
- 原文链接：https://x.com/Alibaba_Qwen/status/2080270065547809133

## 精选理由

TTS 模型终于学会控制情感和语调了，Qwen 这次把自然语言提示和细粒度标签一起放进去，做语音助手的可以直接从‘能说话’跳进‘有性格’。

## AI 摘要

阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS，提供Flash（实时交互）和Plus（高质量生成）两个版本。新功能包括细粒度内联标签控制（如[whisper]、[angry]）、自然语言风格控制、支持16种语言，以及一次生成长达3分钟的长文本。该模型目前在Artificial Analysis TTS排行榜上排名第一。

## 正文

推出 Qwen-Audio-3.0-TTS。

我们最新的文本转语音模型，提供两个版本： • Flash：实时交互 • Plus：高质量生成

新特性： • 细粒度内联标签控制——[低语]、[愤怒]、[呼吸声] 和 [笑声] • 自由风格的自然语言控制——“读慢一点，像讲睡前故事一样” • 支持 16 种语言 • 即使参考音频有噪音，也能输出干净语音 • 一次生成长文本最长可达 3 分钟

目前在 Artificial Analysis TTS 排行榜上排名第一。

博客：https://funaudiollm.github.io/qwen-audio-3.0-tts/ API：https://www.alibabacloud.com/help/en/model-studio/realtime-tts-user-guide
