STORY · 事件已收束

阿里通义千问发布Qwen-Audio-3.0-TTS

2 个精选信源 · 2 篇报道持续 3最新动态 14天前
最新进展

通义千问发布Qwen-Audio-3.0-TTS,登顶TTS排行榜

TIMELINE

报道时间线

2 条公开报道 · 官方一手 2 条 · 最新在前
  1. 通义千问发布Qwen-Audio-3.0-TTS,登顶TTS排行榜
    X:通义千问 / Qwen (@Alibaba_Qwen)官方一手精选

    阿里通义千问推出最新文本转语音模型Qwen-Audio-3.0-TTS,提供Flash(实时交互)和Plus(高质量生成)两个版本。新功能包括细粒度内联标签控制(如[whisper]、[angry])、自然语言风格控制、支持16种语言,以及一次生成长达3分钟的长文本。该模型目前在Artificial Analysis TTS排行榜上排名第一。

  2. Qwen-Audio-3.0-TTS 发布:从“能说话”到“会表达”
    公众号:通义实验室(千问)官方一手精选

    通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型,含 Flash 与 Plus 两个版本,首包延迟约 300ms。模型支持 16 种语言和 20 种方言,Plus 版在 Artificial Analysis 榜单夺冠,平均说话人相似度达 82.75。新增 Free-style 自然语言指令、细粒度标签控制及嘈杂环境鲁棒性,音频输出提升至 48K,单次合成最长 3 分钟。