STORY · 事件已收束

Qwen-Audio-3.0-TTS Plus 在 Artificial Analysis 榜单夺冠

1 个精选信源 · 1 篇报道持续 1最新动态 14天前
最新进展

Qwen-Audio-3.0-TTS 发布:从“能说话”到“会表达”

TIMELINE

报道时间线

1 条公开报道 · 官方一手 1 条 · 最新在前
  1. Qwen-Audio-3.0-TTS 发布:从“能说话”到“会表达”
    公众号:通义实验室(千问)官方一手精选

    通义实验室发布 Qwen-Audio-3.0-TTS 实时语音合成模型,含 Flash 与 Plus 两个版本,首包延迟约 300ms。模型支持 16 种语言和 20 种方言,Plus 版在 Artificial Analysis 榜单夺冠,平均说话人相似度达 82.75。新增 Free-style 自然语言指令、细粒度标签控制及嘈杂环境鲁棒性,音频输出提升至 48K,单次合成最长 3 分钟。