Qwen-Audio-3.0系列语音模型上线阿里千问AI平台,斩获三项全球第一

IT之家(RSS)·2026-08-17 16:01·19天前
AI 导读

阿里云今日宣布Qwen-Audio-3.0系列语音模型上线千问AI平台和阿里云百炼平台,开发者可通过API或订阅Token Plan调用。该系列包含ASR、TTS和实时交互三款模型,在Artificial Analysis今年7月语音排行榜上斩获三个赛道全球第一,目前已应用于千问App、千问办公、Qoder等产品。

IT之家(RSS)
57AI 编辑部评分,满分 100

Qwen-Audio-3.0系列语音模型上线阿里千问AI平台,斩获三项全球第一

2026-08-17 16:01· 19天前
AI 导读

阿里云今日宣布Qwen-Audio-3.0系列语音模型上线千问AI平台和阿里云百炼平台,开发者可通过API或订阅Token Plan调用。该系列包含ASR、TTS和实时交互三款模型,在Artificial Analysis今年7月语音排行榜上斩获三个赛道全球第一,目前已应用于千问App、千问办公、Qoder等产品。

IT之家 8 月 17 日消息,今天(17 日)下午,阿里云通过公众号宣布,Qwen-Audio-3.0 系列语音模型正式上线千问 AI 平台和阿里云百炼平台。开发者可以通过 API 服务调用模型能力,也可以订阅 Token Plan 使用

Qwen-Audio-3.0 系列模型是阿里巴巴推出的自研语音模型。IT之家附具体的产品阵容如下:

  • 语音识别大模型 Qwen-Audio-3.0-ASR

  • 语音合成大模型 Qwen-Audio-3.0-TTS

  • 实时语音交互对话模型 Qwen-Audio-3.0-Realtime

根据介绍,在全球权威 AI 评测平台 Artificial Analysis 今年 7 月的语音排行榜上,该模型斩获语音识别(ASR)、实时交互(RealTime)和语音合成(TTS)三个赛道的全球第一,拿下“大满贯”。

其中,Qwen-Audio-3.0-ASR 将语音转为文字,支持复杂语境和专业领域识别;Qwen-Audio-3.0-TTS 将文字转为语音,支持多语种、多方言,可控制情绪、语气与节奏;Qwen-Audio-3.0-Realtime 支持端到端语音理解与对话,可边听边说、随时打断追问,并支持工具调用

目前,该系列模型已在千问 App、千问办公、Qoder 等产品中应用。

来源:IT之家(RSS)· ithome.com