小米 MiMo-V2.5-ASR 全链路语音模型听觉基座上线,定价 0.5 元/小时

IT之家(RSS)·2026-07-07 10:02·56天前
AI 导读

7月7日,小米旗下 MiMo-V2.5-ASR 全链路语音模型听觉基座正式上线。该模型在中文方言(粤语、吴语、闽南语、四川话等)、中英混转、歌曲识别、强噪音与远场拾音、多人交叉对话、古诗词/专业术语/人名地名知识关联以及原生标点输出等场景均宣称达到业界领先水平。API 按音频转写时长计费,国内 ¥0.5/小时,海外 $0.074/小时。

IT之家(RSS)
69AI 编辑部评分,满分 100

小米 MiMo-V2.5-ASR 全链路语音模型听觉基座上线,定价 0.5 元/小时

2026-07-07 10:02· 56天前
AI 导读

7月7日,小米旗下 MiMo-V2.5-ASR 全链路语音模型听觉基座正式上线。该模型在中文方言(粤语、吴语、闽南语、四川话等)、中英混转、歌曲识别、强噪音与远场拾音、多人交叉对话、古诗词/专业术语/人名地名知识关联以及原生标点输出等场景均宣称达到业界领先水平。API 按音频转写时长计费,国内 ¥0.5/小时,海外 $0.074/小时。

小米 MiMo-V2.5-ASR 全链路语音模型听觉基座上线,定价 0.5 元 / 小时

Ddddavid

千黛嘉美

IT之家 7 月 7 日消息,小米 Mimo 今日宣布 MiMo-V2.5-ASR 正式上线。

作为全链路语音模型听觉基座,MiMo-V2.5-ASR 宣称在方言、双语、强噪音、多说话人等复杂真实场景下均达到业界领先水平

  • 中文方言:覆盖粤语、吴语、闽南语、四川话等

  • Code- Switch:中英混转自由流畅,无需预设语种

  • 歌曲识别:中英文歌词,伴奏人声混合场景高精度识别

  • 强噪音:高噪音、远场拾音等复杂环境中鲁棒识别

  • 多说话人:多人交叉对话场景准确转录

  • 知识关联:古诗词、专业术语、人名地名精准识别

  • 原生标点:结合韵律与语义直接输出标点,转写即用

MiMo-V2.5-ASR 已开放 API 并支持在 Token Plan 中使用。

API 定价:按照音频转写时长计费,国内¥0.5/h,海外 $0.074 /h

IT之家附接入文档链接如下:

来源:IT之家(RSS)· ithome.com