Google DeepMind 推出 Gemini 3.5 Transcribe 语音转文本模型,支持流式与非流式两种 API。据 Artificial Analysis 评测,其流式与非流式平均词错率分别为 4.0% 和 2.6%,支持超 85 种语言、自定义词汇及最多三人说话人识别。
另有 7 家信源报道Ars Technica:AI(RSS)X:Logan Kilpatrick (@OfficialLoganK)X:Artificial Analysis (@ArtificialAnlys)The Verge:AI(RSS)X:Google AI (@GoogleAI)X:Sundar Pichai (@sundarpichai)X:Rohan Paul (@rohanpaul_ai)