周二,Google DeepMind 发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber。Gemini 3.6 Flash 是谷歌的“主力模型”,承诺在编程、知识工作和多模态性能方面有所提升,同时将模型 token 使用量降低高达 17%,使其比前代产品 3.5 Flash 更便宜。
Gemini 3.5 Flash-Lite 是该系列中性价比最高的模型,而 3.5 Flash Cyber 则是一款专用模型,经过微调,能以合理的价格发现并修复网络安全漏洞。据谷歌称,该模型将作为有限访问试点计划的一部分,独家提供给政府和受信任的合作伙伴。
谷歌表示,这些版本的重点是为大规模构建 AI 智能体的客户提供效率、低延迟和可靠性。
此次发布引人注目,不仅在于谷歌推出了什么——针对编程、效率和网络安全进行了优化的更便宜、更快的模型——还在于它没有推出什么。此次更新并未包含人们期待已久的谷歌旗舰模型 Gemini Pro 的更新,该模型上一次更新是在二月份。
自那次发布以来,OpenAI 已经发布了 GPT-5.5 并开始推出 GPT-5.6,而 Anthropic 则推出了 Claude Opus 4.8、Claude Sonnet 5,并扩大了对前沿模型 Fable 5 的访问权限,凸显了竞争对手实验室紧张的发布节奏。
谷歌曾在五月份随 3.5 Flash 发布时预告了 Pro 版本的推出,称 Pro 版本“已在内部使用,我们期待下个月将其推出”。上周,彭博社报道称,谷歌在推出 3.5 Pro 时面临内部延迟,因为其难以达到内部性能目标。
Gemini Pro 模型通常是谷歌为复杂推理和编程任务提供的最高能力产品,而 Flash 模型则优先考虑生产应用中的更低成本和更快响应时间。
Google DeepMind 产品负责人 Logan Kilpatrick 周二表示,该公司目前正在与合作伙伴一起测试 Gemini 3.5 Pro,并希望“很快落地”。他还指出,团队已经开始了迄今为止最雄心勃勃的 Gemini 4 预训练工作。