今天,我们推出全新的 3.8 Flash 模型,这是我们在短短 6 周内发布的第三款 Flash 版本。
与 3.7 Flash 相比,它在软件工程、智能体任务和多步推理方面实现了显著飞跃。在 DeepSWE v1.1 基准上,它以极低的成本,在端到端自主解决复杂工程问题方面超越了大多数更大的前沿模型。
Google 发布 Gemini 3.8 Flash,为 6 周内第 3 次 Flash 更新。官方称相较 3.7 Flash 在软件工程、智能体任务和多步推理上有显著提升,在 DeepSWE v1.1 上以更低成本自主端到端解决复杂工程问题,表现超越多数更大的前沿模型。图中基准显示其 Terminal-bench 2.1 得 89.4%、HLE-Verified 得 54.9%,输入价格 $0.75/1M tokens、输出 $3.75/1M tokens,为 2026 年 12 月 31 日前 introductory 价。详情见 https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
Google 发布 Gemini 3.8 Flash,为 6 周内第 3 次 Flash 更新。官方称相较 3.7 Flash 在软件工程、智能体任务和多步推理上有显著提升,在 DeepSWE v1.1 上以更低成本自主端到端解决复杂工程问题,表现超越多数更大的前沿模型。图中基准显示其 Terminal-bench 2.1 得 89.4%、HLE-Verified 得 54.9%,输入价格 $0.75/1M tokens、输出 $3.75/1M tokens,为 2026 年 12 月 31 日前 introductory 价。详情见 https://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/
原文给出模型能力变化、定价和多项基准对比,读者可据此评估它相对更大模型的性价比与适用场景。
今天,我们推出全新的 3.8 Flash 模型,这是我们在短短 6 周内发布的第三款 Flash 版本。
与 3.7 Flash 相比,它在软件工程、智能体任务和多步推理方面实现了显著飞跃。在 DeepSWE v1.1 基准上,它以极低的成本,在端到端自主解决复杂工程问题方面超越了大多数更大的前沿模型。
来源:Sundar Pichai· x.com