DeepSeek 发布 DeepSeek-V4-Flash 正式版 API
DeepSeek-V4-Flash正式版API公测,Agent能力大幅升级,多项基准远超V4-Pro-Preview。
事件全貌
2026年7月31日,DeepSeek宣布DeepSeek-V4-Flash正式版API上线公测,Agent能力大幅增强。该模型在多项基准测试中表现突出:Terminal Bench 2.1得分82.7,NL2Repo得分54.2,Cybergym得分76.7,DeepSWE得分54.4,Toolathlon verified得分70.3,均远超V4-Pro-Preview版本。部分指标已接近Claude Opus 4.8(如Terminal Bench 82.7 vs 85),并超越GLM-5.2。
模型参数保持不变,仍为284B总参、13B激活的MoE架构,支持1M上下文,但通过后训练与Agent框架优化,代码Agent能力显著提升,DeepSWE得分从7.3飙升至54.4(涨7.5倍),Cybergym翻倍至76.7。
官方V4-Flash原生支持Responses API格式,并已完全适配Codex,相关配置详见官方API文档。有观点认为,长Agent循环是费用堆积之处,将昂贵任务路由给更大模型的理由已不存在。价格方面,输入每百万tokens 0.14美元,输出每百万tokens 0.28美元。老用户API自动切换新版,仅更新Flash API,V4 Pro正式版仍在开发中。官方还预告了Agent框架DeepSeek Harness,并计划在8号支持接入Codex,提供一键配置脚本,保留MCP及项目信任等级。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
报道时间线
- DeepSeek V4-Flash-0731 公测:代码 Agent 能力大涨,价格不变
DeepSeek 正式公测 V4-Flash-0731,未加参数,纯靠后训练与 Agent 框架优化,将 DeepSWE 榜从 7.3 提升至 54.4,Cybergym 翻倍至 76.7,部分硬榜接近 Claude Opus 4.8。价格不变,原生支持 Responses API,老用户 API 自动切换新版。仅更新 Flash API,V4 Pro 正式版仍在开发中。
- DeepSeek V4-Flash 公测,后训练性能碾压闭源
DeepSeek V4-Flash 正式版 API 今日公测,架构不变(284B 总参数、13B 激活的 MoE),仅靠后训练与 Agent 框架优化,DeepSWE 从 7.3 升至 54.4,Terminal Bench 达 82.7(Opus 为 85)。
- DeepSeek-V4-Flash 公测,Agent 能力大幅跃升
DeepSeek-V4-Flash-Preview 官方 API 已进入公开测试,Agent 能力大幅升级,基准分数远超 V4-Pro-Preview,并原生支持 Responses API 格式、完全适配 Codex。主推文称其 TerminalBench-2.1 分数跃升 20+ 点,价格低至 1M tokens 输入 $0.14、输出 $0.28。
- DeepSeek-V4-Flash 发布,性能超 V4-Pro-Preview
DeepSeek-V4-Flash 官方 API 公开测试版上线,Agent 能力大幅升级,基准分数远超 V4-Pro-Preview,并原生支持 Responses API 格式、适配 Codex。
- DeepSeek V4-Flash 公测,后训练让 Agent 能力暴涨
DeepSeek V4-Flash-0731 正式版 API 今日公测,参数未变(284B 总参、13B 激活 MoE、1M 上下文),纯靠后训练与 Agent 框架优化,DeepSWE 从 7.3 飙至 54.4(涨 7.5 倍),Terminal Bench 达 82.7,逼近 Claude Opus 4.8 的 85。
- DeepSeek-V4-Flash 公测 API 上线,Agent 能力大幅升级
DeepSeek-V4-Flash 官方 API 现已公开测试上线,Agent 能力大幅升级,Terminal Bench 2.1 得分 82.7,超越更大的 V4-Pro-Preview。V4-Flash 原生支持 Responses API 格式并完全适配 Codex,配置详见官方 API 文档。主推文认为,将昂贵任务路由给更大模型的理由已不存在,长 Agent 循环正是费用堆积之处。
- DeepSeek V4-Flash 公测,代码 Agent 能力暴涨 7 倍
DeepSeek 正式公测 V4-Flash-0731,纯靠后训练与 Agent 框架优化(参数不变,仍为 284B 总参、13B 激活 MoE、1M 上下文),将代码 Agent 能力大幅提升:DeepSWE 榜从 7.3 飙至 54.4,Cybergym 翻倍至 76.7,Terminal Bench 达 82.7,部分指标已接近 Claude Opus 4.8。
- DeepSeek-V4-Flash 官方 API 上线,Agent 能力逼近 Opus 4.8
DeepSeek-V4-Flash 官方 API 公开测试版上线,Agent 能力大幅升级,基准测试远超 V4-Pro-Preview。其 DeepSWE 得分 54.4%、TerminalBench 得分 82.7%,均逼近 Opus 4.8 并超越 GLM-5.2。
- DeepSeek V4 Flash 正式版在九项 Agent 测试中全部超过 V4 Pro Preview
DeepSeek V4 Flash 正式版在九项 Agent 测试中全部超过 V4 Pro Preview,其中 DeepSWE 长周期功能开发得分提升 7.5 倍。模型结构和尺寸未变,仅重新后训练,价格不变。官方还预告了 Agent 框架 DeepSeek Harness,并计划在 8 号支持接入 codex,提供一键配置脚本,保留 MCP 及项目信任等级。
- DeepSeek-V4-Flash API公测上线,Agent能力大幅升级
🚀 DeepSeek-V4-Flash 官方 API 现已上线公测! 🔷 我们大幅升级了其 Agent 能力——基准测试分数现已远超 V4-Pro-Preview。查看下方巨大的性能飞跃!👇 🔷 官方 V4-Flash 现已原生支持 Responses API 格式,并已完全适配 Codex! 查看我们官方 API 文档中的配置详情:https://api-docs.deepseek.com/quick_start/agent_integrations/codex
- DeepSeek V4 Flash 正式版发布:后训练重做,九项 Agent 测试全面超越 V4 Pro Preview
DeepSeek V4 Flash 正式版发布,模型结构和参数规模不变,仅重做后训练,Terminal Bench 2.1 从 61.8 涨至 82.7,DeepSWE 从 7.3 涨至 54.4。
- DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力基准测试远超 V4-Pro 预览版
DeepSeek 今日宣布 DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力大幅增强,Terminal Bench 2.1 得分 82.7,NL2Repo 54.2,Cybergym 76.7,DeepSWE 54.4,Toolathlon verified 70.3,多项基准远超 V4-Pro-Preview。