STORY · 事件已收束

DeepSeek-V4-Flash 在 Terminal Bench 2.1 得分 82.7

9 个精选信源 · 13 篇报道持续 2最新动态 17天前
最新进展

DeepSeek 发布 V4-Flash-0731 正式版权重,MIT 许可,API 定价每百万输入 $0.14、输出 $0.28。

DIGEST

事件全貌

AI 综述 · 更新于 17天前

DeepSeek 于 2026 年 7 月 31 日宣布 DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力大幅增强。在 Terminal Bench 2.1 上得分 82.7,NL2Repo 54.2,Cybergym 76.7,DeepSWE 54.4,Toolathlon verified 70.3,多项基准远超 V4-Pro-Preview。模型参数保持不变,仍为 284B 总参、13B 激活 MoE、1M 上下文,提升来自后训练与 Agent 框架优化。

官方表示 V4-Flash 原生支持 Responses API 格式,并已完全适配 Codex,调用方式不变,将模型名设为 deepseek-v4-flash 即可使用。

有分析指出,DeepSWE 得分从 7.3 飙升至 54.4,Cybergym 翻倍至 76.7,部分指标已接近 Claude Opus 4.8。Artificial Analysis 智能指数得分 50,较上代提升 10 分,领先 V4 Pro 6 分,单位任务价格目前无人能敌,进入智能与成本帕累托前沿。

最新报道称,DeepSeek 已发布 V4-Flash-0731 正式版权重,取代预览版,采用与 DSpark 相同的模型结构并附带投机解码模块,以 MIT 许可证发布。该版本以更小的激活参数量在多项基准上超越 V4-Pro(预览版),并与最强闭源模型基本持平。API 定价为缓存未命中时每百万输入 token $0.14,输出 token $0.28。有报道称参数为 3040 亿,但多数报道仍为 284B,此处采信多数报道。另有报道称输出 token 价格为 $0.27,与 $0.28 略有出入,但差异微小。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

TIMELINE

报道时间线

13 条公开报道 · 官方一手 1 条 · 最新在前
  1. DeepSeek V4 Flash 3美分定价击穿行业斩杀线
    X:阿易 AI Notes (@AYi_AInotes)

    DeepSeek V4 Flash 0731以单任务3美分成本、50分智能得分,将Claude Opus、GPT-5.6 Sol等10美分至3美元价位的模型全部划入“斩杀线”。

  2. DeepSeek-V4-Flash 正式版跑分报告:约 98% 缓存命中折扣打造 AI 极致性价比
    IT之家(RSS)

    DeepSeek-V4-Flash 正式版 API 上线公测,在 Artificial Analysis 智能指数(AII)中获 50 分,较 4 月版提升 10 分,比 V4 Pro 高 6 分,仅比 GPT-5.6 Luna 低 1 分。

  3. DeepSeek-V4-Flash-0731 发布:304B 参数,智能体能力大幅增强
    Simon Willison 博客

    DeepSeek 发布 V4 系列最新模型 DeepSeek-V4-Flash-0731,拥有 3040 亿参数,智能体能力大幅增强。Artificial Analysis 评测显示其表现优于 428B 参数的 MiniMax M3。定价为每百万输入 token 0.14 美元、每百万输出 token 0.27 美元,可能是当前性价比最高的模型。

  4. DeepSeek 发布 DeepSeek-V4-Flash-0731,智能体与编程能力大幅提升
    MarkTechPost(RSS)

    DeepSeek 于 7 月 31 日发布 DeepSeek-V4-Flash-0731,并将 V4-Flash API 开放公测。该版本沿用 284B 参数 MoE 架构,通过重新后训练实现性能跃升,在智能体基准上全面超越 V4-Pro(预览版)。API 定价为缓存未命中时每百万输入 token $0.14,输出 token $0.28,权重采用 MIT 许可。

  5. DeepSeek V4 Flash 0731 开源,登顶开源模型前三
    X:Artificial Analysis (@ArtificialAnlys)精选

    DeepSeek 发布开源模型 DeepSeek V4 Flash 0731,在 Artificial Analysis 智能指数上得分 50,位列开源模型前三。该模型采用 MIT 许可,总参数 284B(激活 13B),FP4/FP8 混合精度约 167GB,与 V4 Flash 架构和定价一致,并已上线官方 API。

  6. DeepSeek V4 Flash 0731 权重发布
    X:Kim (@kimmonismus)

    DeepSeek 发布 V4-Flash-0731 正式版权重,取代预览版,采用与 DSpark 相同的模型结构并附带投机解码模块。该版本智能体能力大幅增强,以更小的激活参数量在多项基准上超越 V4-Pro(预览版),并与最强闭源模型基本持平,采用 MIT 许可证。

  7. DeepSeek-V4-Flash 发布,性能超 V4-Pro-Preview
    X:Emad Mostaque (@EMostaque)

    DeepSeek-V4-Flash 官方 API 公开测试版上线,Agent 能力大幅升级,基准分数远超 V4-Pro-Preview,并原生支持 Responses API 格式、适配 Codex。

  8. DeepSeek V4 Flash 0731 发布,智能指数跃升 10 分
    X:Artificial Analysis (@ArtificialAnlys)

    DeepSeek V4 Flash 0731 在 Artificial Analysis 智能指数上得 50 分,较 4 月版提升 10 分,领先 V4 Pro 6 分,并进入智能与成本帕累托前沿。

  9. DeepSeek v4 Flash 智能指数得分 50,单位任务价格无敌
    X:Kim (@kimmonismus)

    DeepSeek v4 Flash 在 Artificial Analysis 智能指数上得分 50,较上代提升 10 分,单位任务价格目前无人能敌。其 DeepSWE 达 54.4%,超越 GLM-5.2 和 4 Pro,几乎持平 Opus 4.8;TerminalBench 82.7%,同样逼近 Opus 4.8。

  10. DeepSeek V4-Flash 公测,代码 Agent 能力暴涨 7 倍
    X:阿易 AI Notes (@AYi_AInotes)

    DeepSeek 正式公测 V4-Flash-0731,纯靠后训练与 Agent 框架优化(参数不变,仍为 284B 总参、13B 激活 MoE、1M 上下文),将代码 Agent 能力大幅提升:DeepSWE 榜从 7.3 飙至 54.4,Cybergym 翻倍至 76.7,Terminal Bench 达 82.7,部分指标已接近 Claude Opus 4.8。

  11. DeepSeek-V4-Flash API 公开测试版发布,智能体能力大幅提升
    Hacker News 热门(buzzing.cc 中文翻译)

    DeepSeek-V4-Flash API 正式进入公开测试阶段,调用方式不变,将模型名设为 deepseek-v4-flash 即可使用。

  12. DeepSeek-V4-Flash API公测上线,Agent能力大幅升级
    X:DeepSeek (@deepseek_ai)官方一手精选

    🚀 DeepSeek-V4-Flash 官方 API 现已上线公测! 🔷 我们大幅升级了其 Agent 能力——基准测试分数现已远超 V4-Pro-Preview。查看下方巨大的性能飞跃!👇 🔷 官方 V4-Flash 现已原生支持 Responses API 格式,并已完全适配 Codex! 查看我们官方 API 文档中的配置详情:https://api-docs.deepseek.com/quick_start/agent_integrations/codex

  13. DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力基准测试远超 V4-Pro 预览版
    IT之家(RSS)

    DeepSeek 今日宣布 DeepSeek-V4-Flash 正式版 API 上线公测,Agent 能力大幅增强,Terminal Bench 2.1 得分 82.7,NL2Repo 54.2,Cybergym 76.7,DeepSWE 54.4,Toolathlon verified 70.3,多项基准远超 V4-Pro-Preview。