AYi@AYi_AInotes
69AI 编辑部评分,满分 100
2026-07-31 16:15· 59分钟前
跳到正文
AI 摘要

DeepSeek V4-Flash-0731 正式版 API 今日公测,参数未变(284B 总参、13B 激活 MoE、1M 上下文),纯靠后训练与 Agent 框架优化,DeepSWE 从 7.3 飙至 54.4(涨 7.5 倍),Terminal Bench 达 82.7,逼近 Claude Opus 4.8 的 85。

你永远可以相信开源的力量!!!! DeepSeek V4-Flash 82.7, 价格只有 $0.14 / $0.28, 性价比直接碾压旁边的闭源模型。

V4-Flash正式版API今天公测, 讲真DeepSeek这波后训练,离谱到我以为看错数字了。

模型架构一个字没动,还是284B总参数13B激活的MoE。 就靠后训练+Agent框架优化。 DeepSWE从7.3直接干到54.4,翻了7.5倍。 Terminal Bench 82.7,Opus是85, Cybergym 76.7,Opus是83.1, 之前的V4-Pro Preview,被自己家Flash全面反超。

最狠的是价格, 输入$0.14每M token,输出$0.28, 做Agent、做SWE、做工具调用的,自己算笔账。

之前用Opus跑一遍的钱,现在能跑几十遍, 原生支持Responses API,Codex直接适配,不用改代码。

这才是最恐怖的地方, 不是又出了个更强的大模型。 是小模型靠后训练,在垂直Agent任务上已经摸到第一梯队的门了。

轻、快、便宜,还能打, 做Agent应用的,今天就该去测!!!!

AYi我去,DeepSeek这波是真杀疯了,还是那个13B激活的便宜Flash模型,参数半毛钱没加,纯靠后训练就直接把代码Agent能力干涨7倍, 价格还是地板价, 都快摸到Opus的边了!!! 今天正式开公测的V4-Flash-0731,看完成绩单我直接傻了: ▫️ DeepSWE榜从7.3直接飙到54.4,翻了快7.5倍...
AYi · @AYi_AInotes · X·2026-07-31 16:15·59分钟前
在 X 看原推· x.com
AI 摘要

DeepSeek V4-Flash-0731 正式版 API 今日公测,参数未变(284B 总参、13B 激活 MoE、1M 上下文),纯靠后训练与 Agent 框架优化,DeepSWE 从 7.3 飙至 54.4(涨 7.5 倍),Terminal Bench 达 82.7,逼近 Claude Opus 4.8 的 85。

你永远可以相信开源的力量!!!! DeepSeek V4-Flash 82.7, 价格只有 $0.14 / $0.28, 性价比直接碾压旁边的闭源模型。

V4-Flash正式版API今天公测, 讲真DeepSeek这波后训练,离谱到我以为看错数字了。

模型架构一个字没动,还是284B总参数13B激活的MoE。 就靠后训练+Agent框架优化。 DeepSWE从7.3直接干到54.4,翻了7.5倍。 Terminal Bench 82.7,Opus是85, Cybergym 76.7,Opus是83.1, 之前的V4-Pro Preview,被自己家Flash全面反超。

最狠的是价格, 输入$0.14每M token,输出$0.28, 做Agent、做SWE、做工具调用的,自己算笔账。

之前用Opus跑一遍的钱,现在能跑几十遍, 原生支持Responses API,Codex直接适配,不用改代码。

这才是最恐怖的地方, 不是又出了个更强的大模型。 是小模型靠后训练,在垂直Agent任务上已经摸到第一梯队的门了。

轻、快、便宜,还能打, 做Agent应用的,今天就该去测!!!!

AYi我去,DeepSeek这波是真杀疯了,还是那个13B激活的便宜Flash模型,参数半毛钱没加,纯靠后训练就直接把代码Agent能力干涨7倍, 价格还是地板价, 都快摸到Opus的边了!!! 今天正式开公测的V4-Flash-0731,看完成绩单我直接傻了: ▫️ DeepSWE榜从7.3直接飙到54.4,翻了快7.5倍...
在 X 查看原推x.com