Damn,今天真的可以过年了!!! DeepSeek今天这一下, 直接把Agent的运行成本打穿到地板了🤯🤯🤯
正式版V4-Pro 0813直接放王炸: Terminal Bench 87.9,只比最贵的Fable 5低0.1;
Cybergym 83.3,直接和Fable 5打平;DeepSWE从预览版的12.8干到62.7,全栈开发基准71.1,所有和干活相关的Agent基准,全部追平第一梯队。
最狠的是原生支持OpenAI Responses API,专门给Codex做了优化,一键就能把你Codex的后端换成DeepSeek,连代码都不用改。
价格呢?非高峰输出1.98刀一百万token,高峰也才3.96,Fable5是10刀输入50刀输出,差了几十倍。
还加了三档推理强度,简单任务用low,日常Agent用high,复杂任务开max,钱全花在刀刃上。
不开发布会,也不吹牛逼,甚至不制造焦虑, 直接把和顶级模型差不多的干活能力,
用几十分之一的价格塞到你手里,还兼容你所有的工具链。
做Agent的开发者,今天真的可以过年了。