AYi@AYi_AInotes
45AI 编辑部评分,满分 100
2026-08-03 16:27· 2小时前
跳到正文
AI 摘要

DeepSeek V4 完成同一完整 Agent 任务仅需 3 美分,而 Anthropic 最好的 Fable 5 需 3.15 美元,成本相差 105 倍。V4 Flash 0731 为 284B 总参数、13B 激活的 MoE 架构,支持 1M 上下文,靠后训练将 Agent 能力提升 7 倍。分析认为,可用级智能成本已降至可忽略不计,将催生大规模长程 Agent 应用,并迫使闭源厂商降价。

DeepSeek V4这波绝对称得上DeepSeek 2.0时刻了,

难怪大家都叫梁文峰梁圣, 还有说梁圣的恩情还不完, 以及最近有DeepSeek斩杀线的说法, 之前还有点不太理解,现在想想好像有点意思,

完成同样一个完整的Agent任务, DeepSeek比Anthropic最好的Fable 5要便宜105倍🤯。。。

注意兄弟们,不是token单价便宜105倍, 是真刀真枪跑完一整个任务, 从开始到结束,所有轮次所有工具调用加起来, DeepSeek花3美分, Fable 5花3.15美元, damn,太离谱了!

上一次是2025年初,它证明开源模型能追平闭源, 这一次它证明,可用级别的智能, 成本已经低到几乎可以忽略不计。

很多人没意识到105倍这个数字意味着什么, 这不是简单的打个折,或者说性能优化了20%, 就是一个数量级的差异, 大白话就是,你跑一个任务花3块钱,别人花3分钱的差异。

以前你跑Agent, 每多一轮调用都在心疼token, 要做缓存,要剪枝,要想尽办法省调用,

现在你完全可以让Agent随便跑, 跑十轮二十轮, 成本还不到以前的零头。

我觉得这样肯定会直接催生一整代以前根本不可能存在的产品, 那些需要大规模、长程、多轮Agent调用的应用, 以前算下来ROI根本不成立, 现在突然就全部成立了。

Cline那个开源编码Agent为什么第一个跳出来喊, 因为他们最清楚, 用户之前不敢大规模跑自动编码, 根本不是能力不够,是账单太吓人, 现在这个枷锁直接被砸碎了。

当然差距还是存在的, 顶尖模型在最难的任务上还是更强, 但日常80%的工作, 3美分和3美元做出来的东西, 大多数人根本分不出区别。

接下来会发生什么, 闭源厂商会被迫继续降价, 开发者会重新分层使用模型, 高频日常任务全用Flash级别的模型, 只有最关键的决策才用最贵的模型。

但最深远的影响其实是, 智能本身正在变成大宗商品, 就像电力,就像带宽, 当它便宜到一定程度, 就没有人再去讨论它的价格了, 大家只会讨论用它来造什么。

而这一天,可能比我们所有人预想的都要来得快。

AYiDeepSeek给全球大模型画了条斩杀线,基本上是把大模型定价权直接干碎了。 X轴是单任务成本,越往右越贵,Y轴是智能指数,越高越强。 DeepSeek V4 Flash 0731在哪?得分50,成本3美分,3美分。 它右边那片橙色区域--从10美分到3美元,Claude Opus、GPT-5.6 Sol、Kimi K...
AYi · @AYi_AInotes · X·2026-08-03 16:27·2小时前
在 X 看原推· x.com
AI 摘要

DeepSeek V4 完成同一完整 Agent 任务仅需 3 美分,而 Anthropic 最好的 Fable 5 需 3.15 美元,成本相差 105 倍。V4 Flash 0731 为 284B 总参数、13B 激活的 MoE 架构,支持 1M 上下文,靠后训练将 Agent 能力提升 7 倍。分析认为,可用级智能成本已降至可忽略不计,将催生大规模长程 Agent 应用,并迫使闭源厂商降价。

DeepSeek V4这波绝对称得上DeepSeek 2.0时刻了,

难怪大家都叫梁文峰梁圣, 还有说梁圣的恩情还不完, 以及最近有DeepSeek斩杀线的说法, 之前还有点不太理解,现在想想好像有点意思,

完成同样一个完整的Agent任务, DeepSeek比Anthropic最好的Fable 5要便宜105倍🤯。。。

注意兄弟们,不是token单价便宜105倍, 是真刀真枪跑完一整个任务, 从开始到结束,所有轮次所有工具调用加起来, DeepSeek花3美分, Fable 5花3.15美元, damn,太离谱了!

上一次是2025年初,它证明开源模型能追平闭源, 这一次它证明,可用级别的智能, 成本已经低到几乎可以忽略不计。

很多人没意识到105倍这个数字意味着什么, 这不是简单的打个折,或者说性能优化了20%, 就是一个数量级的差异, 大白话就是,你跑一个任务花3块钱,别人花3分钱的差异。

以前你跑Agent, 每多一轮调用都在心疼token, 要做缓存,要剪枝,要想尽办法省调用,

现在你完全可以让Agent随便跑, 跑十轮二十轮, 成本还不到以前的零头。

我觉得这样肯定会直接催生一整代以前根本不可能存在的产品, 那些需要大规模、长程、多轮Agent调用的应用, 以前算下来ROI根本不成立, 现在突然就全部成立了。

Cline那个开源编码Agent为什么第一个跳出来喊, 因为他们最清楚, 用户之前不敢大规模跑自动编码, 根本不是能力不够,是账单太吓人, 现在这个枷锁直接被砸碎了。

当然差距还是存在的, 顶尖模型在最难的任务上还是更强, 但日常80%的工作, 3美分和3美元做出来的东西, 大多数人根本分不出区别。

接下来会发生什么, 闭源厂商会被迫继续降价, 开发者会重新分层使用模型, 高频日常任务全用Flash级别的模型, 只有最关键的决策才用最贵的模型。

但最深远的影响其实是, 智能本身正在变成大宗商品, 就像电力,就像带宽, 当它便宜到一定程度, 就没有人再去讨论它的价格了, 大家只会讨论用它来造什么。

而这一天,可能比我们所有人预想的都要来得快。

AYiDeepSeek给全球大模型画了条斩杀线,基本上是把大模型定价权直接干碎了。 X轴是单任务成本,越往右越贵,Y轴是智能指数,越高越强。 DeepSeek V4 Flash 0731在哪?得分50,成本3美分,3美分。 它右边那片橙色区域--从10美分到3美元,Claude Opus、GPT-5.6 Sol、Kimi K...
在 X 查看原推x.com