- 当前驱动 token 使用量的模型厂商
- V4 是首个足以支撑智能体工作负载的 DeepSeek 模型
- DeepSeek 与中国模型的崛起
- 方法论
DeepSeek——这家在许多人心目中仍与开源大语言模型划等号的公司——于 4 月 24 日发布了其新的旗舰 V4 模型系列。
V4 是否让 DeepSeek 重新回到了 AI 话题的中心?还是智能体能力的爆发已经让开源模型落在了后面?
当前驱动 token 使用量的模型厂商
年初时,DeepSeek 在 OpenRouter 上每周 token 流量中的占比略低于 10%。随着智能体工作负载在 2 月和 3 月开始占据主导,并以前所未有的速度推高 token 使用量,DeepSeek 的总 token 占比实际上跌到了 5%。该公司一方面被上方的闭源模型挤压,另一方面又被下方一波又一波的其他开源大语言模型挤压。
V4 模型系列的发布带来了立竿见影的积极影响。到 6 月初,DeepSeek 已拿下近 20% 的 token 份额,并且正如《华尔街日报》所报道的那样,自 5 月中旬以来一直是 OpenRouter 上排名第一的模型。
对 2026 年 1 月和 6 月进行直接对比,可以看出模型厂商之间的偏好转移速度有多快。DeepSeek 在此期间实际上将 token 份额翻了一番(从 9% 增至 18%),但许多其他模型提供商也经历了命运的大起大落。
一批中国开源模型厂商,包括小米、MiniMax 和腾讯,其 token 份额在过去 6 个月里都有所上升。这似乎是以几家领先的美国模型公司为代价的,尤其是 Google 和 OpenAI。
DeepSeek 份额翻倍并不局限于某一类用户。到 6 月初,各类公司和个人都在越来越多地使用 DeepSeek 的 token。爱好者用户(他们通常通过角色扮演、通用聊天、个人智能体等面向消费者的应用类别产生大量使用量)现在将近三分之一的 token 流量路由到 DeepSeek 模型。
即使在 AI 原生公司或大型组织的用户中——这两类用户原本都可能被预期优先使用前沿闭源模型——6 月初流向 DeepSeek 的 token 流量也远高于年初。
DeepSeek V4 Flash 在最便宜的端点上,输入每百万 token 收费 0.09 美元,输出每百万 token 收费 0.18 美元。作为对比,GPT-5.5 目前定价为输入每百万 token 5 美元,输出每百万 token 30 美元。
因此,看到 V4 的 token 用量突然飙升,却并未带来支出份额的同等激增,也就不足为奇了。V4 的成本效益与输出质量之比在同类产品中处于领先水平——事实上,它已经足够出色,以至于各种规模的组织都开始信任 DeepSeek,将真正的智能体工作交给它处理。
V4 是第一款足以胜任智能体工作负载的 DeepSeek 模型
我们按 API 密钥级别将 token 流量划分为三大类(智能体、混合和人工)。这些类别是根据一个包含 7 项信号的加权综合评分来分配的,评分输入包括工具调用率、轮次数量、间隔时间等。
众所周知,智能体工作消耗的 token 比正常的人类 AI 使用要多得多(根据 OpenRouter 数据,每个请求大约多 15 倍)。但值得记住的是,智能体 token 的爆炸式增长是 2026 年的现象,而且实际上直到今年 2 月初才真正开始。
不过,即便这样说,对某些模型厂商而言也还是夸大了。
智能体工作负载消耗的 token 大约在 2 月 1 日前后超过了人类使用量。起初,智能体工作集中在少数几家模型厂商手中,而 DeepSeek 并不在那个少数群体之列。
V4 的发布标志着 DeepSeek 真正加入了智能体工作流的竞争。
并非所有工作负载都会同时切换到最新模型。上图显示,在今年前 5 个月里,DeepSeek token 用量中的人类活动部分一直与 DeepSeek V3.2 绑定在一起。
然而,智能体工作负载已将 V4 作为其首选模型。到 5 月底,也就是发布仅仅一个月后,V4-Flash 已占 DeepSeek 用量中智能体 token 流的 70%。
DeepSeek 与中国模型的崛起
Token 流向两个国家创建的大语言模型:美国和中国(米色小切片中还有少量其他国家的代表)。2026 年 token 用量呈爆炸式增长,但这种增长并未扩散到其他国家的 LLM。
2025 年是美国模型 token 的天下,来自美国模型的 token 用量约占全部用量的四分之三。而 2026 年的竞争要激烈得多,截至 6 月初,中国模型在 token 份额上实际上已经超过了美国模型。
毫不意外的是,自 4 月底 V4 发布以来,DeepSeek 一直在中国模型中领跑。虽然过去 6 周里,几家美国头部模型的 token 用量趋于平稳,但多家中国竞争对手的 token 用量在 6 月初出现了激增。
随着高性价比的 token 用量占据夏季头条,我们预计这些更便宜但依然强大的开源模型将继续吸引更多 token。正如《华尔街日报》在最近这篇报道(引用了 OpenRouter 数据)中所提到的:“初创公司和科技巨头都在混搭使用各种 AI 模型,以避免支付溢价。”
DeepSeek V4 必定是这种混搭组合中的一员。
方法论
- 数据来源:OpenRouter 的请求日志
- 样本规模:2026 年 1 月 1 日至 2026 年 6 月 14 日期间超过 457 万亿个 token
- 活动类型:我们按 API 密钥级别将 token 流量分为三大类(智能体型、混合型、人工型)。这些分类依据一个包含 7 项信号的加权综合评分来判定,评分输入包括工具调用率、轮次数量、间隔时长等。