OpenRouter:Announcements(RSS)
精选
73AI 编辑部评分,满分 100

DeepSeek V4 智能体 token 份额持续增长

2026-06-19 08:00· 58天前· OpenRouter
AI 导读

DeepSeek 于4月24日发布新一代旗舰模型 V4 系列。OpenRouter 数据显示,V4 发布后其 token 份额从年初的9%增长至6月初的18%,自5月中旬起成为 OpenRouter 最受欢迎模型。V4 是首个足以胜任智能体工作负载的 DeepSeek 模型,到5月底 V4-Flash 已占 DeepSeek 智能体 token 流量的70%。V4-Flash 最便宜端点价格为每百万 token 输入 $0.09、输出 $0.18,远低于 GPT-5.5 的 $5/$30。中国模型整体 token 份额于6月初超过美国模型,DeepSeek 是主要驱动力。

推荐理由

OpenRouter 独家数据展示了代际转折:DeepSeek V4 靠性价比吃下代理负载,中国模型 token 份额首次超过美国,这个信号比任何 benchmark 排名都真实,做应用选型的人该重新算账了。

正文 · AI 翻译
DeepSeek V4 Is Earning Agentic Token Share
  • 当前驱动 token 使用量的模型厂商
  • V4 是首个足以支撑智能体工作负载的 DeepSeek 模型
  • DeepSeek 与中国模型的崛起
  • 方法论

DeepSeek——这家在许多人心目中仍与开源大语言模型划等号的公司——于 4 月 24 日发布了其新的旗舰 V4 模型系列。

V4 是否让 DeepSeek 重新回到了 AI 话题的中心?还是智能体能力的爆发已经让开源模型落在了后面?

当前驱动 token 使用量的模型厂商

年初时,DeepSeek 在 OpenRouter 上每周 token 流量中的占比略低于 10%。随着智能体工作负载在 2 月和 3 月开始占据主导,并以前所未有的速度推高 token 使用量,DeepSeek 的总 token 占比实际上跌到了 5%。该公司一方面被上方的闭源模型挤压,另一方面又被下方一波又一波的其他开源大语言模型挤压。

V4 模型系列的发布带来了立竿见影的积极影响。到 6 月初,DeepSeek 已拿下近 20% 的 token 份额,并且正如《华尔街日报》所报道的那样,自 5 月中旬以来一直是 OpenRouter 上排名第一的模型。

对 2026 年 1 月和 6 月进行直接对比,可以看出模型厂商之间的偏好转移速度有多快。DeepSeek 在此期间实际上将 token 份额翻了一番(从 9% 增至 18%),但许多其他模型提供商也经历了命运的大起大落。

一批中国开源模型厂商,包括小米、MiniMax 和腾讯,其 token 份额在过去 6 个月里都有所上升。这似乎是以几家领先的美国模型公司为代价的,尤其是 Google 和 OpenAI。

DeepSeek 份额翻倍并不局限于某一类用户。到 6 月初,各类公司和个人都在越来越多地使用 DeepSeek 的 token。爱好者用户(他们通常通过角色扮演、通用聊天、个人智能体等面向消费者的应用类别产生大量使用量)现在将近三分之一的 token 流量路由到 DeepSeek 模型。

即使在 AI 原生公司或大型组织的用户中——这两类用户原本都可能被预期优先使用前沿闭源模型——6 月初流向 DeepSeek 的 token 流量也远高于年初。

DeepSeek V4 Flash 在最便宜的端点上,输入每百万 token 收费 0.09 美元,输出每百万 token 收费 0.18 美元。作为对比,GPT-5.5 目前定价为输入每百万 token 5 美元,输出每百万 token 30 美元。

因此,看到 V4 的 token 用量突然飙升,却并未带来支出份额的同等激增,也就不足为奇了。V4 的成本效益与输出质量之比在同类产品中处于领先水平——事实上,它已经足够出色,以至于各种规模的组织都开始信任 DeepSeek,将真正的智能体工作交给它处理。

V4 是第一款足以胜任智能体工作负载的 DeepSeek 模型

我们按 API 密钥级别将 token 流量划分为三大类(智能体、混合和人工)。这些类别是根据一个包含 7 项信号的加权综合评分来分配的,评分输入包括工具调用率、轮次数量、间隔时间等。

众所周知,智能体工作消耗的 token 比正常的人类 AI 使用要多得多(根据 OpenRouter 数据,每个请求大约多 15 倍)。但值得记住的是,智能体 token 的爆炸式增长是 2026 年的现象,而且实际上直到今年 2 月初才真正开始。

不过,即便这样说,对某些模型厂商而言也还是夸大了。

智能体工作负载消耗的 token 大约在 2 月 1 日前后超过了人类使用量。起初,智能体工作集中在少数几家模型厂商手中,而 DeepSeek 并不在那个少数群体之列。

V4 的发布标志着 DeepSeek 真正加入了智能体工作流的竞争。

并非所有工作负载都会同时切换到最新模型。上图显示,在今年前 5 个月里,DeepSeek token 用量中的人类活动部分一直与 DeepSeek V3.2 绑定在一起。

然而,智能体工作负载已将 V4 作为其首选模型。到 5 月底,也就是发布仅仅一个月后,V4-Flash 已占 DeepSeek 用量中智能体 token 流的 70%。

DeepSeek 与中国模型的崛起

Token 流向两个国家创建的大语言模型:美国和中国(米色小切片中还有少量其他国家的代表)。2026 年 token 用量呈爆炸式增长,但这种增长并未扩散到其他国家的 LLM。

2025 年是美国模型 token 的天下,来自美国模型的 token 用量约占全部用量的四分之三。而 2026 年的竞争要激烈得多,截至 6 月初,中国模型在 token 份额上实际上已经超过了美国模型。

毫不意外的是,自 4 月底 V4 发布以来,DeepSeek 一直在中国模型中领跑。虽然过去 6 周里,几家美国头部模型的 token 用量趋于平稳,但多家中国竞争对手的 token 用量在 6 月初出现了激增。

随着高性价比的 token 用量占据夏季头条,我们预计这些更便宜但依然强大的开源模型将继续吸引更多 token。正如《华尔街日报》在最近这篇报道(引用了 OpenRouter 数据)中所提到的:“初创公司和科技巨头都在混搭使用各种 AI 模型,以避免支付溢价。”

DeepSeek V4 必定是这种混搭组合中的一员。

方法论

  • 数据来源:OpenRouter 的请求日志
  • 样本规模:2026 年 1 月 1 日至 2026 年 6 月 14 日期间超过 457 万亿个 token
  • 活动类型:我们按 API 密钥级别将 token 流量分为三大类(智能体型、混合型、人工型)。这些分类依据一个包含 7 项信号的加权综合评分来判定,评分输入包括工具调用率、轮次数量、间隔时长等。

来源:OpenRouter:Announcements(RSS) · openrouter.ai

DeepSeek V4 智能体 token 份额持续增长

OpenRouter:Announcements(RSS)·2026-06-19 08:00·58天前·OpenRouter
AI 导读

DeepSeek 于4月24日发布新一代旗舰模型 V4 系列。OpenRouter 数据显示,V4 发布后其 token 份额从年初的9%增长至6月初的18%,自5月中旬起成为 OpenRouter 最受欢迎模型。V4 是首个足以胜任智能体工作负载的 DeepSeek 模型,到5月底 V4-Flash 已占 DeepSeek 智能体 token 流量的70%。V4-Flash 最便宜端点价格为每百万 token 输入 $0.09、输出 $0.18,远低于 GPT-5.5 的 $5/$30。中国模型整体 token 份额于6月初超过美国模型,DeepSeek 是主要驱动力。

正文 · AI 翻译
DeepSeek V4 Is Earning Agentic Token Share
  • 当前驱动 token 使用量的模型厂商
  • V4 是首个足以支撑智能体工作负载的 DeepSeek 模型
  • DeepSeek 与中国模型的崛起
  • 方法论

DeepSeek——这家在许多人心目中仍与开源大语言模型划等号的公司——于 4 月 24 日发布了其新的旗舰 V4 模型系列。

V4 是否让 DeepSeek 重新回到了 AI 话题的中心?还是智能体能力的爆发已经让开源模型落在了后面?

当前驱动 token 使用量的模型厂商

年初时,DeepSeek 在 OpenRouter 上每周 token 流量中的占比略低于 10%。随着智能体工作负载在 2 月和 3 月开始占据主导,并以前所未有的速度推高 token 使用量,DeepSeek 的总 token 占比实际上跌到了 5%。该公司一方面被上方的闭源模型挤压,另一方面又被下方一波又一波的其他开源大语言模型挤压。

V4 模型系列的发布带来了立竿见影的积极影响。到 6 月初,DeepSeek 已拿下近 20% 的 token 份额,并且正如《华尔街日报》所报道的那样,自 5 月中旬以来一直是 OpenRouter 上排名第一的模型。

对 2026 年 1 月和 6 月进行直接对比,可以看出模型厂商之间的偏好转移速度有多快。DeepSeek 在此期间实际上将 token 份额翻了一番(从 9% 增至 18%),但许多其他模型提供商也经历了命运的大起大落。

一批中国开源模型厂商,包括小米、MiniMax 和腾讯,其 token 份额在过去 6 个月里都有所上升。这似乎是以几家领先的美国模型公司为代价的,尤其是 Google 和 OpenAI。

DeepSeek 份额翻倍并不局限于某一类用户。到 6 月初,各类公司和个人都在越来越多地使用 DeepSeek 的 token。爱好者用户(他们通常通过角色扮演、通用聊天、个人智能体等面向消费者的应用类别产生大量使用量)现在将近三分之一的 token 流量路由到 DeepSeek 模型。

即使在 AI 原生公司或大型组织的用户中——这两类用户原本都可能被预期优先使用前沿闭源模型——6 月初流向 DeepSeek 的 token 流量也远高于年初。

DeepSeek V4 Flash 在最便宜的端点上,输入每百万 token 收费 0.09 美元,输出每百万 token 收费 0.18 美元。作为对比,GPT-5.5 目前定价为输入每百万 token 5 美元,输出每百万 token 30 美元。

因此,看到 V4 的 token 用量突然飙升,却并未带来支出份额的同等激增,也就不足为奇了。V4 的成本效益与输出质量之比在同类产品中处于领先水平——事实上,它已经足够出色,以至于各种规模的组织都开始信任 DeepSeek,将真正的智能体工作交给它处理。

V4 是第一款足以胜任智能体工作负载的 DeepSeek 模型

我们按 API 密钥级别将 token 流量划分为三大类(智能体、混合和人工)。这些类别是根据一个包含 7 项信号的加权综合评分来分配的,评分输入包括工具调用率、轮次数量、间隔时间等。

众所周知,智能体工作消耗的 token 比正常的人类 AI 使用要多得多(根据 OpenRouter 数据,每个请求大约多 15 倍)。但值得记住的是,智能体 token 的爆炸式增长是 2026 年的现象,而且实际上直到今年 2 月初才真正开始。

不过,即便这样说,对某些模型厂商而言也还是夸大了。

智能体工作负载消耗的 token 大约在 2 月 1 日前后超过了人类使用量。起初,智能体工作集中在少数几家模型厂商手中,而 DeepSeek 并不在那个少数群体之列。

V4 的发布标志着 DeepSeek 真正加入了智能体工作流的竞争。

并非所有工作负载都会同时切换到最新模型。上图显示,在今年前 5 个月里,DeepSeek token 用量中的人类活动部分一直与 DeepSeek V3.2 绑定在一起。

然而,智能体工作负载已将 V4 作为其首选模型。到 5 月底,也就是发布仅仅一个月后,V4-Flash 已占 DeepSeek 用量中智能体 token 流的 70%。

DeepSeek 与中国模型的崛起

Token 流向两个国家创建的大语言模型:美国和中国(米色小切片中还有少量其他国家的代表)。2026 年 token 用量呈爆炸式增长,但这种增长并未扩散到其他国家的 LLM。

2025 年是美国模型 token 的天下,来自美国模型的 token 用量约占全部用量的四分之三。而 2026 年的竞争要激烈得多,截至 6 月初,中国模型在 token 份额上实际上已经超过了美国模型。

毫不意外的是,自 4 月底 V4 发布以来,DeepSeek 一直在中国模型中领跑。虽然过去 6 周里,几家美国头部模型的 token 用量趋于平稳,但多家中国竞争对手的 token 用量在 6 月初出现了激增。

随着高性价比的 token 用量占据夏季头条,我们预计这些更便宜但依然强大的开源模型将继续吸引更多 token。正如《华尔街日报》在最近这篇报道(引用了 OpenRouter 数据)中所提到的:“初创公司和科技巨头都在混搭使用各种 AI 模型,以避免支付溢价。”

DeepSeek V4 必定是这种混搭组合中的一员。

方法论

  • 数据来源:OpenRouter 的请求日志
  • 样本规模:2026 年 1 月 1 日至 2026 年 6 月 14 日期间超过 457 万亿个 token
  • 活动类型:我们按 API 密钥级别将 token 流量分为三大类(智能体型、混合型、人工型)。这些分类依据一个包含 7 项信号的加权综合评分来判定,评分输入包括工具调用率、轮次数量、间隔时长等。

来源:OpenRouter:Announcements(RSS)· openrouter.ai