# 谁在真正购买 SOTA 模型？OpenRouter 数据显示 84% 的 token 并非前沿模型

- 来源：Tomer Tunguz 博客（VC 分析）
- 发布时间：2026-08-14 08:00
- AIHOT 分数：63
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmtggvk4n0ch1roj7gqlkgpp7
- 原文链接：https://tomtunguz.com/model-release-exhaustion

## 精选理由

作者用 OpenRouter 与 Ramp 数据说明多数流量流向性价比模型，为判断前沿模型商业化的可持续性提供了可参考的框架。

## AI 摘要

OpenRouter 数据显示，84% 的 token 并非来自 SOTA 模型，用户选择的六款主力模型仅提供前沿约 77% 的性能，成本却仅为 Claude Fable 5 的 2.5%。这些模型混合价格约 $0.50/百万 token，而 Fable 5 为 $20。企业正转向更小、微调或开源模型，前沿模型的经济效益面临挑战。

## 正文

最先进的模型比去年十一月时聪明了三分之二。这种飞速改进的节奏仍在持续，每三天就有两款新模型问世。

但在 OpenRouter 上，84% 的 token 并非来自最先进的模型。

事实上，用户选择用来生成绝大多数 token 的六款模型，其性能约为前沿模型的 77%，而成本仅为 Claude Fable 5 的 2.5%。

该指数持续攀升。大约每个季度就会出现一次三到五个 Artificial Analysis 积分的大幅跃升，较小的涨幅则填补了其间空白。

在 8 月 10 日那一周，六款模型承载了 80% 的流量。它们的综合价格为每百万 token 0.50 美元，而 Fable 5 为 20 美元。

Ramp 的数据显示，买家对价格高度敏感。Fable 5 定价约为每百万 token 10 美元，上线一个月后便占据了 Anthropic token 流量的 6% 和 Anthropic 支出的 11%。GPT-5.6 Sol 作为 OpenAI 最贵的主流产品线，则持有 OpenAI 约四分之一的 token 流量。

尽管 Fable 5 价格远高于 GPT-5.6 Sol，但七月份其模型归因收入约为后者的 75%。

每一代新的最先进模型发布，所抢占的市场份额都应少于前一代。

企业将整合支出。合同会像云时代那样集中在少数一两家供应商手中，而一旦某款模型通过了高价值任务的考验，该工作负载就会长期留在那里。

在显著的价格折扣下，性能已经足够出色。差距正从下方不断收窄。最好的开源权重模型到五月份时已达到前沿模型分数的 80%，而一年前这一比例仅为 48%。

应用部署则是另一回事。我们越来越多的投资组合公司和初创企业默认选择更小的模型、微调模型和开源模型。他们在优化另一条帕累托前沿——以价格换性能。

如果市场份额不再转移，且“够用就好”持续成立，那么最先进模型的经济逻辑就会改变。一次九位数的训练投入必须赢得市场份额才能收回成本，而这个门槛会随着时间推移不断抬高。

这个标题有些轻率。很多人确实在购买最先进的模型，而且理由充分。软件工程架构和安全性设计是最明显的例子，在这些场景中，最好的可用模型物有所值。

但我们掌握的公开数据表明，真正重要的前沿是另一条。

Artificial Analysis 模型目录与智能指数。主要实验室的月度发布数量与前沿路径。样本起始于 2025-11-01。发布速率趋势持平。大型（≥3 分）前沿跃迁之间的中位间隔约为 3.5 个月。智能指数 ↩︎

最先进水平指某一周内可获得的最佳 Artificial Analysis 得分；当某模型的得分处于该周最佳命名模型的 10% 以内时，即被视为接近前沿。将 OpenRouter 每周命名的头部模型与 Artificial Analysis 得分进行匹配，取的是 OpenRouter 轮播列表的头部，而非全部 API。份额序列，周次为 2025-11-03 至 2026-05-25（n=30），仅计命名模型，排除 Others。前十三周与后十三周相比，接近前沿的比例约为 17.5% 对 14.6%（约 82-85% 处于前沿之外）。集中度快照，2026-08-10 当周，覆盖命名 token 前约 80% 的模型。按 token 加权的 Artificial Analysis 得分落后全球目录最先进水平约 23%（约为前沿质量的 77%），并落后该 OpenRouter 列表上最佳模型约 10%。混合篮子约为 $0.50/百万 token，而 Fable 5 为 $20/百万（约 40 倍）。2026 年 5 月的历史核查显示，落后本地列表领先者约 16%。最佳开源权重模型在前十三周的前沿得分为 47.5%，后十三周为 70.9%；单周最佳为 2026-05-25，DeepSeek V4 Pro 得分 45.27，前沿为 56.31（80.4%）。OpenRouter 排名 ↩︎ ↩︎ ↩︎

这些数据源并未涵盖第一方云服务，即 OpenAI、Anthropic 与 Google 自身的服务。运行在原生 API 上的前沿流量从未进入 OpenRouter 排名，因此数据存在偏差。 ↩︎

Ramp Economics Lab，AI 指数 2026 年 8 月（Fable 5 采用情况）。econlab.substack.com/p/ai-index-august-2026 ↩︎
