Dylan Patel:Anthropic 与 OpenAI 到 2028 年将控制全球大部分算力

Dwarkesh Patel:Podcast & Blog(RSS)·2026-08-25 23:32·52分钟前·Dwarkesh Patel
AI 导读

在最新一期播客中,SemiAnalysis 创始人 Dylan Patel 与 Dwarkesh Patel 讨论实验室经济学,预计 Anthropic 和 OpenAI 到 2028 年将控制全球大部分可用 FLOPs,因其能更好变现算力并出价高于其他方。

Dwarkesh Patel:Podcast & Blog(RSS)
精选
64AI 编辑部评分,满分 100

Dylan Patel:Anthropic 与 OpenAI 到 2028 年将控制全球大部分算力

2026-08-25 23:32· 52分钟前· Dwarkesh Patel
AI 导读

在最新一期播客中,SemiAnalysis 创始人 Dylan Patel 与 Dwarkesh Patel 讨论实验室经济学,预计 Anthropic 和 OpenAI 到 2028 年将控制全球大部分可用 FLOPs,因其能更好变现算力并出价高于其他方。

推荐理由

六亿美元晶圆厂资本开支最终可能对应超一万亿美元终端AI收入,这个数量级差距能解释实验室愿高价竞购算力并推高市场利率的一种机制。

正文 · AI 翻译

再次与我的双胞胎兄弟 Dylan Patel 聊天,非常开心。

我们探讨了未来几年实验室的经济学——随着 RSI(递归自我改进)临近,算力重心如何从推理转向训练;以及 Anthropic 和 OpenAI 如何有望在未来几年内掌控全球大部分可用 FLOPs(因为他们能更好地将算力变现,从而在竞价中压过所有人)。

接着我们讨论了:到本十年末,我们将会看到的总计超过 10 万亿美元的 AI 资本支出,是否会导致主权债务危机——超大规模云厂商的债务推高利率,将未涉足 AI 的国家推向破产,并重挫非 AI 类股票。

我们未能解决的一个问题是:是否存在任何力量能够抗衡这个行业正在涌向中心化的所有趋势——训练中的规模经济、算力的稀缺性,以及最终会到来的持续学习和 RSI。

赞助商

  • Grok Bot 在我寻找新编辑的过程中帮了大忙。我创建了一个招聘机器人,描述了我想要找的编辑类型。然后这个机器人又派生出几个子代理,它们翻遍了我的邮件和 X 私信,阅读了我喜欢的各种纪录片的片尾字幕,并查明了哪些人给我最喜欢的 YouTuber 做剪辑。它汇总了所有这些结果,然后给我提供了一份符合我标准的候选人短名单。你也可以在 x.ai/bot 亲自试试 Grok Bot。

  • Antithesis 让你能把“时间旅行”加入软件测试工具箱。由于 Antithesis 平台是完全确定性的,其中发生的一切都可以完美复现。所以如果你的软件崩溃了,你可以倒回到精确的出错时刻,冻结时间,然后进行调查。或者你可以通过扰动系统来测试不同的假设:杀掉一个节点或禁用一个功能,看看会发生什么,然后重置轨迹再尝试别的方案。了解更多请访问 antithesis.com/dwarkesh

  • Jane Street 目前正在招聘两个独立的机器学习实习生岗位,一个主要侧重研究,另一个侧重工程。两种岗位都要求实习生参与实际工作,而非虚构的练习项目:一个常见的项目是将前沿大语言模型论文适配到金融市场,这类任务往往伴随着大量棘手的挑战。重要的是,申请时不需要任何金融背景。2027 年的申请现已开放,请访问 janestreet.com/dwarkesh。

时间戳

(00:00:00)—— 两家实验室很快将控制全球大部分算力

(00:07:01)—— 60 亿美元的晶圆厂资本支出可带来超过 1 万亿美元的最终收入

(00:13:08)—— 如果实验室出价高于所有人,算力价格将上涨

(00:18:22)—— 哪一层将捕获大部分剩余价值?

(00:25:40)—— 什么可能拖慢进展?

(00:29:43)—— 实验室正在将算力从推理转向研发

(00:33:27)—— 中国获得的新增算力不到 10%,但其实验室需求也更少

(00:48:48)—— AI 会导致主权债务危机吗?

(01:07:52)—— 世界未来的劳动力会属于少数几家公司吗?

00:00:00 —— 两家实验室很快将控制全球大部分算力

好的,我再次请到了 Dylan Patel,SemiAnalysis 的创始人。我们版本的“家庭感恩节晚餐”就是每年一次定期播客。不过我们实际上并没有亲戚关系。

Dylan Patel

别告诉别人这件事。

那会毁掉这个神话。基本上,世界经济的走向越来越取决于实验室经济的走向、算力市场的走向等等。我想了解这个疯狂的未来在几年内会变成什么样。但让我们从今天开始说起。请带我了解一下目前实验室的算力和收入情况,也许再展望一两年。

Dylan Patel

回顾去年,即使在年底,美国 GDP 增长的大部分都来自 AI 基础设施。展望今年,即将上线的算力中约有三分之一是面向实验室的,也就是 OpenAI 和 Anthropic。这些算力可能是由其他方建设然后租给它们的,但从最终客户的角度来看,就是它们。

展望未来,算力的投入规模正在急剧膨胀。今年我们的资本开支略超一万亿美元。到2028年,这一数字将超过两万亿美元。各大实验室在这其中的占比也在不断提高。所以最终你会看到一个非常有意思的局面:实验室正从每年花费数百亿美元的公司,变成每年花费数千亿美元,甚至预计到本十年末每年将花费数万亿美元。这至少是他们已经开始与合作伙伴签署的部分合同所反映出的情况。

这要求它们的经济模式发生重大重塑。迄今为止,它们大多是亏损的公司。Anthropic 在第二季度开始盈利。据信在第三季度的某个时点,随着 Codex 和 5.6 等产品的更大规模崛起,OpenAI 甚至也可能开始盈利。但如果回到一年前,它们所有的钱都是风险投资支撑的亏损。即便回到今年年初,也依然是风险投资支撑的亏损。如今它们已经转过拐点,真正开始盈利了。

这并不意味着它们不再吸纳新资本。新资本仍在涌入,以进一步加速增长。但归根结底,它们越来越多的业务是靠自身收入来支撑,而不是靠外部注资。在过去一年半里,它们的利润率确实飙升了。算力的基础成本大约在每兆瓦1000万到1300万到1500万美元之间。

当前最有趣的一点在于:过去,如果他们部署一个模型——比如在英伟达 Hopper GPU 上运行 GPT-4——对 OpenAI 来说是在产生负毛利。但现在,当 OpenAI 部署 GPT-5.6,或 Anthropic 部署 Opus 5 或 Fable 5 时,他们的收入已经远远超过了每兆瓦 1000 万到 1500 万美元的增量成本。以 Anthropic 为例,其收入已经高达每兆瓦 5000 万美元。这让他们现在能够做到的是:“嘿,如果我在推理算力上花 10 美元,实际上能产生 50 美元的收入,然后我可以把这些利润全部再增量投入到训练中。”

我非常想了解的一点是,你如何看待算力在各大实验室的集中化趋势,或者说流向全球其他地方的算力与流向实验室的算力之间的相对比例。如果说现在大约三分之一的增量算力流向了实验室,那么到什么时候,全球增量算力中超过一半会流向实验室?到哪个时间点,实验室会基本上掌握全球绝大部分算力?

Dylan Patel

今年年初,OpenAI 起步于 2 吉瓦,Anthropic 不到 2 吉瓦。到今年年底,两家都会超过 5 吉瓦。所以他们的总算力增长了 3 到 4 倍。如果看新增的增量算力,这大约占今年全球新增算力的 30%。

展望明年,考虑到已经签署、敲定、落笔的合同,情况会更加惊人。Anthropic 和 OpenAI 明年将拿走高达 40% 到 50% 的算力。这种集中化趋势看起来并没有放缓或停止的迹象。事实上,它似乎只会加速。

为他们建造这些算力的厂商将会发生变化。明年,一个重要的新入局者就是 SpaceX,他们正在建设大量算力。他们很可能会主动将其中相当一部分租给 Anthropic 和 OpenAI,因为他们是最有能力支付最高价格的增量买家。此外,OpenAI 和 Anthropic 也开始自建算力——OpenAI 用自己的芯片,Anthropic 则使用从 Google 采购、并通过 Fluidstack 部署的 TPU。

于是你问:“嘿,全球新增算力什么时候会有一半只流向 OpenAI 和 Anthropic?”实际上到明年年底,新增算力的一半就已经流向 Anthropic 和 OpenAI 了。

因为算力增长太快,新增算力基本上将占据算力总量的大部分。所以很快——你是说大概一年半到两年之内——全球大部分算力就会被两家实验室掌控,或者至少是在为两家实验室的需求服务。

现在有这样一个趋势:全球算力(以吉瓦计)每年翻一番,但前沿实验室的算力每年翻三倍。如果保持当前趋势,从今年年初的 2 到今年年底接近 6,直接乘以 3 就行。到 2027 年底是 18,到 2028 年底是 54。你会不会觉得:“好吧,到那个时候,考虑到全球算力总量,他们根本不可能继续三倍增长了?”你如何看待未来几年全球算力的局面?

Dylan Patel

如果今年新增算力是 30 吉瓦,明年 50 吉瓦,后年大约 70 吉瓦,你就会看到一个非常有趣的现象。今年新部署的每一瓦算力,效率都远高于两年前部署的瓦数。全球算力中有很大比例是今年部署的。虽然部署的瓦数没有翻倍,但我部署的是 GB300、TPUv7 和 Trainium3,这些芯片的效率要高得多得多。它们每瓦性能是上一代芯片的 3-5 倍。

所以最终你面前有一个巨大的阶梯。如果 Anthropic 和 OpenAI 明年拿下 45% 的算力,那么到 2027 年 12 月,它们就已经拿下了全球新增算力的一半。但全球新增算力的这一半,实际性能比之前所有算力都更高。所以这上面还有另一个乘数效应。等到 2028 年底——如果这个趋势持续下去,而我看不到任何阻止它的因素——它们就会独自掌控全球大部分可用算力(flops)。

00:07:01 – 60亿美元的晶圆厂资本支出可撬动超过1万亿美元的最终收入

我感到困惑的是,为什么你认为如果我们进入一个算力价值大幅提升的世界,2028年我们只会新增80吉瓦。

Dylan Patel

顺便说一句,那是上限。那属于“我他妈的极度看多”的情形。

好,咱们来做个链式推理。几个月前我采访你时,你说要制造一吉瓦的,我记得是Vera Rubins,需要55,000片N3晶圆、6,000片N5晶圆和170,000片DRAM晶圆。我不知道这些数字现在有没有变化。

Dylan Patel

我要调侃你一下——你说“晶圆”的方式太印度了。“Vafers”。

顺便说一句,我们刚搬到美国的时候,我的v/w不分特别严重,而且我当时还是个素食主义者。

Dylan Patel

我记得你跟我讲过这件事。

在北达科他州,我上小学的时候,我会说——

Dylan Patel

能给我来个“wedgie”吗?

能给我来几个“wedgies”吗?

总之,那是针对一吉瓦的。我让一个大语言模型运行了你的晶圆厂设备模型,算出基本上每一年生产一吉瓦算力所需的工具成本是多少。它给出的数字是30到40亿美元。现在假设你再加上洁净室、厂房外壳以及晶圆厂的其他一切。那么60亿美元的晶圆厂资本支出每年就能产出一吉瓦。而一吉瓦目前能产生1000亿美元的收入。

而且这60亿美元的资本支出每年都在产出一吉瓦,这一吉瓦每年都在产生1000亿美元。所以在五年时间里,第一吉瓦已经产生了五年的利润,晶圆厂产出的第二吉瓦已经产生了四年的利润,以此类推。晶圆厂层面的60亿美元资本支出最终将产生超过一万亿美元的AI最终收入。

Dylan Patel

没错。但沿途有大量的运营支出。还有很多其他资本支出,比如数据中心、电力。

而且你还得为OpenAI的研发买单。

Dylan Patel

安装。这里有很多不同的人都需要分到钱。

把这些中间环节拿走一半,仍然意味着晶圆厂资本支出与最终产生的收入之间存在100倍的差距。实际上还不止,但我们只是非常保守地估计。结果是……这就是资本主义。存在如此巨大的差距,你可以把1美元变成100美元。他们难道想不出办法造出更多镜子吗?

Dylan Patel

他们确实在想。只是这些镜子需要时间才能造出来。

但紧迫性如此之大,Anthropic 和 OpenAI 都在说:“我们现在就能赚一万亿美元,但瓶颈就卡在进入 ASML 机器的镜子上。”如果我们在这上面花1000亿美元,怎么能造出更多镜子?这就是我们很快就要面对的局面。我们难道解决不了那个供应瓶颈吗?这似乎很难想象。

Dylan Patel

你见过有人在这里做有趣的套利——买下涡轮机然后试图转卖,因为涡轮机的价值要高得多,毕竟它是制约你数据中心的关键瓶颈。我觉得如果有人有4亿美元,并且有能力说服 ASML 卖给他们一台 EUV 光刻机,他们完全应该直接买一台,等着,然后以超过10亿美元的价格卖出去。

但归根结底,是的,资本主义会让这些东西扩张。但这像一条鞭子。鞭子的信号传到末端需要很长时间。供应链不会立即反应。事实上,你去跟 Carl Zeiss 的人聊,他们会说:“对对对,我们到本十年末需要造出100台 EUV 光刻机。”今年早些时候我们做那期节目时,他们甚至不认为自己需要造那么多——足以支撑每年100台 EUV 光刻机的镜子。现在他们说:“好吧,我们需要做到。”但实际上,考虑到正在发生的所有这些经济因素,应该还要更多。产能爬坡需要太长时间了。

假设这个产业链上的每一家公司都被私募股权收购了。某个极度信奉 AGI 的人进来后说:“我们要把产能最大化。”你觉得,在制造更多东西这件事上,物理层面的约束会是什么?我问这个问题的原因是,我们很快就要进入这样一个世界:实验室的收入,或者说仅仅是 AI 的现金流——因为显然加速器业务也有巨大的现金流——会大到你可以直接用这些现金流来为所有产能的极端扩张提供资金。

Dylan Patel

我大体上同意。显然存在一些物理约束。按照目前供应链扩张的方式,100 这个数字大致仍然是正确的。

针对 2030 年?

Dylan Patel

2030 年需要 100 台 ASML 设备。但如果你说:“卡尔蔡司,这是 100 亿美元。请给我拼命扩大产能。”那情况就会改变。你必须对供应链上的每一家公司都这么做。

但你不认为这会在明年发生?

Dylan Patel

我不认为今年会发生。我不认为明年会发生。我也不认为后年会发生,因为这个世界受资本约束。

但在这样一个世界里,比如说,顶级实验室明年合计产生一万亿美元的收入,它们却无法从中拿出 100 亿美元来——

Dylan Patel

我不认为它们会这么做,但是……

或者至少拿出数千亿?看起来它们似乎已经意识到世界正在朝哪个方向发展。我觉得它们完全可以……

Dylan Patel

问题是,实验室明年确实会产生数千亿美元的收入。但最终,明年的资本支出大约是 2 万亿美元。所以这里存在巨大的错配。晶圆制造设备供应链的规模大约在 2000 亿美元量级。数据中心市场供应链的规模会更大。加速器供应链的规模还会更大。能源供应链也会有一个不小的数字。把这些全部加起来,资本支出总额将远超 2 万亿美元。所以实验室的现金流还没有达到能够为这些东西提供资金的程度。

显然它们永远不会达到那个程度,因为你总是希望让你的资本支出高于你的回报。

Dylan Patel

是的,你要再投资。

00:13:08 – 如果各大实验室的出价超过所有人,算力价格将会上涨

我真正想理解的关键问题是:如果当前趋势持续下去,到 2028 年底,每个实验室的算力将超过 50 吉瓦。那么它们合计将拥有 100 吉瓦。正如你所说,这些吉瓦到 2028 年将带来比现在多出数倍的吞吐量或性能,因为硬件已经变得更好了。不仅每瓦特浮点运算次数增加了,而且硬件在处理 AI 工作负载方面的表现也更好了。

好的,那么到 2028 年底,实验室拥有 100 吉瓦。全球算力总量是多少?

Dylan Patel

我认为这可能有点困难,因为到 2028 年,它们已经拿走了增量算力的 70-80%。我不确定届时市场会发生什么。算力价格要飙升到什么程度,它们才能真正买下 70-80% 的算力?Google 或 Meta 或 Amazon 愿意卖出那么多吗?

另外,当我们谈论这些吉瓦数字时,有一个注意事项。当 Amazon 在提供 Bedrock Anthropic 模型服务时,在我们的世界观里,这算作 Anthropic 的算力,因为归根结底,它最终被计为 Anthropic 的收入,尽管存在收入分成和返点之类的安排。但最终到 2028 年,如果它们合计达到 100 吉瓦,它们就已经对市场做出了真正具有颠覆性的事情。

因为如今任何人都能靠每兆瓦 1000-1500 万美元的算力赚到钱。我没开玩笑,这并不难。去弄一个 GB300 机架,去下载 Kimi 的权重,去下载 vLLM 或 SGLang,把它搭起来。Codex 和 Fable 实际上可以帮你做到这一点。这相当简单。不是小菜一碟,但也不是什么高深莫测的事。把它放到 OpenRouter 上。非常简单。你开始产生的收入会超过你为算力支付的费用。

这已经导致这种算力定价——每兆瓦 1000-1500 万美元——开始向上拐头。要达到 2028 年的 100 吉瓦,你必须相信实验室能够为算力支付更高的价格,因为任何人都能在 1000 到 1500 万美元的价格下赚钱。算力现在会涨到每兆瓦 2500 万美元吗?会涨到每兆瓦 4000 万美元吗?

正如你所说,目前各大实验室每兆瓦产生的收入已经远超其他所有人。如果他们能保持目前这样的领先优势,那么这种情况预计会持续下去。如果存在某种递归式自我改进,让 AI 实验室相对获得提升——或者他们在内部拥有不对外发布的模型,用来帮助自己把下一代模型做得更好——那么这种情况预计会更加明显。

你不是已经看到这种情况了吗?SpaceX,或者其他稍微落后一点的机构,如果无法像实验室那样在内部把算力变现,就会把算力卖给出价最高的人?你可以预期他们会持续竞标,争取越来越大的算力市场份额。

Dylan Patel

我认为这就是我的世界观。他们会继续吞下越来越多的算力。但归根结底,他们不可能按当前价格或接近当前的价格做到这一点。他们确实必须开始支付每兆瓦 2500 万、3000 万、5000 万美元的价格,才能真正在 2028 年吞下全球 70% 的算力,到 2028 年达到 100 吉瓦——这是一个非常激进的目标。

这件事的另一个极具挑战性的方面在于,我们已经看到 AI 实验室出现了大幅放缓。他们所倡导的这项监管,实际上对实验室的拖累远大于对开源中文语言模型的拖累。OpenAI 没有发布 Astra。OpenAI 停止训练两周。Anthropic 没有发布其安全评估所认定的 Model 2——外界普遍认为那是 Mythos 的下一代版本。

他们显然没有发布自己最好的模型,在这种情况下,他们每兆瓦的收入会停滞,甚至可能再次开始下滑,因为其他模型又变得有竞争力了。并不是他们在落后,只是他们没有发布自己最顶尖的东西。

如果存在某种监管影响,阻止他们发布最好的模型呢?那么他们每兆瓦的收入就不会爬升得那么快。他们以高于其他人的价格购买增量算力的能力开始减弱,然后也许他们就无法达到那个 100 吉瓦的目标了。

但在一个安全无关紧要的世界里,我确实相信事情就会这样发展。他们每兆瓦可以产生1亿美元甚至更多的收入,也就能为每兆瓦支付5000万美元。其他任何人除了说“拜托,Dario,把我手里的算力全都拿走吧”之外,没有任何合乎逻辑的理由去用这些算力做别的事。但还有一些我们无法描述的势力在起作用,它们可能会减缓这一进程。

我觉得一个好的直觉启发是:如果AI模型真的能像一名完全自动化的软件工程师一样出色会怎样?它们目前还达不到那个水平。我认为它们距离完全自动化一名白领员工的全部工作还差得很远。但白领员工年收入在六位数或更高。如果你有一个吉瓦级的算力,能够支撑大约一百万白领员工的规模,那么由此带来的……那就是1000亿美元。这其实低得惊人。

Dylan Patel

对,每人10万美元,一百万人。

我不知道。但如果实现完全AGI,每吉瓦带来的价值将是数千亿美元。

00:18:22 —— 哪一层将捕获大部分剩余价值?

Dylan Patel

这件事的另一个方面——我们一直在看到这一点——是大部分价值捕获并没有发生。这些模型产生的大部分价值并没有落到OpenAI和Anthropic手里。值得庆幸的是,到目前为止,这些价值大部分只是被送给了用户。

Jane Street,凭借他们与OpenAI关于GPT-5.6超快速模式的独家合同,或者说Jane Street作为Anthropic最大的客户之一,从他们付费购买的token中产生的价值远远、远远、远远超过Anthropic所获得的利润,因为他们能从市场中赚到钱。

再比如Meta,它一度被传闻占Anthropic业务量的10%。他们通过优化广告算法之类的做法,让用户参与时长延长了5%,所有这些都带来了更高的效率。他们从使用这些模型中赚到的钱比Anthropic多得多。

这就是所需要的。当然,如果你有一百万名新的软件工程师,软件工程师的成本也会下降。

我感到困惑的一点是,市场会达到均衡状态吗?如果会达到均衡,你是否会预期算力的价格等于 Anthropic 和 OpenAI 能从中产生的收益,或者非常接近这个数值,只给 Anthropic 和 OpenAI 留出很小的加价空间?

目前很奇怪的是,算力的售价与 Anthropic 能从中赚到的钱之间存在 4 倍甚至更大的差距。在一个每吉瓦收入持续增长的世界里,如果 Anthropic 将每吉瓦变现的能力翻倍或翻三倍,那么差距继续扩大就很奇怪了。Anthropic 仅仅凭借一些权重,就能把花 10 美元买来的东西变成 100 美元。

Dylan Patel

这总是一个有趣的问题。价值在 AI 中流向何处?AI 正在创造所有这些价值。你有终端用户,我认为我们都同意他们创造的价值比任何人都多,因此他们为这些模型支付了很多钱。然后是应用层。到目前为止,应用层创造的价值非常少。然后是模型层,直到一年前它还在产生负毛利,而现在则产生了巨大的正毛利。看起来它正走在每兆瓦产生 1 亿美元收入的道路上。所以正如你所说,把 10-15 美元变成 100 美元。

但如果回到一年前,硬件供应链攫取了所有这些毛利,而其他所有人都在亏钱。OpenAI 和 Anthropic 只是在把风投的钱砸进去,许多其他初创公司也是如此。许多超大规模云厂商在不确定是否会有回报的情况下建设基础设施。

所以最终你在模型层创造了负价值,可以这么说,因为他们以低于基础设施成本的价格出售 token。所有价值都被芯片、晶圆厂捕获了。最初在 2023 年,存储厂商从 HBM 或 AI 存储中赚不到钱,尽管理论上他们交付的价值是巨大的。

现在你有了……嗯,实际上台积电从价值中分到的份额远不如存储厂商。所以价值捕获的分布发生了很大变化,这对追踪市场或参与市场的人来说非常有趣,比如 Jane Street 就是一个例子。这不是广告。这不是广告。这不是广告。

他们是赞助商,但你也不用这么卖力地给他们打广告。

Dylan Patel

那接下来会发生什么?Anthropic 和 OpenAI 已经开始逐渐膨胀它们在价值捕获中的份额。它们会继续膨胀并拿走全部价值吗?嗯,这曾经是一种想法,然后 Elon 证明了,“实际上,不是这样。我可以把我的算力以每兆瓦 2500 万美元或每兆瓦 4000 万美元的价格卖给 Anthropic 和 Google。即使这是短期交易,我也已经按这个价格卖出去了,一年之内我就能收回全部资本开支。”

你预测相关批次的算力——比如 SpaceX 以每吉瓦 400 亿美元卖给 Google 的 B300 或类似的东西——到明年年底会卖到什么价格?

Dylan Patel

我认为大多数算力交易仍将维持在每吉瓦低于 200 亿美元的水平。

即使到明年年底也是这样?

Dylan Patel

因为所有这些都必须靠融资来支撑。如果 Meta、微软、亚马逊、SpaceX 可以在不找到客户的情况下就建设算力,只是说一句,“管他呢,我就要建这些算力,”然后等到建好之后再回头找客户,那他们就掌控了局面。

大多数算力都是在建成之前就签好合同的。这就是 Elon 在市场上利用的机会。他实际上拥有所有这些算力。他就像在说,“嘿,Anthropic,我知道你们每吉瓦能赚 600 多亿美元。你们不如花一大笔钱把我的东西买了吧?”显然,这也不是 Elon 单方面决定的,也不是 Anthropic 单方面决定的。市场自己找到了平衡。

其他人呢,你去随便找一家云服务商,他们会说,“好,我要建一吉瓦的算力,或者 100 兆瓦的算力。我要投入这笔资本开支。我需要回头去找客户。如果我想找到客户,我就需要找到资金。谁会同时给我资金和客户?客户必须先签下合同。然后我拿着客户的承诺去信贷市场融资。”

所以存在一种完全不同的权力结构,Meta 实际上在囤积算力。他们和 SpaceX 是仅有的两个可能的第三名,因为他们囤积了所有这些算力。他们利用自己的资产负债表和能力来建设算力,却没有一个能大规模变现的终端客户。他们有真实的资产负债表,所以可以去信贷市场融资。你建一个吉瓦的算力,就能赚到利润,不是疯狂的利润,但也是不错的利润。现在我就拥有了所有这些算力。

现在 Meta 和 SpaceX 拥有了这种选择权,可以环顾四周然后想:“我的内部用例能让我赚更多钱,还是我应该把这些算力以疯狂的利润率卖给 Anthropic 或 OpenAI?”所以现在我们进入了一个新阶段,SpaceX 和 Meta 在说:“实际上,我要建算力,而且我可以不按 13 美元出租。我可以卖到 25 美元、50 美元,甚至更高。”

00:25:40 – 数据中心监管会拖慢 AI 的发展吗?

你觉得到 2027 年底,他们每吉瓦的收入会是多少?对 Anthropic 或 OpenAI 来说,到 27 年底。

Dylan Patel

我认为这在很大程度上取决于谁拥有最好的模型,以及他们是否被允许继续发布自己最好的模型。但我不认为每兆瓦的收入会低于 5000 多万美元。

到 27 年底。

Dylan Patel

哦,到 27 年底?那就更有挑战性了,但我认为可能会更高,达到每兆瓦 7000 万到 8000 万美元,按公司整体混合计算,甚至可能更高。

看起来低了。

Dylan Patel

如果是这样的话,那算力的价格会怎样变化?如果我是 Anthropic,增量算力是值得的。也许我会在 SpaceX 的算力上每兆瓦花 4000 万美元。如果我是 SpaceX,我会看向供应链,然后想:“嗯,我和 Jensen 达成了这笔交易(他现在突然开始用 Twitter 了)。”Elon 说他们只独家使用 Nvidia 的芯片,但为什么 Jensen 不涨价呢?然后 SK 海力士、美光和三星看到这种情况,也会想:“那我们为什么不涨价呢?”

关于价值获取,我认为这里存在一个“牛鞭效应”。仅仅因为有人提价,并不意味着整个供应链会立即重新平衡。但随着时间的推移,供应链会重新平衡,成本会越来越高。要获得那部分增量产能,你基本上不得不这样做。所以台积电提价非常缓慢,但内存公司提价非常快。基板公司提价也非常快。埃隆不会在15美元时出售,但他现在出售是因为价格已经超过25美元。所以显然他提价提得非常快。

我很惊讶你认为到明年年底,每吉瓦的营收增长幅度不会远超100美元。

迪伦·帕特尔

递归自我改进什么时候发生?起飞什么时候发生?

或者即使递归自我改进不发生,就说当前的发展速度继续保持。看看我们在过去一年半里取得了多少进展。一年半前的模型是什么?Claude 3.5 之类的?

迪伦·帕特尔

我对这个问题的看法是,世界上现存最好的模型是在二月份训练的。

所以你的意思是,也许我们根本不被允许发布实验室最好的模型。

迪伦·帕特尔

OpenAI 说他们两周内不训练模型,天哪。这到底是怎么回事?

有一件事是,在内部,他们是否获得了足够的使用量,以至于会推高算力的价格?另一件事是,AI 整体的进步是否会因为监管而放缓?

迪伦·帕特尔

是的,但他们甚至不允许在内部使用这个新模型。Astra 甚至没有在内部广泛部署。

但话说回来,如果你有一个模型是……去年年初发布的模型是什么?GPT……

迪伦·帕特尔

4o?是 4o 吗?

是的。你说的是,到2027年底,会再次实现从 GPT-4o 到 Mythos 2 级别的飞跃。

迪伦·帕特尔

是的,但 Mythos 2 还没发布。

或者甚至 Mythos。又是那种飞跃。

迪伦·帕特尔

甚至 Mythos 也不被允许发布。他们把它阉割了。我们不能用它来优化推理性能。我们不能用它来优化各种其他东西。

是的,也许AI进展或AI部署会出现一些放缓,这意味着每吉瓦的营收可以更低。但在我看来,这是唯一能让明年年底每兆瓦营收只有1亿美元的情况。

Dylan Patel

只要模型变得更好,它产生的价值就会变得更好。显然,谁能捕获这部分价值仍有争议,但最终每个人都会提高价格。因为他们可以这样做,而且这具有极强的通胀效应。

尤其是如果监管方式是……目前,到目前为止,监管方式还只是“不要发布模型”。但越来越多的监管方式是纽约禁止数据中心。得克萨斯州在实施暂停令。俄亥俄州在说,或者至少试图说,你必须支付一定半径内所有人的房产税。这类事情会减少供应并增加成本。这些成本也会被转嫁出去。

你最终会陷入这样一种局面:进展确实放缓了,至少从外部感知来看是这样,即使模型内部在持续变得更好。在爆发式增长的情景下,为什么Anthropic不把最好的模型比外部可用的版本提前六个月发布?因为安全和监管的原因,但也是因为竞争优势?如果进展在加速,那六个月的差距实际上是一个更大的差异。

所以,这就是会限制每兆瓦营收增长、使其远低于今年上半年增速的因素。

00:29:43 – 实验室正在将算力从推理转向研发

这是我很感兴趣的一点。随着这些公司上市并对投资者负责,假设到明年年底它们拥有接近20吉瓦的算力。那么10%的算力就是2吉瓦。

假设它们想把训练算力的占比从60%提高到70%。而它们的投资者会说:“如果你们每吉瓦能产生1000亿美元的营收,那你们为了增加训练算力,基本上就是在对2000亿美元的营收说不。”所以投资者会说:“搞什么?你们在训练上已经花了那么多钱。为什么还要在训练上花更多?”

作为一家上市公司,你觉得如果他们直接说“不,我们会继续提高用于训练的算力占比,以抵消每吉瓦算力带来的收入增长”,会发生什么?

Dylan Patel

这是我个人的看法。各大实验室会随着时间的推移,把越来越少的算力分配给推理。我认为这个观点非常非主流。大多数人的标准看法是:“哦,大部分算力都会用于推理。”但实际上,大部分算力会用于训练的前向传播,而不一定是产生收入的推理。

归根结底,如果今天每兆瓦能产生3000-4000万美元收入,你会把40%分配给推理。如果现在每兆瓦能产生6000-7000万美元收入,你还会把40%分配给推理,然后赚取所有这些利润,再做分红和股票回购吗?还是去造AGI?我认为Anthropic和OpenAI的答案很明显——不只是高管层,也包括董事会——就是去造AGI,因为那要赚钱得多。所以最终你会看到他们把用于训练的算力占比不断往上调——

而如果把这些算力用于推理,每一份新增算力都在产生越来越多的利润。

Dylan Patel

没错。关键在于,如果我在卖token……OpenAI推出Ultrafast模式只是给外部用,还是内部也在用?事实证明,不是的。实际上,我会把它同时分配给内部和外部,因为我从超快AI或最好AI模型中获得的内部价值,远超外部用户能带来的价值。

所以最终,当然,我每兆瓦能赚1亿美元,但如果我把这些算力转向AI研究,我能获得多少增量进展?那对我未来的盈利潜力、对我所做一切的折现现金流意味着什么?他们不会去做这种计算,但归根结底,把越来越多的算力投入内部更有意义。推理算力之所以要这么大,唯一的原因就是让你能扩大训练集群。

我认为这是一个很有意思的经济学问题,我觉得我们可以让模型来消化理解。在一个推理所消耗算力占比下降的世界里,需要满足哪些条件才可能成立?

Dylan Patel

我认为过去三个月他们已经在这么做了。我觉得在今年的一些时间段里,他们确实在提高算力占比……我们一个月一个月来看。你会同意,Anthropic 每个月新增的算力都比上个月多。可能在他们签下 SpaceX 之类的交易时会有些波动,但总体而言,算力总量是一条向上的曲线。

所以一月份,他们新增的算力比十二月份少,但他们的收入增长却飙升了。然后他们基本上进入了平台期。他们现在不是每个月都增加 250 亿美元的年度经常性收入(ARR)。这意味着他们获得的边际兆瓦电力,投入到研发的比例高于投入到推理的比例。所以事实上,他们今天正在把更多算力转向研发。我觉得只要你足够仔细地观察他们在做什么,这一点是不言自明的。

00:33:27 – 中国获得的新增算力不到 10%,但其实验室需求更少

如果我看你刚才说的全球算力增长速度的数字,有些事情我想搞清楚。似乎如果我把你刚才说的数字加起来,到 2028 年底全球算力会超过 200 吉瓦,对吧?

Dylan Patel

对,全球范围内。

好的。那 2028 年之后,全球 AI 算力还能以多快的速度继续增长?

Dylan Patel

今年 30,明年 50,2028 年 70。2029 年应该在 90-100 左右。

然后每年就再增加 100 左右?

Dylan Patel

我认为斜率可以继续向上。要预测四年以后的事情很难。谁知道我们是不是处于 RSI 阶段,或者世界经济什么时候能以每年 10% 的速度增长?因为如果你每年新增 100 多吉瓦,那就意味着荒谬的 GDP 增长率。

如果你认为 2028 年全球有 200 吉瓦,那到时候中国有多少?在整个趋势中,中国的算力是如何持续增长的?因为如果 RSI 相关的事情在中国拥有大量算力之前就在西方启动了,那我们可能生活在一个与不启动时截然不同的世界。

Dylan Patel

如果我们把时间拉回到2022年,美国当时新增算力约占全球的45-50%,中国约占30-35%,其余部分由世界其他地区占据。自2022年以来,美国对中国实施了大规模管制,同时美国本土算力大幅增长。所以如今,70%的电力部署在美国。中国所占的比例非常小,用于数据中心AI计算的电力部署不到10%。

展望未来,中国的占比仍然很小。其本土产量相当有限,从Nvidia的采购量也依然很小,而且其中很大一部分最终流向了其他地方,比如马来西亚之类的。

因此,归根结底,中国本土新增算力仍将保持在10%以下。我认为到2028年可能会开始出现拐点。但基本可以肯定的是,中国的AI算力将达到3000万千瓦或更少。

到2028年?

Dylan Patel

是的,2028年。

好的。那他们的增长曲线会以多快的速度飙升?

Dylan Patel

我确实认为在2028年,中国能够部署的算力会有大幅提升。在2026年,他们仍然主要依赖大量走私芯片,以及台积电为那些被认为不是华为、但最终被证实是华为的公司所制造的芯片,还有三星出货的大量HBM。

但到了2027年,晶圆厂开始投产。尤其是2028年,中芯国际和长鑫存储等厂商的晶圆厂开始放量,本土产量实际上将达到每年数百万颗的规模。仅2028年一年,他们就能新增500万到1000万千瓦的本土制造芯片。这些芯片的性能肯定不如Nvidia在2028年、Google在2028年或OpenAI在2028年所拥有的芯片。

所以你的意思是,即使是吉瓦这个数字也高估了实际情况。3000万千瓦没错,但芯片性能确实差得多。不过,如果你认为明年全球将新增1亿千瓦——我知道你说过很难预测那么远——那中国下一年能新增多少?基本上,我想知道的是:他们是在能够大规模出货算力的那一刻就迎来指数级增长,还是说他们的增长仍然会低于美国及其盟友?

Dylan Patel

美国能否通过《MATCH法案》、相关工具是否会继续受到出口管制、中国能以多快速度建成其开始具备本土生产能力的新设备,这些都还存在很大变数。但归根结底,中国必然会迎来爆发式增长。如果说中国最擅长什么,那就是以极快的速度扩大制造规模。

我预计中国将能够越来越多地把外国芯片的采购量转移到国内,或者至少在缩小美国允许英伟达向中国出售芯片的额度方面缩小差距,诸如此类。

但你认为中国在2029年能新增500亿瓦(50吉瓦)的算力吗?

Dylan Patel

我认为这完全合理。其中一部分也可能来自国外采购。但没错,我认为中国在2029年达到500亿瓦是完全合理的。但如果其中大部分是国产芯片,那么存在一个因素:这500亿瓦的实际价值大约只相当于美国芯片的200亿瓦。

对。所以你实际上在预测这样一个世界:如果按质量加权计算吉瓦数,2028年领先的实验室可能拥有比中国在2029年甚至2030年所拥有的全部算力还要多的计算资源。

Dylan Patel

这意味着没有任何措施来减缓美国实验室的发展。

没错。

Dylan Patel

但显然政府和政客们已经开始这么做了。而中国不会放慢AI发展的步伐。事实上,他们唯一会做的就是加速推进。

说实话,当我采访Jensen并问及出口管制时——我是一个自由意志主义者——我并不完全确定自己对这个问题的看法。我当时是在为他所持观点的对立面做最强有力的辩护,因为我认为把各种想法摊开来讨论很重要。我当时想的是:“是啊,也许存在这样一个世界:如果我们只是与中国合作,对我们反而更好,尤其是考虑到他们控制了供应链中如此多的环节,以及机器人技术未来所需的其他东西。”

但我之前没意识到算力状况像你说的这么糟糕。实际上,出口管制似乎确实起到了很大作用……如果他们真的按你说的那个量出货,那差别就大了。等我们有了自动化程序员、开始进入自动化研究员阶段时,中国在算力存量上会远远落后。如果最终真是这样,那这套做法就奏效了。我觉得这其实是一个相当显著的成功。

Dylan Patel

唯一的保留意见是,这里面一部分是出口管制的原因,但另一部分也跟金融体系有关。美国金融体系比中国金融体系更愿意把钱砸进初创公司。但一旦中国金融体系选定一个行业重点投入,它们会给予多得多的补贴。

所以中国半导体行业获得的补贴总额,比全球其他所有半导体行业加起来的补贴还要多得多。如果起飞速度没有你暗示的那么快,而是实际需要更长时间,那么中国最终会在半导体领域大幅追赶上来,而半导体在某个时间点上就等同于算力。

这件事另一个值得注意的方面是,中国公司今天在AI模型上并没有落后太多——至少公众感知上是这样——而考虑到他们拥有的算力量,这就更值得注意了。中国领先的实验室总共最多只有100-200兆瓦的算力,字节跳动的Seed是唯一的例外,他们的算力远超这个数。但Kimi并没有在运行千兆瓦级别的算力,连接近都谈不上。而Anthropic到今年年底会超过5千兆瓦。

所以问题是,这重要吗?我觉得目前这种算力差距没那么重要。当我们拆解一个实验室的算力比例或预算时,到目前为止大约是60%用于训练、40%用于推理。但训练部分还可以进一步拆分。实际上50%的算力用于研究,10%用于开发,然后40%用于推理。

我说的研究和开发是指:研究人员在产生想法、测试新架构、测试新的数据配比、测试新的超参数、新的注意力机制技术,等等等等。但最终当他们进行正式训练时——比如Anthropic训练Mythos时——功耗是低于200兆瓦的。

预训练还是整个流程?

Dylan Patel

预训练。大约不到200兆瓦,持续大概两个月。然后强化学习用的算力甚至更少。

你认为强化学习用的算力比预训练还少?

Dylan Patel

至少就单一地点的预训练而言,是的。

但总算力可能更高,对吧?

Dylan Patel

但这是按顺序进行的。他们在某个时间点最多用过的算力大概是200兆瓦。实际上他们拥有数千兆瓦的算力,所以他们大部分算力都用在了研究上,而不是模型开发上。

这其中有原因。协调所有这些集群很困难。把它们都放在同一地点很困难。做多地点训练很困难。做强化学习也很困难。在强化学习期间生成更多的展开样本并不一定会让它变得更好。有各种各样的原因导致你可能无法把你拥有的全部两千兆瓦算力都用在训练上。实际上,我只能用上200兆瓦。

随着我们在自动化编码和自动化研究方面走得越来越远,我实际上预计用于研究相对于训练的算力预算占比会变得更加模糊,甚至训练占比会更高。还有持续学习之类的事情。所有这些都开始意味着越来越多的算力实际上用在了训练模型上。

如果你最终进入一个每年消耗100吉瓦的世界,按当前价格计算,那将是每年5万亿美元的资本支出。

Dylan Patel

再加上你必须在更早之前就建好发电厂。而且那也是30年期的资产。再加上数据中心是15到20年期的资产,而且你当时也必须把它建好。所以那5万亿美元,一旦你把未来几年的增长考虑进去,实际上会更接近7万亿或10万亿美元的资本支出。

等等,我没明白。那还没有包括数据中心本身没有发电基础设施这个事实。

Dylan Patel

对,没错。谈到AI资本支出时,人们说的是400亿、500亿美元。但那其实只是核心IT部分:服务器、网络、光纤、收发器、光通信,诸如此类。它并没有把数据中心本身或发电厂算进去,而这些都是在提前建设的。

如果今年我建100吉瓦,明年建150吉瓦,那么这150吉瓦对应的所有建筑都需要在今年计入资本支出。如果后年我要建200吉瓦,那所有这些发电厂都需要投入……你今年就得买好涡轮机。所以实际上,如果你在建100吉瓦,这个数字甚至比5万亿美元还要大得多。

对。很有可能,到2030年底,每年的增量资本支出将接近10万亿美元,这将是世界经济总量的近十分之一。如果所有这些都发生在美国……美国经济届时也会增长。但即便如此,按美国经济目前的规模来看,这相当于美国经济的三分之一到四分之一都投向了数据中心。

我这么一说出口,自己都觉得:“也许你是对的,我们就是不会允许这种事发生,而这正是这件事不会成真的原因。”因为要让这种指数级增长持续下去,美国经济的四分之一都在建数据中心。

迪伦·帕特尔

我相信资本主义,相信资源会流向最有利可图的地方。但与此同时,政治是存在的,信贷市场是存在的,资本市场也是存在的。

所以,要实现比如说2030年那100吉瓦的目标……或者我们甚至把它缩减到2028年,那时所有这些项目的资本支出将达到3到4万亿美元:其中超过2.5万亿美元投向IT资本支出,另外1到2万亿美元投向数据中心和能源,以及下游的整个供应链,比如半导体之类的。如果你有3到4万亿美元的资本支出,这些现金从哪里来?目前还没有任何企业能从业务中产生这么多现金。

超大规模云厂商支撑了迄今为止的全部增长。谷歌、微软、亚马逊、Meta。它们承担了其中很大一部分。它们占了算力的一半以上,但如今它们自身并不产生现金流。实际上,它们把所有资金都花在了资本开支上。此外,它们还举债,并把借来的钱也全部投入资本开支。你已经看到Meta这么做了,甚至亚马逊、谷歌也是如此。微软很快也会跟上。所有人都在举债来支付资本开支。

那么,谁是那个以前没出钱、现在要新增出钱的人?以谷歌为例,它们停止回购股票,或者Meta停止回购股票,转而购买计算基础设施,这很简单。这对市场影响不算大,但确实有一定影响。然而,当你展望到2028年——届时超大规模云厂商要举债数千亿美元,它们的整个供应链也要举债数千亿美元——谁来为这一切买单?

有几种不同的方式。有半导体公司,比如英伟达、博通以及存储芯片公司,转身决定为部分资本开支提供资金。还有传统基础设施投资者,他们正在募集资金并投资于基础设施。只不过从桥梁变成了数据中心。

最后,还有经济中的每一个人,他们开始意识到:“也许我不该买房,也许我不该投资那些帮人买房的信贷,也许我不该买政府债券。我应该买超大规模云厂商的债券,或者买这个数据中心的债券,或者买Anthropic的债券。因为Anthropic愿意为新增的十亿美元产能支付20%的利率。因为他们知道由此带来的收入会非常可观,而且他们愿意付20%,因为这仍然比从SpaceX以每吉瓦500亿美元的价格租算力要划算。”

所以你会看到所有这些争夺。但如果你真的这么做,整个世界经济格局就会被彻底重塑。

00:48:48 —— AI会引发主权债务危机吗?

过去几天,你我私下一直在争论一个问题:AI 是否会导致主权债务危机。逻辑是这样的。正如我们刚才提到的,现在出现了一种局面——极少量的投资就能转化为巨额的财富。所以投资回报率——

Dylan Patel

这他妈是个多大的问题啊,兄弟。我的天。简直不敢相信。

不,这对其他那些没法用少量资金撬动巨额财富的人来说,是个天大的问题。所以投资回报率极高。哪怕只看数据中心层面,如果你建一个数据中心,想以折旧成本 10 倍的价格租给 Anthropic 或 OpenAI,这他妈简直离谱。你投 1 美元,年底就能变成 2 美元、甚至 10 美元。这会推高利率。

那么,如果利率走高,而且是对整个经济而言……人们借的钱越来越多。他们在跟政府原本会做的放贷竞争,跟其他公司原本会做的放贷竞争,也跟你作为消费者或房贷购房者原本会做的借贷竞争。这让其他所有人的借贷成本都变得更贵。这对千千万万的人都有巨大的影响。抱歉,我可能要在这儿多说几句,但这些问题是我们一起思考过的。

我觉得美国最终会没事。因为如果数据中心建在美国境内,你基本上可以直接对数据中心征税。但按照现行税制,企业所得税占联邦财政收入的比例不到 10%。超过 80% 来自工资税和所得税,而随着自动化程度越来越高,这部分税基会不断萎缩。

与此同时,在支出端,目前有 20% 的税收收入用于偿还债务,也就是支付债务利息。而现在很大一部分债务是短期的,所以每五年就要展期一次。你他妈笑什么?

Dylan Patel

因为这些都是你上个月才学到的东西。

说得好像你就不是一样。你可是拿了金融经济学学位的人。

Dylan Patel

我没有。网上的人都以为我是养蜂的。就几个月,就几个月的事。

这就是我们的行当,Dylan。

Dylan Patel

我知道,我知道。抱歉,抱歉。

这下我有点不自在了。靠。

Dylan Patel

不,挺好的。你做得很好。我只是觉得挺好笑。一百万人听这个家伙讲他上个月才刚学会的债务知识。

假设利率上升 1%。以五年为基准,用于偿还债务的税收收入占比会从 20% 上升到 25%。如果利率上升 5 个百分点,这个比例会超过 40%。但如果把政府每年借入 2 万亿美元这个事实也考虑进去,那就会从 40% 一路涨到 60% 以上。也就是说,60% 的税收收入仅仅用来支付债务利息。

不过,我认为美国会没事,因为如果我们允许数据中心在美国建设,税基就会扩大。在我看来,其他国家绝对完蛋了。我刚刚在看哪些国家债务很多、税收收入很少,而且债务偿还频率很高。像巴基斯坦或尼日利亚这样的国家,我觉得在这种新的利率环境下会非常惨。

Dylan Patel

正是这种挤出效应,才不是“管他呢,上 10 亿吉瓦”。你看有这么多行业和国家大量使用债务,你之前提到的那些贫困国家,它们就直接违约了。还有消费品行业,所有那些你在 Trader Joe‘s 之类地方看到的东西的生产公司,它们用了大量债务。所有电信公司也用了大量债务。银行也用了大量债务。

所以如果市场利率上升——不一定是政府设定的利率,而是政府公布的联邦利率与其他所有人收取的利率之间的利差,因为亚马逊明年想借 1000 亿美元债务,或者管它具体是多少,可能少一些——你就会面临一个非常棘手的问题:钱从哪来?

有一部分是靠现金流来支撑的,而且现金流还在持续增长。但合乎逻辑的做法是投资远超你现金流的规模,因为那样未来几年的回报会非常惊人。所以就有了这个差额。

那么,压低这个增量的,就是所有这些其他因素:针对数据中心的监管、消费者的不满、政客的不满、针对AI的监管,以及AI实验室出于安全原因不发布最新模型。利率上升对所有这些因素都有影响。所以,所有这些因素都在把曲线从资本主义在纯粹、简单的经济学意义上想要的方向,拉向我们这个复杂系统想要的方向,并且越拉越低,以至于最终建成的吉瓦数达不到本应建成的规模。

嗯,但利率本身就是资本主义的一部分,对吧?

Dylan Patel

对,但这是在简单经济模型和更复杂的现实情况之间的区别。

你觉得明年亚马逊或Anthropic之类的公司发行债券融资的利率会是多少?如果他们发行数千亿美元的债券。平均利率是多少?

Dylan Patel

我不认为亚马逊会发行数千亿美元的债券。

我是说总共。比如说所有大型科技公司加起来。

Dylan Patel

超大规模云厂商加起来,以及所有云服务商……在我们做的建模中,2024年到2029年的资本开支大约是11万亿美元。

总共?

Dylan Patel

总共。如果你尽可能多地用现金流来融资,最终仍然会有超过5万亿美元的信贷需要发行,来支撑这11万亿美元以上的建设规模。

所以你不认为AI收入能继续每年翻三倍增长?

Dylan Patel

AI收入确实在增长。但我不认为它能永远增长下去而不碰到某些约束。实验室会有某些激励。在很多情况下,实验室并不是所有算力的建设方,尽管他们越来越倾向于往那个方向走。

但他们会有这么多现金流。你说收入会是多少?你觉得他们不会有那么多收入吗?

Dylan Patel

不,我只是说,到2029年,资本开支的规模在11万亿美元左右。其中6万亿美元用现金融资,5万亿美元用债务融资。如果是这样的话,整个生态系统要筹集5万亿美元的债务,确实会推高利率。

那什么能阻止这种情况呢?有几件事。其一,实验室会不会提高每兆瓦的营收,并保持推理算力分配充足?如果是这样,他们就把标普500的全部利润都积累到自己手里,因为所有人都在花钱降本。当然,他们自己的利润也会上升,但现金总得有来源。所以,他们的营收增速相对于他们为世界创造的价值,是存在上限的。而且这项技术还有扩散效应。

但归根结底,实验室的营收会持续上涨。他们无法完全靠现金流来支撑一切。最优的方案其实是尽可能多地利用信贷来融资,因为即便实验室的现金流能支撑很多东西,你想建的规模比那更大。所以,总会有一定规模的信贷被创造出来。

我们目前的模型测算显示,到2029年,信贷规模为5万亿美元,现金出资的基础设施投资为6万亿美元。把这些算进去,相对于AI模型带来的需求增长,算力仍然不够。所以答案显而易见——每兆瓦的营收会持续上升。

有道理。那你觉得到2029年,这一切会把利率推高多少?

Dylan Patel

兄弟,这纯粹是拍脑袋估个数,但既然要拍……世界经济的增速在大幅上升,那亚马逊的利率凭什么不从现在的位置往上涨?

这个数字会非常拍脑袋,但最近Meta以5%到6%的利率融资。我看不出他们为什么不会付8%。他们会很乐意付8%,因为他们要建的算力带来的回报是巨大的。市场不希望他们付这么高,但他们自己愿意付8%。

反过来看,如果他们从现在的5%、5.5%、6%涨到8%——也就是250个基点的上升——那经济里的其他所有人也得跟着多付250个基点,这会引发一连串连锁反应。银行会叫苦连天,因为如果它们的信用利差扩大,债务的重新定价速度会快于资产的重新定价。如果信用利差爆掉,它们最终会亏掉大量资金。

这一点的另一个后果——这是你提出的观点——是如果利率上升,贴现率就会提高,这意味着所有股票的贴现现金流都会暴跌。也就是说,即使整个股市表现尚可——标普500没问题——任何一只个股的价值很可能也已经暴跌了,尤其是巴菲特、伯克希尔那种类型,即“未来30年持续产生良好现金流”的股票。

Dylan Patel

是的。就像在问:“我为什么要为强生付这么多钱?”它们被视为稳健股:现金流良好,会随时间逐步回馈现金流。或者一家铁路公司。如果我的贴现率不是3%或5%,我凭什么投那么多钱?现在已经是8%或10%了。

对于发展中国家……Basil Halperin,他是我的好朋友,也是一位经济学家,他提出我们会看到第二次沃尔克冲击。80年代,为了对抗通胀,美联储主席保罗·沃尔克把利率提高了5个百分点以上,实际利率大约达到8%。那导致那个十年里大约40个国家——主要位于拉丁美洲——发生违约。我认为这种情况很可能会再次发生。

好,现在我们开始聊奇点了。我们刚才一直在讨论利率上升会发生什么——

Dylan Patel

顺便说一句,我认为这一切都发生在奇点之前。

对,我就是这个意思。我们刚才说的是在奇点之前,利率上升2-3%等等。到了某个时点,我认为世界经济非常有可能每年翻一番。这不是五年内会发生的事,但最终会到来。有一位研究者叫Damon Binder,他在这方面做了很棒的工作。如果你去看一个完全自动化经济体的投入产出表……要让经济中全部物资存量每年翻一番,需要什么条件?

Dylan Patel

是的。如果经济每年增长3%,那么按70法则,就是20多年翻一番。

对。但他说的是:“好吧,现在我们的瓶颈在于人力,而且你不可能每年都让人员翻倍。”但在一个你也能每年让劳动力翻倍的世界里,经济能增长多快?我觉得它可以每年翻一番。至少也会是每年百分之几十的增长。

好吧。利率应该会非常接近增长率。不会完全相等,因为还有消费的因素,但应该会相当接近。然后我们会进入一个——我认为是在2030年代——利率达到百分之几十的世界。我脑子里有一部分在想:“可能会是百分之几百,”但我们就说至少是百分之几十吧。

我就想,好吧。每一个没有参与AI生产的国家都会违约。每一只不是AI股的股票基本上都一文不值,因为折现现金流毫无价值。如果联邦政府想不出办法对AI征税,那么偿债支出就会超过当前的税收收入。而且还有所有这些其他影响,我敢肯定我们甚至都没把它们计入价格:你贷不到房贷,等等等等。

从根本上说,这个世界正在发生什么?这全都是技术宅的黑话,对吧?但让我们退一步看。到底发生了什么?

Dylan Patel

现在才开始说黑话吗?

我们会进入一个完全不同的增长模式。经济基本上在说:“嘿,现在政府借钱给民众发养老金的的机会成本极高。因为那些钱本可以用来建一座机器人工厂,而这座工厂再去建另一座机器人工厂,那座再建下一座。”资本的机会成本会大幅上升。这从根本上就是我们刚才讨论的所有这些事情的根源。

Dylan Patel

随着利率上升,股票市场会受到重创。连AI公司也不例外。有些真正相信AI的人会说:“为什么美光、海力士或者铠侠的市盈率只有2到3倍?”答案是:“嗯,如果你真的被AI洗脑了,那经济里的每一样东西都应该以2到3倍的市盈率交易。”如果你没被AI洗脑,那当然,它们确实是超额盈利了。

这是一个论证,说明为什么——我认为内存股会表现很好——内存股不应该再涨10倍或类似幅度。因为如果我们处于一个对内存有如此巨大需求的市场——这意味着AI已经引发了经济的剧烈变革——那么所有东西都应该以2到3倍的市盈率交易,股市应该彻底崩盘。

从某种意义上说,Meta的估值……我认为他们是一家大约1.5万亿美元的公司。这算什么?太荒谬了。他们的价值远不止于此,至少在逻辑上是这样。你只要看看他们的现金流、他们囤积的所有基础设施,以及他们将要能够以每瓦特疯狂的价格出售的所有算力——要么以token的形式出售(因为他们的实验室成功了),要么直接卖给Anthropic和OpenAI。

这最终变成了一个问题:你必须把所有的资本重新配置给AGI。而做到这一点的方式,就是把其他所有人都挤出市场。所以AGI的瓶颈不在于研究工程师——比如我们的室友Sholto——能多快地转动齿轮。实际上真正的问题是,世界其他地方愿意让这件事走多远?

因为他们会进行监管。他们显然会提高利率。他们会说“不许建数据中心”。他们会说“停止建晶圆厂”。他们会说“天哪,每家公司的股权价值都在暴跌,那我怎么还能花钱买AI来提升我的业务?”

那么,Anthropic和OpenAI就必须开始自己建设这些东西。他们已经在打造自己的芯片了,或者至少在设计自己的芯片,而且这还会继续扩展。他们正在签订自己的数据中心合同,并在未来几年内建设自己的基础设施。

这里有一个问题,就是这种经济资源的重新分配会如何发生。即便模型本身具备实现“直线起飞”的能力,也存在很大的下行压力,阻止这种情况直接发生。我认为你我都相信,我们正处在一个模型具备这种能力的时代。但“慢速起飞”至少是我所希望的,因为经济领域和监管领域有各种因素在起作用。政府说“不要发布你们的模型”,政府说“实际上,你们甚至不能在内部过多使用你们的模型”,因为这种情况很快就会发生。他们已经在说你们不能发布模型了。

我最担心的是“奇点”的出现,而外部部署实际上有助于防止这一点。所以,我们阻止外部部署这件事,是愚蠢的。

Dylan Patel

那能阻止奇点吗?

目前来看,这会带来更多收入,因为模型还不具备递归自我改进(RSI)的能力。但我担心的是,到了2030年,政府会说:“你们要等六个月才能向公众发布你们最新的模型。”

Dylan Patel

六个月,100倍的算力增长。来吧。

在那六个月里,他们在内部进行递归自我改进。公司内部会发生各种疯狂的事情。与此同时,我们其他人只能被困在那些按当前速度来看落后了好几年的模型里。

我的想法是这样的。假设全世界都参与这个“阴谋”,试图减缓AI的发展。

Dylan Patel

我不认为这是阴谋。每个政客都公开写明了这一点。

假设他们把AI发展减缓了一年。如果算力每年增长2到3倍,他们阻止了一整年的AI部署,那么你就比你本应达到的水平落后了一年。而在递归自我改进期间,你可以在一年内获得3到6年的AI进展。

Dylan Patel

但他们不只是限制算力。他们还限制了实验室在内部发布模型的能力。我们看到了这一点。

如果他们那样做了,那将是理想的。

Dylan Patel

Anthropic 曾一度不得不停止向外国员工提供 Mythos。

我不知道这是真的,内部也是这样吗?

Dylan Patel

那是他们声称的。

我以为那只是一个不同的检查点,不是 Mythos,但基本上就是 Mythos。

Dylan Patel

但这类事情同样不会被允许。政府虽然笨,但我想他们至少不至于笨到那个地步。各国政府——至少是手握筹码的美国联邦政府——不会愿意让 Anthropic 内部使用 Mythos 4。他们会说:“等等,先停一下。”因为所有这些监管层面的原因。

每个当选的人都会讨厌 AI。就连现在已经当选的人都已经讨厌 AI 了。所有选民都是。我敢打赌,总有一天你父母会打电话给你说:“Dwarkesh 孩子,你干得太糟糕了。你让 AI 进展得太快了。”

因为我的播客,我在加速 AI 进展?

Dylan Patel

也许吧。你在教育人们。也许如果他们更聪明,他们就会更快地推进 AI。

总之,AI 的进展、开发和部署将会受到现实世界的种种约束。尽管这一切最终会发生,但在到达那一步之前,我们可能会先把自己撕裂。

01:07:52 —— 世界未来的劳动力会归属于少数几家公司吗?

这些情景中让我觉得疯狂的一点是,世界未来劳动力供给中有多大比例最终会集中在极少数公司手里,而且这个劳动力供给每年增长得有多快。如果前沿算力以 FLOP 计每年增长 4-5 倍——而且达到某一能力水平所需的算力每年下降 3 倍——基本上,前沿实验室的有效 AI 人口规模每年增长 10 倍。这在当下其实没那么重要,因为 AI 还不够好,无法胜任完整的工作,也无法像人一样在干活或搞阴谋等方面拥有同等自主性。

但如果当前趋势持续下去,你会看到一个这样的世界:OpenAI 从今年大约拥有 1000 万 AI 劳动力,到明年变成 1 亿,再到后年变成 10 亿。用不了多久,即使算力扩展放缓,也用不了几年,每家公司的劳动力当量就会超过地球上的人口总数。我认为到本十年末,这完全有可能实现——单个实验室内部的 AI 劳动力、有效人口规模,将超过地球上的人口总数。

我们经常谈论因国有化或其他原因导致的权力集中。但我们没有充分思考这样一个事实:我们实际上正在飞速进入一个阶段,在这个阶段里,大多数“人”——按工作产出计算——都集中在两个实验室中,而这两个实验室正在消耗全球越来越多的算力。如果这些 AI 出现对齐问题,那么基本上整个世界都是失对齐的,因为世界上大多数“心智”都在那里。但即使它们没有对齐问题,也只有极少数公司拥有很大的影响力或控制力。

Dylan Patel

最近有一场争论,我记得是 Gavin Baker 说:“Dario 认为世界上只会剩下一家公司。”然后 Sholto 和 Dario 出来澄清说:“不不不,我们没这么说过。”但归根结底,如果你相信 RSI,如果你相信实验室是算力最有效的使用者、能从中产生最大价值,那么唯一会发生的事情就是算力集中化。如果你相信 AI 研究者、RSI、AGI,那么这一切都存在,这一切都是基础。

即使没有 RSI,这一点也成立。在给定能力水平下,前沿领域的有效人口目前正以每年 10 倍的速度增长。所以如果你达到了一名非常能干的远程工作者、或一名非常能干的软件工程师、或一名非常能干的研究者的能力水平,那么这类“人口”在当前能力增长速度下,正以每年 10 倍的速度增长。

Dylan Patel

我明白了,而且这还是在不考虑 RSI 的情况下。一旦有了 RSI,那就更疯狂了。

然后它可能是每年增长100倍或1000倍。或者它们的智能在提升,但人口数量没有增加。又或者是这两者的某种混合,对吧?

Dylan Patel

Dwarkesh,你看到的是一个什么样的世界,在那里一切都不是中心化的?因为在我看来,每一种力量都在朝着中心化狂奔。这简直太可怕了。

我也希望它不要完全中心化。但也许这就是一台热爱优雅的机器的全部意义所在,对吧?它无处不在,让我们的生活变得美好。

思考未来实在太难了。但我同意你的看法。我认为根本问题在于,AI训练具有巨大的规模经济效应,因为你花在训练AI掌握某项特定技能或特定知识集上的任何努力,都会被分摊到数十亿次会话或数十亿用户身上。所以这是其中一个效应。

另一个效应是,如果你在AI竞赛中略微领先,而算力又处于短缺状态,你就可以收取高得多的加价,因为你能更好地利用这种稀缺资源。所以有两个效应会让AI竞赛中的领先者获得越来越多的优势。可能还有更多。如果模型从部署中学习,而一个模型的部署范围比另一个广泛得多,它就能获得多得多的真实世界数据。

Dylan Patel

我明白你的意思了,无论是用户部署和持续学习,无论是训练及其带来的规模经济效应,还是渐进式进步——最好的AI模型帮助你制造下一个最好的AI模型,RSI(递归自我改进),所有这些都指向中心化。

我认为,说实话,我们应该花些时间思考的重大智力课题之一——或者至少我会花些时间思考的——是:在AGI之后,一个去中心化、广泛赋能的未来愿景是什么样的,同时认真对待这些规模经济效应?另一种愿景是政府控制它,也许你认为你可以更信任政府,因为它不是私营企业。

Dylan Patel

我不信任政府,我也不信任Dario,我也不信任Sam。

这是个问题,对吧?显然,对未来做出判断是很容易出错的。你无法预见到某个关键效应,或者某件改变一切的事情。但事前来看,我们很难看到如何避免一种局面——我们不得不在某一种集权来源之间做出选择。

Dylan Patel

这就是资本主义之所以有效的原因,对吧?它是去中心化的决策和去中心化的权力。这也是为什么超级集权的资本主义经济体在某种程度上实际上比超级去中心化的资本主义经济体增长得更慢。你必须有法治等等这些。但AI把这一切彻底颠覆了。最终你会觉得:“其实,私有制可能不是最高效的经济形态,因此它比一个集权化的AI经济发展得更慢。”

嗯,这仍然是私有制,但真正参与这一经济份额的公司有多少家呢?大概只占目前经济的2%左右吧?1万亿美元除以30。英伟达占了其中很大一部分,还有Anthropic、OpenAI以及那些超大规模云厂商。显然还有其他公司参与其中,但AI领域的很大一部分业务实际上只来自极少数公司。所以它可以是私有财产,但参与其中的公司非常少。

Dylan Patel

我的意思是,这就是市场结构正在做的事情。那么什么能阻止它呢?我不知道。除非AI进展放缓,除非政府对它进行严厉监管,否则这就是将要发生的一切。在这种情况下,我们正走向一个世界——要么资源高度集中,我们祈祷那一家公司把所有事情都做对;要么政府拖慢一切、人们拖慢一切,希望以某种方式出现进展放缓,从而有更多的权力平衡。

即使在我们走向AGI、ASI、RSI的过程中,沿途的一切仍然会导致有人攫取更多资源。所以很难找到一个框架,让AI不会导致超级集中。

现在,这里唯一积极的一点是,如今 Anthropic 并没有攫取大部分价值。我们可以尽情讨论他们如何从每兆瓦 2000 万美元涨到每兆瓦 1 亿美元,但他们购买的大量算力仍然只支付 1300 万美元。但归根结底,他们之所以涨到每兆瓦 1 亿美元,是因为 Jane Street 正在每兆瓦赚取 3 亿美元或 5 亿美元。或者 Dwarkesh,通过研究他的播客和学习信用/信贷知识,每兆瓦能赚多少美元?而你能用多少呢?很难说。

但我认为这是唯一的可取之处,即经济体的其他部分从 Anthropic 中获得的利润可能要多得多——

不,但你之前阐述的整个逻辑——他们将推理算力重新分配给 AI 研发——那个逻辑的核心在于,AI 实验室内部的劳动回报远高于外部的回报。

Dylan Patel

是的。这是我的自我安慰。我同意。在世界上所有的情景中……有 8 万个世界,而其中只有一个世界里,Anthropic 没有拥有整个世界。再说一遍,权力会集中,因为我不想把 token 发送到外部。它们在内部更有价值。所以这是一回事。我为什么要让 Jane Street 从那些堕落的期权交易者身上赚走所有这些钱呢?

嘿,他们是赞助商,拜托。天哪。

Dylan Patel

不,我觉得这很好。让市场变得更高效,对世界来说是有价值的。Jane Street 通过正确理解世界图景赚了这么多钱,从堕落的期权交易者身上赚钱,不管是什么,Anthropic 为什么要为这个分配算力呢?如果 Jane Street 每兆瓦的最终变现是 2 亿美元,所以他们愿意付给 Anthropic 1 亿美元……那么,如果 Anthropic 在内部使用这些算力,每兆瓦就能产生数亿美元的收入呢?这就是正在发生的事情。

带着这个沉重的基调,我想我们要等到 RSI 正式启动时再见了。

Dylan Patel

你不会要过两个月才再请我上你的播客吧?

好的,酷。谢了,兄弟。

来源:Dwarkesh Patel:Podcast & Blog(RSS)· dwarkesh.com