# OpenAI 前端优化：15，529→64 条对话加载

- 来源：AYi (@AYi_AInotes)
- 发布时间：2026-08-15 19:00
- AIHOT 分数：42
- AIHOT 链接：https://aihot.virxact.com/items/cmsuad6v205sbroe04wekv1kh
- 原文链接：https://x.com/AYi_AInotes/status/2088581633100095584

## AI 摘要

OpenAI 将打开 741 轮、231MB 对话的前端 transcript 加载从 15,529 条砍至 64 条，耗时从 27 秒降至 1.66 秒，网络请求从 894 个减至 16 个，JS 堆内存增长减少 87.8%。Brent 称 forking 和 side chat 接近瞬时，覆盖 CLI、所有应用和模型。此举承认 agentic 时代瓶颈已从模型转向客户端。

## 正文

15,529 → 64
这可能是 @OpenAI 这周最被忽略的一个数字,比官方吹的 94% 提速重要十倍,
因为94% 是给媒体写标题用的,15,529 → 64 才是给工程师看的,

这是打开一个 741 轮、231MB 对话时,前端实际加载的 transcript 条目数,从一万五千多条砍到 64 条,

以前的做法是把整段对话历史连同所有 tool call、代码块、中间结果一股脑塞进内存和 DOM,打开等 27 秒,风扇狂转,页面随时崩,

现在只加载视口附近的一小撮,1.66 秒,网络请求从 894 个砍到 16 个,JS 堆内存增长减少 87.8%,

但更狠的还不是这些数字,
Brent 补了一句:forking 和 side chat 接近瞬时,覆盖 CLI、所有应用、所有模型,

这就不是滚动优化了,是对话状态、分支管理、历史索引全部重写,

关键问题是为什么现在才做,
因为以前 @ChatGPT 是一问一答,客户端性能根本不是瓶颈,现在 Codex 一跑就是几百轮,上下文窗口涨到百万 token,模型在狂奔,客户端还在把整段历史一次性塞进 DOM,

简直是模型在狂奔,UI 在裸奔,
这次优化等于 OpenAI 公开承认了一件事:agentic 时代的瓶颈早就不在模型了,而在客户端,

我觉得以后评价一个 AI 产品,参数榜单会越来越不重要,能让你在一个会话里待多久、分多少叉、塞多重的上下文而不卡,会变成新的竞争力维度,
这组数字就是第一枪吧 hhh

### 引用推文

> Andrew Ambrosino：always nice to see internal slack messages like this- thanks @btraut
