15,529 → 64 这可能是 @OpenAI 这周最被忽略的一个数字,比官方吹的 94% 提速重要十倍, 因为94% 是给媒体写标题用的,15,529 → 64 才是给工程师看的,
这是打开一个 741 轮、231MB 对话时,前端实际加载的 transcript 条目数,从一万五千多条砍到 64 条,
以前的做法是把整段对话历史连同所有 tool call、代码块、中间结果一股脑塞进内存和 DOM,打开等 27 秒,风扇狂转,页面随时崩,
现在只加载视口附近的一小撮,1.66 秒,网络请求从 894 个砍到 16 个,JS 堆内存增长减少 87.8%,
但更狠的还不是这些数字, Brent 补了一句:forking 和 side chat 接近瞬时,覆盖 CLI、所有应用、所有模型,
这就不是滚动优化了,是对话状态、分支管理、历史索引全部重写,
关键问题是为什么现在才做, 因为以前 @ChatGPT 是一问一答,客户端性能根本不是瓶颈,现在 Codex 一跑就是几百轮,上下文窗口涨到百万 token,模型在狂奔,客户端还在把整段历史一次性塞进 DOM,
简直是模型在狂奔,UI 在裸奔, 这次优化等于 OpenAI 公开承认了一件事:agentic 时代的瓶颈早就不在模型了,而在客户端,
我觉得以后评价一个 AI 产品,参数榜单会越来越不重要,能让你在一个会话里待多久、分多少叉、塞多重的上下文而不卡,会变成新的竞争力维度, 这组数字就是第一枪吧 hhh