# 消息称英伟达重启推理预填充芯片 Rubin CPX 项目，设计大幅调整

- 来源：IT之家（RSS）
- 发布时间：2026-09-01 09:42
- AIHOT 分数：49
- AIHOT 链接：https://aihot.virxact.com/items/cmti1tzg907wprofqutdyh3pw
- 原文链接：https://www.ithome.com/0/996/759.htm

## AI 摘要

分析师郭明錤称，英伟达已重启 AI 推理预填充加速 GPU Rubin CPX 项目，设计大幅调整，预计 2027Q1 开始生产。

## 正文

IT之家 9 月 1 日消息，分析师郭明錤昨日表示，其最新产业调查显示 NVIDIA（英伟达）已重启人工智能推理预填充加速 GPU "Rubin CPX" 项目，不过其设计得到了大幅度的调整，预计 2027Q1 开始生产。

在芯片级别，新 Rubin CPX 拥有接近标准 Rubin GPU 的算力，预填充性能进一步提升，单体最高功耗同为 2300W，配备 168GB HBM4 内存（IT之家注：旧 Rubin CPX 为 128GB GDDR7，168GB 或指向 7×24GB 设计）。

来到托盘与机架级别，8 颗新 Rubin CPX 构成 1 个计算托盘；8 个计算托盘构成 1 个机架模组，内部以 Spectrum-6 全铜以太网横向扩展 (Scale-out)；新 Rubin CPX 采用独立的 MGX ETL 机架，每个机架包含 1~4 组机架模组，机架模组间横向扩展则是 Spectrum-6 + OSFP 光学方案。

而在系统层面，NVIDIA 建议 Rubin CPX 与标准 Rubin 按 1:1 配对，Rubin CPX ETL 机架与 Vera Rubin NVL72 机架间采用基于以太网的 RDMA 连接。

这位分析师评论称，目前的 AI 推理工作量中超过 50% 来自处理输入并建立相应的 KV Cache，新 Rubin CPX 能以更具弹性的部署方式与更低成本承接预填充负载；新 Rubin CPX 计算托盘具备 1.34TB HBM 内存，足以满足大多数长上下文预填充与 KV Cache 建立需求。
