# 智谱联合驭驯网络与清华提出ZCube组网架构，破解大模型推理网络瓶颈

- 来源：公众号：智谱（GLM）
- 作者：智谱
- 发布时间：2026-05-21 10:30
- AIHOT 分数：76
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmsdu107800u2rofz68f17j53
- 原文链接：https://mp.weixin.qq.com/s?__biz=MzkyMzI3NzQ0Mg%3D%3D&mid=2247493850&idx=1&sn=5b9dd246aa4d65190b9ee0556ce4b6ba

## 精选理由

架构创新不只是省钱，ZCube 在 GLM-5.1 集群里用三分之一交换机成本换来 15% 吞吐提升和 40% 尾时延改善，为 PD 分离推理提供了一条可复用的组网路径。

## AI 摘要

智谱、驭驯网络与清华大学联合提出并落地ZCube组网架构，以扁平化拓扑替代传统Clos/ROFT架构，从结构层面消除PD分离推理中的可避免拥塞。在GLM-5.1 coding生产环境千卡集群实测中，ZCube相比ROFT将GPU平均推理吞吐提升15%以上，TTFT P99降低40.6%，同时减少约三分之一的交换机与光模块成本。

## 正文

公众号正文需在微信内阅读，站内仅提供摘要。

> 站内仅提供摘要，全文见原文。
