Emad · @EMostaque · X·2026-09-01 06:11·12小时前
AI 导读

Emad Mostaque 转评一篇关于智谱的文章,称 GLM 6.0 将充分利用相关进展,GLM 5.3 基于年初开始的预训练,在网页数据枯竭后大规模扩展数据环境,并提到 20 亿美元 ARR。引用文章称 GLM-5.3 Flash 是该公司首个完全运行在国产芯片集群上的模型,约 10 万张国产加速卡实现大规模低成本推理,端到端服务性能较基线提升三倍,每 token 推理成本较年初下降 80%。

Emad@EMostaque
46AI 编辑部评分,满分 100
2026-09-01 06:11· 12小时前
AI 导读

Emad Mostaque 转评一篇关于智谱的文章,称 GLM 6.0 将充分利用相关进展,GLM 5.3 基于年初开始的预训练,在网页数据枯竭后大规模扩展数据环境,并提到 20 亿美元 ARR。引用文章称 GLM-5.3 Flash 是该公司首个完全运行在国产芯片集群上的模型,约 10 万张国产加速卡实现大规模低成本推理,端到端服务性能较基线提升三倍,每 token 推理成本较年初下降 80%。

something something RSI

which they intend to use fully for GLM 6.0

GLM 5.3 is based on pre-train from start of year, scaling up massively on data environments as web data tapped out

$2b ARR!

Lot's of interesting stuff in here

Zephyrhttps://x.com/i/article/2094542324617658368