GLM-5.3-Flash 在 AA 综合智能指数取得 57 分
GLM-5.3-Flash线上流量完全运行在10万颗国产芯片上,供应商或含华为、海光、摩尔线程。
事件全貌
智谱于2026年8月26日上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,总参数量320B、激活参数仅18B,支持1M-token上下文窗口,采用MIT许可证开源。该模型此前以Ox Alpha代号预览,完全运行于国产AI芯片,现已在HuggingFace、API等全平台上线。
GLM-5.3-Flash在AA综合智能指数取得57分,与Claude Opus 4.8持平,编程表现亦相当。定价为GLM-5.3的1/10,限时折扣为1/20,为Opus 4.8的1/40。模型已接入ZCode等平台,并开放API调用。
最新报道补充,该模型首次在大规模流量中由国产芯片集群提供算力支持,线上流量完全运行在10万颗国产芯片上,供应商可能包括华为、海光和摩尔线程。发布前,匿名“Ox Alpha”模型在OpenRouter和OpenCode上处理了62T token,同样使用中国硬件。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
报道时间线
- 智谱开源GLM-5.3-Flash,国产芯片驱动
智谱于8月26日开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型。其线上流量完全运行在10万颗国产芯片上。发布前,匿名“Ox Alpha”模型在OpenRouter和OpenCode上处理了62T token——同样使用中国硬件。据报道,供应商可能包括华为、海光和摩尔线程。该模型在Artificial Analysis上得分为57,与Claude Opus 4.8持平,而成本仅为GLM-5.3的十分之一。开放模型、国产算力、全球需求。
- GLM-5.3-Flash:前沿智能进入普惠时代
智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,在AA综合智能指数取得57分,与Claude Opus 4.8持平。其定价为GLM-5.3的1/10(限时1/20),为Opus 4.8的1/40,并首次在大规模流量中由国产芯片集群提供算力支持。模型已接入ZCode等平台,同步开放API调用。
- 智谱发布GLM-5.3-Flash,MIT开源320B模型
智谱推出GLM-5.3-Flash,原生多模态,支持1M-token上下文窗口,320B-A18B参数,MIT许可证开源。该模型此前以Ox Alpha代号预览,完全运行于国产AI芯片,现已在HuggingFace、API等全平台上线,主打高性价比。
- 智谱开源 GLM-5.3-Flash 原生多模态模型,限时折扣价为 GLM-5.3 的 1/20
智谱上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列首个原生多模态模型,总参数量 320B、激活参数仅 18B。该模型在 AA 综合智能指数取得 57 分,与 Claude Opus 4.8 持平,编程表现亦相当;定价为 GLM-5.3 的 1/10,限时折扣为 1/20,为 Opus 4.8 的 1/40。模型已接入 ZCode 等平台,并开放 API 调用。