# 智谱开源 GLM-5.3-Flash 原生多模态模型，限时折扣价为 GLM-5.3 的 1/20

- 来源：IT之家（RSS）
- 发布时间：2026-08-26 22:21
- AIHOT 分数：76
- AIHOT 标记：同事件
- AIHOT 链接：https://aihot.virxact.com/items/cmta6rj5j03vxroj263nwkuxk
- 原文链接：https://www.ithome.com/0/994/765.htm

## AI 摘要

智谱上线并开源 GLM-5.3-Flash（320B-A18B），这是 GLM-5 系列首个原生多模态模型，总参数量 320B、激活参数仅 18B。该模型在 AA 综合智能指数取得 57 分，与 Claude Opus 4.8 持平，编程表现亦相当；定价为 GLM-5.3 的 1/10，限时折扣为 1/20，为 Opus 4.8 的 1/40。模型已接入 ZCode 等平台，并开放 API 调用。

## 正文

IT之家 8 月 26 日消息，智谱今晚上线并开源 GLM-5.3-Flash (320B-A18B)，这是 GLM-5 系列的首个原生多模态模型。该模型总参数量为 320B（3200 亿），激活参数仅 18B（180 亿）。

智谱在正式发布前，以匿名模型 Ox-Alpha（中文社区称作牛来）在 OpenCode 和 OpenRouter 上进行了大规模测试。Ox-Alpha 迅速成为当周最受欢迎的模型，创下双平台调用量新高。而这些请求流量全部由国产芯片提供算力支持。

GLM-5.3-Flash 能力超过 GLM-5.2，在全球权威的 Artificial Analysis Intelligence Index（AA 综合智能指数）中取得 57 分，进入全球前沿模型能力区间，与 Anthropic 最受欢迎的模型 Claude Opus 4.8 得分持平。在自研 Z.ai Code Bench 体感评估中，其编程表现与 Claude Opus 4.8 相当。

与此同时，GLM-5.3-Flash 定价为 GLM-5.3 的 1/10，限时折扣内为 GLM-5.3 的 1/20，为 Opus 4.8 的 1/40。

官方表示，GLM-5.3-Flash 在各项基准测试和实际使用中，全面超越参数量高出一倍的 GLM-5.2，定价却仅为后者的 1/10。

据介绍，这得益于其全新模型架构。GLM-5.3-Flash 的架构专为极低成本而设计，总参数量与 GLM-4.5 相当（355B vs. 320B），但激活参数量（32B → 18B）与层数（92 → 45）几乎减半。结合最新的 30T Token 多模态预训练语料，GLM-5.3-Flash 能够以更少的计算资源实现更强的性能。

GLM-5.3-Flash 同时进行了多项架构升级，是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型，在保持精准长上下文能力的同时，大幅降低长上下文服务成本；并采用流形约束超连接（Manifold-Constrained Hyper-Connections，mHC）提升模型 Scaling 能力。

GLM-5.3-Flash 正式面向全球开源，已接入 ZCode 等编码平台，并纳入 GLM Coding Plan（每天限量发放 10,000 张体验卡），同步开放 API 调用。

IT之家附相关链接：

BigModel 开放平台：https://docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash

Z.ai：https://docs.z.ai/guides/vlm/glm-5.3-flash

GLM Coding Plan：https://bigmodel.cn/glm-coding

HuggingFace：https://huggingface.co/zai-org/GLM-5.3-Flash
