GLM-5.3权重将在两周后开源
官方称因双重用途风险,将先由安全伙伴受控评估,再开放API和完整权重。
事件全貌
智谱(Z.ai)于2026年8月14日发布GLM-5.3模型,该模型沿用GLM-5.2的743B基座模型,未重新训练基座,全部提升来自扩展的后训练。官方称编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。Terminal-Bench 3.0得分从4.6升至28.3。
在安全能力方面,GLM-5.3在白盒代码审查等任务中表现持平Mythos 5,在CyberGym测试中得分84.5%,超过Mythos 5(83.8%)和GPT-5.6 Sol(83.6%)。模型经安全数据训练,在269个项目中找到2,436个漏洞,部分漏洞存在长达40年。ExploitBench达54.4%(此前24.4%),ExploitGym两小时完成105项任务(此前29项)。
模型权重原计划在发布约两周后开源,即日起已上线ZCode、AutoClaw等工具,并通过Z.ai API、GLM Coding Plan提供。最新官方消息称,因双重用途风险,将先由安全伙伴受控评估,再开放API和完整权重。SemiAnalysis评论称GLM-5.3大幅超越所有美国开源模型,并指出美国若继续走“Nemotron委员会”路线将落后。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
报道时间线
- GLM-5.3:中国实验室如何跟上前沿步伐
Z.ai 今日发布 GLM-5.3,目前仅限编程套餐使用,API 即将上线,两周后开源权重至 Hugging Face。该模型在多项基准上超越 Moonshot AI 的 Kimi K3,部分指标超过 Claude Fable 5 或 GPT-5.6-Sol,仅约 750B 参数,为 Kimi K3 的三分之一。
- GLM-5.3 碾压美国开源模型,全靠后训练
祝贺 @Zai_org 推出 GLM-5.3。它大幅超越所有美国开源模型:Nemotron、Laguna、Inkling,差距明显。 GLM-5.3 与 GLM-5.2 使用相同的基础模型;所有提升均来自后训练。如果美国继续走“Nemotron 委员会”这条路,而不是培育真正的竞争,它将继续落后。
- 智谱发布 GLM-5.3,称其为最强开源权重编程模型
智谱发布 GLM-5.3,与上一代 GLM-5.2 共享相同基座,全部提升来自扩展的后训练,并称其为最强开源权重编程模型,智能体任务进步最大。该模型经安全数据训练,在 269 个项目中找到 2,436 个漏洞,部分漏洞存在长达 40 年。GLM-5.3 现可通过 GLM Coding Plan 使用,权重将在安全审查完成后于两周内开源。
- Z.ai 发布 GLM-5.3:不重训基座模型,复杂编程与长程任务能力显著提升
Z.ai 发布 GLM-5.3,沿用 GLM-5.2 的 743B 基座模型,全部提升来自扩展的后训练。Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 达 84.5%,超过 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。模型已通过 Z.ai API、GLM Coding Plan 和 ZCode 提供,权重预计在发布约两周后公开。
- GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。
- GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。