智谱发布 GLM-5.3
GLM-5.3在多项基准上超越Kimi K3,部分指标超过Claude Fable 5或GPT-5.6-Sol。
事件全貌
智谱于2026年8月14日发布GLM-5.3模型,主打编码与网络安全能力。该模型基于与GLM-5.2相同的743B参数基础模型,通过扩展后训练实现提升,编程能力较前代提升50%,在Terminal Bench 3.0、Agents' Last Exam (CLI)等公开基准中取得开源第一,并接近Claude Fable 5。
在网络安全方面,GLM-5.3在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%,高于Mythos 5(83.8%)和GPT-5.6 Sol(83.6%)。具体基准得分:Terminal-Bench 3.0从4.6升至28.3,CyberGym从77.2%升至84.5%,ExploitBench从24.4%升至54.4%。智谱称该模型能推理多阶段漏洞利用并构建完整攻击链。
模型权重将在发布约两周后开源,即日起上线ZCode、AutoClaw等工具,并通过Z.ai API、GLM Coding Plan提供。API访问和开放权重将在严格安全评估后分阶段发布。最新报道补充,该模型经安全数据训练,在269个项目中找到2,436个漏洞,部分漏洞存在长达40年。此外,GLM-5.3在多项基准上超越Moonshot AI的Kimi K3,部分指标超过Claude Fable 5或GPT-5.6-Sol,仅约750B参数,为Kimi K3的三分之一。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
报道时间线
- GLM-5.3:中国实验室如何跟上前沿步伐
Z.ai 今日发布 GLM-5.3,目前仅限编程套餐使用,API 即将上线,两周后开源权重至 Hugging Face。该模型在多项基准上超越 Moonshot AI 的 Kimi K3,部分指标超过 Claude Fable 5 或 GPT-5.6-Sol,仅约 750B 参数,为 Kimi K3 的三分之一。
- GLM-5.3 碾压美国开源模型,全靠后训练
祝贺 @Zai_org 推出 GLM-5.3。它大幅超越所有美国开源模型:Nemotron、Laguna、Inkling,差距明显。 GLM-5.3 与 GLM-5.2 使用相同的基础模型;所有提升均来自后训练。如果美国继续走“Nemotron 委员会”这条路,而不是培育真正的竞争,它将继续落后。
- 智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5
智谱发布 GLM-5.3,基于 743B 基座模型后训练,在漏洞发现等网络防御测试中超越 Anthropic Mythos 5。其 Terminal Bench 3.0 从 4.6 升至 28.3,DeepSWE 达 66.9;CyberGym 得分 84.5%,但 ExploitBench 仅 54.4%,落后于 Mythos 5 的 78.0%。
- 智谱发布 GLM-5.3,称其为最强开源权重编程模型
智谱发布 GLM-5.3,与上一代 GLM-5.2 共享相同基座,全部提升来自扩展的后训练,并称其为最强开源权重编程模型,智能体任务进步最大。该模型经安全数据训练,在 269 个项目中找到 2,436 个漏洞,部分漏洞存在长达 40 年。GLM-5.3 现可通过 GLM Coding Plan 使用,权重将在安全审查完成后于两周内开源。
- Z.ai 发布 GLM-5.3:不重训基座模型,复杂编程与长程任务能力显著提升
Z.ai 发布 GLM-5.3,沿用 GLM-5.2 的 743B 基座模型,全部提升来自扩展的后训练。Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 达 84.5%,超过 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。模型已通过 Z.ai API、GLM Coding Plan 和 ZCode 提供,权重预计在发布约两周后公开。
- GLM-5.3 发布:网络安全能力大幅跃升
智谱发布 GLM-5.3,743B 基础模型与 GLM-5.2 相同,提升完全来自扩展后训练。其 Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 从 77.2% 升至 84.5%,ExploitBench 从 24.4% 升至 54.4%。智谱称该模型能推理多阶段漏洞利用并构建完整攻击链,进展快于预期。
- 智谱正式发布 GLM-5.3:编程能力最强开源模型,较 GLM-5.2 提升 50%
智谱今日发布 GLM-5.3,基于与 GLM-5.2 相同的基座模型,通过后训练 Scaling 将编程能力提升 50%,在 Terminal Bench 3.0、Agents' Last Exam (CLI) 等公开基准中取得开源第一。
- GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。
- 智谱发布GLM-5.3,CyberGym得分超GPT-5.6
智谱AI在ZCode上发布了GLM-5.3,在CyberGym上获得84.5分,高于Mythos 5和GPT-5.6 Sol! > 基于743B基础模型训练。 > 专为网络防御和编程任务打造。 > “API访问和开放权重将在严格安全评估后分阶段发布。”
- GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。
- 智谱发布GLM-5.3,主打编码与网安
推出 GLM-5.3:为编码而生,为网络防御而备。 - 基于 743B 基础模型进行后训练,实现顶尖的编码与智能体能力 - 网络安全领域重大飞跃,树立开源模型新标准 技术博客:https://z.ai/blog/glm-5.3