STORY · 事件已收束

智谱发布 GLM-5.3

11 个精选信源 · 11 篇报道持续 1最新动态 21天前
最新进展

GLM-5.3在多项基准上超越Kimi K3,部分指标超过Claude Fable 5或GPT-5.6-Sol。

DIGEST

事件全貌

AI 综述 · 更新于 19天前

智谱于2026年8月14日发布GLM-5.3模型,主打编码与网络安全能力。该模型基于与GLM-5.2相同的743B参数基础模型,通过扩展后训练实现提升,编程能力较前代提升50%,在Terminal Bench 3.0、Agents' Last Exam (CLI)等公开基准中取得开源第一,并接近Claude Fable 5。

在网络安全方面,GLM-5.3在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%,高于Mythos 5(83.8%)和GPT-5.6 Sol(83.6%)。具体基准得分:Terminal-Bench 3.0从4.6升至28.3,CyberGym从77.2%升至84.5%,ExploitBench从24.4%升至54.4%。智谱称该模型能推理多阶段漏洞利用并构建完整攻击链。

模型权重将在发布约两周后开源,即日起上线ZCode、AutoClaw等工具,并通过Z.ai API、GLM Coding Plan提供。API访问和开放权重将在严格安全评估后分阶段发布。最新报道补充,该模型经安全数据训练,在269个项目中找到2,436个漏洞,部分漏洞存在长达40年。此外,GLM-5.3在多项基准上超越Moonshot AI的Kimi K3,部分指标超过Claude Fable 5或GPT-5.6-Sol,仅约750B参数,为Kimi K3的三分之一。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

TIMELINE

报道时间线

11 条公开报道 · 官方一手 4 条 · 最新在前
  1. GLM-5.3:中国实验室如何跟上前沿步伐
    Nathan Lambert:Interconnects(RSS)官方一手

    Z.ai 今日发布 GLM-5.3,目前仅限编程套餐使用,API 即将上线,两周后开源权重至 Hugging Face。该模型在多项基准上超越 Moonshot AI 的 Kimi K3,部分指标超过 Claude Fable 5 或 GPT-5.6-Sol,仅约 750B 参数,为 Kimi K3 的三分之一。

  2. GLM-5.3 碾压美国开源模型,全靠后训练
    X:SemiAnalysis (@SemiAnalysis_)

    祝贺 @Zai_org 推出 GLM-5.3。它大幅超越所有美国开源模型:Nemotron、Laguna、Inkling,差距明显。 GLM-5.3 与 GLM-5.2 使用相同的基础模型;所有提升均来自后训练。如果美国继续走“Nemotron 委员会”这条路,而不是培育真正的竞争,它将继续落后。

  3. 智谱 GLM-5.3 在漏洞发现等网络防御测试中超越 Anthropic Mythos 5
    X:Rohan Paul (@rohanpaul_ai)

    智谱发布 GLM-5.3,基于 743B 基座模型后训练,在漏洞发现等网络防御测试中超越 Anthropic Mythos 5。其 Terminal Bench 3.0 从 4.6 升至 28.3,DeepSWE 达 66.9;CyberGym 得分 84.5%,但 ExploitBench 仅 54.4%,落后于 Mythos 5 的 78.0%。

  4. 智谱发布 GLM-5.3,称其为最强开源权重编程模型
    The Decoder:AI News(RSS)

    智谱发布 GLM-5.3,与上一代 GLM-5.2 共享相同基座,全部提升来自扩展的后训练,并称其为最强开源权重编程模型,智能体任务进步最大。该模型经安全数据训练,在 269 个项目中找到 2,436 个漏洞,部分漏洞存在长达 40 年。GLM-5.3 现可通过 GLM Coding Plan 使用,权重将在安全审查完成后于两周内开源。

  5. Z.ai 发布 GLM-5.3:不重训基座模型,复杂编程与长程任务能力显著提升
    MarkTechPost(RSS)

    Z.ai 发布 GLM-5.3,沿用 GLM-5.2 的 743B 基座模型,全部提升来自扩展的后训练。Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 达 84.5%,超过 Mythos 5(83.8%)和 GPT-5.6 Sol(83.6%)。模型已通过 Z.ai API、GLM Coding Plan 和 ZCode 提供,权重预计在发布约两周后公开。

  6. GLM-5.3 发布:网络安全能力大幅跃升
    X:Kim (@kimmonismus)

    智谱发布 GLM-5.3,743B 基础模型与 GLM-5.2 相同,提升完全来自扩展后训练。其 Terminal-Bench 3.0 得分从 4.6 升至 28.3,CyberGym 从 77.2% 升至 84.5%,ExploitBench 从 24.4% 升至 54.4%。智谱称该模型能推理多阶段漏洞利用并构建完整攻击链,进展快于预期。

  7. 智谱正式发布 GLM-5.3:编程能力最强开源模型,较 GLM-5.2 提升 50%
    IT之家(RSS)

    智谱今日发布 GLM-5.3,基于与 GLM-5.2 相同的基座模型,通过后训练 Scaling 将编程能力提升 50%,在 Terminal Bench 3.0、Agents' Last Exam (CLI) 等公开基准中取得开源第一。

  8. GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
    智谱:研究(网页内嵌数据)官方一手精选

    智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。

  9. 智谱发布GLM-5.3,CyberGym得分超GPT-5.6
    X:Testing Catalog (@testingcatalog)

    智谱AI在ZCode上发布了GLM-5.3,在CyberGym上获得84.5分,高于Mythos 5和GPT-5.6 Sol! > 基于743B基础模型训练。 > 专为网络防御和编程任务打造。 > “API访问和开放权重将在严格安全评估后分阶段发布。”

  10. GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力
    公众号:智谱(GLM)官方一手精选

    智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。

  11. 智谱发布GLM-5.3,主打编码与网安
    X:智谱 Z.ai (@Zai_org)官方一手

    推出 GLM-5.3:为编码而生,为网络防御而备。 - 基于 743B 基础模型进行后训练,实现顶尖的编码与智能体能力 - 网络安全领域重大飞跃,树立开源模型新标准 技术博客:https://z.ai/blog/glm-5.3