STORY · 事件已收束

GLM-5.3 在 CyberGym 得分 84.5%

1 个精选信源 · 1 篇报道持续 1最新动态 18天前
最新进展

GLM-5.3 开放前安全评估:网络防御能力显著提升

TIMELINE

报道时间线

1 条公开报道 · 官方一手 1 条 · 最新在前
  1. GLM-5.3 开放前安全评估:网络防御能力显著提升
    X:智谱 Z.ai (@Zai_org)官方一手精选

    智谱发布 GLM-5.3,为网络安全任务最强模型,在漏洞发现、利用分析和多步安全任务上大幅提升。CyberGym 得分 84.5%(GLM-5.2 为 77.2%),ExploitBench 达 54.4%(此前 24.4%),ExploitGym 两小时完成 105 项任务(此前 29 项)。因双重用途风险,将先由安全伙伴受控评估,再开放 API 和完整权重。