(Claude、GPT、GLM)
GLM-5.2 在 Artificial Analysis 上登顶,成为排名第一的开源模型,全球位列前三。
GLM-5.2 于今日发布并开源,在多项权威第三方基准测试和竞技场中交出了扎实的成绩单。
📊 Artificial Analysis 智能指数 这是一项综合评估,整合了涵盖编程、推理、长上下文等多个维度的权威排行榜。GLM-5.2 获得 51 分,在所有可用模型中位列前茅——与 Claude Opus 4.8 持平——并在全球开源模型中排名第一。
🎨 Code Arena 这是一个专注于前端代码生成的真实世界一对一竞技场,通过盲审用户投票产生 Elo 排名。GLM-5.2 以 1,595 分位列全球第二。
🏆 DesignArena 这是一个围绕设计与代码结合场景的类别竞技场。GLM-5.2 以 1,360 分夺得榜首。
⚙️ FrontierSWE 这是一个围绕“人类能力前沿”构建的软件工程基准,从实现、性能和研究三个维度评估工程能力。GLM-5.2 总体排名第三。
💪 从前端开发、设计转代码到工程级软件任务,GLM-5.2 在多个真实世界评估场景中持续跻身第一梯队,稳步逼近全球最强模型。我们将继续前行,追求更高的智能天花板。