阿里发布 Qwen3.8-Max-0902,以 1691 分登顶 CodeArena WebDev 代码榜

AYi · @AYi_AInotes · X·2026-09-02 13:02·57分钟前
AI 导读

阿里更新旗舰模型 Qwen3.8-Max-0902,在 CodeArena WebDev 榜单以 1691 分登顶,超过 Claude Opus 5(1688)和 Kimi K3(1674),较前代提升 22 分。

AYi@AYi_AInotes
72AI 编辑部评分,满分 100

阿里发布 Qwen3.8-Max-0902,以 1691 分登顶 CodeArena WebDev 代码榜

2026-09-02 13:02· 57分钟前
AI 导读

阿里更新旗舰模型 Qwen3.8-Max-0902,在 CodeArena WebDev 榜单以 1691 分登顶,超过 Claude Opus 5(1688)和 Kimi K3(1674),较前代提升 22 分。

Damn,全球代码第一的宝座易主了!!!

阿里今天更新的旗舰 Qwen3.8-Max-0902, 在权威三方榜单 CodeArena WebDev 直接轰出 1691 分,较前代暴涨 22 分,

一举反超 Claude Opus 5 (1688) 和 Kimi K3 (1674),正式登顶全球代码总榜第一!

2.4 万亿总参数加 100 万超长上下文,经过 Coding 和 Cowork 专项后训练后,企业级复杂工程、长程科研工作流和 Agent 自主编程能力直接被拉爆。

但我觉得最厉害的的还不是它拿了世界第一, 而是它极其残暴的帕累托斩杀线:

1️⃣ 全球顶流代码智商:在最吃复杂工程的前端与全栈 WebDev 评测中,把一众欧美顶流旗舰全踩在脚下。 2️⃣ 成本直接砍到脚脖子:输入每百万 tokens 只要 2 美元,输出 6 美元,缓存命中最低 0.17 美元,综合平均仅 5 美元左右。 3️⃣ 大模型性价比清洗:在性价比前沿曲线上,直接一刀斩杀所有价格高于 5 美元的其他模型。 以前做复杂 Agent 调 Opus 5 贵得肉疼,现在是拿着全球第一的代码底座,用着连海外零头都不到的白菜价。

完整 Arena 跑分战报和 API 接入指南放一楼了, 做 Coding Agent 的兄弟赶紧去换底座 👇

Qwen🚀Qwen3.8-Max just got upgraded. Meet Qwen3.8-Max-0902! 2.4T parameters. 1M context tokens. Built for real world complexity. Further post trained on Coding & Co...