← 返回模型榜
Anthropic

Claude Opus 4.5 20251101

本轮更新 8月15日 03:17
AIHOT 共识分27.7当前第 28
各榜成绩

这个模型在各家榜单上的表现

证据覆盖 65.0%;已评估 69 项,未评估项目也会完整列出

榜单原榜名次原始分数原榜型号
Artificial Analysis Intelligence Index
原榜名次#42原始分数41.9原榜型号claude-opus-4-5-thinking官方榜单 ↗
Artificial Analysis Multilingual Index
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
LiveBench Global Average
原榜名次#30原始分数72.6原榜型号claude-opus-4-5-20251101-thinking-64k-high-effort官方榜单 ↗
Arena Text Style-Controlled
原榜名次#34原始分数1,469原榜型号claude-opus-4-5-20251101官方榜单 ↗
Arena WebDev
原榜名次#38原始分数1,468原榜型号claude-opus-4-5-20251101官方榜单 ↗
APEX-Agents Mean Score · ReActAPEX-Agents
原榜名次#15原始分数34.8原榜型号claude-opus-4-5-high官方榜单 ↗
APEX-Agents Mean Score · LoopAPEX-Agents
原榜名次#23原始分数37.1原榜型号claude-opus-4-5-high官方榜单 ↗
DeepSWE v1.1
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
Vals Finance Agent
原榜名次原始分数暂无评估原榜型号官方榜单 ↗

榜单来源与计算方法