← 返回模型榜
OpenAI
GPT-5.6 Luna
本轮更新 8月10日 08:20
AIHOT 共识分
64.1
当前第 11 名
各榜成绩
这个模型在各家榜单上的表现
证据覆盖 86.9%;已评估 13/20 项,未评估项目也会完整列出
榜单
原榜名次
原始分数
原榜型号
Agents' Last Exam
原榜名次
#2
原始分数
0.3
原榜型号
GPT-5.6-Luna
官方榜单 ↗
Artificial Analysis Intelligence Index
原榜名次
#16
原始分数
52.3
原榜型号
GPT-5.6 Luna (max)
官方榜单 ↗
DeepSWE v1.1
原榜名次
#6
原始分数
0.7
原榜型号
gpt-5-6-luna
官方榜单 ↗
Epoch Capabilities Index
原榜名次
#11
原始分数
156.1
原榜型号
GPT-5.6 Luna
官方榜单 ↗
EQ-Bench 4
原榜名次
#16
原始分数
1,166
原榜型号
openai/gpt-5.6-luna
官方榜单 ↗
LiveBench Global Average
原榜名次
#22
原始分数
73.6
原榜型号
gpt-5.6-luna-max
官方榜单 ↗
MacOS App
llm2014 Agent
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
Web
llm2014 Agent
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
Game
llm2014 Agent
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
Rust App
llm2014 Agent
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
Simple Model
llm2014 Agent
原榜名次
#12
原始分数
373
原榜型号
GPT-5.6 Luna (max)
官方榜单 ↗
iOS + Server
llm2014 Agent
原榜名次
#11
原始分数
379
原榜型号
GPT-5.6 Luna (max)
官方榜单 ↗
Animation
llm2014 Agent
原榜名次
#7
原始分数
0
原榜型号
GPT-5.6 Luna (max)
官方榜单 ↗
Data Process
llm2014 Agent
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
llm2014 Reasoning
原榜名次
#12
原始分数
52.0
原榜型号
GPT-5.6 Luna (xhigh)
官方榜单 ↗
Arena Text Style-Controlled
原榜名次
#60
原始分数
1,450
原榜型号
gpt-5.6-luna-xhigh
官方榜单 ↗
Arena WebDev
原榜名次
#22
原始分数
1,523
原榜型号
gpt-5.6-luna-xhigh (codex-harness)
官方榜单 ↗
Vals Index
原榜名次
#7
原始分数
69.9
原榜型号
openai/gpt-5.6-luna
官方榜单 ↗
APEX-Agents Mean Score · ReAct
APEX-Agents
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
APEX-Agents Mean Score · Loop
APEX-Agents
原榜名次
—
原始分数
暂无评估
原榜型号
—
官方榜单 ↗
所有官方榜单
精选
全部
日报
更多
反馈