← 返回模型榜
OpenAI

GPT-5.6 Luna

本轮更新 8月10日 08:20
AIHOT 共识分64.1当前第 11
各榜成绩

这个模型在各家榜单上的表现

证据覆盖 86.9%;已评估 1320 项,未评估项目也会完整列出

榜单原榜名次原始分数原榜型号
Agents' Last Exam
原榜名次#2原始分数0.3原榜型号GPT-5.6-Luna官方榜单 ↗
Artificial Analysis Intelligence Index
原榜名次#16原始分数52.3原榜型号GPT-5.6 Luna (max)官方榜单 ↗
DeepSWE v1.1
原榜名次#6原始分数0.7原榜型号gpt-5-6-luna官方榜单 ↗
Epoch Capabilities Index
原榜名次#11原始分数156.1原榜型号GPT-5.6 Luna官方榜单 ↗
EQ-Bench 4
原榜名次#16原始分数1,166原榜型号openai/gpt-5.6-luna官方榜单 ↗
LiveBench Global Average
原榜名次#22原始分数73.6原榜型号gpt-5.6-luna-max官方榜单 ↗
MacOS Appllm2014 Agent
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
Webllm2014 Agent
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
Gamellm2014 Agent
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
Rust Appllm2014 Agent
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
Simple Modelllm2014 Agent
原榜名次#12原始分数373原榜型号GPT-5.6 Luna (max)官方榜单 ↗
iOS + Serverllm2014 Agent
原榜名次#11原始分数379原榜型号GPT-5.6 Luna (max)官方榜单 ↗
Animationllm2014 Agent
原榜名次#7原始分数0原榜型号GPT-5.6 Luna (max)官方榜单 ↗
Data Processllm2014 Agent
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
llm2014 Reasoning
原榜名次#12原始分数52.0原榜型号GPT-5.6 Luna (xhigh)官方榜单 ↗
Arena Text Style-Controlled
原榜名次#60原始分数1,450原榜型号gpt-5.6-luna-xhigh官方榜单 ↗
Arena WebDev
原榜名次#22原始分数1,523原榜型号gpt-5.6-luna-xhigh (codex-harness)官方榜单 ↗
Vals Index
原榜名次#7原始分数69.9原榜型号openai/gpt-5.6-luna官方榜单 ↗
APEX-Agents Mean Score · ReActAPEX-Agents
原榜名次原始分数暂无评估原榜型号官方榜单 ↗
APEX-Agents Mean Score · LoopAPEX-Agents
原榜名次原始分数暂无评估原榜型号官方榜单 ↗

所有官方榜单