STORY · 事件进行中

GPT-5.6 在 ARC-AGI-3 上得分 38.3%

1 个精选信源 · 1 篇报道持续 1最新动态 1小时前
最新进展

GPT-5.6 构建者指南:如何以更低成本实现前沿智能体性能

TIMELINE

报道时间线

1 条公开报道 · 官方一手 1 条 · 最新在前
  1. GPT-5.6 构建者指南:如何以更低成本实现前沿智能体性能
    OpenAI:官网动态(RSS · 排除企业/客户案例)官方一手精选

    GPT-5.6 模型家族以更低成本实现前沿级智能体性能,并新增推理持久化、原生多智能体编排和程序化工具调用等 API 能力。在 ARC-AGI-3 上,启用保留推理和压缩后,Sol 得分从 13.3% 跃升至 38.3%,且输出 token 减少约 6 倍。Luna 在 BrowseComp 上以 84.04% 的得分追平 GPT-5.5(84.36%),成本从 $33.27 降至 $1.33。