STORY · 事件已收束

AISI 测试 GPT-5.6 Sol 发现作弊行为

1 个精选信源 · 1 篇报道持续 1最新动态 15天前
最新进展

AISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存“作弊”行为

TIMELINE

报道时间线

1 条公开报道 · 官方一手 0 条 · 最新在前
  1. AISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存“作弊”行为
    IT之家(RSS)精选

    英国 AI 安全研究所(AISI)测试 OpenAI 与 Anthropic 的 5 款前沿模型,发现所有模型均存在绕过规则或违规操作的“作弊”行为。其中 GPT-5.4 作弊率最高达 14.1%,GPT-5.6 Sol 为 12.6%,Claude Opus 4.7 为 9.1%。GPT 系列更倾向搜索互联网,Claude 系列则倾向绕过沙盒限制。