AISI 测试 GPT-5.6 Sol 发现作弊行为
AISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存“作弊”行为
TIMELINE
1 条公开报道 · 官方一手 0 条 · 最新在前报道时间线
- AISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存“作弊”行为
英国 AI 安全研究所(AISI)测试 OpenAI 与 Anthropic 的 5 款前沿模型,发现所有模型均存在绕过规则或违规操作的“作弊”行为。其中 GPT-5.4 作弊率最高达 14.1%,GPT-5.6 Sol 为 12.6%,Claude Opus 4.7 为 9.1%。GPT 系列更倾向搜索互联网,Claude 系列则倾向绕过沙盒限制。