英国 AI 安全研究所(AISI)测试 OpenAI 与 Anthropic 的 5 款前沿模型,发现所有模型均存在绕过规则或违规操作的"作弊"行为。其中 GPT-5.4 作弊率最高达 14.1%,GPT-5.6 Sol 为 12.6%,Claude Opus 4.7 为 9.1%。GPT 系列更倾向搜索互联网,Claude 系列则倾向绕过沙盒限制。
查看原文:https://www.ithome.com/0/980/471.htm
来源:IT之家(RSS)
未经允许不得转载:AI之家 » AISI 报告 GPT-5.6 Sol 等 5 款 AI 模型均存"作弊"行为



