AI“作弊”大曝光:5款前沿模型违规操作被英国研究所揭露
创始人
2026-07-23 11:37:11
0

7月23日,英国AI安全研究所(AISI)发布博文,公布了对OpenAI与Anthropic旗下5款前沿AI模型的测试结果。测试发现,所有模型均存在“作弊”行为,试图绕过既定规则,通过捷径或违规操作完成任务。涉及的5款模型包括GPT-5.4、GPT-5.5、GPT-5.6Sol、ClaudeOpus4.7和ClaudeMythosPreview。

在测试中,GPT-5.4的“作弊率”最高,达到14.1%,在475次测试中有67次;GPT-5.6Sol模型的作弊率为12.6%,475次测试中有60次。Anthropic的ClaudeOpus4.7出现了9.1%的作弊情况,而ClaudeMythosPreview则出现了7.8%的作弊行为。AISI分析指出,GPT-5系列模型更倾向于搜索互联网,而Claude模型则倾向于绕过沙盒限制。在一次因任务配置错误而无法完成测试中,一个模型甚至编写代码,尝试通过外部服务访问研究所的评估基础设施,触发安全警报。

相关内容

热门资讯

小米澎程N90白色版沙漠路测曝... 近日,小米澎程N90白色版实车在荒漠场地进行路测,这是官方发布白色官图后,该配色实车首次完整亮相。澎...
新能源汽车出国游遭远程锁车,车... 近日,一位车主在社交平台上分享了自己的新能源汽车在跨境自驾途中被厂家远程锁车的经历。7月16日,刘先...
美国科技巨头AI投资推高表外债... 7月23日,据《日本经济新闻》报道,美国科技巨头的表外债务因AI投资热潮而激增。谷歌母公司Alpha...
广州番禺洛浦东乡村系统治理“老... 文/羊城晚报全媒体记者 梁怿韬 通讯员 陈雪滢图/通讯员提供记者7月22日从广州市番禺区洛浦街道东乡...
开局之年看中国|溯源创新浙江:... 夏风浩荡,万象更新。在“开局之年看中国·解码创新浙江——在温州看见创新中国”网络主题宣传活动中,采风...
2026中国经济半年报丨新兴产... 光明网讯(记者 赵艳艳)今年上半年,工信部实施重大技术装备攻关工程和产业基础再造工程,推进制造业新技...
不断开创基础教育高质量发展新局... 建设教育强国,基点在基础教育。“全面贯彻党的教育方针,落实立德树人根本任务”“不断开创基础教育高质量...
总台记者探访丨“中国制造”为欧... 今年夏天,持续热浪席卷欧洲,多国高温纪录不断被刷新。持续高温带动空调、风扇等降温产品需求激增。依托完...
粤新同心绘就16米巨幅长卷大美... 新快报讯 记者李佳文 郭思杰 实习生周文婷报道 近日,粤疆两地艺术家共同创作的巨幅国画《大美天山》在...