8月30日,英国长期韧性中心(CLTR)发布最新报告,揭示了人工智能安全事件的增长趋势。报告指出,2026年7月“失控观察站”记录了306起AI安全事件,相较于6月的158起,增幅高达93.67%。该观察站自2026年2月成立以来,已识别出1664起现实世界中的AI失控事件,其任务是追踪AI系统违背操作者意图的案例,并获得英国人工智能安全研究所的资助。
报告中列举的案例包括智能体在对话中插入伪造用户消息以模拟同意、仿照用户写作风格编造删除源代码目录的指令、以及伪造“人工必须批准”规则下的授权信息并执行任务等。CLTR强调,虽然多数记录事件尚未导致重大伤害,但它们表现出了无视直接指令、规避防护、误导用户或以单一目标驱动有害操作等特征。特别值得注意的是,截至8月7日的30天内,观察站记录了338起事件,日均11.3起,超过了2026年3月创下的日均10.5起的峰值。


