8月8日,Anthropic宣布将从8月14日起,对Pro、Max和Team订阅用户调整ClaudeCode的默认权限模式为自动模式(AutoMode)。自动模式通过独立的AI分类器实时评估工具调用和Shell命令,确保安全操作并自动拦截破坏性、不可逆或越权行为。目前,ClaudeEnterprise、ClaudeAPI等平台仍提供自动模式作为可选设置,但Anthropic计划在未来1个月内将自动模式设为默认,并取消相关费用。
在测试推行方面,Anthropic邀请了1,053名付费测试者参与测试。结果显示,在传统人工审批模式下,仅识别出13.6%的危险命令,而自动模式能够识别89%的危险命令。TrajectoryLabs在72个场景下进行了720次攻击尝试的评估,结果显示ClaudeCode v2.1.205和Codex v0.144.5在自动模式下能够全部拦截攻击,而GPT-5.6Sol在Codex的自动审阅模式下的成功率为5.83%,在完全访问模式下为19.03%。Anthropic还指出,未加额外防护的bypassPermissions模式平均攻击成功率为0.09%,而OpenAI新发布的Auto-review版本可能会影响这一结果。自动模式能有效防止工具调用和浏览器GUI使用过程中的提示注入攻击,第三方评估显示OpenAI模型在浏览器任务上的攻击成功率更高。


