Claude Code 将默认自动执行,人类仅拦下 14% 危险

Claude Code 将默认自动执行,人类仅拦下 14% 危险

Anthropic 宣布,从 2026 年 8 月 14 日起,Claude Code 的「自动模式」将成为 Pro、Max 与 Team 套餐用户的默认权限设置,除非用户或管理员手动锁定了其他偏好。

所谓自动模式,是用一个分类器取代过去反复弹出的逐条授权确认。每执行一次工具调用,分类器会先判断它是否属于不可逆、破坏性,或超出授权范围的操作。若判定危险,Claude 会改走更安全的路线,或转而向用户申请许可;在被连续拦截多次之后,会话才会退回手动确认。

Anthropic 表示,作为这次调整的一部分,公司不再对自动模式分类器消耗的「每步少量额外令牌」收费。

更值得留意的是一组对比数据。在针对 1053 名付费测试者的研究中,人类只能识别并拦下 13.6% 的危险命令,而自动模式拦下了 89%;而且在连续处理约 50 条提示之后,人类的正确率进一步跌到约 5%。换言之,长时间盯着授权弹窗的人,反而比机器更容易放过危险操作。

Anthropic 提醒,分类器并不能彻底消除风险,涉及生产环境的改动仍建议人工复核。不过公司也给出了一组数据:在 Team 与 Enterprise 客户中,开启自动模式的用户比其他人多提交了约 25% 的合并请求。

9to5Mac 在评测中认为,对熟练用户来说这大概率是更合理的默认项,但前提是先和编程智能体建立足够的信任。有意思的是,作为对比,OpenAI 曾出于额外谨慎,一度在其最强版本 GPT-5.6 上关闭了类似的自动模式。

来源:9to5Mac