测试一千程序员后,Anthropic发现Claude Code全自动更安全
编辑|泽南
时代变了,自动模式比人工审批还安全了。
昨日,Anthropic 宣布, 从 8 月 14 日起,自动模式将成为 Claude Code 中 Pro、Max 和 Team 用户的默认权限模式 。
自动模式使用单独的分类器审查 shell 命令和操作。在测试中,它捕获了 89% 的危险命令,而人类手动批准只捕获了 14%。看起来,现在的 Agent 工具在基础设施层的防御机制已经相对成熟,足以让官方有底气将 Auto 模式设为默认,以追求极致的开发效率。

Anthropic 表示,作出这项更改主要的原因就是在测试中,自动模式的安全性已经匹配或者超越了手动权限审查。使用自动模式,长时程的工作将更具可行性,你可以在后台运行数小时的任务,而无需监督权限。
自动模式分类器每次工具调用会使用少量额外 token,不过从今天起 Anthropic 将不再向 Pro、Max 和 Team 套餐的 Claude Code 用户收取这部分费用。
在 Agent 工具的运行期间,AI 会要求各种权限以执行任务。自动模式顾名思义不会弹出提示,而是将每次工具调用都路由到一个分类器,其旨在阻止不可逆、破坏性或针对环境之外的操作。当分类器阻止某些操作时,Claude 通常会自行寻找更安全的处理方式,或直接征求人类许可;如果无法继续(连续三次或一次会话中二十次),Claude Code 将回退到手动审批模式。
虽然可能还算不上绝对安全,但 Anthropic 已经认为到了让 AI 放手去干的阶段了。过去几个月,Anthropic 开展了一项包含 1053 名付费测试人员的对照研究,并分析了实际生产环境中的测试结果。在所有测试指标中,自动模式的表现都与人工审核相当或更优。
自动模式允许 Claude 自主运行更长时间,这使得像 Claude Opus 5 这样专为长时间运行任务而设计的模型能够更有效地处理大型任务。Anthropic 称,在 Teams 和 Enterprise 版本中,使用自动模式的用户提交的 PR 数量增加了约 25%。Adobe、Nuro、Gusto 和 Garner Health 的团队已经将自动模式设置为生产环境的默认设置。
手动审核与自动审核模式的比较
数据显示,若手动审核的话,无脑下一步会成为习惯: 在 Claude Code 中,用户批准了 97% 的权限提示 。虽然大多数提示可能都是针对安全、常规的命令,但如此高的批准率表明,许多用户只是下意识地点击,而不是仔细审查每个命令。数据还表明,用户更频繁地审查和拒绝其他类型的对话框:例如,当 Claude 展示一个计划供用户批准时,用户会拒绝其中 39% 的计划。但对于单个权限请求,拒绝率仅为 3%。
同样的模式也出现在配置文件中。截至 2026 年 6 月,49.5% 的活跃命令行用户手动创建了 Bash 允许规则 —— 其中 5% 的用户直接允许所有 shell 命令,另有 43% 的用户设置了类似 --progressBash (python:*) 或 Bash (node:*)--progress 的解释器规则,这些规则在实践中本质上是等效的 —— 而且这一比例大约每 5 周增长 5 个百分点。除了允许规则之外,62% 的用户 bypassPermissions 在 Bash 中使用过或点击过「不再询问」选项,25% 的交互式会话以绕过权限模式启动。
在自动模式下,权限规则仍然会在分类器之前生效,但允许执行任意代码的规则(例如 python:*)除外。这些任意规则在自动模式下会被忽略,因为它们会导致命令完全跳过分类器。配置文件不会被修改,切换到其他模式后,这些规则会立即重新生效。
通过自动模式提高安全性
Anthropic 内部以及第三方研究表明,自动模式比普通用户目前处理权限提示的方式更安全。