8月14日起Claude Code Pro/Max/Team计划默认启用Auto模式,其危险命令分类器检出率89%,远超人工审查的13.6%,程序员角色进一步转向AI输出监督。
Claude Code 很快将默认以 Auto Mode 运行。只有 Enterprise 客户仍需主动选择开启。这一变化意味着 AI 将更加独立地完成开发过程中的更多工作。
Auto Mode 让这款 AI 编程工具能够自主工作,无需在每个步骤都等待人工批准。一个分类器会判断某个操作是否存在危险或不可逆,仅在这些情况下才请求确认。
Anthropic 在一篇博文中宣布,从 8 月 14 日起,Claude Code 将为 Pro、Max 和 Team 计划默认启用 Auto Mode。在对 1,053 名付费测试者以及内部红队测试中,Auto Mode 的安全性表现至少与人工审批持平,往往甚至更好。使用 Auto Mode 的团队也生成了约多 25% 的 Pull Request,意味着他们完成了更多工作。

Anthropic 还表示,Auto Mode 提供了一层针对提示词注入攻击的保护,这类攻击中注入的代码会试图劫持 Agent,使其偏离用户的指令。Trajectory Labs 的一项独立审计测试了 72 个攻击场景,每个场景执行 10 次。在 Auto Mode 下,720 次攻击尝试无一成功穿透 Claude 当前的模型 Fable 5、Opus 5 和 Sonnet 5。而在 OpenAI 的 GPT-5.6 Sol 的 Codex Auto-Review 模式下,有 5.83% 的攻击成功突破。
在 Anthropic 内部,Auto Mode 曾阻止 Claude 将机密数据上传到公共页面。该公司表示,在一次长时会话中,Auto Mode 还终止了约 2,000 个本会干扰正在运行的 GPU 训练任务的进程。
Anthropic 对分类器本身消耗的 token 不收取费用。但将 Auto Mode 设为默认模式对公司来说仍然是一笔划算的生意。当 Claude 工作时间更长、完成更多工作时,token 消耗总量也会上升,进而带来更多收入——即便这并非 Anthropic 做出这一改变的主要动机。
开发者从写代码转向看 AI 写代码
Claude Code 目前是最广泛使用的 AI 编程工具,将 Auto Mode 设为默认进一步将开发者的角色从主动编码推向审查 AI 生成的输出。Anthropic 自身也呼吁保持谨慎。
分类器降低了风险,但并未消除风险。"对于生产基础设施的重要变更,我们仍然建议您亲自审查 Claude 的操作," 该公司写道。
这一建议构成了一个悖论。开发者越少介入,就越显得他们的监督重要。但要深入理解那些主要由 Auto Mode 在很少人工参与的情况下构建的项目,也变得更加困难。而网络安全的发展速度和复杂性正超过任何人类能够真正跟上的程度。