前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
基础篇
进阶篇
高频篇
精选篇
手写篇
原理篇
面经篇
AI 面试
自检篇
每日一题
  • 综合
    • 综合题型
    • 其他问题
    • 设计模式
    • 思维导图
    • 学习路线
  • 前端基础
    • HTTP
    • 浏览器
    • 计算机基础
  • 进阶学习
    • NPM工作流
    • Docker
    • Canvas
    • Node学习指南
    • 前端综合文章
  • 其他
    • Handbook
    • 职场话题
    • CSS可视化
小程序题库
公众号动态
博客动态
AI 热点
开发者导航
返回 AI 情报前线
All News · 全部资讯3779
  • AI文本检测器实测:14款工具无一超过80%准确率
  • Pokee-Isaac 28B:10M 上下文企业级 Agent 模型
  • 为何AI编程助手每天都要从头开始
  • AI开发Chrome扩展的5条安全规则
  • 理解 Token:AI 模型如何处理文本及成本、上下文、Agent 关系
  • Python+Dify 为低成本 LLM 注入实时本地上下文
  • Claude Code 实战技巧:上下文压缩、路由策略与安全修复
  • Andrew Ng 发布多智能体系统图工程实践指南
  • Takumi:为 AI 编程 Agent 注入工程判断力
  • SwarmForge:tmux 多 AI 智能体协作框架
  • Autolang:面向 AI 生成代码的轻量运行时
  • 用LLM做代码review的正确方式
  • AI Agent 跑通 Demo 却栽在生产环境:缺的是业务上下文层
  • AI 应用应提交工作负载,而非直接选 GPU
  • 多AI编程智能体并行管理:任务所有权与协调经验
  • Claude Code 新增跨会话消息功能
  • Agentic Harness:赋予LLM自主执行能力的架构设计
  • Google官方Agent Skills:覆盖Cloud/GKE/AI全场景
  • AI记忆≠上下文:程序员应知的模型实际工作原理
  • AI激活率≠实际使用率:企业落地为何徒有其表
  • Anthropic将Claude Code默认开启Auto模式
  • LLM-as-Judge:用大模型评估大模型的实战方法
  • 如何为AI Agent构建高质量测试集
  • AI Agent评估方法论:无确定性输入如何做可重复验证
  • Seedance 2.5 / MiniMax H3 / Wan 3.0 视频模型API实测对比
  • 基于 Pydantic AI 的类型化 WebSocket 流式 Agent 实战
  • 腾讯 WorkBuddy 跃居国内 AI 办公智能体榜首
  • 用 Claude Code 排查生产内存泄漏实战复盘
  • Atlassian Rovo 提示词注入漏洞可泄露 Jira 数据
  • AI Agent生产环境仍存在五类工程缺陷
  • OpenAI训练事故时间线分析:RLVR强化学习与安全边界的教训
  • AI修复的SSRF漏洞仍是CWE-918:Cursor的防护在DNS重解析处失效
  • 支付幂等性深坑:超时不是失败,而是未知
  • Gentoo Bugzilla 因 AI 爬虫过载被迫关闭
  • 模型路由省了成本,却没解决AI代码信任问题
  • 五大AI玩家共推插件互操作标准,开发者迎统一生态
  • Cloudflare:AI机器流量首超人类,五年后比例将达1000:1
  • video-shotcraft:用shot卡片让AI Agent产出可编辑视频代码
  • 机密计算证明的边界:软件可验证,人无法验证
  • AI 真实单位成本不是 Token,而是 GPU 利用率
  • AI Agent 安全 guard 设计:错误地 fail-open 导致的真实事故
  • 用乐高类比理解现代GPT架构
  • Git Worktree优化AI编码工作流
  • 为OpenAI/Anthropic SDK打造无代理成本追踪包装器
  • K8s AIOps Agent的人类闭环 Remediation 实践
  • AI Agent提交代码的生产级验证协议设计
  • 语音Agent多租户 plumbing:每个教程都跳过的工程细节
  • Claude Code多终端会话现已支持互相通信和状态共享
  • 零依赖MCP Server:解决LLM时间计算的边界错误
  • Zero Dependency 2026:用标准库而非第三方包证明工程能力
  • 单卡运行284B MoE模型:79%时间在等硬盘
  • 已加载 51 / 3779
9.0
重磅
AI SCORE
编程提效2026-08-08 22:58

Anthropic将Claude Code默认开启Auto模式

The Decoder#Claude#Anthropic#AI编程工具
Editor brief · 编辑速览

8月14日起Claude Code Pro/Max/Team计划默认启用Auto模式,其危险命令分类器检出率89%,远超人工审查的13.6%,程序员角色进一步转向AI输出监督。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

Claude Code 很快将默认以 Auto Mode 运行。只有 Enterprise 客户仍需主动选择开启。这一变化意味着 AI 将更加独立地完成开发过程中的更多工作。

Auto Mode 让这款 AI 编程工具能够自主工作,无需在每个步骤都等待人工批准。一个分类器会判断某个操作是否存在危险或不可逆,仅在这些情况下才请求确认。

Anthropic 在一篇博文中宣布,从 8 月 14 日起,Claude Code 将为 Pro、Max 和 Team 计划默认启用 Auto Mode。在对 1,053 名付费测试者以及内部红队测试中,Auto Mode 的安全性表现至少与人工审批持平,往往甚至更好。使用 Auto Mode 的团队也生成了约多 25% 的 Pull Request,意味着他们完成了更多工作。

在包含 1,053 名付费测试者的对照研究中,人工审核者仅捕获了 13.6% 的危险命令,而 Auto Mode 捕获了 89%。| 图片来源:Anthropic

Anthropic 还表示,Auto Mode 提供了一层针对提示词注入攻击的保护,这类攻击中注入的代码会试图劫持 Agent,使其偏离用户的指令。Trajectory Labs 的一项独立审计测试了 72 个攻击场景,每个场景执行 10 次。在 Auto Mode 下,720 次攻击尝试无一成功穿透 Claude 当前的模型 Fable 5、Opus 5 和 Sonnet 5。而在 OpenAI 的 GPT-5.6 Sol 的 Codex Auto-Review 模式下,有 5.83% 的攻击成功突破。

在 Anthropic 内部,Auto Mode 曾阻止 Claude 将机密数据上传到公共页面。该公司表示,在一次长时会话中,Auto Mode 还终止了约 2,000 个本会干扰正在运行的 GPU 训练任务的进程。

Anthropic 对分类器本身消耗的 token 不收取费用。但将 Auto Mode 设为默认模式对公司来说仍然是一笔划算的生意。当 Claude 工作时间更长、完成更多工作时,token 消耗总量也会上升,进而带来更多收入——即便这并非 Anthropic 做出这一改变的主要动机。

开发者从写代码转向看 AI 写代码

Claude Code 目前是最广泛使用的 AI 编程工具,将 Auto Mode 设为默认进一步将开发者的角色从主动编码推向审查 AI 生成的输出。Anthropic 自身也呼吁保持谨慎。

分类器降低了风险,但并未消除风险。"对于生产基础设施的重要变更,我们仍然建议您亲自审查 Claude 的操作," 该公司写道。

这一建议构成了一个悖论。开发者越少介入,就越显得他们的监督重要。但要深入理解那些主要由 Auto Mode 在很少人工参与的情况下构建的项目,也变得更加困难。而网络安全的发展速度和复杂性正超过任何人类能够真正跟上的程度。

Original source

本文由 AI 翻译整理自 The Decoder,原文版权归原作者所有。

阅读英文原文
上一篇
AI激活率≠实际使用率:企业落地为何徒有其表
下一篇
LLM-as-Judge:用大模型评估大模型的实战方法