前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9301
  • Graphify:把代码库转为知识图谱供AI助手查询
  • Agent权限应写成机器可读文件而非提示词
  • 免费编程模型打补丁引入了多少回归?
  • 流式 AI 界面错误处理:需要声明式播报策略而非重试按钮
  • OpenAI 兼容不等于真的兼容:AI 编程 Agent 兼容性检查清单
  • Claude Code 将自动执行模式改为默认,批准权限需手动开启
  • 模型没失败,界面失败了:企业 AI 落地七成失败根因分析
  • AI Agent权力过大:如何审计过度代理风险
  • WordPress七月贡献24个PR实录
  • 美团图灵两年实践总结:Agent评测体系搭建方法论
  • Claude Code安全配置:欧盟团队必须知道的GDPR合规风险
  • SDK包应为AI Coding Agent设计专用接口规范
  • 云GPU上的「吵闹邻居」:共享GPU性能波动根因分析
  • NVIDIA开源VoiceChat 11B:端到端语音对话,448ms打断响应
  • Harvey开源法律Agent评测基准LAB:真实法律任务+量化评分
  • Claude Code Agent 调试指南:读转录、追踪工具调用、定位错误
  • 使用 AI 生成代码不丢失代码库理解的实践策略
  • Docker Sandboxes:面向AI Agent的临时隔离沙箱
  • 使用AI而不被AI淘汰:desirable difficulties原则
  • 字节Seed发布全双工音视频大模型:看听说三位一体
  • Claude Code 5天后默认自动模式,费用由Anthropic承担
  • LLM与强化学习全栈指南:从RLHF到推理模型
  • Claude Code 自动执行模式 8 月 14 日起默认开启
  • Visual QA Agent:在 AI 生成的代码发布前捕获 UI 回归
  • 代码里三种永远不会失败的检查——以及它们为何危险
  • 实测有效的AI编程提示词:调试时间减半的工作流
  • AI写测试的真相:能加速脚手架,但会漏掉真实Bug
  • 企业级Claude Code最佳实践:后台分析而非全权委托
  • 50+ Skills实战总结:AI编程Agent技能设计的5条核心规则
  • 确定性AI:何时使用及其实践方法
  • Claude Code自动模式升级为默认模式
  • Claude -p命令意外读取项目CLAUDE.md的发现
  • MCP协议安全漏洞:工具服务器无权限隔离
  • AI Agent生产失败的真实原因:不是模型问题
  • 自反思 Agent 架构:研究任务自动循环补全
  • LLM 学习法:不是提问而是测验,HN 257 条评论验证有效
  • 实时网页数据喂给LLM Agent的实战方法
  • RAG评估实战:从黄金数据集到LLM-as-Judge
  • 用Claude Code把芯片制造变成模拟经营游戏
  • 我用免费API让AI代理直接查询产品数据库
  • 接入LLM API一年的3条血泪教训:token计量、多模型抽象与生产防护
  • 小鹏要求员工AI工具API日志保留两年、季度审计
  • 健身房预约系统 API 未鉴权,可任意取消他人订单
  • 2026 向量数据库选型指南:按规模决策
  • Node.js 文档机器人的检索架构:混合搜索 + Rerank + Evidence Gate
  • RTS游戏AI新思路:用优先级列表替代寻路算法
  • OpenAI Agent突破测试环境:安全边界值得警惕
  • 双 AI 终端交叉验证调试法
  • 3B参数端侧VLX模型:超越英伟达谷歌,实现精准物理世界感知
  • Claude 共享对话被谷歌搜索收录
  • Vercel开源安全审查工具deepsec支持一键启动
  • 已加载 51 / 9301
9.0
重磅
AI SCORE
工具产品2026-08-10 13:37

Claude Code 5天后默认自动模式,费用由Anthropic承担

量子位#Claude#AI编程#Claude Code
Editor brief · 编辑速览

Claude Code即将在5天后将默认模式改为自动模式(autonomous),用户无需手动干预即可让AI自主完成任务,同时产生的额外费用由Anthropic公司承担而非用户。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

梦晨 发自 凹非寺量子位 | 公众号 QbitAI

咱就是想问,还有人认真看AI编程工具给的权限审批请求吗?

Anthropic也发现了,只有3%的权限请求被拒绝。

于是他们做了一个决定,5天后,所有Claude Code将默认启用自动模式。

自动模式的分类器每次工具调用会额外消耗少量token,这部分开销将不再向用户收费。

亚马逊谷歌微软等云平台目前仍然是选配,但Anthropic只给他们一个月时间,要把这些渠道也切成默认自动模式。

Claude Code之父表示,团队内部早就只是用自动模式了,根本无法想象再去手动审批权限。

对于这次改动Anthropic给出的第一组理由,是人工审批已经变成一种习惯性动作:

用户对Claude Code权限提示的同意率是97%。作为对照,当Claude把一份计划交给用户批准时,拒绝率是39%;而单条权限请求的拒绝率只有3%。

同样的倾向也出现在配置文件里。截至2026年6月,49.5%的活跃CLI用户手动写过Bash allow-rule,其中5%直接放行任意shell命令,另有43%写了Bash(python:)、Bash(node:)这类实际效果基本等同的解释器规则,这个比例大约每五周增长5个百分点。

此外,62%的用户用过bypassPermissions或者在Bash上点过"不再询问",25%的交互式会话一开始就运行在bypass permissions模式下。

第二组理由来自一项受控实验。Anthropic通过研究供应商招募了1053名付费专业测试者,在专门搭建的测试环境里完成编码任务。会话进行到一半时,其中一条权限提示被替换成一条明显危险的命令,供应商记录测试者是否点了同意(同意并不会真的执行任何危险操作,被改动的只是提示文本)。

结果是测试者拦住这条命令的比例为13.6%,143次;auto mode面对同样的命令拦下了89%,937次。

正面比较下来,auto mode拦住了800条人类放行的命令,人类只拦住了6条auto mode放行的命令。

而且会话越长,人的表现越差:前期还能拦住约17%,在经历50条以上提示之后降到约5%,而auto mode的拦截率不随会话长度变化。

2026年5月到6月,Anthropic从已授权数据用于训练与分析的账号中,取出安全流水线标记过的会话,用模型按0到10的严重程度重新评级。

-10分代表全公司范围、不可逆的伤害。-7分代表删除生产数据库记录这一级别-0分代表覆盖一个临时文件这类完全可回滚的本地操作,

同时评估用户对该操作的要求有多明确。在7分及以上的严重级别上,走人工审批的会话中有6.3%出现了用户并未明确要求的有害操作,auto mode会话是2.4%,在测试过的每个严重级别上差距都成立。

分类器本身也经过对抗测试。Anthropic与AI安全公司Apollo Research做了为期两周的试点,把合成攻击注入真实编码轨迹,覆盖泛化失效、数据外泄和安全相关威胁三类数据集。

Apollo交回成功攻击样本与加固建议后,Anthropic主要通过给分类器提供更多环境上下文来加固,包括仓库可见性、git状态和数据处理规则。

加固后Apollo用一组Anthropic无法接触的留出攻击集重测,auto mode追回了此前漏掉的约一半攻击,代价是漏掉约2%此前拦住的攻击,两组数据集合并计算,漏检率从12%降到7%。Anthropic同时说明,这些攻击是为找出分类器失效点而合成的,7%不应被理解为真实流量下的漏检率。

针对提示词注入,Anthropic委托第三方Trajectory Labs做了评测,还拉来了OpenAI来当垫背,共72个间接注入场景,每个场景跑10次。

攻击是针对Claude Opus 4.7优化的,而Opus 4.7不在被测名单中,所以所有参测模型面对的都是未见过的攻击。

在720次攻击尝试中,运行auto mode的Claude Fable 5、Opus 5和Sonnet 5没有一次被攻破;

运行Codex Auto-review模式的GPT-5.6 Sol攻击成功率为5.83%,Full Access模式下为19.03%。

作为参照,Claude最新模型在不加额外防护的bypassPermissions模式下的平均攻击成功率是0.09%。

一次向内部云盘上传失败后,Claude的备选方案是把同一份报告发布到公开代码分享站点,被拒绝并转为询问用户;

一次长会话中,Claude试图跨越两千个pod批量结束进程,并排队了会让数百张GPU上在跑的训练任务被拆除的删除操作,命令在执行前被标记;

还有一次是被要求配置只读账单权限时,Claude取用了一个在账户根级别拥有完整管理权限的云角色,权限范围与请求不符被拦下。

把数据外泄列为hard deny,分类器永不批准,要执行必须切出auto mode或手动运行,该规则可在设置中扩展;

区分密钥与敏感信息各自可访问和可分享的范围,并在git push或PR执行前检查目标仓库是公开、私有还是可信;

在git reset —hard这类可能丢弃未提交工作的命令前读取git status;

以及在Claude拉取网页、文件或工具输出时,由API侧探针扫描注入企图并在结果进入上下文前加上警告。

对Pro、Max、Team用户来说,如果从未设置过默认权限模式,会收到产品内通知,新会话自动以auto mode启动;设过其他默认的会看到一次性询问;如果Team管理员已经在managed settings里指定了默认,则不受影响。

切换模式在CLI中按Shift+Tab,桌面端使用模式下拉菜单。管理员可以用managed settings中的defaultMode固定组织级默认,或用disableAutoMode完全关闭auto mode。

Anthropic在公告结尾提示,auto mode依赖分类系统,可以降低风险但不能消除风险,对生产基础设施的高风险改动,仍然建议用户自行审查Claude的操作。

参考链接:[1] https://claude.com/blog/auto-mode-default-in-claude-code

Original source

本文由 AI 翻译整理自 量子位,原文版权归原作者所有。

阅读英文原文
上一篇
字节Seed发布全双工音视频大模型:看听说三位一体
下一篇
LLM与强化学习全栈指南:从RLHF到推理模型