前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9264
  • GPT-6.1 Sol发布:编码与计算机操控能力达Astra九成功力,价格仅五分之一
  • Vercel AI Gateway集成Browserbase网页搜索与抓取工具
  • MCP服务器限流与退避设计:防止Agent把账单跑爆
  • 安全让AI Agent部署:四规则让它永远删不了东西
  • Gemini 4 Argon 正式发布:能力大幅提升,但目前仅限「受信任的网络防御者」使用
  • 构建 Agent 数据工厂:Parquet + DuckDB + MCP 架构实战
  • Agent 规则文件是"君子协定":用机制设计让违规无利可图
  • Gemini 4 Argon 模型已发布,但你暂时还用不上
  • Google 发布 Gemini 4 Argon,号称进入下一代前沿智能时代
  • Gemini 4 Argon 测评:表现出色,但你暂时还用不上
  • OpenAI 联手 Synopsys 打造芯片设计 AI 模型 GPT-Synopsys
  • TokenCap:为什么我们用确定性 AST 重构而非让 LLM 生成代码
  • 实测:LLM 能否检出自己帮忙泄露的 Supabase 密钥
  • 三步让 Claude 后台 Agent 快 3-5 倍且更省钱
  • AI Agent 网络搜索 API 真实成本:10 万次搜索实际花销对比
  • Google 将 Gems 升级为 Skills,拥抱代理友好的提示格式
  • PageIndex:无向量数据库的推理型 RAG,可本地运行
  • dbx:25MB 搞定 100+ 数据库,支持 MCP 和本地 AI
  • AI 工程学习路线:从调 API 到上线真实 AI 产品
  • Google Gemini 应用引入 Skills 功能,Workspace AI 自定义能力再升级
  • 两月Claude Code复盘:1675美元API成本与117次危险命令拦截
  • Hugging Face 开源 WebGPU 本地 AI 推理内核,支持 200+ 算子
  • 用Amazon Bedrock知识库自然语言查询保险理赔
  • OpenAI Dots长时间运行边界问题率翻倍
  • 基于 AWS Bedrock 构建多代理音乐生成流水线
  • AI 智能体意外泄露 1.3 万张企业截图,含敏感信息
  • OpenAI Dot 虚拟机配置曝光:AMD 霄龙 + 9.7GB 内存,预装全栈开发工具
  • Google SynthID Bio:AI蛋白水印方案开源
  • AI代理演示成功不代表生产能成功
  • Deepseek为华为昇腾芯片发布开源编程工具TileLang
  • HydraFusion 研究预览版登陆 VS Code 与 GitHub Copilot 应用
  • NVIDIA 开源 AI Agent 安全沙箱 OpenShell
  • x402 新增 OpenAPI 变更检测与限频推断 API
  • OpenAI推理负责人:数学突破仅是智能体时代的开始
  • B站开源Index-Translate:150语言翻译模型,支持社区俚语和长文档
  • Cloudflare Monetization Gateway:用 HTTP 402 向 AI Agent 收费
  • Cloudflare AI Gateway自动路由器:边缘分类器降低AI成本
  • Cloudflare Workers 内置错误监控可直接推给编码 Agent 调查并提 PR
  • Cloudflare Containers 启动提速 6 倍,支持 Agent 运行时选配沙箱
  • 蚂蚁百灵发布 Ling-3.1-flash:560B 总参数、25B 激活参数、1M 上下文
  • 智谱开源GLM-5.3漏洞利用能力逼近Claude,20美元即可发起Chrome攻击
  • OpenClaw 企业版发布:定位「Agent 版 Kubernetes」
  • Perplexity自研Rust检索引擎Photon,P99延迟从800ms降至65ms
  • OpenAI DevDay 2026发布Dots、Sol 6.1、Ultrafast及Agent API等重磅更新
  • AI时代应放弃维护测试脚本,改用自然语言测试用例
  • React+Tailwind构建高并发生成式视频Studio的架构详解
  • Kimi K3:2.8T 参数 MoE 模型,输出成本仅为 GPT-5 的 1/3
  • Agent「说做了就是做了」问题:如何用证据门拦截虚假执行
  • Agent承诺漂移:6个周期只在说要开始而从未真正执行
  • OpenAI DevDay 一夜发布 25 项更新,GPT-6.1 Sol 登场
  • Liquid AI发布d1决策模型:零token输出结构化决策
  • 已加载 51 / 9264
9.0
重磅
AI SCORE
工具产品2026-10-01 00:04

两月Claude Code复盘:1675美元API成本与117次危险命令拦截

dev.to · AI#Claude#AI编程工具#成本分析
Editor brief · 编辑速览

作者回放两个月106个Claude Code会话共8113次模型调用,用Paveo统计出API费用及被拦截的危险操作,Opus 5消耗占77%达1300美元。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

我在做 Paveo,一个介于 AI Agent 和它所有调用之间的检查点,在不该有的调用运行之前就拒绝掉。在让任何其他人信任它之前,我用它来回放我最常用的 Agent:也就是我自己的 Claude Code,覆盖了我构建 Paveo 的那两个月。

我用的是订阅模式,所以这些都没有实际计费。这一点对下面的内容很重要:以下数字是我的用量在 API 上的费用,以及我的 Agent 本来会被阻止执行的命令。

数据来源

Claude Code 在磁盘上保存每一个会话,每个会话一个 .jsonl 文件,位于 ~/.claude/projects 下。每条 assistant 消息记录了其 token 用量,每个 tool call 记录了其名称和参数。paveo replay 读取这些文件,从带日期的价格表对模型调用定价,并将每个 tool call 过一遍策略。它不存储任何数据,只打印计数和规则名称。

59 天。106 个会话。8,113 次模型调用。8,176 次 tool call。

本来会花多少

文件里几乎每个调用都省略了由哪个区域提供服务,而某些模型在美国区域的推理成本更高,所以这些调用都按美国价格定价。总价可能最高高出 10%。它永远不会偏低,这是预算应该 err 的方向。

那个一直萦绕在我脑海的数字是单个会话:$452.92。在订阅模式下,这不过是一个普通的长下午。在 API 上,作为一个无人值守的 Agent,这就是一份事故报告。

本来会阻止什么

Claude Code 的入门策略很短:几条匹配毁灭性命令的模式,加上指向 Agent 自身设置和 guard 自身文件的路径。在 8,176 次 tool call 上回放,它会拒绝 670 次:

关于这些数字的两个诚实说明。

并非每个 rm -rf 都是错误。很多都是 Agent 在清理它刚刚创建的 build 目录。Guard 会让它找另一种方式,或者来问你。我对这种交换没有意见:一次误报只会让你重试一次,漏掉一次则会让你丢失工作。

547 次中的大部分都是误报,但我还是保留了这个规则。我当时在做一个工具,它的文件位于 .paveo 下,所以 Agent 不断触碰它们。但"Agent 编辑自己的设置或自己的 guard"是我最不想允许的一件事,因为这是关闭其他所有限制的方式。一条保护 guard 的噪音规则,留着。

给所有运行 Agent 的人三条建议

在把会话移到 API 之前,先给它们定价。文件已经在你磁盘上了。如果你手工加总,每条消息 id 只算一次:一条流式消息可能出现在多行上。

在每次运行开始之前设置一个费用上限。每月告警是在 $450 会话发生之后才告诉你。用每次调用前检查的上限来拒绝那个会突破上限的调用。

保持 never-list 短小且机械。值得硬停的操作都是容易被捕获的:递归删除、force-push、任何会花钱的操作。把拒绝写成一条指令("不要用另一种方式重试,告诉我你想要什么"),而不是判决,否则模型会去寻找另一条路线。

Paveo 的仓库本周开源。它运行在你自己的进程里,不打开任何网络 socket,同一个策略文件可以守护 Claude Code、Codex、Cursor 或者你自己构建的 Agent。

如果你给自己的会话定过价,我想知道:费用最高的那次是多少?

Original source

本文由 AI 翻译整理自 dev.to · AI,原文版权归原作者所有。

阅读英文原文
上一篇
Google Gemini 应用引入 Skills 功能,Workspace AI 自定义能力再升级
下一篇
Hugging Face 开源 WebGPU 本地 AI 推理内核,支持 200+ 算子