Claude Code 用户遭遇使用限制提前耗尽
Claude Code 用户普遍反映额度耗尽速度远超预期,引发对计费和功能限制的广泛讨论和质疑。
Claude Code 用户普遍反映额度耗尽速度远超预期,引发对计费和功能限制的广泛讨论和质疑。
意外的配额消耗引发用户投诉,并导致自动化工作流中断。
Anthropic 旗下 AI 编程助手 Claude Code 的用户正遭遇 token 用量异常升高、配额提前耗尽的问题,正常工作因此受到影响。
Anthropic 已承认这一问题,并表示:“人们触及 Claude Code 使用上限的速度远超预期。我们正在积极调查……这是团队当前的最高优先级。”
一名订阅 Claude Pro(每年 200 美元)的用户在该公司的 Discord 论坛上表示:“每到周一配额就用光了,要到周六才会重置,过去几周一直如此……一个月 30 天,我只有 12 天能用 Claude。”
Reddit 上的 Anthropic 论坛也充斥着相关投诉。“我工作 1 小时就用光了 Max 5,以前能工作 8 小时。”一名开发者今天表示。Max 5 方案每月收费 100 美元。
这项变化背后可能有多个因素。上周,Anthropic 表示将在高峰时段下调配额。工程师 Thariq Shihipar 称,这项调整将影响约 7% 的用户,同时又表示:“我们已经实现了许多效率方面的提升,可以抵消这部分影响。”
3 月 28 日也是 Claude 一项促销活动的最后一天。该活动会在每日六小时的高峰时段之外,将使用上限提高一倍。
第三个因素是,Claude Code 可能存在导致 token 用量增加的 bug。一名用户声称,在对 Claude Code 二进制文件进行逆向工程后,他们“发现了两个相互独立的 bug,会导致 prompt cache 失效,在用户毫不知情的情况下将成本推高 10 至 20 倍”。一些用户证实,降级到旧版本后情况有所改善。其中一人表示:“降级到 2.1.34 后,变化非常明显。”
有关 prompt caching 的文档称,缓存能够“显著降低重复任务或包含固定元素的 prompt 所需的处理时间与成本”。不过,缓存的有效期只有五分钟,这意味着,即便只是短暂休息,或者几分钟没有使用 Claude Code,恢复使用时也会产生更高的成本。
Contracts 已进入 C++26,尽管其价值仍存在争议
Contracts 已进入 C++26,尽管其价值仍存在争议
Linear 转向 agentic AI,CEO 宣称 issue tracking 已死
Linear 转向 agentic AI,CEO 宣称 issue tracking 已死
JetBrains 借 Central 转向 agentic 开发,并告别 pair programming
JetBrains 借 Central 转向 agentic 开发,并告别 pair programming
Mozilla 推出 cq,称其为“面向 Agent 的 Stack Overflow”
Mozilla 推出 cq,称其为“面向 Agent 的 Stack Overflow”
开发者可以将缓存有效期升级到一小时,但文档指出:“一小时缓存的写入 token 价格是基础输入 token 价格的 2 倍。”缓存读取 token 的价格则是基础价格的 0.1 倍,因此,这是一个至关重要的优化方向。
Anthropic 并未公布各项方案的确切使用上限。例如,Pro 方案只承诺“每个 session 的使用量至少是免费服务的五倍”。Standard Team 方案则承诺“每个 session 的使用量比 Pro 方案多 1.25 倍”。这使开发者很难知道自己的实际使用上限,只能查看 dashboard,了解已经消耗了多少配额。
这类问题并不少见。本月早些时候,Google Antigravity 的用户也曾就类似问题发起抗议。
即使不考虑 bug,我们现在看到的也是用户与服务提供商围绕 AI 开发中什么样的定价和用量模式才算合理,展开的一场隐性博弈。用户希望控制成本,而服务提供商需要盈利。与此同时,厂商的营销宣传与配额机制之间也存在脱节:一方面,厂商敦促开发者将 AI 嵌入每一个流程,在某些情况下甚至包括自动化工作流;另一方面,配额系统却可能让 AI 工具突然停止响应。
一名用户提醒道:“对于在自动化工作流中运行 Claude Code 的人来说:必须显式捕获 rate-limit 错误——它们看起来就像普通故障,会在无人察觉的情况下触发重试。循环中的一个 session,几分钟内就可能耗光你一整天的预算。”®