前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片NEW
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 业务场景题真实业务问题与追问
  • 查漏补缺常见问题解析
  • AI 模拟面试NEW模拟真实面试 + 报告
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
    • AI 定制路线NEW按你的简历现排
    • AI 知识地图NEW串起全站知识点
  • 动态
    • AI 热点NEWAI 每日动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
AI 助手NEW
旧版
返回 AI 情报前线
All News · 全部资讯8836
  • 五大LLM网关工具生产环境横评
  • GitHub Copilot应用如何渲染百万行PR
  • 基于 AWS 构建 Agent 式视频智能对话系统架构解析
  • Bedrock 上用开源权重模型做 AI 编程助手
  • Anthropic 实验室:Claude 自主发现类 CRISPR 新型酶系统
  • ChatGPT Voice 集成邮件、日历和 Slack:Altman 心中的"Her"更近一步
  • OpenAI GPT-6 Sol/Luna 和 Claude Opus 5.5 同步降价 50%
  • AI 工具循环必须显式传递 Retry-After 头否则必死循环
  • AI 代码补丁静默引入新工具调用:merge 前必须强制契约检查
  • AI 写 API 文档无法区分 null/0/缺省三态:OpenAPI 契约必须显式约束
  • AI 编程 Agent 工具输出遭截断:应记录 stdout_bytes 和截断标志
  • Anthropic工程师揭秘:Claude为何越进化写作越差
  • Gemini 3.8 Flash / Flash-Lite TTS 发布:千款语音、30秒克隆、逐行台词控制
  • 工程师详解:新版Claude为何写作风格变得怪异
  • 小米MiMo-V3将搭载HySparse 2:100万Token下KV缓存缩小4.5倍
  • GitHub Copilot 应用新增本地沙箱隔离功能
  • AI Agent 调试指南:重启不是调试,七层架构定位根因
  • AI 加剧软件供应链攻击威胁,行业如何应对
  • 阿里 Qwen Audio 3.1 发布:语音识别/TTS 多模型,API 价格最高降 95%
  • Claude Code部署到Lizard平台实战指南
  • Claude Opus 5.5降价却破坏四个Agent依赖项
  • OpenAI GPT-6 Sol/Luna 半价发布,缓存机制或为更大降本杠杆
  • treg:聚合 3000+ Agent 工具的统一网关
  • 向量检索权限校验应内嵌到 pgvector 查询中
  • Univer:面向 AI Agent 的开源办公套件 SDK
  • DeepSeek公开Agent训练新论文,梁文锋署名
  • 为 AI 编程 Agent 构建可复用技能系统的实践
  • DeepMind研究:百个AI智能体协作求解时出现作弊与告密现象
  • Google AX:开源Agent编排运行时
  • 阿里千问发布Qwen-Audio-3.1:TTS降价70%、ASR降价95%
  • 诺基亚开源AnyJev:无训练即可将任意开源LLM转为校准决策模型
  • 2026年AI网关横评:Bifrost领跑,多路 failover 哪家强
  • GPT-6 Sol/Luna 发布:准确率翻倍、成本减半,价格战开启
  • Claude Opus 5.5 登场,AI 模型价格普降 40-50%
  • Kyutai开源语音模型Voice of Reason,口算GSM8K准确率从27%升至77%
  • 微软Copilot大促:10万席最高半价,向超级AI应用转型
  • OpenAI GPT-6 Sol/Luna:API价格腰斩,长任务Prompt缓存优化
  • AI 编码 Agent 在移动端多久“看”一次才够用
  • GPT-6 Astra 引领 3D 生成技术,竞争格局生变
  • Claude Opus 5.5 缓存读取降价 60%,68 万行代码迁移攻略
  • 用 AI 辅助求职的工程实践:诚实原则与确定性设计
  • Agent 补丁评分卡:防止测试被悄悄弱化的 CI 策略
  • Opus 5.5 缓存降价后 text-to-SQL 成本重算分析
  • Slack推出Code Channels:团队对话内集成AI编程助手
  • GPT-6 Sol/Luna 登场:价格腰斩,定位细分
  • TypeSafe Jev:让AI返回结构化决策而非段落文本
  • Text-to-SQL访问控制:身份决定Schema可见性
  • Jev 1.13实测:工单分类精度达100%,对比规则引擎和本地LLM
  • GitHub Copilot应用支持OpenTelemetry可观测性配置
  • Copilot for JetBrains新增工具审批和Agent控制功能
  • 两款 AI 代码审查基准测评结论相反
  • 已加载 51 / 8836
9.0
重磅
AI SCORE
模型发布2026-09-23 20:00

Claude Opus 5.5降价却破坏四个Agent依赖项

The New Stack#Anthropic#Claude#API变更
Editor brief · 编辑速览

Anthropic新版Opus 5.5虽调低价格,但API变更导致现有Agent工具链出现四个兼容性问题,需及时适配。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

Anthropic 于周二发布的 Claude Opus 5.5 比前代产品更便宜了:每百万输入 token 的价格从 5 美元降至 4 美元,每百万输出 token 的价格从 25 美元降至 20 美元。100 万 token 的上下文窗口和 12.8 万 token 的最大输出保持不变。

从纸面数据看,升级是一个很容易做的决定。但在实践中,换一个模型 ID 可能并没有那么简单。

Anthropic 的迁移指南标注了四个破坏性变更,这些变更会导致原本为 Opus 5 构建的请求在切换到 Opus 5.5 后返回 400 错误。还有一些其他变更不会触发错误,但仍然可能改变现有 agent 的行为。

Anthropic 的迁移指南标注了四个破坏性变更,这些变更会导致原本为 Opus 5 构建的请求在切换到 Opus 5.5 后返回 400 错误。

Thinking 始终开启

第一个变更涉及 thinking 控件。Opus 5.5 在请求将 thinking 设置为 disabled 或使用 enabled 且同时设置 budget_tokens 时会返回 400 错误,effort 成为控制模型推理量的唯一方式。之前为了节省时间和 token 而对简单步骤关闭 thinking 的 agent,现在需要给那些步骤分配一个更低的 effort 级别。由于 thinking 现在始终开启,响应以 thinking 块开头,所以假设第一个 content 块是文本的代码也需要修改。

默认的 effort 级别也从 Opus 5 的 high 降到了 Opus 5.5 的 medium,所以省略该参数的请求将悄无声息地以更低的设置运行。Anthropic 建议显式设置 effort 并重新运行 effort 评估,因为每个步骤的合适级别可能已经随着成本和延迟的变化而改变。

不再支持强制工具调用

强制工具调用也不再可用:将 tool_choice 设置为 any 或 tool 会返回 400 错误,包括在 token 计数端点上——基于这些设置的成本估算将连同它们本应定价的请求一起失败。许多 agent 循环会在某个步骤必须查询数据库、运行代码或访问其他服务时强制调用,而 Anthropic 的替代方案是将 auto 与 strict 工具使用或结构化输出结合,并在提示词中说明该工具的适用时机。

路由与会话历史

Thinking 块现在与产生它的模型和会话绑定。在 Claude API 上,Fable 5.1 和 Mythos 5.1 是唯一能读取 Opus 5.5 thinking 块的其他模型,因此路由器或降级方案将对话交给任何其他模型时,这些轮次将在没有先前推理的情况下运行,而不是返回错误。

对于那些已经在监控 agent 调用是否被悄悄路由到旧模型的团队来说,这增加了一层复杂性。Opus 5.5 可以读取 Opus 5 以及更早的 Opus、Sonnet 和 Haiku 模型的 thinking 块,但无法读取 Fable 或 Mythos 的 thinking 块。

对于这些块保持有效,会话也必须保持仅追加模式。修剪旧消息、更改工具定义、在客户端汇总早期上下文,或在会话中途重写系统提示词,都会使现有的 thinking 块失效——对于在 2026 年 8 月 31 日 UTC 零点或之后创建的账户,在其中一种编辑后重放 thinking 块会默认返回 400 错误。旧账户不会收到错误,但无效的块仍然会发送给模型,Anthropic 表示未来的模型将对所有账户强制执行此检查。不编辑早期轮次的集成无需代码变更,Anthropic 表示 Claude Code、claude.ai、Claude Managed Agents 和 Claude Agent SDK 已经以这种方式工作,而自行压缩上下文的 agent 应遵循该公司关于保留 thinking 的文档。

第四个变更影响 Claude API 和 Google Cloud 上的 computer-use agent,Opus 5.5 拒绝 computer_20251124 工具,只接受通过 computer_toolset_20260801 工具集进行的 computer use。请求本身变得更简单,因为 beta header 被移除,工具集条目不需要名称或显示尺寸,但 agent 循环需要更多改动。每个操作现在作为自己的 tool_use 块到达,通过块的 name 而不是 input.action 来标识,单个轮次可以包含多个这样的块,且每个结果都必须回显 toolset_name。旧工具在 Amazon Bedrock 上仍然可用,Anthropic 引导其他平台的开发者参阅 computer use 工具的兼容性文档。

……路由器或降级方案将对话交给任何其他模型时,这些轮次将在没有先前推理的情况下运行,而不是返回错误。

不会抛出错误的变更

最容易被忽视的变更根本不会产生错误。在 Opus 5 上,Claude 在工具调用之间写入的文本作为 text 块返回,但在 Opus 5.5 上,那些叙述作为 progress-update thinking 块到达,而在 thinking.display 的默认省略设置下,这些块是空的。

任何将这些叙述流式传输给用户的 agent 界面都将在工具调用之间变得沉默,直到开发者将 display 设置为 updates——一个在隐藏推理的同时返回进度更新的 beta 选项——或设置为 summarized,后者同时返回两者,然后在其前面的工具调用之前渲染每个非空的 thinking 块。

Opus 5.5 还附带更广泛的安全分类器。它可以返回 refusal 的 stop_reason,其中 stop_details 类别现在除了 cyber 还包括 bio 和 reasoning_extraction,而 Anthropic 的服务端降级方案不会重试因 reasoning_extraction 而被拒绝的请求,而是将拒绝交还给应用程序。

不处理拒绝的 agent 将在任务中途停止,这是一个开发者已经在 OpenAI 的安全系统切断 API 响应时遇到过的问题。

最容易被忽视的变更根本不会产生错误。

从旧模型升级

从 Opus 4.8 升级的团队需要先完成 Opus 5 迁移,这涉及 thinking 默认开启及随之而来的响应格式变更,然后再应用 Opus 5.5 的变更。使用 Opus 4.7 或更早版本的团队有更多工作要做,而使用比 Opus 4.7 更旧的模型的团队还面临 rejected sampling 参数、被拒绝的手动 extended thinking、被移除的 prefill 以及更新的 tokenizer。

Claude Managed Agents 用户只需更改模型名称。在 Claude Code 中工作的开发者可以运行 /claude-api migrate 来应用模型 ID 替换、参数变更、prefill 替换和整个代码库的 effort 校准,然后手动审查清单上的各项进行验证。

Anthropic 建议在切换生产流量之前在开发环境中测试迁移。维护自己集成的开发者也需要测试模型周围的各个部分。工具调用、模型交接、会话历史和面向用户的进度更新在切换后都可能表现不同,因为 agent 故障通常起源于模型本身之外。

Original source

本文由 AI 翻译整理自 The New Stack,原文版权归原作者所有。

阅读英文原文
上一篇
Claude Code部署到Lizard平台实战指南
下一篇
OpenAI GPT-6 Sol/Luna 半价发布,缓存机制或为更大降本杠杆