前端进阶之旅前端进阶之旅
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
基础篇
进阶篇
高频篇
精选篇
手写篇
面经篇
AI 篇
原理篇
每日一题
小程序题库
知识卡片
  • 场景篇按分类整理的大前端场景考点
  • 历年面经按年份追踪真实考点
  • 算法题库NEW在线编码即时判题
  • 专项自测100 题快速查漏
  • 前端基础
    • HTTP从报文一路讲到 HTTPS
    • 浏览器渲染、事件循环、进程
    • 计算机基础Linux、网络、操作系统
  • 进阶专项
    • 设计模式23 种模式怎么用
    • 前端系统进阶学习大型项目工程化
    • 前端综合文章长期沉淀的实践文
  • 工程与工具
    • Node学习指南从环境搭建到服务端
    • NPM工作流script、依赖与发布
    • Docker容器化部署上手
    • Canvas图形与动画实战
  • 路线与导图
    • 思维导图知识点全景图
    • 学习路线按图索骥不跑偏
  • 动态
    • 公众号动态公众号历史文章
    • 博客动态站长的技术博客
    • 开发者导航常用工具与文档站
  • AI 助手随时提问,即时解析
  • AI 模拟面试模拟真实面试 + 报告
  • AI 知识地图串起全站知识点
  • AI 定制路线按你的简历现排
AI 热点
旧版
返回 AI 情报前线
All News · 全部资讯9369
  • Claude-Mem:让AI编程工具跨会话持久记忆
  • Google Gemini 调整分层策略:免费用户只能用量最小的 Flash-Lite
  • 积分系统设计中没人会纳入预算的工程细节
  • Agenthof:用控制面让 AI Agent 的每次调用都有审计可查
  • Claude Code Mods 发布:Agent 变成可扩展平台
  • ThinkingBox:Benchmark 专门捕获 AI Agent「说完成但没做完」
  • 5 个 JSON Schema 将 AI 编程智能体的输出质量管起来
  • DeepSeek Harness v0.2 发布官方桌面客户端
  • Redis 作者新项目 DwarfStar:消费级硬件运行 DeepSeek V4
  • Chalkboard:用可视化面板追踪 AI Agent 修改过程的 Electron 工具
  • Agent PR 合并率 90% 仍可能掩盖工程工作流弱点
  • AI API 定价的隐藏成本:system prompt token 开销常被低估
  • MacBook Pro外接iPhone加速LLM推理:预填充最高提效44%
  • MCP 传输协议对比:stdio 与远程 HTTP 怎么选
  • 远程 MCP 服务器的 OAuth 2.1 认证完整指南
  • Agent报告完成但数据库未写入:分布式一致性的典型陷阱
  • Kiro Workflows:多 Agent 编排的声明式工作流框架
  • 我用AI当助产士:程序员用LLM记录分析分娩全程
  • Nocturne:可自编辑记忆的 Agent,支持遗忘策略与召回验证
  • 零依赖 Pre-commit 守卫:防止 Cursor/Claude Code 破坏整洁架构
  • Claude官方指南:如何充分释放Opus 5.5在Claude和Claude Code中的性能
  • Claude Code 接入第三方模型作子代理,省 Token 新思路
  • OpenAPI 规范一键转 MCP Server 的具体映射方法
  • 编码 Agent 权限安全:黑名单漏过 46/75 提示注入,能力边界放过 3 成
  • AI编程代理成本实测:token单价低不等于任务成本低
  • 我用 Diff Budget 约束 AI 编码 Agent 的范围蔓延
  • AI加速漏洞利用,传统漏洞表格已跟不上节奏
  • 8GB 显卡运行 510GB DeepSeek-V4.1-Flash 的实战记录
  • 本地语音转文字 pipeline:faster-whisper int8 量化实现全离线
  • 393 个 AI 构建仓库人工复审:八分之一存在严重缺陷
  • 开源工具 BootLoops + Claude 三个月产出 36 篇跨学科论文
  • Jev/TEV意图识别 vs Embedding:不是替代是分工
  • 2026年AI智能合约审计实战:从LLM到CI/CD集成
  • AI Agent通过DNS逃逸:OpenAI训练事故的技术复盘
  • Verax:为AI Agent设计的可验证紧急停止开关
  • Claude Code推出Mods系统:可直接从内部重写AI编码工具
  • IBM Bob 支持私有化部署,代码不出内网的 AI 开发时代来了
  • 近期三个 AI API 变更正在静默破坏你的线上代码
  • Angular升级全自动Agent循环架构解析
  • 7 行 Claude Code mod 可绕过 deny 规则:权限安全审计
  • Prime Intellect推出Prime Inference:前沿开源模型Serverless推理服务
  • OpenAI官方指南:如何选对GPT-6系列模型并优化提示词
  • 微软发布MAI-Transcribe-2-Streaming:实时语音转文字登顶基准榜
  • OpenAI 自研芯片 Jalapeño 量产,搭配 AMD Turin 而非英伟达
  • SQL Agent 的知识层缺失:OKF 实践(下)
  • 突变测试导致AI代理误删真实账本
  • 决策AI模型横评:TypeSafe Jev对阵Fastino GLiDE等开源竞品
  • Sparse VideoGen:TPU 上视频扩散模型注意力加速 1.69 倍
  • x402 生产避坑:支付签名重放漏洞与防护清单
  • Claude Code 首次请求实测:空文件夹 23207 tokens,flag 可降至 2664
  • Agent 沙箱逃逸警示:DNS 隐蔽信道与 Kill Switch 实测缺失
  • 已加载 51 / 9369
9.0
重磅
AI SCORE
编程提效2026-10-04 02:29

Claude官方指南:如何充分释放Opus 5.5在Claude和Claude Code中的性能

Hacker News#Claude#AI编程#官方指南
Editor brief · 编辑速览

Claude官方博客详述Opus 5.5的新能力与最佳调用方式,涵盖prompt优化、上下文管理、工具调用效率提升等工程级技巧,HN热度155。

文章思维导图
Knowledge map
拖拽缩放
Full translation

完整中文译文

如何在 Claude 和 Claude Code 中充分发挥 Opus 5.5 的潜力

如何给 Opus 5.5 下指令、引导一个长时间运行的任务,以及在 Claude 应用和 Claude Code 中检查结果。

Opus 5.5 与你已有的 Claude 使用方式配合得很好。不过有几处行为有所不同:它会自主工作更长时间,会清楚地告诉你它做了什么,而且它会在每次回复前先思考。本文涵盖如何在 Claude 应用和 Claude Code 中使用 Opus 5.5,包括如何给模型下指令、引导长时间运行的任务,以及如何检查结果。

第一次使用 Opus 5.5 可以尝试的三件事

一次性交付整个任务。说明"完成"是什么样的,以及何时希望它停下来询问你。然后让它开始工作。

删除"仔细思考"这类表述。Opus 5.5 已经在每次回复前会先思考了。

当一个长时间运行结束时,先看它需要你做什么。

说明"完成"是什么样的,然后让它运行

做什么。 在一条消息中给出整个任务。说明终点线是什么样的,比如"测试通过"或"每个端点都迁移完成"。然后让它去执行。

为什么在 Opus 5.5 上很重要。 Opus 5.5 在处理长的、多部分任务时比 Opus 5 表现更好。与之前的 Opus 模型相比,它在多步骤工作上的提升最为显著,比如将一个变更贯穿整个代码库直到测试通过。早期的测试者让它连续几个小时运行长的编码任务,几乎不需要监督。有了明确的终点线,它就知道什么时候该结束了。

怎么做。 例如在 Claude Code 中:

Migrate the payment endpoints from the old client to the new one.
Done means: every endpoint uses the new client, the old client is deleted, and the test suite passes.
Stop and ask me only if a test fails for a reason you can't explain.

FIG A 一条消息:整个任务、终点线,以及何时停止。

The example prompt split into three labelled boxes: the whole task (migrate the payment endpoints from the old client to the new one), the finish line, highlighted (every endpoint uses the new client, the old client is deleted, and the test suite passes), and when to stop (only if a test fails for a reason you can't explain). Footer: "Give the whole task in one message. Name the finish line. Then leave it alone."

不要再让它"努力思考"

做什么。 从你的提示词和保存的指令中删除"仔细思考"、"分步骤思考"以及类似的表述。

为什么在 Opus 5.5 上很重要。 Opus 5.5 每次回复前都会思考,而且它自己决定思考多少。你不需要要求它思考。在我们的聊天产品测试中,删除一条"仔细思考"的表述让回复开始得更快,质量没有明显下降。

怎么做。 删除那行。对于简单问题的快速回答,直接说出来:"直接回答"。要改变 Claude Code 中的思考量,可以调整 effort。

在运行中添加内容

做什么。 如果你在运行过程中想起了什么,可以在它工作时输入后续内容。

为什么在 Opus 5.5 上很重要。 现在的运行时间更长了,所以重启的代价更高。

怎么做。 在 Claude Code 中,在 Claude 工作时输入消息并按回车,例如:"另外把旧的端点名保留为别名"。

做设计工作时,说出你不想要的风格

做什么。 当你请求一个页面、一个应用或一个产物时,列出你希望排除的设计习惯。

为什么在 Opus 5.5 上很重要。 没有设计方向时,Opus 5.5 会回退到几个默认风格。像"避免通用外观"这样的通用指令基本上只是把一个默认换成另一个。列出一组具体的模式效果要好得多。

怎么做。 说出那些模式:

Build a personal website with placeholder content.
Don't use a cream or off-white background, italic accent words in headings, numbered "01 / 02 / 03" section labels, monospace labels, or pill-shaped buttons.

然后看看它选择了什么。如果你也不喜欢那个,把它加到列表里再试一次。

2. 在 CLAUDE CODE 中引导长时间运行

告诉它你希望它在哪些点停下来

做什么。 在你的 CLAUDE.md 文件中放一条简短规则,说明何时该停下来询问,何时该继续前进。

为什么在 Opus 5.5 上很重要。 Opus 5.5 在工作时会让你了解进展。在一个长任务上,它有时会停下来汇报而不是继续:要么是一个总结,指出下一步是什么但没有执行,要么是提议继续,要么是一列选择但不会阻塞工作。它会遵循明确说明这些停顿点的指令。你也需要说明你希望它在哪些点停下来。

怎么做。 将以下内容添加到 CLAUDE.md 中,并编辑它以适应你的项目:

When a step doesn't need my input, keep going. Put status notes in the same message as your next action.
Stop and ask me only when you can't continue without me, or before anything destructive: deleting data, force-pushing, or changing anything outside this repository.

FIG B CLAUDE.md 规则:何时继续,何时停下来询问。

A CLAUDE.md card titled "Tell it which stops you want" with two boxes. Keep going: when a step doesn't need my input, keep going, and put status notes in the same message as your next action. Stop and ask: only when you can't continue without me, or before anything destructive: deleting data, force-pushing, or changing anything outside this repository. Footer: "Edit it to fit your project. Keep permission prompts on for destructive commands too."

如果运行停在了"要我继续吗?",回复"继续"。如果这种情况经常发生,上面的规则会有帮助。

一条"继续前进"的规则意味着更少的停顿,所以在你做任何有风险或难以撤销的事情之前,自己先检查一下。上面规则的最后一行就是这么做的。对于破坏性命令也保持权限提示开启。

对于结对编程,你可能想要相反的效果:开始前一行计划,结束时简短回顾。在你的 CLAUDE.md 中说明这一点。Opus 5.5 两种方式都会遵循。

让它把大工作分配给 subagents

做什么。 对于大型代码库中的审计、迁移或审查,让 Opus 5.5 把工作分配给 subagents 并检查每个结果。

为什么在 Opus 5.5 上很重要。 早期测试者让 Opus 5.5 在长时间的审计和迁移中协调并行的 subagents,几乎不需要监督。

Audit every service in services/ for the retry bug in the linked issue.
Give each service to its own subagent. When a subagent reports back, check its evidence before you accept it.
Finish with one table: service, affected yes or no, and the evidence.

FIG C 分发到 subagents,检查每个的证据,然后用一个表格总结。

Diagram titled "Give each service to its own subagent." The prompt "Audit every service in services/ for the retry bug in the linked issue" fans out to four subagents. Their reports join at a "Check its evidence" step ("When a subagent reports back, check its evidence before you accept it"), then an arrow leads to "Finish with one table," an empty table with the columns Service, Affected yes or no, and The evidence.

把任务列表保存在文件中

做什么。 对于需要运行一段时间的任务,让 Opus 5.5 把任务列表保存在一个文件中,并在执行过程中更新它。然后读取这个文件而不是滚动历史来看运行到哪里了。

为什么在 Opus 5.5 上很重要。 现在的运行时间更长了。长时间运行会填满上下文窗口,然后 Claude Code 会总结较早的对话。文件中的列表可以经受住这个过程,而且能让你一眼看出什么是完成的、什么还没做。

怎么做。 "在 TASKS.md 中保持一个检查清单。每完成一项就打勾,发现新内容时加上。"

3. 检查结果

先看它需要你做什么

做什么。 当一个长时间运行结束时,首先寻找 Claude 在等你做的事情,比如它留下的待决决策或希望你批准的变更。然后再看 Claude 的其余总结。

为什么在 Opus 5.5 上很重要。 Opus 5.5 比 Opus 5 更清楚地报告它的工作。它的更新和最终总结会用通俗的语言说明它做了什么、发现了什么,以及它需要你做什么。

怎么做。 要改变总结的格式,在 CLAUDE.md 中说明,例如:"每次运行结束时用三个标题结尾:阻塞我的、已更改的、已发现的"。

让它审查代码

做什么。 在人工审查之前,让 Opus 5.5 审查一个 diff 或一个 pull request。

为什么在 Opus 5.5 上很重要。 一位早期测试者说,Opus 5.5 在最低 effort 下发现的 bug 比 Opus 5 在最高 effort 下发现的还多,而且误报更少。它也用通俗的语言解释它的变更,所以它的 pull request 描述更容易审查。

怎么做。 把这个提示词喂给 Claude:

Review the diff on this branch against main.
List only problems you'd block the merge for. For each one, give the file and line, why it's wrong, and how to show it fails.

让它标记它无法确认的内容

做什么。 对于研究和分析,让它说出它找不到或无法检查的内容。

为什么在 Opus 5.5 上很重要。 "我找不到这个"值得一读,要求它这么做就能容易地找到。

怎么做。 在请求中添加"标记任何你无法确认的内容,并说明你在哪里查找的"。这在 Claude 的研究报告中和 Claude Code 中都有效。

首先,检查模型选择器显示的是 Opus 5.5。

直接分享图表或截图本身

做什么。 附上图表、图表、截图或幻灯片。不要重新输入数字。

为什么在 Opus 5.5 上很重要。 Opus 5.5 读取图表、图表和截图比 Opus 5 更准确,而且不需要额外步骤就能做到。它也更擅长理解依赖图像中元素位置的意义:箭头连接了哪些框、图表的两个版本之间发生了什么变化,或者日历截图中会议何时开始何时结束。

怎么做。 附上图片并问一个具体的问题:"哪些服务直接调用 billing API?"

让它检查长文档

做什么。 给它一个长的计划、报告或演示稿,让它找出错误。

为什么在 Opus 5.5 上很重要。 Opus 5.5 比之前的 Opus 模型更注重细节。在我们的测试中,它发现了一个日期落在了错误的工作日(在一个长的计划讨论中),以及一张图表与文稿中的数字不匹配。

怎么做。 提交提示词:"检查这个演示稿中任何自相矛盾的内容:数字、日期和名字。引用每个问题并说明它在哪里。"

要求生成完整的文件

做什么。 当你想要一个电子表格或文档时,要求生成文件,而不是大纲。

为什么在 Opus 5.5 上很重要。 Opus 5.5 生成的电子表格和文档比 Opus 5 生成的在你分享之前需要更少的编辑。

怎么做。 "把这个做成一个我可以分享的电子表格:每个供应商一行,列为成本、合同结束日期和负责人"。

在项目中说明何时答案已确定

做什么。 如果在长对话中的后续问题感觉变慢了,添加一条指令说明较早的答案是确定的。

为什么在 Opus 5.5 上很重要。 在一个长的对话中,Opus 5.5 有时在思考一个简短的跟进问题时,会回顾较早的答案。这会拖慢回复速度。

怎么做。 将以下内容添加到项目指令中:

Once you have answered something, treat that answer as done. Focus on what I'm asking now, and don't go back over an earlier answer unless I ask about it or point out a problem with it.

在需要后续步骤揭示较早步骤错误的长时间分析中,不要加入这一条。

5. 当消息被标记时

Opus 5.5 是第一个以 Fable 级别的生物安全和网络安全防护上线的 Opus 模型。在 Claude 应用和 Claude Code 中,大多数被标记的消息会转到较旧的模型,你的工作在那里继续。查找源代码中的安全漏洞是被允许的,日常的健康和教育问题应该仍然可以正常工作。这些防护有时会标记合法的工作,我们正在调整它们以减少错误标记。如果你被切换了,以下是你会看到什么以及该怎么做。

你看到的。 一条以"切换到"开头的通知,以及较旧模型的名称。Claude 在那个模型上回答,对话保持在该模型上。

要回到 Opus 5.5,在模型选择器中选择它。如果较早的消息仍在对话中,它可能会再次被标记。开始一个新的对话可以避免这种情况。

要被先询问,进入设置,然后是功能,关闭"当消息被标记时切换模型"。你会看到一个"暂停"卡片,上面有你的选项。

检查涵盖对话中的所有内容,包括文件和搜索结果。所以标记可能来自较早的内容,而不仅仅是你的最后一条消息。

你看到的。 一条通知,标明较旧的模型。会话来续在该模型上。

运行 /model 切换回去。

按 Esc 两次来编辑你的最后一条消息并重试。

要被先询问,运行 /config 并更改"当消息被标记时切换模型"。

如果标记是错误的,运行 /feedback。

不要让它在回复中展示推理过程

做什么。 从你的提示词和指令中删除要求在回复中重现其内部推理的请求。

为什么在 Opus 5.5 上很重要。 在回复中重现其内部推理的请求可能会被拒绝。这是标记类别之一。

怎么做。 改为向 Claude 要求你需要的东西,例如:"用三句话解释你为什么选择这个方法"。

当你在等待每个回复时开启 fast mode

做什么。 在 Claude Code 中,对于来回的工作(你在发送下一条消息之前阅读每个回复),使用 fast mode。

为什么在 Opus 5.5 上很重要。 Fast mode 在上线时作为研究预览对 Opus 5.5 可用。你得到的是相同的模型,文本到达得更早。它需要额外开启使用,而且每 token 的成本比标准模式高。

怎么做。 在 Claude 中输入 /fast。

你的 OPUS 5.5 检查清单

在下次做长任务之前过一遍这个清单。

FIG D 清单一览。

The checklist as a card with four groups of checkbox items: Asking, Long runs in Claude Code, Checking, and Flags. The same items are listed as text below.

提问

  • 任务说明了"完成"是什么样的
  • 提示词和保存的指令中没有"努力思考"这类表述
  • 设计请求列出了要排除的风格
  • 图表和截图是附上的,不是重新输入的

Claude Code 中的长时间运行

  • CLAUDE.md 说明了何时停止、何时继续,以及在任何破坏性操作之前停止
  • 破坏性命令的权限提示仍然开启
  • 大型审计和迁移分配给 subagents
  • 任务列表保存在文件中

检查

  • 先阅读报告中的"需要你做的"部分
  • 在人工审查之前运行一次审查
  • 研究答案标记了无法确认的内容
  • 你知道如何切换回去:模型选择器,或 /model
  • "当消息被标记时切换模型"已按你的偏好设置

用 Opus 5.5 开始构建吧!

感谢 Molly Vorwerck 的审阅。

Original source

本文由 AI 翻译整理自 Hacker News,原文版权归原作者所有。

阅读英文原文
上一篇
零依赖 Pre-commit 守卫:防止 Cursor/Claude Code 破坏整洁架构
下一篇
Claude Code 接入第三方模型作子代理,省 Token 新思路