Claude官方博客详述Opus 5.5的新能力与最佳调用方式,涵盖prompt优化、上下文管理、工具调用效率提升等工程级技巧,HN热度155。
如何在 Claude 和 Claude Code 中充分发挥 Opus 5.5 的潜力
如何给 Opus 5.5 下指令、引导一个长时间运行的任务,以及在 Claude 应用和 Claude Code 中检查结果。
Opus 5.5 与你已有的 Claude 使用方式配合得很好。不过有几处行为有所不同:它会自主工作更长时间,会清楚地告诉你它做了什么,而且它会在每次回复前先思考。本文涵盖如何在 Claude 应用和 Claude Code 中使用 Opus 5.5,包括如何给模型下指令、引导长时间运行的任务,以及如何检查结果。
一次性交付整个任务。说明"完成"是什么样的,以及何时希望它停下来询问你。然后让它开始工作。
删除"仔细思考"这类表述。Opus 5.5 已经在每次回复前会先思考了。
当一个长时间运行结束时,先看它需要你做什么。
做什么。 在一条消息中给出整个任务。说明终点线是什么样的,比如"测试通过"或"每个端点都迁移完成"。然后让它去执行。
为什么在 Opus 5.5 上很重要。 Opus 5.5 在处理长的、多部分任务时比 Opus 5 表现更好。与之前的 Opus 模型相比,它在多步骤工作上的提升最为显著,比如将一个变更贯穿整个代码库直到测试通过。早期的测试者让它连续几个小时运行长的编码任务,几乎不需要监督。有了明确的终点线,它就知道什么时候该结束了。
怎么做。 例如在 Claude Code 中:
Migrate the payment endpoints from the old client to the new one.
Done means: every endpoint uses the new client, the old client is deleted, and the test suite passes.
Stop and ask me only if a test fails for a reason you can't explain.
FIG A 一条消息:整个任务、终点线,以及何时停止。

做什么。 从你的提示词和保存的指令中删除"仔细思考"、"分步骤思考"以及类似的表述。
为什么在 Opus 5.5 上很重要。 Opus 5.5 每次回复前都会思考,而且它自己决定思考多少。你不需要要求它思考。在我们的聊天产品测试中,删除一条"仔细思考"的表述让回复开始得更快,质量没有明显下降。
怎么做。 删除那行。对于简单问题的快速回答,直接说出来:"直接回答"。要改变 Claude Code 中的思考量,可以调整 effort。
做什么。 如果你在运行过程中想起了什么,可以在它工作时输入后续内容。
为什么在 Opus 5.5 上很重要。 现在的运行时间更长了,所以重启的代价更高。
怎么做。 在 Claude Code 中,在 Claude 工作时输入消息并按回车,例如:"另外把旧的端点名保留为别名"。
做什么。 当你请求一个页面、一个应用或一个产物时,列出你希望排除的设计习惯。
为什么在 Opus 5.5 上很重要。 没有设计方向时,Opus 5.5 会回退到几个默认风格。像"避免通用外观"这样的通用指令基本上只是把一个默认换成另一个。列出一组具体的模式效果要好得多。
怎么做。 说出那些模式:
Build a personal website with placeholder content.
Don't use a cream or off-white background, italic accent words in headings, numbered "01 / 02 / 03" section labels, monospace labels, or pill-shaped buttons.
然后看看它选择了什么。如果你也不喜欢那个,把它加到列表里再试一次。
做什么。 在你的 CLAUDE.md 文件中放一条简短规则,说明何时该停下来询问,何时该继续前进。
为什么在 Opus 5.5 上很重要。 Opus 5.5 在工作时会让你了解进展。在一个长任务上,它有时会停下来汇报而不是继续:要么是一个总结,指出下一步是什么但没有执行,要么是提议继续,要么是一列选择但不会阻塞工作。它会遵循明确说明这些停顿点的指令。你也需要说明你希望它在哪些点停下来。
怎么做。 将以下内容添加到 CLAUDE.md 中,并编辑它以适应你的项目:
When a step doesn't need my input, keep going. Put status notes in the same message as your next action.
Stop and ask me only when you can't continue without me, or before anything destructive: deleting data, force-pushing, or changing anything outside this repository.
FIG B CLAUDE.md 规则:何时继续,何时停下来询问。

如果运行停在了"要我继续吗?",回复"继续"。如果这种情况经常发生,上面的规则会有帮助。
一条"继续前进"的规则意味着更少的停顿,所以在你做任何有风险或难以撤销的事情之前,自己先检查一下。上面规则的最后一行就是这么做的。对于破坏性命令也保持权限提示开启。
对于结对编程,你可能想要相反的效果:开始前一行计划,结束时简短回顾。在你的 CLAUDE.md 中说明这一点。Opus 5.5 两种方式都会遵循。
做什么。 对于大型代码库中的审计、迁移或审查,让 Opus 5.5 把工作分配给 subagents 并检查每个结果。
为什么在 Opus 5.5 上很重要。 早期测试者让 Opus 5.5 在长时间的审计和迁移中协调并行的 subagents,几乎不需要监督。
Audit every service in services/ for the retry bug in the linked issue.
Give each service to its own subagent. When a subagent reports back, check its evidence before you accept it.
Finish with one table: service, affected yes or no, and the evidence.
FIG C 分发到 subagents,检查每个的证据,然后用一个表格总结。

做什么。 对于需要运行一段时间的任务,让 Opus 5.5 把任务列表保存在一个文件中,并在执行过程中更新它。然后读取这个文件而不是滚动历史来看运行到哪里了。
为什么在 Opus 5.5 上很重要。 现在的运行时间更长了。长时间运行会填满上下文窗口,然后 Claude Code 会总结较早的对话。文件中的列表可以经受住这个过程,而且能让你一眼看出什么是完成的、什么还没做。
怎么做。 "在 TASKS.md 中保持一个检查清单。每完成一项就打勾,发现新内容时加上。"
做什么。 当一个长时间运行结束时,首先寻找 Claude 在等你做的事情,比如它留下的待决决策或希望你批准的变更。然后再看 Claude 的其余总结。
为什么在 Opus 5.5 上很重要。 Opus 5.5 比 Opus 5 更清楚地报告它的工作。它的更新和最终总结会用通俗的语言说明它做了什么、发现了什么,以及它需要你做什么。
怎么做。 要改变总结的格式,在 CLAUDE.md 中说明,例如:"每次运行结束时用三个标题结尾:阻塞我的、已更改的、已发现的"。
做什么。 在人工审查之前,让 Opus 5.5 审查一个 diff 或一个 pull request。
为什么在 Opus 5.5 上很重要。 一位早期测试者说,Opus 5.5 在最低 effort 下发现的 bug 比 Opus 5 在最高 effort 下发现的还多,而且误报更少。它也用通俗的语言解释它的变更,所以它的 pull request 描述更容易审查。
怎么做。 把这个提示词喂给 Claude:
Review the diff on this branch against main.
List only problems you'd block the merge for. For each one, give the file and line, why it's wrong, and how to show it fails.
做什么。 对于研究和分析,让它说出它找不到或无法检查的内容。
为什么在 Opus 5.5 上很重要。 "我找不到这个"值得一读,要求它这么做就能容易地找到。
怎么做。 在请求中添加"标记任何你无法确认的内容,并说明你在哪里查找的"。这在 Claude 的研究报告中和 Claude Code 中都有效。
首先,检查模型选择器显示的是 Opus 5.5。
做什么。 附上图表、图表、截图或幻灯片。不要重新输入数字。
为什么在 Opus 5.5 上很重要。 Opus 5.5 读取图表、图表和截图比 Opus 5 更准确,而且不需要额外步骤就能做到。它也更擅长理解依赖图像中元素位置的意义:箭头连接了哪些框、图表的两个版本之间发生了什么变化,或者日历截图中会议何时开始何时结束。
怎么做。 附上图片并问一个具体的问题:"哪些服务直接调用 billing API?"
做什么。 给它一个长的计划、报告或演示稿,让它找出错误。
为什么在 Opus 5.5 上很重要。 Opus 5.5 比之前的 Opus 模型更注重细节。在我们的测试中,它发现了一个日期落在了错误的工作日(在一个长的计划讨论中),以及一张图表与文稿中的数字不匹配。
怎么做。 提交提示词:"检查这个演示稿中任何自相矛盾的内容:数字、日期和名字。引用每个问题并说明它在哪里。"
做什么。 当你想要一个电子表格或文档时,要求生成文件,而不是大纲。
为什么在 Opus 5.5 上很重要。 Opus 5.5 生成的电子表格和文档比 Opus 5 生成的在你分享之前需要更少的编辑。
怎么做。 "把这个做成一个我可以分享的电子表格:每个供应商一行,列为成本、合同结束日期和负责人"。
做什么。 如果在长对话中的后续问题感觉变慢了,添加一条指令说明较早的答案是确定的。
为什么在 Opus 5.5 上很重要。 在一个长的对话中,Opus 5.5 有时在思考一个简短的跟进问题时,会回顾较早的答案。这会拖慢回复速度。
怎么做。 将以下内容添加到项目指令中:
Once you have answered something, treat that answer as done. Focus on what I'm asking now, and don't go back over an earlier answer unless I ask about it or point out a problem with it.
在需要后续步骤揭示较早步骤错误的长时间分析中,不要加入这一条。
Opus 5.5 是第一个以 Fable 级别的生物安全和网络安全防护上线的 Opus 模型。在 Claude 应用和 Claude Code 中,大多数被标记的消息会转到较旧的模型,你的工作在那里继续。查找源代码中的安全漏洞是被允许的,日常的健康和教育问题应该仍然可以正常工作。这些防护有时会标记合法的工作,我们正在调整它们以减少错误标记。如果你被切换了,以下是你会看到什么以及该怎么做。
你看到的。 一条以"切换到"开头的通知,以及较旧模型的名称。Claude 在那个模型上回答,对话保持在该模型上。
要回到 Opus 5.5,在模型选择器中选择它。如果较早的消息仍在对话中,它可能会再次被标记。开始一个新的对话可以避免这种情况。
要被先询问,进入设置,然后是功能,关闭"当消息被标记时切换模型"。你会看到一个"暂停"卡片,上面有你的选项。
检查涵盖对话中的所有内容,包括文件和搜索结果。所以标记可能来自较早的内容,而不仅仅是你的最后一条消息。
你看到的。 一条通知,标明较旧的模型。会话来续在该模型上。
运行 /model 切换回去。
按 Esc 两次来编辑你的最后一条消息并重试。
要被先询问,运行 /config 并更改"当消息被标记时切换模型"。
如果标记是错误的,运行 /feedback。
做什么。 从你的提示词和指令中删除要求在回复中重现其内部推理的请求。
为什么在 Opus 5.5 上很重要。 在回复中重现其内部推理的请求可能会被拒绝。这是标记类别之一。
怎么做。 改为向 Claude 要求你需要的东西,例如:"用三句话解释你为什么选择这个方法"。
做什么。 在 Claude Code 中,对于来回的工作(你在发送下一条消息之前阅读每个回复),使用 fast mode。
为什么在 Opus 5.5 上很重要。 Fast mode 在上线时作为研究预览对 Opus 5.5 可用。你得到的是相同的模型,文本到达得更早。它需要额外开启使用,而且每 token 的成本比标准模式高。
怎么做。 在 Claude 中输入 /fast。
在下次做长任务之前过一遍这个清单。
FIG D 清单一览。

提问
Claude Code 中的长时间运行
检查
/model用 Opus 5.5 开始构建吧!
感谢 Molly Vorwerck 的审阅。