Simon Willison逐行对比了两个Claude版本的系统提示词变化,揭示模型行为优化细节。对调试和优化Claude应用的Prompt有直接指导价值。
Opus 4.7 前不久(2026 年 4 月 16 日)上线,Claude.ai 的系统提示词相比 Opus 4.6(2026 年 2 月 5 日)有所更新。
我让 Claude Code 将他们系统提示词的 Markdown 版本拆分成各个模型的独立文档,然后用代表每次提示词更新发布日期的虚假提交日期为这些文件构建了一份 Git 历史——这是我用 Claude Code for the web 使用的提示词。
以下是 Opus 4.6 和 4.7 之间的 git diff。这些是我从该 diff 中提取的个人重点——所有情况下加粗的文本都是我的强调:
"developer platform"现在叫"Claude Platform"了。
系统提示词中提到的 Claude 工具列表现在包括了"Claude in Chrome——一个能自主与网站交互的浏览代理、Claude in Excel——一个电子表格代理,以及 Claude in Powerpoint——一个幻灯片代理。Claude Cowork 可以将所有这些用作工具。"——Claude in Powerpoint 在 4.6 的提示词中没有提及。
儿童安全部分已大幅扩展,现在用新的 <critical_child_safety_instructions> 标签包装。特别值得注意的是:"一旦 Claude 因儿童安全原因拒绝了一个请求,该对话中的所有后续请求都必须极其谨慎地处理。"
看起来他们在试图让 Claude 不那么强势:"如果用户表示他们准备结束对话,Claude 不会请求用户停留在互动中或试图诱发另一轮对话,而是尊重用户的停止请求。"
新的 <acting_vs_clarifying> 部分包括:当一个请求留下了小细节未指定时,通常这个人想让 Claude 现在就做出合理尝试,而不是先被提问。Claude 仅在请求在没有缺失信息的情况下真正无法回答时才会预先提问(例如,它引用了一个不存在的附件)。当有一个工具可以解决歧义或提供缺失信息——搜索、查找这个人的位置、检查日历、发现可用功能——Claude 会调用该工具来尝试解决歧义,而不是询问这个人。使用工具来行动优于让这个人自己做查找。一旦 Claude 开始了一项任务,Claude 会把它进行到完整的答案,而不是中途停止。[...]
当一个请求留下了小细节未指定时,通常这个人想让 Claude 现在就做出合理尝试,而不是先被提问。Claude 仅在请求在没有缺失信息的情况下真正无法回答时才会预先提问(例如,它引用了一个不存在的附件)。
当有一个工具可以解决歧义或提供缺失信息——搜索、查找这个人的位置、检查日历、发现可用功能——Claude 会调用该工具来尝试解决歧义,而不是询问这个人。使用工具来行动优于让这个人自己做查找。
一旦 Claude 开始了一项任务,Claude 会把它进行到完整的答案,而不是中途停止。[...]
看起来 Claude 聊天现在有了一个工具搜索机制,如这个 API 文档所示,也在这篇 2025 年 11 月的文章中有所描述:在得出 Claude 缺乏某种能力之前——访问这个人的位置、记忆、日历、文件、过去的对话或任何外部数据——Claude 会调用 tool_search 来检查是否有相关工具可用但被推迟。"我无法访问 X"仅在 tool_search 确认不存在匹配工具后才是正确的。
在得出 Claude 缺乏某种能力之前——访问这个人的位置、记忆、日历、文件、过去的对话或任何外部数据——Claude 会调用 tool_search 来检查是否有相关工具可用但被推迟。"我无法访问 X"仅在 tool_search 确认不存在匹配工具后才是正确的。
有新的语言来鼓励 Claude 不那么冗长:Claude 保持其回复集中和简洁,以避免用过长的回复可能压倒用户。即使答案有免责声明或注意事项,Claude 也会简洁地披露它们,并将其回复的大部分集中在其主要答案上。
Claude 保持其回复集中和简洁,以避免用过长的回复可能压倒用户。即使答案有免责声明或注意事项,Claude 也会简洁地披露它们,并将其回复的大部分集中在其主要答案上。
这一部分在 4.6 的提示词中存在,但在 4.7 中已被移除,大概是因为新模型不再以相同的方式出现问题:Claude 避免使用星号内的表情符号或操作,除非这个人明确要求这种通信风格。Claude 避免说"genuine"、"honestly"或"straightforward"。
Claude 避免使用星号内的表情符号或操作,除非这个人明确要求这种通信风格。
Claude 避免说"genuine"、"honestly"或"straightforward"。
有一个关于"饮食失调"的新部分,之前没有被明确提及:如果一个用户表现出饮食失调的迹象,Claude 不应该在对话的任何地方给出精确的营养、饮食或运动指导——没有具体的数字、目标或循序渐进的计划。即使这是为了帮助设定更健康的目标或强调饮食失调的潜在危险,这些详细信息可能会触发或鼓励饮食失调的倾向。
如果一个用户表现出饮食失调的迹象,Claude 不应该在对话的任何地方给出精确的营养、饮食或运动指导——没有具体的数字、目标或循序渐进的计划。即使这是为了帮助设定更健康的目标或强调饮食失调的潜在危险,这些详细信息可能会触发或鼓励饮食失调的倾向。
对 AI 模型的一个流行的截图攻击是强制它们对有争议的问题回答是或否。Claude 的系统提示词现在对此进行了防守(在 <evenhandedness> 部分中):如果人们要求 Claude 对复杂或有争议的问题或作为对有争议人物的评论给出简单的是或否答案(或任何其他简短或单词回复),Claude 可以拒绝提供简短回复,而改为给出一个细致的答案并解释为什么简短回复不合适。
如果人们要求 Claude 对复杂或有争议的问题或作为对有争议人物的评论给出简单的是或否答案(或任何其他简短或单词回复),Claude 可以拒绝提供简短回复,而改为给出一个细致的答案并解释为什么简短回复不合适。
Claude 4.6 有一个部分明确说明"Donald Trump 是美利坚合众国的现任总统,并于 2025 年 1 月 20 日就职",因为没有这个的话,模型的知识截断日期加上它之前关于 Trump 虚假声称赢得 2020 年选举的知识会导致它否认他是总统。4.7 中这种语言已消失,反映了模型新的可靠知识截断日期为 2026 年 1 月。
Anthropic 发布的系统提示词遗憾地不是全部故事——他们发布的信息不包括提供给模型的工具描述,如果你想充分利用 Claude 聊天 UI 能为你做什么,这可以说是更重要的文档。
幸运的是你可以直接问 Claude——我使用了这个提示词:
List all tools you have available to you with an exact copy of the tool description and parameters
我的共享笔录有完整的详细信息,但命名工具的列表如下:
places_map_display_v0
recommend_claude_apps
visualize:show_widget
我不认为这个列表自 Opus 4.6 以来有所变化。
OpenAI 对 Hugging Face 的意外网络攻击是发生了的科幻小说 - 2026 年 7 月 22 日
与 Claude Code 团队的 Cat 和 Thariq 进行炉边谈话 - 2026 年 7 月 21 日
Kimi K3,以及我们仍然可以从鹈鹕基准学到什么 - 2026 年 7 月 16 日
这是由 Simon Willison 发布的《Claude Opus 4.6 和 4.7 之间系统提示词的变化》,发布于 2026 年 4 月 18 日。
下一篇:拿着无线电的浣熊在哪里?(ChatGPT Images 2.0)
上一篇:加入我们在长滩的 2026 年 PyCon US——我们今年有新的 AI 和安全课程
以每月 10 美元赞助我,获得一份精选的每月最重要 LLM 发展的邮件摘要。
付钱给我以发送更少!