Anthropic 将原本封闭的 Claude 系统提示词改为公开的版本化变更记录,开发者可追踪每次编辑的时间和内容。
大家通常把模型的 system prompt 当成一个上锁的黑盒,只能通过泄露的越狱指令和论坛截图来逆向推断。Anthropic 这次直接把 Claude 的 system prompt 公开了——以持续更新的变更日志的形式。
Claude system prompts 页面现在列出了驱动 Claude 底层运行的指令,以版本化的发布说明呈现。每次 Anthropic 修改那段控制语气、拒答行为、输出格式或工具调用的文本时,页面都会即时显示,标注日期,而不是等上几周、等到有人在 X 上发一张截图说「Claude 性格变了」才知道。
这对于在 Claude 之上构建产品而非单纯聊天的人来说,意义最为重大。如果你通过 API 让 Claude 运行在一个产品、Agent 或客服工具里,那么从 system prompt 诞生那天起,你就在不停地调试各种幽灵回归:Claude 突然拒绝一件原本能做的事,或者用另一种格式回答,而你根本没法确认这是你的 prompt 出了问题、模型更新了,还是 Anthropic 那边静默改了 system prompt。Prompt 工程师和评估团队实际上一直在对一个移动靶做取证分析。
真正的变化在于可_diff_性。System prompt 是原始模型与用户实际体验到的「Claude」之间的那层,它在你的 prompt 运行之前就设定了默认行为。如果这层没有文档记录,每一个行为变化看起来都和模型回归一模一样,团队会花上几个小时排查自己的代码,才怀疑到 Anthropic 那边。变更日志把这种死胡同式的调试变成了一次查表。你看到日期,看到修改内容,就能把它和你评估开始失败、或你的 Agent 行为开始异常的那个精确时刻对应起来。这就是「猜测」与「读 diff」之间的差别。
这也为整个领域设定了一个低调的期待。如果 Claude 公开了其他人视作专有资产的那层,那么接下来最自然的问题就是:OpenAI 和 Google 会跟进,还是 Anthropic 把这当作一个差异点,专门吸引那些受够了在黑暗中调试的开发者。
如果你在 Claude Code 上构建 Agent,想看看 prompt 层的变化实际上如何在日常输出中浮现,建议在下次评估周期之前读一读每日运行的 field notes。想每天在收件箱里收到一条 AI 信号,可以订阅 vinpatel.com/subscribe/。