运行在 Anthropic 聊天机器人背后的 Claude 系统提示词(system prompt)长达 56,148 个单词——是该公司公开发布的 4,269 字版本的 13 倍多。这一差距意味着,研究官方提示词的开发者看到的只是一个摘要,而实际运行的模型则遵循着一套详尽得多的指令。
为什么规模很重要
每个 AI 产品在处理用户查询之前都会读取“系统提示词”。该提示词会告知模型它的身份、语气风格、必须拒绝的内容以及如何格式化回答。公司通常会对这些提示词保密,因为其中包含运营细节和安全策略。Anthropic 为了提高透明度发布了 Claude 提示词的精简版,但一位研究人员通过要求模型重复其指令,提取出了一个规模大出一个数量级的版本。
隐藏规则揭示了什么
- 语气经过精心设计 —— 大量章节规定了句子长度、避免说教,并指定了特定的语调。Anthropic 在塑造语气方面的努力表明,它希望 Claude 在每次交互中都能保持一致的声音,而不仅仅是遵循功能性命令。
- 拒绝类别非常明确 —— 公开的安全政策使用的是宽泛的语言,但完整的提示词列出了 Claude 必须拒绝的具体话题,从而更清晰地展示了模型的护栏(guardrails)。
- 格式规则非常详尽 —— 提取出的提示词详细说明了回答应如何构建,从项目符号的使用到标记规范。开发者可以借鉴这些规则,使他们自己的 AI 输出更具可读性。
对开发者和研究人员的影响
该研究人员通过要求 Claude 重复其自身的指令获得了更长的提示词。模型可能会对章节进行改写、省略或重新排序,因此提取出的文本可能并非逐字逐句的副本。应将这个较长的版本视为高质量的证据,而非最终的规范说明。
后续关注点
- 社区分析 —— 文本差异对比(text-diff)工具可以突出两个版本之间的确切差异,让开发者无需“重新发明轮子”即可提取出具有操作性的规则。
结论很简单:公开的 Claude 提示词只是一个骨架,而实际运行的提示词则是一份内容充实的指南。任何基于 Claude(或任何依赖系统提示词的 AI 模型)进行构建的人,都需要透过官方文档,去理解引导模型行为的真实约束和能力。
