Anthropicのチャットボットの背後で動作しているClaudeのシステムプロンプトは56,148語に及び、同社が公開している4,269語のバージョンよりも13倍以上長くなっています。この差は、公式プロンプトを研究している開発者が目にしているのは要約に過ぎず、実際のモデルははるかに詳細な指示セットに従っていることを意味します。
なぜサイズが重要なのか
すべてのAI製品は、ユーザーのクエリを処理する前に「システムプロンプト」を読み込みます。プロンプトは、モデルに対して、自身が何者であるか、どのような口調であるべきか、何を拒否すべきか、そして回答をどのようにフォーマットすべきかを伝えます。これらのプロンプトには運用の詳細や安全ポリシーが含まれているため、企業は通常、これらを非公開にしています。Anthropicは透明性のためにClaudeのプロンプトの簡略版を公開しましたが、モデルに自身の指示を繰り返すよう求めたある研究者が、桁違いに大きなバージョンを抽出しました。
隠されたルールが明らかにするもの
- トーンは設計されている – 膨大なセクションが文章の長さ、説教臭さを避けること、そして特定の語り口を規定しています。トーンを形成しようとするAnthropicの取り組みは、単に機能的なコマンドに従うだけでなく、あらゆるやり取りにおいてClaudeの響きを一定に保ちたいという意図を示しています。
- 拒否カテゴリが明示されている – 公開されている安全ポリシーは広範な言葉を使っていますが、完全なプロンプトにはClaudeが拒否しなければならない正確なトピックがリストアップされており、モデルのガードレールをより明確に示しています。
- フォーマット規則が詳細である – 抽出されたプロンプトには、箇条書きの使用法からマークアップの慣習に至るまで、回答をどのように構成すべきかが詳しく記されています。開発者はこれらのルールを模倣することで、自身のAI出力の可読性を高めることができます。
開発者と研究者にとっての重要性
その研究者は、Claudeに自身の指示を繰り返すよう求めることで、より長いプロンプトを入手しました。モデルはセクションを言い換えたり、省略したり、順序を入れ替えたりすることがあるため、抽出されたテキストは逐語的なコピーではない可能性があります。長い方のバージョンは、決定的な仕様書としてではなく、質の高い証拠として扱うべきです。
次に注目すべきこと
- コミュニティによる分析 – テキストの差分比較(diff)ツールを使用すれば、2つのバージョンの正確な違いを浮き彫りにでき、開発者は一から作り直すことなく、実用的なルールを抽出できます。
結論はシンプルです。公開されているClaudeのプロンプトは骨組みに過ぎず、実際のプロンプトは肉付けされた完全なガイドなのです。Claude、あるいはシステムプロンプトに依存するあらゆるAIモデルを活用して構築を行う者は、モデルの挙動を規定する真の制約と能力を理解するために、公式ドキュメントの先を見る必要があります。
