Anthropic의 챗봇 뒤에서 실행되는 Claude의 시스템 프롬프트는 56,148단어에 달하며, 이는 회사가 공개적으로 게시한 4,269단어 버전보다 13배 이상 깁니다. 이 격차는 공식 프롬프트를 연구하는 개발자들이 요약본만을 보게 되는 반면, 실제 모델은 훨씬 더 상세한 지침 세트를 따른다는 것을 의미합니다.
크기가 중요한 이유
모든 AI 제품은 사용자의 질문을 처리하기 전에 "시스템 프롬프트"를 읽습니다. 프롬프트는 모델에게 자신이 누구인지, 어떤 말투를 사용해야 하는지, 무엇을 거부해야 하는지, 그리고 답변 형식을 어떻게 구성해야 하는지를 알려줍니다. 기업들은 운영 세부 사항과 안전 정책이 포함되어 있기 때문에 보통 이러한 프롬프트를 비공개로 유지합니다. Anthropic은 투명성을 위해 Claude 프롬프트의 축소된 버전을 공개했지만, 모델에게 지침을 반복하라고 요청한 한 연구자가 실제로는 그보다 훨씬 더 큰 규모의 버전을 추출해 냈습니다.
숨겨진 규칙이 드러내는 것들
- 톤(Tone)이 설계됨 – 방대한 섹션이 문장 길이를 규정하고, 도덕적 훈계를 지양하며, 특정한 목소리를 지정합니다. 톤을 형성하려는 Anthropic의 노력은 Claude가 단순히 기능적인 명령을 따르는 것을 넘어, 모든 상호작용에서 일관된 말투를 유지하기를 원한다는 것을 보여줍니다.
- 거부 카테고리가 명시적임 – 공개된 안전 정책은 포괄적인 언어를 사용하지만, 전체 프롬프트에는 Claude가 거부해야 하는 정확한 주제들이 나열되어 있어 모델의 가드레일(guardrails)을 더 명확하게 보여줍니다.
- 형식 규칙이 상세함 – 추출된 프롬프트는 불렛 포인트 사용부터 마크업 컨벤션에 이르기까지 답변이 어떻게 구조화되어야 하는지를 상세히 설명합니다. 개발자들은 이러한 규칙을 복제하여 자신만의 AI 출력물을 더 읽기 쉽게 만들 수 있습니다.
개발자와 연구자에게 미치는 영향
해당 연구자는 Claude에게 자신의 지침을 반복하라고 요청함으로써 더 긴 프롬프트를 얻어냈습니다. 모델은 섹션을 의역하거나 생략 또는 재배열할 수 있으므로, 추출된 텍스트가 토씨 하나 틀리지 않은 원문은 아닐 수 있습니다. 따라서 더 긴 버전을 확정적인 사양(specification)이 아닌, 고품질의 증거로 취급해야 합니다.
향후 주목할 점
- 커뮤니티 분석 – 텍스트 비교(text-diff) 도구를 사용하면 두 버전 사이의 정확한 차이점을 강조할 수 있으며, 개발자들은 처음부터 다시 연구할 필요 없이 즉시 적용 가능한 규칙을 추출할 수 있습니다.
결론은 간단합니다. 공개된 Claude 프롬프트는 뼈대일 뿐이며, 실제 작동하는 프롬프트는 살이 붙은 완전한 가이드입니다. Claude를 기반으로 구축하거나 시스템 프롬프트에 의존하는 모든 AI 모델을 다루는 사람들은 모델의 행동을 안내하는 진정한 제약 조건과 역량을 이해하기 위해 공식 문서 그 이상을 살펴봐야 합니다.
