De system prompt van Claude die achter de chatbot van Anthropic draait, is 56.148 woorden lang — meer dan 13 keer de versie van 4.269 woorden die het bedrijf openbaar heeft gedeeld. Dit gat betekent dat ontwikkelaars die de officiële prompt bestuderen slechts een samenvatting zien, terwijl het live model een veel gedetailleerdere set instructies volgt.

Waarom de omvang ertoe doet

Elk AI-product leest een "system prompt" voordat het een gebruikersvraag verwerkt. De prompt vertelt het model wie het is, hoe het moet klinken, wat het moet weigeren en hoe het zijn antwoorden moet formatteren. Bedrijven houden deze prompts meestal privé omdat ze operationele details en veiligheidsbeleid bevatten. Anthropic heeft een ingekorte versie van Claude's prompt uitgebracht voor de transparantie, maar een onderzoeker die het model vroeg zijn instructies te herhalen, extraheerde een versie die een factor tien groter is.

Wat de verborgen regels onthullen

  • De toon is ontworpen – Grote secties dicteren de zinslengte, ontmoedigen moraliseren en schrijven een specifieke stem voor. De inspanning van Anthropic om de toon vorm te geven, laat zien dat ze willen dat Claude in elke interactie hetzelfde klinkt, en niet alleen functionele commando's opvolgt.
  • Weigeringscategorieën zijn expliciet – Openbare veiligheidsrichtlijnen gebruiken algemene taal, maar de volledige prompt somt exacte onderwerpen op die Claude moet weigeren, wat een duidelijker beeld geeft van de beveiligingskaders van het model.
  • Formatteringsregels zijn gedetailleerd – De onderschepte prompt legt haarfijn uit hoe antwoorden gestructureerd moeten worden, van het gebruik van opsommingstekens tot markup-conventies. Ontwikkelaars kunnen deze regels kopiëren om hun eigen AI-output leesbaarder te maken.

Belangen voor ontwikkelaars en onderzoekers

De onderzoeker verkreeg de langere prompt door Claude te vragen zijn eigen instructies te herhalen. Modellen kunnen secties parafraseren, weglaten of herschikken, dus de onderschepte tekst is mogelijk geen letterlijke kopie. Beschouw de langere versie als hoogwaardig bewijs, niet als een definitieve specificatie.

Waar je op moet letten

  • Community-analyse – Text-diff-tools kunnen de exacte verschillen tussen de twee versies markeren, waardoor ontwikkelaars bruikbare regels kunnen extraheren zonder het wiel opnieuw uit te hoeven vinden.

De conclusie is simpel: de openbare Claude-prompt is een skelet, terwijl de live prompt een volledig uitgewerkte gids is. Iedereen die bouwt op Claude — of op welk AI-model dan ook dat afhankelijk is van system prompts — moet verder kijken dan het officiële document om de werkelijke beperkingen en mogelijkheden te begrijpen die het gedrag van het model sturen.