Systemowy prompt Claude'a, który działa w tle chatbota Anthropic, ma 56 148 słów – to ponad 13 razy więcej niż 4 269-słowna wersja opublikowana przez firmę. Ta różnica oznacza, że programiści analizujący oficjalny prompt widzą jedynie podsumowanie, podczas gdy działający model stosuje znacznie bardziej szczegółowy zestaw instrukcji.
Dlaczego rozmiar ma znaczenie
Każdy produkt AI przed przetworzeniem zapytania użytkownika odczytuje „system prompt”. Prompt ten mówi modelowi, kim jest, jak powinien brzmieć, czego musi odmówić oraz jak ma formatować swoje odpowiedzi. Firmy zazwyczaj zachowują te prompty dla siebie, ponieważ zawierają one szczegóły operacyjne i polityki bezpieczeństwa. Anthropic udostępniło skróconą wersję promptu Claude'a w celu zapewnienia przejrzystości, ale badacz, który poprosił model o powtórzenie jego instrukcji, wydobył wersję o rząd wielkości większą.
Co ujawniają ukryte reguły
- Ton jest zaprojektowany – obszerne sekcje dyktują długość zdań, zniechęcają do moralizowania i narzucają konkretny sposób wypowiedzi. Działania Anthropic mające na celu ukształtowanie tonu pokazują, że firma chce, aby Claude brzmiał tak samo w każdej interakcji, a nie tylko wykonywał polecenia funkcjonalne.
- Kategorie odmów są jawne – publiczne polityki bezpieczeństwa używają ogólnego języka, ale pełny prompt wymienia dokładne tematy, których Claude musi odmówić, co daje wyraźniejszy obraz zabezpieczeń (guardrails) modelu.
- Reguły formatowania są szczegółowe – pozyskany prompt precyzyjnie określa, jak powinny być strukturyzowane odpowiedzi, od użycia wypunktowań po konwencje znaczników. Programiści mogą skopiować te reguły, aby ich własne wyniki AI były bardziej czytelne.
Stawka dla programistów i badaczy
Badacz uzyskał dłuższy prompt, prosząc Claude'a o powtórzenie własnych instrukcji. Modele mogą parafrazować, pomijać lub zmieniać kolejność sekcji, więc pozyskany tekst może nie być dosłowną kopią. Należy traktować dłuższą wersję jako wysokiej jakości dowód, a nie jako definitywną specyfikację.
Na co zwrócić uwagę w przyszłości
- Analiza społeczności – narzędzia typu text-diff mogą wskazać dokładne różnice między obiema wersjami, co pozwoli programistom wyodrębnić praktyczne reguły bez konieczności wyważania otwartych drzwi.
Wniosek jest prosty: publiczny prompt Claude'a to szkielet, podczas gdy działający prompt to w pełni rozwinięty przewodnik. Każdy, kto buduje rozwiązania w oparciu o Claude'a – lub jakikolwiek inny model AI polegający na systemowych promptach – musi wyjść poza oficjalny dokument, aby zrozumieć rzeczywiste ograniczenia i możliwości kierujące zachowaniem modelu.
