Narzędzia MCP zwiększają, a nie zmniejszają Twój rachunek za tokeny wejściowe w Claude Code; każdy prompt wysłany za pomocą narzędzia czyszczącego ostatecznie kosztuje więcej tokenów, a zatem więcej pieniędzy. Deweloperzy dążący do obniżenia kosztów API często sięgają po czyściki oparte na MCP, zakładając, że zmniejszą one prompt, zanim zobaczy go model.
Dlaczego licznik tokenów ma znaczenie
Claude Code liczy tokeny w momencie, gdy Twój tekst trafia do okna kontekstowego modelu. Model zaczyna czytać surowy prompt, a następnie decyduje, czy wywołać narzędzie MCP. Narzędzie czyszczące uruchamia się po tym, jak oryginalny tekst stanie się już częścią konwersacji, więc licznik zdążył już zarejestrować te tokeny.
Typowy przepływ wygląda następująco:
- Twój surowy prompt zostaje przesłany – licznik tokenów idzie w górę.
- Model czyta prompt i decyduje się wywołać narzędzie czyszczące.
- Narzędzie zwraca skróconą wersję.
- Kontekst zawiera teraz trzy elementy: oryginalny prompt, metadane wywołania narzędzia oraz oczyszczony prompt.
Płacisz za wszystkie trzy wpisy. Wersja „czysta” nie zastępuje oryginału; ona jedynie współistnieje obok niego.
Kiedy czyszczenie przez MCP faktycznie pomaga
Narzędzie MCP oszczędza tokeny tylko wtedy, gdy surowy tekst nigdy nie trafia do głównego kontekstu Claude Code. Dzieje się tak w przypadku wywołań typu downstream, takich jak:
- Zapytania typu Retrieval-augmented generation (RAG), które model przekazuje do silnika wyszukiwania lub bazy danych.
- Instrukcje wysyłane do subagentów, którzy działają niezależnie od głównej konwersacji.
W takich przypadkach model przekazuje oczyszczony payload bezpośrednio do systemu zewnętrznego, nie wliczając oryginalnego tekstu użytkownika do głównego licznika tokenów.
Jak faktycznie zmniejszyć liczbę tokenów wejściowych
Jeśli chcesz zmniejszyć liczbę tokenów przekazywanych do Claude Code, oczyść tekst zanim trafi on do modelu. Oto trzy praktyczne podejścia, które działają obecnie:
- Skróty klawiszowe na poziomie systemu – Na Windows użyj skryptu AutoHotkey; na macOS użyj Automator. Skrypt wybiera tekst, który zamierzasz wysłać, przekazuje go do zewnętrznego API zwracającego oczyszczoną wersję, a następnie zastępuje tekst w edytorze. Ponieważ surowa wersja nigdy nie opuszcza Twojego urządzenia, przesyłana jest wyłącznie wersja oczyszczona.
- Przekazywanie potokowe CLI – Uruchom Claude Code z terminala i wstępnie przetwórz prompt za pomocą filtra bash (np. skryptu
sedlub Python), który usunie zbędne białe znaki, komentarze lub powtarzające się frazy. Do modelu trafia przefiltrowany wynik. - MCP wyłącznie do wywołań typu downstream – Zarezerwuj narzędzia MCP dla kroków RAG lub subagentów opisanych wcześniej. Pozwól modelowi obsłużyć początkowy prompt użytkownika bezpośrednio, a narzędziu czyszczącemu pozwól działać tylko na payload, który opuszcza główną konwersację.
Typowe pułapki, których należy unikać
- Zakładanie, że narzędzia MCP skracają oryginalny prompt – Dodają one blok tokenów wywołania narzędzia i zachowują surowy tekst, co zwiększa całkowitą liczbę.
- Poleganie na hookach Claude Code – Hooki mogą wstrzykiwać dodatkowy kontekst lub blokować prompty, ale nie mogą nadpisać tekstu, który jest już w konwersacji.
- Używanie komend ukośnikowych (slash commands) z czyszczeniem wewnątrz linii – Nawet jeśli komenda uruchamia skrypt czyszczący, surowe argumenty pozostają częścią linii komend, którą model rejestruje, więc również za nie płacisz.
Licznik tokenów startuje w momencie, gdy Twoje znaki trafią do punktu końcowego (endpoint) API modelu. Wszystko, co czyści tekst po tym punkcie, jedynie generuje dodatkowy narzut.
Co to oznacza dla deweloperów
Koszty tokenów pojawiają się jako osobna pozycja na większości rachunków za usługi AI. Nadpłacanie z powodu „czyścika”, który dodaje ukryte tokeny, może szybko zniwelować wszelkie oszczędności, na które liczyłeś. Przenieś krok czyszczenia na stronę klienta, aby zachować rzetelny licznik tokenów i przewidywalny budżet.
Podsumowanie: Narzędzia MCP są przydatne dla payloadów typu downstream, ale nie mogą skrócić liczby tokenów w wpisywanym przez Ciebie prompcie. Czyść przed wysłaniem lub ogranicz czyszczenie do wywołań, które nigdy nie pojawiają się w głównym kontekście, jeśli chcesz uzyskać rzeczywistą redukcję kosztów tokenów w Claude Code.
