Guide · Tokens & Kosten
Token-Verbrauch um 58 % reduziert
Der Skill, der Claude beibringt, sparsamer zu arbeiten.
- 58%
- Weniger Token-Verbrauch
- 2x
- Mehr Nachrichten pro Tag
TRICKS 1-4
Kontext-Hygiene
Die wichtigsten Grundlagen für weniger Token-Verbrauch
/clear nach jeder Aufgabe
Jede Nachricht in einem langen Chat kostet exponentiell mehr. Nachricht 30 kostet 31x so viel wie Nachricht 1. Neuer Task = neuer Chat. Immer.
Plan Mode vor größeren Aufgaben
Wenn Claude in die falsche Richtung coded und du alles verwerfen musst, sind das verbrannte Tokens. Mit /plan analysiert Claude erst die Aufgabe.
CLAUDE.md unter 200 Zeilen
Die Datei wird bei jeder Nachricht komplett neu gelesen. Halte sie kurz und nutze sie als Index der auf andere Dateien verweist.
MCPs disconnecten
Jeder verbundene MCP-Server frisst tausende Tokens pro Nachricht — selbst wenn du ihn nicht benutzt. Disconnecte alles was du gerade nicht brauchst. Unsichtbarer Token-Killer Ein MCP-Server kann bis zu 18.000 Tokens pro Nachricht kosten — selbst wenn du ihn in dieser Session gar nicht benutzt.
TRICKS 5-7
Token-Verbrauch optimieren
Versteckte Kosten sichtbar machen und eliminieren
/compact bei 60%
Das fasst deinen bisherigen Chat zusammen und gibt dir wieder Platz. Warte nicht bis Claude es automatisch macht — bei 95% ist der Kontext schon degraded.
.claudeignore anlegen
Claude liest dann keine Build-Artefakte, Lock-Files oder node_modules mehr. Erstelle eine .claudeignore im Projekt-Root. Funktioniert wie .gitignore.
Thinking-Budget runtersetzen
Claude reserviert standardmäßig 31.999 Tokens fürs Nachdenken. Bei einfachen Aufgaben übertrieben. Setze MAX_THINKING_TOKENS auf 10.000 — spart ~70% an versteckten Kosten. Toggle mit Option+T (Mac) im Chat. Allein Trick 7 spart ~70% der versteckten Kosten. Die meisten wissen nicht mal, dass Claude standardmäßig 32.000 Tokens nur fürs Nachdenken reserviert — bei jeder einzelnen Nachricht.
TRICKS 8-10
Die letzten Prozente
Fortgeschrittene Optimierungen für Poweruser
Sub-Agent Modell auf Sonnet
Wenn dein Hauptmodell Opus ist, laufen Sub-Agents auch auf Opus. Für Suche und Zusammenfassungen reicht Sonnet locker und spart deutlich.
5-Minuten-Cache beachten
Claude cached deinen Kontext, aber der Cache läuft nach 5 Minuten ab. Vor jeder Pause /compact — sonst wird alles von Null neu verarbeitet.
10 /context regelmäßig checken
So siehst du wieviel Kontext verbraucht ist und wann du compacten oder clearen solltest.
Alle
Tricks im
Überblick # Trick Was es spart Schwierigkeit
/clear nach jeder Aufgabe
Token-Explosion stoppen Einfach
Plan Mode nutzen
Verbrannte Tokens Einfach
CLAUDE.md kürzen
Tokens pro Nachricht Einfach
MCPs disconnecten
Bis zu 18.000/Nachricht Einfach
/compact bei 60%
Kontext-Degradierung Einfach
.claudeignore anlegen
Index-Tokens Mittel
Thinking-Budget senken
~70% versteckte Kosten Mittel
Sub-Agents auf Sonnet
Opus-Tokens für Tasks Mittel
Cache-Timing beachten
Doppelte Verarbeitung Einfach
10 /context checken
Bewusstsein schaffen Einfach
BEST PRACTICES
Die richtige Reihenfolge
So setzt du alle
Tricks zusammen ein
Vor jeder Session
Checke mit /context deinen aktuellen Verbrauch. Disconnecte MCPs die du nicht brauchst. Stelle sicher dass dein Thinking-Budget angemessen ist.
Bei jeder neuen Aufgabe
/clear → neuer Chat. Kurzer, präziser Prompt. Bei komplexen Tasks erst /plan nutzen bevor Claude loscoded.
Während der Arbeit
Bei 60% Kontext: /compact. Vor jeder Pause länger als 5 Minuten: /compact. Regelmäßig /context checken.
Einmal einrichten
.claudeignore im Projekt-Root anlegen. CLAUDE.md unter 200 Zeilen halten. In settings.json: MAX_THINKING_TOKENS und SUBAGENT_MODEL konfigurieren. Die wichtigste Erkenntnis: Wenn du ständig ins Limit läufst, brauchst du nicht immer mehr Claude. Du brauchst besseren Kontext. Diese 10 Tricks geben dir genau das.
SKILL INSTALLIEREN
Caveman in einer Zeile installieren
Kopiere diesen Befehl in dein Terminal
Befehl kopieren und ausführen
Kopiere den Befehl unten in dein Terminal. Der Skill wird automatisch installiert — kein Setup nötig.
Skill aktivieren
Danach /caveman in Claude Code eingeben — fertig. Der Skill übernimmt die Token-Optimierung automatisch.
Skill deaktivieren
Zum Deaktivieren: 'stop caveman' oder 'normal mode'. Jederzeit zwischen aktiviert und deaktiviert wechseln. npx skills add JuliusBrussee/caveman Dein 5-Minuten Aktionsplan 1. settings.json: MAX_THINKING_TOKENS auf 10000, SUBAGENT_MODEL auf sonnet 2. .claudeignore erstellen: node_modules/, dist/, *.lock, .next/ 3. CLAUDE.md auf maximal 200 Zeilen kürzen 4. Ungenutzte MCPs disconnecten 5. /clear bei neuem Task · /compact bei 60% · /context checken Du willst mehr KI-Tools und Strategien die dir einen unfairen Vorteil geben? Folge @tim_huck_ auf Instagram für tägliche Claude-Tipps, Automatisierungen und KI-Workflows die dein Business auf das nächste Level bringen. → @tim_huck_ auf Instagram · → www.shortmedia.agency