1 · Input- und Output-Tokens sparen

Wo die Tokens in Claude Code wirklich hingehen – Prompt Caching, Thinking-Tokens, Subagenten & wie du teure Cache-Fallen vermeidest.

2 · Wie das 5-Stunden-Limit berechnet wird

Session-, Wochen- und Opus-Limit im Zusammenspiel. Was Anthropic wirklich dokumentiert – und was reine Gerüchte sind.

3 · Das 5-Stunden-Fenster optimal nutzen

Timing, Session-Hygiene und Cache-Wärme: Mein Tagesrhythmus, bei dem dich das Limit garantiert nicht mehr ausbremst.

4 · Context clever einsparen

Was der Session-Start kostet, wie sich Datei-Reads summieren und warum CLAUDE.md vs. Skills oft den entscheidenden Unterschied macht.

5 · Best Practices für die 5er-Reihe

Opus 5, Sonnet 5, Fable 5 & Haiku 4.5: Effort-Level, Breaking Changes und Prompt-Kniffe, die alte Gewohnheiten auf den Kopf stellen.

6 · Gemessen: Was Modell und Effort kosten

171 headless Läufe über vier Modelle und zwei Effort-Stufen: Speed, Tokenvolumen und geschätzter Limit-Verbrauch pro Task.

7 · In Etappen arbeiten

Effort mitten in der Session anpassen, Tasks delegieren und nach /clear ohne Kontextverlust weiterbauen – der optimale Workflow.

Worauf ich bewusst verzichtet habe

Mir ist wichtig, dass hier nur Fakten stehen, die ich selbst testen und belegen konnte. Deshalb habe ich drei Dinge weggelassen:

Die wichtigsten Befehle

BefehlZweck
/usageKontingent, Aufschlüsselung nach Skills/Subagents/MCP; d/w für 24 h / 7 Tage
/contextWas aktuell das Kontextfenster belegt
/clearKontext zurücksetzen — kostenlos
/compact <Anweisung>Gesteuert zusammenfassen — selbst ein teurer Request
/rewind · Esc EscAuf Checkpoint zurück; trifft einen bereits warmen Cache
/btwNebenfrage, die nie in die Historie wandert
/model · /effortModell und Effort — beides invalidiert mitten in der Session den Cache
/mcpMCP-Server anzeigen und abschalten
/usage-creditsZusatzkontingent (senkt die Cache-TTL auf 5 Minuten)