Claude Session Limit vermeiden
Inhalt
Was sind die Limits? Zu unterscheiden sind das
- Nutzungslimit und das
- Kontextfenster
Nutzungslimit Alles was man macht resettet sich nach 5h, bzw. nach dem Wochenlimit. Alle Oberflächen zahlen auf das Limit ein. Unterschiedliche Faktoren sind hier relevant. Das Kontextfenster sind die eingegebenen Token z.B. im Chatfenster.
Model
Wähle immer das Model, das zur Aufgabe passt.
- Haiku: einfachere Sachen - Zusammenfassungen, Excerpting, Übersetzungen etc.
- Sonnet: Allrounder - Blogartikel, Code debuggen
- Opus: Architektur-Entscheidungen, Analysen, Genauigkeit
Aufwand
Downsizing bei Bedarf reduziert den Token-Use mit ‘/effort’.
Kontext kleinhalten
Systemprompt klein halten. Man kann diese in Claude Code mit /context ausgeben, dort zeigt Claude die Verwendung respektive die Aufteilung.
Komprimieren
Wenn der Kontext zu groß wird, dann verschlingt Claude Code übermäßig viele Token. Claude Code kann hier mit dem Befehl /compact zur Komprimierung aufgefordert werden. Dies wird sinnvollerweise proaktiv ausgelöst und nicht auf Claude selbst gewartet. Unterstützend hier hilft ein Prompt, z.B.
“Schreibe eine kurze Zusammenfassung aller offener Todos (Bugs, fehlgeschlagene Tests etc.)”
Das Ergebnis in ein neues Fenster, neuen Chat kopieren und weitermachen.
Löschen
/clear killt den Chat. Also aufpassen.
Sub-Agents
Claude anweisen Arbeitspakete auf Sub-Agents auszulagern. Dies erzeugt “kontext-reduzierte” Mini-Claudes, die den Balast des Haupt-Agents nicht mitschleifen.
Custom Sub-Agent
z.B. Prompt:
Leg einen Custom Sub Agent für Code Reviews an. Dieser soll Sonnet nutzen
Plan-Mode
Mit STRG + TAB umschaltbar. In diesem Modus darf Claude nur lesen und recherchieren aber nichts ändern. Dies vermeidet “unfreiwillige” Änderungen am Code. Daraus geniert Claude einen Plan den man sich anschauen und korrigieren kann.
Opus macht die besseren Pläne.
CLAUDE.md schlank halten
Auslesen mit /memory. Hier muss nur das rein, was immer gilt.
Skils
Arbeitsabläufe und Prozesse.
Auslesen mit /skills
Prompt-Cache
Jedes Modell hat seinen eigenen Cache. Diese werden nicht geteilt zwischen Haiku, Sonnet und Opus. Daher nicht “sinnlos” durch die Modelle springen.
Lebensdauer
Cache-Timer ist bei ca. 1h. Längere Inaktivität killt den Cache. Pausen daher nach Abschluss größerer Aufgaben.
Hooks
Ein Hook wird einmalig erstellt und kann dann immer wieder genutzt werden ohne Tokenverbrauch.
Claude bitten einen Hook einzurichten um wiederkehrende Aufgaben zu erledigen: in settings.json
Beispiel: “Formatiere den Code nach dem Speichern und vor dem Commit”