Deepseek ArtifactsDeepseek Artifacts
Speed-Fix-Guide

Claude Code langsam? 12 Lösungen für träge Antworten (2026)

Warum ist Claude Code so langsam? Lesen Sie die Statuszeile, schlanken Sie den Kontext mit einer kompakten CLAUDE.md und /clear ab, wechseln Sie mit /model das Modell und behalten Sie das 5-Stunden-Limit im Blick.

TL;DR

  • Die meisten „Claude Code ist langsam“-Fälle sind Kontextblähung. Die Spinner-Statuszeile zeigt den Preis jedes Durchlaufs in Sekunden und Tokens — lesen Sie sie, bevor Sie nach einem neuen Werkzeug suchen.
  • Weniger laden: mit /init eine CLAUDE.md anlegen und unter 200 Zeilen halten, zwischen Aufgaben /clear, und ein /compact mit Fokus, wenn eine Sitzung überleben muss.
  • Arbeit dem richtigen Motor zuweisen: mit /model ein schnelleres Standardmodell für Routine-Edits, mit /context sehen, was das Fenster frisst, und weniger MCP-Server pro Projekt.
  • Manche Langsamkeit ist nicht Ihre Schuld: prüfen Sie status.claude.com auf Störungen und beobachten Sie das rollierende 5-Stunden-Limit — ein Terminal-Monitor zeigt Reset-Timer und Burn Rate live.

Wait.. Claude Code is MADE Slow on Purpose? Heres How to Fix It

Kanal: AI LABS10:35

Ansehen

Why Claude Code Gets Slow and Forgetful and 4 Habits That Fix It

Kanal: Prompt to Prod11:00

Ansehen

Manage costs & usage limits — official documentation

Offizielle Doku: code.claude.com/docs

Ansehen

Jeder Befehl, jedes Limit und jeder Standard auf dieser Seite wurde gegen code.claude.com/docs und das anthropics/claude-code-Changelog geprüft; die Videos oben sind die Bild- und Faktenquellen, inklusive der Statuszeilen-Werte und des Fünf-Stunden-Fenster-Monitors. Wo Video und Doku abweichen, folgt der Guide der Doku.

Screenshots werden ihren Urhebern zugeschrieben und tiefenverlinkt auf den exakten Zeitpunkt. Keine Facecam-Frames.

Claude Code wieder schnell machen, Schritt für Schritt

Teil 1 — Sehen, wo die Zeit hingeht

  1. 1

    Einer frischen Sitzung einen echten Prompt schicken

    Starten Sie claude in Ihrem Projekt und tippen Sie eine echte Anfrage. Eine brandneue Sitzung beginnt mit nichts als der Welcome-Box, also muss Claude Ihre Dateien lesen, bevor es antworten kann — diese Entdeckungsrunde ist der Anfang der meisten „Claude Code ist langsam“-Berichte. Beobachten Sie, wie sich die Spinner-Verben im Eingabefeld ändern.

    Claude Code welcome box in a macOS terminal with tips for getting started and the first prompt Hi there, Could You Edit the Notes Component typed at the empty input
    Eine frische Sitzung: Die Tipps der Welcome-Box sind der gesamte Kontext, mit dem Claude Code startet.Ansehen bei 0:08
  2. 2

    Die Statuszeile während der Arbeit lesen

    Unter dem Diff erscheint eine Zeile wie „Unravelling… (16s · 351 tokens · esc to interrupt)“. Das Verb ist Dekoration; die Sekunden und die Token-Anzahl sind Ihr Tacho. Sie zeigen, ob Claude denkt, wartet oder sich durch Dateien wühlt. Verbrennt jeder Durchlauf hunderte Tokens vor dem ersten Edit, bremst der Kontext.

    VS Code diff of a notes app page while Claude Code shows the Unravelling status line with 16 seconds elapsed, 351 tokens spent and esc to interrupt
    Die Statuszeile ist Ihr Tacho: Verb, Sekunden, Tokens, esc to interrupt.Ansehen bei 1:08
  3. 3

    Den Diff öffnen und sehen, was ein Edit nach sich zog

    Auch ein kleines Feature muss erst gefunden werden. Der Word-Counter-Edit im Video ändert eine Datei mit neun Ergänzungen — und der Durchlauf verbraucht trotzdem 352 Tokens, bis sich der Spinner legt. In einem größeren Repo bedeutet das Verzeichnisse listen und Dateien lesen, die mit der Anfrage nichts zu tun haben — das Video nennt es „in unnötigen Informationen ertrinken“.

    Claude Code updating a notes app page with nine additions in a green VS Code diff while the Hatching spinner reports 3 seconds and 352 tokens
    Neun Ergänzungen in einer Datei — und der Spinner zählt weiter Tokens.Ansehen bei 0:22

Teil 2 — Weniger Kontext verfüttern

  1. 4

    Mit /init die CLAUDE.md anlegen

    Tippen Sie /init und wählen Sie „Initialize a new CLAUDE.md file with codebase documentation“. Das ist der dokumentierte Befehl, der Claude ein dauerhaftes Briefing über Ihr Repo gibt, damit eine frische Sitzung nicht vor jedem Edit das Projekt neu erkundet. Das größte Einzelheilmittel für die Beschwerde „es liest zuerst alles“.

    Claude Code slash-command menu opened by typing /init, highlighting Initialize a new CLAUDE.md file with codebase documentation next to compact, doctor and upgrade
    /init ist der dokumentierte Weg zur CLAUDE.md.Ansehen bei 3:38
  2. 5

    Den einmaligen Scan geschehen lassen

    Claude liest package.json, das README, den Router und mehr und schreibt dann die Datei — der Lauf im Video zeigt einen Deciphering…-Spinner nach rund 90 Tokens an Tool-Aufrufen. Diese Kosten zahlen Sie einmal. Ab der nächsten Sitzung steckt der Kontext, den Claude braucht, bereits in der CLAUDE.md statt erneut von der Platte gelesen zu werden.

    Claude Code reading package.json, README.md and router.tsx and searching for cursor rules before writing CLAUDE.md, spinner showing Deciphering after 7 seconds and 90 tokens
    Der einmalige Scan: Lesen, Suchen, dann das Schreiben.Ansehen bei 2:22
  3. 6

    CLAUDE.md schlank halten — Befehle und Architektur

    Die fertige Datei enthält Dev-Befehle, die Datenbankschicht und eine kurze Architektur-Zusammenfassung. Bleiben Sie dabei: Die offizielle Doku sagt, dass die CLAUDE.md bei jedem Sitzungsstart in den Kontext geladen wird, und empfiehlt unter 200 Zeilen. Eine aufgeblähte CLAUDE.md erschafft das Problem neu, das sie lösen soll — verlagern Sie Spezial-Workflows in Skills, die nur bei Bedarf laden.

    CLAUDE.md open in the VS Code editor listing npm run dev, build and lint commands plus a three-tier Next.js 15 notes app architecture in a short file
    Befehle und Architektur — die Datei, die bei jeder Sitzung lädt. Kurz halten.Ansehen bei 3:50
  4. 7

    Dokus per semantischer Suche holen statt den Kontext vollzustopfen

    Bei Bibliotheksfragen zeigt das Video, wie das Context7-MCP get-library-docs mit dem Topic „best practices“ aufruft und nur den relevanten Abschnitt aus Microsofts TypeScript-Repo zurückbekommt. Semantische Suche liefert nur die Teile, die zählen, statt ganze Doku-Seiten ins Fenster zu ziehen.

    Claude Code calling the Context7 get-library-docs tool with topic best practices to pull only the relevant TypeScript documentation section from Microsofts repo
    get-library-docs liefert den passenden Abschnitt, nicht das ganze Handbuch.Ansehen bei 2:48
  5. 8

    Den MCP-Server mit /mcp prüfen

    Führen Sie /mcp aus und bestätigen Sie, dass der Server „connected“ zeigt — das Video fügt den semantischen Code-Server Serena mit claude mcp add hinzu und prüft ihn hier. Zwei Einschränkungen aus Video und Doku: Ein MCP-Server gilt pro Projekt, also in jedem Repo hinzufügen, in dem Sie ihn wollen; und ein Server, der beim Start hängt, verzögert jede Sitzung in diesem Projekt.

    Claude Code Manage MCP servers screen listing serena as connected with Enter to view details and Esc to exit after adding the semantic code retrieval server
    /mcp ist der Ort, an dem sich langsame Server verstecken: serena zeigt ein grünes connected.Ansehen bei 5:31

Teil 3 — Modelle, Limits und Monitoring

  1. 9

    Für Routinearbeit das schnellere Modell wählen

    Öffnen Sie /model — oder den Picker Ihrer IDE — und passen Sie den Motor an die Aufgabe an. Die offizielle Doku empfiehlt Sonnet als günstigeren Alltagstandard und Opus für komplexes Räsonieren; simple Subagent-Aufgaben laufen auch auf Haiku. Ein schnelleres Modell heilt keinen verstopften Kontext, aber bei kleinen Edits senkt es Antwortzeit und Token-Preis zugleich.

    IDE model picker listing claude-4-sonnet, claude-3.5-sonnet, gemini-2.5-pro and gpt-4.1 above a Next.js upgrade answer, used to pick a faster model per task
    Gleicher Prompt, anderer Motor: Der Picker lebt in /model und der IDE-Toolbar.Ansehen bei 4:32
  2. 10

    Wissen, was am Limit passiert

    Anthropics Doku zieht eine klare Grenze: „You've hit your session limit“ und Wochenlimit-Meldungen sind sitzbasiert — ein Modellwechsel hilft nicht, und die Meldung zeigt die Reset-Zeit. Modell-spezifische Limits lassen sich mit /model umgehen, und seit v2.1.234 kann das /rate-limit-options-Menü eine Aufgabe nach dem Reset automatisch fortsetzen.

    Claude documentation page on usage limits showing expected usage per plan, how limits work and the heading What happens when I reach my limit
    Die offizielle Antwort auf „Was passiert, wenn ich mein Limit erreiche?“Ansehen bei 4:44
  3. 11

    Den Verbrauch mit einem Terminal-Monitor verfolgen

    Das Video empfiehlt den Open-Source Claude Code Usage Monitor (Maciek-roboblog auf GitHub, MIT-lizenziert, Installation mit uv oder pip) und hält ihn in einem zweiten Terminal-Tab offen. Er liest Claude Codes eigene Sitzungslogs, sodass der Verbrauch neben der Arbeit erscheint — kein separates Web-UI nötig.

    GitHub repository page for Maciek-roboblog Claude-Code-Usage-Monitor with Code, Issues and Pull requests tabs above the MIT-licensed file list
    Der Monitor aus dem Video: Maciek-roboblog/Claude-Code-Usage-Monitor.Ansehen bei 6:22
  4. 12

    Reset-Timer und Burn Rate beobachten

    Das TUI zeigt Balken für Kosten, Tokens und Nachrichten, einen Time-to-Reset-Countdown (im Video 2 h 52 m), die Modellverteilung und eine live Burn Rate mit Vorhersagen wie „Tokens will run out: 3:00 PM“. Mit dem 5-Stunden-Fenster im Blick ist eine plötzliche Verlangsamung kein Rätsel mehr — Sie sehen die Decke sich nähern.

    Claude Code Usage Monitor terminal TUI with progress bars for cost, token and messages usage, Time to Reset 2h 52m, Sonnet 100 percent and a 21.1 tokens per minute burn rate
    Burn Rate und Reset-Countdown, live in einem Terminal-Tab.Ansehen bei 6:50

Claude Code gegen Cursor, Codex und den letzten Monat

Wer „claude code slower than cursor“ und „than codex“ sucht, vergleicht meist verschiedene Setups, nicht verschiedene Motoren. Was wirklich unterscheidet:

  • 1Gegen Cursor — Cursor bringt eine eigene Kontext-Pipeline mit und kürzte zum Zeitpunkt des Videos das Modellfenster auf rund 120k Tokens, während Claude Code Claude die vollen 200k gibt, dafür aber mehr vom Repo hineinlädt. Keins ist „schneller“ im Allgemeinen: Das Werkzeug mit dem schlankeren Fenster fühlt sich schneller an.
  • 2Gegen Codex CLI — dieselbe Physik. Jeder Coding-Agent wird langsam, wenn der Prompt ein ganzes Repo mitschleppt; /clear, eine schlanke Kontext-Datei und fokussierte Compacts übertragen eins zu eins auf Codex. Modell-Warteschlangen und Rate-Limits unterscheiden sich nach Plan, nicht nach Terminal.
  • 3Gegen Claude Code letzten Monat („langsamer als früher“) — verdächtigen Sie zuerst Ihre eigene Sitzungslänge, nicht das Release. Lange Sitzungen überschreiten die Auto-Compact-Schwelle, und jede Kompaktion ist selbst ein großer Request; /clear und ein Zwei-Zeilen-Briefing bringen meist die alte Spritzigkeit zurück. Danach Changelog prüfen und claude --safe-mode laufen lassen, um eigene Anpassungen auszuschließen.
  • 4Gegen den claude.ai-Chat — Chat wirkt sofort, weil er Ihr Repo nicht liest. Claude Code tauscht dieses Startgewicht gegen Handlungsfähigkeit: volles Kontextfenster, lokale Tools, Edits auf der Platte. Bewerten Sie es nach Aufgabenzeit, nicht nach First-Token-Zeit.
  • 5Das ehrliche Fazit — die rohe Modell-Latenz ist bei den Top-Agenten ähnlich. Die Unterschiede, die Sie spüren, sind Kontextgröße, MCP-Start und Rate-Limit-Warteschlangen — alle drei messbar, alle drei auf dieser Seite behebbar.

Wenn Sie wegen der Geschwindigkeit das Werkzeug gewechselt haben: Laufen Sie dieselbe Aufgabe zweimal — einmal mit /context-Lektüre vor jedem Durchlauf — und vergleichen Sie die Token-Zahlen. Die meisten „dieses Werkzeug ist schneller“-Geschichten sind in Wahrheit „diese Sitzung war kleiner“.

Immer noch langsam? Die Checkliste abarbeiten

Langsamkeit hat eine Handvoll klarer Ursachen, jede mit einem Erkennungszeichen. Wenn die Schritte oben Ihre Trägheit nicht erklärt haben, arbeiten Sie diese Liste durch:

  • 1Heute dreht sich überall alles → zuerst status.claude.com prüfen. Provider-Störungen zeigen sich als lange Wartezeiten und Wiederholungen überall gleichzeitig; lokal ist nichts zu machen, und die Token-Zahl in der Statuszeile bleibt verdächtig niedrig, während die Sekunden steigen.
  • 2Ein Fehler wie „Invalid API key · Please run /login“ → das ist Authentifizierung, keine Geschwindigkeit, aber es blockiert Sitzungen genauso. Mit /login neu authentifizieren; bei hartnäckigen Fällen empfehlen die Doku /logout, Claude Code schließen und neu starten. Prüfen Sie auch eine herumliegende ANTHROPIC_API_KEY — sie überschreibt Ihren Subscription-Login.
  • 3Erst nach einer Stunde Arbeit langsam → das Kontextfenster ist voll. Auto-Compact fasst ältere Historie nahe der Schwelle zusammen, und jede Kompaktion ist selbst ein großer Request. Ein /compact mit Fokus (zum Beispiel: nur Plan und Diff behalten) oder /clear und ein Zwei-Zeilen-Briefing.
  • 4Hängt bei connecting oder MCP-Start → /mcp ausführen und den Server suchen, der festhängt; aus dem Projekt entfernen. Am Start wurde zuletzt viel repariert — v2.1.292 merkt sich langsame stdio-Server für 7 Tage und lässt Headless-Erstanfragen nicht mehr auf HTTP-Server warten.
  • 5Minutenlange Pausen, die von selbst weiterlaufen → Sie stoßen an das Nutzungslimit. Sitzungslimit-Meldungen zeigen die Reset-Zeit; gegen ein sitzbasiertes Limit hilft kein Modellwechsel, aber /rate-limit-options (v2.1.234+) setzt die Aufgabe nach dem Reset fort, und /model hilft nur bei modell-spezifischen Limits.
  • 6Das Terminal selbst ruckelt — langsames Scrollen, Geistertext, verzögerte Eingabe → das ist Rendering, keine Inferenz. claude --safe-mode deaktiviert für eine Sitzung Hooks und Statusline-Skripte; verschwindet das Ruckeln, kürzen Sie Ihr Statusline-Skript oder Ihre Hooks. Dieselbe Sitzung zusätzlich in VS-Code-Panel und Terminal testen — so grenzen Sie es weiter ein.

Noch eins aus der Doku: Überschreitet eine Sitzung 2,5 GB Speicher, starten Sie sie neu — claude --continue setzt das Gespräch in einem frischen Prozess fort, meist schneller als der, den Sie verlassen haben.

FAQ

Verwandte Claude-Code-Guides