Claude Code lent ? 12 correctifs pour des réponses rapides (2026)
Pourquoi Claude Code est-il si lent ? Lisez la ligne de statut, allégez le contexte avec une CLAUDE.md sobre et /clear, changez de modèle avec /model et suivez la limite de 5 heures.
TL;DR
- La plupart des « Claude Code est lent » sont un contexte enflé. La ligne de statut affiche le prix de chaque tour en secondes et en tokens — lisez-la avant de chercher un autre outil.
- Réduisez ce qui se charge : /init pour créer une CLAUDE.md gardée sous 200 lignes, /clear entre les tâches, et un /compact ciblé quand une session doit survivre.
- Envoyez le travail au bon moteur : /model pour un modèle plus rapide sur les retouches courantes, /context pour voir qui mange la fenêtre, moins de serveurs MCP par projet.
- Une partie de la lenteur n'est pas la vôtre : vérifiez status.claude.com et surveillez la limite glissante de 5 heures — un moniteur en terminal affiche en direct le compte à rebours et le burn rate.
Wait.. Claude Code is MADE Slow on Purpose? Heres How to Fix It
Chaîne : AI LABS10:35
Why Claude Code Gets Slow and Forgetful and 4 Habits That Fix It
Chaîne : Prompt to Prod11:00
Manage costs & usage limits — official documentation
Doc officielle : code.claude.com/docs
Chaque commande, limite et valeur par défaut de cette page est vérifiée contre code.claude.com/docs et le changelog anthropics/claude-code ; les vidéos ci-dessus sont les sources visuelles et factuelles, y compris les lectures de la ligne de statut et le moniteur de la fenêtre de cinq heures. En cas de désaccord entre la vidéo et la doc, le guide suit la doc.
Les captures d'écran sont attribuées à leurs créateurs avec des liens profonds vers l'horodatage exact. Aucune image de visage n'est utilisée.
Rendre sa vitesse à Claude Code, étape par étape
Partie 1 — Voir où passe le temps
- 1
Envoyer une vraie requête à une session toute neuve
Lancez claude dans votre projet et tapez une vraie demande. Une session toute neuve ne démarre qu'avec l'encadré de bienvenue : Claude doit lire vos fichiers avant de répondre — c'est cette passe de découverte qui ouvre la plupart des « Claude Code est lent ». Regardez les verbes du spinner changer dans la zone de saisie.

Une session neuve : les astuces de l'encadré de bienvenue sont tout le contexte de départ de Claude Code.Regarder à 0:08 - 2
Lire la ligne de statut pendant qu'il travaille
Sous le diff apparaît une ligne comme « Unravelling… (16s · 351 tokens · esc to interrupt) ». Le verbe est décoratif ; les secondes et le nombre de tokens sont votre compteur. Ils disent si Claude réfléchit, attend ou fouille dans les fichiers. Si chaque tour brûle des centaines de tokens avant la première édition, c'est le contexte qui ralentit tout.

La ligne de statut est votre compteur : verbe, secondes, tokens, esc to interrupt.Regarder à 1:08 - 3
Ouvrir le diff et voir ce qu'une petite édition a traîné
Même une petite fonction doit d'abord être trouvée. L'ajout du compteur de mots dans la vidéo ne touche qu'un fichier, neuf lignes — et le tour dépense quand même 352 tokens avant que le spinner se pose. Dans un dépôt plus grand, la découverte signifie lister des répertoires et lire des fichiers sans rapport avec la demande — la vidéo parle de « se noyer dans des informations inutiles ».

Neuf ajouts dans un seul fichier — et le spinner continue de compter les tokens.Regarder à 0:22
Partie 2 — Nourrir moins de contexte
- 4
Lancer /init pour générer la CLAUDE.md
Tapez /init et choisissez « Initialize a new CLAUDE.md file with codebase documentation ». C'est la commande documentée qui donne à Claude un brief permanent sur votre dépôt, pour qu'une session neuve cesse de redécouvrir le projet avant chaque édition. Le plus grand remède à la plainte « il relit tout à chaque fois ».

/init est la façon documentée de créer la CLAUDE.md.Regarder à 3:38 - 5
Laisser se produire le scan unique
Claude lit package.json, le README, le routeur et plus encore, puis écrit le fichier — l'exécution de la vidéo montre un spinner Deciphering… après environ 90 tokens d'appels d'outils. Ce coût ne se paie qu'une fois. Dès la session suivante, le contexte dont Claude a besoin est déjà dans la CLAUDE.md au lieu d'être relu depuis le disque.

Le scan unique : lectures, recherches, puis l'écriture.Regarder à 2:22 - 6
Garder la CLAUDE.md sobre — commandes et architecture
Le fichier fini contient les commandes de dev, la couche base de données et un court résumé d'architecture. Restez-y : la doc officielle dit que la CLAUDE.md est chargée dans le contexte à chaque début de session et recommande moins de 200 lignes. Une CLAUDE.md obèse recrée le problème qu'elle est censée résoudre — déplacez les workflows spécialisés vers des skills, chargés à la demande.

Commandes et architecture — le fichier chargé à chaque session. Restez court.Regarder à 3:50 - 7
Chercher la doc par recherche sémantique au lieu de bourrer le contexte
Pour les questions de bibliothèque, la vidéo montre le MCP Context7 appeler get-library-docs avec le sujet « best practices » et ne récupérer que la section pertinente du dépôt TypeScript de Microsoft. La recherche sémantique ne renvoie que les fragments utiles au lieu de tirer des pages entières de documentation dans la fenêtre.

get-library-docs renvoie la section qui correspond, pas tout le manuel.Regarder à 2:48 - 8
Vérifier le serveur MCP avec /mcp
Lancez /mcp et confirmez que le serveur affiche « connected » — la vidéo ajoute le serveur de code sémantique Serena avec claude mcp add et le vérifie ici. Deux réserves de la vidéo et de la doc : un serveur MCP vaut par projet, ajoutez-le donc dans chaque dépôt où vous le voulez ; et un serveur qui bloque au démarrage retarde chaque session du projet.

/mcp est l'endroit où se cache un serveur lent : serena affiche un connected vert.Regarder à 5:31
Partie 3 — Modèles, limites et supervision
- 9
Confier les tâches routinières à un modèle plus rapide
Ouvrez /model — ou le sélecteur de votre IDE — et accordez le moteur à la tâche. La doc officielle recommande Sonnet comme standard quotidien moins cher et Opus pour le raisonnement complexe ; les tâches simples de sous-agents peuvent tourner sur Haiku. Un modèle plus rapide ne répare pas un contexte encombré, mais sur les petites éditions il réduit à la fois le temps de réponse et le coût par token.

Même prompt, autre moteur : le sélecteur vit dans /model et la barre d'outils de l'IDE.Regarder à 4:32 - 10
Savoir ce qui se passe à la limite
La doc d'Anthropic trace une ligne claire : « You've hit your session limit » et les messages de limite hebdomadaire sont liés au siège — changer de modèle n'aide pas, et le message affiche l'heure de réinitialisation. Les limites propres à un modèle se contournent avec /model, et depuis la v2.1.234 le menu /rate-limit-options peut reprendre une tâche après réinitialisation.

La réponse officielle à « Que se passe-t-il quand j'atteins ma limite ? »Regarder à 4:44 - 11
Suivre la consommation avec un moniteur en terminal
La vidéo recommande le Claude Code Usage Monitor open source (Maciek-roboblog sur GitHub, licence MIT, installation par uv ou pip) et le garde dans un deuxième onglet de terminal. Il lit les propres logs de session de Claude Code : la consommation s'affiche à côté du travail, sans interface web séparée à laisser ouverte.

Le moniteur recommandé par la vidéo : Maciek-roboblog/Claude-Code-Usage-Monitor.Regarder à 6:22 - 12
Surveiller le compte à rebours et le burn rate
Le TUI affiche des barres de coût, de tokens et de messages, un compte à rebours Time to Reset (2 h 52 min dans la vidéo), la répartition des modèles, et un burn rate en direct avec des prédictions comme « Tokens will run out: 3:00 PM ». Avec la fenêtre de 5 heures sous les yeux, un ralentissement soudain n'est plus un mystère — vous voyez le plafond approcher.

Burn rate et compte à rebours, en direct dans un onglet de terminal.Regarder à 6:50
Claude Code face à Cursor, Codex et au mois dernier
Les recherches « claude code slower than cursor » et « than codex » comparent le plus souvent des configurations différentes, pas des moteurs différents. Ce qui diffère vraiment :
- 1Face à Cursor — Cursor embarque sa propre chaîne de contexte et, à l'époque de la vidéo, plafonnait la fenêtre du modèle à environ 120k tokens, quand Claude Code donne à Claude les 200k complets mais y charge davantage de votre dépôt. Aucun n'est « plus rapide » en soi : l'outil qui garde la fenêtre la plus légère paraît le plus rapide.
- 2Face à Codex CLI — même physique. N'importe quel agent de code ralentit quand le prompt traîne un dépôt entier ; /clear, un fichier de contexte sobre et des compacts ciblés se transposent tels quels à Codex. Les files d'attente et limites dépendent du plan, pas du terminal.
- 3Face à Claude Code le mois dernier (« plus lent qu'avant ») — soupçonnez d'abord la longueur de votre session, pas la version. Les longues sessions franchissent le seuil d'auto-compact et chaque compaction est elle-même une grosse requête ; /clear et un brief de deux lignes rendent généralement la vivacité d'antan. Ensuite consultez le changelog et lancez claude --safe-mode pour écarter une personnalisation.
- 4Face au chat claude.ai — le chat paraît instantané parce qu'il ne lit pas votre dépôt. Claude Code échange ce poids de démarrage contre la capacité d'agir : fenêtre de contexte complète, outils locaux, éditions sur disque. Jugez-le au temps de la tâche, pas au premier token.
- 5Le bilan honnête — la latence brute des modèles est semblable chez les meilleurs agents. Les différences que vous sentez tiennent à la taille du contexte, au démarrage MCP et aux files d'attente de limites — les trois se mesurent, les trois se réparent sur cette page.
Si vous avez changé d'outil pour la vitesse, exécutez la même tâche deux fois — en lisant /context avant chaque tour — et comparez les compteurs de tokens. La plupart des histoires « cet outil est plus rapide » sont en réalité « cette session était plus petite ».
Encore lent ? Suivez la liste
La lenteur a quelques causes bien distinctes, chacune avec son signe. Quand les étapes ci-dessus n'expliquent pas votre lag, descendez cette liste :
- 1Tout tourne en rond aujourd'hui, dans tous les dépôts → vérifiez status.claude.com. Un incident fournisseur se manifeste par de longues attentes et des retries partout en même temps ; rien ne se règle en local, et le nombre de tokens de la ligne de statut reste bizarrement bas pendant que les secondes grimpent.
- 2Une erreur comme « Invalid API key · Please run /login » → c'est de l'authentification, pas de la vitesse, mais ça bloque la session pareil. Relancez /login pour vous réauthentifier ; dans les cas tenaces, la doc recommande /logout, fermer Claude Code, puis repartir propre. Supprimez aussi un ANTHROPIC_API_KEY égaré — il écrase votre connexion par abonnement.
- 3Lent seulement après une heure de travail → la fenêtre de contexte est pleine. L'auto-compact résume l'historique ancien près du seuil et chaque compaction est elle-même une grosse requête. Un /compact ciblé (par exemple : ne garder que le plan et le diff), ou /clear puis un brief de deux lignes.
- 4Bloqué sur connecting ou au démarrage MCP → lancez /mcp, repérez le serveur qui pend et retirez-le du projet. Le démarrage a été vraiment corrigé récemment — la v2.1.292 garde en mémoire 7 jours les serveurs stdio lents et ne fait plus attendre le premier tour headless sur les serveurs HTTP.
- 5Des pauses de minutes qui reprennent seules → vous touchez la limite d'usage. Les messages de limite de session affichent l'heure de réinitialisation ; changer de modèle ne sert à rien contre une limite de siège, mais /rate-limit-options (v2.1.234+) reprend la tâche après réinitialisation, et /model ne joue que sur les limites propres à un modèle.
- 6Le terminal lui-même rame — défilement lent, texte fantôme, frappe retardée → c'est du rendu, pas de l'inférence. Lancez claude --safe-mode pour désactiver hooks et scripts de statusline le temps d'une session ; si le lag disparaît, allégez votre script statusline ou vos hooks. Refaire la même session dans le panneau VS Code puis dans le terminal isole encore mieux.
Encore un point de la doc : si la mémoire d'une session dépasse 2,5 Go, redémarrez-la — claude --continue reprend la conversation dans un processus frais, en général plus rapide que celui que vous avez quitté.
