Deepseek ArtifactsDeepseek Artifacts
Guía contra la lentitud

¿Claude Code lento? 12 arreglos para respuestas ágiles (2026)

¿Por qué es tan lento Claude Code? Lee la línea de estado, recorta contexto con una CLAUDE.md ligera y /clear, cambia de modelo con /model y vigila el límite de 5 horas.

TL;DR

  • La mayoría de los «Claude Code va lento» es hinchazón de contexto. La línea de estado muestra el precio de cada turno en segundos y tokens — léela antes de buscar otra herramienta.
  • Carga menos: crea una CLAUDE.md con /init y mantenla bajo 200 líneas, usa /clear entre tareas y un /compact con foco cuando la sesión deba sobrevivir.
  • Manda el trabajo al motor correcto: /model para un modelo más rápido en ediciones de rutina, /context para ver quién se come la ventana y menos servidores MCP por proyecto.
  • Parte de la lentitud no es tuya: revisa status.claude.com y vigila el límite móvil de 5 horas — un monitor en terminal muestra el temporizador de reinicio y el burn rate en vivo.

Wait.. Claude Code is MADE Slow on Purpose? Heres How to Fix It

Canal: AI LABS10:35

Ver

Why Claude Code Gets Slow and Forgetful and 4 Habits That Fix It

Canal: Prompt to Prod11:00

Ver

Manage costs & usage limits — official documentation

Docs oficiales: code.claude.com/docs

Ver

Cada comando, límite y valor por defecto de esta página está verificado contra code.claude.com/docs y el changelog de anthropics/claude-code; los vídeos de arriba son las fuentes visuales y de datos, incluidas las lecturas de la línea de estado y el monitor de la ventana de cinco horas. Cuando el vídeo y las docs discrepan, la guía sigue las docs.

Las capturas se atribuyen a sus creadores con enlaces profundos al minuto exacto. No se usa ningún fotograma con cara.

Devolverle la velocidad a Claude Code, paso a paso

Parte 1 — Ver a dónde se va el tiempo

  1. 1

    Mandar un prompt real a una sesión recién estrenada

    Arranca claude en tu proyecto y escribe una petición de verdad. Una sesión nueva empieza sin nada más que la caja de bienvenida, así que Claude tiene que leer tus archivos antes de responder — ese pase de descubrimiento es donde nacen la mayoría de los «Claude Code va lento». Observa cómo cambian los verbos del spinner en la entrada.

    Claude Code welcome box in a macOS terminal with tips for getting started and the first prompt Hi there, Could You Edit the Notes Component typed at the empty input
    Una sesión nueva: los consejos de la caja de bienvenida son todo el contexto con el que arranca Claude Code.Ver en 0:08
  2. 2

    Leer la línea de estado mientras trabaja

    Bajo el diff aparece una línea como «Unravelling… (16s · 351 tokens · esc to interrupt)». El verbo es decoración; los segundos y el conteo de tokens son tu velocímetro. Te dicen si Claude piensa, espera o rebusca entre archivos. Si cada turno quema cientos de tokens antes de la primera edición, el contexto es el que frena.

    VS Code diff of a notes app page while Claude Code shows the Unravelling status line with 16 seconds elapsed, 351 tokens spent and esc to interrupt
    La línea de estado es tu velocímetro: verbo, segundos, tokens, esc to interrupt.Ver en 1:08
  3. 3

    Abrir el diff y ver lo que arrastró una edición pequeña

    Hasta una función mínima hay que encontrarla primero. La edición del contador de palabras del video toca un archivo con nueve líneas añadidas — y el turno gasta 352 tokens antes de que el spinner se asiente. En un repo más grande, el descubrimiento significa listar directorios y leer archivos que no vienen al caso — el video lo llama «ahogarse en información innecesaria».

    Claude Code updating a notes app page with nine additions in a green VS Code diff while the Hatching spinner reports 3 seconds and 352 tokens
    Nueve líneas añadidas a un archivo — y el spinner sigue contando tokens.Ver en 0:22

Parte 2 — Alimentar con menos contexto

  1. 4

    Ejecutar /init para crear la CLAUDE.md

    Escribe /init y elige «Initialize a new CLAUDE.md file with codebase documentation». Es el comando documentado que le da a Claude un resumen permanente de tu repo, para que una sesión nueva deje de redescubrir el proyecto antes de cada edición. El mayor antídoto contra la queja de «primero lo lee todo».

    Claude Code slash-command menu opened by typing /init, highlighting Initialize a new CLAUDE.md file with codebase documentation next to compact, doctor and upgrade
    /init es la forma documentada de generar la CLAUDE.md.Ver en 3:38
  2. 5

    Dejar que ocurra el escaneo único

    Claude lee package.json, el README, el router y más, y luego escribe el archivo — la corrida del video muestra un spinner Deciphering… tras unos 90 tokens de llamadas a herramientas. Ese costo se paga una vez. Desde la siguiente sesión, el contexto que Claude necesita ya está en la CLAUDE.md en vez de volver a leerse del disco.

    Claude Code reading package.json, README.md and router.tsx and searching for cursor rules before writing CLAUDE.md, spinner showing Deciphering after 7 seconds and 90 tokens
    El escaneo único: lecturas, búsquedas y luego la escritura.Ver en 2:22
  3. 6

    Mantener la CLAUDE.md ligera — comandos y arquitectura

    El archivo terminado guarda comandos de desarrollo, la capa de base de datos y un breve resumen de arquitectura. Quédate ahí: las docs oficiales dicen que la CLAUDE.md se carga en el contexto al inicio de cada sesión y recomiendan menos de 200 líneas. Una CLAUDE.md obesa recrea el problema que venía a resolver — mueve los flujos especializados a skills, que cargan bajo demanda.

    CLAUDE.md open in the VS Code editor listing npm run dev, build and lint commands plus a three-tier Next.js 15 notes app architecture in a short file
    Comandos y arquitectura — el archivo que se carga en cada sesión. Manténlo corto.Ver en 3:50
  4. 7

    Traer la documentación por búsqueda semántica, no llenando contexto

    Para preguntas de librerías, el video muestra el MCP Context7 llamando get-library-docs con el tema «best practices» y recibiendo solo la sección pertinente del repositorio de TypeScript de Microsoft. La búsqueda semántica devuelve solo los trozos que importan en lugar de meterse páginas enteras de documentación en la ventana.

    Claude Code calling the Context7 get-library-docs tool with topic best practices to pull only the relevant TypeScript documentation section from Microsofts repo
    get-library-docs devuelve la sección que coincide, no el manual completo.Ver en 2:48
  5. 8

    Verificar el servidor MCP con /mcp

    Ejecuta /mcp y confirma que el servidor aparece «connected» — el video añade el servidor de código semántico Serena con claude mcp add y lo comprueba aquí. Dos advertencias del video y de las docs: un servidor MCP vale por proyecto, así que instálalo en cada repo donde lo quieras; y un servidor que se cuelga al arrancar retrasa cada sesión de ese proyecto.

    Claude Code Manage MCP servers screen listing serena as connected with Enter to view details and Esc to exit after adding the semantic code retrieval server
    /mcp es donde se esconde un servidor lento: serena muestra un connected verde.Ver en 5:31

Parte 3 — Modelos, límites y monitoreo

  1. 9

    Pasar la rutina a un modelo más rápido

    Abre /model — o el selector de tu IDE — y empareja el motor con la tarea. Las docs oficiales recomiendan Sonnet como predeterminado diario más barato y Opus para razonamiento complejo; las tareas simples de subagentes pueden ir sobre Haiku. Un modelo más rápido no arregla un contexto congestionado, pero en ediciones pequeñas recorta a la vez tiempo de respuesta y costo por token.

    IDE model picker listing claude-4-sonnet, claude-3.5-sonnet, gemini-2.5-pro and gpt-4.1 above a Next.js upgrade answer, used to pick a faster model per task
    Mismo prompt, otro motor: el selector vive en /model y en la barra del IDE.Ver en 4:32
  2. 10

    Saber qué pasa al llegar al límite

    Las docs de Anthropic marcan la línea: «You've hit your session limit» y los avisos de límite semanal son por asiento — cambiar de modelo no ayuda, y el mensaje muestra la hora de reinicio. Los límites específicos de modelo se rodean con /model, y desde v2.1.234 el menú /rate-limit-options puede retomar una tarea tras el reinicio.

    Claude documentation page on usage limits showing expected usage per plan, how limits work and the heading What happens when I reach my limit
    La respuesta oficial a «¿Qué pasa cuando alcanzo mi límite?»Ver en 4:44
  3. 11

    Rastrear el consumo con un monitor de terminal

    El video recomienda el Claude Code Usage Monitor open source (Maciek-roboblog en GitHub, licencia MIT, se instala con uv o pip) y lo deja en una segunda pestaña de terminal. Lee los propios logs de sesión de Claude Code, así que el uso aparece junto a tu trabajo — sin interfaz web aparte que mantener abierta.

    GitHub repository page for Maciek-roboblog Claude-Code-Usage-Monitor with Code, Issues and Pull requests tabs above the MIT-licensed file list
    El monitor que recomienda el video: Maciek-roboblog/Claude-Code-Usage-Monitor.Ver en 6:22
  4. 12

    Vigilar el temporizador de reinicio y el burn rate

    El TUI muestra barras de costo, tokens y mensajes, una cuenta atrás Time to Reset (2 h 52 min en el video), distribución de modelos y un burn rate en vivo con predicciones como «Tokens will run out: 3:00 PM». Con la ventana de 5 horas a la vista, una desaceleración súbita deja de ser un misterio — ves acercarse el techo.

    Claude Code Usage Monitor terminal TUI with progress bars for cost, token and messages usage, Time to Reset 2h 52m, Sonnet 100 percent and a 21.1 tokens per minute burn rate
    Burn rate y cuenta atrás, en vivo en una pestaña de terminal.Ver en 6:50

Claude Code contra Cursor, Codex y el mes pasado

Quien busca «claude code slower than cursor» o «than codex» suele comparar configuraciones distintas, no motores distintos. Lo que de verdad difiere:

  • 1Contra Cursor — Cursor trae su propia tubería de contexto y, en la época del video, recortaba la ventana del modelo a unos 120k tokens, mientras Claude Code le da a Claude los 200k completos pero carga más de tu repo dentro. Ninguno es «más rápido» en abstracto: se siente más rápido la herramienta que mantiene la ventana más ligera.
  • 2Contra Codex CLI — la misma física. Cualquier agente de código se frena cuando el prompt arrastra un repo entero; /clear, un archivo de contexto ligero y compacts con foco se trasladan uno a uno a Codex. Las colas de modelos y los límites dependen del plan, no del terminal.
  • 3Contra el Claude Code del mes pasado («más lento que antes») — sospecha primero de la duración de tu sesión, no de la versión. Las sesiones largas cruzan el umbral del auto-compact y cada compactación es en sí una petición grande; /clear y un resumen de dos líneas suelen devolver la agilidad de antes. Después revisa el changelog y lanza claude --safe-mode para descartar una personalización.
  • 4Contra el chat de claude.ai — el chat parece instantáneo porque no lee tu repo. Claude Code cambia ese peso de arranque por capacidad de actuar: ventana de contexto completa, herramientas locales, ediciones en disco. Júzgalo por el tiempo de la tarea, no por el primer token.
  • 5La conclusión honesta — la latencia bruta de los modelos es parecida en los agentes punteros. Las diferencias que se sienten son tamaño de contexto, arranque de MCP y colas de límites — las tres se miden y las tres se arreglan en esta página.

Si cambiaste de herramienta por velocidad, corre la misma tarea dos veces — leyendo /context antes de cada turno — y compara los conteos de tokens. La mayoría de las historias de «esta herramienta es más rápida» son en realidad «esta sesión era más pequeña».

¿Sigue lento? Recorre la lista

La lentitud tiene unas pocas causas bien distintas, y cada una tiene su pista. Cuando los pasos de arriba no explican tu retraso, baja por esta lista:

  • 1Hoy gira en todas partes, en todos los repos → revisa status.claude.com. Un incidente del proveedor se manifiesta como esperas largas y reintentos en todos lados a la vez; nada local lo arregla, y el conteo de tokens de la línea de estado se queda sospechosamente bajo mientras los segundos suben.
  • 2Un error como «Invalid API key · Please run /login» → eso es autenticación, no velocidad, pero atasca la sesión igual. Ejecuta /login para reautenticarte; en casos tercos las docs recomiendan /logout, cerrar Claude Code y empezar de cero. Quita también una variable ANTHROPIC_API_KEY suelta — anula tu inicio de sesión de suscripción.
  • 3Lento solo tras una hora de trabajo → la ventana de contexto está llena. El auto-compact resume el historial viejo cerca del umbral y cada compactación es en sí una petición grande. Un /compact con foco (por ejemplo: conservar solo el plan y el diff) o /clear y un resumen de dos líneas.
  • 4Atascado en connecting o en el arranque de MCP → ejecuta /mcp, localiza el servidor colgado y quítalo de ese proyecto. El arranque recibió arreglos reales hace poco — v2.1.292 recuerda 7 días los servidores stdio lentos y ya no hace esperar el primer turno headless por servidores HTTP.
  • 5Pausas de minutos que se reanudan solas → te estás topando con el límite de uso. Los mensajes de límite de sesión muestran la hora de reinicio; cambiar de modelo no sirve contra un límite por asiento, pero /rate-limit-options (v2.1.234+) retoma la tarea tras el reinicio, y /model solo juega con límites específicos de modelo.
  • 6La terminal misma se arrastra — scroll lento, texto fantasma, tecleo retrasado → eso es renderizado, no inferencia. Lanza claude --safe-mode para desactivar hooks y scripts de statusline durante una sesión; si la lentitud desaparece, recorta tu script de statusline o tus hooks. Probar la misma sesión en el panel de VS Code y en la terminal acota aún más.

Una más de las docs: si la memoria de una sesión pasa de 2,5 GB, reiníciala — claude --continue retoma la conversación en un proceso nuevo, normalmente más rápido que el que dejaste.

FAQ

Guías relacionadas de Claude Code