Deepseek ArtifactsDeepseek Artifacts
Guia de correções de velocidade

Claude Code lento? 12 correções para respostas ágeis (2026)

Por que o Claude Code está tão lento? Leia a linha de status, enxugue o contexto com uma CLAUDE.md enxuta e /clear, troque de modelo com /model e acompanhe o limite de 5 horas.

TL;DR

  • A maioria dos «Claude Code está lento» é inchaço de contexto. A linha de status mostra o preço de cada turno em segundos e tokens — leia-a antes de sair procurando outra ferramenta.
  • Carregue menos: crie uma CLAUDE.md com /init e mantenha abaixo de 200 linhas, use /clear entre tarefas e um /compact com foco quando a sessão tiver que sobreviver.
  • Mande o trabalho para o motor certo: /model para um modelo mais rápido nas edições de rotina, /context para ver quem está comendo a janela e menos servidores MCP por projeto.
  • Parte da lentidão não é sua: confira status.claude.com e fique de olho no limite rolante de 5 horas — um monitor no terminal mostra o contador de reset e o burn rate ao vivo.

Wait.. Claude Code is MADE Slow on Purpose? Heres How to Fix It

Canal: AI LABS10:35

Assistir

Why Claude Code Gets Slow and Forgetful and 4 Habits That Fix It

Canal: Prompt to Prod11:00

Assistir

Manage costs & usage limits — official documentation

Docs oficiais: code.claude.com/docs

Assistir

Cada comando, limite e padrão desta página foi verificado contra code.claude.com/docs e o changelog do anthropics/claude-code; os vídeos acima são as fontes visuais e de fatos, incluindo as leituras da linha de status e o monitor da janela de cinco horas. Quando o vídeo e a documentação divergem, o guia segue a documentação.

As capturas de tela são atribuídas aos seus criadores com deep links para o timestamp exato. Nenhum quadro com rosto é usado.

Devoler a velocidade ao Claude Code, passo a passo

Parte 1 — Ver para onde vai o tempo

  1. 1

    Enviar um prompt de verdade a uma sessão recém-aberta

    Rode claude no seu projeto e digite um pedido real. Uma sessão novinha começa sem nada além da caixa de boas-vindas, então o Claude precisa ler seus arquivos antes de responder — essa passada de descoberta é onde nascem a maioria dos «Claude Code está lento». Observe os verbos do spinner mudando na área de entrada.

    Claude Code welcome box in a macOS terminal with tips for getting started and the first prompt Hi there, Could You Edit the Notes Component typed at the empty input
    Uma sessão nova: as dicas da caixa de boas-vindas são todo o contexto com que o Claude Code parte.Assistir em 0:08
  2. 2

    Ler a linha de status enquanto ele trabalha

    Abaixo do diff aparece uma linha como «Unravelling… (16s · 351 tokens · esc to interrupt)». O verbo é decoração; os segundos e a contagem de tokens são seu velocímetro. Eles dizem se o Claude está pensando, esperando ou garimpando arquivos. Se todo turno queima centenas de tokens antes da primeira edição, o contexto é quem está freando.

    VS Code diff of a notes app page while Claude Code shows the Unravelling status line with 16 seconds elapsed, 351 tokens spent and esc to interrupt
    A linha de status é seu velocímetro: verbo, segundos, tokens, esc to interrupt.Assistir em 1:08
  3. 3

    Abrir o diff e ver o que uma edição pequena arrastou

    Até uma função mínima precisa ser encontrada primeiro. A edição do contador de palavras do vídeo mexe em um arquivo com nove adições — e o turno gasta 352 tokens antes do spinner assentar. Num repo maior, a descoberta significa listar diretórios e ler arquivos que não têm nada a ver com o pedido — o vídeo chama isso de «se afogar em informação desnecessária».

    Claude Code updating a notes app page with nine additions in a green VS Code diff while the Hatching spinner reports 3 seconds and 352 tokens
    Nove adições em um único arquivo — e o spinner continua contando tokens.Assistir em 0:22

Parte 2 — Alimentar com menos contexto

  1. 4

    Rodar /init para gerar a CLAUDE.md

    Digite /init e escolha «Initialize a new CLAUDE.md file with codebase documentation». É o comando documentado que dá ao Claude um briefing permanente sobre seu repo, para a sessão nova parar de redescobrir o projeto antes de cada edição. O maior antídoto para a reclamação de «ele lê tudo primeiro».

    Claude Code slash-command menu opened by typing /init, highlighting Initialize a new CLAUDE.md file with codebase documentation next to compact, doctor and upgrade
    /init é a forma documentada de gerar a CLAUDE.md.Assistir em 3:38
  2. 5

    Deixar o scan único acontecer

    O Claude lê package.json, o README, o router e mais, e então escreve o arquivo — a execução do vídeo mostra um spinner Deciphering… depois de uns 90 tokens em chamadas de ferramentas. Esse custo se paga uma vez. Da próxima sessão em diante, o contexto de que o Claude precisa já está na CLAUDE.md em vez de ser relido do disco.

    Claude Code reading package.json, README.md and router.tsx and searching for cursor rules before writing CLAUDE.md, spinner showing Deciphering after 7 seconds and 90 tokens
    O scan único: leituras, buscas e depois a escrita.Assistir em 2:22
  3. 6

    Manter a CLAUDE.md enxuta — comandos e arquitetura

    O arquivo pronto guarda comandos de dev, a camada de banco de dados e um resumo curto de arquitetura. Fique aí: a documentação oficial diz que a CLAUDE.md é carregada no contexto a cada início de sessão e recomenda menos de 200 linhas. Uma CLAUDE.md obesa recria o problema que veio resolver — mova fluxos especializados para skills, que carregam sob demanda.

    CLAUDE.md open in the VS Code editor listing npm run dev, build and lint commands plus a three-tier Next.js 15 notes app architecture in a short file
    Comandos e arquitetura — o arquivo que carrega a cada sessão. Mantenha curto.Assistir em 3:50
  4. 7

    Trazer a documentação por busca semântica, em vez de entupir o contexto

    Para perguntas de biblioteca, o vídeo mostra o MCP Context7 chamando get-library-docs com o tópico «best practices» e recebendo só a seção relevante do repositório de TypeScript da Microsoft. Busca semântica devolve apenas os pedaços que importam, em vez de puxar páginas inteiras de documentação para a janela.

    Claude Code calling the Context7 get-library-docs tool with topic best practices to pull only the relevant TypeScript documentation section from Microsofts repo
    get-library-docs devolve a seção correspondente, não o manual inteiro.Assistir em 2:48
  5. 8

    Verificar o servidor MCP com /mcp

    Rode /mcp e confirme que o servidor aparece «connected» — o vídeo adiciona o servidor de código semântico Serena com claude mcp add e confere aqui. Duas ressalvas do vídeo e da documentação: um servidor MCP vale por projeto, então adicione em cada repo onde quiser usá-lo; e um servidor que trava na inicialização atrasa cada sessão daquele projeto.

    Claude Code Manage MCP servers screen listing serena as connected with Enter to view details and Esc to exit after adding the semantic code retrieval server
    /mcp é onde um servidor lento se esconde: serena mostra um connected verde.Assistir em 5:31

Parte 3 — Modelos, limites e monitoramento

  1. 9

    Passar a rotina para um modelo mais rápido

    Abra /model — ou o seletor do seu IDE — e combine o motor com a tarefa. A documentação oficial recomenda Sonnet como padrão do dia a dia mais barato e Opus para raciocínio complexo; tarefas simples de subagentes podem rodar no Haiku. Um modelo mais rápido não conserta contexto entupido, mas em edições pequenas corta junto tempo de resposta e custo por token.

    IDE model picker listing claude-4-sonnet, claude-3.5-sonnet, gemini-2.5-pro and gpt-4.1 above a Next.js upgrade answer, used to pick a faster model per task
    Mesmo prompt, outro motor: o seletor mora no /model e na barra do IDE.Assistir em 4:32
  2. 10

    Saber o que acontece ao bater no limite

    A docs da Anthropic traça a linha: «You've hit your session limit» e os avisos de limite semanal são por assento — trocar de modelo não ajuda, e a mensagem mostra o horário do reset. Limites específicos de modelo se contornam com /model, e desde a v2.1.234 o menu /rate-limit-options pode retomar uma tarefa após o reset.

    Claude documentation page on usage limits showing expected usage per plan, how limits work and the heading What happens when I reach my limit
    A resposta oficial para «O que acontece quando atinjo meu limite?»Assistir em 4:44
  3. 11

    Acompanhar o consumo com um monitor no terminal

    O vídeo recomenda o Claude Code Usage Monitor open source (Maciek-roboblog no GitHub, licença MIT, instala com uv ou pip) e o mantém numa segunda aba de terminal. Ele lê os próprios logs de sessão do Claude Code, então o uso aparece ao lado do seu trabalho — sem interface web separada para manter aberta.

    GitHub repository page for Maciek-roboblog Claude-Code-Usage-Monitor with Code, Issues and Pull requests tabs above the MIT-licensed file list
    O monitor que o vídeo recomenda: Maciek-roboblog/Claude-Code-Usage-Monitor.Assistir em 6:22
  4. 12

    Vigiar o contador de reset e o burn rate

    O TUI mostra barras de custo, tokens e mensagens, a contagem Time to Reset (2 h 52 min no vídeo), distribuição de modelos e um burn rate ao vivo com previsões como «Tokens will run out: 3:00 PM». Com a janela de 5 horas na tela, uma desaceleração súbita deixa de ser mistério — você vê o teto se aproximando.

    Claude Code Usage Monitor terminal TUI with progress bars for cost, token and messages usage, Time to Reset 2h 52m, Sonnet 100 percent and a 21.1 tokens per minute burn rate
    Burn rate e contador de reset, ao vivo numa aba do terminal.Assistir em 6:50

Claude Code contra Cursor, Codex e o mês passado

Quem busca «claude code slower than cursor» e «than codex» geralmente compara configurações diferentes, não motores diferentes. O que realmente difere:

  • 1Contra o Cursor — o Cursor traz seu próprio pipeline de contexto e, na época do vídeo, cortava a janela do modelo para uns 120k tokens, enquanto o Claude Code dá ao Claude os 200k completos mas carrega mais do seu repo dentro. Nenhum é «mais rápido» em absoluto: sente-se mais rápida a ferramenta que mantém a janela mais leve.
  • 2Contra o Codex CLI — a mesma física. Qualquer agente de código freia quando o prompt arrasta um repo inteiro; /clear, um arquivo de contexto enxuto e compacts com foco transferem um a um para o Codex. Filas de modelo e rate limits dependem do plano, não do terminal.
  • 3Contra o Claude Code do mês passado («mais lento que antes») — desconfie primeiro do tamanho da sua sessão, não do release. Sessões longas cruzam o limiar do auto-compact e cada compactação é em si uma requisição grande; /clear e um briefing de duas linhas geralmente devolvem a agilidade de antes. Depois confira o changelog e rode claude --safe-mode para descartar uma personalização.
  • 4Contra o chat do claude.ai — o chat parece instantâneo porque não lê seu repo. O Claude Code troca esse peso de partida pela capacidade de agir: janela de contexto completa, ferramentas locais, edições no disco. Julgue pelo tempo da tarefa, não pelo primeiro token.
  • 5O veredito honesto — a latência bruta dos modelos é parecida nos agentes de ponta. As diferenças que você sente são tamanho de contexto, inicialização de MCP e filas de rate limit — as três se medem e as três se consertam nesta página.

Se você trocou de ferramenta por causa da velocidade, rode a mesma tarefa duas vezes — lendo o /context antes de cada turno — e compare as contagens de tokens. A maioria das histórias de «essa ferramenta é mais rápida» é, na verdade, «essa sessão era menor».

Ainda lento? Percorra a lista

Lentidão tem algumas causas bem distintas, cada uma com seu sinal. Quando os passos acima não explicam seu atraso, desça esta lista:

  • 1Hoje gira tudo, em todo repo → confira status.claude.com primeiro. Incidente do provedor aparece como esperas longas e retries em todos os lugares ao mesmo tempo; nada local resolve, e a contagem de tokens da linha de status fica suspeitamente baixa enquanto os segundos sobem.
  • 2Um erro como «Invalid API key · Please run /login» → isso é autenticação, não velocidade, mas trava a sessão do mesmo jeito. Rode /login para se reautenticar; em casos teimosos a documentação recomenda /logout, fechar o Claude Code e recomeçar. Remova também um ANTHROPIC_API_KEY solto — ele se sobrepõe ao login da sua assinatura.
  • 3Lento só depois de uma hora de trabalho → a janela de contexto encheu. O auto-compact resume o histórico antigo perto do limiar e cada compactação é em si uma requisição grande. Um /compact com foco (por exemplo: manter só o plano e o diff) ou /clear e um briefing de duas linhas.
  • 4Preso em connecting ou na inicialização de MCP → rode /mcp, localize o servidor pendurado e remova-o daquele projeto. A inicialização ganhou consertos de verdade há pouco — a v2.1.292 lembra por 7 dias dos servidores stdio lentos e não faz mais o primeiro turno headless esperar servidores HTTP.
  • 5Pausas de minutos que retomam sozinhas → você está esbarrando no limite de uso. Mensagens de limite de sessão mostram o horário do reset; trocar de modelo não adianta contra um limite por assento, mas /rate-limit-options (v2.1.234+) retoma a tarefa após o reset, e /model só vale para limites específicos de modelo.
  • 6O terminal em si engasga — scroll lento, texto fantasma, digitação atrasada → isso é renderização, não inferência. Rode claude --safe-mode para desativar hooks e scripts de statusline por uma sessão; se o engasgo sumir, enxugue seu script de statusline ou seus hooks. Testar a mesma sessão no painel do VS Code e no terminal afina ainda mais.

Mais uma da documentação: se a memória de uma sessão passar de 2,5 GB, reinicie — o claude --continue retoma a conversa num processo novo, geralmente mais rápido que aquele que você deixou.

FAQ

Guias relacionados de Claude Code