Kimi K3 no Claude Code: o guia completo de configuração
A Moonshot oferece um endpoint compatível com Anthropic, então o Claude Code roda no Kimi K3 com um único bloco de variáveis no settings.json. Cada valor de configuração abaixo foi conferido palavra por palavra na documentação oficial da Kimi, e as oito capturas de tela acompanham uma sessão real do K3, do primeiro prompt a um jogo verificado e jogável.
Resumo — Kimi K3 dentro do Claude Code
- A Messages API da Moonshot é compatível com Anthropic: aponte ANTHROPIC_BASE_URL para https://api.moonshot.ai/anthropic, cole sua chave Kimi no ANTHROPIC_AUTH_TOKEN, e o Claude Code mantém todos os recursos enquanto o Kimi K3 pensa.
- O settings.json oficial mapeia todas as camadas de modelo para kimi-k3[1m] (a variante de contexto 1M), a camada Haiku para kimi-k2.7-code, além de definir CLAUDE_CODE_AUTO_COMPACT_WINDOW como 1000000 e CLAUDE_CODE_EFFORT_LEVEL como max.
- Duas formas de verificar: execute /status e confira a Base URL junto com o modelo kimi-k3[1m], ou simplesmente leia o banner de inicialização — na demo, ele exibe Using kimi-k3 (from .claude/settings.json).
- O K3 funciona com pagamento por uso na Kimi API Platform: US$ 3 por milhão de tokens de entrada, US$ 15 de saída, US$ 0,30 com cache, contexto de 1M. O modelo em si é um MoE de 2,8 trilhões de parâmetros com 104B ativos e raciocínio sempre ligado.
Kimi K3 + Claude Code Demo
Vídeo de demonstração:Data Science in your pocket8:11
Use Kimi in Claude Code — official guide
Fatos do produto:platform.kimi.aiKimi API Platform docs
Os passos 1 a 4 (instalação, chave de API, bloco de variáveis, verificação com curl) são documentados a partir do guia oficial da Kimi, porque não existe nenhuma gravação limpa do processo de configuração — todos os tutoriais do YouTube trazem a câmera do autor. Os passos 5 a 12 são quadros de uma gravação somente de terminal com o Claude Code v2.1.207 no kimi-k3.
Os quadros são capturas creditadas do vídeo de origem, cada uma com link direto para seu momento. O texto deste guia é original — não é uma transcrição.
Kimi K3 no Claude Code, passo a passo
1 · Apontar o Claude Code para o Kimi K3
- 1
Instalar o Claude Code
Use o instalador nativo da Anthropic: curl -fsSL https://claude.ai/install.sh | bash no macOS e Linux, ou irm https://claude.ai/install.ps1 | iex no PowerShell do Windows. O caminho pelo npm também funciona: npm install -g @anthropic-ai/claude-code exige Node.js 22 ou mais recente. Já tem o Claude Code? Pule esta etapa — mas se alguma ferramenta de terceiros já editou o ~/.claude/settings.json, limpe antes as entradas ANTHROPIC_* obsoletas do campo env, porque esses valores sobrescrevem em silêncio tudo o que você exportar no terminal.
- 2
Criar uma chave de API da Kimi
Entre em platform.kimi.ai, abra o Console e crie uma chave em API Keys. O K3 é liberado após uma recarga bem-sucedida e o mínimo é US$ 1: um único dólar basta para acompanhar este tutorial inteiro. Atenção: esta é a Kimi API Platform, com pagamento por uso. Uma assinatura do Kimi Code ou Kimi Membership é outro produto e não fornece a chave de API que esta configuração precisa.
- 3
Escrever o bloco de variáveis em ~/.claude/settings.json
Abra (ou crie) o ~/.claude/settings.json e preencha o campo env exatamente como o guia oficial determina: ANTHROPIC_BASE_URL em https://api.moonshot.ai/anthropic, ANTHROPIC_AUTH_TOKEN com sua chave Kimi, ANTHROPIC_MODEL junto com as camadas OPUS, SONNET e FABLE e o CLAUDE_CODE_SUBAGENT_MODEL em kimi-k3[1m], ANTHROPIC_DEFAULT_HAIKU_MODEL em kimi-k2.7-code, CLAUDE_CODE_AUTO_COMPACT_WINDOW em 1000000 e CLAUDE_CODE_EFFORT_LEVEL em max. Mapear cada camada importa: o Claude Code envia requisições de segundo plano e de subagentes por esses apelidos, e um que falte faz falhar em silêncio. O bloco env sobrescreve variáveis exportadas no terminal e guarda sua chave em texto puro — nunca faça commit dele.
- 4
Provar o endpoint e a chave com curl
Antes de abrir o Claude Code, envie uma requisição de um token direto à rota compatível com Anthropic: curl https://api.moonshot.ai/anthropic/v1/messages com um cabeçalho Authorization: Bearer carregando sua chave Kimi e um corpo com model kimi-k3 e max_tokens 1. Uma resposta JSON normal significa que endpoint e credencial funcionam. Um 401 significa que a chave é inválida, que a Base URL não corresponde à plataforma que emitiu a chave, ou que um ANTHROPIC_API_KEY residual colide com o ANTHROPIC_AUTH_TOKEN — remova-o.
2 · Iniciar e provar que o K3 está no controle
- 5
Abrir o claude e ler o banner
Inicie o claude dentro de uma pasta de projeto. O banner conta toda a história: Claude Code v2.1.207 na demo, depois kimi-k3 · API Usage Billing e, em seguida, a linha que importa — Using kimi-k3 (from .claude\settings.json) · /model. É o bloco de variáveis sendo carregado; um .claude/settings.json no nível do projeto funciona da mesma forma. Se o seu banner ainda mostra uma linha de cobrança da Claude ou Anthropic, volte ao passo 3 e reinicie o Claude Code.

O banner de inicialização nomeia o kimi-k3 e o settings.json de onde ele veio.Ver em 0:22 - 6
Enviar uma tarefa real, não um quem-é-você
A demo abre com help me develop a game called snake and ladders. — um pedido concreto e construível. O K3 pensa antes de responder: Thought for 16s e, enquanto a resposta chega em streaming, a linha de status conta Channeling… 25s · ↓1.0k tokens. Esqueça o teste de perguntar qual modelo ele é: a configuração mapeia apelidos da Claude para IDs da Kimi, e a autoidentificação não prova nada — /status e o banner são a evidência.

Primeiro prompt enviado, K3 pensando — o contador de tokens começa a rodar.Ver em 1:42 - 7
Responder as perguntas de esclarecimento
O K3 não adivinha: ele pergunta. Aparece um seletor com abas — Platform, Players, Rules, Submit — oferecendo Web (HTML/CSS/JS), Python console, Python + pygame ou texto próprio, cada opção com sua explicação embaixo. Enter seleciona, Tab e as setas navegam, Esc cancela. Essas perguntas estruturadas logo no começo são metade da razão de o resultado final não precisar de retrabalho.

A interface de perguntas em abas: Enter seleciona, Tab e as setas navegam, Esc cancela.Ver em 2:04
3 · Um prompt, um jogo: o ciclo de trabalho do K3
- 8
Revisar e enviar suas respostas
Antes de qualquer coisa rodar, o Claude Code mostra a tela Review your answers: as abas Platform, Players e Rules aparecem marcadas em verde — Python + pygame, 1 player vs computer e Classic na demo — e o Submit answers espera como opção destacada. Um Enter depois, o agente tem a especificação completa. Revise com cuidado aqui: o plano é construído exatamente a partir dessas escolhas.

Platform, Players e Rules marcadas — o Submit answers está a um Enter de distância.Ver em 2:12 - 9
Ler o plano e deixar instalar o que faltar
O plano chega em etapas verificáveis: checar o ambiente e confirmar Python + pygame; escrever o jogo e confirmar que compila; testar lógica e renderização sem interface, de modo que as partidas simuladas terminem em uma vitória chegando exatamente à casa 100. Ele detecta Python 3.13, percebe que falta o pygame e executa por conta própria python -m pip install pygame. Repare no tempo de raciocínio — 4 min 53 s de uma vez — é o CLAUDE_CODE_EFFORT_LEVEL=max em ação; o K3 usa por padrão o esforço máximo de raciocínio.

O plano em três partes e, depois, a instalação automática do pygame no Python 3.13.Ver em 3:42 - 10
Aprovar a escrita e ver a checagem de compilação
O K3 escreve o snake_and_ladders.py — 279 linhas na demo — e então verifica o próprio trabalho: primeiro uma checagem de compilação (python -m py_compile … && echo "compile OK"), depois um teste de fumaça sem interface que renderiza cada elemento e simula milhares de partidas completas. O rodapé mostra accept edits on (shift+tab to cycle), o modo de permissão que deixa as escritas passarem sem confirmação arquivo por arquivo. Uma escrita rejeitada tem recuperação — a própria demo se recupera de uma rejeição acidental e tenta de novo.

279 linhas escritas e o python -m py_compile rodando sob accept edits on.Ver em 6:05
4 · Resultado verificado, pronto para executar
- 11
Ler a lista de verificação
All checks pass. The game is done and verified — e o Claude Code enumera as evidências: Compilação ✓, Renderização — tabuleiro, cobras, escadas e dado todos desenhados sem erros ✓, Mapeamento do tabuleiro — casa 1 embaixo à esquerda em ziguezague até a 100 ✓, Regras — passar da casa anula a jogada, vencer exige a casa exata 100 ✓, e 2000 partidas simuladas, todas terminando com um vencedor ✓. Abaixo, ele imprime o comando de execução e um resumo do que você recebe. Esse hábito vale a pena copiar: nunca confie no código, simule-o.

Compilação, renderização, mapeamento do tabuleiro, regras e 2000 partidas simuladas — tudo verde.Ver em 6:55 - 12
Executar
Rode o comando impresso — python C:\Users\datas\snake_and_ladders\snake_and_ladders.py na demo — e a janela do jogo se abre: um tabuleiro 10x10 com cobras verdes onduladas e escadas marrons, um painel lateral SNAKES & LADDERS com indicador de vez, dado e botão verde Roll. Espaço ou clique rola o dado, R reinicia, Esc sai. De uma frase a um jogo jogável e autoverificado em cerca de dez minutos de K3.

A janela final do Snakes & Ladders, aberta com o comando impresso pelo K3.Ver em 7:35
