Kimi Code vs Claude Code: o mito dos US$ 19 em 2026

Última Atualização: 2026-07-23 09:57:43

Durante um ano, a comparação parecia simples: o Kimi Code seria o agente de terminal de US$ 19 que fazia o que o Claude Code faz por um quinto do preço. Isso mudou em 16 de julho, quando o Kimi K3 chegou cobrando US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída — exatamente a mesma faixa do Claude Sonnet. O desconto de 10x que tornava o Kimi Code uma escolha óbvia estava ligado ao antigo K2. Agora, a discussão não é mais barato contra caro, mas qual dos dois agentes de código combina melhor com a sua forma de trabalhar.

O que são Kimi Code e Claude Code

Os dois são agentes de programação para terminal: uma CLI capaz de ler seu repositório, executar comandos, editar arquivos e acionar um modelo. O Claude Code é a ferramenta oficial da Anthropic e provavelmente a mais conhecida: uma CLI em Node.js, também disponível no IDE, Slack e web, que roda Opus 4.8 ou Sonnet 5 e conta com um ecossistema maduro de MCP, hooks, CLAUDE.md e subagentes.

O Kimi Code é a alternativa da Moonshot, ainda menos difundida: oferece API, extensão para VS Code e CLI, usando por padrão o K3 da própria Kimi, com contexto de 1M, ou o K2.7 Code, mais barato. A base técnica é semelhante à do Claude Code — TypeScript, npm e Node.js — e inclui subagentes, modo de planejamento, MCP e suporte a VS Code, JetBrains e Zed. Na prática, o que separa as ferramentas vem depois: os modelos disponíveis, seu custo e onde o seu código é processado.

Página inicial do Kimi Code anunciando o modelo de programação K3 Documentação de introdução do Kimi Code CLI explicando o que o agente de terminal faz Página do Claude Code: trabalhe com Claude pelo terminal, IDE e web

Preços verificados em 23 de julho de 2026

Há duas formas de pagar por qualquer uma das ferramentas: API por token ou assinatura. Todos os valores abaixo foram consultados nas páginas oficiais de preços em 23 de julho de 2026 — preços da API da Moonshot e documentação de preços da Anthropic.

Preços de API, por 1M de tokens:

ModeloEntradaSaídaLeitura de cacheContexto
Kimi K2.7 CodeUS$ 0,95US$ 4,00US$ 0,19256K
Kimi K3US$ 3,00US$ 15,00US$ 0,301M
Claude Sonnet 5*US$ 3,00US$ 15,00US$ 0,20
Claude Opus 4.8US$ 5,00US$ 25,00US$ 0,50

*O Sonnet 5 custa US$ 2/US$ 10 em preço introdutório até 31 de agosto de 2026; depois, passa para US$ 3/US$ 15.

Gráfico de barras comparando preços de API por milhão de tokens de entrada e saída entre modelos Kimi e Claude para programação

O padrão é claro: a vantagem de preço do Kimi existe inteiramente no K2.7 Code, seu modelo especializado em programação, a US$ 0,95/US$ 4. O K3, carro-chefe da linha, custa o mesmo que o Sonnet, enquanto o Opus 4.8 fica acima dos dois. Há ainda dois detalhes que afetam a conta final: os modelos Claude Opus 4.7 e posteriores usam um tokenizador mais novo que gera cerca de 30% mais tokens para o mesmo texto, segundo a documentação de preços da Anthropic; além disso, a Moonshot informou que as assinaturas Kimi e Kimi Code em breve serão divididas em planos separados.

Assinaturas: o plano Claude Pro custa US$ 20/mês, ou US$ 17 com cobrança anual, e inclui o Claude Code. O Max vai de US$ 100/mês, com 5x de uso, a US$ 200, com 20x. O Kimi inclui créditos do Kimi Code em suas faixas de assinatura: Andante ¥39, Moderato ¥79, Allegretto ¥159 e Allegro ¥559 por mês, com créditos de programação escalando em 1x / 4x / 20x / 60x entre elas. O local de compra também pesa: um gateway compatível com Anthropic, como o AIReiter, revende modelos Claude abaixo do preço de tabela. Portanto, o custo por token depende do fornecedor, não apenas do modelo.

O mesmo teste de código para os dois

Benchmarks costumam ser abstratos, então fiz um teste prático pequeno. O prompt pedia um avaliador de expressões em Python com suporte a + - * /, parênteses, menos unário e decimais, sem usar eval(). É um tipo clássico de problema que expõe erros de precedência e associatividade de operadores. Enviei exatamente o mesmo prompt ao Claude Opus 4.8 e ao Kimi K2.7 Code por um único endpoint de API e rodei cada resposta contra dez casos de teste.

Os dois acertaram 10/10. Não houve diferença de correção nessa tarefa: ambos lidaram bem com as armadilhas de precedência e com os casos extremos do menos unário. A diferença apareceu na velocidade e no tamanho das respostas:

CorreçãoLatênciaTokens de saída
Claude Opus 4.810/107,3s651
Kimi K2.7 Code10/1035,7s1.256
Gráfico de barras: Claude Opus 4.8 concluiu a mesma tarefa de programação em 7,3 segundos, contra 35,7 segundos do Kimi K2.7 Code

O Claude foi cerca de 5x mais rápido e gerou aproximadamente metade dos tokens para chegar à mesma resposta funcional. A solução do Kimi estava correta, mas foi mais prolixa e lenta. Trata-se de um único prompt, não de um benchmark: o K3 não podia ser chamado pelo meu endpoint, portanto o teste usa o K2.7 Code, que é o modelo para o qual o Kimi Code direciona nas faixas mais baixas. Considere isto um dado isolado e honesto: em uma tarefa que ambos resolvem, latência e economia de tokens ainda os diferenciam.

Como usar o Kimi dentro do Claude Code em 2 linhas

Na prática, você não precisa escolher uma única interface. O Claude Code lê duas variáveis de ambiente, então é possível manter a experiência dele e apontá-lo para os modelos da Kimi — uma configuração que muitos desenvolvedores procuram pelo nome.

export ANTHROPIC_BASE_URL=https://api.kimi.com/coding/
export ANTHROPIC_API_KEY=your_kimi_key
# then use model "k3" (or "k3[1m]" for the 1M window) and run:
claude

Execute /status. Se a URL base exibida for https://api.kimi.com/coding/, o Kimi estará conduzindo o Claude Code, sem alterar seus servidores MCP, hooks, CLAUDE.md e comandos com barra já existentes. A Moonshot documenta isso em seu guia oficial de integração com o Claude Code, e o mesmo truque com variáveis de ambiente permite conectar outros modelos de terceiros ao Claude Code.

Página da documentação oficial da Kimi mostrando como rodar modelos Kimi dentro do Claude Code por variáveis de ambiente

Essa é a configuração híbrida que uma parcela crescente de desenvolvedores descreve no X: a interface do Claude Code com os preços do Kimi para tarefas grandes em que vale consumir créditos baratos, e os modelos da Anthropic quando a confiabilidade é prioridade.

Quatro critérios mais importantes que benchmarks

Antes de se decidir, vale checar estes pontos. Eles pesam mais que qualquer pontuação isolada:

  • Para onde seu código é enviado. A API hospedada da Kimi roda em servidores na China. Em projetos pessoais, isso pode não fazer diferença; para código corporativo ou sujeito a regulação, pode ser um impedimento definitivo. O caminho de dados do Claude é mais comum em cenários corporativos.
  • Hospedagem própria. A previsão é que o Kimi K3 libere pesos abertos por volta de 27 de julho, criando uma opção para equipes que precisam de inferência on-premise — algo que a Anthropic não oferece. Se residência de dados for sua restrição, esse é o caminho alternativo.
  • Maturidade do ecossistema. O Claude Code tem mais tempo de mercado em integrações com IDEs, ferramentas de terceiros e confiabilidade em produção. O Kimi Code é mais novo e evolui rápido, mas sua comunidade ao redor ainda é menor.
  • O modelo importa mais que o logo. Como as duas interfaces podem rodar modelos de ambas as famílias, preço e qualidade acompanham muito mais o *modelo* escolhido do que a CLI que o envolve.

Qual deles vale rodar

Para a maioria dos desenvolvedores, Claude Code é a escolha padrão mais segura: o ecossistema é mais profundo, as respostas são rápidas e concisas, e o caminho de dados tende a passar por revisões corporativas. Prefira o Kimi Code quando o custo por token for decisivo, quando você precisar do K3 com contexto de 1M em um repositório grande ou quando pesos abertos e hospedagem própria forem importantes para conformidade. Quer economizar, mas não abre mão da interface do Claude Code? A configuração híbrida acima entrega os dois.

Preço, por si só, já não resolve a escolha. Decida com base em velocidade, tamanho de contexto, residência de dados e profundidade do ecossistema — os pontos em que essas duas opções realmente diferem.

Perguntas frequentes

Posso usar o Kimi Code no Claude Code?

Sim. Defina ANTHROPIC_BASE_URL como https://api.kimi.com/coding/ e ANTHROPIC_API_KEY com sua chave Kimi; depois, selecione o modelo k3, ou k3[1m] para contexto de 1M. A interface do Claude Code, os servidores MCP e os hooks continuam funcionando sem mudanças.

Kimi Code é mais barato que Claude Code?

Apenas com o modelo K2.7 Code, que custa US$ 0,95/US$ 4 por 1M de tokens. O K3, modelo principal da Kimi, custa US$ 3/US$ 15 — o mesmo que o Claude Sonnet — enquanto o Claude Opus 4.8 custa US$ 5/US$ 25. A antiga alegação de ser “10x mais barato” se baseava no modelo K2 anterior.

Qual é melhor para bases de código grandes?

O Kimi K3 oferece uma janela de contexto de 1M de tokens, útil para repositórios muito grandes. O Claude Code combina um fluxo de trabalho maduro de IDE e subagentes com modelos fortes; para a maioria dos projetos, esse ecossistema importa mais do que o tamanho bruto do contexto.

Em que tecnologia o Kimi Code roda?

Segundo a documentação da Moonshot, a CLI do Kimi Code é escrita em TypeScript, instalada via npm e executada em Node.js — a mesma pilha do Claude Code. Ambos também se integram ao VS Code e ao JetBrains.

O Kimi K3 é open source?

A expectativa é que a Moonshot libere os pesos abertos do K3 por volta de 27 de julho de 2026, permitindo hospedagem própria — algo que os modelos da Anthropic não oferecem.

Leituras relacionadas