AIREITER

Preços e análise de programação da API do Grok 4.7

Última Atualização: 2026-09-21 20:02:18

Se você está avaliando o Grok 4.7 para um fluxo de trabalho via API, a manchete está correta — mas conta só parte da história: a documentação da xAI informa US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída na API padrão. O Grok 4.7 é oferecido oficialmente pelo identificador de modelo grok-4.7, mas o gateway escolhido, o roteamento regional nos EUA, o cache e o uso de contexto longo podem mudar bastante o valor final da cobrança.

Resposta curta: o acesso existe, mas US$ 2/US$ 6 é apenas a referência direta

O Grok 4.7 não é apenas um rumor nem um nome restrito ao chat. A página oficial da xAI, atualizada em 21 de setembro de 2026, documenta o acesso à API tanto pela Responses API quanto pelo Chat Completions. A especificação inclui janela de contexto de 500.000 tokens, entrada de texto e imagem, saída de texto, chamadas de função, busca na web, busca no X e execução de código.

A tarifa de US$ 2/US$ 6 foi confirmada especificamente como o preço direto padrão:

Rota ou modo de usoEntradaSaídaO que isso significa
API direta da xAI, padrãoUS$ 2,00/MUS$ 6,00/MReferência oficial para o grok-4.7
Endpoint regional da xAI nos EUAUS$ 2,20/M*US$ 6,60/M*Adicional de 10% sobre o preço padrão
Listagem padrão da OpenRouterUS$ 1,60/MUS$ 4,80/MPreço do gateway/provedor, não a tarifa direta da xAI
Promoção da Vercel AI GatewayUS$ 1,20/MUS$ 3,60/MPreço promocional exibido até 27 de setembro de 2026

*Os valores para os EUA são calculados a partir do adicional de 10% documentado pela xAI, e não aparecem como preços de destaque separados. Para o uso direto da xAI, faça o orçamento com US$ 2/US$ 6; trate as tarifas de gateways como específicas de cada rota e confirme suas condições e disponibilidade.

O que a xAI oferece oficialmente

O identificador oficial do modelo é grok-4.7. A xAI apresenta três formas compatíveis de acesso: pelo SDK, por um cliente compatível com a OpenAI apontado para https://api.x.ai/v1 e por uma requisição POST direta para https://api.x.ai/v1/responses.

A especificação documentada é especialmente relevante para agentes:

EspecificaçãoValor documentado pela xAI
Janela de contexto500.000 tokens
Data de corte do conhecimentoMaio de 2026
Níveis de raciocínioLow, medium, high, xhigh
Raciocínio padrãoHigh
EntradaTexto e imagens
SaídaTexto
APIsResponses API e Chat Completions
FerramentasChamadas de função, busca na web, busca no X e execução de código
Preço padrão de entradaUS$ 2/M tokens
Preço padrão de saídaUS$ 6/M tokens

O exemplo da documentação pede que o modelo encontre e explique um bug em uma função JavaScript que calcula a mediana. Isso demonstra a integração com a API, não a qualidade da programação. A página não traz uma tabela de benchmark independente, resultados de latência, compromisso de disponibilidade nem taxa de conclusão de tarefas.

Preços da API do Grok 4.7: detalhes que podem mudar a conta

API direta e preços via gateway

A página do modelo na OpenRouter informa US$ 1,60/M para entrada, US$ 4,80/M para saída e US$ 0,40/M para leituras em cache. Já a página da Vercel AI Gateway mostra uma redução promocional de 40%, para US$ 1,20/M e US$ 3,60/M, com término previsto para 27 de setembro de 2026.

Os preços dos gateways podem refletir promoções ou roteamentos diferentes. Compare o custo completo das requisições, e não apenas as tarifas de destaque por token.

Roteamento regional nos EUA

A xAI documenta https://us.api.x.ai/v1 como um endpoint regional nos EUA, com adicional de 10% sobre o uso de tokens. Na tarifa padrão, isso equivale a US$ 2,20/M para entrada e US$ 6,60/M para saída.

O cache faz diferença em prompts repetidos de repositórios

A xAI recomenda um identificador para o roteamento de cache: prompt_cache_key na Responses API ou o cabeçalho x-grok-conv-id no Chat Completions. Encaminhar turnos repetidos para o mesmo servidor aumenta a confiabilidade dos acertos de cache; quando o cache está frio, você pode pagar o preço integral da entrada.

A tabela de preços do Grok 4.7 no Cursor oferece uma referência em ambiente hospedado: US$ 0,50/M para leituras em cache na categoria padrão, contra US$ 2/M para entradas sem cache. Essa é a superfície de cobrança do Cursor, não uma garantia de que a API direta da xAI use exatamente o mesmo preço de cache.

Contexto longo não é contexto grátis

O Cursor lista 256 mil tokens como contexto padrão e 500 mil como máximo. A documentação informa que requisições acima de 256 mil usam tarifas mais altas para contexto longo: o uso padrão custa o dobro, enquanto o modo Fast custa o triplo.

A xAI confirma a capacidade de contexto de 500 mil tokens, mas não publica um multiplicador separado para contexto longo no resumo do modelo. Consulte as regras de cobrança da rota escolhida antes de presumir que 500 mil tokens serão cobrados pela tarifa básica.

O que as evidências publicadas sustentam — e o que não sustentam

O caso documentado para o Grok 4.7 é o trabalho prolongado com agentes. xAI, Cursor e OpenRouter posicionam o modelo para programação, engenharia de software de longa duração, autoverificação e contextos extensos. A documentação do modelo no Cursor lista busca de arquivos, edição de arquivos, comandos de shell, controle do navegador, acesso à web, geração de imagens e perguntas de esclarecimento no ambiente de agente.

Esses recursos justificam um piloto de programação, mas não provam que o modelo seja melhor para corrigir bugs, passar em testes ou reduzir o custo por tarefa. Execute um teste reproduzível no seu repositório e registre o sucesso das tarefas, as tentativas repetidas, as chamadas de ferramentas, o tempo total e o número de tokens usados.

O nível de esforço vai de low a xhigh, com high como padrão. Níveis mais altos podem aumentar o tempo de execução e alterar o consumo; confirme como o seu provedor informa e cobra o uso de raciocínio antes de projetar os custos de produção.

O trabalho de conhecimento atual exige recuperação de informação

O Grok 4.7 aceita imagens, oferece busca na web e no X e tem data de corte do conhecimento em maio de 2026. Para pesquisas atuais, use recuperação de informação ou busca e avalie a precisão das citações, a cobertura das fontes, o número de revisões e o tempo de correção humana — não apenas a qualidade do texto.

Quanto custariam dois exemplos de loops de agente

Use este modelo simples para a tarifa direta padrão:

custo = (tokens_de_entrada / 1.000.000 × US$ 2) + (tokens_de_saída / 1.000.000 × US$ 6)

Exemplo de requisiçãoCusto de entradaCusto de saídaCusto dos tokens
100 mil de entrada + 20 mil de saídaUS$ 0,20US$ 0,12US$ 0,32
500 mil de entrada + 50 mil de saídaUS$ 1,00US$ 0,30US$ 1,30

O segundo exemplo usa a tarifa básica apenas como referência. O valor pode aumentar com o adicional regional, multiplicadores de contexto longo em uma rota hospedada, prompts repetidos sem cache, regras específicas de raciocínio do provedor e requisições adicionais. Um agente de programação que faça dez requisições pode custar muito mais do que uma única requisição com 500 mil tokens.

Como verificar o acesso antes de assumir um compromisso

  1. Use o identificador oficial do modelo. Envie grok-4.7, não um alias chutado nem um nome específico de gateway.
  2. Comece com uma requisição pequena pela Responses API. A xAI documenta POST https://api.x.ai/v1/responses com autenticação Bearer e uma entrada de texto.
  3. Registre o uso na resposta e na fatura. Capture os tokens de entrada, os tokens de saída, o uso de raciocínio, se estiver disponível, as chamadas de ferramentas e o valor cobrado.
  4. Teste o cache separadamente. Repita o mesmo prompt de sistema longo usando prompt_cache_key e compare a cobrança de entrada da segunda requisição.
  5. Teste sua faixa de contexto. Faça uma execução abaixo de 256 mil tokens e outra acima desse limite se a aplicação precisar de contexto longo de repositórios.
  6. Escolha o endpoint de forma deliberada. Use o endpoint padrão para estabelecer a economia de referência; recorra ao endpoint regional nos EUA apenas quando o benefício de localização dos dados justificar o adicional de 10%.
  7. Trate os preços dos gateways como produtos separados. Confirme o fim da promoção, o roteamento do provedor, o comportamento de fallback, as políticas de retenção de dados e as cobranças específicas da rota antes de usar US$ 1,20/US$ 3,60 ou US$ 1,60/US$ 4,80 em uma projeção.
  8. Meça as tarefas concluídas. Em programação, acompanhe os testes aprovados, as tentativas repetidas, as chamadas de ferramentas, o tempo total e o custo total por alteração aceita.

FAQ da API do Grok 4.7

O Grok 4.7 está disponível pela API oficial?

Sim. A documentação da xAI lista o modelo grok-4.7 para a Responses API e o Chat Completions, com exemplos usando SDK, cliente compatível com a OpenAI e cURL.

US$ 2 para entrada e US$ 6 para saída é o preço confirmado?

Sim, para a tarifa padrão da API direta da xAI documentada em 21 de setembro de 2026. Um endpoint regional nos EUA acrescenta 10%, enquanto os gateways podem exibir preços ou promoções diferentes.

O Grok 4.7 é bom para programação?

É um candidato razoável para um piloto com agentes de programação de longa duração, já que o design documentado inclui uso de ferramentas, raciocínio ajustável, orientações para compactação de contexto e contexto de até 500 mil tokens. As fontes disponíveis não comprovam de forma independente uma vantagem em programação; por isso, teste o modelo nas tarefas do seu próprio repositório.

O Grok 4.7 tem janela de contexto de 500 mil tokens?

Sim. A xAI informa 500.000 tokens. O Cursor descreve separadamente 256 mil como seu contexto padrão e 500 mil como o nível máximo, com preços mais altos acima de 256 mil.

O Grok 4.7 Fast está disponível pela API pública?

Não. A documentação do Grok 4.7 da xAI descreve o Grok 4.7 Fast como o mesmo modelo executado em uma infraestrutura mais rápida, com o dobro das tarifas padrão, mas informa que ele não está disponível pela API pública da xAI. O modelo aparece listado no Cursor e no Grok Build.

A decisão: faça um piloto, mas calcule o orçamento com a rota que você realmente usará

O acesso à API do Grok 4.7 e a referência de US$ 2/US$ 6 estão confirmados; a vantagem em programação, não. Se o seu fluxo enviar mais de 256 mil tokens, depender de contexto de repositório sem cache, usar roteamento nos EUA ou disparar muitas chamadas de raciocínio, o custo por tarefa concluída pode ser bem diferente. Comece com um piloto medido antes de migrar cargas de trabalho de produção.