AIREITER

API do Grok 4.6: preços, benchmarks e o que mudou

Última Atualização: 2026-08-13 02:28:30

O Grok 4.6 chegou em 12 de agosto de 2026, cinco dias depois da data sugerida pelas “duas semanas” de Elon Musk. À primeira vista, nada mudou na tabela: US$ 2,00 por milhão de tokens de entrada, US$ 6,00 de saída e 500K de contexto — exatamente as condições do Grok 4.5. Na prática, a conta mudou. A entrada em cache custa 67% mais do que na versão 4.5, e medições independentes indicam que o modelo usa mais tokens para concluir o mesmo trabalho.

O que chegou em 12 de agosto

O identificador do modelo é grok-4.6, e as notas de versão da SpaceXAI registram sua disponibilidade na API em 12 de agosto de 2026. A especificação documentada é esta:

PropriedadeGrok 4.6
ID do modelogrok-4.6
Contexto500K tokens
EntradaTexto e imagem
SaídaSomente texto, sem limite de saída informado
Esforço de raciocíniolow, medium, high (padrão), xhigh
Corte de conhecimento1 de fevereiro de 2026
Entrada nas notas de versão da SpaceXAI, datada de 12 de agosto de 2026, anunciando o Grok 4.6 na API da xAI com sua janela de contexto e preços

Duas dessas linhas são novidades. O xhigh é um quarto nível de raciocínio que o Grok 4.5 não oferece — a versão 4.5 vai apenas até high. A documentação também passou a informar o corte de conhecimento em 1 de fevereiro de 2026, um dado relevante para quem direcionava perguntas datadas para contornar esse ponto cego do modelo.

O catálogo de modelos posiciona o Grok 4.6 como carro-chefe para código e chat, marcado como Latest na barra lateral e com a página datada de 12 de agosto de 2026. O Grok 4.5 não foi aposentado: ele continua na página de preços, com suas próprias tarifas.

Documentação para desenvolvedores da SpaceXAI mostrando o Grok 4.6 marcado como New, com contexto de 500k e preços de US$ 2,00 para entrada e US$ 6,00 para saída

A distribuição foi ampla já no primeiro dia. O anúncio da SpaceXAI cita Cursor e Grok Build, ambos com 2x de uso incluído na primeira semana, além da API e de parceiros como OpenRouter, Vercel e Cloudflare. O texto também menciona uma variante rápida pelo dobro do preço; como ela ainda não aparece na página pública de preços, trate esse 2x como um número do anúncio, não como uma tarifa publicada.

Preço do Grok 4.6: tabela igual, cache mais caro

As tarifas de entrada e saída são as mesmas do Grok 4.5. O preço da entrada em cache, porém, mudou.

Tarifa por 1M de tokensGrok 4.5Grok 4.6
Entrada (abaixo de 200K)US$ 2,00US$ 2,00
Entrada em cache (abaixo de 200K)US$ 0,30US$ 0,50
Saída (abaixo de 200K)US$ 6,00US$ 6,00
Entrada / cache / saída (200K+)US$ 4,00 / US$ 0,60 / US$ 12,00US$ 4,00 / US$ 1,00 / US$ 12,00
Gráfico de barras agrupadas comparando as tarifas de entrada, entrada em cache e saída do Grok 4.5 e do Grok 4.6 abaixo de 200K de contexto

O desconto para entrada em cache caiu de 85% para 75%: são 20 centavos a mais por milhão de tokens em um item que cresce com as etapas de um agente, não com o número de tarefas. Um harness que reproduz 50M de tokens em cache por dia paga US$ 15,00 no 4.6, contra US$ 9,00 no 4.5.

A regra para contexto longo não mudou e continua pegando muita gente. Quando o prompt de uma requisição alcança 200K tokens, todos os tokens daquela requisição são cobrados pela faixa mais alta — uma chamada de 210K tokens custa US$ 4,00 por milhão de tokens de entrada sobre a requisição inteira, e não uma combinação das duas faixas. A listagem pública de modelos da OpenRouter informa os mesmos preços e a mesma substituição a partir de 200K, portanto usar uma rota de terceiros não altera essa conta.

Em quais avaliações oficiais o Grok 4.6 avança — e em quais fica atrás

A SpaceXAI publicou uma comparação de dez linhas contra Grok 4.5, GPT-5.6 Sol Max e Fable 5 Max. O Grok 4.6 lidera em três: GDPVal-AA v2 (1753), AA-Briefcase (1577) e Harvey LAB (15,8%). Ele perde nas outras sete. Estas são as oito linhas mais relevantes para decidir o roteamento:

Tabela oficial de avaliações da SpaceXAI comparando o Grok 4.6 com Grok 4.5, GPT-5.6 Sol e Fable 5 em dez benchmarks
AvaliaçãoGrok 4.6Grok 4.5GPT-5.6 SolFable 5
AA Intelligence Index61566162
GDPVal-AA v21753152617281741
CursorBench v3.269,9%66,7%67,2%70,5%
DeepSWE v1.165,9%54%73%70%
FrontierCode v1.161,3%56,6%60,6%63,6%
APEX-Agents57,5%47,1%56,7%59,2%
Terminal-Bench v3.026%15,7%34,6%34,1%
AA-Briefcase1577131315021574

O Terminal-Bench é a diferença que merece atenção redobrada. O Grok 4.6 marca 26%, enquanto o GPT-5.6 Sol chega a 34,6% e o Fable 5, a 34,1% — terceiro lugar, com uma distância de oito pontos, na avaliação que mais se aproxima de um agente operando um shell. O DeepSWE conta a mesma história com outros números: 65,9%, contra 73% do Sol. Se sua carga de trabalho envolve agentes conduzidos pelo terminal, a própria tabela do fornecedor diz que este não é o modelo líder.

O avanço sobre o Grok 4.5 é real e consistente. Todas as linhas melhoraram, e APEX-Agents (de 47,1% para 57,5%) e Terminal-Bench (de 15,7% para 26%) avançaram mais de dez pontos. A SpaceXAI atribui o resultado a um ciclo adicional e mais longo de treinamento, trajetórias SFT regeneradas e RL agentivo em ambientes de programação e trabalho do conhecimento. Vale notar o que o anúncio não informa: a contagem de parâmetros. O número de 2 trilhões associado a este modelo veio de Musk, não do lançamento.

O custo mensurado desse ganho de inteligência

Tabelas de fornecedores mostram pontuações, mas não revelam quanto elas custaram. A Artificial Analysis publica ambos os dados, e sua medição de 13 de agosto expõe o verdadeiro trade-off do Grok 4.6.

Medido no mesmo índiceGrok 4.5 (high)Grok 4.6 (high)
Intelligence Index56 (#16 de 184)61 (#6 de 184)
Velocidade de saída56,9 tokens/s (#102)67,6 tokens/s (#74)
Tokens de saída gerados60M72M
Custo da avaliação completaUS$ 579,21US$ 1.068,47
Gráfico de barras comparando o custo de executar o Artificial Analysis Intelligence Index no Grok 4.5 e no Grok 4.6

Cinco pontos de inteligência custaram 1,8x mais. As tarifas de tabela são idênticas, mas a mesma suíte de benchmarks saiu US$ 489 mais cara: em parte pela maior verbosidade, com 72M de tokens de saída contra 60M, e em parte pelo reajuste do cache citado acima. A Artificial Analysis não divulga a composição do custo por item nessa execução; portanto, 1,8x é um total observado, não uma fórmula que possa ser refeita.

A velocidade melhorou: 67,6 tokens de saída por segundo, contra 56,9 no 4.5. Isso o tira da metade inferior e o leva para aproximadamente a mediana dos 184 modelos de sua categoria.

O que Musk prometeu e o que de fato foi lançado

O nome surgiu em uma resposta de três palavras. Em 18 de julho, respondendo a @minchoi, Musk escreveu: “Nosso modelo de 2T, que é melhor que o nosso 1,5T em todos os aspectos, terminará o treinamento inicial na próxima semana. Ele talvez consiga superar o Kimi, mas com velocidade e eficiência de tokens próximas às do nosso 1,5T, também conhecido como Grok 4.5.” Quando Andrew Curran perguntou se se tratava do Grok 4.6, ele respondeu: “Yeah, Grok 4.6.”

Thread de Elon Musk no X descrevendo um modelo de 2T melhor que o Grok 4.5 de 1,5T, seguida por sua resposta de três palavras confirmando o nome Grok 4.6

Em 24 de julho, veio o cronograma: “Grok 4.6 em 2 semanas e Grok 4.7 em 4 semanas.” Duas semanas a partir dessa data levam a aproximadamente 7 de agosto; o modelo foi lançado em 12 de agosto, cinco dias depois.

Post de Elon Musk no X dizendo Grok 4.6 em 2 semanas e Grok 4.7 em 4 semanas, em resposta ao seu gráfico de fronteira de Pareto do FrontierCode

Três afirmações dessas publicações não se sustentaram integralmente no lançamento:

  • 2 trilhões de parâmetros continuam sem confirmação. O anúncio, a documentação do modelo e as notas de versão da SpaceXAI não informam uma contagem de parâmetros para o Grok 4.6.
  • “Eficiência de tokens próxima à do Grok 4.5” é contrariada pela medição da Artificial Analysis: 72M de tokens de saída contra 60M na mesma avaliação.
  • “Talvez supere o Kimi” segue sem teste contra o K3 da Moonshot na tabela da SpaceXAI, que compara o modelo apenas com GPT-5.6 Sol e Fable 5.

Vale migrar do Grok 4.5 para o Grok 4.6?

Sim, para trabalho agentivo e de conhecimento caso você venha do Grok 4.5 — mas confira a fatura de tokens após uma semana, e não apenas no momento da migração. O Grok 4.5 continua disponível com as tarifas antigas, então a mudança é reversível e deve ser medida, não presumida.

Migre agora se seu trabalho envolve agentes de longo horizonte ou tarefas de conhecimento: o APEX-Agents sobe 10,4 pontos, o GDPVal-AA avança 227, e a geração mais rápida se acumula em execuções com várias etapas. Fique no 4.5 se seu tráfego usa muito cache e é sensível a preço — o aumento de 67% na leitura de cache é uma regressão real, e as pontuações do 4.5 não caíram quando o 4.6 chegou. Para agentes de terminal especificamente, procure alternativas: a própria tabela da SpaceXAI coloca o Grok 4.6 oito pontos atrás do GPT-5.6 Sol e do Fable 5.

Confira três pontos antes de alterar uma rota em produção:

  1. Entenda que os dois IDs são aliases. As regras de alias da SpaceXAI apontam grok-4.6 para a compilação estável mais recente e grok-4.6-latest para a mais nova; apenas um ID datado no formato <modelname>-<date> é imutável, e nem o catálogo de modelos nem a OpenRouter listam uma variante datada do 4.6. Fluxos de trabalho reprodutíveis não têm hoje uma versão que possa ser fixada.
  2. Teste novamente o esforço de raciocínio. O novo nível xhigh não é uma atualização gratuita: ele consome mais tokens em um modelo que já foi medido como mais verboso do que seu antecessor. O padrão high é a comparação equivalente com o 4.5.
  3. Confirme se seu provedor já o oferece. A disponibilidade no primeiro dia na SpaceXAI não significa disponibilidade imediata em todos os lugares. Ao consultar /v1/models em 13 de agosto, tanto a API oficial quanto a OpenRouter retornaram grok-4.6, enquanto um endpoint de revendedor compatível com OpenAI que testei ainda ia apenas até grok-4.5 e rejeitou o novo ID com model_not_found. Antes de rotear tráfego, confirme com sua própria chave que o ID exato responde.

Perguntas frequentes

Quanto custa a API do Grok 4.6?

US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída abaixo de 200K de contexto, com entrada em cache a US$ 0,50. Acima de 200K tokens no prompt, a requisição inteira é cobrada a US$ 4,00 para entrada, US$ 1,00 para cache e US$ 12,00 para saída. O anúncio menciona uma variante rápida pelo dobro do preço, mas ela não aparece na página pública de preços.

O Grok 4.6 é melhor que o Grok 4.5?

Em todos os benchmarks publicados pela SpaceXAI, sim: 61 contra 56 no AA Intelligence Index, com os maiores avanços nas avaliações agentivas. A medição independente traz uma ressalva: ele gerou 72M de tokens de saída, contra 60M do Grok 4.5, na mesma avaliação; por isso, a mesma tarefa custa mais.

Quantos parâmetros o Grok 4.6 tem?

Não divulgado. Musk descreveu um modelo de 2 trilhões de parâmetros em 18 de julho de 2026 e confirmou o nome, mas os materiais de lançamento da SpaceXAI não trazem contagem de parâmetros, detalhes da arquitetura nem uma declaração sobre quantos parâmetros são ativados por token.

Qual é a janela de contexto e o corte de conhecimento do Grok 4.6?

São 500K tokens de contexto, com entrada de texto e imagem e saída somente em texto. A documentação informa corte de conhecimento em 1 de fevereiro de 2026, e o modelo não tem acesso a eventos posteriores sem Web Search ou X Search no servidor habilitados.

O Grok é feito pela xAI ou pela SpaceXAI?

Os dois nomes se referem à mesma empresa. A documentação para desenvolvedores se chama “SpaceXAI Docs”, e o rodapé do anúncio ainda informa X.AI LLC, após a mudança de 2026 para a SpaceX. Os domínios x.ai e os IDs de modelo grok-* não foram renomeados.

Quando sai o Grok 4.7?

Nenhuma data foi anunciada. A publicação de Musk em 24 de julho colocou o Grok 4.7 a cerca de quatro semanas de distância, apontando para aproximadamente 21 de agosto de 2026, e o Grok 4.6 chegou cinco dias após a data que suas próprias previsões sugeriam.

Leituras relacionadas

Preços, IDs de modelos e números dos benchmarks verificados na documentação da SpaceXAI, no anúncio do Grok 4.6 e na Artificial Analysis em 13 de agosto de 2026.