O Grok 4.6 chegou em 12 de agosto de 2026, cinco dias depois da data sugerida pelas “duas semanas” de Elon Musk. À primeira vista, nada mudou na tabela: US$ 2,00 por milhão de tokens de entrada, US$ 6,00 de saída e 500K de contexto — exatamente as condições do Grok 4.5. Na prática, a conta mudou. A entrada em cache custa 67% mais do que na versão 4.5, e medições independentes indicam que o modelo usa mais tokens para concluir o mesmo trabalho.
O que chegou em 12 de agosto
O identificador do modelo é grok-4.6, e as notas de versão da SpaceXAI registram sua disponibilidade na API em 12 de agosto de 2026. A especificação documentada é esta:
| Propriedade | Grok 4.6 |
|---|---|
| ID do modelo | grok-4.6 |
| Contexto | 500K tokens |
| Entrada | Texto e imagem |
| Saída | Somente texto, sem limite de saída informado |
| Esforço de raciocínio | low, medium, high (padrão), xhigh |
| Corte de conhecimento | 1 de fevereiro de 2026 |
Duas dessas linhas são novidades. O xhigh é um quarto nível de raciocínio que o Grok 4.5 não oferece — a versão 4.5 vai apenas até high. A documentação também passou a informar o corte de conhecimento em 1 de fevereiro de 2026, um dado relevante para quem direcionava perguntas datadas para contornar esse ponto cego do modelo.
O catálogo de modelos posiciona o Grok 4.6 como carro-chefe para código e chat, marcado como Latest na barra lateral e com a página datada de 12 de agosto de 2026. O Grok 4.5 não foi aposentado: ele continua na página de preços, com suas próprias tarifas.
A distribuição foi ampla já no primeiro dia. O anúncio da SpaceXAI cita Cursor e Grok Build, ambos com 2x de uso incluído na primeira semana, além da API e de parceiros como OpenRouter, Vercel e Cloudflare. O texto também menciona uma variante rápida pelo dobro do preço; como ela ainda não aparece na página pública de preços, trate esse 2x como um número do anúncio, não como uma tarifa publicada.
Preço do Grok 4.6: tabela igual, cache mais caro
As tarifas de entrada e saída são as mesmas do Grok 4.5. O preço da entrada em cache, porém, mudou.
| Tarifa por 1M de tokens | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Entrada (abaixo de 200K) | US$ 2,00 | US$ 2,00 |
| Entrada em cache (abaixo de 200K) | US$ 0,30 | US$ 0,50 |
| Saída (abaixo de 200K) | US$ 6,00 | US$ 6,00 |
| Entrada / cache / saída (200K+) | US$ 4,00 / US$ 0,60 / US$ 12,00 | US$ 4,00 / US$ 1,00 / US$ 12,00 |
O desconto para entrada em cache caiu de 85% para 75%: são 20 centavos a mais por milhão de tokens em um item que cresce com as etapas de um agente, não com o número de tarefas. Um harness que reproduz 50M de tokens em cache por dia paga US$ 15,00 no 4.6, contra US$ 9,00 no 4.5.
A regra para contexto longo não mudou e continua pegando muita gente. Quando o prompt de uma requisição alcança 200K tokens, todos os tokens daquela requisição são cobrados pela faixa mais alta — uma chamada de 210K tokens custa US$ 4,00 por milhão de tokens de entrada sobre a requisição inteira, e não uma combinação das duas faixas. A listagem pública de modelos da OpenRouter informa os mesmos preços e a mesma substituição a partir de 200K, portanto usar uma rota de terceiros não altera essa conta.
Em quais avaliações oficiais o Grok 4.6 avança — e em quais fica atrás
A SpaceXAI publicou uma comparação de dez linhas contra Grok 4.5, GPT-5.6 Sol Max e Fable 5 Max. O Grok 4.6 lidera em três: GDPVal-AA v2 (1753), AA-Briefcase (1577) e Harvey LAB (15,8%). Ele perde nas outras sete. Estas são as oito linhas mais relevantes para decidir o roteamento:
| Avaliação | Grok 4.6 | Grok 4.5 | GPT-5.6 Sol | Fable 5 |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69,9% | 66,7% | 67,2% | 70,5% |
| DeepSWE v1.1 | 65,9% | 54% | 73% | 70% |
| FrontierCode v1.1 | 61,3% | 56,6% | 60,6% | 63,6% |
| APEX-Agents | 57,5% | 47,1% | 56,7% | 59,2% |
| Terminal-Bench v3.0 | 26% | 15,7% | 34,6% | 34,1% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
O Terminal-Bench é a diferença que merece atenção redobrada. O Grok 4.6 marca 26%, enquanto o GPT-5.6 Sol chega a 34,6% e o Fable 5, a 34,1% — terceiro lugar, com uma distância de oito pontos, na avaliação que mais se aproxima de um agente operando um shell. O DeepSWE conta a mesma história com outros números: 65,9%, contra 73% do Sol. Se sua carga de trabalho envolve agentes conduzidos pelo terminal, a própria tabela do fornecedor diz que este não é o modelo líder.
O avanço sobre o Grok 4.5 é real e consistente. Todas as linhas melhoraram, e APEX-Agents (de 47,1% para 57,5%) e Terminal-Bench (de 15,7% para 26%) avançaram mais de dez pontos. A SpaceXAI atribui o resultado a um ciclo adicional e mais longo de treinamento, trajetórias SFT regeneradas e RL agentivo em ambientes de programação e trabalho do conhecimento. Vale notar o que o anúncio não informa: a contagem de parâmetros. O número de 2 trilhões associado a este modelo veio de Musk, não do lançamento.
O custo mensurado desse ganho de inteligência
Tabelas de fornecedores mostram pontuações, mas não revelam quanto elas custaram. A Artificial Analysis publica ambos os dados, e sua medição de 13 de agosto expõe o verdadeiro trade-off do Grok 4.6.
| Medido no mesmo índice | Grok 4.5 (high) | Grok 4.6 (high) |
|---|---|---|
| Intelligence Index | 56 (#16 de 184) | 61 (#6 de 184) |
| Velocidade de saída | 56,9 tokens/s (#102) | 67,6 tokens/s (#74) |
| Tokens de saída gerados | 60M | 72M |
| Custo da avaliação completa | US$ 579,21 | US$ 1.068,47 |
Cinco pontos de inteligência custaram 1,8x mais. As tarifas de tabela são idênticas, mas a mesma suíte de benchmarks saiu US$ 489 mais cara: em parte pela maior verbosidade, com 72M de tokens de saída contra 60M, e em parte pelo reajuste do cache citado acima. A Artificial Analysis não divulga a composição do custo por item nessa execução; portanto, 1,8x é um total observado, não uma fórmula que possa ser refeita.
A velocidade melhorou: 67,6 tokens de saída por segundo, contra 56,9 no 4.5. Isso o tira da metade inferior e o leva para aproximadamente a mediana dos 184 modelos de sua categoria.
O que Musk prometeu e o que de fato foi lançado
O nome surgiu em uma resposta de três palavras. Em 18 de julho, respondendo a @minchoi, Musk escreveu: “Nosso modelo de 2T, que é melhor que o nosso 1,5T em todos os aspectos, terminará o treinamento inicial na próxima semana. Ele talvez consiga superar o Kimi, mas com velocidade e eficiência de tokens próximas às do nosso 1,5T, também conhecido como Grok 4.5.” Quando Andrew Curran perguntou se se tratava do Grok 4.6, ele respondeu: “Yeah, Grok 4.6.”
Em 24 de julho, veio o cronograma: “Grok 4.6 em 2 semanas e Grok 4.7 em 4 semanas.” Duas semanas a partir dessa data levam a aproximadamente 7 de agosto; o modelo foi lançado em 12 de agosto, cinco dias depois.
Três afirmações dessas publicações não se sustentaram integralmente no lançamento:
- 2 trilhões de parâmetros continuam sem confirmação. O anúncio, a documentação do modelo e as notas de versão da SpaceXAI não informam uma contagem de parâmetros para o Grok 4.6.
- “Eficiência de tokens próxima à do Grok 4.5” é contrariada pela medição da Artificial Analysis: 72M de tokens de saída contra 60M na mesma avaliação.
- “Talvez supere o Kimi” segue sem teste contra o K3 da Moonshot na tabela da SpaceXAI, que compara o modelo apenas com GPT-5.6 Sol e Fable 5.
Vale migrar do Grok 4.5 para o Grok 4.6?
Sim, para trabalho agentivo e de conhecimento caso você venha do Grok 4.5 — mas confira a fatura de tokens após uma semana, e não apenas no momento da migração. O Grok 4.5 continua disponível com as tarifas antigas, então a mudança é reversível e deve ser medida, não presumida.
Migre agora se seu trabalho envolve agentes de longo horizonte ou tarefas de conhecimento: o APEX-Agents sobe 10,4 pontos, o GDPVal-AA avança 227, e a geração mais rápida se acumula em execuções com várias etapas. Fique no 4.5 se seu tráfego usa muito cache e é sensível a preço — o aumento de 67% na leitura de cache é uma regressão real, e as pontuações do 4.5 não caíram quando o 4.6 chegou. Para agentes de terminal especificamente, procure alternativas: a própria tabela da SpaceXAI coloca o Grok 4.6 oito pontos atrás do GPT-5.6 Sol e do Fable 5.
Confira três pontos antes de alterar uma rota em produção:
- Entenda que os dois IDs são aliases. As regras de alias da SpaceXAI apontam
grok-4.6para a compilação estável mais recente egrok-4.6-latestpara a mais nova; apenas um ID datado no formato<modelname>-<date>é imutável, e nem o catálogo de modelos nem a OpenRouter listam uma variante datada do 4.6. Fluxos de trabalho reprodutíveis não têm hoje uma versão que possa ser fixada. - Teste novamente o esforço de raciocínio. O novo nível
xhighnão é uma atualização gratuita: ele consome mais tokens em um modelo que já foi medido como mais verboso do que seu antecessor. O padrãohighé a comparação equivalente com o 4.5. - Confirme se seu provedor já o oferece. A disponibilidade no primeiro dia na SpaceXAI não significa disponibilidade imediata em todos os lugares. Ao consultar
/v1/modelsem 13 de agosto, tanto a API oficial quanto a OpenRouter retornaramgrok-4.6, enquanto um endpoint de revendedor compatível com OpenAI que testei ainda ia apenas atégrok-4.5e rejeitou o novo ID commodel_not_found. Antes de rotear tráfego, confirme com sua própria chave que o ID exato responde.
Perguntas frequentes
Quanto custa a API do Grok 4.6?
US$ 2,00 por milhão de tokens de entrada e US$ 6,00 por milhão de tokens de saída abaixo de 200K de contexto, com entrada em cache a US$ 0,50. Acima de 200K tokens no prompt, a requisição inteira é cobrada a US$ 4,00 para entrada, US$ 1,00 para cache e US$ 12,00 para saída. O anúncio menciona uma variante rápida pelo dobro do preço, mas ela não aparece na página pública de preços.
O Grok 4.6 é melhor que o Grok 4.5?
Em todos os benchmarks publicados pela SpaceXAI, sim: 61 contra 56 no AA Intelligence Index, com os maiores avanços nas avaliações agentivas. A medição independente traz uma ressalva: ele gerou 72M de tokens de saída, contra 60M do Grok 4.5, na mesma avaliação; por isso, a mesma tarefa custa mais.
Quantos parâmetros o Grok 4.6 tem?
Não divulgado. Musk descreveu um modelo de 2 trilhões de parâmetros em 18 de julho de 2026 e confirmou o nome, mas os materiais de lançamento da SpaceXAI não trazem contagem de parâmetros, detalhes da arquitetura nem uma declaração sobre quantos parâmetros são ativados por token.
Qual é a janela de contexto e o corte de conhecimento do Grok 4.6?
São 500K tokens de contexto, com entrada de texto e imagem e saída somente em texto. A documentação informa corte de conhecimento em 1 de fevereiro de 2026, e o modelo não tem acesso a eventos posteriores sem Web Search ou X Search no servidor habilitados.
O Grok é feito pela xAI ou pela SpaceXAI?
Os dois nomes se referem à mesma empresa. A documentação para desenvolvedores se chama “SpaceXAI Docs”, e o rodapé do anúncio ainda informa X.AI LLC, após a mudança de 2026 para a SpaceX. Os domínios x.ai e os IDs de modelo grok-* não foram renomeados.
Quando sai o Grok 4.7?
Nenhuma data foi anunciada. A publicação de Musk em 24 de julho colocou o Grok 4.7 a cerca de quatro semanas de distância, apontando para aproximadamente 21 de agosto de 2026, e o Grok 4.6 chegou cinco dias após a data que suas próprias previsões sugeriam.
Leituras relacionadas
- Grok 4.5: tudo o que sabemos até agora
- GPT-5.6 Sol e Terra vs. Grok 4.5
- Claude Opus 5: o que está confirmado
Preços, IDs de modelos e números dos benchmarks verificados na documentação da SpaceXAI, no anúncio do Grok 4.6 e na Artificial Analysis em 13 de agosto de 2026.