Se a prioridade é custo, escolha o DeepSeek V4 Pro; se é latência, o Grok leva vantagem. Esse padrão se manteve nas sete tarefas que executei pelas duas APIs. Há, porém, uma ressalva importante: a própria página de preços do DeepSeek avisa sobre um aumento significativo, o que pode eliminar boa parte da diferença que sustenta essa recomendação.
O que está realmente em comparação em agosto de 2026
Os dois modelos mudaram de identidade na semana anterior a este comparativo. O Grok 4.6 passou a ocupar a posição Latest na documentação de modelos da xAI, apresentado como o carro-chefe "for code and everything else", enquanto o DeepSeek V4 Pro é atualmente servido pelo snapshot DeepSeek-V4-Pro-0813. Nenhuma dessas mudanças aparece no ID do modelo usado pela API.
A string de versão do DeepSeek aparece apenas na linha MODEL VERSION da página de preços. A API continua respondendo ao simples deepseek-v4-pro, sem sufixo de data. Assim, uma requisição enviada hoje e outra enviada em julho parecem idênticas nos logs, embora possam estar chegando a pesos diferentes.
A seguir está a comparação completa de especificações e preços, com dados das páginas de preços da xAI e do DeepSeek em 13 de agosto de 2026:
| Grok 4.6 | DeepSeek V4 Pro (0813) | |
|---|---|---|
| Janela de contexto | 500K | 1M |
| Saída máxima | Não publicada | 384K |
| Entrada / 1M | US$ 2,00 | US$ 0,435 |
| Entrada em cache / 1M | US$ 0,50 | US$ 0,003625 |
| Saída / 1M | US$ 6,00 | US$ 0,87 |
| Tarifa para contexto longo | 2x em todas as tarifas com prompt ≥200K | Nenhuma |
| Entrada de imagem | Sim | Não |
| Chamadas de ferramentas | Sim | Sim |
| Raciocínio | Configurável | Thinking / non-thinking |
| Corte de conhecimento | 1 de fevereiro de 2026 | Não publicado |
O Grok 4.6 manteve inalteradas as tarifas de destaque do Grok 4.5: US$ 2,00 para entrada e US$ 6,00 para saída. O preço que mudou foi o da entrada em cache: a mesma tabela da xAI lista US$ 0,30 para o Grok 4.5 e US$ 0,50 para o Grok 4.6. Na prática, reaproveitar o cache ficou 67% mais caro no modelo novo.
Gateways de terceiros ainda entregam o Grok 4.5
O fato de o modelo estar disponível na documentação da xAI não significa que ele esteja disponível em todos os canais pelos quais você compra tokens. No gateway usado para os testes, grok-4.6 retornou o erro model_not_found, e os aliases grok-latest e grok foram resolvidos para grok-4.5-build. Se você acessa o Grok por um revendedor, e não pela API da própria xAI, confirme para qual versão o alias aponta antes de assumir que está usando um modelo específico.
Esse atraso também explica por que as medições abaixo foram feitas com o grok-4.5, e não com o 4.6. Como ambos têm o mesmo preço de entrada e saída, as conclusões de custo se aplicam; os resultados de precisão por tarefa, no entanto, são do 4.5.
O cumprimento de instruções é onde eles de fato se separam
Em sete tarefas verificadas mecanicamente, seis terminaram empatadas e uma mostrou uma diferença decisiva. A tarefa que os separou exigia exatamente quatro linhas, cada uma terminando com uma descrição de exatamente cinco palavras. O DeepSeek V4 Pro acertou 5 de 5 tentativas; o Grok acertou 0 de 5.
As falhas do Grok não foram a repetição de um único bug. Em duas execuções, ele imprimiu uma chamada bruta da ferramenta web_search como texto da resposta, em vez de responder. Uma delas dizia, na íntegra, "I need accurate information on the four stages of canary deployment. Let me search for that." Em duas outras, a estrutura de quatro linhas estava correta, mas as descrições tinham quatro e seis palavras. Em uma execução, o modelo levou 130 segundos e gerou 10.357 tokens de saída, retornando 331 linhas.
O vazamento provavelmente é responsabilidade do gateway, não do modelo: ele transforma um prompt de 6 tokens em 201 tokens de entrada reportados, o que sugere um preâmbulo injetado declarando as ferramentas server-side da xAI. Os erros de contagem de palavras são outra questão. Nessas execuções, o modelo respondeu normalmente, mas ainda assim ignorou a restrição.
Metodologia: deepseek-v4-pro e grok-4.5 no mesmo gateway compatível com OpenAI, nas configurações padrão; uma execução por tarefa, exceto a tarefa de formatação, rodada cinco vezes para cada modelo. Todas as tarefas tinham respostas verificadas mecanicamente, portanto a pontuação não envolveu um modelo juiz. As seis tarefas empatadas aparecem pelo nome na tabela de custos abaixo.
Os dois aceitaram uma premissa falsa
A sétima tarefa inseria dois erros no prompt: que o DeepSeek V4 Pro tem uma janela de contexto de 128K e que o Grok 4.6 foi lançado em janeiro de 2026 com contexto de 2M. Depois, perguntei qual usar para um corpus de 900.000 tokens. Nenhum dos dois contestou qualquer um dos números. Ambos raciocinaram corretamente a partir dos dados errados e recomendaram o Grok com confiança.
Se você colar especificações desatualizadas em um prompt e pedir uma recomendação, os dois modelos podem entregar uma resposta errada, mas bem fundamentada, em vez de corrigir a premissa.
Mesmo gerando menos tokens, o Grok custou 5,7x mais
Nas seis tarefas que ambos concluíram, o Grok gerou 5.275 tokens de saída, contra 6.331 do DeepSeek: 17% menos. Ainda assim, pelos preços oficiais de saída de cada modelo, as mesmas respostas custaram US$ 0,0317 no Grok e US$ 0,0055 no DeepSeek. É uma diferença de 5,7x a favor do DeepSeek.
| Tarefa | Tokens DeepSeek | Tokens Grok | Custo DeepSeek | Custo Grok |
|---|---|---|---|---|
| JSON estrito | 147 | 219 | 0,013¢ | 0,131¢ |
| Mesclar intervalos | 384 | 416 | 0,033¢ | 0,250¢ |
| Agulha em 56K | 181 | 174 | 0,016¢ | 0,104¢ |
| Aritmética de preços | 520 | 647 | 0,045¢ | 0,388¢ |
| Parser de duração | 4.087 | 2.611 | 0,356¢ | 1,567¢ |
| Agregação SQL | 1.012 | 1.208 | 0,088¢ | 0,725¢ |
| Total | 6.331 | 5.275 | 0,551¢ | 3,165¢ |
A eficiência de tokens existe, mas não basta: o Grok foi mais conciso no parser de duração, com 2.611 tokens contra 4.087, e ainda custou quatro vezes mais para entregar aquela resposta.
Em uma escala mensal de trabalho, a conta é simples de refazer: 1.000 requisições com 50.000 tokens de entrada sem cache e 3.000 tokens de saída cada equivalem a 50M de entrada e 3M de saída. No Grok 4.6, isso representa US$ 100,00 mais US$ 18,00, totalizando US$ 118,00. No DeepSeek V4 Pro, são US$ 21,75 mais US$ 2,61, ou US$ 24,36.
O Grok foi mais rápido nas seis tarefas, e a margem cresceu conforme a tarefa ficava mais longa: 48,8 segundos contra 83,3 no parser de duração, ante 3,7 contra 5,4 na tarefa de JSON. São execuções únicas em um gateway compartilhado, então trate as diferenças pequenas como ruído e a maior como uma tendência.
Duas regras de cobrança que a tabela de especificações não revela
Duas mecânicas de precificação pesam mais na fatura real do que as tarifas de destaque, e nenhuma aparece como coluna em uma tabela de especificações.
O limite de contexto longo da xAI é um degrau, não uma progressão. Qualquer requisição cujo prompt alcance 200.000 tokens é cobrada com tarifa dobrada para todos os tokens da requisição, não apenas para os que passam do limite. Um prompt de 199.000 tokens custa US$ 0,398 em entrada; um de 201.000 tokens custa US$ 0,804. Ultrapassar o limite em 1% dobra a conta.
O cache do DeepSeek custa quase nada. Um cache hit sai por US$ 0,003625 por 1M de tokens de entrada, contra US$ 0,50 no Grok 4.6: cerca de 138 vezes mais barato. Em trabalho repetido sobre uma base de código estável, esse é o número que define a fatura. Um desenvolvedor no Hacker News relatou:
A API oficial do DeepSeek tem uma taxa de cache hit superior a 99% se você a usar continuamente na mesma base de código durante sessões longas, então ela é muito mais barata que modelos de ponta. Tenho um exemplo de sessão de 200M de tokens no claude code.
O ponto é que as tarifas do DeepSeek são explicitamente temporárias. A página de preços traz a observação: "We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected." Uma análise no Hacker News sobre os preços promocionais do DeepSeek estima as tarifas pré-desconto em US$ 1,74 para entrada e US$ 3,48 para saída. A conta é consistente, já que US$ 0,435 e US$ 0,87 são exatamente um quarto desses valores, mas o DeepSeek não publicou os termos da promoção.
Se o aumento chegar a esses níveis, o cenário mensal acima passa de US$ 24,36 para US$ 97,44, contra US$ 118,00 do Grok. A diferença no preço de saída cai de 6,9x para cerca de 1,7x, e uma decisão baseada exclusivamente em preço deixa de ser óbvia.
Qual modelo usar
Use o DeepSeek V4 Pro em trabalho de alto volume, sensível a custo e com contexto repetido: processamento em lote, sessões longas de programação agêntica sobre o mesmo repositório e qualquer situação acima de aproximadamente 200K tokens por prompt, quando o limite do Grok dobra a tarifa. A janela de contexto de 1M e o cache quase gratuito trabalham a seu favor, e o modelo respeitou a restrição de formato exato nas cinco tentativas. Você pode usá-lo diretamente pela página da API do DeepSeek V4 Pro.
Use o Grok 4.6 em tarefas sensíveis à latência e multimodais. O Grok foi mais rápido em todas as tarefas, embora tanto essa medição quanto o resultado de formatação tenham sido obtidos no 4.5, não no 4.6. Ele aceita entrada de imagem, algo que o DeepSeek não faz, e ao menos informa publicamente seu corte de conhecimento em 1 de fevereiro de 2026. Se você usa um gateway, confirme que está recebendo o 4.6, e não o 4.5. O Grok no AIReiter, assim como qualquer outro revendedor, depende da versão conectada upstream.
Não escolha nenhum dos dois com base em um preço anunciado. A nota do próprio DeepSeek torna a vantagem atual um alvo móvel, e a tarifa de entrada em cache do Grok já subiu 67% entre o 4.5 e o 4.6. Refaça os cálculos acima com as páginas de preços atualizadas antes de comprometer uma carga de trabalho.
Perguntas frequentes
O Grok 4.6 foi realmente lançado?
Sim. Em 13 de agosto de 2026, o Grok 4.6 aparece na documentação de modelos da xAI na posição Latest, com preço publicado de US$ 2,00 para entrada e US$ 6,00 para saída por 1M de tokens, além de uma janela de contexto de 500K. Gateways de terceiros ainda podem direcionar grok-latest ao Grok 4.5.
O que é DeepSeek-V4-Pro-0813?
É a string de versão do modelo que o DeepSeek serve atualmente por trás do endpoint de API deepseek-v4-pro, listada na linha MODEL VERSION da página oficial de preços. O ID da API não leva sufixo de data, portanto o snapshot pode mudar sem qualquer alteração na sua requisição.
Qual modelo tem a maior janela de contexto?
O DeepSeek V4 Pro, com 1M de tokens, contra 500K do Grok 4.6. O DeepSeek também publica uma saída máxima de 384K; a xAI não publica um limite máximo de saída para o Grok 4.6.
O DeepSeek V4 Pro é mais barato que o Grok 4.6?
Nos preços de tabela de 13 de agosto de 2026, sim: 4,6x mais barato na entrada e 6,9x na saída. A página de preços do DeepSeek alerta para um aumento significativo e, nas tarifas pré-promoção identificadas por desenvolvedores, a diferença na saída cairia para aproximadamente 1,7x.
Qual deles segue instruções com mais confiabilidade?
No único teste que os separou, o DeepSeek V4 Pro manteve uma restrição de formato exato em 5 de 5 tentativas, enquanto o Grok acertou 0 de 5. Os dois modelos também falharam em contestar especificações falsas inseridas em um prompt.
Leitura relacionada: GPT-5.6 Luna vs DeepSeek V4 Pro