AIREITER

Grok 4.6 vs DeepSeek V4 Pro : un écart de coût de 5,7x, test à l’appui

Dernière mise à jour: 2026-08-13 03:10:59

Si votre priorité est la facture, choisissez DeepSeek V4 Pro ; si c’est la latence, Grok garde l’avantage. C’est le constat qui ressort des sept tâches exécutées via les deux API. Reste une réserve importante : DeepSeek prévient lui-même sur sa page tarifaire qu’une hausse significative est à venir, ce qui pourrait réduire fortement l’écart sur lequel repose cette recommandation.

Ce que vous comparez réellement en août 2026

Les deux modèles ont changé d’identité dans la semaine précédant ce comparatif. Grok 4.6 occupe désormais la position Latest dans la documentation des modèles de xAI, où il est présenté comme le modèle phare « for code and everything else ». De son côté, DeepSeek V4 Pro est actuellement fourni sous le snapshot DeepSeek-V4-Pro-0813. Aucun de ces changements n’apparaît dans un ID de modèle d’API.

Documentation xAI listant Grok 4.6 dans la catégorie Latest, avec 500K de contexte, 2,00 $ en entrée et 6,00 $ en sortie par million de tokens

La chaîne de version de DeepSeek n’est visible que dans la ligne MODEL VERSION de la page tarifaire. L’API répond toujours au simple identifiant deepseek-v4-pro, sans suffixe de date. Une requête envoyée aujourd’hui et une autre envoyée en juillet peuvent donc être identiques dans vos logs tout en ciblant potentiellement des poids différents.

Page tarifaire de l’API DeepSeek indiquant MODEL VERSION DeepSeek-V4-Pro-0813 pour le point d’accès deepseek-v4-pro

Voici le comparatif complet des spécifications et des prix, relevés sur la page tarifaire de xAI et la page tarifaire de DeepSeek le 13 août 2026 :

Grok 4.6DeepSeek V4 Pro (0813)
Fenêtre de contexte500K1M
Sortie maximaleNon publiée384K
Entrée / 1M2,00 $0,435 $
Entrée en cache / 1M0,50 $0,003625 $
Sortie / 1M6,00 $0,87 $
Tarif long contexteTous les tarifs x2 à partir d’un prompt de 200KAucun
Entrée imageOuiNon
Appels d’outilsOuiOui
RaisonnementConfigurableThinking / non-thinking
Date limite des connaissances1 février 2026Non publiée

Grok 4.6 conserve les tarifs affichés de Grok 4.5, soit 2,00 $ en entrée et 6,00 $ en sortie. Un seul prix a évolué : l’entrée en cache. Le même tableau xAI indique 0,30 $ pour Grok 4.5 et 0,50 $ pour Grok 4.6, soit une réutilisation du cache 67 % plus chère sur le nouveau modèle.

Les passerelles tierces restent sur Grok 4.5

La disponibilité dans la documentation xAI ne garantit pas que le modèle soit accessible partout où vous achetez des tokens. Sur la passerelle utilisée pour ce test, grok-4.6 renvoyait une erreur model_not_found, tandis que les alias grok-latest et grok résolvaient tous deux vers grok-4.5-build. Si vous accédez à Grok via un revendeur plutôt que par l’API directe de xAI, vérifiez vers quelle version votre alias pointe réellement avant de la supposer acquise.

Ce décalage explique aussi pourquoi les mesures ci-dessous ont été réalisées avec grok-4.5 et non 4.6. Les deux versions ayant les mêmes tarifs d’entrée et de sortie, les conclusions sur les coûts restent valables ; les résultats d’exactitude par tâche concernent toutefois 4.5.

Le vrai point de rupture : le suivi strict des consignes

Sur les sept tâches vérifiées mécaniquement, six se sont soldées par une égalité et une a nettement séparé les modèles. Cette dernière exigeait exactement quatre lignes, chacune se terminant par une description de cinq mots exactement. DeepSeek V4 Pro a réussi les 5 tentatives sur 5 ; Grok a échoué les 5 fois sur 5.

Les échecs de Grok ne venaient pas tous du même problème. Dans deux exécutions, il a affiché un appel d’outil web_search brut dans le corps du texte au lieu de répondre. L’une d’elles disait intégralement : « I need accurate information on the four stages of canary deployment. Let me search for that. » Deux autres ont respecté la structure en quatre lignes, mais se sont trompées dans le décompte avec des descriptions de quatre et six mots. Une dernière exécution a duré 130 secondes et généré 10 357 tokens de sortie, pour renvoyer 331 lignes.

La fuite provient probablement de la passerelle plutôt que du modèle : elle transforme un prompt de 6 tokens en 201 tokens d’entrée déclarés, ce qui suggère l’injection d’un préambule décrivant les outils côté serveur de xAI. Les erreurs de comptage des mots sont un problème distinct. Ces exécutions ont répondu normalement tout en abandonnant la contrainte.

Méthode : deepseek-v4-pro et grok-4.5 ont été testés via la même passerelle compatible OpenAI, avec les réglages par défaut. Une exécution a été faite par tâche, sauf pour la tâche de format qui a été lancée cinq fois pour chaque modèle. Toutes les tâches disposaient d’une réponse vérifiable mécaniquement : aucun modèle juge n’a donc participé à la notation. Les six tâches arrivées à égalité figurent dans le tableau des coûts ci-dessous.

Les deux modèles ont accepté une prémisse erronée

La septième tâche introduisait volontairement deux erreurs dans le prompt : DeepSeek V4 Pro aurait une fenêtre de contexte de 128K, et Grok 4.6 aurait été lancé en janvier 2026 avec 2M de contexte. Il fallait ensuite recommander un modèle pour un corpus de 900 000 tokens. Aucun des deux modèles n’a contesté ces chiffres. Tous deux ont raisonné proprement à partir de données erronées pour recommander Grok avec assurance.

Si vous collez des spécifications obsolètes dans un prompt et demandez une recommandation, les deux modèles vous fourniront une réponse erronée mais bien argumentée au lieu de corriger les données fournies.

Moins de tokens chez Grok, mais un coût 5,7x supérieur

Sur les six tâches terminées par les deux modèles, Grok a produit 5 275 tokens de sortie, contre 6 331 pour DeepSeek, soit 17 % de moins. Mais aux tarifs officiels de sortie de chaque modèle, ces réponses ont coûté 0,0317 $ avec Grok et 0,0055 $ avec DeepSeek : un écart de 5,7x en défaveur de Grok.

Graphique en barres groupées du coût de sortie par tâche en cents américains, comparant DeepSeek V4 Pro et Grok sur six tâches
TâcheTokens DeepSeekTokens GrokCoût DeepSeekCoût Grok
JSON strict1472190,013¢0,131¢
Fusion de plages3844160,033¢0,250¢
Aiguille dans 56K1811740,016¢0,104¢
Calcul tarifaire5206470,045¢0,388¢
Parseur de durées4 0872 6110,356¢1,567¢
Agrégation SQL1 0121 2080,088¢0,725¢
Total6 3315 2750,551¢3,165¢

L’efficacité en tokens est réelle, mais elle ne suffit pas. Grok a été plus concis sur le parseur de durées, avec 2 611 tokens contre 4 087, tout en coûtant quatre fois plus cher pour cette réponse.

À l’échelle d’un mois de travail, le calcul est simple à reproduire : 1 000 requêtes composées chacune de 50 000 tokens d’entrée non mis en cache et de 3 000 tokens de sortie représentent 50M de tokens en entrée et 3M en sortie. Avec Grok 4.6, cela revient à 100,00 $ plus 18,00 $, soit 118,00 $. Avec DeepSeek V4 Pro, le total est de 21,75 $ plus 2,61 $, soit 24,36 $.

Grok a été plus rapide dans les six tâches, avec un écart qui augmente sur les tâches longues : 48,8 secondes contre 83,3 pour le parseur de durées, contre 3,7 et 5,4 pour la tâche JSON. Il s’agit d’exécutions uniques sur une passerelle partagée : considérez les faibles écarts comme du bruit et le plus grand comme une indication de tendance.

Graphique en barres groupées de la latence de bout en bout mesurée en secondes pour DeepSeek V4 Pro et Grok 4.5 sur six tâches

Deux règles de facturation absentes des fiches techniques

Deux mécanismes tarifaires influencent davantage la facture réelle que les tarifs affichés, et aucun ne figure dans une colonne de tableau de spécifications.

Le seuil de long contexte de xAI est une marche, pas une progression. Toute requête dont le prompt atteint 200 000 tokens est facturée au double du tarif pour tous les tokens de cette requête, et non seulement ceux au-delà du seuil. Un prompt de 199 000 tokens coûte 0,398 $ en entrée ; un prompt de 201 000 tokens coûte 0,804 $. Dépasser le seuil de 1 % double la facture.

Le cache de DeepSeek est presque gratuit. Un cache hit coûte 0,003625 $ par million de tokens d’entrée, contre 0,50 $ pour Grok 4.6, soit environ 138 fois moins cher. Pour un travail répété sur une base de code stable, c’est ce chiffre qui déterminera la facture. Un développeur sur Hacker News rapporte :

L’API officielle de DeepSeek offre un taux de cache hit supérieur à 99 % si vous l’utilisez en continu sur la même base de code pendant de longues sessions ; elle revient donc bien moins cher que les modèles de pointe. J’ai un exemple de session de 200M tokens dans claude code.

Le revers, c’est que les tarifs de DeepSeek sont explicitement temporaires. La page tarifaire comporte cette note : « We plan to raise the overall pricing for DeepSeek API services in the near future, with a significant increase expected. » Une analyse sur Hacker News des tarifs promotionnels de DeepSeek estime les tarifs avant remise à 1,74 $ en entrée et 3,48 $ en sortie. Le calcul est cohérent, puisque 0,435 $ et 0,87 $ correspondent exactement au quart de ces montants, mais DeepSeek n’a publié aucune condition de promotion.

Si la hausse atteint ces niveaux, le scénario mensuel ci-dessus passerait de 24,36 $ à 97,44 $, contre 118,00 $ pour Grok. L’écart de prix en sortie tomberait de 6,9x à environ 1,7x, et un choix fondé uniquement sur le prix deviendrait bien moins évident.

Quel modèle choisir ?

Choisissez DeepSeek V4 Pro pour les gros volumes, les usages sensibles au coût et les contextes répétés : traitement par lots, longues sessions de code agentique sur un même dépôt, ou tout prompt dépassant environ 200K tokens, seuil auquel Grok double son tarif. La fenêtre de contexte de 1M et le cache quasi gratuit jouent alors en votre faveur, tandis que le modèle a respecté la contrainte de format exacte lors des cinq tentatives. Vous pouvez l’utiliser directement depuis la page API DeepSeek V4 Pro.

Choisissez Grok 4.6 pour les usages sensibles à la latence et le multimodal. Grok s’est montré plus rapide dans chaque tâche, même si ce résultat, tout comme le test de format, a été mesuré sur 4.5 et non 4.6. Il accepte les images en entrée, ce que DeepSeek ne fait pas, et sa date limite de connaissances publiée, le 1 février 2026, a au moins le mérite d’être indiquée. Si vous passez par une passerelle, confirmez que vous obtenez bien 4.6 et non 4.5. Grok sur AIReiter, comme tout autre revendeur, dépend de la version configurée en amont.

Ne choisissez ni l’un ni l’autre sur la base d’un prix annoncé. La note de DeepSeek fait de son avantage actuel une cible mouvante, et le tarif d’entrée en cache de Grok a déjà augmenté de 67 % entre 4.5 et 4.6. Reprenez les calculs ci-dessus à partir des pages tarifaires en vigueur avant d’engager une charge de travail.

FAQ

Grok 4.6 est-il vraiment disponible ?

Oui. Au 13 août 2026, Grok 4.6 apparaît dans la documentation des modèles de xAI à la position Latest, avec un tarif publié de 2,00 $ en entrée et 6,00 $ en sortie par million de tokens, ainsi qu’une fenêtre de contexte de 500K. Les passerelles tierces peuvent toutefois encore diriger grok-latest vers Grok 4.5.

Qu’est-ce que DeepSeek-V4-Pro-0813 ?

C’est la chaîne de version du modèle actuellement servi par DeepSeek derrière le point d’accès API deepseek-v4-pro, indiquée dans la ligne MODEL VERSION de la page tarifaire officielle. L’ID API ne contient aucun suffixe de date : le snapshot peut donc changer sans que votre requête ne change.

Quel modèle offre la plus grande fenêtre de contexte ?

DeepSeek V4 Pro, avec 1M tokens contre 500K pour Grok 4.6. DeepSeek publie également une sortie maximale de 384K, tandis que xAI ne publie aucune limite de sortie maximale pour Grok 4.6.

DeepSeek V4 Pro est-il moins cher que Grok 4.6 ?

Aux tarifs affichés le 13 août 2026, oui : il est 4,6x moins cher en entrée et 6,9x moins cher en sortie. La page tarifaire de DeepSeek annonce une hausse significative ; aux tarifs pré-promotion identifiés par des développeurs, l’écart en sortie tomberait à environ 1,7x.

Lequel suit le plus fiablement les instructions ?

Dans le seul test qui les a départagés, DeepSeek V4 Pro a respecté une contrainte de format exacte lors de 5 tentatives sur 5, contre 0 sur 5 pour Grok. Les deux modèles n’ont en revanche pas remis en cause les spécifications erronées introduites dans un prompt.


À lire aussi : GPT-5.6 Luna vs DeepSeek V4 Pro