Grok 4.6 est arrivé le 12 août 2026, soit cinq jours après l’échéance suggérée par les « two weeks » d’Elon Musk. Sur le papier, rien ne change : $2.00 par million de tokens en entrée, $6.00 en sortie et une fenêtre de contexte de 500K, exactement comme Grok 4.5. Dans les faits, la facture grimpe : les entrées en cache coûtent 67 % plus cher que sur 4.5, et des mesures indépendantes montrent que le modèle utilise davantage de tokens pour accomplir un même travail.
Ce que Grok 4.6 apporte depuis le 12 août
Le modèle porte l’identifiant grok-4.6. Les notes de version de SpaceXAI datent sa disponibilité via API au 12 août 2026. Voici les spécifications documentées :
| Caractéristique | Grok 4.6 |
|---|---|
| Identifiant du modèle | grok-4.6 |
| Contexte | 500K tokens |
| Entrée | Texte et image |
| Sortie | Texte uniquement, sans limite de sortie annoncée |
| Niveau de raisonnement | low, medium, high (par défaut), xhigh |
| Date limite des connaissances | 1 février 2026 |
Deux lignes sont inédites. xhigh constitue un quatrième niveau de raisonnement absent de Grok 4.5, qui s’arrête à high. La documentation indique aussi désormais une date limite des connaissances au 1 février 2026, une précision utile si vous deviez contourner l’angle mort temporel du modèle pour les questions datées.
Le catalogue des modèles présente Grok 4.6 comme le fleuron pour le code et le chat, avec le libellé Latest dans la barre latérale et une page datée du 12 août 2026. Grok 4.5 n’est pas retiré : il figure toujours sur la page des tarifs avec ses propres prix.
La diffusion a été large dès le premier jour. L’annonce de SpaceXAI cite Cursor et Grok Build, tous deux avec 2x d’usage inclus pendant la première semaine, ainsi que l’API et des partenaires parmi lesquels OpenRouter, Vercel et Cloudflare. Elle évoque également une variante rapide deux fois plus chère ; celle-ci n’a pas encore de ligne sur la grille tarifaire publique. Le multiplicateur 2x est donc à considérer comme le chiffre de l’annonce, et non comme un tarif publié.
Tarifs de Grok 4.6 : le cache devient nettement plus cher
Les prix des tokens d’entrée et de sortie restent identiques à ceux de Grok 4.5. Ce n’est pas le cas des entrées en cache.
| Tarif pour 1M de tokens | Grok 4.5 | Grok 4.6 |
|---|---|---|
| Entrée (moins de 200K) | $2.00 | $2.00 |
| Entrée en cache (moins de 200K) | $0.30 | $0.50 |
| Sortie (moins de 200K) | $6.00 | $6.00 |
| Entrée / cache / sortie (200K+) | $4.00 / $0.60 / $12.00 | $4.00 / $1.00 / $12.00 |
La remise sur les entrées en cache passe de 85 % à 75 % : cela représente 20 cents de plus par million de tokens sur le poste qui augmente avec les étapes d’un agent, et non avec le nombre de tâches. Un banc de test rejouant 50M de tokens en cache par jour paie $15.00 avec 4.6, contre $9.00 avec 4.5.
La règle du contexte long ne change pas, et elle continue de surprendre. Dès qu’un prompt atteint 200K tokens, tous les tokens de la requête sont facturés au palier supérieur : un appel de 210K tokens coûte $4.00 par million de tokens d’entrée sur l’intégralité de la requête, et non un mélange des deux paliers. La fiche publique du modèle sur OpenRouter indique les mêmes tarifs et le même basculement à 200K ; passer par un fournisseur tiers ne modifie donc pas le calcul.
Les benchmarks officiels : où Grok 4.6 progresse, et où il reste derrière
SpaceXAI a publié un comparatif sur dix lignes face à Grok 4.5, GPT-5.6 Sol Max et Fable 5 Max. Grok 4.6 obtient le meilleur score dans trois cas : GDPVal-AA v2 (1753), AA-Briefcase (1577) et Harvey LAB (15.8 %). Il s’incline sur les sept autres. Voici les huit résultats les plus utiles pour orienter le routage :
| Évaluation | Grok 4.6 | Grok 4.5 | GPT-5.6 Sol | Fable 5 |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54% | 73% | 70% |
| FrontierCode v1.1 | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26% | 15.7% | 34.6% | 34.1% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
Terminal-Bench mérite qu’on s’y attarde. Grok 4.6 atteint 26 %, contre 34.6 % pour GPT-5.6 Sol et 34.1 % pour Fable 5 : une troisième place avec huit points de retard sur l’évaluation qui ressemble le plus à un agent pilotant un shell. DeepSWE raconte la même histoire avec d’autres chiffres : 65.9 %, contre 73 % pour Sol. Pour des agents opérant dans un terminal, le tableau du fournisseur lui-même indique clairement que ce n’est pas le modèle de tête.
Le progrès face à Grok 4.5 est néanmoins réel et uniforme. Chaque ligne s’améliore, avec des hausses de plus de dix points sur APEX-Agents, de 47.1 % à 57.5 %, et Terminal-Bench, de 15.7 % à 26 %. SpaceXAI attribue ces résultats à une phase d’entraînement complémentaire plus longue, à des trajectoires SFT régénérées et à du RL agentique dans des environnements de code et de travail intellectuel. Un élément manque toutefois dans l’annonce : le nombre de paramètres. Le chiffre de 2 trillion associé à ce modèle vient de Musk, pas de la sortie officielle.
Le vrai prix du gain en intelligence
Les tableaux des éditeurs donnent des scores, pas leur coût. Artificial Analysis publie les deux, et sa mesure du 13 août révèle le compromis réel de Grok 4.6.
| Mesuré sur le même index | Grok 4.5 (high) | Grok 4.6 (high) |
|---|---|---|
| Intelligence Index | 56 (#16 sur 184) | 61 (#6 sur 184) |
| Vitesse de sortie | 56.9 tokens/s (#102) | 67.6 tokens/s (#74) |
| Tokens de sortie générés | 60M | 72M |
| Coût de l’évaluation complète | $579.21 | $1,068.47 |
Cinq points d’intelligence supplémentaires coûtent 1.8x plus cher. Les tarifs affichés sont identiques, mais la même suite de benchmarks a coûté $489 de plus : en partie à cause d’une plus grande verbosité, avec 72M de tokens de sortie contre 60M, et en partie du fait de la hausse du cache détaillée plus haut. Artificial Analysis ne publie pas la ventilation de cette exécution : le facteur 1.8x est donc un total observé, pas une formule reproductible.
La vitesse évolue en revanche dans le bon sens : 67.6 tokens de sortie par seconde, contre 56.9 pour 4.5. Cela fait passer le modèle de la moitié basse à environ la médiane des 184 modèles de sa catégorie.
Les déclarations de Musk face au produit livré
Le nom est apparu dans une réponse de trois mots. Le 18 juillet, en réponse à @minchoi, Musk écrivait : « Our 2T model, which is better than our 1.5T in every way, will finish initial training next week. It might be able to exceed Kimi, but with speed and token efficiency close to our 1.5T (aka Grok 4.5). » Interrogé par Andrew Curran pour savoir s’il s’agissait de Grok 4.6, il répondait : « Yeah, Grok 4.6. »
Le 24 juillet, il donnait le calendrier : « Grok 4.6 in 2 weeks and Grok 4.7 in 4 weeks. » Deux semaines après cette date mènent aux environs du 7 août ; le modèle a été lancé le 12 août, cinq jours plus tard.
Trois affirmations de ces publications ne résistent pas entièrement aux éléments de sortie :
- 2 trillion de paramètres reste non confirmé. L’annonce, la documentation du modèle et les notes de version de SpaceXAI ne donnent aucun nombre de paramètres pour Grok 4.6.
- « Token efficiency close to Grok 4.5 » est contredit par la mesure d’Artificial Analysis : 72M de tokens de sortie contre 60M sur la même évaluation.
- « Might exceed Kimi » n’a toujours pas été testé face à K3 de Moonshot dans le tableau de SpaceXAI, qui ne le compare qu’à GPT-5.6 Sol et Fable 5.
Faut-il passer de Grok 4.5 à Grok 4.6 ?
Oui pour les usages agentiques et les tâches de connaissance si vous venez de Grok 4.5, mais vérifiez la facture de tokens après une semaine plutôt qu’au moment de la migration. Grok 4.5 reste disponible à ses anciens tarifs : le changement est réversible et mérite d’être mesuré plutôt que présumé.
Adoptez-le dès maintenant pour les agents à long horizon ou les tâches de connaissance : APEX-Agents gagne 10.4 points, GDPVal-AA progresse de 227 points, et la génération plus rapide s’accumule sur les exécutions à plusieurs étapes. Restez sur 4.5 si votre trafic repose fortement sur le cache et que le prix compte : la hausse de 67 % pour les lectures de cache est une vraie régression, tandis que les scores de 4.5 n’ont pas baissé avec la sortie de 4.6. Pour les agents de terminal en particulier, regardez ailleurs : le propre tableau de SpaceXAI place Grok 4.6 huit points derrière GPT-5.6 Sol et Fable 5.
Avant de basculer une route de production, contrôlez trois points :
- Les deux identifiants sont des alias. Les règles d’alias de SpaceXAI font pointer
grok-4.6vers la dernière build stable etgrok-4.6-latestvers la plus récente ; seul un identifiant daté<modelname>-<date>est figé. Or ni le catalogue de modèles ni OpenRouter ne listent de variante 4.6 datée. Il n’existe donc pas aujourd’hui de version épinglable pour les workflows reproductibles. - Testez à nouveau le niveau de raisonnement. Le nouveau palier
xhighn’est pas une mise à niveau gratuite : il consomme plus de tokens sur un modèle déjà mesuré comme plus verbeux que son prédécesseur. Le niveauhigh, par défaut, est la comparaison équivalente avec 4.5. - Confirmez la disponibilité chez votre fournisseur. La disponibilité le premier jour chez SpaceXAI ne signifie pas une disponibilité immédiate partout. En interrogeant
/v1/modelsle 13 août, l’API officielle et OpenRouter renvoyaient tous deuxgrok-4.6, tandis qu’un endpoint de revendeur compatible OpenAI que j’ai testé s’arrêtait encore àgrok-4.5et rejetait le nouvel identifiant avecmodel_not_found. Vérifiez que l’identifiant exact répond avec votre propre clé avant d’y diriger du trafic.
FAQ
Combien coûte l’API Grok 4.6 ?
Elle coûte $2.00 par million de tokens d’entrée et $6.00 par million de tokens de sortie sous 200K de contexte, avec les entrées en cache à $0.50. Au-delà de 200K tokens dans le prompt, toute la requête est facturée à $4.00 en entrée, $1.00 en cache et $12.00 en sortie. Une variante rapide deux fois plus chère est mentionnée dans l’annonce, mais ne figure pas sur la page tarifaire publique.
Grok 4.6 est-il meilleur que Grok 4.5 ?
Oui, sur tous les benchmarks publiés par SpaceXAI : 61 contre 56 sur l’AA Intelligence Index, avec les gains les plus importants sur les évaluations agentiques. La mesure indépendante apporte toutefois une nuance : il a généré 72M de tokens de sortie contre 60M pour Grok 4.5 sur la même évaluation ; une même tâche coûte donc davantage.
Combien de paramètres compte Grok 4.6 ?
Ce n’est pas divulgué. Musk a décrit un modèle de 2 trillion de paramètres le 18 juillet 2026 et en a confirmé le nom, mais les documents de sortie de SpaceXAI ne fournissent ni nombre de paramètres, ni détail d’architecture, ni indication sur le nombre de paramètres activés par token.
Quelle est la fenêtre de contexte et la date limite des connaissances de Grok 4.6 ?
Grok 4.6 dispose de 500K tokens de contexte, accepte le texte et les images en entrée, et ne produit que du texte. La documentation fixe la date limite des connaissances au 1 février 2026 ; sans Web Search ou X Search côté serveur, le modèle n’a pas accès aux événements postérieurs.
Grok est-il développé par xAI ou SpaceXAI ?
Les deux noms désignent la même entreprise. La documentation développeur est intitulée « SpaceXAI Docs » et le pied de page de l’annonce affiche toujours X.AI LLC, après le passage sous SpaceX en 2026. Les domaines x.ai et les identifiants de modèle grok-* n’ont pas été renommés.
Quand Grok 4.7 sortira-t-il ?
Aucune date n’a été annoncée. Dans sa publication du 24 juillet, Musk situait Grok 4.7 à environ quatre semaines, soit aux alentours du 21 août 2026, tandis que Grok 4.6 est arrivé cinq jours après sa propre date implicite.
À lire aussi
- Grok 4.5 : tout ce que nous savons à ce stade
- GPT-5.6 Sol et Terra face à Grok 4.5
- Claude Opus 5 : ce qui est confirmé
Tarifs, identifiants de modèles et chiffres des benchmarks vérifiés auprès de la documentation SpaceXAI, de l’annonce de Grok 4.6 et d’Artificial Analysis le 13 août 2026.