Le tarif de lancement de Claude Sonnet 5 ne disparaîtra finalement pas. Le 10 août 2026, Anthropic a annulé la hausse programmée au 1er septembre : les tarifs standards restent fixés à $2 par million de tokens en entrée et $10 par million de tokens en sortie. Si votre budget API du quatrième trimestre reposait sur les $3/$15 annoncés lors du lancement en juin, il faut revoir ce poste. Et si vous étiez resté sur Sonnet 4.6 dans l'attente du « vrai » tarif, la donne vient de changer.
Claude Sonnet 5 : la grille tarifaire API actuelle
Sur l'API directe d'Anthropic, Claude Sonnet 5 coûte $2 par million de tokens d'entrée et $10 par million de tokens de sortie. Tous les tarifs réduits sont calculés à partir de cette base. La documentation tarifaire de Claude Platform, consultée le 16 août 2026, est explicite : « The previously scheduled increase ... will not occur. »
| Tarif | Prix pour 1 M de tokens | Multiplicateur par rapport à l'entrée de base |
|---|---|---|
| Entrée standard | $2.00 | 1.0x |
| Sortie standard | $10.00 | 5x l'entrée |
| Écriture de cache, 5 min | $2.50 | 1.25x |
| Écriture de cache, 1 heure | $4.00 | 2x |
| Lecture de cache (hit) | $0.20 | 0.1x |
| Entrée Batch | $1.00 | 50 % de réduction |
| Sortie Batch | $5.00 | 50 % de réduction |
Trois précisions de la même documentation ne tiennent pas dans un tarif d'appel. La fenêtre de contexte complète de 1 M de tokens est facturée au même prix par token : une requête de 900 k tokens et une autre de 9 k tokens affichent le même coût unitaire, sans surtaxe pour le contexte long. Forcer l'inférence aux États-Unis avec inference_geo: "us" applique un multiplicateur de 1.1x aux tarifs d'entrée, de sortie et de cache. Enfin, la recherche web côté serveur est facturée $10 pour 1 000 recherches, en plus des tokens habituels.
La hausse au 1er septembre finalement abandonnée
Claude Sonnet 5 est sorti le 30 juin 2026 à $2/$10, un prix alors clairement présenté comme promotionnel. Le tarif devait passer à $3/$15 le 1er septembre 2026, soit le même niveau que Sonnet 4.6. C'est encore ce montant que reprennent la plupart des tableaux tarifaires publiés début juillet. Le 10 août 2026, le journal des modifications de l'annonce de lancement a reçu une simple ligne : le prix de lancement devient permanent. L'article de lancement de TechCrunch comporte lui aussi une note de mise à jour reflétant ce tarif durable.
Un tableau qui annonce encore le passage à $3/$15, ou un tarif « après le 31 août », date donc d'avant le 10 août : il surestime de 50 % les deux tarifs standards. Passée cette échéance, rien d'autre ne change structurellement. À $2/$10, Sonnet 5 reste un cran sous Sonnet 4.6 à $3/$15, soit 33 % moins cher en entrée.
Sonnet 5 ou Sonnet 4.6 : le calcul de migration s'inverse
La principale raison d'hésiter tenait initialement au tokenizer. Sonnet 5 utilise la famille de tokenizers mise à jour avec Opus 4.7. L'annonce de lancement d'Anthropic indique un multiplicateur de 1.0x à 1.35x pour un texte identique selon le type de contenu, tandis que la documentation de la plateforme situe la hausse typique près de 30 %. Avec l'ancien scénario, le tarif standard de $3/$15 aurait porté le coût d'un prompt équivalent jusqu'à $4.05 par million de tokens d'entrée et $20.25 en sortie, contre $3/$15 avec Sonnet 4.6.
À $2/$10 de manière permanente, même le pire cas renverse la comparaison. Avec une inflation maximale de 1.35x du nombre de tokens, un texte équivalent coûte $2.70 par million de tokens en entrée et $13.50 en sortie : moins que Sonnet 4.6 sur les deux volets. Et ce, sans même compter les meilleurs résultats de Sonnet 5 dans le tableau comparatif de lancement : 63.2 % contre 58.1 % sur SWE-bench Pro, 80.4 % contre 67.0 % sur Terminal-Bench 2.1 et 81.2 % contre 78.5 % sur OSWorld-Verified.
Il reste toutefois une objection importante : ce qui compte est le coût par problème résolu, pas le coût par token. Des tests d'Artificial Analysis, cités par eesel AI, évaluent Sonnet 5 à environ $2.29 par tâche sur son Intelligence Index. Sans prix promotionnel, le modèle pouvait coûter davantage par tâche qu'Opus 4.8, car les exécutions à effort élevé consomment des thinking tokens facturés au tarif de sortie. La réaction de la communauté ne mâchait pas ses mots :
« tl;dr : Sonnet 5 est moins cher par token, mais plus cher par problème résolu — et reste derrière Opus 4.8 en intelligence globale. » - u/Chubby, r/accelerate
Le tarif fixe modifie les chiffres de l'équation, pas sa leçon : les réglages d'effort et le volume de tokens par tâche continuent de déterminer la facture. Pour le volet capacités de la migration, consultez notre comparatif Sonnet 5 vs Sonnet 4.6.
Effort et cache : les vrais leviers de la facture
Deux paramètres ont davantage d'impact sur une facture Sonnet 5 qu'une annonce de prix. Le premier est le niveau d'effort. Sonnet 5 propose les niveaux low, medium, high, xhigh et max. L'annonce de lancement revendique une efficacité coût nettement améliorée à effort moyen ; une couverture du lancement estime ainsi que Sonnet 5 en medium équivaut approximativement à Sonnet 4.6 en high. Il peut donc être pertinent de vérifier si un cran d'effort en moins conserve la qualité requise pour votre charge de travail. Le second levier est le cache de prompts. Une écriture de cache de 5 minutes à $2.50 est amortie dès la lecture suivante ; une écriture d'une heure à $4.00 l'est après deux lectures. Chaque lecture de cache coûte ensuite $0.20, soit 90 % de moins que l'entrée. D'après la documentation de la plateforme, les multiplicateurs de cache et de batch se cumulent.
Le Batch mérite d'autant plus d'attention avec ce nouveau tarif permanent. À $1/$5 par million de tokens, le traitement asynchrone de Sonnet 5, avec résultats sous 24 heures, coûte autant que le tarif standard à la demande de Haiku 4.5, pour un modèle qui atteint 63.2 % sur SWE-bench Pro. Le Batch est généralement l'option la moins chère pour les évaluations indépendantes non sensibles à la latence, les reprises de données et le traitement documentaire.
Selon le fournisseur, la facture ne sera pas la même
La grille de Sonnet 5 n'est pas identique chez les sept fournisseurs qui l'hébergent. Le tableau des fournisseurs de CloudPrice affiche $2.00/$10.00 chez Anthropic en direct, Amazon Bedrock, Azure AI Foundry, Google Vertex AI, OpenRouter et Vercel AI Gateway. Snowflake facture en revanche $2.40/$12.00, soit une majoration de 20 %. Deux suppléments s'appliquent quel que soit le fournisseur, selon la documentation de la plateforme : les points de terminaison régionaux ou multirégionaux de Bedrock et Vertex coûtent environ 10 % de plus que les endpoints globaux, et l'inférence limitée aux États-Unis applique le multiplicateur de 1.1x.
| Fournisseur | Entrée / 1 M | Sortie / 1 M | Notes |
|---|---|---|---|
| API Anthropic | $2.00 | $10.00 | Batch $1/$5, tarifs de cache complets |
| Amazon Bedrock | $2.00 | $10.00 | Endpoints régionaux +10 % |
| Google Vertex AI | $2.00 | $10.00 | Endpoints régionaux +10 % |
| Azure AI Foundry | $2.00 | $10.00 | Déploiement US Data Zone disponible |
| OpenRouter | $2.00 | $10.00 | Variante Batch $1/$5 |
| Vercel AI Gateway | $2.00 | $10.00 | - |
| Snowflake | $2.40 | $12.00 | +20 % par rapport au tarif standard |
Attention lors des comparaisons entre annuaires : le tarif « à partir de $1.00/$5.00 » associé à Sonnet 5 dans certaines fiches correspond au Batch, pas au prix à la demande. Le même annuaire affiche Sonnet 4.6 à $1.50/$7.50 : c'est exactement son tarif Batch, et non son tarif standard de $3/$15.
Ce que le tarif durable de $2/$10 change dans votre budget
Les arbitrages restants concernent désormais le modèle, et non une date butoir. Sonnet 5 est le modèle par défaut des forfaits Claude Free et Pro, et il est inclus dans Max, Team et Enterprise, selon l'annonce de lancement. Les abonnés ne paient donc jamais ces tarifs API. Le guide des tarifs de l'API Claude explique à partir de quel point un abonnement devient plus pertinent qu'une API. Pour les acheteurs d'API :
| Situation | Recommandation |
|---|---|
| Agents de production sensibles à la latence | Sonnet 5 à $2/$10, avec cache de 5 min sur les prompts système |
| Reprises nocturnes, campagnes d'évaluation, traitement en volume | Sonnet 5 Batch à $1/$5 |
| Les tâches de code les plus difficiles (Opus 4.8 : 69.2 % contre 63.2 % sur SWE-bench Pro, selon le tableau comparatif de lancement d'Anthropic) | Opus 4.8 à $5/$25 |
| Classification, routage, résumé | Haiku 4.5 à $1/$5 |
| Sonnet 4.6 est toujours en production | Lancez un pilote de migration : la fourchette de tokenizer documentée par Anthropic, de 1.0x à 1.35x, reste moins chère que 4.6 par token équivalent ; validez d'abord la qualité et les tokens par tâche sur du trafic réel |
Aux niveaux xhigh et max, les thinking tokens facturés $10 par million continuent de faire augmenter la facture avec la difficulté du problème. Artificial Analysis a constaté qu'une exécution Sonnet 5 à effort élevé pouvait coûter plus par tâche qu'Opus 4.8 avec les anciens tarifs de $3/$15. La baisse permanente réduit ce plancher d'un tiers, mais ne le supprime pas : mesurez les tokens par tâche avant de fixer un montant trimestriel. Faites passer une semaine de trafic réel par l'endpoint API Claude avec votre réglage d'effort de production, puis chiffrez la charge de travail — pas uniquement le prix au million de tokens.
À lire aussi : Claude Sonnet 5 vs Sonnet 4.6 - Guide des tarifs de l'API Claude 2026 - Guide de Claude Sonnet 5