AIREITER

Tarifs de Claude Sonnet 5 : les $2/$10 sont désormais définitifs (2026)

Dernière mise à jour: 2026-08-16 19:20:58

Le tarif de lancement de Claude Sonnet 5 ne disparaîtra finalement pas. Le 10 août 2026, Anthropic a annulé la hausse programmée au 1er septembre : les tarifs standards restent fixés à $2 par million de tokens en entrée et $10 par million de tokens en sortie. Si votre budget API du quatrième trimestre reposait sur les $3/$15 annoncés lors du lancement en juin, il faut revoir ce poste. Et si vous étiez resté sur Sonnet 4.6 dans l'attente du « vrai » tarif, la donne vient de changer.

Claude Sonnet 5 : la grille tarifaire API actuelle

Sur l'API directe d'Anthropic, Claude Sonnet 5 coûte $2 par million de tokens d'entrée et $10 par million de tokens de sortie. Tous les tarifs réduits sont calculés à partir de cette base. La documentation tarifaire de Claude Platform, consultée le 16 août 2026, est explicite : « The previously scheduled increase ... will not occur. »

TarifPrix pour 1 M de tokensMultiplicateur par rapport à l'entrée de base
Entrée standard$2.001.0x
Sortie standard$10.005x l'entrée
Écriture de cache, 5 min$2.501.25x
Écriture de cache, 1 heure$4.002x
Lecture de cache (hit)$0.200.1x
Entrée Batch$1.0050 % de réduction
Sortie Batch$5.0050 % de réduction
Documentation tarifaire officielle de Claude Platform d'Anthropic au 16 août 2026

Trois précisions de la même documentation ne tiennent pas dans un tarif d'appel. La fenêtre de contexte complète de 1 M de tokens est facturée au même prix par token : une requête de 900 k tokens et une autre de 9 k tokens affichent le même coût unitaire, sans surtaxe pour le contexte long. Forcer l'inférence aux États-Unis avec inference_geo: "us" applique un multiplicateur de 1.1x aux tarifs d'entrée, de sortie et de cache. Enfin, la recherche web côté serveur est facturée $10 pour 1 000 recherches, en plus des tokens habituels.

La hausse au 1er septembre finalement abandonnée

Claude Sonnet 5 est sorti le 30 juin 2026 à $2/$10, un prix alors clairement présenté comme promotionnel. Le tarif devait passer à $3/$15 le 1er septembre 2026, soit le même niveau que Sonnet 4.6. C'est encore ce montant que reprennent la plupart des tableaux tarifaires publiés début juillet. Le 10 août 2026, le journal des modifications de l'annonce de lancement a reçu une simple ligne : le prix de lancement devient permanent. L'article de lancement de TechCrunch comporte lui aussi une note de mise à jour reflétant ce tarif durable.

Un tableau qui annonce encore le passage à $3/$15, ou un tarif « après le 31 août », date donc d'avant le 10 août : il surestime de 50 % les deux tarifs standards. Passée cette échéance, rien d'autre ne change structurellement. À $2/$10, Sonnet 5 reste un cran sous Sonnet 4.6 à $3/$15, soit 33 % moins cher en entrée.

Sonnet 5 ou Sonnet 4.6 : le calcul de migration s'inverse

La principale raison d'hésiter tenait initialement au tokenizer. Sonnet 5 utilise la famille de tokenizers mise à jour avec Opus 4.7. L'annonce de lancement d'Anthropic indique un multiplicateur de 1.0x à 1.35x pour un texte identique selon le type de contenu, tandis que la documentation de la plateforme situe la hausse typique près de 30 %. Avec l'ancien scénario, le tarif standard de $3/$15 aurait porté le coût d'un prompt équivalent jusqu'à $4.05 par million de tokens d'entrée et $20.25 en sortie, contre $3/$15 avec Sonnet 4.6.

À $2/$10 de manière permanente, même le pire cas renverse la comparaison. Avec une inflation maximale de 1.35x du nombre de tokens, un texte équivalent coûte $2.70 par million de tokens en entrée et $13.50 en sortie : moins que Sonnet 4.6 sur les deux volets. Et ce, sans même compter les meilleurs résultats de Sonnet 5 dans le tableau comparatif de lancement : 63.2 % contre 58.1 % sur SWE-bench Pro, 80.4 % contre 67.0 % sur Terminal-Bench 2.1 et 81.2 % contre 78.5 % sur OSWorld-Verified.

Comparaison des coûts ajustés au tokenizer entre Sonnet 5 et Sonnet 4.6

Il reste toutefois une objection importante : ce qui compte est le coût par problème résolu, pas le coût par token. Des tests d'Artificial Analysis, cités par eesel AI, évaluent Sonnet 5 à environ $2.29 par tâche sur son Intelligence Index. Sans prix promotionnel, le modèle pouvait coûter davantage par tâche qu'Opus 4.8, car les exécutions à effort élevé consomment des thinking tokens facturés au tarif de sortie. La réaction de la communauté ne mâchait pas ses mots :

« tl;dr : Sonnet 5 est moins cher par token, mais plus cher par problème résolu — et reste derrière Opus 4.8 en intelligence globale. » - u/Chubby, r/accelerate

Le tarif fixe modifie les chiffres de l'équation, pas sa leçon : les réglages d'effort et le volume de tokens par tâche continuent de déterminer la facture. Pour le volet capacités de la migration, consultez notre comparatif Sonnet 5 vs Sonnet 4.6.

Effort et cache : les vrais leviers de la facture

Deux paramètres ont davantage d'impact sur une facture Sonnet 5 qu'une annonce de prix. Le premier est le niveau d'effort. Sonnet 5 propose les niveaux low, medium, high, xhigh et max. L'annonce de lancement revendique une efficacité coût nettement améliorée à effort moyen ; une couverture du lancement estime ainsi que Sonnet 5 en medium équivaut approximativement à Sonnet 4.6 en high. Il peut donc être pertinent de vérifier si un cran d'effort en moins conserve la qualité requise pour votre charge de travail. Le second levier est le cache de prompts. Une écriture de cache de 5 minutes à $2.50 est amortie dès la lecture suivante ; une écriture d'une heure à $4.00 l'est après deux lectures. Chaque lecture de cache coûte ensuite $0.20, soit 90 % de moins que l'entrée. D'après la documentation de la plateforme, les multiplicateurs de cache et de batch se cumulent.

Le Batch mérite d'autant plus d'attention avec ce nouveau tarif permanent. À $1/$5 par million de tokens, le traitement asynchrone de Sonnet 5, avec résultats sous 24 heures, coûte autant que le tarif standard à la demande de Haiku 4.5, pour un modèle qui atteint 63.2 % sur SWE-bench Pro. Le Batch est généralement l'option la moins chère pour les évaluations indépendantes non sensibles à la latence, les reprises de données et le traitement documentaire.

Comparatif des tarifs API des modèles Claude par million de tokens, août 2026

Selon le fournisseur, la facture ne sera pas la même

La grille de Sonnet 5 n'est pas identique chez les sept fournisseurs qui l'hébergent. Le tableau des fournisseurs de CloudPrice affiche $2.00/$10.00 chez Anthropic en direct, Amazon Bedrock, Azure AI Foundry, Google Vertex AI, OpenRouter et Vercel AI Gateway. Snowflake facture en revanche $2.40/$12.00, soit une majoration de 20 %. Deux suppléments s'appliquent quel que soit le fournisseur, selon la documentation de la plateforme : les points de terminaison régionaux ou multirégionaux de Bedrock et Vertex coûtent environ 10 % de plus que les endpoints globaux, et l'inférence limitée aux États-Unis applique le multiplicateur de 1.1x.

FournisseurEntrée / 1 MSortie / 1 MNotes
API Anthropic$2.00$10.00Batch $1/$5, tarifs de cache complets
Amazon Bedrock$2.00$10.00Endpoints régionaux +10 %
Google Vertex AI$2.00$10.00Endpoints régionaux +10 %
Azure AI Foundry$2.00$10.00Déploiement US Data Zone disponible
OpenRouter$2.00$10.00Variante Batch $1/$5
Vercel AI Gateway$2.00$10.00-
Snowflake$2.40$12.00+20 % par rapport au tarif standard

Attention lors des comparaisons entre annuaires : le tarif « à partir de $1.00/$5.00 » associé à Sonnet 5 dans certaines fiches correspond au Batch, pas au prix à la demande. Le même annuaire affiche Sonnet 4.6 à $1.50/$7.50 : c'est exactement son tarif Batch, et non son tarif standard de $3/$15.

Ce que le tarif durable de $2/$10 change dans votre budget

Les arbitrages restants concernent désormais le modèle, et non une date butoir. Sonnet 5 est le modèle par défaut des forfaits Claude Free et Pro, et il est inclus dans Max, Team et Enterprise, selon l'annonce de lancement. Les abonnés ne paient donc jamais ces tarifs API. Le guide des tarifs de l'API Claude explique à partir de quel point un abonnement devient plus pertinent qu'une API. Pour les acheteurs d'API :

SituationRecommandation
Agents de production sensibles à la latenceSonnet 5 à $2/$10, avec cache de 5 min sur les prompts système
Reprises nocturnes, campagnes d'évaluation, traitement en volumeSonnet 5 Batch à $1/$5
Les tâches de code les plus difficiles (Opus 4.8 : 69.2 % contre 63.2 % sur SWE-bench Pro, selon le tableau comparatif de lancement d'Anthropic)Opus 4.8 à $5/$25
Classification, routage, résuméHaiku 4.5 à $1/$5
Sonnet 4.6 est toujours en productionLancez un pilote de migration : la fourchette de tokenizer documentée par Anthropic, de 1.0x à 1.35x, reste moins chère que 4.6 par token équivalent ; validez d'abord la qualité et les tokens par tâche sur du trafic réel

Aux niveaux xhigh et max, les thinking tokens facturés $10 par million continuent de faire augmenter la facture avec la difficulté du problème. Artificial Analysis a constaté qu'une exécution Sonnet 5 à effort élevé pouvait coûter plus par tâche qu'Opus 4.8 avec les anciens tarifs de $3/$15. La baisse permanente réduit ce plancher d'un tiers, mais ne le supprime pas : mesurez les tokens par tâche avant de fixer un montant trimestriel. Faites passer une semaine de trafic réel par l'endpoint API Claude avec votre réglage d'effort de production, puis chiffrez la charge de travail — pas uniquement le prix au million de tokens.

À lire aussi : Claude Sonnet 5 vs Sonnet 4.6 - Guide des tarifs de l'API Claude 2026 - Guide de Claude Sonnet 5