À peine Sonnet 5 lancé le 30 juin 2026, r/ClaudeAI a soulevé une objection que sa grille tarifaire ne permet pas d’anticiper : « Sonnet 5 est-il moins bon qu’Opus au même prix en high et xhigh ? »
Un participant a résumé le mécanisme en une phrase : Sonnet est « réellement moins cher par token, mais il lui faut beaucoup plus d’étapes et de tokens pour finir les tâches ; c’est là qu’il perd son avantage tarifaire ».
Le constat est juste, à une exception près. À budget égal, Claude Opus 5 bat Sonnet 5 presque partout : au-delà d’environ 2,30 $ par tâche, Opus réglé un niveau d’effort plus bas fait mieux que Sonnet un niveau plus haut, à la fois sur le coût et la qualité. Sous ce seuil, ainsi que pour les travaux courts en une seule requête, Sonnet 5 est 3,4 fois moins cher.
Les terrains où chaque modèle prend l’avantage
| Claude Opus 5 | Claude Sonnet 5 | |
|---|---|---|
| Identifiant du modèle | claude-opus-5 | claude-sonnet-5 |
| Disponibilité | 24 juillet 2026 | 30 juin 2026 |
| Entrée / sortie par MTok | 5 $ / 25 $ | 2 $ / 10 $ jusqu’au 31 août 2026, puis 3 $ / 15 $ |
| Entrée / sortie Batch | 2,50 $ / 12,50 $ | 1 $ / 5 $ jusqu’au 31 août 2026 |
| Paliers d’effort | low, medium, high, xhigh, max (high par défaut) | les mêmes cinq paliers (high par défaut) |
| Extended thinking | activé par défaut | adaptatif |
| Contexte / sortie maximale | 1M / 128k tokens | 1M / 128k tokens |
| Date limite des connaissances | mai 2026 | janvier 2026 |
| Remise par token | aucune | 60 % de moins qu’Opus aujourd’hui, 40 % de moins à partir du 1er septembre |
| Cas d’usage privilégiés | exécutions agentiques de longue durée, raisonnement difficile, travaux coûteux à relire | extraction en une requête, forte concurrence, UX sensible à la latence |
| Notre test rapide sur quatre tâches | 4/4 réussies, 1 182 tokens de sortie, 2,955 ¢ | 4/4 réussies, 858 tokens de sortie, 0,858 ¢ |
Aucun benchmark public sur des tâches agentiques longues n’a encore évalué Opus 5. Les tableaux de coût par tâche ci-dessous utilisent donc Opus 4.8 dans la colonne Opus. Considérez-les comme une borne basse prudente : les deux modèles ont le même tarif, et Anthropic place Opus 5 devant 4.8 sur le travail agentique.
Une comparaison Claude Opus 5 vs Sonnet 5 à budget égal est possible parce que les deux modèles acceptent le même paramètre effort, sur les mêmes cinq paliers et sans header bêta. On achète donc de la capacité en tournant le même réglage, pas en changeant de modèle. Les prix viennent de la page tarifaire de Claude Platform, vérifiée le 25 juillet 2026.
Coût par palier : le point où les courbes se croisent
Les chiffres par niveau proviennent de DeepSWE v1.1, le classement de Datacurve consacré aux agents sur tâches longues :
- 113 tâches rédigées de zéro, et non extraites de PR fusionnées, fondement de son argument d’absence de contamination
- 91 dépôts, dans 5 langages
- Un même harness pour tous les modèles, avec quatre exécutions par tâche
- Dernière mise à jour le 21 juillet, trois jours avant la sortie d’Opus 5
Opus 4.8 occupe donc la colonne Opus. La seule inconnue est de savoir si Opus 5 consomme davantage de tokens par tâche que 4.8.
| Effort | Sonnet 5 $/tâche | Opus 4.8 $/tâche | Sonnet ÷ Opus | Sonnet pass@1 | Opus pass@1 |
|---|---|---|---|---|---|
| low | 2,19 $ | 2,29 $ | 0,95x | 30,5 % | 40,8 % |
| medium | 4,08 $ | 3,44 $ | 1,18x | 39,8 % | 48,7 % |
| high | 7,43 $ | 4,28 $ | 1,73x | 48,2 % | 51,8 % |
| xhigh | 11,89 $ | 8,01 $ | 1,49x | 49,7 % | 54,4 % |
| max | 26,40 $ | 13,22 $ | 2,00x | 53,8 % | 59,0 % |
Sonnet 5 n’est moins cher qu’à un seul palier, low. C’est aussi celui où il abandonne 10,3 points de taux de réussite.
Comment un modèle moins cher finit par facturer davantage
La variable déterminante est le nombre d’étapes, pas la verbosité.
| Effort | Étapes médianes Sonnet 5 | Étapes médianes Opus 4.8 | Entrée par tâche Sonnet | Entrée par tâche Opus |
|---|---|---|---|---|
| low | 70 | 47 | 4,5M | 2,4M |
| max | 260 | 116 | 72,4M | 17,0M |
Une remise de 60 % par token ne résiste pas à quatre fois plus de texte à lire.
Pourquoi la colonne des dollars est crédible
Commençons par une réserve : DeepSWE ne publie pas sa base tarifaire.
Une autre série de 24 tâches, exécutée le 13 juillet, a couvert les deux modèles sur les cinq paliers dans Claude Code. En multipliant la colonne Sonnet de DeepSWE par 0,67 — soit le tarif promotionnel de 2 $/10 $ face au tarif standard de 3 $/15 $ — les deux jeux de résultats concordent à 0,03 près à chaque palier.
Deux ensembles de tâches indépendants, un même croisement entre medium et high. Cette concordance suggère aussi fortement que DeepSWE a facturé Sonnet aux tarifs standards.
L’auteur développe et commercialise Stet, le harness lié dans cet article : il faut donc lire cela comme le test d’un éditeur sur son propre produit.
À budget égal, les paliers ne racontent plus la même histoire
Comparer les modèles au même palier répond à la mauvaise question : personne n’achète un niveau d’effort. On paie pour un résultat dans une enveloppe donnée, et c’est cette approche qui réorganise le comparatif Claude Opus 5 vs Sonnet 5.
Pour chaque configuration de Sonnet 5, le tableau ci-dessous indique le palier Opus 4.8 le moins cher qui atteint ou dépasse son taux de réussite. La colonne promo correspond au tarif standard multiplié par 0,67.
| Configuration Sonnet 5 | Sonnet pass@1 | Sonnet $, standard | Sonnet $, promo (est.) | Palier Opus 4.8 le moins cher qui l’égale | Opus $ | Opus pass@1 | Coût Opus vs Sonnet promo | Écart de qualité |
|---|---|---|---|---|---|---|---|---|
| low | 30,5 % | 2,19 $ | 1,47 $ | low | 2,29 $ | 40,8 % | 1,56x | +10,3 pp |
| medium | 39,8 % | 4,08 $ | 2,73 $ | low | 2,29 $ | 40,8 % | 0,84x | +1,0 pp |
| high | 48,2 % | 7,43 $ | 4,98 $ | medium | 3,44 $ | 48,7 % | 0,69x | +0,4 pp |
| xhigh | 49,7 % | 11,89 $ | 7,97 $ | high | 4,28 $ | 51,8 % | 0,54x | +2,1 pp |
| max | 53,8 % | 26,40 $ | 17,69 $ | xhigh | 8,01 $ | 54,4 % | 0,45x | +0,5 pp |
Regardez les deux dernières colonnes : en descendant Opus d’un palier par rapport au niveau Sonnet envisagé, on obtient un taux de réussite égal ou supérieur pour 16 % à 55 % moins cher, même face au prix promotionnel. Seule la ligne low inverse le résultat : à faible effort, Sonnet 5 en promotion coûte 36 % de moins, mais cède 10,3 points de réussite.
L’argument inverse a aussi du sens
Dans le premier fil, un commentaire s’appuie sur le graphique officiel au niveau medium : Opus approcherait 7 $ contre 4,50 $ pour Sonnet, avec des taux de réussite de 68 % et 62 %, soit « 55 % de prix en plus pour moins de 10 % de gain de réussite dans ce test ».
Le compromis est défendable si rater 6 points ne coûte rien. Il ne l’est plus lorsqu’un mauvais diff peut partir en production.
Les deux raisonnements dépendent de la distribution de tâches de quelqu’un d’autre. Vingt à cinquante tâches issues de votre propre usage, évaluées au coût par réalisation réussie plutôt qu’au coût par token, valent mieux que n’importe quel tableau de cette page.
Ce qu’Opus 5 peut changer avec le même tarif de 5 $ et 25 $
Le tarif de lancement d’Opus 5 est identique à celui d’Opus 4.8, ligne pour ligne. Reste donc le troisième axe : la consommation de tokens par tâche. Les éléments disponibles vont dans les deux sens.
| Éléments en faveur d’un Opus 5 moins cher par tâche | Éléments en faveur d’un coût supérieur |
|---|---|
| Anthropic indique qu’Opus 5 domine Frontier-Bench v0.1 et « plus que double les performances d’Opus 4.8 à un coût par tâche inférieur » (données déclarées par le fournisseur, sur ses propres exécutions, sans reproduction indépendante) | Extended thinking est activé par défaut, alors qu’il était désactivé sur Opus 4.8 |
| Un partenaire juridique non nommé aurait observé environ 26 % de tokens en moins au raisonnement max (information relayée par Anthropic, sans méthodologie) | Sur nos quatre tâches, Opus 4.8 a produit 380 tokens de sortie, contre 1 182 pour Opus 5 |
Les deux scénarios restent plausibles : avant d’allouer un budget, refaites les mesures de coût sur votre propre dépôt.
Attention également à une optimisation apparemment évidente pour réduire le coût d’Opus 5 : thinking: {"type": "disabled"} n’est accepté qu’au niveau high ou inférieur ; à xhigh et max, l’API retourne une erreur 400. C’est l’un des nombreux changements incompatibles entre Opus 4.8 et Opus 5 à examiner avant une migration.
Le domaine de Sonnet 5 : les tâches courtes en une requête
Le 24 juillet 2026, nous avons soumis les deux modèles à quatre petites tâches, notées par script plutôt qu’à l’appréciation : corriger deux défauts dans kth_smallest, générer un JSON strict avec un ordre de clés imposé et une somme de contrôle cohérente, répondre 65 à une question sur les nombres de Frobenius, puis refactorer en ajoutant une validation tout en conservant la signature et sans laisser le moindre commentaire.
Les deux ont validé les quatre tâches. L’écart est apparu sur le compteur.
| Claude Sonnet 5 | Claude Opus 5 | |
|---|---|---|
| Vérifications réussies | 4/4 | 4/4 |
| Tokens de sortie, quatre tâches | 858 | 1 182 |
| Latence totale | 13,7 s | 24,6 s |
| Coût de sortie aux tarifs promo / standard | 0,858 ¢ / 1,287 ¢ | 2,955 ¢ |
Pour des sorties identiques et vérifiées, Opus 5 coûte 3,4 fois plus cher au tarif actuel de Sonnet, ou 2,3 fois plus une fois la promotion terminée, tout en prenant un peu plus de la moitié du temps en plus. La répétition des deux tâches de code via le canal officiel Claude Code donne le même signal : 240 tokens de sortie pour Sonnet 5, contre 465 pour Opus 5.
Trois limites comptent davantage que ce chiffre :
- Une seule exécution par modèle et par tâche. C’est un test de fumée, pas un benchmark.
- Les coûts ne couvrent que les tokens de sortie, aux tarifs officiels de sortie : la passerelle injectait un prompt système variable, rendant les volumes de tokens d’entrée impropres à un calcul de facturation.
- Il s’agit de quatre prompts courts, soit précisément le régime que le débat communautaire écarte. Aucune tâche ne fait 70 étapes ; rien ici ne reproduit donc l’explosion du nombre d’étapes.
Dans ce périmètre, la remise de Sonnet 5 tient pleinement. Un développeur décrivait précisément ce type de charge : des agents très documentaires réalisant des « extractions en une requête avec un raisonnement minimal », pour lesquels « Opus serait surdimensionné ».
Deux dates à associer à tous les chiffres de cet article
30 juin 2026 : le graphique officiel de coût a été corrigé
L’annonce d’Anthropic pour Claude Sonnet 5 contient une note de modification. Le graphique initial coût-performance employait « une méthodologie plus simple qui ne reflétait pas la méthodologie standard utilisée pour les évaluations de recherche agentique », ce qui a eu « pour effet de sous-estimer les performances de Sonnet 5 dans l’évaluation ».
Le graphique et le texte qui l’accompagne ont été révisés pour suivre la méthodologie BrowseComp de la system card, « utilisant un budget de 10M de tokens avec compaction et appels d’outils programmatiques ».
Si vous citez ce graphique, vérifiez donc sa version et lisez sa légende : Sonnet 5 y est chiffré aux tarifs standards de 3 $/15 $, le tarif promotionnel y est indiqué comme inférieur au coût réel du graphique, et Opus 4.8 y est valorisé à 5 $/25 $.
1er septembre 2026 : fin de la tarification promotionnelle
Le tarif de lancement de Sonnet 5 expire, toutes les lignes publiées augmentent de 50 %, tandis qu’Opus 5 reste à 5 $/25 $. Il reste donc 37 jours à compter de la publication avant que tout modèle de dépense fondé sur les tarifs actuels ne devienne caduc.
Une autre date revient souvent dans ces discussions, mais elle ne s’applique pas ici. Le tokenizer de Claude 4.7 produit environ 30 % de tokens de plus pour un même texte que celui de Sonnet 4.6 ; comparer Sonnet 5 et Sonnet 4.6 au prix par token sous-estime donc la hausse réelle. Opus 5 et Sonnet 5 partagent ce tokenizer : cet effet s’annule entre eux.
Quel modèle choisir selon votre budget ?
Le duel Claude Opus 5 vs Sonnet 5 ne produit pas un vainqueur unique, mais trois règles de routage. Les seuils reprennent le coût moyen par tâche de DeepSWE, avec Opus 4.8 dans le rôle d’Opus. Ils constituent un point de départ pour le travail sur dépôt, pas des constantes pour les agents de recherche, les pipelines de support ou les workflows documentaires.
- Sous environ 2,30 $ par tâche, choisissez Sonnet 5 en low. C’est la seule configuration où son avantage de prix survit sur du travail agentique, avec un taux de réussite de 30,5 % en contrepartie. Pour l’extraction en une requête, la classification ou tout résultat borné, restez ici et profitez du facteur 3,4 mesuré. Un développeur qualifiait Sonnet 5 de « suffisamment proche d’Opus pour 90 % du travail, mais instantané, relativement parlant », un atout important lorsqu’un humain attend la réponse.
- D’environ 2,30 $ à 8 $ par tâche, préférez Opus un palier plus bas à Sonnet un palier plus haut. Opus medium constitue un bon défaut de travail ; passez à Opus high lorsqu’une erreur est coûteuse à détecter en revue. Sur Opus 5, le prix par token est identique mais le nombre de tokens par tâche reste inconnu : utilisez cette tranche comme point de départ pour vos tests.
- Au-delà de 8 $, cessez d’augmenter le réglage Sonnet. Sonnet 5 en max coûte 26,40 $ par tâche pour 53,8 % sur DeepSWE ; Opus 4.8 en xhigh coûte 8,01 $ pour 54,4 % ; Fable 5 en low atteint 59,6 % pour 3,76 $. AIReiter référence Opus 4.8 à 1,56 $/7,76 $ par MTok, soit environ 69 % sous le tarif catalogue, même si sa gamme Claude ne propose pas encore Opus 5.
FAQ
Claude Opus 5 est-il plus cher que Sonnet 5 ?
Par token, oui : 5 $/25 $ contre les 2 $/10 $ promotionnels de Sonnet 5. Opus coûte donc 2,5 fois plus jusqu’au 31 août 2026, puis 1,67 fois plus. Par tâche terminée, l’ordre peut s’inverser, et les médianes le confirment au-delà de quelques exécutions aberrantes. Sur DeepSWE, le coût médian au niveau max était de 23,28 $ pour Sonnet 5, contre 12,35 $ pour Opus 4.8.
Combien coûte Claude Sonnet 5 ?
2 $ par million de tokens d’entrée et 10 $ par million de tokens de sortie jusqu’au 31 août 2026, puis respectivement 3 $ et 15 $ à compter du 1er septembre. Cette hausse est de 50 % sur toutes les lignes publiées : les écritures de cache de 5 minutes passent de 2,50 $ à 3,75 $, celles d’une heure de 4 $ à 6 $, et les lectures de cache de 0,20 $ à 0,30 $. Le tarif Batch est de 1 $/5 $ pendant la promotion.
Pourquoi un modèle moins cher peut-il coûter plus cher au final ?
Parce que la facture dépend du nombre d’étapes, pas du nombre de tâches. Sur toute l’échelle d’effort, le nombre médian d’étapes de Sonnet 5 passe de 70 à 260, contre 47 à 116 pour Opus 4.8 ; en max, il lit 72,4M de tokens par tâche contre 17,0M. Lire quatre fois plus annule largement une remise de 60 % sur chaque token.
Opus 5 est-il nettement meilleur que Sonnet 5 ?
Sur une seule tentative, oui : sur DeepSWE, Opus 4.8 devance Sonnet 5 de 3,5 à 10,3 points de pass@1, avec l’écart le plus grand au niveau le plus bas.
Avec quatre tentatives chacun, l’écart se referme presque : Sonnet 5 en high atteint 79,6 % de pass@4, contre 77,9 % pour Opus 4.8 ; en max, les deux montent à 78,8 % et 79,3 %. Sonnet peut y arriver, mais il lui faut davantage d’essais, et chacun est facturé.
La hausse de prix de Sonnet 5 au 1er septembre change-t-elle la conclusion ?
Elle abaisse le point de croisement au lieu de le relever. L’avantage de Sonnet 5 par token passe de 60 % à 40 %, tandis qu’Opus 5 reste à 5 $/25 $ : chaque combinaison du tableau à budget égal devient moins favorable à Sonnet. La seule ligne qui lui était favorable, low, à 36 % sous Opus low avec le tarif promotionnel, se réduit à environ 4 % sous le tarif standard.
