Les nouveautés de Claude Sonnet 5.5
Anthropic a lancé Claude Sonnet 5.5 le 28 septembre 2026 en tant qu'évolution directe de Sonnet 5. Le prix officiel n'a pas changé ; la quantité de travail accomplie et le nombre de tokens utilisés pour y parvenir, en revanche, ont évolué.
Proche d'Opus 5.5 sur le travail de connaissances
Anthropic rapporte un score GDPval-AA de 1844 pour Sonnet 5.5, deux points derrière Opus 5.5 (1846) et environ 400 points devant Sonnet 5 (1449). Anthropic indique également qu'Opus 5.5 reste nettement supérieur sur les tâches ouvertes nécessitant un jugement continu.
Une avancée majeure en programmation
Sur CursorBench 4.0, Anthropic rapporte 55,5 % pour Sonnet 5.5, contre 34,1 % pour Sonnet 5 et 57,8 % pour Opus 5.5. Anthropic le positionne pour les tâches quotidiennes bien définies : développement de fonctionnalités, correction de bugs et création de documents, présentations et feuilles de calcul.
Moins de tokens pour la même tâche
Les premiers clients ont constaté des économies sur leurs propres charges de travail : Slack a observé environ 14 % de tokens de sortie en moins sans modifier ses prompts, et Balyasny Asset Management a mesuré environ 121k tokens par réponse contre 497k sur Sonnet 5 sur 2 441 tâches financières.
Génération plus rapide, même tokenizer
Anthropic affirme que la génération est plus de 30 % plus rapide que Sonnet 5 ; Artificial Analysis a mesuré environ 139 tokens de sortie par seconde. Le tokenizer reste inchangé, de sorte que le même texte équivaut au même nombre de tokens sur les deux modèles.
Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5
Les trois fonctionnent avec la même clé AIReiter. En résumé : quittez Sonnet 5 dès que vos requêtes respectent les vérifications de migration ci-dessous, et conservez Opus 5.5 pour les tâches ouvertes les plus complexes.
Sonnet 5.5 vs Sonnet 5 : même prix, plus de résultats
Les deux modèles sont affichés au tarif officiel de 2 $ en entrée et 10 $ en sortie par million de tokens. Sonnet 5.5 obtient de meilleurs scores sur les benchmarks de programmation et de travail de connaissances ci-dessus et utilise généralement moins de tokens, ce qui réduit le coût d'une même tâche.
Sonnet 5.5 vs Opus 5.5 : moitié prix
Ici, Sonnet 5.5 est à 1,00 $ en entrée et 5,00 $ en sortie par million de tokens ; Opus 5.5 est à 2,00 $ et 10,00 $. Les deux disposent d'une fenêtre de contexte de 1M de tokens et d'une sortie maximale de 128k, donc la transition se résume à modifier le champ model, rien de plus.
Quand Opus 5.5 reste pertinent
Pour les tâches longues et ambiguës où le modèle doit planifier, détecter ses propres erreurs et poursuivre son exécution. Base44 a rapporté 3,6 itérations par création d'application sur Sonnet 5.5 contre 7,7 sur Opus 5 : essayez donc d'abord Sonnet 5.5 et ne basculez vers Opus que pour les tâches qui échouent.
Quand rester sur Sonnet 5 pour l'instant
Si votre code désactive le thinking, force l'utilisation d'un outil spécifique ou définit une temperature, ces requêtes échoueront sur Sonnet 5.5 tant qu'elles ne seront pas modifiées. Les outils de sécurité peuvent également rencontrer davantage de refus. Corrigez ces points au préalable avant de migrer.
Migration depuis Sonnet 5 : ce qui renvoie désormais une erreur
Changer la chaîne du modèle en claude-sonnet-5-5 n'est pas toujours suffisant. Ces structures de requêtes fonctionnaient sur Sonnet 5 et sont rejetées par Sonnet 5.5.
thinking: disabled renvoie une erreur 400
L'adaptive thinking est activé en permanence. Remplacez {"type": "disabled"} par {"type": "between_tools"}, le réglage le plus bas, qui ignore le thinking avant la première réponse. between_tools fonctionne uniquement avec un effort low, medium ou high ; pour xhigh ou max, omettez thinking ou envoyez {"type": "adaptive"}.
Les budgets manuels de thinking renvoient une erreur 400
thinking: {"type": "enabled", "budget_tokens": N} est rejeté. Contrôlez plutôt la profondeur avec le niveau d'effort. Les tokens de thinking sont toujours décomptés de max_tokens et facturés comme des tokens de sortie, veillez donc à augmenter max_tokens si les réponses commencent à être tronquées.
Le choix forcé d'outil est rejeté
Un tool_choice qui force un outil spécifique génère désormais une erreur. Utilisez le choix d'outil automatique avec des définitions d'outils strictes et laissez le modèle décider quand les appeler.
Les valeurs personnalisées de temperature, top_p et top_k renvoient une erreur 400
Seul l'échantillonnage par défaut est accepté. Supprimez ces champs de la requête au lieu de leur attribuer des valeurs fixes. Un changement joue en votre faveur : le prompt minimal pouvant être mis en cache passe de 1 024 à 512 tokens.
Choisissez le niveau d'effort avant de déployer
L'effort est désormais le principal levier pour ajuster le coût et la latence. Il existe cinq niveaux : low, medium, high, xhigh et max.
La valeur par défaut de l'API est high
Si vous ne spécifiez aucun effort, l'API s'exécute à high. Claude Code et les applications Claude utilisent medium par défaut. Définissez output_config.effort explicitement afin que votre facture ne dépende pas d'une valeur par défaut.
max est coûteux
Avec l'effort max, Artificial Analysis a mesuré 7,60 $ par tâche au tarif catalogue et 410M de tokens de sortie sur l'ensemble de son index, contre une médiane de 88M. Les affirmations d'Anthropic concernant l'efficacité portent sur les niveaux inférieurs, pas sur max.
Commencez à medium, mesurez, puis ajustez
Exécutez vos tâches réelles à medium, vérifiez la qualité et n'augmentez le niveau que lorsque cela s'avère insuffisant. Pour les boucles d'outils sensibles à la latence, low ou medium avec le raisonnement between_tools permet de garder des premières réponses rapides.
Tarifs de l'API Claude Sonnet 5.5 sur AIReiter
Chaque ligne est facturée à 50 % du tarif catalogue d'Anthropic. Même modèle, même protocole Messages.
Moitié prix par rapport au tarif catalogue sur chaque ligne
Entrée : 1,00 $ (catalogue : 2,00 $). Sortie : 5,00 $ (catalogue : 10,00 $). Lectures du cache : 0,10 $ (catalogue : 0,20 $). Écritures du cache : 1,25 $ (catalogue : 2,50 $). Tous les prix sont par million de tokens.
Un appel réel : 1,50 $ au lieu de 3,00 $
Un million de tokens d'entrée plus cent mille tokens de sortie coûte 1,50 $ ici et 3,00 $ au tarif catalogue d'Anthropic. Le même appel sur Opus 5.5 ici coûte 3,00 $.
Facturé selon les tokens réellement utilisés
Une estimation est provisionnée au début de l'appel, puis régularisée par rapport au nombre réel de tokens lorsque la réponse est terminée, et la différence est restituée. Le tarif est identique du premier au millionième token ; il n'y a pas de palier pour les contextes longs.
Comment appeler l'API Claude Sonnet 5.5
Le point de terminaison utilise le protocole Messages d'Anthropic, de sorte qu'un client Claude existant n'a besoin que d'une nouvelle URL de base et d'une nouvelle clé.
Obtenez une clé et pointez le client vers AIReiter
Créez une clé API dans votre tableau de bord AIReiter. Dans les SDK officiels d'Anthropic, définissez l'URL de base sur https://aireiter.com/api — le SDK ajoute /v1/messages automatiquement.
Envoyez une requête avec curl
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'
Ou utilisez le SDK Python
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)
FAQ de l'API Claude Sonnet 5.5
/ 01Quand Claude Sonnet 5.5 est-il sorti et quel est l'identifiant du modèle ?
Anthropic l'a publié le 28 septembre 2026. L'identifiant du modèle dans l'API est claude-sonnet-5-5, et sa date limite de connaissances est juin 2026.
/ 02Quelle est la fenêtre de contexte et la sortie maximale ?
Une fenêtre de contexte de 1M de tokens et jusqu'à 128K tokens de sortie par requête. Il accepte du texte et des images en entrée et renvoie du texte.
/ 03Combien coûte l'API Claude Sonnet 5.5 ?
Anthropic affiche 2 $ en entrée et 10 $ en sortie par million de tokens, soit le même tarif que Sonnet 5. AIReiter facture la moitié : 1 $ en entrée, 5 $ en sortie, 0,10 $ pour les lectures de cache et 1,25 $ pour les écritures de cache.
/ 04Puis-je désactiver le raisonnement ?
Pas totalement. thinking disabled renvoie une erreur 400. Le paramètre le plus bas est between_tools, qui fonctionne avec un effort low, medium et high.
/ 05Sonnet 5.5 est-il meilleur que Sonnet 5 ?
D'après les benchmarks de programmation et de travail intellectuel publiés par Anthropic, oui, et de loin, pour le même prix catalogue. Vérifiez les modifications de migration ci-dessus avant de basculer, car certains formats de requête Sonnet 5 échouent désormais.
/ 06Pourquoi ma question de sécurité a-t-elle été refusée ou traitée par Sonnet 5 ?
Sonnet 5.5 est le premier modèle Sonnet à intégrer les garde-fous de cybersécurité utilisés sur les modèles les plus performants d'Anthropic. Certaines requêtes à risque plus élevé basculent vers Sonnet 5, et des tâches de sécurité légitimes peuvent essuyer davantage de refus. Il s'agit d'un comportement en amont.
/ 07Ai-je besoin d'un compte Anthropic ?
Non. Une clé AIReiter fonctionne avec l'endpoint AIReiter, et vous pouvez tester le modèle dans le playground sur cette page avant d'écrire la moindre ligne de code.
/ 08Quelles API sont prises en charge ?
Anthropic Messages à l'adresse /api/v1/messages constitue le contrat principal, avec streaming. Les Chat Completions de style OpenAI et l'API Responses sont également prises en charge, et /api/v1/models liste les modèles disponibles pour votre clé.