AIREITER
AnthropicText Chat

Claude Sonnet 5.5

API Claude Sonnet 5.5 à moitié prix par rapport au tarif Anthropic : 1 $ en entrée, 5 $ en sortie par million de tokens. Nouveautés par rapport à Sonnet 5, benchmarks, changements majeurs et code opérationnel.

EntréeOfficiel $2.00 par million de tokensAIReiter $1.00 par million de tokensSortieOfficiel $10.00 par million de tokensAIReiter $5.00 par million de tokensLecture cacheOfficiel $0.20 par million de tokensAIReiter $0.10 par million de tokensCréation cacheOfficiel $2.50 par million de tokensAIReiter $1.25 par million de tokens
Exécuter avec l'API

ENTRÉE

SORTIE

Example
Generated in
42.7 seconds
Token d’entrée
134
Token de sortie
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Détails du modèle

Utilisez la même clé de modèle dans le Playground, les requêtes API et les workflows internes.

ID du modèle
claude-sonnet-5-5
Fournisseur
Anthropic
Protocole
Anthropic Messages
Fenêtre de contexte
1,000,000 tokens
Sortie maximale
128,000 tokens
Token d’entrée
100 crédits / 1 M de tokens
Token de sortie
500 crédits / 1 M de tokens
Lecture du cache
10 crédits / 1 M de tokens
Écriture du cache
125 crédits / 1 M de tokens

Les nouveautés de Claude Sonnet 5.5

Anthropic a lancé Claude Sonnet 5.5 le 28 septembre 2026 en tant qu'évolution directe de Sonnet 5. Le prix officiel n'a pas changé ; la quantité de travail accomplie et le nombre de tokens utilisés pour y parvenir, en revanche, ont évolué.

Proche d'Opus 5.5 sur le travail de connaissances

Anthropic rapporte un score GDPval-AA de 1844 pour Sonnet 5.5, deux points derrière Opus 5.5 (1846) et environ 400 points devant Sonnet 5 (1449). Anthropic indique également qu'Opus 5.5 reste nettement supérieur sur les tâches ouvertes nécessitant un jugement continu.

Une avancée majeure en programmation

Sur CursorBench 4.0, Anthropic rapporte 55,5 % pour Sonnet 5.5, contre 34,1 % pour Sonnet 5 et 57,8 % pour Opus 5.5. Anthropic le positionne pour les tâches quotidiennes bien définies : développement de fonctionnalités, correction de bugs et création de documents, présentations et feuilles de calcul.

Moins de tokens pour la même tâche

Les premiers clients ont constaté des économies sur leurs propres charges de travail : Slack a observé environ 14 % de tokens de sortie en moins sans modifier ses prompts, et Balyasny Asset Management a mesuré environ 121k tokens par réponse contre 497k sur Sonnet 5 sur 2 441 tâches financières.

Génération plus rapide, même tokenizer

Anthropic affirme que la génération est plus de 30 % plus rapide que Sonnet 5 ; Artificial Analysis a mesuré environ 139 tokens de sortie par seconde. Le tokenizer reste inchangé, de sorte que le même texte équivaut au même nombre de tokens sur les deux modèles.

Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5

Les trois fonctionnent avec la même clé AIReiter. En résumé : quittez Sonnet 5 dès que vos requêtes respectent les vérifications de migration ci-dessous, et conservez Opus 5.5 pour les tâches ouvertes les plus complexes.

Sonnet 5.5 vs Sonnet 5 : même prix, plus de résultats

Les deux modèles sont affichés au tarif officiel de 2 $ en entrée et 10 $ en sortie par million de tokens. Sonnet 5.5 obtient de meilleurs scores sur les benchmarks de programmation et de travail de connaissances ci-dessus et utilise généralement moins de tokens, ce qui réduit le coût d'une même tâche.

Sonnet 5.5 vs Opus 5.5 : moitié prix

Ici, Sonnet 5.5 est à 1,00 $ en entrée et 5,00 $ en sortie par million de tokens ; Opus 5.5 est à 2,00 $ et 10,00 $. Les deux disposent d'une fenêtre de contexte de 1M de tokens et d'une sortie maximale de 128k, donc la transition se résume à modifier le champ model, rien de plus.

Quand Opus 5.5 reste pertinent

Pour les tâches longues et ambiguës où le modèle doit planifier, détecter ses propres erreurs et poursuivre son exécution. Base44 a rapporté 3,6 itérations par création d'application sur Sonnet 5.5 contre 7,7 sur Opus 5 : essayez donc d'abord Sonnet 5.5 et ne basculez vers Opus que pour les tâches qui échouent.

Quand rester sur Sonnet 5 pour l'instant

Si votre code désactive le thinking, force l'utilisation d'un outil spécifique ou définit une temperature, ces requêtes échoueront sur Sonnet 5.5 tant qu'elles ne seront pas modifiées. Les outils de sécurité peuvent également rencontrer davantage de refus. Corrigez ces points au préalable avant de migrer.

Migration depuis Sonnet 5 : ce qui renvoie désormais une erreur

Changer la chaîne du modèle en claude-sonnet-5-5 n'est pas toujours suffisant. Ces structures de requêtes fonctionnaient sur Sonnet 5 et sont rejetées par Sonnet 5.5.

thinking: disabled renvoie une erreur 400

L'adaptive thinking est activé en permanence. Remplacez {"type": "disabled"} par {"type": "between_tools"}, le réglage le plus bas, qui ignore le thinking avant la première réponse. between_tools fonctionne uniquement avec un effort low, medium ou high ; pour xhigh ou max, omettez thinking ou envoyez {"type": "adaptive"}.

Les budgets manuels de thinking renvoient une erreur 400

thinking: {"type": "enabled", "budget_tokens": N} est rejeté. Contrôlez plutôt la profondeur avec le niveau d'effort. Les tokens de thinking sont toujours décomptés de max_tokens et facturés comme des tokens de sortie, veillez donc à augmenter max_tokens si les réponses commencent à être tronquées.

Le choix forcé d'outil est rejeté

Un tool_choice qui force un outil spécifique génère désormais une erreur. Utilisez le choix d'outil automatique avec des définitions d'outils strictes et laissez le modèle décider quand les appeler.

Les valeurs personnalisées de temperature, top_p et top_k renvoient une erreur 400

Seul l'échantillonnage par défaut est accepté. Supprimez ces champs de la requête au lieu de leur attribuer des valeurs fixes. Un changement joue en votre faveur : le prompt minimal pouvant être mis en cache passe de 1 024 à 512 tokens.

Choisissez le niveau d'effort avant de déployer

L'effort est désormais le principal levier pour ajuster le coût et la latence. Il existe cinq niveaux : low, medium, high, xhigh et max.

La valeur par défaut de l'API est high

Si vous ne spécifiez aucun effort, l'API s'exécute à high. Claude Code et les applications Claude utilisent medium par défaut. Définissez output_config.effort explicitement afin que votre facture ne dépende pas d'une valeur par défaut.

max est coûteux

Avec l'effort max, Artificial Analysis a mesuré 7,60 $ par tâche au tarif catalogue et 410M de tokens de sortie sur l'ensemble de son index, contre une médiane de 88M. Les affirmations d'Anthropic concernant l'efficacité portent sur les niveaux inférieurs, pas sur max.

Commencez à medium, mesurez, puis ajustez

Exécutez vos tâches réelles à medium, vérifiez la qualité et n'augmentez le niveau que lorsque cela s'avère insuffisant. Pour les boucles d'outils sensibles à la latence, low ou medium avec le raisonnement between_tools permet de garder des premières réponses rapides.

Tarifs de l'API Claude Sonnet 5.5 sur AIReiter

Chaque ligne est facturée à 50 % du tarif catalogue d'Anthropic. Même modèle, même protocole Messages.

Moitié prix par rapport au tarif catalogue sur chaque ligne

Entrée : 1,00 $ (catalogue : 2,00 $). Sortie : 5,00 $ (catalogue : 10,00 $). Lectures du cache : 0,10 $ (catalogue : 0,20 $). Écritures du cache : 1,25 $ (catalogue : 2,50 $). Tous les prix sont par million de tokens.

Un appel réel : 1,50 $ au lieu de 3,00 $

Un million de tokens d'entrée plus cent mille tokens de sortie coûte 1,50 $ ici et 3,00 $ au tarif catalogue d'Anthropic. Le même appel sur Opus 5.5 ici coûte 3,00 $.

Facturé selon les tokens réellement utilisés

Une estimation est provisionnée au début de l'appel, puis régularisée par rapport au nombre réel de tokens lorsque la réponse est terminée, et la différence est restituée. Le tarif est identique du premier au millionième token ; il n'y a pas de palier pour les contextes longs.

Comment appeler l'API Claude Sonnet 5.5

Le point de terminaison utilise le protocole Messages d'Anthropic, de sorte qu'un client Claude existant n'a besoin que d'une nouvelle URL de base et d'une nouvelle clé.

01

Obtenez une clé et pointez le client vers AIReiter

Créez une clé API dans votre tableau de bord AIReiter. Dans les SDK officiels d'Anthropic, définissez l'URL de base sur https://aireiter.com/api — le SDK ajoute /v1/messages automatiquement.

02

Envoyez une requête avec curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

Ou utilisez le SDK Python

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

FAQ de l'API Claude Sonnet 5.5

/ 01

Quand Claude Sonnet 5.5 est-il sorti et quel est l'identifiant du modèle ?

Anthropic l'a publié le 28 septembre 2026. L'identifiant du modèle dans l'API est claude-sonnet-5-5, et sa date limite de connaissances est juin 2026.

/ 02

Quelle est la fenêtre de contexte et la sortie maximale ?

Une fenêtre de contexte de 1M de tokens et jusqu'à 128K tokens de sortie par requête. Il accepte du texte et des images en entrée et renvoie du texte.

/ 03

Combien coûte l'API Claude Sonnet 5.5 ?

Anthropic affiche 2 $ en entrée et 10 $ en sortie par million de tokens, soit le même tarif que Sonnet 5. AIReiter facture la moitié : 1 $ en entrée, 5 $ en sortie, 0,10 $ pour les lectures de cache et 1,25 $ pour les écritures de cache.

/ 04

Puis-je désactiver le raisonnement ?

Pas totalement. thinking disabled renvoie une erreur 400. Le paramètre le plus bas est between_tools, qui fonctionne avec un effort low, medium et high.

/ 05

Sonnet 5.5 est-il meilleur que Sonnet 5 ?

D'après les benchmarks de programmation et de travail intellectuel publiés par Anthropic, oui, et de loin, pour le même prix catalogue. Vérifiez les modifications de migration ci-dessus avant de basculer, car certains formats de requête Sonnet 5 échouent désormais.

/ 06

Pourquoi ma question de sécurité a-t-elle été refusée ou traitée par Sonnet 5 ?

Sonnet 5.5 est le premier modèle Sonnet à intégrer les garde-fous de cybersécurité utilisés sur les modèles les plus performants d'Anthropic. Certaines requêtes à risque plus élevé basculent vers Sonnet 5, et des tâches de sécurité légitimes peuvent essuyer davantage de refus. Il s'agit d'un comportement en amont.

/ 07

Ai-je besoin d'un compte Anthropic ?

Non. Une clé AIReiter fonctionne avec l'endpoint AIReiter, et vous pouvez tester le modèle dans le playground sur cette page avant d'écrire la moindre ligne de code.

/ 08

Quelles API sont prises en charge ?

Anthropic Messages à l'adresse /api/v1/messages constitue le contrat principal, avec streaming. Les Chat Completions de style OpenAI et l'API Responses sont également prises en charge, et /api/v1/models liste les modèles disponibles pour votre clé.