AIREITER
AnthropicText Chat

Claude Opus 5.5

API Claude Opus 5.5 à 50 % du tarif Anthropic : 2 $ en entrée, 10 $ en sortie par million de tokens. Tarif unique sur toute la fenêtre de 1M. Testez ici, puis POST /v1/messages.

EntréeOfficiel $4.00 par million de tokensAIReiter $2.00 par million de tokensSortieOfficiel $20.00 par million de tokensAIReiter $10.00 par million de tokensLecture cacheOfficiel $0.20 par million de tokensAIReiter $0.10 par million de tokensCréation cacheOfficiel $5.00 par million de tokensAIReiter $2.50 par million de tokens
Exécuter avec l'API

ENTRÉE

SORTIE

Example
Generated in
42.7 seconds
Token d’entrée
134
Token de sortie
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Détails du modèle

Utilisez la même clé de modèle dans le Playground, les requêtes API et les workflows internes.

ID du modèle
claude-opus-5-5
Fournisseur
Anthropic
Protocole
Anthropic Messages
Fenêtre de contexte
1,000,000 tokens
Sortie maximale
128,000 tokens
Token d’entrée
200 crédits / 1 M de tokens
Token de sortie
1,000 crédits / 1 M de tokens
Lecture du cache
10 crédits / 1 M de tokens
Écriture du cache
250 crédits / 1 M de tokens

Ce que coûte Claude Opus 5.5 ici

AIReiter facture 50 % du tarif officiel d'Anthropic sur chaque ligne. Même modèle, même protocole Messages, moitié moins sur la facture.

Un appel réel : 3,00 $ au lieu de 6,00 $

Un million de tokens d'entrée plus cent mille tokens de sortie coûtent 3,00 $ sur AIReiter. Le même appel facturé au tarif officiel d'Anthropic revient à 6,00 $. Rien ne change dans la requête — seulement l'endpoint et la clé.

Chaque ligne, divisée par deux

L'entrée à 4,00 $ passe à 2,00 $. La sortie à 20,00 $ passe à 10,00 $. Les lectures de cache à 0,20 $ passent à 0,10 $. Les écritures de cache à 5,00 $ passent à 2,50 $. Le tout par million de tokens.

Vous ne payez que les tokens réellement utilisés

AIReiter bloque une estimation avant l'appel, puis ajuste le montant selon le nombre réel de tokens dès la fin de la réponse et vous rembourse la différence. Une réponse courte à un prompt long ne vous coûte pas le montant estimé.

Pas de palier tarifaire à 200K

Le tarif est identique du premier au millionième token. Il n'y a aucun palier de contexte long à contourner et aucune raison de découper un long document simplement pour rester sous un seuil.

Claude Opus 5.5 vs GPT-6 Sol

Tous deux lancés la même semaine et accessibles ici avec une seule clé, cette comparaison se base sur les prix réels d'AIReiter plutôt que sur les grilles tarifaires officielles. En résumé : Sol est moins cher, Opus 5.5 est plus régulier et plus performant sur les tâches agentiques.

GPT-6 Sol est moins cher par token

Sol coûte 0,60 $ en entrée et 3,00 $ en sortie par million de tokens ici, contre 2,00 $ et 10,00 $ pour Opus 5.5. Cela reste vrai pour toutes les longueurs de prompt, y compris dans le palier de contexte long de Sol. Si le coût par token est votre seul critère, Sol l'emporte.

Sol a un palier tarifaire ; Opus 5.5 n'en a pas

Au-delà de 272K de contexte, le prix d'entrée de Sol double et son prix de sortie augmente de moitié. Une charge de travail qui dépasse ce seuil voit sa facture grimper brutalement. Opus 5.5 applique un tarif unique jusqu'à 1M, votre courbe de coûts reste donc parfaitement linéaire.

Les tâches agentiques et de code avantagent Opus 5.5

Anthropic rapporte qu'Opus 5.5 surpasse Claude Fable 5.1 sur les principaux benchmarks agentiques tout en affichant un tarif bien inférieur. Ce sont les chiffres annoncés par le fournisseur, non mesurés ici — testez-le sur vos propres cas d'usage réels avant de décider.

Une seule clé, les deux modèles

Sol et Opus 5.5 sont disponibles dans le même playground sur le même compte. Exécutez une tâche réelle sur chacun d'eux et comparez le coût par tâche accomplie plutôt que le coût par requête.

Comment appeler l'API Claude Opus 5.5

La route utilise le protocole Messages d'Anthropic. Deux lignes suffisent à adapter un client Claude existant.

01

Rediriger le client

Définissez l'URL de base sur https://aireiter.com/api/v1 et remplacez votre clé par votre clé AIReiter. Les SDK officiels d'Anthropic fonctionnent sans modification une fois l'URL de base configurée.

02

Envoyer la requête

POST https://aireiter.com/api/v1/messages { "model": "claude-opus-5-5", "max_tokens": 4096, "messages": [{"role": "user", "content": "Hello"}] }

03

Ajustez le paramètre effort, pas le thinking

Le mode adaptive thinking est activé par défaut. Pour consommer moins de tokens, définissez output_config.effort sur low ou medium plutôt que de désactiver thinking — sans thinking, la famille Opus 5 écrit parfois un appel d'outil sous forme de texte visible au lieu d'émettre un bloc tool_use.

FAQ de l'API Claude Opus 5.5

/ 01

Ai-je besoin d'un compte Anthropic ?

Non. Utilisez une clé AIReiter avec le endpoint AIReiter. Si vous n'avez encore rien intégré, testez d'abord le modèle dans le playground sur cette page.

/ 02

Combien cela coûte-t-il par rapport à un accès direct ?

La moitié. Anthropic affiche 4 $ en entrée et 20 $ en sortie par million de tokens ; AIReiter facture 2 $ et 10 $. Les lectures de cache sont à 0,10 $ contre 0,20 $ au tarif officiel.

/ 03

Quels protocoles puis-je utiliser ?

Anthropic Messages sur /api/v1/messages est le contrat principal. Les Chat Completions au format OpenAI et l'API Responses sont également pris en charge, et /api/v1/models liste ce qui est disponible pour votre clé.

/ 04

Le streaming fonctionne-t-il ?

Oui. La route Messages prend en charge les réponses en streaming et sans streaming avec le même format de requête que celui que vous enverriez à Anthropic.

/ 05

Comment suis-je facturé si une réponse est interrompue ?

Une estimation fait l'objet d'une retenue au début de l'appel, puis est régularisée selon les tokens d'entrée et de sortie réels à la fin, et la partie non utilisée est restituée. Vous êtes facturé sur l'utilisation réelle, pas sur la retenue.

/ 06

Dois-je choisir Opus 5.5 ou GPT-6 Sol ?

Sol coûte moins cher par token, quelle que soit la longueur. Choisissez Opus 5.5 si vous souhaitez un tarif fixe sans effet de seuil sur les contextes longs, ou si la qualité agentique et de code est déterminante. Les deux sont accessibles avec une seule clé, alors testez plutôt que de deviner.