AIREITER
DOCS APITARIFS
MODÈLES
  • AIReiter
  • Blog
  • Fable 5.1 contre Fable 5 : coûts, benchmarks et changements d’API

Fable 5.1 contre Fable 5 : coûts, benchmarks et changements d’API

Dernière mise à jour: 2026-09-02 02:43:19

Remplacer claude-fable-5 par claude-fable-5-1 peut sembler anodin : la première réponse arrive correctement, puis le routeur d’outils ou l’historique de conversation mutable commence à poser problème. Fable 5.1 est le meilleur choix par défaut pour les agents qui travaillent longtemps avec beaucoup de contenu mis en cache, mais ce n’est pas une mise à niveau sans risque : les tarifs catalogue et les limites restent identiques, tandis que trois comportements de l’API changent.

En bref : passez à Fable 5.1 pour les agents qui exploitent le cache

Claude Fable 5.1 succède désormais à Claude Fable 5, et la documentation d’Anthropic recommande cette version pour ses performances améliorées. L’intérêt est particulièrement évident pour un agent qui relit constamment un long préfixe de prompt : les lectures du cache passent de 1 $ à 0,25 $ par million de tokens, tandis que les tarifs standards d’entrée et de sortie restent respectivement de 10 $ et 50 $ par million de tokens. (Présentation de Fable 5.1 par Anthropic)

Si votre charge de travail…Commencez avec…Pourquoi
Réutilise un long prompt système, une base de code ou le contexte d’un documentFable 5.1Les lectures du cache coûtent 75 % moins cher et Anthropic rapporte de meilleurs résultats sur les tâches agentiques.
Force des appels d’outils, par exemple avec tool_choice: {"type":"any"}Testez Fable 5.1 avant de basculerFable 5.1 refuse la sélection forcée d’un outil et renvoie une erreur 400.
Modifie ou reconstruit d’anciens tours de conversationRestez sur Fable 5 jusqu’à la correction de la couche d’historiqueFable 5.1 lie les blocs de réflexion au prompt, aux outils et à l’historique qui les précèdent.
Doit bénéficier du tarif standard par token le plus basAucun des deux modèles FableLes deux coûtent 10 $ par million de tokens d’entrée et 50 $ par million de tokens de sortie.
Exécute des prompts classiques, sans cache, avec une intégration Fable 5 stableCommencez par une évaluationL’économie liée au tarif catalogue peut être limitée et les gains de benchmark varient selon la tâche.

Ce qui change entre Fable 5 et Fable 5.1

Claude Fable 5.1 conserve les principales caractéristiques de Claude Fable 5 : une fenêtre de contexte d’1 million de tokens, une sortie maximale de 128 000 tokens et une réflexion adaptative toujours activée. Les différences documentées concernent le statut du modèle, la date de coupure des connaissances — juin 2026 au lieu de janvier 2026 —, le prix réduit des lectures du cache ainsi que le comportement de l’API vis-à-vis des outils et des blocs de réflexion. (Présentation de l’ancien modèle Fable 5 ; Présentation du modèle Fable 5.1)

CaractéristiqueClaude Fable 5Claude Fable 5.1
ID du modèle dans l’APIclaude-fable-5claude-fable-5-1
Cycle de vieActif, ancien modèleActif, dernier modèle Fable
Date de sortie9 juin 20261er septembre 2026
Fenêtre de contexte1 million de tokens1 million de tokens
Sortie maximale128 000 tokens128 000 tokens
RéflexionAdaptative, toujours activéeAdaptative, toujours activée
Niveau d’effort par défautÉlevéÉlevé
Date de coupure des connaissances fiablesJanvier 2026Juin 2026
Tarif entrée / sortie10 $ / 50 $ par MTok10 $ / 50 $ par MTok
Tarif des lectures du cache1 $ / MTok0,25 $ / MTok

Fable 5.1 est disponible via l’API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform sur AWS. Anthropic indique que Fable 5 est proposé sur les mêmes familles de plateformes, avec un retrait qui n’interviendra pas avant le 9 juin 2027 ; le retrait de Fable 5.1 n’est pas prévu avant le 1er septembre 2027. (Disponibilité et cycle de vie de Fable 5.1 ; Disponibilité et cycle de vie de Fable 5)

L’économie se fait sur les lectures du cache, pas sur les tarifs catalogue

Fable 5.1 ne coûte pas moins cher lorsqu’il traite un nouvel input ou génère des tokens de sortie. Le modèle facture les mêmes 10 $ par million de tokens d’entrée et 50 $ par million de tokens de sortie que Fable 5. En revanche, une lecture du cache coûte 0,25 $ par million de tokens, contre 1 $ avec Fable 5. (Documentation tarifaire d’Anthropic)

Catégorie d’utilisationFable 5Fable 5.1Évolution
Input non mis en cache10 $ / MTok10 $ / MTokAucune
Sortie50 $ / MTok50 $ / MTokAucune
Écriture du cache pendant 5 minutes12,50 $ / MTok12,50 $ / MTokAucune
Écriture du cache pendant 1 heure20 $ / MTok20 $ / MTokAucune
Lecture du cache1 $ / MTok0,25 $ / MTok75 % moins cher
Entrée / sortie en traitement par lotsRemise de 50 %Remise de 50 %Même remise annoncée

Prenons un exemple simple : un agent relit dix fois le contexte mis en cache d’un projet contenant 1 million de tokens, puis génère 200 000 tokens de sortie. La partie lecture du cache coûte 10 $ avec Fable 5 et 2,50 $ avec Fable 5.1 ; la sortie coûte 10 $ dans les deux cas. Dans ces conditions précises, la facture de tokens passe donc de 20 $ à 12,50 $, soit une baisse de 37,5 %.

Les économies réelles dépendent du taux de succès des lectures du cache, des écritures, de la longueur des sorties, des nouvelles tentatives, des appels d’outils et du routage vers un modèle de secours. Anthropic estime le coût environ 25 % inférieur pour les charges classiques, et jusqu’à environ 45 % inférieur pour les charges fortement agentiques. (Page produit Fable d’Anthropic)

L’usage par abonnement obéit à une logique distincte de celle de l’API. Le centre d’aide d’Anthropic indique que Fable 5 et Fable 5.1 suivent les mêmes règles de forfait actuellement en vigueur : les abonnements Max ainsi que les sièges Team Premium ou Enterprise historique peuvent utiliser les modèles Fable dans la limite de 50 % du quota hebdomadaire, tandis que les comptes Pro et les sièges standards utilisent des crédits à la consommation. La promotion initiale de Fable 5 s’est terminée le 19 juillet 2026 et Fable 5.1 n’en faisait pas partie. (Instructions d’Anthropic sur les forfaits)

Les benchmarks confirment un vrai progrès, mais pas partout au même niveau

La comparaison publiée par Anthropic donne à Fable 5.1 une avance nette sur plusieurs mesures liées aux agents et à l’utilisation d’ordinateurs, mais l’écart va de modeste à très important. Ces résultats proviennent d’évaluations spécifiques à une version et menées avec des garde-fous ; prenez-les comme une indication et validez-les avec vos propres prompts. (Tableau des benchmarks d’Anthropic)

BenchmarkFable 5.1Fable 5Écart
Terminal-Bench-Science 0.152,6 %24,7 %+27,9 points
Terminal-Bench 4.055,8 %42,0 %+13,8 points
GDPval-AA v21 853 Elo1 723 Elo+130 Elo
OSWorld 2.0, partiel77,9 %72,9 %+5,0 points
OSWorld 2.0, strict41,7 %36,1 %+5,6 points
Humanity’s Last Exam, sans outils60,9 %57,8 %+3,1 points
Humanity’s Last Exam, avec outils65,0 %63,8 %+1,2 points
AutomationBench31,4 %17,1 %+14,3 points
CursorBench 3.2.073,4 %70,5 %+2,9 points
Comparaison des benchmarks officiels de Fable 5.1 et Fable 5

L’écart publié le plus important apparaît sur Terminal-Bench-Science 0.1 : le score annoncé de Fable 5.1 est plus de deux fois supérieur à celui de Fable 5. AutomationBench et Terminal-Bench 4.0 affichent eux aussi des progressions significatives. Les gains plus limités sur Humanity’s Last Exam et CursorBench conduisent à une conclusion plus nuancée : Fable 5.1 n’est pas systématiquement meilleur avec la même marge pour tous les types de tâches.

Le tableau d’Anthropic attribue le résultat de 55,8 % à Fable 5.1 public sur Terminal-Bench 4.0 et présente séparément Mythos 5.1, à 60,9 %. Mythos 5.1 ne constitue pas un remplacement généralement disponible de Fable 5.1. (Page produit d’Anthropic)

Migration d’API : trois comportements de Fable 5 à tester en priorité

Anthropic présente la migration vers Fable 5.1 comme essentiellement compatible, mais trois changements peuvent provoquer des erreurs en production ou modifier discrètement le comportement d’un agent. Testez-les avant de remplacer l’ID du modèle dans tous vos environnements. (Guide de migration vers Fable 5.1)

1. Le choix forcé d’un outil renvoie une erreur 400

Fable 5.1 accepte tool_choice: {"type":"auto"} et tool_choice: {"type":"none"}. En revanche, {"type":"any"} et le forçage d’un outil nommé sont refusés avec une erreur 400 invalid_request_error, y compris dans l’API Messages, l’API Message Batches et le point de terminaison de comptage des tokens.

Si l’application doit produire du JSON valide, utilisez les sorties structurées lorsqu’elles sont disponibles, ou conservez auto avec un schéma strict et une instruction explicite. Si elle doit appeler un outil précis lors d’un tour donné, Anthropic recommande à la place d’ajouter une instruction système limitée à ce tour.

2. Les blocs de réflexion restent liés au modèle qui les a produits

Fable 5.1 peut lire les blocs de réflexion conservés par Fable 5 et les anciens modèles Claude compatibles. Les anciens modèles ne peuvent pas lire les blocs de réflexion de Fable 5.1 ; si un mécanisme de secours redirige la conversation vers un modèle plus ancien, l’API supprime les blocs illisibles et le modèle de secours doit recommencer sa phase de planification.

Ces blocs supprimés ne sont pas facturés comme des tokens d’entrée, mais cette nouvelle phase de planification peut augmenter la latence et le coût du premier tour après un changement de modèle. Pour le débogage, Anthropic documente l’en-tête bêta thinking-binding-controls-2026-08-01, qui signale une transformation model_binding_mismatch.

3. Modifier l’historique peut invalider la requête

Sur les comptes utilisant les versions récentes de l’API, Fable 5.1 vérifie si le prompt système, les outils ou l’historique des messages précédents ont changé avant un bloc de réflexion conservé. Modifier, réordonner, supprimer ou reconstruire ce préfixe peut provoquer une erreur 400 de signature invalide au lieu de générer une réponse.

La règle la plus sûre consiste à conserver un historique auquel on ajoute uniquement de nouveaux tours. Préférez la compaction côté serveur ou l’édition du contexte plutôt que d’insérer un résumé au milieu d’une transcription, et gardez les fichiers inter-tours stables en utilisant un file_id de l’API Files ou des octets identiques. Un client qui préserve déjà le préfixe à l’identique peut se contenter de changer l’ID du modèle ; un client qui reconstruit les messages à chaque tour aura besoin d’un adaptateur au préalable.

Des changements additifs à exploiter

Fable 5.1 ajoute aussi des contrôles susceptibles d’améliorer un agent longue durée sans nécessiter de réécriture complète :

  1. Niveau d’effort par message : passez de low à medium, high, xhigh ou max lors d’un tour ultérieur sans invalider le préfixe mis en cache.
  2. Messages système limités à un tour : ajoutez une instruction valable pour un seul tour sans injecter puis supprimer du texte dans le prompt système initial.
  3. Mises à jour de progression : demandez des informations lisibles entre les appels d’outils à l’aide des paramètres d’affichage documentés.
  4. Tarif réduit des lectures du cache : conservez le préfixe réutilisé, mais remesurez le taux de succès des lectures après la migration.

Le nom d’un niveau d’effort ne correspond pas à une unité de travail comparable d’un modèle à l’autre. Commencez avec la valeur par défaut documentée, high, puis comparez la qualité, la latence et le nombre total de tokens avec medium et les niveaux supérieurs sur votre véritable jeu de tâches.

L’accès, les quotas et le modèle de secours peuvent changer le bilan

Fable 5.1 est largement accessible avec les forfaits Claude payants, ainsi que via l’API d’Anthropic et les plateformes cloud listées, mais l’accès à un forfait ne signifie pas que l’usage inclus est illimité. Les utilisateurs Pro et les sièges Team standards peuvent devoir acheter des crédits dès la première requête, tandis que les sièges Max et Premium partagent une portion de leur quota hebdomadaire réservée à Fable. Claude Code nécessite la version 2.1.250 ou ultérieure pour Fable 5.1 ; Fable 5 fonctionne à partir de la version 2.1.170. (Guide d’Anthropic sur les forfaits et l’accès)

Le basculement automatique peut également donner une impression différente dans l’application et dans l’API. Anthropic indique que certaines requêtes sensibles liées à la cybersécurité et à la biologie peuvent être routées vers des modèles Opus de secours, et que le basculement automatique est activé par défaut dans les interfaces Claude. Dans l’API, les développeurs doivent configurer les solutions de secours ; un refus est renvoyé comme une réponse HTTP réussie avec une raison d’arrêt indiquant le refus, sauf si une gestion du fallback a été ajoutée. (Consignes d’Anthropic sur les modèles de secours)

Les premiers retours d’utilisateurs restent anecdotiques, mais ils mettent en évidence deux coûts à mesurer pendant un pilote :

« 5.1 semble correct, mais il semble effectivement plus lent. » — u/BeowulfShaeffer, discussion de sortie sur r/ClaudeAI

« Je suis déjà à 100 % d’utilisation. » — u/noeyb, discussion de sortie sur r/ClaudeAI

Ces témoignages ne permettent pas d’établir une tendance générale sur les performances, mais ils justifient le suivi du temps réel d’exécution et de la consommation du quota, en plus de la qualité des réponses.

Quel choix pour les utilisateurs de Fable 5 ?

SituationChoix pratique
Nouvel agent qui relit souvent le même contexteFable 5.1, avec suivi du taux de succès du cache et de la latence dès le premier jour
Agent Fable 5 existant avec historique en ajout uniquement et outils automatiquesTestez Fable 5.1 sur un échantillon représentatif de tâches
Agent existant qui force des outils nommésCorrigez d’abord la sélection des outils, puis testez Fable 5.1
Client qui réécrit d’anciens messages ou prompts systèmeConservez Fable 5 comme solution de secours pendant la refonte de la couche d’historique
Prompts principalement nouveaux, avec peu de réutilisation du cacheComparez le coût par tâche terminée, pas uniquement les tarifs par token
Travail susceptible de déclencher les garde-fous liés à la cybersécurité ou à la biologieModélisez le parcours de secours et son tarif Opus avant de migrer
Besoin de tarifs standards d’entrée et de sortie plus basComparez un autre modèle Anthropic, car Fable 5.1 et Fable 5 ont exactement les mêmes tarifs catalogue

Un test de migration peut rester limité : rejouez 20 à 50 tâches représentatives avec les mêmes outils et les mêmes prompts, puis mesurez le taux de réussite, les erreurs liées aux outils forcés, le nombre de basculements, les tokens lus depuis le cache, le total des tokens d’entrée et de sortie, la latence, la consommation du quota et le coût par tâche terminée. Ne généralisez Fable 5.1 que s’il atteint le niveau de qualité attendu sans provoquer de problème de compatibilité ou de quota inacceptable.

Les questions qui reviennent chez les acheteurs

Pourquoi Claude a-t-il quitté Fable 5.1 ?

Un classificateur de sécurité peut déclencher un basculement automatique pour certaines requêtes liées à la cybersécurité, à la biologie, à l’extraction du raisonnement ou au développement de modèles avancés. Dans les applications Claude, la requête peut être relancée avec un modèle Opus ; dans l’API, le comportement de secours doit être configuré par le développeur. (Consignes d’Anthropic sur les modèles de secours)

Fable 5.1 est la meilleure base pour un nouvel agent capable de travailler sur un horizon long, ainsi que pour les charges Fable 5 qui réutilisent beaucoup leur contexte. En revanche, conservez Fable 5 pendant un pilote de compatibilité si votre intégration force des outils, modifie l’historique des messages ou ne peut pas composer avec l’incertitude liée aux basculements et aux quotas.

>_Répertoire des modèles AIReiter

Accès API rapide aux modèles liés à ce guide

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCréer une API Key >

Claude Fable 5

Chat

Un modèle Claude premium pour le raisonnement approfondi et le travail long et complexe.

AnthropicCréer une API Key >

Claude Opus 4.8

Chat

Un modèle Claude hautement performant pour les tâches de raisonnement exigeantes et le travail professionnel.

AnthropicCréer une API Key >

Claude Opus 5

Chat

Un modèle Claude premium pour le raisonnement complexe, le codage et le travail professionnel à long contexte.

AnthropicCréer une API Key >

Claude Sonnet 5

Chat

Un modèle Claude équilibré pour le raisonnement avancé, le codage et le travail quotidien.

AnthropicCréer une API Key >

Articles récents

GPT-6 Astra API : test (2026) — conçu pour les agents, pas pour un remplacement à l’identique

2026-09-07

API Kling : guide d’intégration officielle et via agrégateurs (2026)

2026-09-07

Clé API Suno : comment l’obtenir et combien elle coûte (2026)

2026-09-07

Test de GPT-6 Astra : le tarif API de 10 $/50 $ en vaut-il la peine ?

2026-09-06
AIREITER

Des questions ? Contactez-nous à
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Vidéo IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Image IA

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Voir tout →

Entreprise

Politique de confidentialitéConditions d'utilisationPolitique de remboursement

© 2026 AIReiter. Tous droits réservés.