Remplacer claude-fable-5 par claude-fable-5-1 peut sembler anodin : la première réponse arrive correctement, puis le routeur d’outils ou l’historique de conversation mutable commence à poser problème. Fable 5.1 est le meilleur choix par défaut pour les agents qui travaillent longtemps avec beaucoup de contenu mis en cache, mais ce n’est pas une mise à niveau sans risque : les tarifs catalogue et les limites restent identiques, tandis que trois comportements de l’API changent.
En bref : passez à Fable 5.1 pour les agents qui exploitent le cache
Claude Fable 5.1 succède désormais à Claude Fable 5, et la documentation d’Anthropic recommande cette version pour ses performances améliorées. L’intérêt est particulièrement évident pour un agent qui relit constamment un long préfixe de prompt : les lectures du cache passent de 1 $ à 0,25 $ par million de tokens, tandis que les tarifs standards d’entrée et de sortie restent respectivement de 10 $ et 50 $ par million de tokens. (Présentation de Fable 5.1 par Anthropic)
| Si votre charge de travail… | Commencez avec… | Pourquoi |
|---|---|---|
| Réutilise un long prompt système, une base de code ou le contexte d’un document | Fable 5.1 | Les lectures du cache coûtent 75 % moins cher et Anthropic rapporte de meilleurs résultats sur les tâches agentiques. |
Force des appels d’outils, par exemple avec tool_choice: {"type":"any"} | Testez Fable 5.1 avant de basculer | Fable 5.1 refuse la sélection forcée d’un outil et renvoie une erreur 400. |
| Modifie ou reconstruit d’anciens tours de conversation | Restez sur Fable 5 jusqu’à la correction de la couche d’historique | Fable 5.1 lie les blocs de réflexion au prompt, aux outils et à l’historique qui les précèdent. |
| Doit bénéficier du tarif standard par token le plus bas | Aucun des deux modèles Fable | Les deux coûtent 10 $ par million de tokens d’entrée et 50 $ par million de tokens de sortie. |
| Exécute des prompts classiques, sans cache, avec une intégration Fable 5 stable | Commencez par une évaluation | L’économie liée au tarif catalogue peut être limitée et les gains de benchmark varient selon la tâche. |
Ce qui change entre Fable 5 et Fable 5.1
Claude Fable 5.1 conserve les principales caractéristiques de Claude Fable 5 : une fenêtre de contexte d’1 million de tokens, une sortie maximale de 128 000 tokens et une réflexion adaptative toujours activée. Les différences documentées concernent le statut du modèle, la date de coupure des connaissances — juin 2026 au lieu de janvier 2026 —, le prix réduit des lectures du cache ainsi que le comportement de l’API vis-à-vis des outils et des blocs de réflexion. (Présentation de l’ancien modèle Fable 5 ; Présentation du modèle Fable 5.1)
| Caractéristique | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| ID du modèle dans l’API | claude-fable-5 | claude-fable-5-1 |
| Cycle de vie | Actif, ancien modèle | Actif, dernier modèle Fable |
| Date de sortie | 9 juin 2026 | 1er septembre 2026 |
| Fenêtre de contexte | 1 million de tokens | 1 million de tokens |
| Sortie maximale | 128 000 tokens | 128 000 tokens |
| Réflexion | Adaptative, toujours activée | Adaptative, toujours activée |
| Niveau d’effort par défaut | Élevé | Élevé |
| Date de coupure des connaissances fiables | Janvier 2026 | Juin 2026 |
| Tarif entrée / sortie | 10 $ / 50 $ par MTok | 10 $ / 50 $ par MTok |
| Tarif des lectures du cache | 1 $ / MTok | 0,25 $ / MTok |
Fable 5.1 est disponible via l’API Claude, Amazon Bedrock, Google Cloud, Microsoft Foundry et Claude Platform sur AWS. Anthropic indique que Fable 5 est proposé sur les mêmes familles de plateformes, avec un retrait qui n’interviendra pas avant le 9 juin 2027 ; le retrait de Fable 5.1 n’est pas prévu avant le 1er septembre 2027. (Disponibilité et cycle de vie de Fable 5.1 ; Disponibilité et cycle de vie de Fable 5)
L’économie se fait sur les lectures du cache, pas sur les tarifs catalogue
Fable 5.1 ne coûte pas moins cher lorsqu’il traite un nouvel input ou génère des tokens de sortie. Le modèle facture les mêmes 10 $ par million de tokens d’entrée et 50 $ par million de tokens de sortie que Fable 5. En revanche, une lecture du cache coûte 0,25 $ par million de tokens, contre 1 $ avec Fable 5. (Documentation tarifaire d’Anthropic)
| Catégorie d’utilisation | Fable 5 | Fable 5.1 | Évolution |
|---|---|---|---|
| Input non mis en cache | 10 $ / MTok | 10 $ / MTok | Aucune |
| Sortie | 50 $ / MTok | 50 $ / MTok | Aucune |
| Écriture du cache pendant 5 minutes | 12,50 $ / MTok | 12,50 $ / MTok | Aucune |
| Écriture du cache pendant 1 heure | 20 $ / MTok | 20 $ / MTok | Aucune |
| Lecture du cache | 1 $ / MTok | 0,25 $ / MTok | 75 % moins cher |
| Entrée / sortie en traitement par lots | Remise de 50 % | Remise de 50 % | Même remise annoncée |
Prenons un exemple simple : un agent relit dix fois le contexte mis en cache d’un projet contenant 1 million de tokens, puis génère 200 000 tokens de sortie. La partie lecture du cache coûte 10 $ avec Fable 5 et 2,50 $ avec Fable 5.1 ; la sortie coûte 10 $ dans les deux cas. Dans ces conditions précises, la facture de tokens passe donc de 20 $ à 12,50 $, soit une baisse de 37,5 %.
Les économies réelles dépendent du taux de succès des lectures du cache, des écritures, de la longueur des sorties, des nouvelles tentatives, des appels d’outils et du routage vers un modèle de secours. Anthropic estime le coût environ 25 % inférieur pour les charges classiques, et jusqu’à environ 45 % inférieur pour les charges fortement agentiques. (Page produit Fable d’Anthropic)
L’usage par abonnement obéit à une logique distincte de celle de l’API. Le centre d’aide d’Anthropic indique que Fable 5 et Fable 5.1 suivent les mêmes règles de forfait actuellement en vigueur : les abonnements Max ainsi que les sièges Team Premium ou Enterprise historique peuvent utiliser les modèles Fable dans la limite de 50 % du quota hebdomadaire, tandis que les comptes Pro et les sièges standards utilisent des crédits à la consommation. La promotion initiale de Fable 5 s’est terminée le 19 juillet 2026 et Fable 5.1 n’en faisait pas partie. (Instructions d’Anthropic sur les forfaits)
Les benchmarks confirment un vrai progrès, mais pas partout au même niveau
La comparaison publiée par Anthropic donne à Fable 5.1 une avance nette sur plusieurs mesures liées aux agents et à l’utilisation d’ordinateurs, mais l’écart va de modeste à très important. Ces résultats proviennent d’évaluations spécifiques à une version et menées avec des garde-fous ; prenez-les comme une indication et validez-les avec vos propres prompts. (Tableau des benchmarks d’Anthropic)
| Benchmark | Fable 5.1 | Fable 5 | Écart |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6 % | 24,7 % | +27,9 points |
| Terminal-Bench 4.0 | 55,8 % | 42,0 % | +13,8 points |
| GDPval-AA v2 | 1 853 Elo | 1 723 Elo | +130 Elo |
| OSWorld 2.0, partiel | 77,9 % | 72,9 % | +5,0 points |
| OSWorld 2.0, strict | 41,7 % | 36,1 % | +5,6 points |
| Humanity’s Last Exam, sans outils | 60,9 % | 57,8 % | +3,1 points |
| Humanity’s Last Exam, avec outils | 65,0 % | 63,8 % | +1,2 points |
| AutomationBench | 31,4 % | 17,1 % | +14,3 points |
| CursorBench 3.2.0 | 73,4 % | 70,5 % | +2,9 points |
L’écart publié le plus important apparaît sur Terminal-Bench-Science 0.1 : le score annoncé de Fable 5.1 est plus de deux fois supérieur à celui de Fable 5. AutomationBench et Terminal-Bench 4.0 affichent eux aussi des progressions significatives. Les gains plus limités sur Humanity’s Last Exam et CursorBench conduisent à une conclusion plus nuancée : Fable 5.1 n’est pas systématiquement meilleur avec la même marge pour tous les types de tâches.
Le tableau d’Anthropic attribue le résultat de 55,8 % à Fable 5.1 public sur Terminal-Bench 4.0 et présente séparément Mythos 5.1, à 60,9 %. Mythos 5.1 ne constitue pas un remplacement généralement disponible de Fable 5.1. (Page produit d’Anthropic)
Migration d’API : trois comportements de Fable 5 à tester en priorité
Anthropic présente la migration vers Fable 5.1 comme essentiellement compatible, mais trois changements peuvent provoquer des erreurs en production ou modifier discrètement le comportement d’un agent. Testez-les avant de remplacer l’ID du modèle dans tous vos environnements. (Guide de migration vers Fable 5.1)
1. Le choix forcé d’un outil renvoie une erreur 400
Fable 5.1 accepte tool_choice: {"type":"auto"} et tool_choice: {"type":"none"}. En revanche, {"type":"any"} et le forçage d’un outil nommé sont refusés avec une erreur 400 invalid_request_error, y compris dans l’API Messages, l’API Message Batches et le point de terminaison de comptage des tokens.
Si l’application doit produire du JSON valide, utilisez les sorties structurées lorsqu’elles sont disponibles, ou conservez auto avec un schéma strict et une instruction explicite. Si elle doit appeler un outil précis lors d’un tour donné, Anthropic recommande à la place d’ajouter une instruction système limitée à ce tour.
2. Les blocs de réflexion restent liés au modèle qui les a produits
Fable 5.1 peut lire les blocs de réflexion conservés par Fable 5 et les anciens modèles Claude compatibles. Les anciens modèles ne peuvent pas lire les blocs de réflexion de Fable 5.1 ; si un mécanisme de secours redirige la conversation vers un modèle plus ancien, l’API supprime les blocs illisibles et le modèle de secours doit recommencer sa phase de planification.
Ces blocs supprimés ne sont pas facturés comme des tokens d’entrée, mais cette nouvelle phase de planification peut augmenter la latence et le coût du premier tour après un changement de modèle. Pour le débogage, Anthropic documente l’en-tête bêta thinking-binding-controls-2026-08-01, qui signale une transformation model_binding_mismatch.
3. Modifier l’historique peut invalider la requête
Sur les comptes utilisant les versions récentes de l’API, Fable 5.1 vérifie si le prompt système, les outils ou l’historique des messages précédents ont changé avant un bloc de réflexion conservé. Modifier, réordonner, supprimer ou reconstruire ce préfixe peut provoquer une erreur 400 de signature invalide au lieu de générer une réponse.
La règle la plus sûre consiste à conserver un historique auquel on ajoute uniquement de nouveaux tours. Préférez la compaction côté serveur ou l’édition du contexte plutôt que d’insérer un résumé au milieu d’une transcription, et gardez les fichiers inter-tours stables en utilisant un file_id de l’API Files ou des octets identiques. Un client qui préserve déjà le préfixe à l’identique peut se contenter de changer l’ID du modèle ; un client qui reconstruit les messages à chaque tour aura besoin d’un adaptateur au préalable.
Des changements additifs à exploiter
Fable 5.1 ajoute aussi des contrôles susceptibles d’améliorer un agent longue durée sans nécessiter de réécriture complète :
- Niveau d’effort par message : passez de
lowàmedium,high,xhighoumaxlors d’un tour ultérieur sans invalider le préfixe mis en cache. - Messages système limités à un tour : ajoutez une instruction valable pour un seul tour sans injecter puis supprimer du texte dans le prompt système initial.
- Mises à jour de progression : demandez des informations lisibles entre les appels d’outils à l’aide des paramètres d’affichage documentés.
- Tarif réduit des lectures du cache : conservez le préfixe réutilisé, mais remesurez le taux de succès des lectures après la migration.
Le nom d’un niveau d’effort ne correspond pas à une unité de travail comparable d’un modèle à l’autre. Commencez avec la valeur par défaut documentée, high, puis comparez la qualité, la latence et le nombre total de tokens avec medium et les niveaux supérieurs sur votre véritable jeu de tâches.
L’accès, les quotas et le modèle de secours peuvent changer le bilan
Fable 5.1 est largement accessible avec les forfaits Claude payants, ainsi que via l’API d’Anthropic et les plateformes cloud listées, mais l’accès à un forfait ne signifie pas que l’usage inclus est illimité. Les utilisateurs Pro et les sièges Team standards peuvent devoir acheter des crédits dès la première requête, tandis que les sièges Max et Premium partagent une portion de leur quota hebdomadaire réservée à Fable. Claude Code nécessite la version 2.1.250 ou ultérieure pour Fable 5.1 ; Fable 5 fonctionne à partir de la version 2.1.170. (Guide d’Anthropic sur les forfaits et l’accès)
Le basculement automatique peut également donner une impression différente dans l’application et dans l’API. Anthropic indique que certaines requêtes sensibles liées à la cybersécurité et à la biologie peuvent être routées vers des modèles Opus de secours, et que le basculement automatique est activé par défaut dans les interfaces Claude. Dans l’API, les développeurs doivent configurer les solutions de secours ; un refus est renvoyé comme une réponse HTTP réussie avec une raison d’arrêt indiquant le refus, sauf si une gestion du fallback a été ajoutée. (Consignes d’Anthropic sur les modèles de secours)
Les premiers retours d’utilisateurs restent anecdotiques, mais ils mettent en évidence deux coûts à mesurer pendant un pilote :
« 5.1 semble correct, mais il semble effectivement plus lent. » — u/BeowulfShaeffer, discussion de sortie sur r/ClaudeAI
« Je suis déjà à 100 % d’utilisation. » — u/noeyb, discussion de sortie sur r/ClaudeAI
Ces témoignages ne permettent pas d’établir une tendance générale sur les performances, mais ils justifient le suivi du temps réel d’exécution et de la consommation du quota, en plus de la qualité des réponses.
Quel choix pour les utilisateurs de Fable 5 ?
| Situation | Choix pratique |
|---|---|
| Nouvel agent qui relit souvent le même contexte | Fable 5.1, avec suivi du taux de succès du cache et de la latence dès le premier jour |
| Agent Fable 5 existant avec historique en ajout uniquement et outils automatiques | Testez Fable 5.1 sur un échantillon représentatif de tâches |
| Agent existant qui force des outils nommés | Corrigez d’abord la sélection des outils, puis testez Fable 5.1 |
| Client qui réécrit d’anciens messages ou prompts système | Conservez Fable 5 comme solution de secours pendant la refonte de la couche d’historique |
| Prompts principalement nouveaux, avec peu de réutilisation du cache | Comparez le coût par tâche terminée, pas uniquement les tarifs par token |
| Travail susceptible de déclencher les garde-fous liés à la cybersécurité ou à la biologie | Modélisez le parcours de secours et son tarif Opus avant de migrer |
| Besoin de tarifs standards d’entrée et de sortie plus bas | Comparez un autre modèle Anthropic, car Fable 5.1 et Fable 5 ont exactement les mêmes tarifs catalogue |
Un test de migration peut rester limité : rejouez 20 à 50 tâches représentatives avec les mêmes outils et les mêmes prompts, puis mesurez le taux de réussite, les erreurs liées aux outils forcés, le nombre de basculements, les tokens lus depuis le cache, le total des tokens d’entrée et de sortie, la latence, la consommation du quota et le coût par tâche terminée. Ne généralisez Fable 5.1 que s’il atteint le niveau de qualité attendu sans provoquer de problème de compatibilité ou de quota inacceptable.
Les questions qui reviennent chez les acheteurs
Pourquoi Claude a-t-il quitté Fable 5.1 ?
Un classificateur de sécurité peut déclencher un basculement automatique pour certaines requêtes liées à la cybersécurité, à la biologie, à l’extraction du raisonnement ou au développement de modèles avancés. Dans les applications Claude, la requête peut être relancée avec un modèle Opus ; dans l’API, le comportement de secours doit être configuré par le développeur. (Consignes d’Anthropic sur les modèles de secours)
Fable 5.1 est la meilleure base pour un nouvel agent capable de travailler sur un horizon long, ainsi que pour les charges Fable 5 qui réutilisent beaucoup leur contexte. En revanche, conservez Fable 5 pendant un pilote de compatibilité si votre intégration force des outils, modifie l’historique des messages ou ne peut pas composer avec l’incertitude liée aux basculements et aux quotas.