Si può sostituire claude-fable-5 con claude-fable-5-1 e ottenere una prima risposta corretta, per poi scoprire che il router dei tool o la cronologia conversazionale mutabile non funzionano più. Fable 5.1 è la scelta predefinita più solida per i carichi di lavoro lunghi e ricchi di accessi alla cache, ma non è un aggiornamento completamente indolore: prezzi di listino e limiti restano invariati, mentre cambiano tre comportamenti delle API.
In breve: conviene per gli agenti che usano la cache, non per ogni richiesta
Claude Fable 5.1 è il successore attuale di Claude Fable 5 e la documentazione di Anthropic ne raccomanda l’adozione per ottenere prestazioni migliori. Il vantaggio si vede soprattutto quando un agente rilegge più volte un lungo prefisso del prompt: le letture dalla cache passano da 1 $ a 0,25 $ per milione di token, mentre le tariffe standard per input e output restano rispettivamente di 10 $ e 50 $ per milione di token. (La panoramica di Fable 5.1 di Anthropic)
| Se il tuo carico di lavoro… | Parti da… | Perché |
|---|---|---|
| Riutilizza un lungo prompt di sistema, una codebase o il contesto di un documento | Fable 5.1 | Le letture dalla cache costano il 75% in meno e Anthropic segnala risultati migliori nei test agentici. |
Usa chiamate ai tool forzate, come tool_choice: {"type":"any"} | Testa Fable 5.1 prima di passare al nuovo modello | Fable 5.1 rifiuta la selezione forzata dei tool con un errore 400. |
| Modifica o ricostruisce turni precedenti della conversazione | Mantieni Fable 5 finché il livello di gestione della cronologia non sarà corretto | Fable 5.1 lega i blocchi di thinking al prompt, ai tool e alla cronologia precedenti. |
| Ha bisogno del prezzo più basso per i token standard | Nessuno dei due modelli Fable | Entrambi costano 10 $ per milione di token di input e 50 $ per milione di token di output. |
| Esegue prompt ordinari, senza cache, con un’integrazione Fable 5 stabile | Esegui prima una valutazione | Il risparmio sul prezzo di listino può essere ridotto e i miglioramenti nei benchmark variano in base al compito. |
Che cosa cambia da Fable 5 a Fable 5.1
Claude Fable 5.1 conserva il profilo di capacità principale di Claude Fable 5: finestra di contesto da 1 milione di token, output massimo di 128.000 token e thinking adattivo sempre attivo. Le differenze documentate riguardano lo stato del ciclo di vita, il cutoff di conoscenza fissato a giugno 2026 invece che a gennaio 2026, il costo inferiore delle letture dalla cache e il nuovo comportamento delle API per tool e blocchi di thinking. (Panoramica di Fable 5 come modello legacy; Panoramica del modello Fable 5.1)
| Specifiche | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| ID del modello API | claude-fable-5 | claude-fable-5-1 |
| Ciclo di vita | Attivo, legacy | Attivo, modello Fable più recente |
| Data di rilascio | 9 giugno 2026 | 1 settembre 2026 |
| Finestra di contesto | 1M token | 1M token |
| Output massimo | 128K token | 128K token |
| Thinking | Adattivo, sempre attivo | Adattivo, sempre attivo |
| Livello predefinito | High | High |
| Cutoff di conoscenza affidabile | Gennaio 2026 | Giugno 2026 |
| Prezzo input / output | 10 $ / 50 $ per MTok | 10 $ / 50 $ per MTok |
| Prezzo letture dalla cache | 1 $ / MTok | 0,25 $ / MTok |
Fable 5.1 è disponibile tramite Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. Anthropic indica le stesse famiglie di piattaforme anche per Fable 5, il cui ritiro non avverrà prima del 9 giugno 2027; per Fable 5.1 il ritiro non è previsto prima del 1 settembre 2027. (Disponibilità e ciclo di vita di Fable 5.1; Disponibilità e ciclo di vita di Fable 5)
La differenza di prezzo riguarda la cache, non le tariffe di listino
Fable 5.1 non costa meno quando si usano token di input o output normali, non presenti in cache. Il modello applica gli stessi 10 $ per milione di token di input e 50 $ per milione di token di output di Fable 5, ma una lettura dalla cache costa 0,25 $ per milione di token invece di 1 $. (Documentazione sui prezzi di Anthropic)
| Categoria d’uso | Fable 5 | Fable 5.1 | Variazione |
|---|---|---|---|
| Input non presente in cache | 10 $ / MTok | 10 $ / MTok | Nessuna |
| Output | 50 $ / MTok | 50 $ / MTok | Nessuna |
| Scrittura in cache di 5 minuti | 12,50 $ / MTok | 12,50 $ / MTok | Nessuna |
| Scrittura in cache di 1 ora | 20 $ / MTok | 20 $ / MTok | Nessuna |
| Lettura dalla cache | 1 $ / MTok | 0,25 $ / MTok | 75% in meno |
| Input / output in batch | Sconto del 50% | Sconto del 50% | Stesso sconto dichiarato |
Per un esempio semplice, immaginiamo che un agente legga dieci volte il contesto di un progetto da 1 milione di token conservato nella cache e generi poi 200.000 token di output. La parte relativa alle letture dalla cache costa 10 $ con Fable 5 e 2,50 $ con Fable 5.1; l’output costa 10 $ con entrambi i modelli. In queste condizioni circoscritte, la spesa per i token scende da 20 $ a 12,50 $, cioè del 37,5%.
Il risparmio effettivo dipende dagli accessi alla cache, dalle scritture, dalla lunghezza dell’output, dai tentativi ripetuti, dalle chiamate ai tool e dal routing di fallback. Anthropic stima un costo inferiore di circa il 25% per i carichi di lavoro tipici e fino a circa il 45% per quelli fortemente agentici. (La pagina prodotto di Fable di Anthropic)
L’utilizzo incluso negli abbonamenti è un tema distinto dall’economia delle API. Secondo il centro assistenza di Anthropic, Fable 5 e Fable 5.1 seguono le stesse regole attuali dei piani: gli utenti Max e quelli con piani Team premium o con abbonamenti Enterprise legacy possono usare i modelli Fable fino al 50% del limite settimanale, mentre gli utenti Pro e quelli con piani standard utilizzano crediti a consumo. La promozione iniziale per Fable 5 è terminata il 19 luglio 2026 e Fable 5.1 non ne faceva parte. (Indicazioni di Anthropic sui piani)
I benchmark confermano un miglioramento reale, ma non uniforme
Il confronto pubblicato da Anthropic assegna a Fable 5.1 un vantaggio netto in diverse prove agentiche e di utilizzo del computer, ma l’ampiezza del divario va da modesta a molto significativa. Si tratta di risultati riportati dal fornitore e ottenuti in valutazioni version-specifiche e sottoposte a salvaguardie: usali come indicazione e verifica sempre il comportamento sui tuoi prompt. (La tabella dei benchmark di Anthropic)
| Benchmark | Fable 5.1 | Fable 5 | Differenza |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52,6% | 24,7% | +27,9 punti |
| Terminal-Bench 4.0 | 55,8% | 42,0% | +13,8 punti |
| GDPval-AA v2 | 1.853 Elo | 1.723 Elo | +130 Elo |
| OSWorld 2.0, parziale | 77,9% | 72,9% | +5,0 punti |
| OSWorld 2.0, rigoroso | 41,7% | 36,1% | +5,6 punti |
| Humanity’s Last Exam, senza tool | 60,9% | 57,8% | +3,1 punti |
| Humanity’s Last Exam, con tool | 65,0% | 63,8% | +1,2 punti |
| AutomationBench | 31,4% | 17,1% | +14,3 punti |
| CursorBench 3.2.0 | 73,4% | 70,5% | +2,9 punti |
Il divario più ampio tra quelli pubblicati riguarda Terminal-Bench-Science 0.1, dove il punteggio dichiarato di Fable 5.1 è più del doppio rispetto a quello di Fable 5. Anche AutomationBench e Terminal-Bench 4.0 mostrano incrementi consistenti. I miglioramenti più contenuti su Humanity’s Last Exam e CursorBench portano però a una conclusione più prudente: Fable 5.1 non è migliore in modo uniforme, né con lo stesso margine, per ogni tipo di attività.
Nella sua tabella Anthropic riporta il risultato del 55,8% ottenuto da Fable 5.1 pubblico in Terminal-Bench 4.0 e presenta separatamente Mythos 5.1, al 60,9%. Mythos 5.1 non è un sostituto generalmente disponibile di Fable 5.1. (La pagina prodotto di Anthropic)
Migrazione delle API: tre comportamenti di Fable 5 da verificare subito
Anthropic descrive la migrazione a Fable 5.1 come quasi completamente compatibile, ma tre cambiamenti possono causare errori in produzione o modificare silenziosamente il comportamento dell’agente. Verificali prima di cambiare l’ID del modello in tutti gli ambienti. (Guida alla migrazione a Fable 5.1)
1. La selezione forzata dei tool restituisce un errore 400
Fable 5.1 accetta tool_choice: {"type":"auto"} e tool_choice: {"type":"none"}. Rifiuta invece {"type":"any"} e la forzatura di un tool specifico con un errore 400 invalid_request_error, anche nelle Messages API, Message Batches API e nell’endpoint per il conteggio dei token.
Se l’applicazione ha bisogno di JSON valido, usa gli structured outputs quando disponibili oppure mantieni la selezione dei tool su auto, abbinandola a uno schema rigoroso e a un’istruzione esplicita. Se in un determinato turno serve un tool preciso, Anthropic documenta come alternativa l’aggiunta di un’istruzione di sistema limitata a quel turno.
2. I blocchi di thinking sono legati al modello che li ha generati
Fable 5.1 può leggere i blocchi di thinking conservati da Fable 5 e dai precedenti modelli Claude compatibili. I modelli più vecchi non possono leggere i blocchi generati da Fable 5.1; se un fallback invia la conversazione a un modello precedente, le sezioni non leggibili vengono eliminate e il modello di fallback deve pianificare di nuovo.
I blocchi eliminati non vengono conteggiati come input a pagamento, ma il nuovo passaggio di pianificazione può aumentare la latenza e il costo del primo turno dopo il cambio di modello. Per il debugging, Anthropic documenta l’header beta thinking-binding-controls-2026-08-01, che segnala una trasformazione model_binding_mismatch.
3. Modificare la cronologia precedente può invalidare la richiesta
Nei nuovi account API, Fable 5.1 verifica se il prompt di sistema, i tool o la cronologia dei messaggi precedenti sono cambiati prima di un blocco di thinking conservato. Modificare, riordinare, eliminare o ricostruire quel prefisso può produrre un errore 400 di firma non valida invece di una risposta.
L’impostazione più sicura è una cronologia modificabile solo in append. Usa la compattazione lato server o gli strumenti di modifica del contesto invece di inserire un riepilogo nel mezzo della trascrizione, e mantieni stabili i file condivisi tra i turni usando un file_id della Files API o byte identici. Un client che conserva già il prefisso esatto potrebbe richiedere soltanto la modifica dell’ID del modello; uno che ricostruisce i messaggi a ogni turno ha invece bisogno prima di un adapter.
Modifiche additive da sfruttare
Fable 5.1 aggiunge anche controlli utili per migliorare un agente di lunga durata senza doverlo riscrivere completamente:
- Livello per messaggio: modifica
low,medium,high,xhighomaxda un turno successivo senza invalidare il prefisso in cache. - Messaggi di sistema limitati al turno: aggiungi un’istruzione per un solo turno senza inserire e poi rimuovere testo dal prompt di sistema precedente.
- Aggiornamenti sullo stato di avanzamento: richiedi aggiornamenti leggibili tra una chiamata ai tool e l’altra usando le impostazioni di visualizzazione documentate.
- Prezzo inferiore delle letture dalla cache: conserva il prefisso riutilizzato, ma misura nuovamente il tasso di accessi riusciti alla cache dopo la migrazione.
Il nome del livello di effort non corrisponde a un’unità di lavoro trasferibile da un modello all’altro. Parti dal valore predefinito documentato, high, poi confronta qualità, latenza e token totali con medium e con i livelli superiori sul set di attività reale.
Accesso, quote e fallback possono cambiare il risultato pratico
Fable 5.1 è ampiamente disponibile sui piani Claude a pagamento e tramite le API di Anthropic e le piattaforme cloud indicate, ma l’accesso dal piano non equivale a un utilizzo incluso illimitato. Gli utenti Pro e quelli con piani Team standard potrebbero dover ricorrere ai crediti a consumo già dalla prima richiesta, mentre gli utenti Max e quelli con piani premium condividono una parte del loro plafond settimanale riservata a Fable. Claude Code richiede la versione 2.1.250 o successiva per Fable 5.1; per Fable 5 serve la versione 2.1.170 o successiva. (Guida di Anthropic a piani e accesso)
Il cambio automatico del modello può inoltre far apparire diverso il confronto tra Fable 5 e Fable 5.1 nell’app rispetto alle API. Anthropic afferma che le richieste sensibili di cybersecurity e biologia possono essere instradate verso modelli Opus di fallback e che il cambio automatico è attivo per impostazione predefinita nelle interfacce Claude. Nelle API, invece, gli sviluppatori devono configurare i fallback; un rifiuto viene restituito come risposta HTTP completata correttamente con un motivo di stop di rifiuto, a meno che non venga aggiunta una gestione del fallback. (Indicazioni di Anthropic sui fallback)
Le prime segnalazioni degli utenti sono aneddotiche, ma indicano due costi da misurare durante un pilot:
“La 5.1 sembra andare bene, ma pare effettivamente più lenta.” — u/BeowulfShaeffer, discussione sul rilascio in r/ClaudeAI
“Sono già al 100% dell’utilizzo.” — u/noeyb, discussione sul rilascio in r/ClaudeAI
Questi commenti non dimostrano una velocità generale del modello, ma rendono utile registrare il tempo effettivo e il consumo della quota insieme alla qualità delle risposte.
Una tabella decisionale per chi usa Fable 5
| Situazione | Scelta pratica |
|---|---|
| Nuovo agente con letture ripetute del contesto | Fable 5.1, registrando fin dall’inizio accessi riusciti alla cache e latenza |
| Agente Fable 5 esistente con cronologia solo in append e tool automatici | Prova pilota con Fable 5.1 su un campione rappresentativo di attività |
| Agente esistente che forza tool specifici | Correggi prima la selezione dei tool, poi testa Fable 5.1 |
| Client esistente che riscrive vecchi messaggi o prompt di sistema | Mantieni Fable 5 come fallback mentre riprogetti il livello di gestione della cronologia |
| Prevalenza di prompt nuovi, con poco riutilizzo della cache | Confronta il costo per attività completata, non soltanto le tariffe dei token |
| Attività che potrebbero attivare le salvaguardie per cyber o biologia | Modella il percorso di fallback e il relativo prezzo Opus prima della migrazione |
| Servono tariffe standard più basse per input e output | Confronta un altro modello Anthropic, perché Fable 5.1 e Fable 5 hanno le stesse tariffe di listino |
Un test di migrazione pratico può restare contenuto: riproduci da 20 a 50 attività rappresentative, fissa gli stessi tool e gli stessi prompt e registra tasso di successo, errori dovuti ai tool forzati, numero di fallback, token letti dalla cache, token totali di input/output, latenza, consumo della quota e costo per attività completata. Promuovi Fable 5.1 soltanto se supera la soglia qualitativa senza introdurre problemi inaccettabili di compatibilità o di quota.
Le domande che gli acquirenti fanno ancora
Perché Claude ha abbandonato Fable 5.1?
Un classificatore delle salvaguardie può attivare un fallback automatico per alcune richieste di cybersecurity, biologia, estrazione del ragionamento o sviluppo di modelli frontier. Nelle app Claude la richiesta può essere rieseguita su un modello Opus; nelle API, invece, il comportamento di fallback deve essere configurato dallo sviluppatore. (Indicazioni di Anthropic sui fallback)
Fable 5.1 è il punto di partenza migliore per un nuovo agente con orizzonte operativo lungo e per i carichi di lavoro Fable 5 che riutilizzano molto la cache. Mantieni Fable 5 durante un pilot di compatibilità se l’integrazione forza i tool, modifica la cronologia dei messaggi oppure non può tollerare incertezza su fallback e quote.