AIREITER
DOC APIPREZZI
TEMPLATE
  • AIReiter
  • Blog
  • Fable 5.1 vs 5: costi, benchmark e cambiamenti alle API

Fable 5.1 vs 5: costi, benchmark e cambiamenti alle API

Ultimo Aggiornamento: 2026-09-02 02:41:29

Si può sostituire claude-fable-5 con claude-fable-5-1 e ottenere una prima risposta corretta, per poi scoprire che il router dei tool o la cronologia conversazionale mutabile non funzionano più. Fable 5.1 è la scelta predefinita più solida per i carichi di lavoro lunghi e ricchi di accessi alla cache, ma non è un aggiornamento completamente indolore: prezzi di listino e limiti restano invariati, mentre cambiano tre comportamenti delle API.

In breve: conviene per gli agenti che usano la cache, non per ogni richiesta

Claude Fable 5.1 è il successore attuale di Claude Fable 5 e la documentazione di Anthropic ne raccomanda l’adozione per ottenere prestazioni migliori. Il vantaggio si vede soprattutto quando un agente rilegge più volte un lungo prefisso del prompt: le letture dalla cache passano da 1 $ a 0,25 $ per milione di token, mentre le tariffe standard per input e output restano rispettivamente di 10 $ e 50 $ per milione di token. (La panoramica di Fable 5.1 di Anthropic)

Se il tuo carico di lavoro…Parti da…Perché
Riutilizza un lungo prompt di sistema, una codebase o il contesto di un documentoFable 5.1Le letture dalla cache costano il 75% in meno e Anthropic segnala risultati migliori nei test agentici.
Usa chiamate ai tool forzate, come tool_choice: {"type":"any"}Testa Fable 5.1 prima di passare al nuovo modelloFable 5.1 rifiuta la selezione forzata dei tool con un errore 400.
Modifica o ricostruisce turni precedenti della conversazioneMantieni Fable 5 finché il livello di gestione della cronologia non sarà correttoFable 5.1 lega i blocchi di thinking al prompt, ai tool e alla cronologia precedenti.
Ha bisogno del prezzo più basso per i token standardNessuno dei due modelli FableEntrambi costano 10 $ per milione di token di input e 50 $ per milione di token di output.
Esegue prompt ordinari, senza cache, con un’integrazione Fable 5 stabileEsegui prima una valutazioneIl risparmio sul prezzo di listino può essere ridotto e i miglioramenti nei benchmark variano in base al compito.

Che cosa cambia da Fable 5 a Fable 5.1

Claude Fable 5.1 conserva il profilo di capacità principale di Claude Fable 5: finestra di contesto da 1 milione di token, output massimo di 128.000 token e thinking adattivo sempre attivo. Le differenze documentate riguardano lo stato del ciclo di vita, il cutoff di conoscenza fissato a giugno 2026 invece che a gennaio 2026, il costo inferiore delle letture dalla cache e il nuovo comportamento delle API per tool e blocchi di thinking. (Panoramica di Fable 5 come modello legacy; Panoramica del modello Fable 5.1)

SpecificheClaude Fable 5Claude Fable 5.1
ID del modello APIclaude-fable-5claude-fable-5-1
Ciclo di vitaAttivo, legacyAttivo, modello Fable più recente
Data di rilascio9 giugno 20261 settembre 2026
Finestra di contesto1M token1M token
Output massimo128K token128K token
ThinkingAdattivo, sempre attivoAdattivo, sempre attivo
Livello predefinitoHighHigh
Cutoff di conoscenza affidabileGennaio 2026Giugno 2026
Prezzo input / output10 $ / 50 $ per MTok10 $ / 50 $ per MTok
Prezzo letture dalla cache1 $ / MTok0,25 $ / MTok

Fable 5.1 è disponibile tramite Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry e Claude Platform on AWS. Anthropic indica le stesse famiglie di piattaforme anche per Fable 5, il cui ritiro non avverrà prima del 9 giugno 2027; per Fable 5.1 il ritiro non è previsto prima del 1 settembre 2027. (Disponibilità e ciclo di vita di Fable 5.1; Disponibilità e ciclo di vita di Fable 5)

La differenza di prezzo riguarda la cache, non le tariffe di listino

Fable 5.1 non costa meno quando si usano token di input o output normali, non presenti in cache. Il modello applica gli stessi 10 $ per milione di token di input e 50 $ per milione di token di output di Fable 5, ma una lettura dalla cache costa 0,25 $ per milione di token invece di 1 $. (Documentazione sui prezzi di Anthropic)

Categoria d’usoFable 5Fable 5.1Variazione
Input non presente in cache10 $ / MTok10 $ / MTokNessuna
Output50 $ / MTok50 $ / MTokNessuna
Scrittura in cache di 5 minuti12,50 $ / MTok12,50 $ / MTokNessuna
Scrittura in cache di 1 ora20 $ / MTok20 $ / MTokNessuna
Lettura dalla cache1 $ / MTok0,25 $ / MTok75% in meno
Input / output in batchSconto del 50%Sconto del 50%Stesso sconto dichiarato

Per un esempio semplice, immaginiamo che un agente legga dieci volte il contesto di un progetto da 1 milione di token conservato nella cache e generi poi 200.000 token di output. La parte relativa alle letture dalla cache costa 10 $ con Fable 5 e 2,50 $ con Fable 5.1; l’output costa 10 $ con entrambi i modelli. In queste condizioni circoscritte, la spesa per i token scende da 20 $ a 12,50 $, cioè del 37,5%.

Il risparmio effettivo dipende dagli accessi alla cache, dalle scritture, dalla lunghezza dell’output, dai tentativi ripetuti, dalle chiamate ai tool e dal routing di fallback. Anthropic stima un costo inferiore di circa il 25% per i carichi di lavoro tipici e fino a circa il 45% per quelli fortemente agentici. (La pagina prodotto di Fable di Anthropic)

L’utilizzo incluso negli abbonamenti è un tema distinto dall’economia delle API. Secondo il centro assistenza di Anthropic, Fable 5 e Fable 5.1 seguono le stesse regole attuali dei piani: gli utenti Max e quelli con piani Team premium o con abbonamenti Enterprise legacy possono usare i modelli Fable fino al 50% del limite settimanale, mentre gli utenti Pro e quelli con piani standard utilizzano crediti a consumo. La promozione iniziale per Fable 5 è terminata il 19 luglio 2026 e Fable 5.1 non ne faceva parte. (Indicazioni di Anthropic sui piani)

I benchmark confermano un miglioramento reale, ma non uniforme

Il confronto pubblicato da Anthropic assegna a Fable 5.1 un vantaggio netto in diverse prove agentiche e di utilizzo del computer, ma l’ampiezza del divario va da modesta a molto significativa. Si tratta di risultati riportati dal fornitore e ottenuti in valutazioni version-specifiche e sottoposte a salvaguardie: usali come indicazione e verifica sempre il comportamento sui tuoi prompt. (La tabella dei benchmark di Anthropic)

BenchmarkFable 5.1Fable 5Differenza
Terminal-Bench-Science 0.152,6%24,7%+27,9 punti
Terminal-Bench 4.055,8%42,0%+13,8 punti
GDPval-AA v21.853 Elo1.723 Elo+130 Elo
OSWorld 2.0, parziale77,9%72,9%+5,0 punti
OSWorld 2.0, rigoroso41,7%36,1%+5,6 punti
Humanity’s Last Exam, senza tool60,9%57,8%+3,1 punti
Humanity’s Last Exam, con tool65,0%63,8%+1,2 punti
AutomationBench31,4%17,1%+14,3 punti
CursorBench 3.2.073,4%70,5%+2,9 punti
Confronto tra i benchmark ufficiali di Fable 5.1 e Fable 5

Il divario più ampio tra quelli pubblicati riguarda Terminal-Bench-Science 0.1, dove il punteggio dichiarato di Fable 5.1 è più del doppio rispetto a quello di Fable 5. Anche AutomationBench e Terminal-Bench 4.0 mostrano incrementi consistenti. I miglioramenti più contenuti su Humanity’s Last Exam e CursorBench portano però a una conclusione più prudente: Fable 5.1 non è migliore in modo uniforme, né con lo stesso margine, per ogni tipo di attività.

Nella sua tabella Anthropic riporta il risultato del 55,8% ottenuto da Fable 5.1 pubblico in Terminal-Bench 4.0 e presenta separatamente Mythos 5.1, al 60,9%. Mythos 5.1 non è un sostituto generalmente disponibile di Fable 5.1. (La pagina prodotto di Anthropic)

Migrazione delle API: tre comportamenti di Fable 5 da verificare subito

Anthropic descrive la migrazione a Fable 5.1 come quasi completamente compatibile, ma tre cambiamenti possono causare errori in produzione o modificare silenziosamente il comportamento dell’agente. Verificali prima di cambiare l’ID del modello in tutti gli ambienti. (Guida alla migrazione a Fable 5.1)

1. La selezione forzata dei tool restituisce un errore 400

Fable 5.1 accetta tool_choice: {"type":"auto"} e tool_choice: {"type":"none"}. Rifiuta invece {"type":"any"} e la forzatura di un tool specifico con un errore 400 invalid_request_error, anche nelle Messages API, Message Batches API e nell’endpoint per il conteggio dei token.

Se l’applicazione ha bisogno di JSON valido, usa gli structured outputs quando disponibili oppure mantieni la selezione dei tool su auto, abbinandola a uno schema rigoroso e a un’istruzione esplicita. Se in un determinato turno serve un tool preciso, Anthropic documenta come alternativa l’aggiunta di un’istruzione di sistema limitata a quel turno.

2. I blocchi di thinking sono legati al modello che li ha generati

Fable 5.1 può leggere i blocchi di thinking conservati da Fable 5 e dai precedenti modelli Claude compatibili. I modelli più vecchi non possono leggere i blocchi generati da Fable 5.1; se un fallback invia la conversazione a un modello precedente, le sezioni non leggibili vengono eliminate e il modello di fallback deve pianificare di nuovo.

I blocchi eliminati non vengono conteggiati come input a pagamento, ma il nuovo passaggio di pianificazione può aumentare la latenza e il costo del primo turno dopo il cambio di modello. Per il debugging, Anthropic documenta l’header beta thinking-binding-controls-2026-08-01, che segnala una trasformazione model_binding_mismatch.

3. Modificare la cronologia precedente può invalidare la richiesta

Nei nuovi account API, Fable 5.1 verifica se il prompt di sistema, i tool o la cronologia dei messaggi precedenti sono cambiati prima di un blocco di thinking conservato. Modificare, riordinare, eliminare o ricostruire quel prefisso può produrre un errore 400 di firma non valida invece di una risposta.

L’impostazione più sicura è una cronologia modificabile solo in append. Usa la compattazione lato server o gli strumenti di modifica del contesto invece di inserire un riepilogo nel mezzo della trascrizione, e mantieni stabili i file condivisi tra i turni usando un file_id della Files API o byte identici. Un client che conserva già il prefisso esatto potrebbe richiedere soltanto la modifica dell’ID del modello; uno che ricostruisce i messaggi a ogni turno ha invece bisogno prima di un adapter.

Modifiche additive da sfruttare

Fable 5.1 aggiunge anche controlli utili per migliorare un agente di lunga durata senza doverlo riscrivere completamente:

  1. Livello per messaggio: modifica low, medium, high, xhigh o max da un turno successivo senza invalidare il prefisso in cache.
  2. Messaggi di sistema limitati al turno: aggiungi un’istruzione per un solo turno senza inserire e poi rimuovere testo dal prompt di sistema precedente.
  3. Aggiornamenti sullo stato di avanzamento: richiedi aggiornamenti leggibili tra una chiamata ai tool e l’altra usando le impostazioni di visualizzazione documentate.
  4. Prezzo inferiore delle letture dalla cache: conserva il prefisso riutilizzato, ma misura nuovamente il tasso di accessi riusciti alla cache dopo la migrazione.

Il nome del livello di effort non corrisponde a un’unità di lavoro trasferibile da un modello all’altro. Parti dal valore predefinito documentato, high, poi confronta qualità, latenza e token totali con medium e con i livelli superiori sul set di attività reale.

Accesso, quote e fallback possono cambiare il risultato pratico

Fable 5.1 è ampiamente disponibile sui piani Claude a pagamento e tramite le API di Anthropic e le piattaforme cloud indicate, ma l’accesso dal piano non equivale a un utilizzo incluso illimitato. Gli utenti Pro e quelli con piani Team standard potrebbero dover ricorrere ai crediti a consumo già dalla prima richiesta, mentre gli utenti Max e quelli con piani premium condividono una parte del loro plafond settimanale riservata a Fable. Claude Code richiede la versione 2.1.250 o successiva per Fable 5.1; per Fable 5 serve la versione 2.1.170 o successiva. (Guida di Anthropic a piani e accesso)

Il cambio automatico del modello può inoltre far apparire diverso il confronto tra Fable 5 e Fable 5.1 nell’app rispetto alle API. Anthropic afferma che le richieste sensibili di cybersecurity e biologia possono essere instradate verso modelli Opus di fallback e che il cambio automatico è attivo per impostazione predefinita nelle interfacce Claude. Nelle API, invece, gli sviluppatori devono configurare i fallback; un rifiuto viene restituito come risposta HTTP completata correttamente con un motivo di stop di rifiuto, a meno che non venga aggiunta una gestione del fallback. (Indicazioni di Anthropic sui fallback)

Le prime segnalazioni degli utenti sono aneddotiche, ma indicano due costi da misurare durante un pilot:

“La 5.1 sembra andare bene, ma pare effettivamente più lenta.” — u/BeowulfShaeffer, discussione sul rilascio in r/ClaudeAI

“Sono già al 100% dell’utilizzo.” — u/noeyb, discussione sul rilascio in r/ClaudeAI

Questi commenti non dimostrano una velocità generale del modello, ma rendono utile registrare il tempo effettivo e il consumo della quota insieme alla qualità delle risposte.

Una tabella decisionale per chi usa Fable 5

SituazioneScelta pratica
Nuovo agente con letture ripetute del contestoFable 5.1, registrando fin dall’inizio accessi riusciti alla cache e latenza
Agente Fable 5 esistente con cronologia solo in append e tool automaticiProva pilota con Fable 5.1 su un campione rappresentativo di attività
Agente esistente che forza tool specificiCorreggi prima la selezione dei tool, poi testa Fable 5.1
Client esistente che riscrive vecchi messaggi o prompt di sistemaMantieni Fable 5 come fallback mentre riprogetti il livello di gestione della cronologia
Prevalenza di prompt nuovi, con poco riutilizzo della cacheConfronta il costo per attività completata, non soltanto le tariffe dei token
Attività che potrebbero attivare le salvaguardie per cyber o biologiaModella il percorso di fallback e il relativo prezzo Opus prima della migrazione
Servono tariffe standard più basse per input e outputConfronta un altro modello Anthropic, perché Fable 5.1 e Fable 5 hanno le stesse tariffe di listino

Un test di migrazione pratico può restare contenuto: riproduci da 20 a 50 attività rappresentative, fissa gli stessi tool e gli stessi prompt e registra tasso di successo, errori dovuti ai tool forzati, numero di fallback, token letti dalla cache, token totali di input/output, latenza, consumo della quota e costo per attività completata. Promuovi Fable 5.1 soltanto se supera la soglia qualitativa senza introdurre problemi inaccettabili di compatibilità o di quota.

Le domande che gli acquirenti fanno ancora

Perché Claude ha abbandonato Fable 5.1?

Un classificatore delle salvaguardie può attivare un fallback automatico per alcune richieste di cybersecurity, biologia, estrazione del ragionamento o sviluppo di modelli frontier. Nelle app Claude la richiesta può essere rieseguita su un modello Opus; nelle API, invece, il comportamento di fallback deve essere configurato dallo sviluppatore. (Indicazioni di Anthropic sui fallback)

Fable 5.1 è il punto di partenza migliore per un nuovo agente con orizzonte operativo lungo e per i carichi di lavoro Fable 5 che riutilizzano molto la cache. Mantieni Fable 5 durante un pilot di compatibilità se l’integrazione forza i tool, modifica la cronologia dei messaggi oppure non può tollerare incertezza su fallback e quote.

>_Directory modelli AIReiter

Accesso API rapido ai modelli collegati a questa guida

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicCrea API Key >

Claude Fable 5

Chat

Un modello Claude premium per il ragionamento profondo e il lavoro complesso su contenuti lunghi.

AnthropicCrea API Key >

Claude Opus 4.8

Chat

Un modello Claude ad alte prestazioni per ragionamenti impegnativi e lavoro professionale.

AnthropicCrea API Key >

Claude Opus 5

Chat

Un modello Claude premium per ragionamenti complessi, programmazione e lavoro professionale su contesti lunghi.

AnthropicCrea API Key >

Claude Sonnet 5

Chat

Un modello Claude equilibrato per ragionamento avanzato, coding e lavoro quotidiano.

AnthropicCrea API Key >

Post recenti

Recensione dell’API GPT-6 Astra (2026): pensata per gli agenti, non per il semplice drop-in

2026-09-07

Kling API: guida all'integrazione ufficiale e tramite aggregatori (2026)

2026-09-07

Chiave API Suno: come ottenerla e quanto costa (2026)

2026-09-07

Recensione di GPT-6 Astra: i prezzi API da $10/$50 valgono la spesa?

2026-09-06
AIREITER

Domande? Contattaci a
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Video IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Immagine IA

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Vedi Tutto →

Azienda

Informativa sulla privacyTermini di servizioPolitica di rimborso

© 2026 AIReiter. Tutti i diritti riservati.