Claude Opus 5 vs Fable 5: vale ancora la pena pagare 2x?

Ultimo Aggiornamento: 2026-07-25 05:30:07

Claude Opus 5 costa la metà di Claude Fable 5 e, secondo i dati di lancio diffusi da Anthropic, con effort max arriva a meno dello 0,5% dal miglior punteggio di Fable 5 su CursorBench 3.2.

Inoltre supera il miglior risultato di Fable 5 su OSWorld 2.0 spendendo circa un terzo per attività; entrambi sono dati del vendor e non hanno ancora ricevuto repliche indipendenti. Eppure Fable 5 resta prezzato al doppio su ogni voce del listino:

Per milione di tokenClaude Fable 5Claude Opus 5Rapporto
Input$10$52.0x
Output$50$252.0x
Scrittura cache, 5 min$12.50$6.252.0x
Lettura cache$1$0.502.0x
Batch API$5 / $25$2.50 / $12.502.0x

Prezzi verificati sulla pagina dei prezzi di Anthropic il 25 luglio 2026. Il confronto Claude Opus 5 vs Fable 5 si riduce quindi a una domanda: cosa deve accadere nel vostro carico di lavoro perché quel 2x si ripaghi?

La risposta breve, numeri alla mano, è questa: Fable 5 deve riuscire con una frequenza superiore di circa il 60% rispetto a Opus 5. Per questo Opus 5 è la scelta predefinita, mentre Fable 5 rappresenta l'eccezione.

Il rapporto è davvero 2.0x, salvo in tre casi

Non bisogna sommare l'inflazione del tokenizer alla differenza di tariffa. La panoramica dei modelli indica che il tokenizer di Fable 5, introdotto con Opus 4.7, genera "all'incirca il 30% di token in più" rispetto ai modelli precedenti a Opus 4.7. Anche Opus 5 appartiene alla generazione 4.7 o successiva: l'inflazione è quindi identica per entrambi e il divario resta 2.0x, non 2.6x.

Ci sono però tre tariffe che cambiano completamente il rapporto:

  • La fast mode di Opus 5 costa $10 / $50, cioè la tariffa standard di Fable 5. A parità di spesa, il confronto diventa tra le capacità di Fable 5 e Opus 5 fino a circa 2.5x token di output al secondo. Solo Claude API.
  • Con la Batch API, Fable 5 costa $5 / $25: il prezzo di listino di Opus 5. Per i lavori che tollerano latenza, si ottiene il modello di punta alla tariffa sincrona standard del modello predefinito. Batch contro Batch il 2x resta invariato: è arbitraggio sulla modalità di fatturazione, non uno sconto.
  • Le letture dalla cache di Fable 5 costano $1, contro $0.50 per Opus 5. A parità di condizioni il rapporto resta 2x, ma una lettura da cache con Fable 5 costa un quinto di una lettura di input fresco con Opus 5. Nei loop che usano molto la cache, il divario assoluto si riduce.

Quattro attività, meno token per Fable 5 ma un conto più alto

Il 24 luglio 2026 abbiamo eseguito una volta per modello quattro attività valutate meccanicamente: correzione di due difetti in kth_smallest, un compito con schema JSON rigoroso, un quesito sul numero di Frobenius con pacchi da 7 e 12 e risposta 65, e un refactoring senza commenti con validazione. Entrambi i modelli hanno superato 4 prove su 4.

AttivitàOutput Opus 5Output Fable 5Canale
Bugfix con due difetti36 tok / 4.52s69 tok / 5.61sClaude Code
Schema JSON rigoroso94 tok / 4.8s86 tok / 4.4sGateway
Numero di Frobenius (65)407 tok / 6.8s358 tok / 7.3sGateway
Refactoring senza commenti429 tok / 6.93s251 tok / 8.09sClaude Code
Totale966 tok / 23.05s764 tok / 25.40s
Costo output a listino$0.024$0.038

Fable 5 ha prodotto il 21% di token di output in meno, ma il costo per esecuzione è rimasto circa 1.6x superiore, perché la sua tariffa di output è doppia. Il modello meno costoso è stato anche quello più prolisso; il risparmio di token di Fable 5 ha recuperato meno della metà del suo sovrapprezzo.

Grafico a linee del costo cumulativo in centesimi di dollaro USA dei token di output su 1, 5, 10, 20 e 50 ripetizioni delle stesse quattro attività, confrontando Claude Opus 5 a $25 per milione di token di output con Claude Fable 5 a $50 per milione, calcolato dai conteggi di token misurati

La documentazione classifica Fable 5 come "Slower" e Opus 5 come "Moderate"; in questo test Fable 5 è stato più lento in tre attività su quattro.

Tre precisazioni su questi dati:

  • Una sola esecuzione per ogni coppia modello-attività, con effort predefinito e valutazione meccanica. È uno smoke test, non un benchmark.
  • Sono conteggiati solo i token di output, alle tariffe ufficiali: il nostro gateway ha riportato conteggi dei token di prompt molto variabili per lo stesso prompt, quindi una fattura reale include anche input e cache.
  • Il numero di token riflette la configurazione del thinking, non la qualità. Opus 5 attiva il thinking per impostazione predefinita con effort high; il thinking adattivo sempre attivo di Fable 5 si è ridotto sulle due attività più brevi.

I totali mescolano inoltre canali diversi: tramite il nostro gateway compatibile con OpenAI, Fable 5 ha restituito una completion vuota in entrambe le attività di codice, per tre volte consecutive. Quelle righe provengono quindi dal canale proprietario Claude Code. È un problema di routing, non un dato sulle capacità di coding di Fable 5, ma merita un controllo dello stato di salute se nello stack è presente un relay.

Il calcolo del punto di pareggio

Il prezzo per token è l'unità di misura sbagliata. Conta la spesa attesa per attività completata:

expected cost per success = cost per attempt / first-pass success rate

La formula incorpora già i tentativi ripetuti: con un tasso di successo p, il numero atteso di tentativi è 1/p. Ponendo uguali i due modelli e semplificando i termini comuni, Claude Opus 5 vs Fable 5 si riduce a una sola disuguaglianza:

success_rate(Fable 5) / success_rate(Opus 5)  >=  cost_per_attempt(Fable 5) / cost_per_attempt(Opus 5)

Il lato destro vale 2.0 se i due modelli emettono lo stesso numero di token, e 1.58 con il nostro mix di output misurato. Consideriamo 1.6 la soglia operativa basata sul solo costo di output: Fable 5 deve riuscire circa il 60% più spesso di Opus 5 perché il sovrapprezzo abbia un ritorno. I carichi di lavoro ricchi di input o cache riportano la soglia verso 2.0x.

Se Opus 5 risolve al primo tentativoFable 5 deve risolvere
30% delle volte47%
40% delle volte63%
50% delle volte79%
60% delle volte95%
63% delle volte100%
70% delle volteirraggiungibile

Le ultime due righe sono decisive. Quando Opus 5 supera circa il 63% di successo al primo tentativo, nessun guadagno di capacità può rendere Fable 5 più economico per risultato ottenuto, perché Fable 5 non può superare il 100%. Con il rapporto generale di 2.0x, questo limite scende al 50%.

Il caso economico di Fable 5 vive quindi nelle attività in cui Opus 5 fallisce. È anche il motivo per cui il miglior modello Claude per il coding, a budget fisso, raramente coincide con quello in cima alla gamma. La soglia si fonda su tre ipotesi; basta infrangerne una per spostarla a favore di Fable 5:

  • I tentativi sono indipendenti.
  • I fallimenti sono economici da rilevare.
  • Un fallimento non costa più di un nuovo tentativo.

C'è un dubbio che questa aritmetica non affronta: il sovrapprezzo compra un modello destinato a essere sostituito prima? La pagina sulle deprecazioni dei modelli indica entrambi come Active:

  • claude-fable-5 verrà ritirato "non prima del 9 giugno 2027".
  • claude-opus-5 verrà ritirato "non prima del 24 luglio 2027".

Anthropic garantisce almeno 60 giorni di preavviso, e queste date minime coprono soltanto le piattaforme gestite da Anthropic. È quindi una decisione sul costo per risultato, non una scommessa sul modello che sopravvivrà.

Quando il 2x si giustifica

Il sovrapprezzo ha senso in tre scenari:

  • Fallimenti che non si possono individuare a basso costo. Una suite di test rende onesto 1/p; non accade lo stesso con un'esecuzione di otto ore che fallisce alla sesta, perché il conto include il calcolo sprecato e il tempo dell'ingegnere che deve ricostruire quanto accaduto. È il contesto a cui Anthropic destina Fable 5: "built for the most demanding reasoning and long-horizon agentic work."
  • Risultati che valgono più dei token. R&D World riporta che Stripe ha migrato in un giorno una codebase Ruby da 50 milioni di righe. Con un rapporto così elevato tra risultato e spesa, il prezzo per token smette di essere una variabile rilevante.
  • Capacità garantita. Priority Tier copre Fable 5 e Opus 4.8, ma esclude Opus 5: una richiesta che nomini Opus 5 non supera quindi la validazione. È l'unico asse sul quale il 2x compra qualcosa che il modello più economico non può offrire, e vale soltanto per le organizzazioni che dispongono già di un impegno contrattuale.

Dove non conviene: due blocchi netti

La zero data retention è un muro, non una questione di prezzo. Fable 5 e Mythos 5 hanno una retention di 30 giorni come Covered Models designati e non sono disponibili con ZDR. Un'organizzazione ZDR riceve quindi 400 invalid_request_error per ogni richiesta a Fable 5, indipendentemente dal budget. Opus 5 non ha questa limitazione.

Nel coding vicino ai temi di sicurezza, il sovrapprezzo porta a un'esperienza peggiore. Il classificatore rilasciato con il ripristino di Fable 5, nelle parole di Anthropic, "comes at the cost of flagging benign requests more often during routine coding and debugging tasks." Le richieste bloccate vengono reindirizzate a Opus 4.8, mentre un rifiuto a metà stream fattura la risposta parziale già trasmessa senza consegnare alcun risultato. Due misurazioni esterne quantificano questo costo:

Tre ulteriori costi restano fuori dalla tariffa:

  • Storico di disponibilità. La dichiarazione sul redeployment di Anthropic registra la sospensione di entrambi i modelli per tutti gli utenti dal 12 giugno al 1 luglio 2026: circa 18 giorni senza alcun accesso, dopo che i controlli USA sulle esportazioni "required us to restrict access to foreign nationals, whether inside or outside the United States."
  • Lavoro di integrazione. Le note di lancio chiedono agli integratori che invocano Fable 5 di pianificare una nuova gestione dei rifiuti, retry di fallback su un altro modello Claude e nuove regole di fatturazione. Il modello a 1x non richiede nulla di tutto questo.
  • Due funzionalità vanno nella direzione opposta. Il cutoff di conoscenza affidabile di Opus 5 è maggio 2026, contro gennaio 2026 per Fable 5; inoltre le modifiche agli strumenti a conversazione in corso, beta mid-conversation-tool-changes-2026-07-01, sono disponibili da Opus 5 in poi.

La posizione di Mythos 5 e Project Glasswing

Screenshot della pagina Claude Platform Docs di Anthropic intitolata Introducing Claude Fable 5 and Claude Mythos 5, con l'avviso di accesso ripristinato e la tabella dei modelli che elenca claude-fable-5 e claude-mythos-5 con le rispettive descrizioni

Anthropic continua a definire Fable 5 "Anthropic's most capable widely released model". L'espressione widely released è la precisazione che esclude Claude Mythos 5 (claude-mythos-5), il quale offre le stesse capacità allo stesso prezzo di $10 / $50.

Mythos 5 viene distribuito solo attraverso Project Glasswing, un rilascio limitato per la cybersecurity difensiva senza registrazione self-service. La differenza riguarda classificatori e accesso, non le capacità: è Fable 5 senza i classificatori di sicurezza, non un modello più potente.

Questo cambia l'ordine delle opzioni per la sicurezza. Anthropic colloca Opus 5 dietro Mythos 5 in cybersecurity e biologia, e "far behind" nello sviluppo di exploit; sono dati del vendor. Il Claude più potente per il lavoro di sicurezza è quello che non si può acquistare, mentre quello acquistabile a 2x è proprio il modello il cui classificatore segnala anche debugging benigno. Il confronto tra Mythos 5 e Opus 4.8 approfondisce questa linea di modelli.

Come chiamare i due modelli

ID dei modelli e disponibilità

Opus 5 è disponibile come claude-opus-5 ed è il nuovo modello predefinito di Claude Max. Fable 5 è claude-fable-5 sulla stessa API; in Claude Code entrambi si selezionano con /model. Opus 5 è disponibile su:

  • Claude API, claude.ai, Claude Code e Claude Cowork
  • Amazon Bedrock, come anthropic.claude-opus-5
  • Google Cloud e Microsoft Foundry

Entrambi supportano una finestra di 1M token e un output massimo di 128k, quindi il contesto non è un criterio decisivo. Nei piani consumer, dal 7 luglio l'allocazione di Fable 5 è passata ai crediti di utilizzo; inoltre i normali posti Enterprise non includono alcuna allocazione Fable 5. Un'organizzazione senza crediti non ha quindi accesso a Fable 5.

La leva di spesa

Effort e controlli del thinking sono il punto in cui si muove davvero la spesa. Opus 5 espone livelli da low a max, usa high come predefinito e accetta il thinking disabilitato a high o sotto. Il thinking adattivo di Fable 5, invece, non può essere disabilitato: non è una manopola, ma un limite minimo strutturale ai token di output.

Se instradate Claude tramite un gateway compatibile con Anthropic, controllate quale lato di questo confronto viene effettivamente supportato.

AIReiter prezza Opus 4.8 a $1.56 / $7.76 per MTok, contro i $5 / $25 ufficiali: circa il 69% in meno. Al 25 luglio, la sua gamma Claude si ferma a Fable 5, Sonnet 5, Opus 4.8 e Opus 4.7, senza ancora una voce per Opus 5.

La raccomandazione e l'unica eccezione

La scelta predefinita è Opus 5; considerate Fable 5 un'escalation da giustificare per singola classe di attività. Anche Anthropic suggerisce lo stesso approccio: "start with Claude Opus 5 for complex agentic coding and enterprise work. For workloads that need the highest available capability, use Claude Fable 5."

Due casi modificano gli input del calcolo, invece di superare la soglia:

  • Esecuzioni autonome lunghe, in cui un fallimento silenzioso costa più di un retry e p non è più misurabile.
  • Qualsiasi lavoro asincrono, perché Fable 5 su Batch equivale al prezzo sincrono di listino di Opus 5.

Un'eccezione scavalca l'aritmetica anziché soddisfarla: Priority Tier. Fable 5 e Opus 4.8 sono inclusi, mentre Opus 5, Sonnet 5 e Mythos 5 sono esclusi. Un carico di lavoro che richieda throughput con uptime contrattuale del 99.5% non può acquistare l'opzione più economica, a nessun prezzo.

Va letto in modo restrittivo. Anthropic dichiara che questi impegni di capacità "are no longer available for purchase"; chi li possiede già li mantiene soltanto fino alla fine del contratto. Senza un impegno già attivo, questa eccezione non è disponibile e il calcolo del pareggio resta valido.

FAQ

Opus 5 è migliore di Fable 5?

Con effort max, Opus 5 arriva entro lo 0,5% dal miglior punteggio di Fable 5 su CursorBench 3.2, spendendo metà per attività; sono dati del vendor, non replicati indipendentemente. Ha anche un cutoff di conoscenza più recente: maggio 2026 contro gennaio 2026.

Fable 5 mantiene il titolo di modello ampiamente distribuito più capace ed è progettato per esecuzioni agentiche di lunga durata. L'idoneità a Priority Tier aiuta soltanto le organizzazioni che possiedono già un impegno contrattuale.

Perché Fable 5 è stato rimosso da Claude, ed è tornato?

Anthropic ha sospeso entrambi i modelli per tutti gli utenti dal 12 giugno al 1 luglio 2026, dopo che i controlli USA sulle esportazioni hanno richiesto di limitare l'accesso ai cittadini stranieri. L'innesco era un metodo segnalato dall'esterno per indurre Fable 5 a superare le proprie protezioni e cercare vulnerabilità software. L'accesso è stato ripristinato con un classificatore riaddestrato, che lo blocca in oltre il 99% dei casi ma segnala più spesso anche richieste di coding legittime.

Claude Fable 5 è gratuito?

No. Sull'API costa $10 / $50 per milione di token. I piani consumer lo includevano fino al 50% dei limiti di utilizzo settimanali fino al 7 luglio; in seguito l'accesso è passato ai crediti di utilizzo, senza alcuna allocazione per i normali posti Enterprise. Per grandi volumi, la via meno costosa è la Batch API a $5 / $25.

Il tokenizer di Fable 5 porta il divario reale a 2.6x?

No. Entrambi usano il tokenizer introdotto con Opus 4.7: l'inflazione di circa il 30% vale rispetto a Sonnet 4.6 e ai modelli precedenti, non tra questi due. Il divario per token è 2.0x e, nel nostro campione, Fable 5 ha emesso il 21% di token di output in meno, portando il divario per esecuzione a circa 1.6x.

Qual è la differenza tra Fable 5 e Mythos 5?

Specifiche identiche e stesso prezzo di $10 / $50. Mythos 5 condivide le capacità di Fable 5 senza i classificatori di sicurezza ed è distribuito solo tramite Project Glasswing, senza registrazione self-service. Entrambi sono Covered Models con retention di 30 giorni e sono stati sospesi nella stessa finestra di giugno.

Posso disabilitare il thinking su Fable 5 per ridurre il conto?

No. Il thinking adattivo di Fable 5 è sempre attivo, quindi il suo minimo di token di output è strutturale. Opus 5 accetta thinking: {"type": "disabled"} con effort high o inferiore e restituisce 400 con xhigh e max: la regolazione dell'effort diventa quindi una leva di costo solo sul modello più economico.

Il numero da ricordare

Per la maggior parte delle classi di attività, un solo rapporto risolve il confronto Claude Opus 5 vs Fable 5, e punta verso Opus 5. La stessa aritmetica vale tra vendor diversi: nel confronto tra Opus 5 e la famiglia GPT-5.6 cambiano soltanto le tariffe.

  • Il pareggio arriva quando success_rate(Fable 5) / success_rate(Opus 5) >= 1.6 sul vostro carico di lavoro. Sotto questa soglia, Opus 5 con un retry costa meno per ogni attività completata.