AIREITER
DOC APIPREZZI
TEMPLATE
  • AIReiter
  • Blog
  • Claude Fable 5: high, xhigh o max? Quale effort scegliere

Claude Fable 5: high, xhigh o max? Quale effort scegliere

Ultimo Aggiornamento: 2026-07-29 10:54:23

Se devi scegliere tra effort high e max in Claude Fable 5, la risposta pratica è semplice: lascia high per quasi tutto, passa a xhigh quando affronti coding difficile o attività agentiche, e considera max un'ultima risorsa da usare di rado. Nella maggior parte dei casi, max costa circa il doppio a fronte di un miglioramento qualitativo difficile da misurare, e può perfino portare il modello a ragionare troppo. Il dettaglio che molti trascurano è il livello xhigh, collocato tra high e max: di solito è proprio quello la risposta alla domanda «vale la pena aumentare l'effort?».

Cosa cambia davvero con l'impostazione effort di Fable 5

L'effort (output_config.effort) offre cinque livelli: low, medium, high, xhigh e max. In Fable 5 il valore predefinito è high; come indicato nella documentazione Anthropic sull'effort, impostare esplicitamente high equivale a non specificare affatto il parametro.

Ci sono due aspetti che tendono a sorprendere. Il primo è che effort non regola soltanto il ragionamento: controlla tutto il consumo di token, inclusi testo visibile, extended thinking e chiamate agli strumenti in un loop agentico. Con effort basso, le tool call sono meno numerose e più accorpate, le premesse si riducono e le conferme sono più concise; salendo di livello aumentano invece chiamate, pianificazione esplicita e riepiloghi. Il secondo è che il thinking di Fable 5 è sempre attivo e non può essere disabilitato: thinking: {type: "disabled"} restituisce un errore. L'effort è quindi il modo per controllarne la profondità. A high, xhigh e max Claude ragiona quasi sempre in profondità; con low e medium può saltare il thinking nei problemi più semplici.

Tra high e max c'è xhigh: il livello da non ignorare

Il confronto «high vs max» in realtà coinvolge tre gradini, perché xhigh si inserisce nel mezzo e offre un controllo più preciso sul compromesso tra ragionamento e latenza. L'ingegnere Anthropic Boris Cherny lo ha definito «a new level between high and max». È disponibile soltanto su Fable 5, Mythos 5, Opus 4.8, Opus 4.7 e Sonnet 5; modelli precedenti come Opus 4.6 e Sonnet 4.6 passano direttamente da high a max.

Questa è la scala completa, con i casi d'uso associati da Anthropic a ogni livello:

LivelloUso indicato da Anthropic
lowTask semplici che richiedono massima velocità e costi minimi, come i subagent
mediumTask agentici con un equilibrio tra velocità, costo e prestazioni
highRagionamento complesso, coding difficile, task agentici (il valore predefinito)
xhighAttività agentiche o di coding di lunga durata (30+ minuti), con budget nell'ordine di milioni di token
maxRagionamento più profondo, senza limiti allo sforzo interno (l'output resta vincolato da max_tokens)

Per questo, quando qualcuno valuta Fable 5 con max, la prima domanda da fare è un'altra: hai già provato xhigh? Per il coding e il lavoro agentico più impegnativi, il passaggio consigliato è xhigh, non max.

Quanto paghi in più, e in termini di latenza

Aumentare l'effort non modifica il prezzo per token. Fable 5 applica la stessa tariffa a ogni livello: $10 per milione di token in input e $50 per milione di token in output. Il costo sale soltanto perché il modello genera più token.

Grafico a barre che confronta il costo relativo per task e la qualità relativa dell'output nei livelli di effort di Claude Fable 5, da low a max, mostrando costi in forte crescita e qualità che tende a stabilizzarsi

Il grafico è illustrativo, non basato su misurazioni: rappresenta la forma del compromesso descritto sotto, normalizzando entrambi gli assi con max pari a 1.0. La qualità è già vicina al suo massimo con high, mentre il costo continua all'incirca a raddoppiare salendo di livello.

Il passaggio da xhigh a max è quello in cui il rapporto costo-beneficio peggiora. Il software engineer Ishu Agarwal ha riportato (11 luglio 2026) che il salto da high a xhigh «can usually be less than 3%» in termini di qualità, pur costando dal «30% to 100%» in più, e che i modelli tendono «to overthink at higher effort levels». Un post molto condiviso del 14 luglio sosteneva che Fable 5 avesse ottenuto lo stesso punteggio con max e xhigh: «89.0 vs 89.0, at roughly double the cost». Sono dati della community da interpretare come indicazioni di tendenza, non come benchmark controllati. La direzione, però, coincide con quanto osservato dalla stessa Anthropic: max «adds significant cost for relatively small quality gains, and on some structured-output or less intelligence-sensitive tasks it can lead to overthinking.»

La latenza segue una dinamica simile. Dopo aver testato i livelli di effort (11 giugno 2026), il product manager Pawel Huryn ha rilevato che «below max, completion time barely moves», mentre nel lavoro reale «completion jumps from xhigh up». C'è poi un'altra insidia: il tokenizer di Fable 5, condiviso con l'ultima generazione Opus, può generare fino a circa il 35% di token in più per lo stesso testo rispetto ai precedenti modelli Claude. Qualsiasi stima dei costi basata su un modello precedente sarà quindi sottostimata.

Regola pratica: quando scegliere high, xhigh o max

Tipo di taskEffortQuando salire di livello
Coding di routine, chat, estrazione dati, subagentlow / mediumQuando la qualità dell'output cala in modo evidente
La maggior parte dei task di ragionamento, coding quotidiano, lavoro agenticohigh (predefinito)Quando un task difficile si blocca o richiede una pianificazione più approfondita
Coding e lavoro agentico più complessi, esecuzioni a lungo orizzonte, uso intensivo di toolxhighQuando xhigh non riesce davvero a risolvere il problema
Un problema frontier o un bug che xhigh non ha risolto, con correttezza più importante del costomax(Il livello più alto)

high è il punto di equilibrio tra qualità ed efficienza nell'uso dei token; xhigh aggiunge una riflessione concreta per le attività più dure; max è un tentativo con poche probabilità di riuscita dopo che xhigh ha già fallito. Spesso è più intelligente scendere di livello: secondo Anthropic, l'effort inferiore su Fable 5 mantiene buone prestazioni e «often exceed[s] xhigh performance on prior models». Il CTO Morgan Linton lo ha detto senza mezzi termini: «about 95% of what I do from a coding perspective only requires Fable 5 Low and Medium». Usare sempre high quando Low o Medium restituiscono lo stesso output è il modo più rapido per consumare i limiti del proprio piano.

Se il modello non è adatto al lavoro da svolgere, regolare l'effort non risolverà il problema: è una questione di scelta del modello, non di effort.

Tre equivoci comuni sull'effort di Fable 5

Un effort più alto non rende il modello più intelligente. L'effort stabilisce quanto lavoro Claude svolge prima di rispondere, quindi più thinking e più tool call, non quanto sia capace il modello. Una risposta con low arriva dallo stesso modello di una con max; se il compito va oltre le sue capacità, max spenderà soltanto di più per arrivare allo stesso risultato.

Il valore predefinito di Claude Code non è quello dell'API. Claude Code usa xhigh come default, mentre l'API usa high. Questo spiega molte differenze di comportamento percepite: lo stesso modello sembra più scrupoloso e più costoso in Claude Code semplicemente perché parte da un livello più alto. Se vuoi lo stesso comportamento nell'API, imposta esplicitamente xhigh.

ultracode non è un livello di effort. Compare nel menu di Claude Code, ma l'API accetta soltanto valori da low a max. Ultracode combina xhigh con il permesso permanente di avviare workflow multi-agent: è affamato di token e non è un'opzione che puoi passare all'API.

Come impostare effort e cosa sapere su max_tokens

L'effort si configura in output_config e non richiede beta header. Poiché il thinking di Fable 5 è sempre attivo, ometti del tutto il parametro thinking:

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-fable-5",
    max_tokens=64000,          # lascia spazio a xhigh/max (vedi nota sotto)
    output_config={"effort": "xhigh"},   # low | medium | high | xhigh | max
    messages=[{"role": "user", "content": "Refactor this module and add tests."}],
)

max_tokens è un limite rigido sull'output totale, cioè thinking più testo della risposta. Con xhigh o max, il thinking può consumare una parte consistente del budget: imposta quindi un margine ampio, partendo da circa 64.000, oppure le risposte rischiano di interrompersi a metà ragionamento. Fable 5 supporta un contesto da 1M token e 128K token in output.

FAQ

Qual è la differenza tra effort high e max in Fable 5?

high, il valore predefinito, usa le risorse necessarie per ottenere risultati eccellenti; max elimina ogni vincolo per il ragionamento più profondo. Nella pratica, il salto più significativo da high è quasi sempre xhigh, che si trova tra i due.

Vale la pena usare max su Fable 5?

Raramente: rispetto a xhigh costa circa il doppio, offre pochi miglioramenti misurabili e può portare il modello a ragionare troppo. Riservalo a un problema frontier o a un bug che xhigh non riesce a risolvere.

Come cambio il livello di effort?

Imposta output_config: {"effort": "..."} usando low, medium, high, xhigh oppure max. In Claude Code, usa il relativo menu effort.

Qual è il livello di effort predefinito?

Nell'API è high, identico a omettere il parametro. Claude Code usa invece xhigh come valore predefinito.

Un effort più alto aumenta il prezzo per token?

No: la tariffa rimane fissa. L'effort più alto costa di più soltanto perché il modello genera più token.

L'effort di Fable 5 è uguale ai livelli di Sonnet o Opus?

Parametro e nomi sono gli stessi, ma xhigh è disponibile soltanto su Fable 5, Mythos 5, Opus 4.8, Opus 4.7 e Sonnet 5; inoltre i valori predefiniti consigliati variano da modello a modello. Se stai scegliendo fra i due, consulta il confronto Sonnet 5 versus Fable 5.

>_Directory modelli AIReiter

Accesso API rapido ai modelli collegati a questa guida

Claude Fable 5

Chat

Un modello Claude premium per il ragionamento profondo e il lavoro complesso su contenuti lunghi.

AnthropicCrea API Key >

Claude Sonnet 5

Chat

Un modello Claude equilibrato per ragionamento avanzato, coding e lavoro quotidiano.

AnthropicCrea API Key >

GPT-5.6 Sol

Chat

Un modello di testo GPT-5.6 premium per attività impegnative di coding, ragionamento e lavoro agentico a lungo formato.

OpenAICrea API Key >

Gemini 3.1 Pro

Chat
GoogleCrea API Key >

Claude Sonnet 4.6

Chat
AnthropicCrea API Key >

Post recenti

Recensione dell’API GPT-6 Astra (2026): pensata per gli agenti, non per il semplice drop-in

2026-09-07

Kling API: guida all'integrazione ufficiale e tramite aggregatori (2026)

2026-09-07

Chiave API Suno: come ottenerla e quanto costa (2026)

2026-09-07

Recensione di GPT-6 Astra: i prezzi API da $10/$50 valgono la spesa?

2026-09-06
AIREITER

Domande? Contattaci a
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Video IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Immagine IA

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Blog

Vedi Tutto →

Azienda

Informativa sulla privacyTermini di servizioPolitica di rimborso

© 2026 AIReiter. Tutti i diritti riservati.