I prezzi dell'API Claude vanno da $1 per milione di token (input Haiku 4.5) a $50 per milione (output Fable 5) a partire da luglio 2026, e per ogni modello attuale vale la stessa regola: i token di output costano 5× i token di input. Ma il prezzo di listino è la parte facile. Un nuovo tokenizer, il routing solo negli Stati Uniti, la modalità veloce e una trappola di fatturazione che la maggior parte delle persone non nota mai si frappongono tra il tariffario e la fattura reale — e c'è un modo per acquistare gli stessi modelli a una frazione del prezzo di listino.
Ogni numero qui sotto è tratto dalla pagina ufficiale dei prezzi di Anthropic; controllala prima di definire un budget, poiché le tariffe dei modelli possono cambiare.
Prezzi dell'API Claude nel 2026: ogni modello
Queste sono le tariffe attuali per milione di token, verificate rispetto ai prezzi di Anthropic per luglio 2026 (fonte ufficiale). Opus 4.8 è stato lanciato il 28 maggio 2026 alla stessa tariffa di 4.7.
Modello | Input / 1M | Output / 1M | Contesto |
|---|---|---|---|
Claude Fable 5 | $10.00 | $50.00 | 1M |
Claude Opus 4.8 | $5.00 | $25.00 | 1M |
Claude Opus 4.7 | $5.00 | $25.00 | 1M |
Claude Opus 4.6 | $5.00 | $25.00 | 1M |
Claude Sonnet 4.6 | $3.00 | $15.00 | 1M |
Claude Haiku 4.5 | $1.00 | $5.00 | 200K |
Due cose che molti vecchi guide sbagliano. Fable 5 — il modello più capace di Anthropic — si colloca sopra il livello Opus a $10/$50, e l’intera linea Opus 4.x (4.6, 4.7, 4.8) rimane a $5/$25. Quei $5 raccontano una storia a sé: Opus 4.1 costava $15/$75, e il calo a $5/$25 al lancio di 4.6 è stato un taglio del 67% sul modello di punta, mantenuto attraverso tre release da allora.
Opzioni legacy e budget
Se non hai bisogno dei modelli più recenti, quelli più vecchi sono ancora disponibili: Sonnet 4.5 ($3/$15), Opus 4.5 ($5/$25, 200K context), Haiku 3.5 ($0.80/$4) e Haiku 3 ($0.25/$1.25) per i lavori ad alto volume e più sensibili ai costi.
Un dettaglio sottovalutato: Opus 4.6/4.7/4.8, Sonnet 4.6 e Fable 5 includono tutti la finestra di contesto completa da 1M token a prezzi standard — nessun sovrapprezzo per il contesto lungo. Una richiesta da 900K token costa la stessa tariffa per token di una da 9K, mentre diversi concorrenti applicano un sovrapprezzo oltre una certa soglia di lunghezza.
I costi che non sono sul cartellino del prezzo
La tabella delle tariffe è il punto in cui la maggior parte degli articoli sui prezzi si ferma, ed è anche da lì che iniziano le sorprese — perché diversi fattori fanno aumentare la tua fattura reale senza modificare il numero per token.
Il tokenizer che aggiunge silenziosamente token
Opus 4.7 (e Opus 4.8, che condivide il suo tokenizer) ha cambiato il modo in cui il testo viene suddiviso in token. Lo stesso input può produrre fino a circa il 35% di token in più rispetto a Opus 4.6 — allo stesso tasso per token. Il codice, i dati strutturati (JSON/XML) e il testo non in inglese sono quelli più colpiti, perché il tasso non è cambiato ma il numero di token sì. Non prendere il 35% come un dato scontato: prima di fidarti di un budget vecchio, riesegui i tuoi prompt reali tramite l'endpoint di conteggio dei token sul nuovo modello e confronta.
Pensiero, modalità veloce e routing solo negli Stati Uniti
Secondo la documentazione sui prezzi di Anthropic:
I token di extended thinking vengono fatturati come output, anche quando non li visualizzi mai. Una richiesta pesante di ragionamento fa crescere silenziosamente il lato output del conto.
La modalità Fast (solo Opus 4.8/4.7) esegue lo stesso modello fino a 2,5× più velocemente a 2× il prezzo standard.
Inference solo negli USA (residenza dei dati) aggiunge un moltiplicatore 1,1× su input e output; gli endpoint regionali AWS Bedrock o Vertex aggiungono circa un altro 10% in cima.
Strumenti lato server
Gli strumenti eseguiti dal lato di Anthropic vengono fatturati separatamente, secondo la stessa documentazione sui prezzi: la ricerca web costa $10 ogni 1.000 ricerche più i token per elaborare i risultati, e l'esecuzione del codice è gratuita fino a un limite mensile, poi circa $0.05/ora per container. (Verifica i valori attuali nella pagina dei prezzi — le tariffe degli strumenti server cambiano.)
La trappola della fatturazione che coglie gli utenti di Claude Code
Questo non è presente in nessuna scheda prezzi. Se hai ANTHROPIC_API_KEY impostata nella tua shell, Claude Code fattura tramite la API pay-per-token invece che tramite il tuo abbonamento. Le persone che si aspettavano una tariffa fissa di 20–200 $/mese sono state colte di sorpresa da addebiti a consumo proprio per questo motivo. Controlla il tuo ambiente prima di una sessione lunga.
Quanto ti costerà davvero Claude?
Le tariffe contano poco finché non le colleghi a un carico di lavoro. Tre esempi ai prezzi attuali, tutti a 10.000 richieste/giorno (2.000 token di input + 500 token di output ciascuna — 20M token di input + 5M token di output/giorno):
Un chatbot di supporto su Haiku 4.5 ($1/$5): 20M × $1 + 5M × $5 = $45/giorno, circa $1.350/mese.
Un agent di coding su Sonnet 4.6 ($3/$15): $60 + $75 = $135/giorno, circa $4.050/mese prima dell'ottimizzazione.
Un'app RAG ad alto contesto su Opus 4.8 ($5/$25), dove i documenti recuperati aumentano notevolmente l'input, sale fino a cifre mensili alte a quattro o cinque zeri perché il volume di input domina.
Stesso volume, tre modelli — la sola scelta del modello fa oscillare il conto di ~3× tra Haiku e Sonnet.
Questi non sono limiti ipotetici. Un thread di r/ClaudeAI ha monitorato 31 utenti di Claude Code il cui utilizzo sarebbe costato circa $80,000/month alle tariffe API, con il singolo utente più attivo vicino a $18,000 — una stima di quanto il loro utilizzo in abbonamento farebbe addebitare sulla API a consumo, non una fattura letterale. I carichi di lavoro autonomi pesanti sono il punto in cui il conto diventa reale, ed è proprio lì che le ottimizzazioni qui sotto ripagano.
Limiti di velocità e livelli di utilizzo
Il prezzo non è l’unico vincolo — la velocità con cui puoi spenderlo è a livelli. I nuovi account API iniziano con limiti conservativi di richieste al minuto (RPM) e token al minuto (TPM) che aumentano automaticamente man mano che l’account invecchia e la spesa cumulativa cresce (Tier 1 → 4). I nuovi account ricevono anche $5 di crediti gratuiti da usare per i test, senza necessità di carta di credito. Oltre al throughput, Anthropic offre livelli di servizio che comportano un compromesso tra disponibilità e prezzo: un livello standard (predefinito), un livello priority per la disponibilità garantita e un livello batch per lo sconto asincrono del 50% indicato sotto. Consulta la documentazione sui rate-limits per i numeri esatti del tuo tier prima di progettare per la scalabilità — una quota che ha servito il traffico pilota potrebbe richiedere un aumento di tier per la produzione.
Abbonamento Claude vs API: quale costa meno?
La domanda del mondo reale più comune, e la risposta è una soglia, non un verdetto.
Claude Pro costa $20/mese; Max costa $100 o $200/mese. Questi piani coprono le app Claude e Claude Code con un limite di utilizzo — nessun addebito per token.
L'API è puramente a consumo, senza minimo mensile né limite di utilizzo.
Il punto di pareggio si colloca nella fascia bassa dei milioni di token al mese — circa 3–4M su un modello di fascia media (Sonnet), assumendo un mix bilanciato di input/output e che altrimenti resteresti entro il limite di utilizzo di Pro. Sale con Haiku e scende con Opus, quindi consideralo come un intervallo, non come una soglia fissa. Al di sotto di quel volume, un abbonamento è di solito più economico e semplice. Al di sopra — soprattutto con traffico di produzione o coding agentico pesante — conviene il costo per token dell'API, e ottieni un controllo (limiti di velocità, monitoraggio, fatturazione multi-key) che un piano non offre. Per il coding per tutto il giorno, in particolare, gli sviluppatori stimano che un piano Max possa essere notevolmente più economico rispetto allo stesso lavoro fatturato token per token su Opus.
La regola pratica: prototipi e uso individuale → abbonamento; traffico di prodotto su larga scala → API. E fai attenzione alla trappola di ANTHROPIC_API_KEY qui sopra, altrimenti pagherai in entrambi i modi.
Come pagare meno per la Claude API
Tre leve riducono la fattura standard senza cambiare i modelli.
1. Memorizzazione della cache dei prompt (fino al 90% di sconto sul contesto ripetuto)
Memorizza nella cache un prefisso stabile — un lungo system prompt, documenti recuperati, esempi few-shot — e le letture dalla cache costano 0,1× la tariffa di input, uno sconto del 90%. Il punto critico è la scrittura: una scrittura nella cache di 5 minuti costa 1,25× e si ripaga dopo una lettura; una scrittura di 1 ora costa 2× e si ripaga dopo due. Per qualsiasi cosa con un lungo preambolo fisso richiamato ripetutamente, questa è la leva singola più importante. (Documentazione sul caching.)
2. Batch API (50% di sconto, in entrambe le direzioni)
Per tutto ciò che non necessita di una risposta in tempo reale, la Batch API sconta input e output del 50% e restituisce il risultato entro 24 ore. Sonnet 4.6 scende a $1.50/$7.50; Haiku 4.5 a $0.50/$2.50. Il caching e il batching si combinano, portando il costo effettivo ben al di sotto di metà del prezzo indicato.
3. Instradamento del modello e limiti di output
Non eseguire ogni richiesta su Opus. Inoltra la classificazione, la sintesi e la logica di routing a Haiku, riserva Sonnet per il livello intermedio e chiama Opus solo quando il compito lo richiede — spesso con un taglio del 40–60% da solo. E poiché l'output costa 5× l'input, limitare max_tokens è una delle leve più efficaci: ridurre l'output medio da 800 a 500 token su un milione di chiamate fa risparmiare soldi reali ogni mese.
API ufficiale vs piattaforme di relay: puoi pagare meno?
C'è una quarta strada che la documentazione ufficiale non menziona: acquistare gli stessi modelli Claude tramite un relay. Un API relay (o aggregator) si frappone tra te e Anthropic, espone un endpoint compatibile con Anthropic e applica una propria tariffa.
Perché un relay può essere più economico? Principalmente per tre motivi: i relay acquistano volumi con impegno d’uso che consentono sconti irraggiungibili per un singolo account; instradano in modo efficiente tra regioni e provider; e molti operano con margini sottili (o come prodotto civetta) per conquistare gli sviluppatori. Ma uno sconto così profondo deve provenire da qualche parte — comprendete il modello di una piattaforma prima di farci affidamento.
Gli sconti variano molto. Ecco come si confrontano tre opzioni per gli stessi modelli Claude:
Piattaforma | Sconto rispetto al listino Anthropic | Copertura modelli | Note |
|---|---|---|---|
Official Anthropic API | — (base) | Tutti, incl. Fable 5 / Opus 4.8 | Cache, batch, ogni funzionalità |
≈ listino (trasferisce il prezzo del provider) | Molti modelli, multi-provider | Aggregatore; comodità invece di risparmio | |
EvoLink | ~10% di sconto | Fino a Opus 4.7 | Endpoint compatibile con OpenAI |
~80% di sconto | Fino a Opus 4.6 | Compatibile con Anthropic; il caching viene trasferito |
AIReiter si colloca all'estremità più aggressiva. Ecco a quanto corrisponde per modello il headline ~80%:
Modello | Ufficiale (in / out) | AIReiter (in / out) | Risparmi |
|---|---|---|---|
Claude Haiku 4.5 | $1 / $5 | $0.20 / $1.00 | 80% |
Claude Sonnet 4.6 | $3 / $15 | $0.60 / $3.00 | 80% |
Claude Opus 4.6 | $5 / $25 | $1.00 / $5.00 | 80% |
L'integrazione è plug-and-play: l'endpoint di AIReiter è compatibile con l'Anthropic Messages API, quindi l'SDK ufficiale anthropic funziona modificando due righe — punta base_url a https://aireiter.com/api e sostituisci la chiave:
client = anthropic.Anthropic(
api_key="YOUR_AIREITER_KEY",
base_url="https://aireiter.com/api",
)
Lo streaming, le conversazioni multi-turno, la visione e cache_control passano tutti attraverso, quindi lo sconto di caching del 90% sopra si somma alla tariffa base inferiore.
FAQ
Perché Claude API è così costosa?
Spesso non è la tariffa per token a fare la differenza — è la progettazione del workflow. I principali fattori di costo sono usare sempre Opus quando basterebbero Haiku o Sonnet, contesto ripetuto non cachato, output senza limiti e i token di reasoning che ti vengono addebitati ma che non vedi mai. Risolvere questi aspetti di solito conta più del prezzo dichiarato.
Esiste un livello API gratuito di Claude?
Nessun piano gratuito di produzione permanente, ma i nuovi account ricevono $5 di crediti gratuiti (nessuna carta richiesta) per fare dei test. Dopo di che si paga in base all'utilizzo.
Prezzi di Claude API vs ChatGPT — quale costa meno?
Dipende dal livello che confronti. Indicativamente, per milione di token (in / out):
Claude | OpenAI comparabile |
|---|---|
Haiku 4.5 — $1 / $5 | GPT mini tier — cifre basse a una sola cifra |
Sonnet 4.6 — $3 / $15 | mid tier — comparabile |
Opus 4.8 — $5 / $25 | GPT-5.5 — ~$5 / $30 |
Come calcolo la mia fattura mensile dell'API di Claude?
Stimarlo come: (requests × avg input tokens ÷ 1,000,000 × input rate) + (requests × avg output tokens ÷ 1,000,000 × output rate). Usa l’endpoint di conteggio dei token per conteggi accurati sui tuoi prompt reali — un tokenizer generico può sbagliare del 15–35% su Claude.
In sintesi
Per la maggior parte dei team, la suddivisione è in tre modi: prototipazione o uso individuale → un abbonamento Pro o Max (più semplice, più economico sotto ~3–4M token/mese); produzione sull’ultimo flagship (Opus 4.8, Fable 5) → l’API ufficiale con caching, batching e routing attivi; produzione in cui Sonnet 4.6 o Opus 4.6 è sufficiente → un relay affidabile come AIReiter può ridurre la stessa bolletta fino all’80% con una semplice sostituzione drop-in dell’SDK.
Qualunque opzione tu scelga, la maggior parte dei team paga troppo saltando le ottimizzazioni, non scegliendo il livello sbagliato — quindi attiva le leve prima di preoccuparti del listino prezzi.