AIREITER

Prezzi Claude Sonnet 5: $2/$10 ora sono definitivi (2026)

Ultimo Aggiornamento: 2026-08-16 19:19:39

Il prezzo di lancio di Claude Sonnet 5 non era affatto temporaneo. Il 10 agosto 2026 Anthropic ha annullato l'aumento previsto per il 1° settembre: $2 per milione di token in input e $10 per milione in output diventano la tariffa standard definitiva. Se il budget API del Q4 era stato calcolato sui $3/$15 riportati alla presentazione di giugno, basta correggere una riga; e chi era rimasto su Sonnet 4.6 in attesa del prezzo "reale" deve ora rivedere la scelta.

Quanto costa Claude Sonnet 5 oggi: listino completo

Sull'API diretta di Anthropic, Claude Sonnet 5 costa $2 per milione di token in input e $10 per milione in output. Tutte le tariffe scontate derivano da questa base. La documentazione dei prezzi di Claude Platform, verificata il 16 agosto 2026, lo dice senza ambiguità: "The previously scheduled increase ... will not occur."

TariffaPrezzo per 1M di tokenMoltiplicatore rispetto all'input base
Input base$2.001.0x
Output base$10.005x l'input
Scrittura cache 5 min$2.501.25x
Scrittura cache 1 ora$4.002x
Lettura cache (hit)$0.200.1x
Input Batch$1.0050% di sconto
Output Batch$5.0050% di sconto
Documentazione ufficiale dei prezzi Claude Platform di Anthropic al 16 agosto 2026

Nella documentazione ci sono anche tre dettagli che non emergono dal prezzo di copertina. L'intera finestra di contesto da 1M di token viene fatturata allo stesso prezzo per token: una richiesta da 900k token e una da 9k costano uguale per token, senza sovrapprezzo per il contesto lungo. Vincolare l'inferenza agli Stati Uniti con inference_geo: "us" applica un moltiplicatore di 1.1x a input, output e cache. La ricerca web lato server costa invece $10 ogni 1.000 ricerche, oltre al normale conteggio dei token.

L'aumento del 1° settembre è stato cancellato

Claude Sonnet 5 è arrivato il 30 giugno 2026 con prezzi di $2/$10 dichiarati esplicitamente introduttivi, destinati a salire a $3/$15 il 1° settembre 2026: la stessa tariffa di Sonnet 4.6. È questo il valore che compare ancora in molte tabelle pubblicate a inizio luglio. Il 10 agosto 2026 il changelog dell'annuncio di lancio ha ricevuto una sola, importante modifica: il prezzo introduttivo diventava permanente. Anche l'articolo di lancio di TechCrunch riporta ora una nota di aggiornamento sulla tariffa in vigore.

Le tabelle che indicano ancora il passaggio a $3/$15 come imminente o "dopo il 31 agosto" sono precedenti al 10 agosto: sovrastimano del 50% entrambe le tariffe standard. Superata quella scadenza, la struttura dell'offerta non cambia: Sonnet 5 a $2/$10 si colloca un gradino sotto Sonnet 4.6 a $3/$15, con un taglio del 33% sul costo dell'input.

Sonnet 5 contro Sonnet 4.6: i conti della migrazione sono cambiati

Il motivo principale per procedere con cautela era il tokenizer. Sonnet 5 adotta la famiglia di tokenizer aggiornata introdotta con Opus 4.7: l'annuncio di Anthropic indica, a parità di testo, un moltiplicatore da 1.0x a 1.35x secondo il tipo di contenuto, mentre la documentazione della piattaforma stima un aumento tipico vicino al 30%. Con il vecchio piano, la tariffa standard da $3/$15 avrebbe portato il costo di un prompt equivalente fino a $4.05 per milione di token input e $20.25 in output, contro i $3/$15 di Sonnet 4.6.

Con i $2/$10 definitivi, anche lo scenario peggiore ribalta il confronto. Persino con l'inflazione massima di 1.35x dei token, un testo equivalente costa $2.70 per milione di token input e $13.50 in output: meno di Sonnet 4.6 su entrambi i fronti. E questo prima di considerare i punteggi superiori di Sonnet 5 nella tabella di confronto pubblicata al lancio: 63.2% contro 58.1% su SWE-bench Pro, 80.4% contro 67.0% su Terminal-Bench 2.1 e 81.2% contro 78.5% su OSWorld-Verified.

Confronto dei costi corretti per il tokenizer tra Sonnet 5 e Sonnet 4.6

Resta però un'obiezione da tenere presente: conta il costo per problema risolto, non solo il costo per token. I test di Artificial Analysis, citati da eesel AI, collocano Sonnet 5 a circa $2.29 per task nel suo Intelligence Index e rilevano che, senza prezzi promozionali, potrebbe costare più per task di Opus 4.8. Il motivo sono le esecuzioni ad alto effort, che consumano thinking token fatturati alla tariffa di output. La reazione della community è stata diretta:

"tl;dr: Sonnet 5 è più economico per token, ma più caro per problema risolto — e resta indietro rispetto a Opus 4.8 in termini di intelligenza complessiva." - u/Chubby, r/accelerate

La tariffa fissa modifica i dati di partenza di quell'equazione, non la sua lezione: sono le impostazioni di effort e i token per task a determinare la fattura. Il lato prestazionale della migrazione è analizzato nel nostro confronto tra Sonnet 5 e Sonnet 4.6.

A parità di listino, effort e cache incidono di più

Due leve influenzano la fattura di Sonnet 5 più di qualunque annuncio sui prezzi. La prima è il selettore dell'effort. Sonnet 5 offre i livelli low, medium, high, xhigh e max; l'annuncio di lancio parla di un'efficienza di costo sensibilmente migliore a effort medio. La copertura del lancio traduce il dato così: Sonnet 5 a medium equivale all'incirca a Sonnet 4.6 a high. Vale quindi la pena verificare se un livello di effort in meno mantiene la qualità richiesta dal proprio carico di lavoro. La seconda leva è il prompt caching. Una scrittura in cache da 5 minuti a $2.50 si ripaga con una lettura successiva; quella da 1 ora a $4.00 dopo due. Ogni lettura costa poi $0.20, ovvero il 90% in meno dell'input. Secondo la documentazione della piattaforma, i moltiplicatori di cache e batch si cumulano.

Con la nuova tariffa permanente, il Batch merita un'attenzione particolare. A $1/$5 per milione di token, l'elaborazione asincrona di Sonnet 5, con risultati entro 24 ore, costa quanto la tariffa standard on-demand di Haiku 4.5, ma per un modello che raggiunge il 63.2% su SWE-bench Pro. Il Batch è in genere la soluzione più economica per valutazioni indipendenti non sensibili alla latenza, backfill ed elaborazione documentale.

Confronto dei prezzi API dei modelli Claude per milione di token, agosto 2026

Stesso modello, prezzi diversi a seconda del provider

Il listino di Sonnet 5 non è identico presso tutti i sette provider che lo ospitano. La tabella dei provider di CloudPrice riporta Anthropic direct, Amazon Bedrock, Azure AI Foundry, Google Vertex AI, OpenRouter e Vercel AI Gateway a $2.00/$10.00, mentre Snowflake applica $2.40/$12.00, cioè un sovrapprezzo del 20%. Secondo la documentazione della piattaforma, ci sono inoltre due maggiorazioni indipendenti dal fornitore: gli endpoint regionali o multi-regione su Bedrock e Vertex costano circa il 10% in più rispetto agli endpoint globali, e l'inferenza limitata agli Stati Uniti applica il moltiplicatore di 1.1x.

ProviderInput / 1MOutput / 1MNote
Anthropic API$2.00$10.00Batch $1/$5, tariffe cache complete
Amazon Bedrock$2.00$10.00Endpoint regionali +10%
Google Vertex AI$2.00$10.00Endpoint regionali +10%
Azure AI Foundry$2.00$10.00Disponibile deployment US Data Zone
OpenRouter$2.00$10.00Variante Batch $1/$5
Vercel AI Gateway$2.00$10.00-
Snowflake$2.40$12.00+20% rispetto alla tariffa standard

Attenzione quando si confrontano le directory: il valore "a partire da $1.00/$5.00" associato da alcune schede a Sonnet 5 è la tariffa Batch, non il prezzo on-demand. La stessa directory indica Sonnet 4.6 a $1.50/$7.50, che corrisponde esattamente al suo prezzo Batch e non alla tariffa standard di $3/$15.

Cosa cambia per il budget con $2/$10 definitivi

Le decisioni rimaste sono legate al modello, non più a una scadenza. Stando all'annuncio di lancio, Sonnet 5 è il modello predefinito dei piani Claude Free e Pro ed è incluso in Max, Team ed Enterprise. Gli utenti in abbonamento non incontrano quindi queste tariffe API; la guida ai prezzi Claude API spiega invece dove si colloca il punto di passaggio dall'abbonamento all'API. Per chi acquista via API:

ScenarioScelta consigliata
Agenti in produzione, sensibili alla latenzaSonnet 5 a $2/$10, cache da 5 minuti sui system prompt
Backfill notturni, eval run, elaborazioni in massaSonnet 5 Batch a $1/$5
I task di coding più complessi (Opus 4.8: 69.2% contro 63.2% su SWE-bench Pro, secondo la tabella di confronto di Anthropic al lancio)Opus 4.8 a $5/$25
Classificazione, routing, riepilogoHaiku 4.5 a $1/$5
Sonnet 4.6 ancora in produzioneAvviare un pilota di migrazione: l'intervallo di tokenizer 1.0-1.35x documentato da Anthropic resta sotto 4.6 per token equivalente; validare prima qualità e token per task sul traffico reale

Con xhigh e max, i thinking token fatturati a $10 per milione fanno comunque crescere la spesa con la difficoltà del problema. Artificial Analysis ha rilevato che, alle vecchie tariffe di $3/$15, un'esecuzione Sonnet 5 ad alto effort poteva costare più per task di Opus 4.8; il taglio permanente abbassa quella soglia di un terzo, ma non elimina il problema. Prima di impegnare una cifra trimestrale, misurate i token per task. Fate passare una settimana di traffico reale attraverso l'endpoint Claude API con l'impostazione di effort usata in produzione e calcolate il costo del carico di lavoro, non soltanto i dollari per milione di token.

Approfondimenti correlati: Claude Sonnet 5 vs Sonnet 4.6 - Guida ai prezzi Claude API 2026 - Guida a Claude Sonnet 5