Sonnet 5 è arrivato il 30 giugno 2026 e su r/ClaudeAI è subito emersa un'obiezione che il listino non lascia intuire: "Sonnet 5 is worse than Opus at the same price at high and xhigh?"
Un utente ha riassunto il motivo in modo efficace: Sonnet è "actually cheaper per token, but it takes way more steps and tokens to finish the tasks, so that's what makes it lose its price advantage."
Ha ragione, salvo un'eccezione. Confrontando Claude Opus 5 e Sonnet 5 a parità di budget, Opus prevale quasi ovunque: sopra circa $2.30 per task, Opus impostato un tier di effort più in basso batte Sonnet impostato un tier più in alto sia nei costi sia nella qualità. Sotto quella soglia, e nei task brevi a risposta singola, Sonnet 5 costa 3,4 volte meno.
Dove eccelle ciascun modello
| Claude Opus 5 | Claude Sonnet 5 | |
|---|---|---|
| Model ID | claude-opus-5 | claude-sonnet-5 |
| Disponibilità | 24 luglio 2026 | 30 giugno 2026 |
| Input / output per MTok | $5 / $25 | $2 / $10 fino al 31 agosto 2026, poi $3 / $15 |
| Input / output Batch | $2.50 / $12.50 | $1 / $5 fino al 31 agosto 2026 |
| Tier di effort | low, medium, high, xhigh, max (high predefinito) | gli stessi cinque tier (high predefinito) |
| Extended thinking | attivo per impostazione predefinita | adattivo |
| Contesto / output massimo | 1M / 128k token | 1M / 128k token |
| Knowledge cutoff | maggio 2026 | gennaio 2026 |
| Sconto per token | nessuno | 60% in meno di Opus oggi, 40% in meno dal 1° settembre |
| Utilizzo ideale | run agentici di lunga durata, ragionamento difficile, lavoro costoso da revisionare | estrazione one-shot, alta concorrenza, UX sensibile alla latenza |
| Nostro smoke test su quattro task | 4/4 superati, 1,182 token in output, 2.955¢ | 4/4 superati, 858 token in output, 0.858¢ |
Non esiste ancora un benchmark pubblico di lungo orizzonte eseguito su Opus 5; nelle tabelle per task qui sotto, quindi, la colonna Opus usa Opus 4.8. Consideratela una stima prudenziale: i due modelli hanno lo stesso prezzo e Anthropic posiziona Opus 5 davanti al 4.8 nel lavoro agentico.
Il confronto Claude Opus 5 vs Sonnet 5 a budget equivalente è possibile perché entrambi accettano lo stesso parametro effort sui medesimi cinque tier, senza beta header. La capacità si acquista quindi spostando il selettore, non cambiando modello. I prezzi arrivano dalla pagina prezzi di Claude Platform e sono stati verificati il 25 luglio 2026.
Costi per tier: il punto in cui le curve si incrociano
I dati per singolo tier provengono da DeepSWE v1.1, la classifica di Datacurve per gli agenti su task di lunga durata:
- 113 task scritti da zero, non ricavati da PR già integrate: è la base della sua dichiarazione di assenza di contaminazione
- 91 repository, 5 linguaggi
- Un harness comune per tutti i modelli, con quattro run per task
- Aggiornamento più recente: 21 luglio, tre giorni prima dell'uscita di Opus 5
La colonna Opus ospita quindi Opus 4.8; resta aperta una sola variabile: se Opus 5 consumi più token per task rispetto al 4.8.
| Effort | Sonnet 5 $/task | Opus 4.8 $/task | Sonnet ÷ Opus | Sonnet pass@1 | Opus pass@1 |
|---|---|---|---|---|---|
| low | $2.19 | $2.29 | 0.95x | 30.5% | 40.8% |
| medium | $4.08 | $3.44 | 1.18x | 39.8% | 48.7% |
| high | $7.43 | $4.28 | 1.73x | 48.2% | 51.8% |
| xhigh | $11.89 | $8.01 | 1.49x | 49.7% | 54.4% |
| max | $26.40 | $13.22 | 2.00x | 53.8% | 59.0% |
Sonnet 5 risulta meno costoso in un solo tier, low, proprio quello in cui cede 10.3 punti di pass rate.
Perché il modello più economico può fatturare di più
Conta il numero di step, non la verbosità.
| Effort | Step mediani Sonnet 5 | Step mediani Opus 4.8 | Input per task Sonnet | Input per task Opus |
|---|---|---|---|---|
| low | 70 | 47 | 4.5M | 2.4M |
| max | 260 | 116 | 72.4M | 17.0M |
Uno sconto del 60% per token non regge quando il modello deve leggere una quantità di testo quadrupla.
Quanto sono affidabili i dati in dollari
Prima, una precisazione: DeepSWE non pubblica la base di prezzo utilizzata.
Un run separato su 24 task, datato 13 luglio, ha coperto entrambi i modelli in tutti e cinque i tier dentro Claude Code. Scalando la colonna Sonnet di DeepSWE per 0.67, cioè i $2/$10 promozionali rispetto ai $3/$15 standard, i due set coincidono entro 0.03 a ogni tier.
Due set di task indipendenti, un unico punto di incrocio, nello stesso intervallo fra medium e high. Questa corrispondenza è anche un buon indizio che DeepSWE abbia conteggiato Sonnet alle tariffe standard.
Il suo autore sviluppa e vende Stet, l'harness collegato in quel post: va quindi considerato un test del fornitore sul proprio prodotto.
A budget uguale cambiano i tier, e cambia il risultato
Le tabelle a parità di tier rispondono alla domanda sbagliata: nessuno compra un tier di effort. Si compra un risultato a un certo prezzo, e guardare Claude Opus 5 vs Sonnet 5 da questa prospettiva cambia l'ordine del confronto.
Per ogni configurazione di Sonnet 5, la tabella indica il tier Opus 4.8 meno costoso che ne eguaglia o supera il pass rate. La colonna intro corrisponde al prezzo standard moltiplicato per 0.67.
| Configurazione Sonnet 5 | Sonnet pass@1 | Sonnet $, standard | Sonnet $, intro (stima) | Tier Opus 4.8 più economico che lo eguaglia | Opus $ | Opus pass@1 | Costo Opus vs Sonnet intro | Delta qualità |
|---|---|---|---|---|---|---|---|---|
| low | 30.5% | $2.19 | $1.47 | low | $2.29 | 40.8% | 1.56x | +10.3pp |
| medium | 39.8% | $4.08 | $2.73 | low | $2.29 | 40.8% | 0.84x | +1.0pp |
| high | 48.2% | $7.43 | $4.98 | medium | $3.44 | 48.7% | 0.69x | +0.4pp |
| xhigh | 49.7% | $11.89 | $7.97 | high | $4.28 | 51.8% | 0.54x | +2.1pp |
| max | 53.8% | $26.40 | $17.69 | xhigh | $8.01 | 54.4% | 0.45x | +0.5pp |
Leggete le ultime due colonne dall'alto in basso. Abbassando Opus di un tier rispetto al tier Sonnet che stavate valutando, si ottiene lo stesso pass rate o uno superiore spendendo dal 16% al 55% in meno, anche con i prezzi promozionali. Solo la prima riga ribalta il quadro: con effort low, Sonnet 5 promozionale costa il 36% meno e rinuncia a 10.3 punti di pass rate.
L'interpretazione opposta
Un commentatore nel primo thread ha letto il grafico ufficiale al tier medium: Opus vicino a $7 contro i $4.50 di Sonnet, per tassi di successo del 68% e del 62%, "a 55% increase in price for less than a 10% boost in success rate on this test."
È un compromesso ragionevole quando sbagliare di 6 punti non comporta alcun costo; non lo è quando un diff sbagliato arriva in produzione.
Entrambe le letture dipendono dalla distribuzione dei task di qualcun altro. Venti o cinquanta task vostri, valutati sul costo per completamento riuscito anziché sul costo per token, valgono più di qualsiasi tabella in questa pagina.
Cosa cambia con Opus 5, allo stesso prezzo di $5 e $25
Il prezzo di lancio di Opus 5 replica quello di Opus 4.8 riga per riga. Resta quindi una terza variabile: i token consumati per task. Le evidenze puntano in entrambe le direzioni.
| Indizi che Opus 5 costi meno per task | Indizi che costi di più |
|---|---|
| Anthropic dichiara che Opus 5 guida Frontier-Bench v0.1 e "more than doubles Opus 4.8's performance at a lower cost per task" (dato del fornitore, basato sui suoi run, senza riproduzione indipendente) | Extended thinking è attivo per impostazione predefinita, mentre su Opus 4.8 era disattivato |
| Un partner legale non identificato ha registrato circa il 26% di token in meno al massimo ragionamento (informazione riportata da Anthropic, senza metodologia) | I nostri quattro task: Opus 4.8 ha prodotto 380 token in output, Opus 5 ne ha prodotti 1,182 |
Entrambe le possibilità sono concrete: prima di impegnare un budget, rimisurate le colonne di costo sul vostro repository.
Attenzione anche alla scorciatoia più ovvia per ridurre il costo di Opus 5: thinking: {"type": "disabled"} viene accettato solo fino a effort high e restituisce un 400 a xhigh o max. È una delle varie breaking change tra Opus 4.8 e Opus 5 da conoscere prima della migrazione.
Dove vince Sonnet 5: task brevi e one-shot
Il 24 luglio 2026 abbiamo sottoposto entrambi i modelli a quattro piccoli task, valutati da script e non per impressione: una correzione di due difetti in kth_smallest, un output JSON rigoroso con ordine delle chiavi fisso e checksum coerente, una domanda sul numero di Frobenius con risposta 65 e un refactoring che aggiunge validazione mantenendo la signature e senza commenti.
Tutti e due hanno superato tutti e quattro i task. La differenza è emersa sul contatore.
| Claude Sonnet 5 | Claude Opus 5 | |
|---|---|---|
| Verifiche superate | 4/4 | 4/4 |
| Token in output, quattro task | 858 | 1,182 |
| Latenza totale | 13.7s | 24.6s |
| Costo output a tariffe intro / standard | 0.858¢ / 1.287¢ | 2.955¢ |
Output verificati identici, ma Opus 5 costa 3.4 volte di più ai prezzi attuali di Sonnet, oppure 2.3 volte di più al termine della promozione, impiegando poco più della metà del tempo effettivo. Anche ripetendo i due task di coding attraverso il canale first-party di Claude Code, il risultato andava nella stessa direzione: 240 token in output per Sonnet 5 contro 465 per Opus 5.
Tre limiti contano più di questo numero:
- Un solo run per modello e per task. È uno smoke test, non un benchmark.
- Abbiamo considerato solo i costi dei token in output, alle tariffe output ufficiali, perché il gateway inseriva un system prompt variabile che rendeva i conteggi input inutilizzabili per il calcolo della fatturazione.
- Quattro prompt brevi: proprio il contesto escluso dal dibattito della community. Qui nessun task esegue 70 step, quindi non viene riprodotta l'esplosione degli step.
Entro questi limiti, lo sconto di Sonnet 5 resta intatto. Uno sviluppatore ha descritto esattamente questo tipo di lavoro: agenti ricchi di documenti che eseguono "single-shot extractions with minimal reasoning needed", dove "Opus would be overkill."
Due date da associare a ogni numero
30 giugno 2026: revisione del grafico ufficiale sui costi
L'annuncio di Claude Sonnet 5 di Anthropic include una nota nel changelog. Il grafico originale su costi e prestazioni usava "a simpler methodology that did not reflect the standard methodology we use for agentic search evaluations," con "the result of underestimating Sonnet 5's performance on the evaluation."
Il grafico e il testo circostante sono stati aggiornati per allinearsi alla metodologia BrowseComp della system card, "which used a 10M token budget with compaction and programmatic tool calling."
Se citate quel grafico, verificate quindi quale revisione state guardando e leggete la didascalia: Sonnet 5 è prezzato alle tariffe standard di $3/$15, viene specificato che la tariffa introduttiva porta il costo reale sotto quello mostrato nel grafico, mentre Opus 4.8 è calcolato a $5/$25.
1° settembre 2026: termina il prezzo promozionale
Scade la tariffa introduttiva di Sonnet 5, ogni voce pubblicata aumenta del 50% e Opus 5 resta a $5/$25. Dalla pubblicazione restano quindi 37 giorni, dopodiché qualunque modello di spesa costruito sulle tariffe attuali sarà errato.
In queste discussioni viene spesso citata un'altra data, che però qui non è pertinente. Il tokenizer di Claude 4.7 genera circa il 30% di token in più per lo stesso testo rispetto a Sonnet 4.6; confrontare Sonnet 5 e Sonnet 4.6 sul solo prezzo per token sottostima dunque l'aumento reale. Opus 5 e Sonnet 5 condividono quel tokenizer, perciò l'effetto si annulla nel confronto fra loro.
Quale scegliere in base al budget
Claude Opus 5 vs Sonnet 5 non si risolve con un vincitore unico, ma con tre regole di instradamento. Le soglie sono il costo medio per task di DeepSWE, con Opus 4.8 al posto di Opus: sono fasce iniziali per il lavoro sui repository, non costanti valide per agenti di ricerca, pipeline di assistenza o workflow documentali.
- Sotto circa $2.30 per task, scegliete Sonnet 5 con effort low. È l'unica configurazione in cui il vantaggio di prezzo mantiene validità nel lavoro agentico, al costo di un pass rate del 30.5%. Per estrazione one-shot, classificazione e qualunque attività con output delimitato, restate qui e sfruttate il 3.4x misurato da noi. Uno sviluppatore ha definito Sonnet 5 "close enough to Opus for 90% of the work, but instant (comparatively)", aspetto importante quando c'è una persona in attesa.
- Tra circa $2.30 e $8 per task, scegliete Opus un tier sotto anziché Sonnet un tier sopra. Opus medium come impostazione operativa predefinita, Opus high quando un errore è costoso da intercettare in revisione. Su Opus 5 il prezzo per token è identico, ma i token per task non sono ancora misurati: considerate questa fascia il punto da cui iniziare i test.
- Sopra $8, non continuate ad alzare il selettore di Sonnet. Sonnet 5 a max costa $26.40 per task per un 53.8% su DeepSWE; Opus 4.8 a xhigh costa $8.01 per un 54.4%; Fable 5 a low effort ha raggiunto il 59.6% per $3.76. AIReiter propone Opus 4.8 a $1.56/$7.76 per MTok, circa il 69% sotto listino, anche se la sua offerta Claude non include ancora Opus 5.
FAQ
Claude Opus 5 costa più di Sonnet 5?
Per token, sì: $5/$25 contro i $2/$10 promozionali di Sonnet 5, cioè 2.5 volte tanto fino al 31 agosto 2026 e 1.67 volte tanto dopo. Per task completato, però, l'ordine può invertirsi; lo confermano le mediane, non alcuni run anomali. Su DeepSWE, il costo mediano a effort max è stato $23.28 per Sonnet 5 contro $12.35 per Opus 4.8.
Quanto costa Claude Sonnet 5?
$2 per milione di token input e $10 per milione di token output fino al 31 agosto 2026; dal 1° settembre diventano $3 e $15. L'aumento è del 50% su ogni voce pubblicata: le scritture cache di 5 minuti passano da $2.50 a $3.75, quelle di 1 ora da $4 a $6, i cache hit da $0.20 a $0.30. Durante la promozione, il prezzo Batch è $1/$5.
Perché un modello più economico può finire per costare di più?
Perché la fattura cresce con gli step, non con il numero di task. Lungo la scala di effort, il numero mediano di step di Sonnet 5 sale da 70 a 260, contro i 47-116 di Opus 4.8; a max legge 72.4M token per task, contro 17.0M. Leggere quattro volte tanto annulla uno sconto del 60% su ogni token.
Opus 5 è molto migliore di Sonnet 5?
Sui singoli tentativi, sì: su DeepSWE Opus 4.8 supera Sonnet 5 di 3.5-10.3 punti di pass@1, con il divario più ampio all'estremo basso.
Con quattro tentativi per entrambi, il divario quasi scompare: Sonnet 5 a high effort ha raggiunto il 79.6% di pass@4, contro il 77.9% di Opus 4.8; a max i due erano rispettivamente al 78.8% e al 79.3%. Sonnet può arrivarci, ma richiede più tentativi e ognuno si paga.
L'aumento di prezzo di Sonnet 5 del 1° settembre cambia la conclusione?
Sposta il punto di incrocio verso il basso, non verso l'alto. Il vantaggio di Sonnet 5 per token passa dal 60% al 40%, mentre Opus 5 resta a $5/$25: ogni abbinamento nella tabella a budget equivalente peggiora quindi per Sonnet. L'unica riga favorevole a Sonnet, il tier low al 36% sotto Opus low con il prezzo introduttivo, si riduce a circa il 4% sotto alle tariffe standard.
