AIREITER
AnthropicText Chat

Claude Sonnet 5.5

API Claude Sonnet 5.5 a metà del listino Anthropic: $1 in input, $5 in output per 1M di token. Novità rispetto a Sonnet 5, benchmark, breaking change e codice funzionante.

InputUfficiale $2.00 per 1 M di tokenAIReiter $1.00 per 1 M di tokenOutputUfficiale $10.00 per 1 M di tokenAIReiter $5.00 per 1 M di tokenLettura cacheUfficiale $0.20 per 1 M di tokenAIReiter $0.10 per 1 M di tokenCreazione cacheUfficiale $2.50 per 1 M di tokenAIReiter $1.25 per 1 M di token
Esegui con API

INPUT

OUTPUT

Example
Generated in
42.7 seconds
Token input
134
Token output
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Dettagli del modello

Usa la stessa chiave del modello nel Playground, nelle richieste API e nei flussi di lavoro interni.

ID modello
claude-sonnet-5-5
Provider
Anthropic
Protocollo
Anthropic Messages
Finestra di contesto
1,000,000 token
Output massimo
128,000 token
Token input
100 crediti / 1 M token
Token output
500 crediti / 1 M token
Lettura cache
10 crediti / 1 M token
Scrittura cache
125 crediti / 1 M token

Le novità di Claude Sonnet 5.5

Anthropic ha rilasciato Claude Sonnet 5.5 il 28 settembre 2026 come upgrade diretto di Sonnet 5. Il prezzo di listino è rimasto invariato; ciò che è cambiato è la quantità di lavoro che può svolgere e quanti token impiega per farlo.

Vicino a Opus 5.5 nel knowledge work

Anthropic riporta un punteggio GDPval-AA di 1844 per Sonnet 5.5, a soli due punti da Opus 5.5 (1846) e circa 400 punti avanti rispetto a Sonnet 5 (1449). Anthropic afferma inoltre che Opus 5.5 rimane nettamente superiore nei compiti aperti che richiedono un giudizio continuo.

Un netto passo avanti nel coding

Su CursorBench 4.0 Anthropic registra il 55,5% per Sonnet 5.5, contro il 34,1% di Sonnet 5 e il 57,8% di Opus 5.5. Anthropic lo posiziona per il lavoro quotidiano ben definito: sviluppo di funzionalità, correzione di bug e creazione di documenti, slide e fogli di calcolo.

Meno token per lo stesso compito

I primi clienti hanno riscontrato risparmi concreti nei propri carichi di lavoro: Slack ha registrato circa il 14% di token in uscita in meno senza modificare i prompt, e Balyasny Asset Management ha misurato circa 121K token per risposta contro i 497K su Sonnet 5 su 2.441 task finanziari.

Output più veloce, stesso tokenizer

Anthropic afferma che l'output è oltre il 30% più veloce rispetto a Sonnet 5; Artificial Analysis ha misurato circa 139 token di output al secondo. Il tokenizer è invariato, quindi lo stesso testo corrisponde allo stesso numero di token su entrambi i modelli.

Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5

Tutti e tre funzionano con la stessa chiave AIReiter. In sintesi: abbandona Sonnet 5 non appena le tue richieste superano i controlli di migrazione indicati di seguito, e mantieni Opus 5.5 per i compiti aperti più complessi.

Sonnet 5.5 vs Sonnet 5: stesso prezzo, più risultati

Entrambi hanno un prezzo di listino di $2 in input e $10 in output per milione di token. Sonnet 5.5 ottiene punteggi più alti nei benchmark di coding e knowledge work citati sopra e solitamente completa i task con meno token, quindi lo stesso lavoro tende a costare meno.

Sonnet 5.5 vs Opus 5.5: metà prezzo

Qui Sonnet 5.5 costa $1,00 in input e $5,00 in output per milione di token; Opus 5.5 costa $2,00 e $10,00. Entrambi offrono una context window da 1M di token e un output massimo di 128K, quindi per passare da uno all'altro basta modificare il campo model.

Quando Opus 5.5 conviene ancora

Per task lunghi e ambigui in cui il modello deve pianificare, accorgersi dei propri errori e proseguire. Base44 ha segnalato 3,6 iterazioni per build di app su Sonnet 5.5 contro 7,7 su Opus 5; conviene quindi provare prima Sonnet 5.5 ed effettuare l'escalation solo per i task non riusciti.

Quando rimanere su Sonnet 5 per il momento

Se il tuo codice disabilita il thinking, forza uno strumento specifico o imposta temperature, queste richieste falliranno su Sonnet 5.5 finché non le modifichi. Anche gli strumenti di sicurezza potrebbero riscontrare più rifiuti. Correggi prima questi aspetti, poi effettua il passaggio.

Migrazione da Sonnet 5: cosa restituisce ora un errore

Modificare la stringa del modello in claude-sonnet-5-5 non è sempre sufficiente. Queste strutture di richiesta funzionavano su Sonnet 5 ma vengono rifiutate da Sonnet 5.5.

thinking: disabled restituisce 400

L'adaptive thinking è sempre attivo. Sostituisci {"type": "disabled"} con {"type": "between_tools"}, l'impostazione minima, che salta il thinking prima della prima risposta. between_tools funziona solo con effort impostato su low, medium o high; per xhigh o max, ometti thinking o invia {"type": "adaptive"}.

I budget manuali per thinking restituiscono 400

thinking: {"type": "enabled", "budget_tokens": N} viene rifiutato. Controlla invece la profondità tramite il livello di effort. I token di thinking vengono comunque sottratti da max_tokens e fatturati come output, quindi aumenta max_tokens se le risposte iniziano a essere troncate.

La scelta forzata del tool viene rifiutata

Un tool_choice che impone un tool specifico ora genera un errore. Utilizza la scelta automatica dei tool con definizioni rigorose dei tool e lascia che sia il modello a decidere quando chiamarli.

Valori personalizzati di temperature, top_p e top_k restituiscono 400

È accettato solo il campionamento predefinito. Rimuovi questi campi dalla richiesta anziché impostarli su valori fissi. Una novità va a tuo favore: il prompt minimo memorizzabile nella cache scende da 1.024 a 512 token.

Scegli il livello di effort prima del rilascio

L'effort è ora il fattore principale per costi e latenza. Ci sono cinque livelli: low, medium, high, xhigh e max.

Il valore predefinito dell'API è high

Se non invii alcun effort, l'API viene eseguita su high. Claude Code e le app Claude sono impostate su medium per impostazione predefinita. Imposta esplicitamente output_config.effort in modo che la tua fatturazione non dipenda da un valore predefinito.

max è costoso

A max effort, Artificial Analysis ha misurato $7.60 per task al prezzo di listino e 410M di token di output nel suo indice, rispetto a una mediana di 88M. Le affermazioni di efficienza di Anthropic riguardano i livelli inferiori, non max.

Inizia da medium, misura, poi cambia

Esegui i tuoi task reali a medium, controlla la qualità e aumenta il livello solo dove non è all'altezza. Per i cicli di strumenti sensibili alla latenza, low o medium con il ragionamento between_tools mantiene le prime risposte rapide.

Prezzi dell'API Claude Sonnet 5.5 su AIReiter

Ogni riga è fatturata al 50% del listino di Anthropic. Stesso modello, stesso protocollo Messages.

Metà del listino su ogni voce

Input $1.00 (listino $2.00). Output $5.00 (listino $10.00). Letture cache $0.10 (listino $0.20). Scritture cache $1.25 (listino $2.50). Tutto per milione di token.

Una chiamata reale: $1.50 invece di $3.00

Un milione di token di input più centomila token di output costano $1.50 qui e $3.00 sul listino di Anthropic. La stessa chiamata su Opus 5.5 qui costa $3.00.

Fatturato sui token effettivamente utilizzati

All'avvio della chiamata viene trattenuta una stima, che viene poi conguagliata in base al conteggio reale dei token al completamento della risposta, restituendo la differenza. La tariffa è la stessa dal primo token al milionesimo; non esiste un piano tariffario a parte per contesti lunghi.

Come chiamare l'API di Claude Sonnet 5.5

L'endpoint supporta il protocollo Messages di Anthropic, quindi per un client Claude esistente servono solo un nuovo base URL e una nuova chiave.

01

Ottieni una chiave e punta il client su AIReiter

Crea una chiave API nella tua dashboard AIReiter. Negli SDK ufficiali di Anthropic imposta il base URL su https://aireiter.com/api — l'SDK aggiunge /v1/messages automaticamente.

02

Invia una richiesta con curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

Oppure usa l'SDK Python

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

FAQ sull'API Claude Sonnet 5.5

/ 01

Quando è stato rilasciato Claude Sonnet 5.5 e qual è l'ID del modello?

Anthropic lo ha rilasciato il 28 settembre 2026. L'ID del modello API è claude-sonnet-5-5 e la sua data limite di conoscenza (knowledge cutoff) è giugno 2026.

/ 02

Quali sono la finestra di contesto e l'output massimo?

Una finestra di contesto da 1M di token e fino a 128K token di output per richiesta. Accetta input di testo e immagini e restituisce testo.

/ 03

Quanto costa l'API di Claude Sonnet 5.5?

Anthropic indica $2 per l'input e $10 per l'output per milione di token, la stessa tariffa di Sonnet 5. AIReiter fa pagare la metà: $1 per l'input, $5 per l'output, $0.10 per le letture della cache e $1.25 per le scritture nella cache.

/ 04

Posso disattivare il thinking?

Non del tutto. thinking disabilitato restituisce un errore 400. L'impostazione minima è between_tools, che funziona con effort low, medium e high.

/ 05

Sonnet 5.5 è migliore di Sonnet 5?

In base ai benchmark su coding e knowledge-work riportati da Anthropic, sì, con un ampio margine e allo stesso prezzo di listino. Verifica le modifiche per la migrazione sopra prima di effettuare il passaggio, poiché alcune strutture di richiesta di Sonnet 5 ora non sono più supportate.

/ 06

Perché la mia richiesta sulla sicurezza è stata rifiutata o ha ricevuto risposta da Sonnet 5?

Sonnet 5.5 è il primo Sonnet a integrare le protezioni di cybersecurity utilizzate sui modelli più avanzati di Anthropic. Alcune richieste a rischio più elevato effettuano il fallback a Sonnet 5 e le attività di sicurezza lecite possono incorrere in più rifiuti. Si tratta di un comportamento upstream.

/ 07

Ho bisogno di un account Anthropic?

No. Una chiave AIReiter funziona con l'endpoint AIReiter e puoi provare il modello nel playground su questa pagina prima di scrivere codice.

/ 08

Quali API sono supportate?

Anthropic Messages su /api/v1/messages è l'interfaccia principale, con supporto per lo streaming. Sono supportate anche le Chat Completions in stile OpenAI e le Responses API, mentre /api/v1/models elenca i modelli disponibili per la tua chiave.