Novità di Claude Haiku 5.5
Anthropic ha rilasciato Claude Haiku 5.5 il 7 ottobre 2026, un anno dopo Haiku 4.5. Il prezzo è sceso del 90% sui prompt brevi e il modello si è avvicinato notevolmente a Sonnet.
Il primo Haiku con controllo dell'effort
Haiku 5.5 utilizza il ragionamento adattivo e cinque livelli di effort: low, medium, high, xhigh e max. L'impostazione predefinita è medium. I modelli Haiku precedenti non disponevano dell'impostazione dell'effort.
Contesto da 1M e output da 128K
La finestra di contesto passa da 200K token su Haiku 4.5 a 1M, e l'output massimo da 64K a 128K. Accetta input di testo e immagini. Il knowledge cutoff è giugno 2026.
Un grande balzo in avanti nelle attività di agenti e lavoro d'ufficio
Al massimo livello di effort Anthropic riporta il 72,4% su OSWorld 2.1 (Haiku 4.5: 15,7%) e un punteggio Elo GDPval-AA di 1620 (Haiku 4.5: 735). Sonnet 5.5 rimane in testa in ogni benchmark pubblicato da Anthropic.
Punteggio indipendente
Artificial Analysis assegna a Haiku 5.5 un punteggio di 43 nel suo Intelligence Index con effort al massimo, rispetto al 17 di Haiku 4.5, e 34 con l'effort predefinito medium.
Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5
Tutti questi modelli funzionano con la stessa chiave AIReiter, quindi per passare da uno all'altro basta modificare il campo model.
Haiku 5.5 vs Haiku 4.5
Haiku 4.5 ha un prezzo di listino di $1 per l'input e $5 per l'output per milione di token. Haiku 5.5 ha un listino di $0,10 e $0,50 per prompt fino a 100K token. Anthropic stima che i carichi di lavoro reali costino circa il 75% in meno tenendo conto del nuovo tokenizer, che produce circa il 30% di token in più a parità di testo.
Haiku 5.5 vs Sonnet 5.5
Sonnet 5.5 costa qui $1,00 in input e $5,00 in output per milione di token, venti volte la tariffa base di Haiku 5.5. Anthropic raccomanda comunque Sonnet 5.5 o Opus 5.5 per il coding complesso. Utilizza Haiku 5.5 per classificazione, estrazione, riassunti, routing e passaggi di subagenti.
Haiku 5.5 vs GPT-6 Luna
Entrambi hanno un prezzo di listino di $0,10 in input e $0,50 in output. Anthropic riporta Haiku 5.5 in vantaggio su OSWorld 2.1 (72,4% vs 48,9%) e GDPval-AA (1620 vs 1437). Artificial Analysis osserva che Haiku 5.5 utilizza più token di output rispetto a Luna per raggiungere punteggi simili, quindi confrontali sulle tue specifiche attività.
Prezzi dell'API Claude Haiku 5.5 su AIReiter
Ogni voce è fatturata al 50% del listino Anthropic. La tariffa dipende da quanti token di input invia una singola richiesta.
Fino a 100K token di input
Input $0,05 (listino $0,10). Output $0,25 (listino $0,50). Letture da cache $0,005 (listino $0,01). Scritture in cache $0,0625 (listino $0,125). Tutti i prezzi si intendono per milione di token.
Oltre 100K token di input: ogni tariffa x5
Input $0,25 (listino $0,50). Output $1,25 (listino $2,50). Letture da cache $0,025 (listino $0,05). Scritture in cache $0,3125 (listino $0,625). Il livello viene determinato per richiesta in base all'input totale, compresi i token memorizzati nella cache, e si applica all'intera richiesta.
Due chiamate reali
50K di input più 5K di output costano qui $0,00375 ($0,0075 da listino). 200K di input più 10K di output rientrano nel livello di contesto lungo e costano qui $0,0625 ($0,125 da listino). Se riesci a suddividere un lavoro lungo in richieste inferiori a 100K, costerà un quinto.
Fatturato sui token effettivamente utilizzati
Una stima viene trattenuta all'avvio della chiamata, poi saldata in base al conteggio effettivo dei token al completamento della risposta, e la differenza viene rimborsata. I token di thinking vengono fatturati come output.
Migrazione da Haiku 4.5: cosa restituisce ora un errore
Modificare la stringa del modello in claude-haiku-5-5 non è sempre sufficiente. Queste strutture di richiesta funzionavano su Haiku 4.5, ma vengono rifiutate su Haiku 5.5.
Rimuovi temperature, top_p e top_k
I valori di campionamento non predefiniti restituiscono 400 con "deprecated for this model". Rimuovi questi campi e orienta l'output tramite il prompt e il livello di effort.
Nessun assistant prefill
Una conversazione che termina con un messaggio dell'assistente restituisce 400. L'ultimo messaggio deve provenire dall'utente. Per forzare un formato, usa output strutturati o indicalo nel prompt.
Sostituisci i budget di thinking con effort
L'API di Anthropic rifiuta thinking: {"type": "enabled", "budget_tokens": N} su questo modello, quindi rimuovilo e imposta invece output_config.effort. I token di thinking vengono comunque sottratti da max_tokens, quindi aumenta max_tokens se le risposte vengono troncate.
La disattivazione del thinking limita effort a high
thinking: {"type": "disabled"} funziona con effort low, medium e high. Con xhigh o max restituisce 400. La modalità di thinking between_tools utilizzata su Sonnet 5.5 non è supportata su Haiku 5.5. Il tool_choice forzato continua a funzionare.
Scegli il livello di effort prima del rilascio
L'effort è il parametro principale per regolare qualità, latenza e costi. Su Haiku 5.5 la differenza tra i livelli è marcata.
I punteggi di riferimento sono a max effort
I dati di lancio comunicati da Anthropic utilizzano max effort. Con l'effort predefinito medium, Anthropic riporta un Elo GDPval-AA di 1277 invece di 1620. Valuta i dati dei benchmark tenendo conto del livello di effort.
max consuma molti token
Artificial Analysis ha misurato circa 162K token di output per task dell'Intelligence Index a max effort, circa tre volte GPT-6 Luna a max. A medium ha misurato circa 137 token di output al secondo.
Inizia da low o medium
Per classificazione, estrazione e routing, low o medium con il thinking disattivato mantengono contenuti latenza e costi. Passa a livelli superiori solo per i task in cui la qualità non è sufficiente.
Come chiamare l'API di Claude Haiku 5.5
L'endpoint supporta il protocollo Messages di Anthropic, quindi per un client Claude esistente servono solo un nuovo base URL e una nuova chiave.
Ottieni una chiave e punta il client su AIReiter
Crea una chiave API nella tua dashboard AIReiter. Negli SDK ufficiali di Anthropic imposta il base URL su https://aireiter.com/api — l'SDK aggiunge /v1/messages automaticamente.
Invia una richiesta con curl
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'
Oppure usa l'SDK Python
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))
FAQ sull'API di Claude Haiku 5.5
/ 01Quando è stato rilasciato Claude Haiku 5.5 e qual è il model ID?
Anthropic lo ha rilasciato il 7 ottobre 2026. Il model ID dell'API è claude-haiku-5-5 e la sua knowledge cutoff è giugno 2026. Anthropic ha dichiarato che non verrà ritirato prima del 7 ottobre 2027.
/ 02Quali sono la finestra di contesto e l'output massimo?
Una finestra di contesto da 1M di token e fino a 128K token di output per richiesta. Accetta input di testo e immagini e restituisce testo.
/ 03Quanto costa l'API di Claude Haiku 5.5?
Anthropic indica $0.10 per l'input e $0.50 per l'output per milione di token per richieste fino a 100K token di input, e cinque volte tanto sopra i 100K. AIReiter applica la metà: $0.05 e $0.25, oppure $0.25 e $1.25 sopra i 100K.
/ 04Perché una richiesta è costata cinque volte di più?
L'input totale ha superato i 100K token, quindi l'intera richiesta è stata tariffata secondo il piano per contesti lunghi. Anche i token in cache concorrono al limite dei 100K.
/ 05Perché le risposte iniziano con un blocco thinking?
L'adaptive thinking è attivo per impostazione predefinita, quindi la risposta può contenere un blocco thinking prima del testo. Leggi i blocchi di contenuto in base al tipo anziché usare content[0], oppure disattiva il thinking a livello di effort low, medium o high.
/ 06Haiku 5.5 è adeguato per il coding?
Per modifiche circoscritte di piccole dimensioni e passaggi per sub-agenti, spesso sì. Per attività complesse su più file, Anthropic consiglia Sonnet 5.5 o Opus 5.5, entrambi accessibili con la stessa chiave.
/ 07Ho bisogno di un account Anthropic?
No. Una chiave AIReiter funziona con l'endpoint AIReiter e puoi provare il modello nel playground su questa pagina prima di scrivere codice.
/ 08Quali API sono supportate?
Anthropic Messages su /api/v1/messages è l'interfaccia principale, con supporto per lo streaming. Sono supportate anche le Chat Completions in stile OpenAI e le Responses API, mentre /api/v1/models elenca i modelli disponibili per la tua chiave.