AIREITER
AnthropicText Chat

Claude Haiku 5.5

API Claude Haiku 5.5 a metà del listino Anthropic: $0,05 in input, $0,25 in output per 1M di token fino a 100K di input. Livello per contesto lungo, modifiche sostanziali rispetto a Haiku 4.5, codice funzionante.

Token inputInputOutputLettura cacheCreazione cache
≤ 100,000$0.05 per 1 M di token$0.25 per 1 M di token$0.005 per 1 M di token$0.0625 per 1 M di token
> 100,000$0.25 per 1 M di token$1.25 per 1 M di token$0.025 per 1 M di token$0.3125 per 1 M di token

Prezzi per milione di token. La fascia si applica all’intera richiesta in base ai token di input totali, incluse letture e scritture nella cache.

Esegui con API

INPUT

OUTPUT

Example
Generated in
42.7 seconds
Token input
134
Token output
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Dettagli del modello

Usa la stessa chiave del modello nel Playground, nelle richieste API e nei flussi di lavoro interni.

ID modello
claude-haiku-5-5
Provider
Anthropic
Protocollo
Anthropic Messages
Finestra di contesto
1,000,000 token
Output massimo
128,000 token

Novità di Claude Haiku 5.5

Anthropic ha rilasciato Claude Haiku 5.5 il 7 ottobre 2026, un anno dopo Haiku 4.5. Il prezzo è sceso del 90% sui prompt brevi e il modello si è avvicinato notevolmente a Sonnet.

Il primo Haiku con controllo dell'effort

Haiku 5.5 utilizza il ragionamento adattivo e cinque livelli di effort: low, medium, high, xhigh e max. L'impostazione predefinita è medium. I modelli Haiku precedenti non disponevano dell'impostazione dell'effort.

Contesto da 1M e output da 128K

La finestra di contesto passa da 200K token su Haiku 4.5 a 1M, e l'output massimo da 64K a 128K. Accetta input di testo e immagini. Il knowledge cutoff è giugno 2026.

Un grande balzo in avanti nelle attività di agenti e lavoro d'ufficio

Al massimo livello di effort Anthropic riporta il 72,4% su OSWorld 2.1 (Haiku 4.5: 15,7%) e un punteggio Elo GDPval-AA di 1620 (Haiku 4.5: 735). Sonnet 5.5 rimane in testa in ogni benchmark pubblicato da Anthropic.

Punteggio indipendente

Artificial Analysis assegna a Haiku 5.5 un punteggio di 43 nel suo Intelligence Index con effort al massimo, rispetto al 17 di Haiku 4.5, e 34 con l'effort predefinito medium.

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

Tutti questi modelli funzionano con la stessa chiave AIReiter, quindi per passare da uno all'altro basta modificare il campo model.

Haiku 5.5 vs Haiku 4.5

Haiku 4.5 ha un prezzo di listino di $1 per l'input e $5 per l'output per milione di token. Haiku 5.5 ha un listino di $0,10 e $0,50 per prompt fino a 100K token. Anthropic stima che i carichi di lavoro reali costino circa il 75% in meno tenendo conto del nuovo tokenizer, che produce circa il 30% di token in più a parità di testo.

Haiku 5.5 vs Sonnet 5.5

Sonnet 5.5 costa qui $1,00 in input e $5,00 in output per milione di token, venti volte la tariffa base di Haiku 5.5. Anthropic raccomanda comunque Sonnet 5.5 o Opus 5.5 per il coding complesso. Utilizza Haiku 5.5 per classificazione, estrazione, riassunti, routing e passaggi di subagenti.

Haiku 5.5 vs GPT-6 Luna

Entrambi hanno un prezzo di listino di $0,10 in input e $0,50 in output. Anthropic riporta Haiku 5.5 in vantaggio su OSWorld 2.1 (72,4% vs 48,9%) e GDPval-AA (1620 vs 1437). Artificial Analysis osserva che Haiku 5.5 utilizza più token di output rispetto a Luna per raggiungere punteggi simili, quindi confrontali sulle tue specifiche attività.

Prezzi dell'API Claude Haiku 5.5 su AIReiter

Ogni voce è fatturata al 50% del listino Anthropic. La tariffa dipende da quanti token di input invia una singola richiesta.

Fino a 100K token di input

Input $0,05 (listino $0,10). Output $0,25 (listino $0,50). Letture da cache $0,005 (listino $0,01). Scritture in cache $0,0625 (listino $0,125). Tutti i prezzi si intendono per milione di token.

Oltre 100K token di input: ogni tariffa x5

Input $0,25 (listino $0,50). Output $1,25 (listino $2,50). Letture da cache $0,025 (listino $0,05). Scritture in cache $0,3125 (listino $0,625). Il livello viene determinato per richiesta in base all'input totale, compresi i token memorizzati nella cache, e si applica all'intera richiesta.

Due chiamate reali

50K di input più 5K di output costano qui $0,00375 ($0,0075 da listino). 200K di input più 10K di output rientrano nel livello di contesto lungo e costano qui $0,0625 ($0,125 da listino). Se riesci a suddividere un lavoro lungo in richieste inferiori a 100K, costerà un quinto.

Fatturato sui token effettivamente utilizzati

Una stima viene trattenuta all'avvio della chiamata, poi saldata in base al conteggio effettivo dei token al completamento della risposta, e la differenza viene rimborsata. I token di thinking vengono fatturati come output.

Migrazione da Haiku 4.5: cosa restituisce ora un errore

Modificare la stringa del modello in claude-haiku-5-5 non è sempre sufficiente. Queste strutture di richiesta funzionavano su Haiku 4.5, ma vengono rifiutate su Haiku 5.5.

Rimuovi temperature, top_p e top_k

I valori di campionamento non predefiniti restituiscono 400 con "deprecated for this model". Rimuovi questi campi e orienta l'output tramite il prompt e il livello di effort.

Nessun assistant prefill

Una conversazione che termina con un messaggio dell'assistente restituisce 400. L'ultimo messaggio deve provenire dall'utente. Per forzare un formato, usa output strutturati o indicalo nel prompt.

Sostituisci i budget di thinking con effort

L'API di Anthropic rifiuta thinking: {"type": "enabled", "budget_tokens": N} su questo modello, quindi rimuovilo e imposta invece output_config.effort. I token di thinking vengono comunque sottratti da max_tokens, quindi aumenta max_tokens se le risposte vengono troncate.

La disattivazione del thinking limita effort a high

thinking: {"type": "disabled"} funziona con effort low, medium e high. Con xhigh o max restituisce 400. La modalità di thinking between_tools utilizzata su Sonnet 5.5 non è supportata su Haiku 5.5. Il tool_choice forzato continua a funzionare.

Scegli il livello di effort prima del rilascio

L'effort è il parametro principale per regolare qualità, latenza e costi. Su Haiku 5.5 la differenza tra i livelli è marcata.

I punteggi di riferimento sono a max effort

I dati di lancio comunicati da Anthropic utilizzano max effort. Con l'effort predefinito medium, Anthropic riporta un Elo GDPval-AA di 1277 invece di 1620. Valuta i dati dei benchmark tenendo conto del livello di effort.

max consuma molti token

Artificial Analysis ha misurato circa 162K token di output per task dell'Intelligence Index a max effort, circa tre volte GPT-6 Luna a max. A medium ha misurato circa 137 token di output al secondo.

Inizia da low o medium

Per classificazione, estrazione e routing, low o medium con il thinking disattivato mantengono contenuti latenza e costi. Passa a livelli superiori solo per i task in cui la qualità non è sufficiente.

Come chiamare l'API di Claude Haiku 5.5

L'endpoint supporta il protocollo Messages di Anthropic, quindi per un client Claude esistente servono solo un nuovo base URL e una nuova chiave.

01

Ottieni una chiave e punta il client su AIReiter

Crea una chiave API nella tua dashboard AIReiter. Negli SDK ufficiali di Anthropic imposta il base URL su https://aireiter.com/api — l'SDK aggiunge /v1/messages automaticamente.

02

Invia una richiesta con curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

Oppure usa l'SDK Python

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))

FAQ sull'API di Claude Haiku 5.5

/ 01

Quando è stato rilasciato Claude Haiku 5.5 e qual è il model ID?

Anthropic lo ha rilasciato il 7 ottobre 2026. Il model ID dell'API è claude-haiku-5-5 e la sua knowledge cutoff è giugno 2026. Anthropic ha dichiarato che non verrà ritirato prima del 7 ottobre 2027.

/ 02

Quali sono la finestra di contesto e l'output massimo?

Una finestra di contesto da 1M di token e fino a 128K token di output per richiesta. Accetta input di testo e immagini e restituisce testo.

/ 03

Quanto costa l'API di Claude Haiku 5.5?

Anthropic indica $0.10 per l'input e $0.50 per l'output per milione di token per richieste fino a 100K token di input, e cinque volte tanto sopra i 100K. AIReiter applica la metà: $0.05 e $0.25, oppure $0.25 e $1.25 sopra i 100K.

/ 04

Perché una richiesta è costata cinque volte di più?

L'input totale ha superato i 100K token, quindi l'intera richiesta è stata tariffata secondo il piano per contesti lunghi. Anche i token in cache concorrono al limite dei 100K.

/ 05

Perché le risposte iniziano con un blocco thinking?

L'adaptive thinking è attivo per impostazione predefinita, quindi la risposta può contenere un blocco thinking prima del testo. Leggi i blocchi di contenuto in base al tipo anziché usare content[0], oppure disattiva il thinking a livello di effort low, medium o high.

/ 06

Haiku 5.5 è adeguato per il coding?

Per modifiche circoscritte di piccole dimensioni e passaggi per sub-agenti, spesso sì. Per attività complesse su più file, Anthropic consiglia Sonnet 5.5 o Opus 5.5, entrambi accessibili con la stessa chiave.

/ 07

Ho bisogno di un account Anthropic?

No. Una chiave AIReiter funziona con l'endpoint AIReiter e puoi provare il modello nel playground su questa pagina prima di scrivere codice.

/ 08

Quali API sono supportate?

Anthropic Messages su /api/v1/messages è l'interfaccia principale, con supporto per lo streaming. Sono supportate anche le Chat Completions in stile OpenAI e le Responses API, mentre /api/v1/models elenca i modelli disponibili per la tua chiave.