AIREITER
AnthropicText Chat

Claude Haiku 5.5

Claude Haiku 5.5 API a mitad del precio de lista de Anthropic: $0.05 entrada, $0.25 salida por 1M de tokens hasta 100K de entrada. Nivel de contexto largo, cambios importantes respecto a Haiku 4.5, código funcional.

Token de entradaEntradaSalidaLectura de cachéCreación de caché
≤ 100,000$0.05 por 1 M de tokens$0.25 por 1 M de tokens$0.005 por 1 M de tokens$0.0625 por 1 M de tokens
> 100,000$0.25 por 1 M de tokens$1.25 por 1 M de tokens$0.025 por 1 M de tokens$0.3125 por 1 M de tokens

Precios por millón de tokens. El nivel se aplica a toda la solicitud según los tokens de entrada totales, incluidos los de lectura y escritura en caché.

Ejecutar con API

ENTRADA

SALIDA

Example
Generated in
42.7 seconds
Token de entrada
134
Token de salida
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Detalles del modelo

Usa la misma clave de modelo en Playground, solicitudes API y flujos de trabajo internos.

ID del modelo
claude-haiku-5-5
Proveedor
Anthropic
Protocolo
Anthropic Messages
Ventana de contexto
1,000,000 tokens
Salida máxima
128,000 tokens

Novedades de Claude Haiku 5.5

Anthropic lanzó Claude Haiku 5.5 el 7 de octubre de 2026, un año después de Haiku 4.5. El precio se redujo un 90% en prompts cortos y el modelo se acercó mucho más a Sonnet.

El primer Haiku con control de esfuerzo

Haiku 5.5 utiliza pensamiento adaptativo y cinco niveles de esfuerzo: low, medium, high, xhigh y max. El valor predeterminado es medium. Los modelos Haiku anteriores no tenían ajuste de esfuerzo.

1M de contexto y 128K de salida

La ventana de contexto aumenta de 200K tokens en Haiku 4.5 a 1M, y la salida máxima de 64K a 128K. Acepta entradas de texto e imagen. La fecha límite de conocimiento es junio de 2026.

Un gran salto en tareas de agentes y trabajo de oficina

Con el esfuerzo max, Anthropic reporta un 72.4% en OSWorld 2.1 (Haiku 4.5: 15.7%) y un Elo GDPval-AA de 1620 (Haiku 4.5: 735). Sonnet 5.5 sigue liderando en todos los benchmarks publicados por Anthropic.

Puntuación independiente

Artificial Analysis otorga a Haiku 5.5 una puntuación de 43 en su Intelligence Index con esfuerzo max, frente a 17 de Haiku 4.5, y 34 con el esfuerzo medium predeterminado.

Claude Haiku 5.5 vs Haiku 4.5 vs Sonnet 5.5

Todos estos se ejecutan con la misma clave de AIReiter, por lo que cambiar entre ellos solo requiere modificar el campo model.

Haiku 5.5 vs Haiku 4.5

Haiku 4.5 tiene un precio de lista de $1 por entrada y $5 por salida por millón de tokens. Haiku 5.5 tiene un precio de lista de $0.10 y $0.50 para prompts de hasta 100K tokens. Anthropic calcula que las cargas de trabajo reales cuestan alrededor de un 75% menos teniendo en cuenta el nuevo tokenizador, que produce aproximadamente un 30% más de tokens para el mismo texto.

Haiku 5.5 vs Sonnet 5.5

Sonnet 5.5 cuesta aquí $1.00 de entrada y $5.00 de salida por millón de tokens, veinte veces la tarifa base de Haiku 5.5. Anthropic aún recomienda Sonnet 5.5 u Opus 5.5 para código complejo. Utilice Haiku 5.5 para clasificación, extracción, resúmenes, enrutamiento y pasos de subagentes.

Haiku 5.5 vs GPT-6 Luna

Ambos tienen un precio de lista de $0.10 de entrada y $0.50 de salida. Anthropic informa que Haiku 5.5 está por delante en OSWorld 2.1 (72.4% vs 48.9%) y GDPval-AA (1620 vs 1437). Artificial Analysis señala que Haiku 5.5 utiliza más tokens de salida que Luna para alcanzar puntuaciones similares, por lo que compare en sus propias tareas.

Precios de la API Claude Haiku 5.5 en AIReiter

Cada línea se factura al 50% del precio de lista de Anthropic. La tarifa depende de cuántos tokens de entrada envíe una sola solicitud.

Hasta 100K tokens de entrada

Entrada $0.05 (lista $0.10). Salida $0.25 (lista $0.50). Lecturas de caché $0.005 (lista $0.01). Escrituras en caché $0.0625 (lista $0.125). Todo por millón de tokens.

Más de 100K tokens de entrada: todas las tarifas x5

Entrada $0.25 (lista $0.50). Salida $1.25 (lista $2.50). Lecturas de caché $0.025 (lista $0.05). Escrituras en caché $0.3125 (lista $0.625). El nivel se decide por solicitud según la entrada total, incluidos los tokens en caché, y se aplica a toda la solicitud.

Dos llamadas reales

50K de entrada más 5K de salida cuesta $0.00375 aquí ($0.0075 en lista). 200K de entrada más 10K de salida entra en el nivel de contexto largo y cuesta $0.0625 aquí ($0.125 en lista). Si puede dividir una tarea larga en solicitudes de menos de 100K, cuesta una quinta parte.

Facturación por tokens realmente utilizados

Se retiene una estimación cuando comienza la llamada y luego se liquida con el recuento real de tokens cuando se completa la respuesta, devolviéndose la diferencia. Los tokens de pensamiento se facturan como salida.

Migración desde Haiku 4.5: qué devuelve error ahora

Cambiar la cadena del modelo a claude-haiku-5-5 no siempre es suficiente. Estas estructuras de solicitud funcionaban en Haiku 4.5 y ahora son rechazadas en Haiku 5.5.

Omitir temperature, top_p y top_k

Los valores de muestreo no predeterminados devuelven 400 con «deprecated for this model». Elimine estos campos y oriente la salida con el prompt y el nivel de effort.

Sin prefill del asistente

Una conversación que termina con un mensaje del asistente devuelve 400. El último mensaje debe ser del usuario. Para forzar un formato, use salidas estructuradas o indíquelo en el prompt.

Reemplace los presupuestos de thinking por effort

La API de Anthropic rechaza thinking: {"type": "enabled", "budget_tokens": N} en este modelo, así que elimínelo y configure output_config.effort en su lugar. Los tokens de thinking siguen descontándose de max_tokens, así que aumente max_tokens si las respuestas se cortan.

Desactivar thinking limita effort a high

thinking: {"type": "disabled"} funciona con effort low, medium y high. Con xhigh o max devuelve 400. El modo de thinking between_tools utilizado en Sonnet 5.5 no es compatible con Haiku 5.5. El tool_choice forzado sigue funcionando.

Elige el nivel de esfuerzo antes de pasar a producción

Effort es el control principal para la calidad, la latencia y el coste. En Haiku 5.5, la diferencia entre niveles es grande.

Las puntuaciones destacadas se obtienen con max effort

Las cifras de lanzamiento de Anthropic utilizan max effort. En el nivel predeterminado medium de effort, Anthropic reporta un Elo GDPval-AA de 1277 en lugar de 1620. Lea las afirmaciones de los benchmarks teniendo en cuenta el nivel de effort.

max consume muchos tokens

Artificial Analysis midió cerca de 162K tokens de salida por tarea de Intelligence Index con max effort, aproximadamente el triple que GPT-6 Luna en max. En medium midió unos 137 tokens de salida por segundo.

Comience en low o medium

Para tareas de clasificación, extracción y enrutamiento, low o medium con thinking desactivado mantiene reducidos la latencia y el coste. Suba de nivel solo en las tareas donde la calidad no sea suficiente.

Cómo llamar a la API de Claude Haiku 5.5

El endpoint utiliza el protocolo Messages de Anthropic, por lo que un cliente de Claude existente solo necesita una nueva URL base y una clave.

01

Obtén una clave y apunta el cliente a AIReiter

Crea una clave de API en tu panel de AIReiter. En los SDKs oficiales de Anthropic, establece la URL base en https://aireiter.com/api; el SDK añade /v1/messages automáticamente.

02

Envía una solicitud con curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

O usa el SDK de Python

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))

Preguntas frecuentes sobre la API de Claude Haiku 5.5

/ 01

¿Cuándo se lanzó Claude Haiku 5.5 y cuál es el model ID?

Anthropic lo lanzó el 7 de octubre de 2026. El model ID de la API es claude-haiku-5-5 y su fecha de corte de conocimiento es junio de 2026. Anthropic indica que no será retirado antes del 7 de octubre de 2027.

/ 02

¿Cuál es la ventana de contexto y la salida máxima?

Una ventana de contexto de 1M de tokens y hasta 128K tokens de salida por solicitud. Acepta entradas de texto e imagen y devuelve texto.

/ 03

¿Cuánto cuesta la API de Claude Haiku 5.5?

Anthropic establece $0.10 de entrada y $0.50 de salida por millón de tokens para solicitudes de hasta 100K tokens de entrada, y cinco veces más por encima de 100K. AIReiter cobra la mitad: $0.05 y $0.25, o $0.25 y $1.25 por encima de 100K.

/ 04

¿Por qué una solicitud costó cinco veces más?

Su entrada total superó los 100K tokens, por lo que toda la solicitud se facturó con la tarifa de contexto largo. Los tokens en caché también cuentan para el límite de 100K.

/ 05

¿Por qué mis respuestas comienzan con un bloque de thinking?

El thinking adaptativo está activado por defecto, por lo que la respuesta puede contener un bloque de thinking antes del texto. Lea los bloques de contenido por tipo en lugar de tomar content[0], o desactive thinking en niveles de effort low, medium o high.

/ 06

¿Es Haiku 5.5 lo suficientemente bueno para programar?

Para ediciones pequeñas y bien delimitadas o pasos de subagentes, a menudo sí. Para tareas complejas con múltiples archivos, Anthropic recomienda Sonnet 5.5 u Opus 5.5, ambos disponibles con la misma API key.

/ 07

¿Necesito una cuenta de Anthropic?

No. Una clave de AIReiter funciona con el endpoint de AIReiter, y puedes probar el modelo en el playground de esta página antes de escribir código.

/ 08

¿Qué APIs son compatibles?

Anthropic Messages en /api/v1/messages es el contrato principal, con streaming. También se admiten Chat Completions al estilo de OpenAI y la Responses API, y /api/v1/models lista los modelos disponibles para tu clave.