AIREITER
AnthropicText Chat

Claude Sonnet 5.5

API de Claude Sonnet 5.5 a mitad de precio de lista de Anthropic: $1 de entrada, $5 de salida por 1M de tokens. Cambios respecto a Sonnet 5, benchmarks, breaking changes y código funcional.

EntradaOficial $2.00 por 1 M de tokensAIReiter $1.00 por 1 M de tokensSalidaOficial $10.00 por 1 M de tokensAIReiter $5.00 por 1 M de tokensLectura de cachéOficial $0.20 por 1 M de tokensAIReiter $0.10 por 1 M de tokensCreación de cachéOficial $2.50 por 1 M de tokensAIReiter $1.25 por 1 M de tokens
Ejecutar con API

ENTRADA

SALIDA

Example
Generated in
42.7 seconds
Token de entrada
134
Token de salida
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Detalles del modelo

Usa la misma clave de modelo en Playground, solicitudes API y flujos de trabajo internos.

ID del modelo
claude-sonnet-5-5
Proveedor
Anthropic
Protocolo
Anthropic Messages
Ventana de contexto
1,000,000 tokens
Salida máxima
128,000 tokens
Token de entrada
100 créditos / 1 M de tokens
Token de salida
500 créditos / 1 M de tokens
Lectura de caché
10 créditos / 1 M de tokens
Escritura de caché
125 créditos / 1 M de tokens

Novedades en Claude Sonnet 5.5

Anthropic lanzó Claude Sonnet 5.5 el 28 de septiembre de 2026 como una actualización directa de Sonnet 5. El precio de lista no cambió; lo que sí cambió fue el trabajo que puede realizar y cuántos tokens consume al hacerlo.

Cerca de Opus 5.5 en trabajo de conocimiento

Anthropic reporta una puntuación GDPval-AA de 1844 para Sonnet 5.5, dos puntos por detrás de Opus 5.5 (1846) y unos 400 puntos por delante de Sonnet 5 (1449). Anthropic también señala que Opus 5.5 sigue siendo claramente superior en tareas abiertas que requieren un juicio sostenido.

Un gran avance en programación

En CursorBench 4.0, Anthropic reporta un 55.5% para Sonnet 5.5, frente al 34.1% de Sonnet 5 y el 57.8% de Opus 5.5. Anthropic lo posiciona para el trabajo diario bien delimitado: desarrollo de funcionalidades, corrección de errores y creación de documentos, diapositivas y hojas de cálculo.

Menos tokens para la misma tarea

Los primeros clientes reportaron ahorros en sus propias cargas de trabajo: Slack observó alrededor de un 14% menos de tokens de salida sin modificar los prompts, y Balyasny Asset Management midió aproximadamente 121K tokens por respuesta frente a 497K en Sonnet 5 en 2,441 tareas financieras.

Salida más rápida, mismo tokenizer

Anthropic afirma que la salida es más de un 30% más rápida que en Sonnet 5; Artificial Analysis midió unos 139 tokens de salida por segundo. El tokenizer no ha cambiado, por lo que el mismo texto cuenta como el mismo número de tokens en ambos modelos.

Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5

Los tres funcionan con la misma clave de AIReiter. En resumen: migre desde Sonnet 5 una vez que sus solicitudes superen las comprobaciones de migración a continuación, y reserve Opus 5.5 para el trabajo abierto más complejo.

Sonnet 5.5 vs Sonnet 5: mismo precio, más resultados

Ambos tienen un precio de lista de $2 de entrada y $10 de salida por millón de tokens. Sonnet 5.5 obtiene puntuaciones más altas en los benchmarks anteriores de código y trabajo de conocimiento, y suele terminar con menos tokens, por lo que la misma tarea suele costar menos.

Sonnet 5.5 vs Opus 5.5: a mitad de precio

Aquí, Sonnet 5.5 cuesta $1.00 de entrada y $5.00 de salida por millón de tokens; Opus 5.5 cuesta $2.00 y $10.00. Ambos tienen una ventana de contexto de 1M de tokens y 128K de salida máxima, por lo que cambiar solo requiere modificar el campo model y nada más.

Cuándo sigue valiendo la pena Opus 5.5

En tareas largas y ambiguas donde el modelo debe planificar, detectar sus propios errores y seguir adelante. Base44 reportó 3.6 iteraciones por compilación de aplicación en Sonnet 5.5 frente a 7.7 en Opus 5, por lo que se recomienda probar Sonnet 5.5 primero y escalar únicamente las tareas que fallen.

Cuándo conviene quedarse en Sonnet 5 por ahora

Si su código desactiva thinking, fuerza una herramienta específica o define temperature, esas solicitudes fallarán en Sonnet 5.5 hasta que las modifique. Las herramientas de seguridad también pueden registrar más rechazos. Corrija esto primero y luego realice el cambio.

Migración desde Sonnet 5: qué devuelve ahora un error

Cambiar la cadena del modelo a claude-sonnet-5-5 no siempre es suficiente. Estas estructuras de solicitud funcionaban en Sonnet 5 y son rechazadas por Sonnet 5.5.

thinking: disabled devuelve 400

El thinking adaptativo está siempre activado. Reemplace {"type": "disabled"} por {"type": "between_tools"}, el nivel más bajo, que omite el thinking antes de la primera respuesta. between_tools solo funciona con un nivel de effort low, medium o high; para xhigh o max, omita thinking o envíe {"type": "adaptive"}.

Los presupuestos manuales de thinking devuelven 400

thinking: {"type": "enabled", "budget_tokens": N} es rechazado. En su lugar, controle la profundidad con el nivel de effort. Los tokens de thinking siguen descontándose de max_tokens y se facturan como salida, así que aumente max_tokens si las respuestas empiezan a cortarse.

La selección forzada de herramientas es rechazada

Un tool_choice que fuerce una herramienta específica ahora produce un error. Use la selección automática de herramientas con definiciones estrictas y deje que el modelo decida cuándo llamarlas.

Valores personalizados de temperature, top_p y top_k devuelven 400

Solo se acepta el muestreo por defecto. Elimine estos campos de la solicitud en lugar de fijarles valores constantes. Un cambio a su favor: el prompt mínimo almacenable en caché se reduce de 1,024 a 512 tokens.

Elige el nivel de esfuerzo antes de pasar a producción

El esfuerzo es ahora el control principal para el costo y la latencia. Hay cinco niveles: low, medium, high, xhigh y max.

El valor predeterminado de la API es high

Si no envías effort, la API se ejecuta en high. Claude Code y las aplicaciones de Claude usan medium por defecto. Configura output_config.effort explícitamente para que tu factura no dependa de un valor predeterminado.

max es costoso

Con un esfuerzo max, Artificial Analysis midió $7.60 por tarea a precio de lista y 410M de tokens de salida en todo su índice, frente a una mediana de 88M. Las afirmaciones de eficiencia de Anthropic corresponden a los niveles inferiores, no a max.

Comienza en medium, mide y luego ajusta

Ejecuta tus tareas reales en medium, verifica la calidad y sube de nivel solo donde sea insuficiente. Para bucles de herramientas sensibles a la latencia, low o medium con el pensamiento between_tools mantiene las primeras respuestas rápidas.

Precios de la API de Claude Sonnet 5.5 en AIReiter

Cada línea se factura al 50% del precio de lista de Anthropic. El mismo modelo, el mismo protocolo Messages.

La mitad del precio de lista en cada línea

Entrada $1.00 (lista $2.00). Salida $5.00 (lista $10.00). Lecturas de caché $0.10 (lista $0.20). Escrituras de caché $1.25 (lista $2.50). Todo por millón de tokens.

Una llamada real: $1.50 en lugar de $3.00

Un millón de tokens de entrada más cien mil tokens de salida cuestan $1.50 aquí y $3.00 al precio de lista de Anthropic. La misma llamada en Opus 5.5 aquí cuesta $3.00.

Facturación por tokens realmente utilizados

Se retiene una estimación al iniciar la llamada, luego se liquida según el recuento real de tokens cuando se completa la respuesta y se devuelve la diferencia. La tarifa es la misma desde el primer token hasta el millonésimo; no hay un nivel de contexto largo.

Cómo llamar a la API de Claude Sonnet 5.5

El endpoint utiliza el protocolo Messages de Anthropic, por lo que un cliente de Claude existente solo necesita una nueva URL base y una clave.

01

Obtén una clave y apunta el cliente a AIReiter

Crea una clave de API en tu panel de AIReiter. En los SDKs oficiales de Anthropic, establece la URL base en https://aireiter.com/api; el SDK añade /v1/messages automáticamente.

02

Envía una solicitud con curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

O usa el SDK de Python

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

Preguntas frecuentes sobre la API de Claude Sonnet 5.5

/ 01

¿Cuándo se lanzó Claude Sonnet 5.5 y cuál es el ID del modelo?

Anthropic lo lanzó el 28 de septiembre de 2026. El ID del modelo para la API es claude-sonnet-5-5 y su fecha de corte de conocimiento es junio de 2026.

/ 02

¿Cuál es la ventana de contexto y la salida máxima?

Una ventana de contexto de 1M de tokens y hasta 128K tokens de salida por solicitud. Acepta entradas de texto e imagen y devuelve texto.

/ 03

¿Cuánto cuesta la API de Claude Sonnet 5.5?

Anthropic lista $2 por entrada y $10 por salida por millón de tokens, lo mismo que Sonnet 5. AIReiter cobra la mitad: $1 por entrada, $5 por salida, $0.10 por lecturas de caché y $1.25 por escrituras de caché.

/ 04

¿Puedo desactivar el razonamiento?

No del todo. thinking disabled devuelve un error 400. La configuración más baja es between_tools, que funciona con esfuerzo bajo, medio y alto.

/ 05

¿Es Sonnet 5.5 mejor que Sonnet 5?

Según los benchmarks de programación y tareas de conocimiento reportados por Anthropic, sí, por un amplio margen y al mismo precio de lista. Revisa los cambios de migración anteriores antes de cambiar, ya que algunas estructuras de solicitud de Sonnet 5 ahora fallan.

/ 06

¿Por qué se rechazó mi pregunta de seguridad o fue respondida por Sonnet 5?

Sonnet 5.5 es el primer Sonnet que incorpora las salvaguardas de ciberseguridad utilizadas en los modelos más capaces de Anthropic. Algunas solicitudes de mayor riesgo recurren a Sonnet 5, y las tareas de seguridad benignas pueden experimentar más rechazos. Este es un comportamiento upstream.

/ 07

¿Necesito una cuenta de Anthropic?

No. Una clave de AIReiter funciona con el endpoint de AIReiter, y puedes probar el modelo en el playground de esta página antes de escribir código.

/ 08

¿Qué APIs son compatibles?

Anthropic Messages en /api/v1/messages es el contrato principal, con streaming. También se admiten Chat Completions al estilo de OpenAI y la Responses API, y /api/v1/models lista los modelos disponibles para tu clave.