Novedades en Claude Sonnet 5.5
Anthropic lanzó Claude Sonnet 5.5 el 28 de septiembre de 2026 como una actualización directa de Sonnet 5. El precio de lista no cambió; lo que sí cambió fue el trabajo que puede realizar y cuántos tokens consume al hacerlo.
Cerca de Opus 5.5 en trabajo de conocimiento
Anthropic reporta una puntuación GDPval-AA de 1844 para Sonnet 5.5, dos puntos por detrás de Opus 5.5 (1846) y unos 400 puntos por delante de Sonnet 5 (1449). Anthropic también señala que Opus 5.5 sigue siendo claramente superior en tareas abiertas que requieren un juicio sostenido.
Un gran avance en programación
En CursorBench 4.0, Anthropic reporta un 55.5% para Sonnet 5.5, frente al 34.1% de Sonnet 5 y el 57.8% de Opus 5.5. Anthropic lo posiciona para el trabajo diario bien delimitado: desarrollo de funcionalidades, corrección de errores y creación de documentos, diapositivas y hojas de cálculo.
Menos tokens para la misma tarea
Los primeros clientes reportaron ahorros en sus propias cargas de trabajo: Slack observó alrededor de un 14% menos de tokens de salida sin modificar los prompts, y Balyasny Asset Management midió aproximadamente 121K tokens por respuesta frente a 497K en Sonnet 5 en 2,441 tareas financieras.
Salida más rápida, mismo tokenizer
Anthropic afirma que la salida es más de un 30% más rápida que en Sonnet 5; Artificial Analysis midió unos 139 tokens de salida por segundo. El tokenizer no ha cambiado, por lo que el mismo texto cuenta como el mismo número de tokens en ambos modelos.
Claude Sonnet 5.5 vs Sonnet 5 vs Opus 5.5
Los tres funcionan con la misma clave de AIReiter. En resumen: migre desde Sonnet 5 una vez que sus solicitudes superen las comprobaciones de migración a continuación, y reserve Opus 5.5 para el trabajo abierto más complejo.
Sonnet 5.5 vs Sonnet 5: mismo precio, más resultados
Ambos tienen un precio de lista de $2 de entrada y $10 de salida por millón de tokens. Sonnet 5.5 obtiene puntuaciones más altas en los benchmarks anteriores de código y trabajo de conocimiento, y suele terminar con menos tokens, por lo que la misma tarea suele costar menos.
Sonnet 5.5 vs Opus 5.5: a mitad de precio
Aquí, Sonnet 5.5 cuesta $1.00 de entrada y $5.00 de salida por millón de tokens; Opus 5.5 cuesta $2.00 y $10.00. Ambos tienen una ventana de contexto de 1M de tokens y 128K de salida máxima, por lo que cambiar solo requiere modificar el campo model y nada más.
Cuándo sigue valiendo la pena Opus 5.5
En tareas largas y ambiguas donde el modelo debe planificar, detectar sus propios errores y seguir adelante. Base44 reportó 3.6 iteraciones por compilación de aplicación en Sonnet 5.5 frente a 7.7 en Opus 5, por lo que se recomienda probar Sonnet 5.5 primero y escalar únicamente las tareas que fallen.
Cuándo conviene quedarse en Sonnet 5 por ahora
Si su código desactiva thinking, fuerza una herramienta específica o define temperature, esas solicitudes fallarán en Sonnet 5.5 hasta que las modifique. Las herramientas de seguridad también pueden registrar más rechazos. Corrija esto primero y luego realice el cambio.
Migración desde Sonnet 5: qué devuelve ahora un error
Cambiar la cadena del modelo a claude-sonnet-5-5 no siempre es suficiente. Estas estructuras de solicitud funcionaban en Sonnet 5 y son rechazadas por Sonnet 5.5.
thinking: disabled devuelve 400
El thinking adaptativo está siempre activado. Reemplace {"type": "disabled"} por {"type": "between_tools"}, el nivel más bajo, que omite el thinking antes de la primera respuesta. between_tools solo funciona con un nivel de effort low, medium o high; para xhigh o max, omita thinking o envíe {"type": "adaptive"}.
Los presupuestos manuales de thinking devuelven 400
thinking: {"type": "enabled", "budget_tokens": N} es rechazado. En su lugar, controle la profundidad con el nivel de effort. Los tokens de thinking siguen descontándose de max_tokens y se facturan como salida, así que aumente max_tokens si las respuestas empiezan a cortarse.
La selección forzada de herramientas es rechazada
Un tool_choice que fuerce una herramienta específica ahora produce un error. Use la selección automática de herramientas con definiciones estrictas y deje que el modelo decida cuándo llamarlas.
Valores personalizados de temperature, top_p y top_k devuelven 400
Solo se acepta el muestreo por defecto. Elimine estos campos de la solicitud en lugar de fijarles valores constantes. Un cambio a su favor: el prompt mínimo almacenable en caché se reduce de 1,024 a 512 tokens.
Elige el nivel de esfuerzo antes de pasar a producción
El esfuerzo es ahora el control principal para el costo y la latencia. Hay cinco niveles: low, medium, high, xhigh y max.
El valor predeterminado de la API es high
Si no envías effort, la API se ejecuta en high. Claude Code y las aplicaciones de Claude usan medium por defecto. Configura output_config.effort explícitamente para que tu factura no dependa de un valor predeterminado.
max es costoso
Con un esfuerzo max, Artificial Analysis midió $7.60 por tarea a precio de lista y 410M de tokens de salida en todo su índice, frente a una mediana de 88M. Las afirmaciones de eficiencia de Anthropic corresponden a los niveles inferiores, no a max.
Comienza en medium, mide y luego ajusta
Ejecuta tus tareas reales en medium, verifica la calidad y sube de nivel solo donde sea insuficiente. Para bucles de herramientas sensibles a la latencia, low o medium con el pensamiento between_tools mantiene las primeras respuestas rápidas.
Precios de la API de Claude Sonnet 5.5 en AIReiter
Cada línea se factura al 50% del precio de lista de Anthropic. El mismo modelo, el mismo protocolo Messages.
La mitad del precio de lista en cada línea
Entrada $1.00 (lista $2.00). Salida $5.00 (lista $10.00). Lecturas de caché $0.10 (lista $0.20). Escrituras de caché $1.25 (lista $2.50). Todo por millón de tokens.
Una llamada real: $1.50 en lugar de $3.00
Un millón de tokens de entrada más cien mil tokens de salida cuestan $1.50 aquí y $3.00 al precio de lista de Anthropic. La misma llamada en Opus 5.5 aquí cuesta $3.00.
Facturación por tokens realmente utilizados
Se retiene una estimación al iniciar la llamada, luego se liquida según el recuento real de tokens cuando se completa la respuesta y se devuelve la diferencia. La tarifa es la misma desde el primer token hasta el millonésimo; no hay un nivel de contexto largo.
Cómo llamar a la API de Claude Sonnet 5.5
El endpoint utiliza el protocolo Messages de Anthropic, por lo que un cliente de Claude existente solo necesita una nueva URL base y una clave.
Obtén una clave y apunta el cliente a AIReiter
Crea una clave de API en tu panel de AIReiter. En los SDKs oficiales de Anthropic, establece la URL base en https://aireiter.com/api; el SDK añade /v1/messages automáticamente.
Envía una solicitud con curl
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'
O usa el SDK de Python
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)
Preguntas frecuentes sobre la API de Claude Sonnet 5.5
/ 01¿Cuándo se lanzó Claude Sonnet 5.5 y cuál es el ID del modelo?
Anthropic lo lanzó el 28 de septiembre de 2026. El ID del modelo para la API es claude-sonnet-5-5 y su fecha de corte de conocimiento es junio de 2026.
/ 02¿Cuál es la ventana de contexto y la salida máxima?
Una ventana de contexto de 1M de tokens y hasta 128K tokens de salida por solicitud. Acepta entradas de texto e imagen y devuelve texto.
/ 03¿Cuánto cuesta la API de Claude Sonnet 5.5?
Anthropic lista $2 por entrada y $10 por salida por millón de tokens, lo mismo que Sonnet 5. AIReiter cobra la mitad: $1 por entrada, $5 por salida, $0.10 por lecturas de caché y $1.25 por escrituras de caché.
/ 04¿Puedo desactivar el razonamiento?
No del todo. thinking disabled devuelve un error 400. La configuración más baja es between_tools, que funciona con esfuerzo bajo, medio y alto.
/ 05¿Es Sonnet 5.5 mejor que Sonnet 5?
Según los benchmarks de programación y tareas de conocimiento reportados por Anthropic, sí, por un amplio margen y al mismo precio de lista. Revisa los cambios de migración anteriores antes de cambiar, ya que algunas estructuras de solicitud de Sonnet 5 ahora fallan.
/ 06¿Por qué se rechazó mi pregunta de seguridad o fue respondida por Sonnet 5?
Sonnet 5.5 es el primer Sonnet que incorpora las salvaguardas de ciberseguridad utilizadas en los modelos más capaces de Anthropic. Algunas solicitudes de mayor riesgo recurren a Sonnet 5, y las tareas de seguridad benignas pueden experimentar más rechazos. Este es un comportamiento upstream.
/ 07¿Necesito una cuenta de Anthropic?
No. Una clave de AIReiter funciona con el endpoint de AIReiter, y puedes probar el modelo en el playground de esta página antes de escribir código.
/ 08¿Qué APIs son compatibles?
Anthropic Messages en /api/v1/messages es el contrato principal, con streaming. También se admiten Chat Completions al estilo de OpenAI y la Responses API, y /api/v1/models lista los modelos disponibles para tu clave.