AIREITER

Claude Sonnet 5.5 API: análisis y precios para equipos de desarrollo

Última actualización: 2026-09-30 00:40:44

Claude Sonnet 5.5 combina un precio de $2 por millón de tokens de entrada con una puntuación publicada del 70.6% en Terminal-Bench 4.0. Sin embargo, las ejecuciones de agentes con el máximo nivel de esfuerzo pueden elevar bastante el coste real de cada cambio aceptado. Para los equipos que buscan un modelo de programación para producción, Sonnet 5.5 es la opción predeterminada que conviene probar primero, no un sustituto automático de Opus 5.5.

Conclusión para producción: usa Sonnet 5.5 como opción predeterminada para programar

Empieza probando Claude Sonnet 5.5 con correcciones de errores acotadas, refactorizaciones, generación de pruebas y tareas de repositorio que requieran herramientas. El resultado publicado por Anthropic en Terminal-Bench 4.0 es del 70.6%, por encima del 66.4% de Claude Opus 5.5 y del 10.3% de Claude Sonnet 5 en la misma comparación.

Eso sí, establece límites claros: configura de forma explícita el nivel de esfuerzo y la cantidad máxima de salida. Análisis independientes de costes señalan que Sonnet 5.5 con el máximo esfuerzo puede salir más caro por tarea de benchmark que Opus 5.5, pese a sus tarifas nominales más bajas.

Qué cambia Claude Sonnet 5.5 para los equipos que usan la API

Claude Sonnet 5.5 se lanzó el 28 de septiembre de 2026. La documentación oficial del modelo indica el ID claude-sonnet-5-5, una ventana de contexto de 1 millón de tokens, una salida máxima estándar de 128.000 tokens, razonamiento adaptativo y un nivel de esfuerzo predeterminado en la API de high.

Detalle para producciónClaude Sonnet 5.5
Fecha de lanzamiento28 de septiembre de 2026
ID del modeloclaude-sonnet-5-5
Ventana de contexto1M tokens
Salida máxima estándar128K tokens
Salida máxima en lotes300K tokens con la cabecera beta documentada
Esfuerzo predeterminado en la APIhigh

Anthropic se compromete a no retirar el modelo antes del 28 de septiembre de 2027. Es un límite mínimo de disponibilidad, no una fecha definitiva de retirada.

Los valores predeterminados de la API que afectan a la factura

El razonamiento adaptativo está activado de forma predeterminada. Los equipos que migren desde Sonnet 5 deberían probar between_tools si necesitan desactivar el razonamiento inicial; la documentación oficial indica que el uso forzado de herramientas ahora devuelve un error, y que los valores no predeterminados de temperature, top_p o top_k devuelven errores HTTP 400.

El texto generado entre llamadas a herramientas puede llegar dentro de bloques thinking. Un cliente que procese respuestas en streaming y dé por hecho que todos los mensajes intermedios son bloques de texto normales puede parecer que se ha quedado bloqueado tras la migración. Actualiza el analizador antes de incorporar Sonnet 5.5 a un agente de programación existente.

Rendimiento en Terminal-Bench: suficiente para ser la opción predeterminada

El benchmark de agentes de programación más destacado en este análisis es Terminal-Bench 4.0, que evalúa tareas de línea de comandos con varios pasos. Los resultados comunicados por Anthropic sitúan a Sonnet 5.5 en el 70.6%, frente al 66.4% de Opus 5.5 y el 10.3% de Sonnet 5.

ModeloTerminal-Bench 4.0GDPval-AA EloCursorBench 4.0
Claude Sonnet 5.570.6%184455.5%
Claude Opus 5.566.4%184657.8%
Claude Sonnet 510.3%144934.1%

Las cifras anteriores aparecen en el resumen de benchmarks de DataCamp, que atribuye los resultados de la evaluación al material de lanzamiento de Anthropic. Sonnet 5.5 lidera la comparación de programación en terminal, pero Opus 5.5 sigue por delante en CursorBench y en varias evaluaciones más amplias de razonamiento y trabajo de conocimiento.

Comparativa de benchmarks de programación y coste indexado de Claude Sonnet 5.5

Valida el modelo con reproducciones de tareas reales del repositorio y mide las pruebas superadas, los turnos de herramientas y los cambios aceptados, no solo los diffs.

Precios de la API de Claude Sonnet 5.5 en cargas reales

La tarifa de Anthropic es sencilla, pero un agente de programación puede pagar por algo más que el prompt visible. Los tokens de razonamiento se facturan como salida, y el contexto repetido del repositorio puede convertirse en lecturas de caché entre turnos.

Elemento de la APIPrecio de Claude Sonnet 5.5
Entrada$2 por 1M de tokens
Salida, incluido el razonamiento$10 por 1M de tokens
Escritura en caché durante 5 minutos$2.50 por 1M de tokens
Escritura en caché durante 1 hora$4 por 1M de tokens
Lectura de caché$0.20 por 1M de tokens
Entrada en lotes50% de descuento, equivalente a $1 por 1M
Salida en lotes50% de descuento, equivalente a $5 por 1M

La documentación oficial establece un mínimo de 512 tokens para los prompts almacenables en caché y explica que Sonnet 5.5 utiliza razonamiento adaptativo. Según el análisis de precios independiente de eesel, Sonnet 5.5 utiliza el mismo tokenizador que Sonnet 5; migrar no reduce automáticamente el número de tokens.

Una solicitud con 4.000 tokens de entrada y 700 tokens de salida cuesta aproximadamente $0.015 antes de otros cargos: $0.008 por la entrada más $0.007 por la salida. Un agente de programación que realice 20 turnos con 3.000 tokens de entrada nuevos y 2.000 tokens de salida por turno consumiría aproximadamente $0.12 en entrada nueva y $0.40 en salida, antes de contar lecturas y escrituras de caché, herramientas o reintentos. Son ejemplos de cargas de trabajo, no precios universales por tarea.

El nivel de esfuerzo es el control de costes

El análisis de TokenCost sobre el esfuerzo, basado en mediciones del Artificial Analysis Intelligence Index, publicó estos resultados para Sonnet 5.5:

EsfuerzoPuntuaciónCoste del índice completo
Low35.8$544
Medium40.7$701
High46.7$1,176
Xhigh51.9$2,738
Max56.0$8,977

El resultado con max es la señal de alarma. El mismo análisis situó a Opus 5.5 en 57.6 con max por $8,708, mientras que Opus 5.5 alcanzó 56.0 con xhigh por $4,057. En esa prueba, Sonnet 5.5 con max utilizó aproximadamente 193.000 tokens de salida por tarea.

Empieza con medium o high, limita los tokens de salida y reserva una ruta más cara para las tareas fallidas o de mayor riesgo. No copies una configuración antigua de max de Sonnet 5 a Sonnet 5.5 sin repetir las evaluaciones de coste y calidad.

Checklist de migración para un modelo de programación en producción

  1. Fija claude-sonnet-5-5 en staging en lugar de cambiar un alias de forma global.
  2. Reproduce correcciones de errores, refactorizaciones, pruebas y cambios en varios archivos representativos de tus repositorios.
  3. Configura explícitamente el nivel de esfuerzo y registra los tokens de salida, las lecturas de caché, los turnos de herramientas, el tiempo transcurrido y la tasa de cambios aceptados.
  4. Sustituye thinking: disabled por el comportamiento compatible between_tools cuando corresponda.
  5. Elimina las suposiciones sobre el uso forzado de herramientas y prueba el nuevo comportamiento de selección de herramientas.
  6. Actualiza el código de streaming para procesar bloques thinking entre llamadas a herramientas.
  7. Vuelve a comprobar los parámetros de muestreo no predeterminados; la documentación oficial indica que temperature, top_p y top_k no predeterminados generan errores 400.
  8. Añade un límite de gasto y una condición de aborto para la generación descontrolada o los bucles repetidos de herramientas.
  9. Compara el coste por cambio aceptado, no el coste por solicitud.
  10. Despliega primero en un pequeño porcentaje del tráfico. Amplía el uso de Sonnet solo si iguala la tasa de cambios aceptados del modelo actual dentro de la tolerancia acordada y reduce el coste por cambio aceptado.

El empleado de Anthropic @cjav_dev informó de que las solicitudes con thinking: {"type":"disabled"} empezaron a devolver errores 400 y que debían migrarse a between_tools (publicación en X).

Cuándo elegir Sonnet 5.5, Opus 5.5 o un modelo más barato

Carga de trabajoPrimera opción recomendadaMotivo
Correcciones de errores y refactorizaciones acotadasSonnet 5.5 con medium/highBuena puntuación en terminal con tarifas de tokens más bajas
Clasificación de código a gran escala o ediciones sencillasSonnet 5.5 con low/medium, o un modelo más baratoEvita pagar por razonamiento innecesario
Agente de repositorio de larga duraciónSonnet 5.5 con caché y presupuestos estrictosLa caché y el número de turnos determinan la factura real
Arquitectura ambigua o revisión finalOpus 5.5El criterio global importa más que la tarifa más baja
Análisis de código offline y no urgenteClaude Sonnet 5.5 Batch APILa API ofrece un 50% de descuento en entrada y salida
Experimento de terminal con el máximo esfuerzoSonnet 5.5 solo después de un benchmark internoTerminal-Bench es uno de sus puntos fuertes, pero max puede resultar caro

Usa Sonnet para tareas bien definidas y medibles; deriva a Opus el trabajo de arquitectura ambiguo.

Preguntas frecuentes sobre la API de Claude Sonnet 5.5

¿Cuánto cuesta la API de Claude Sonnet 5.5?

La tarifa estándar es de $2 por millón de tokens de entrada y $10 por millón de tokens de salida. Las lecturas de caché cuestan $0.20 por millón de tokens, las escrituras cuestan $2.50 durante cinco minutos o $4 durante una hora, y la Batch API aplica un descuento del 50% a la entrada y la salida.

¿Es Sonnet 5.5 mejor que Opus 5.5 para programar?

Sonnet 5.5 lidera la comparación publicada de Terminal-Bench 4.0 con un 70.6%, frente al 66.4% de Opus 5.5. Opus sigue por delante en varias evaluaciones, así que los equipos deberían elegir la ruta según el tipo de tarea y no tratar el resultado de programación como una clasificación universal.

¿Cuál es el ID del modelo Sonnet 5.5?

Usa claude-sonnet-5-5 en la API de Claude. Los identificadores específicos de cada proveedor aparecen en la documentación de modelos de Anthropic.

¿Sonnet 5.5 admite una ventana de contexto de 1M de tokens?

Sí. Anthropic indica una ventana de contexto de 1 millón de tokens y una salida máxima estándar de 128.000 tokens. La beta de Message Batches API puede admitir 300.000 tokens de salida con la cabecera beta documentada.

¿Qué cambia al migrar desde Sonnet 5?

Han cambiado el razonamiento adaptativo y el comportamiento de los bloques de respuesta; el uso forzado de herramientas puede generar errores, los parámetros de muestreo no predeterminados pueden devolver errores 400 y thinking: disabled debe sustituirse por el comportamiento compatible. Repite las pruebas del agente y del streaming antes del despliegue en producción.

Haz un piloto de una semana reproduciendo tareas con un nivel de esfuerzo medio/alto, mide el coste por cambio aceptado y deriva los casos fallidos a Opus.