Sonnet 5 llegó el 30 de junio de 2026 y en r/ClaudeAI enseguida apareció una queja que su tarifa no anticipaba: "¿Sonnet 5 es peor que Opus al mismo precio en high y xhigh?"
Un usuario resumió el motivo en una frase. Sonnet es "más barato por token, pero necesita muchos más pasos y tokens para terminar las tareas; ahí es donde pierde su ventaja de precio".
Tenía razón, salvo por una excepción. Al comparar Claude Opus 5 y Sonnet 5 con el mismo presupuesto, Opus gana casi siempre: por encima de unos $2.30 por tarea, Opus con un nivel de esfuerzo menos supera a Sonnet con un nivel más, tanto en coste como en calidad. Por debajo de ese umbral, y en trabajos cortos de una sola interacción, Sonnet 5 es 3,4 veces más barato.
Qué gana cada modelo
| Claude Opus 5 | Claude Sonnet 5 | |
|---|---|---|
| ID del modelo | claude-opus-5 | claude-sonnet-5 |
| Lanzamiento | 24 de julio de 2026 | 30 de junio de 2026 |
| Entrada / salida por MTok | $5 / $25 | $2 / $10 hasta el 31 de agosto de 2026; después, $3 / $15 |
| Entrada / salida por lote | $2.50 / $12.50 | $1 / $5 hasta el 31 de agosto de 2026 |
| Niveles de esfuerzo | low, medium, high, xhigh, max (high por defecto) | los mismos cinco niveles (high por defecto) |
| Razonamiento extendido | activado por defecto | adaptativo |
| Contexto / salida máxima | 1M / 128k tokens | 1M / 128k tokens |
| Corte de conocimiento | mayo de 2026 | enero de 2026 |
| Descuento por token | ninguno | 60% menos que Opus hoy; 40% menos desde el 1 de septiembre |
| Mejor encaje | ejecuciones agénticas de largo recorrido, razonamiento difícil y trabajo caro de revisar | extracción de una sola pasada, alta concurrencia y UX sensible a la latencia |
| Nuestra prueba rápida de cuatro tareas | 4/4 superadas, 1.182 tokens de salida, 2.955¢ | 4/4 superadas, 858 tokens de salida, 0.858¢ |
Todavía no hay ningún benchmark público de largo recorrido que haya probado Opus 5, así que Opus 4.8 ocupa la columna de Opus en las tablas por tarea que siguen. Tómalas como un mínimo conservador: ambos modelos tienen exactamente el mismo precio y Anthropic sitúa a Opus 5 por delante de 4.8 en trabajo agéntico.
La comparación entre Claude Opus 5 y Sonnet 5 con presupuestos equivalentes es posible porque los dos modelos aceptan el mismo parámetro effort en los mismos cinco niveles, sin cabecera beta. La capacidad se compra moviendo ese dial, no cambiando de modelo. Los precios proceden de la página de precios de Claude Platform, verificada el 25 de julio de 2026.
Coste y rendimiento por nivel: aquí se cruzan las curvas
Las cifras de cada nivel proceden de DeepSWE v1.1, el ranking de Datacurve para agentes de largo recorrido:
- 113 tareas redactadas desde cero, no extraídas de PR fusionados, base de su afirmación de estar libre de contaminación
- 91 repositorios y 5 lenguajes
- Un mismo harness para todos los modelos, con cuatro ejecuciones por tarea
- Última actualización: 21 de julio, tres días antes del lanzamiento de Opus 5
Por eso Opus 4.8 ocupa la columna de Opus; la incógnita es si Opus 5 consume más tokens por tarea que 4.8.
| Esfuerzo | Sonnet 5 $/tarea | Opus 4.8 $/tarea | Sonnet ÷ Opus | Sonnet pass@1 | Opus pass@1 |
|---|---|---|---|---|---|
| low | $2.19 | $2.29 | 0.95x | 30.5% | 40.8% |
| medium | $4.08 | $3.44 | 1.18x | 39.8% | 48.7% |
| high | $7.43 | $4.28 | 1.73x | 48.2% | 51.8% |
| xhigh | $11.89 | $8.01 | 1.49x | 49.7% | 54.4% |
| max | $26.40 | $13.22 | 2.00x | 53.8% | 59.0% |
Sonnet 5 solo es más barato en un nivel, low, precisamente el nivel en el que cede 10.3 puntos de tasa de acierto.
Por qué el modelo más barato termina facturando más
La diferencia está en el número de pasos, no en la verbosidad.
| Esfuerzo | Pasos medianos de Sonnet 5 | Pasos medianos de Opus 4.8 | Entrada por tarea de Sonnet | Entrada por tarea de Opus |
|---|---|---|---|---|
| low | 70 | 47 | 4.5M | 2.4M |
| max | 260 | 116 | 72.4M | 17.0M |
Un descuento del 60% por token no resiste leer cuatro veces más texto.
Por qué la columna de dólares resulta creíble
Primero, una salvedad: DeepSWE no publica la base de precios que utiliza.
Una ejecución independiente de 24 tareas del 13 de julio cubrió ambos modelos en los cinco niveles dentro de Claude Code. Si se multiplica la columna de Sonnet de DeepSWE por 0.67, aplicando el precio introductorio de $2/$10 frente al estándar de $3/$15, ambos conjuntos coinciden con una diferencia máxima de 0.03 en todos los niveles.
Dos conjuntos de tareas independientes y un mismo punto de cruce, situado entre medium y high. Esa coincidencia también es una buena señal de que DeepSWE facturó Sonnet con tarifas estándar.
Su autor desarrolla y vende Stet, el harness enlazado en esa publicación, así que conviene tratarlo como una prueba del propio proveedor.
Mismo presupuesto, niveles distintos: la comparación decisiva
Las tablas que enfrentan el mismo nivel de esfuerzo responden a la pregunta equivocada, porque nadie compra un nivel de esfuerzo. Se compra un resultado a un precio, y al valorar así Claude Opus 5 frente a Sonnet 5 el orden cambia.
Para cada configuración de Sonnet 5, esta tabla muestra el nivel más barato de Opus 4.8 que iguala o supera su pass rate. La columna introductoria equivale a la cifra con tarifa estándar multiplicada por 0.67.
| Configuración de Sonnet 5 | Sonnet pass@1 | Sonnet $, estándar | Sonnet $, introductorio (est.) | Nivel más barato de Opus 4.8 que lo iguala | Opus $ | Opus pass@1 | Coste de Opus frente a Sonnet introductorio | Diferencia de calidad |
|---|---|---|---|---|---|---|---|---|
| low | 30.5% | $2.19 | $1.47 | low | $2.29 | 40.8% | 1.56x | +10.3pp |
| medium | 39.8% | $4.08 | $2.73 | low | $2.29 | 40.8% | 0.84x | +1.0pp |
| high | 48.2% | $7.43 | $4.98 | medium | $3.44 | 48.7% | 0.69x | +0.4pp |
| xhigh | 49.7% | $11.89 | $7.97 | high | $4.28 | 51.8% | 0.54x | +2.1pp |
| max | 53.8% | $26.40 | $17.69 | xhigh | $8.01 | 54.4% | 0.45x | +0.5pp |
Fíjate en las dos últimas columnas. Bajar Opus un nivel respecto al Sonnet que estabas considerando ofrece la misma tasa de acierto o una superior por entre un 16% y un 55% menos, incluso con el precio promocional. Solo cambia la primera fila: con esfuerzo low, Sonnet 5 promocional es un 36% más barato, a cambio de ceder 10.3 puntos de pass rate.
La interpretación opuesta también tiene sentido
Un comentario en ese primer hilo leyó la gráfica oficial en medium effort: Opus ronda los $7 frente a los $4.50 de Sonnet, para tasas de éxito del 68% y el 62%; "un aumento del 55% en precio por menos de un 10% de mejora en éxito en esta prueba".
Ese intercambio es razonable cuando fallar por 6 puntos no cuesta nada, y equivocado cuando un diff defectuoso llega a producción.
Las dos lecturas dependen de la distribución de tareas de otra persona. Probar entre veinte y cincuenta tareas propias, evaluando coste por finalización correcta en vez de coste por token, vale más que cualquier tabla de esta página.
Qué cambia Opus 5 con los mismos $5 y $25
El precio de lanzamiento de Opus 5 replica al céntimo el de Opus 4.8, así que queda un tercer eje por resolver: los tokens por tarea. La evidencia apunta en ambas direcciones.
| Indicadores de que Opus 5 costará menos por tarea | Indicadores de que costará más |
|---|---|
| Anthropic afirma que Opus 5 lidera Frontier-Bench v0.1 y "más que duplica el rendimiento de Opus 4.8 con un menor coste por tarea" (dato del proveedor, en sus propias ejecuciones y sin reproducción independiente) | El razonamiento extendido viene activado por defecto, mientras que en Opus 4.8 estaba desactivado |
| Un socio legal no identificado registró aproximadamente un 26% menos de tokens con razonamiento max (dato transmitido por Anthropic, sin metodología publicada) | Nuestras cuatro tareas: Opus 4.8 usó 380 tokens de salida y Opus 5, 1.182 |
Las dos posibilidades siguen abiertas, así que vuelve a medir las columnas de coste en tu propio repositorio antes de comprometer un presupuesto.
Hay una trampa para quien intente abaratar Opus 5 por la vía obvia: thinking: {"type": "disabled"} solo se acepta hasta esfuerzo high y devuelve un 400 en xhigh o max. Es uno de varios cambios incompatibles entre Opus 4.8 y Opus 5 que conviene revisar antes de migrar.
El terreno donde gana Sonnet 5: tareas cortas de una sola pasada
El 24 de julio de 2026 sometimos ambos modelos a cuatro tareas pequeñas, evaluadas por script y no por opinión: corregir dos defectos en kth_smallest, emitir JSON estricto con un orden fijo de claves y un checksum coherente, resolver una pregunta sobre números de Frobenius cuya respuesta era 65 y refactorizar añadiendo validación sin cambiar la firma ni incluir comentarios.
Los dos superaron las cuatro. La diferencia apareció en el contador.
| Claude Sonnet 5 | Claude Opus 5 | |
|---|---|---|
| Comprobaciones superadas | 4/4 | 4/4 |
| Tokens de salida, cuatro tareas | 858 | 1.182 |
| Latencia total | 13.7s | 24.6s |
| Coste de salida con tarifa introductoria / estándar | 0.858¢ / 1.287¢ | 2.955¢ |
Con salidas verificadas idénticas, Opus 5 costó 3,4 veces más al precio actual de Sonnet, o 2,3 veces más cuando termine la promoción, y tardó algo más de la mitad de tiempo adicional. Repetir las dos tareas de código a través del canal oficial de Claude Code apuntó en la misma dirección: 240 tokens de salida para Sonnet 5 frente a 465 para Opus 5.
Tres límites importan más que esa cifra:
- Una ejecución por modelo y tarea. Es una prueba rápida, no un benchmark.
- Solo costes de tokens de salida, con las tarifas oficiales de salida, porque la pasarela inyectaba un prompt de sistema variable que hacía inutilizables los recuentos de entrada para calcular la facturación.
- Cuatro prompts cortos: justo el escenario que excluye la discusión de la comunidad. Ninguno llega a 70 pasos, así que ninguno reproduce la explosión de pasos.
Dentro de esos límites, el descuento de Sonnet 5 se mantiene intacto. Un desarrollador describió exactamente este tipo de trabajo: agentes cargados de documentos que realizan "extracciones de una sola pasada con razonamiento mínimo", donde "Opus sería excesivo".
Dos fechas que condicionan todas las cifras
30 de junio de 2026: se revisó la gráfica oficial de costes
El anuncio de Claude Sonnet 5 de Anthropic incluye una nota en el registro de cambios. La gráfica original de coste-rendimiento empleaba "una metodología más simple que no reflejaba la metodología estándar que usamos para las evaluaciones de búsqueda agéntica", lo que tuvo "el resultado de subestimar el rendimiento de Sonnet 5 en la evaluación".
La gráfica y el texto que la rodea se revisaron para ajustarse a la metodología BrowseComp de la system card, "que utilizó un presupuesto de 10M tokens con compactación y llamadas programáticas a herramientas".
Si vas a citar esa gráfica, comprueba qué versión estás viendo y lee el pie: calcula Sonnet 5 con la tarifa estándar de $3/$15, aclara que el precio introductorio deja el coste real por debajo de la gráfica y fija Opus 4.8 en $5/$25.
1 de septiembre de 2026: termina el precio promocional
La tarifa introductoria de Sonnet 5 expira, todas las líneas publicadas suben un 50% y Opus 5 se mantiene en $5/$25. Desde la publicación quedan 37 días de margen; después, cualquier modelo de gasto basado en las tarifas actuales será erróneo.
Hay otra fecha que suele aparecer en estos debates, aunque aquí no aplica. El tokenizador de Claude 4.7 genera aproximadamente un 30% más de tokens para el mismo texto que el de Sonnet 4.6, de modo que comparar Sonnet 5 con Sonnet 4.6 por token infravalora la subida real. Opus 5 y Sonnet 5 comparten ese tokenizador, por lo que ese sobrecoste se cancela entre ambos.
Qué elegir según el presupuesto
Claude Opus 5 frente a Sonnet 5 se resuelve mejor con tres reglas de enrutamiento que con un único ganador. Los umbrales son el coste medio por tarea de DeepSWE con Opus 4.8 ocupando el puesto de Opus; sirven como rangos iniciales para trabajo en repositorios, no como constantes para agentes de investigación, flujos de soporte o procesos documentales.
- Por debajo de unos $2.30 por tarea, elige Sonnet 5 en low effort. Es la única configuración en la que su ventaja de precio se sostiene en trabajo agéntico, a costa de una tasa de acierto del 30.5%. Para extracción de una sola pasada, clasificación o cualquier salida acotada, quédate aquí y aprovecha el 3,4x que medimos. Un desarrollador calificó Sonnet 5 de "lo bastante cercano a Opus para el 90% del trabajo, pero instantáneo, comparativamente", algo relevante cuando hay una persona esperando.
- Entre unos $2.30 y $8 por tarea, usa Opus un nivel por debajo en lugar de Sonnet un nivel por encima. Opus medium como opción de trabajo por defecto y Opus high cuando un error sea caro de detectar en revisión. En Opus 5 el precio por token es idéntico, pero los tokens por tarea no están medidos; toma este rango como punto de partida para tus pruebas.
- Por encima de $8, deja de subir el dial de Sonnet. Sonnet 5 en max cuesta $26.40 por tarea para un 53.8% en DeepSWE; Opus 4.8 en xhigh cuesta $8.01 para un 54.4%; Fable 5 en low effort alcanzó el 59.6% por $3.76. AIReiter lista Opus 4.8 a $1.56/$7.76 por MTok, aproximadamente un 69% por debajo de tarifa, aunque su catálogo de Claude todavía no incluye Opus 5.
Preguntas frecuentes
¿Claude Opus 5 es más caro que Sonnet 5?
Por token, sí: $5/$25 frente a los $2/$10 promocionales de Sonnet 5. Es decir, 2.5 veces más caro hasta el 31 de agosto de 2026 y 1.67 veces más después. Por tarea terminada el orden puede invertirse, y lo confirman las medianas, no unos pocos casos desbocados. En DeepSWE, el coste mediano en max effort fue de $23.28 para Sonnet 5 frente a $12.35 para Opus 4.8.
¿Cuánto cuesta Claude Sonnet 5?
$2 por millón de tokens de entrada y $10 por millón de tokens de salida hasta el 31 de agosto de 2026; desde el 1 de septiembre, $3 y $15. La subida es del 50% en todas las líneas publicadas: las escrituras de caché de 5 minutos pasan de $2.50 a $3.75, las de caché de 1 hora de $4 a $6 y los aciertos de caché de $0.20 a $0.30. El precio por lote es de $1/$5 durante la promoción.
¿Por qué un modelo más barato puede acabar costando más?
Porque la factura escala con los pasos, no con las tareas. A lo largo del dial de esfuerzo, la mediana de pasos de Sonnet 5 sube de 70 a 260, frente a los 47 a 116 de Opus 4.8; además, su lectura de entrada llega a 72.4M tokens por tarea frente a 17.0M en max. Leer cuatro veces más anula un descuento del 60% en cada token.
¿Opus 5 es mucho mejor que Sonnet 5?
En intentos únicos, sí: Opus 4.8 aventajó a Sonnet 5 entre 3.5 y 10.3 puntos de pass@1 en DeepSWE, con la mayor diferencia en el extremo bajo.
Si ambos tienen cuatro intentos, la distancia casi desaparece: Sonnet 5 en high effort llegó al 79.6% de pass@4, frente al 77.9% de Opus 4.8; en max, quedaron en 78.8% y 79.3%. Puede llegar ahí, pero necesita más intentos y se paga cada uno.
¿La subida de precio de Sonnet 5 el 1 de septiembre cambia la respuesta?
Desplaza el punto de cruce hacia abajo, no hacia arriba. La ventaja por token de Sonnet 5 se estrecha del 60% al 40%, mientras Opus 5 sigue en $5/$25, así que todos los emparejamientos de la tabla con presupuestos equivalentes empeoran para Sonnet. La única fila favorable a Sonnet, su nivel low con un 36% menos que Opus low bajo precio introductorio, se reduce a aproximadamente un 4% menos con las tarifas estándar.
