El presupuesto de API para el cuarto trimestre acaba de mejorar para quienes contaban con una subida de precio. El 10 de agosto de 2026, Anthropic canceló el aumento programado de Claude Sonnet 5 para el 1 de septiembre: los $2 por millón de tokens de entrada y $10 por millón de tokens de salida dejan de ser una oferta de lanzamiento y pasan a ser la tarifa estándar permanente. Si calculaste tus costes con los $3/$15 anunciados en junio, hay que corregir una línea; y si seguiste con Sonnet 4.6 esperando el precio «real», ese criterio ya no aplica.
Precio actual de Claude Sonnet 5: tabla completa de tarifas
En la API directa de Anthropic, Claude Sonnet 5 cuesta $2 por millón de tokens de entrada y $10 por millón de tokens de salida. Todas las tarifas con descuento parten de esa base. La documentación de precios de Claude Platform, revisada el 16 de agosto de 2026, lo deja claro: «El aumento programado anteriormente ... no tendrá lugar».
| Tarifa | Precio por 1M de tokens | Multiplicador frente a entrada base |
|---|---|---|
| Entrada base | $2.00 | 1.0x |
| Salida base | $10.00 | 5x la entrada |
| Escritura de caché de 5 min | $2.50 | 1.25x |
| Escritura de caché de 1 hora | $4.00 | 2x |
| Lectura de caché (acierto) | $0.20 | 0.1x |
| Entrada Batch | $1.00 | 50% de descuento |
| Salida Batch | $5.00 | 50% de descuento |
Hay tres detalles de la misma documentación que no caben en una tarifa de titular. La ventana de contexto completa de 1M de tokens se factura al mismo precio por token: una petición de 900k tokens y otra de 9k cuestan lo mismo por token, sin recargo por contexto largo. Fijar la inferencia en Estados Unidos con inference_geo: "us" añade un multiplicador de 1.1x a las tarifas de entrada, salida y caché. Además, la búsqueda web en servidor cuesta $10 por cada 1.000 búsquedas, además de los tokens habituales.
La subida del 1 de septiembre que Anthropic retiró
Claude Sonnet 5 se lanzó el 30 de junio de 2026 con una tarifa de lanzamiento explícita de $2/$10, que estaba prevista para volver a $3/$15 —el mismo precio que Sonnet 4.6— el 1 de septiembre de 2026. Ese retorno es el que todavía aparece en muchas tablas de precios publicadas a comienzos de julio. El 10 de agosto de 2026, el registro de cambios del anuncio de lanzamiento añadió una sola línea: el precio introductorio pasaba a ser permanente. La cobertura inicial de TechCrunch ya incluye una nota de actualización que refleja la tarifa vigente.
Cualquier tabla que siga describiendo el salto a $3/$15 como futuro o «después del 31 de agosto» es anterior al 10 de agosto: sobreestima ambas tarifas estándar en un 50%. Más allá de la fecha límite, no cambió nada estructuralmente. Sonnet 5 sigue un escalón por debajo de los $3/$15 de Sonnet 4.6, con un recorte del 33% en la entrada.
Sonnet 5 frente a Sonnet 4.6: las cuentas para migrar han cambiado
El principal motivo para ser prudente era el tokenizador. Sonnet 5 incorpora la familia de tokenizadores actualizada que llegó con Opus 4.7. El anuncio de Anthropic sitúa el multiplicador de tokens para texto idéntico entre 1.0x y 1.35x, según el tipo de contenido, mientras que la documentación de la plataforma cifra el aumento típico cerca del 30%. Con el plan anterior, la tarifa estándar de $3/$15 podía elevar el coste de un prompt equivalente hasta $4.05 por millón de tokens de entrada y $20.25 de salida, frente a los $3/$15 de Sonnet 4.6.
Con los $2/$10 permanentes, incluso el peor escenario cambia de sentido. Aun con la inflación máxima de 1.35x en tokens, un texto equivalente cuesta $2.70 por millón de tokens de entrada y $13.50 de salida: menos que Sonnet 4.6 en ambos casos. Y eso sin considerar que Sonnet 5 obtiene mejores resultados en la tabla comparativa del lanzamiento: 63.2% frente a 58.1% en SWE-bench Pro, 80.4% frente a 67.0% en Terminal-Bench 2.1 y 81.2% frente a 78.5% en OSWorld-Verified.
Conviene, no obstante, vigilar el coste por problema resuelto, no solo el coste por token. Las pruebas de Artificial Analysis, citadas por eesel AI, situaron a Sonnet 5 en aproximadamente $2.29 por tarea en su Intelligence Index. También concluyeron que, sin precios promocionales, podía resultar más caro por tarea que Opus 4.8, porque las ejecuciones de alto esfuerzo consumen tokens de razonamiento facturados a tarifa de salida. La reacción de la comunidad fue directa:
«tl;dr: Sonnet 5 es más barato por token, pero más caro por problema resuelto, y además sigue por detrás de Opus 4.8 en inteligencia general». - u/Chubby, r/accelerate
La tarifa fija modifica los datos de partida de esa ecuación, no la lección: los ajustes de esfuerzo y los tokens por tarea siguen determinando la factura. La parte de capacidades de la decisión de migración se analiza en nuestra comparativa entre Sonnet 5 y Sonnet 4.6.
El precio es el mismo; esfuerzo y caché cambian la factura
Hay dos palancas que influyen más en la factura de Sonnet 5 que cualquier anuncio de precios. La primera es el nivel de esfuerzo. Sonnet 5 ofrece los niveles low, medium, high, xhigh y max. El anuncio de lanzamiento afirma que la eficiencia de costes mejora sustancialmente en esfuerzo medio; la cobertura del lanzamiento lo interpreta como un Sonnet 5 en nivel medio que se aproxima a Sonnet 4.6 en nivel alto. Por tanto, merece la pena probar si un nivel menos mantiene la calidad requerida en tu carga de trabajo. La segunda es la caché de prompts. Una escritura de caché de 5 minutos a $2.50 se amortiza tras una lectura posterior; una de 1 hora a $4.00, tras dos. Después, cada lectura cuesta $0.20, un descuento del 90% sobre la entrada. Según la documentación de la plataforma, los multiplicadores de caché y Batch se acumulan.
Con una tarifa base permanente, Batch merece especial atención. A $1/$5 por millón de tokens, el procesamiento asíncrono de Sonnet 5 —con resultados en un plazo de 24 horas— cuesta lo mismo que la tarifa estándar bajo demanda de Haiku 4.5, pero ofrece un modelo que alcanza el 63.2% en SWE-bench Pro. Batch suele ser la opción más económica para evaluaciones independientes sin sensibilidad a la latencia, reprocesados y tratamiento de documentos.
El mismo modelo no cuesta igual en todos los proveedores
La tabla de tarifas de Sonnet 5 no es idéntica en los siete proveedores que lo alojan. La tabla de proveedores de CloudPrice muestra que Anthropic directo, Amazon Bedrock, Azure AI Foundry, Google Vertex AI, OpenRouter y Vercel AI Gateway cobran $2.00/$10.00. Snowflake, en cambio, cobra $2.40/$12.00, un 20% más. Según la documentación de la plataforma, hay dos recargos aplicables con independencia del proveedor: los endpoints regionales o multirregión de Bedrock y Vertex cuestan aproximadamente un 10% más que los globales, y la inferencia exclusiva en Estados Unidos añade el multiplicador de 1.1x.
| Proveedor | Entrada / 1M | Salida / 1M | Notas |
|---|---|---|---|
| Anthropic API | $2.00 | $10.00 | Batch $1/$5, tarifas completas de caché |
| Amazon Bedrock | $2.00 | $10.00 | Endpoints regionales +10% |
| Google Vertex AI | $2.00 | $10.00 | Endpoints regionales +10% |
| Azure AI Foundry | $2.00 | $10.00 | Despliegue US Data Zone disponible |
| OpenRouter | $2.00 | $10.00 | Variante Batch $1/$5 |
| Vercel AI Gateway | $2.00 | $10.00 | - |
| Snowflake | $2.40 | $12.00 | +20% frente a la tarifa estándar |
Hay una trampa al comparar directorios: la cifra de «desde $1.00/$5.00» que algunas fichas atribuyen a Sonnet 5 corresponde a Batch, no al precio bajo demanda. El mismo directorio muestra Sonnet 4.6 a $1.50/$7.50, que es exactamente su tarifa Batch y no su precio estándar de $3/$15.
Qué implica el $2/$10 permanente para tu presupuesto
Las decisiones pendientes son ahora de modelo, no de calendario. Según el anuncio de lanzamiento, Sonnet 5 es el modelo predeterminado de los planes Claude Free y Pro, y está incluido en Max, Team y Enterprise. Los usuarios de suscripción no pagan estas tarifas de API; la guía de precios de Claude API explica en qué punto conviene pasar de suscripción a API. Para quienes compran API:
| Situación | Recomendación |
|---|---|
| Agentes en producción y sensibles a latencia | Sonnet 5 a $2/$10, con caché de 5 min para los prompts de sistema |
| Reprocesados nocturnos, evaluaciones y procesamiento masivo | Sonnet 5 Batch a $1/$5 |
| Las tareas de programación más difíciles (Opus 4.8: 69.2% frente a 63.2% en SWE-bench Pro, según la tabla comparativa de lanzamiento de Anthropic) | Opus 4.8 a $5/$25 |
| Clasificación, enrutamiento y resúmenes | Haiku 4.5 a $1/$5 |
| Sonnet 4.6 sigue en producción | Haz un piloto de migración: el rango de tokenizador documentado por Anthropic, de 1.0-1.35x, sigue quedando por debajo de 4.6 por token equivalente; valida primero la calidad y los tokens por tarea con tráfico real |
En xhigh y max, los tokens de razonamiento facturados a $10 por millón siguen haciendo crecer el coste con la dificultad del problema. Artificial Analysis detectó que una ejecución de Sonnet 5 con esfuerzo alto podía costar más por tarea que Opus 4.8 con las antiguas tarifas de $3/$15. El recorte permanente reduce ese suelo en un tercio, pero no lo elimina: mide los tokens por tarea antes de cerrar una cifra trimestral. Procesa una semana de tráfico real mediante el endpoint de Claude API con tu configuración de esfuerzo de producción y calcula el coste de la carga de trabajo, no solo los dólares por millón de tokens.
Lecturas relacionadas: Claude Sonnet 5 vs Sonnet 4.6 - Claude API Pricing Guide 2026 - Claude Sonnet 5 Guide