Para casi todo, Claude Fable 5 funciona mejor en high. Si el trabajo de programación se complica o un agente necesita más margen para planificar y usar herramientas, sube a xhigh. Deja max para casos excepcionales: en la mayoría de tareas cuesta aproximadamente el doble y la mejora de calidad es difícil de apreciar, además de que puede llevar al modelo a sobreanalizar. La clave es que entre Claude Fable 5 high vs max hay un escalón que muchos pasan por alto: xhigh, y suele ser la respuesta real cuando te preguntas si debes aumentar el esfuerzo.
Qué controla el nivel de esfuerzo en Fable 5
El parámetro de esfuerzo (output_config.effort) ofrece cinco niveles: low, medium, high, xhigh y max. En Fable 5, el valor predeterminado es high; según la documentación de esfuerzo de Anthropic, indicar high produce exactamente el mismo resultado que omitir el parámetro.
Hay dos detalles que suelen sorprender. El esfuerzo no es solo un control de cuánto razona el modelo: afecta a todo el gasto de tokens, incluido el texto visible, el razonamiento extendido y las llamadas a herramientas dentro de un ciclo agéntico. Con menos esfuerzo hay menos llamadas a herramientas y más agrupadas, menos introducción y confirmaciones más breves. Con más esfuerzo, aumentan las llamadas, la planificación explícita y los resúmenes. Además, Fable 5 siempre tiene el razonamiento activado: no se puede deshabilitar (thinking: {type: "disabled"} devuelve un error), de modo que el esfuerzo es la vía para controlar su profundidad. En high, xhigh y max, Claude casi siempre razona a fondo; en low y medium, puede omitir ese razonamiento en problemas sencillos.
Entre high y max hay un paso intermedio: xhigh
En realidad, la comparación «high frente a max» tiene tres niveles, no dos. xhigh se sitúa entre ambos y permite ajustar con más precisión el equilibrio entre razonamiento y latencia. El ingeniero de Anthropic Boris Cherny lo definió como «a new level between high and max». Solo está disponible en Fable 5, Mythos 5, Opus 4.8, Opus 4.7 y Sonnet 5; los modelos anteriores, como Opus 4.6 y Sonnet 4.6, pasan directamente de high a max.
Esta es la escala completa y el uso que Anthropic asigna a cada nivel:
| Nivel | Uso indicado por Anthropic |
|---|---|
low | Tareas sencillas que requieren la máxima velocidad y el menor coste, como subagentes |
medium | Tareas agénticas que equilibran velocidad, coste y rendimiento |
high | Razonamiento complejo, programación difícil y tareas agénticas (el valor predeterminado) |
xhigh | Tareas agénticas o de programación de larga duración (más de 30 minutos), con presupuestos de millones de tokens |
max | Razonamiento más profundo, sin límite al esfuerzo interno (la salida sigue limitada por max_tokens) |
Por eso, si alguien plantea ejecutar Fable 5 en max, la primera pregunta debería ser: ¿ya has probado xhigh? Para los trabajos agénticos y de programación más exigentes, el salto recomendado es xhigh, no max.
El coste y la latencia que asumes al subir el esfuerzo
Aumentar el esfuerzo no eleva el precio por token. Fable 5 factura una tarifa fija de 10 $ por millón de tokens de entrada y 50 $ por millón de tokens de salida en todos los niveles. El coste aumenta únicamente porque el modelo genera más tokens.
El gráfico es ilustrativo, no una medición: representa la forma de la relación descrita a continuación y normaliza ambos ejes para que max valga 1,0. La calidad se acerca a su techo con high, mientras que el coste sigue aproximadamente duplicándose a medida que subes de nivel.
El salto de xhigh a max es donde las cuentas empiezan a jugar en contra. El ingeniero de software Ishu Agarwal señaló el 11 de julio de 2026 que pasar de high a xhigh «can usually be less than 3%» de mejora en calidad, con un coste «30% to 100%» mayor, y que los modelos tienden «to overthink at higher effort levels». Una publicación muy difundida del 14 de julio afirmó que Fable 5 obtuvo el mismo resultado con max y xhigh: «89.0 vs 89.0, at roughly double the cost». Conviene tomar estos datos de la comunidad como indicativos, no como un benchmark controlado. Aun así, la tendencia coincide con la propia advertencia de Anthropic: max «adds significant cost for relatively small quality gains, and on some structured-output or less intelligence-sensitive tasks it can lead to overthinking.»
La latencia sigue el mismo patrón. Tras probar los niveles de esfuerzo el 11 de junio de 2026, el product manager Pawel Huryn observó que «below max, completion time barely moves», mientras que en trabajo real «completion jumps from xhigh up». Hay otra trampa: el tokenizador de Fable 5, compartido con la última generación de Opus, puede contabilizar hasta aproximadamente un 35 % más de tokens para el mismo texto que modelos Claude anteriores. Por tanto, cualquier referencia de costes basada en un modelo previo se quedará corta.
Cuándo usar high, xhigh o max
| Tarea | Esfuerzo | Cuándo escalar |
|---|---|---|
| Programación rutinaria, chat, extracción, subagentes | low / medium | Cuando la calidad de salida empeore de forma visible |
| La mayor parte del razonamiento, programación cotidiana y trabajo agéntico | high (predeterminado) | Cuando una tarea difícil se atasque o requiera una planificación más profunda |
| Programación o trabajo agéntico muy complejo, ejecuciones de largo recorrido y uso intensivo de herramientas | xhigh | Cuando xhigh realmente no pueda resolverlo |
Un problema de frontera o un error que xhigh no haya resuelto, cuando la corrección importe más que el coste | max | (El último escalón) |
high ofrece el mejor equilibrio entre calidad y eficiencia de tokens. xhigh añade una deliberación útil para los trabajos más duros. max, en cambio, es una apuesta remota después de que xhigh ya haya fallado. A menudo es más inteligente bajar el esfuerzo: según Anthropic, Fable 5 sigue rindiendo bien con niveles inferiores y «often exceed[s] xhigh performance on prior models». El CTO Morgan Linton lo resumió sin rodeos: «about 95% of what I do from a coding perspective only requires Fable 5 Low and Medium». Ejecutarlo todo en high cuando Low o Medium ofrecen el mismo resultado es una forma segura de agotar los límites de tu plan.
Si el modelo no es adecuado para el trabajo, ajustar el esfuerzo no lo solucionará: es una cuestión de elección de modelo, no de esfuerzo.
Tres malentendidos habituales sobre el esfuerzo de Fable 5
Más esfuerzo no convierte al modelo en más inteligente. El esfuerzo determina cuánto trabajo hace Claude antes de responder —más razonamiento y más llamadas a herramientas—, no sus capacidades. Una respuesta en low procede del mismo modelo que una en max; si una tarea supera sus capacidades, max solo gastará más para llegar al mismo punto.
El valor predeterminado de Claude Code no coincide con el de la API. Claude Code usa xhigh por defecto, mientras que la API usa high. Esto explica por sí solo muchas dudas de «¿por qué se comporta distinto aquí?»: el mismo modelo parece más minucioso y más caro en Claude Code simplemente por ese nivel predeterminado superior. Establece xhigh explícitamente si quieres que la API se comporte igual.
ultracode no es un nivel de esfuerzo. Aparece en el menú de Claude Code, pero la API solo acepta valores de low a max. Ultracode combina xhigh con permiso permanente para lanzar flujos de trabajo multiagente: consume muchos tokens y no es algo que puedas enviar a la API.
Cómo configurar el esfuerzo y qué tener en cuenta sobre max_tokens
El esfuerzo se define en output_config y no requiere ninguna cabecera beta. Como Fable 5 siempre tiene el razonamiento activado, omite por completo el parámetro thinking:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-fable-5",
max_tokens=64000, # give room at xhigh/max (see note below)
output_config={"effort": "xhigh"}, # low | medium | high | xhigh | max
messages=[{"role": "user", "content": "Refactor this module and add tests."}],
)
max_tokens es un límite estricto para la salida total: razonamiento más texto de respuesta. En xhigh o max, el razonamiento puede consumir buena parte de ese presupuesto. Así que conviene asignar un margen amplio —empieza en torno a 64.000— para evitar que las respuestas se corten a mitad del razonamiento. Fable 5 admite un contexto de 1 millón de tokens y 128K tokens de salida.
Preguntas frecuentes
¿Qué diferencia hay entre high y max effort en Fable 5?
high, el valor predeterminado, invierte lo necesario para obtener resultados excelentes. max elimina toda contención para alcanzar el razonamiento más profundo. Normalmente, el salto significativo desde high es xhigh, que se sitúa entre ambos.
¿Merece la pena usar max effort en Fable 5?
En pocas ocasiones. Su coste es aproximadamente el doble que el de xhigh para una mejora poco medible, y puede hacer que el modelo sobreanalice. Resérvalo para un problema de frontera o un error que xhigh no consiga resolver.
¿Cómo cambio el nivel de esfuerzo?
Configura output_config: {"effort": "..."} con low, medium, high, xhigh o max. En Claude Code, utiliza su menú de esfuerzo.
¿Cuál es el nivel de esfuerzo predeterminado?
high en la API, lo mismo que omitir el parámetro. Claude Code usa xhigh de forma predeterminada.
¿Un esfuerzo mayor cuesta más por token?
No: la tarifa es fija. Un esfuerzo mayor solo cuesta más porque el modelo genera más tokens.
¿El esfuerzo de Fable 5 es igual que los niveles de esfuerzo de Sonnet u Opus?
El parámetro y los nombres son los mismos, pero xhigh solo existe en Fable 5, Mythos 5, Opus 4.8, Opus 4.7 y Sonnet 5, y los valores predeterminados recomendados varían según el modelo. Consulta Sonnet 5 frente a Fable 5 si estás decidiendo entre ambos.