Fugu-Ultra v1.1: mismo precio y Sakana promete hasta 7,9 puntos más

Última actualización: 2026-07-24 02:45:24

Si ya canalizas trabajo a través de Fugu-Ultra, la actualización publicada el 24 de julio de 2026 se resume rápido: mantiene el precio, incorpora modelos más nuevos y, según Sakana, mejora hasta 7,9 puntos. Lo importante está en los matices: qué respaldan realmente esos benchmarks y por qué no todos deberían cambiar de versión sin comprobarlo antes.

Fugu-Ultra no es un modelo al uso. Es el nivel superior de Sakana Fugu, una capa de orquestación que recibe una única llamada a la API y la distribuye entre varios modelos frontier. A cada uno le asigna un papel —planificador, ejecutor o verificador, por ejemplo— y después integra los resultados en una sola respuesta. En la página oficial de Fugu de Sakana se explica el funcionamiento y se recogen los datos de precio, benchmarks y disponibilidad que usamos a continuación.

Página de inicio de Sakana Fugu, donde se presenta como una capa de orquestación que controla varios modelos frontier mediante una sola API

Qué cambia en Fugu-Ultra v1.1

La versión v1.1 actualiza los modelos frontier que trabajan bajo el capó. Sakana la presenta como una renovación, no como una reconstrucción: el sistema de orquestación sigue siendo el mismo, pero se actualiza el conjunto de modelos que ejecuta las tareas. También se mantienen los tres niveles: Fugu, Fugu-Ultra y Fugu-Cyber.

El principal dato del anuncio de lanzamiento es una mejora de hasta 7,9 puntos frente a v1.0. Los avances más grandes, según Sakana, aparecen en ProgramBench y Terminal Bench 2.1, dos suites de programación agéntica y multietapa en las que un único modelo suele perder el hilo. Es justo el tipo de tarea para el que tiene sentido una capa de orquestación. La dirección de la mejora resulta plausible; su magnitud es una cifra de Sakana, y conviene distinguir qué se puede verificar y qué no.

Benchmarks: lo publicado y lo que falta por ver

Estas son las puntuaciones de Fugu-Ultra que Sakana publica actualmente:

Gráfico de barras con puntuaciones de Fugu-Ultra en benchmarks: GPQA-Diamond 95.5, LiveCodeBench 93.2, MRCRv2 93.6, LiveCodeBench Pro 90.8, Terminal Bench 2.1 82.1, SWE-Bench Pro 73.7, Humanity's Last Exam 50.0

Antes de dar por definitiva esa mejora de +7,9, hay dos puntos que conviene tener presentes.

La tabla pública de benchmarks no separa los resultados por versión. Muestra puntuaciones de Fugu-Ultra, pero no pone v1.0 y v1.1 en columnas contiguas, así que no hay forma de comprobar los incrementos por benchmark que sustentan la cifra de 7,9 puntos. Además, los valores visibles —SWE-Bench Pro 73.7, Terminal Bench 2.1 82.1 y LiveCodeBench 93.2— son los mismos que ya se habían publicado para la compilación v1.0. La tabla disponible, por tanto, todavía no refleja la mejora anunciada.

ProgramBench, uno de los benchmarks que el anuncio señala como principal beneficiado, ni siquiera figura en la tarjeta pública de resultados.

Esto no significa que la afirmación sea incorrecta. Pero si eliges modelos basándote en métricas, la lectura honesta es esta: considera esos hasta 7,9 puntos como una declaración del proveedor y pruébalo con tus propias tareas antes de citar una diferencia que Sakana no ha detallado públicamente.

Sin cambios en precio ni acceso

La llegada de v1.1 no altera las tarifas. Fugu-Ultra cuesta $5 por millón de tokens de entrada y $30 por millón de tokens de salida. Cuando una solicitud supera los 272K de contexto, pasa a $10 / $45; la entrada en caché cuesta $0.50 por millón. También continúan los planes de suscripción de $20, $100 y $200 al mes. Para calcular el coste efectivo una vez incluido el sobrecoste de la orquestación, tenemos una guía de precios y API de Sakana Fugu que desglosa cada nivel.

El ID del modelo es fugu-ultra-v1.1; la compilación anterior era fugu-ultra-20260615. Hay una limitación para usuarios fuera de Estados Unidos: Sakana indica que Fugu no está disponible en la UE/EEE mientras trabaja para cumplir con el RGPD.

¿Conviene pasar desde v1.0?

En la mayoría de implementaciones, el riesgo es bajo. Se conservan el precio, el endpoint y el formato de las solicitudes: basta con cambiar el ID del modelo. Si usas el alias sin versión fugu-ultra, es probable que ya estés en v1.1 sin haber hecho ningún cambio.

La excepción es la reproducibilidad. Si fijaste deliberadamente fugu-ultra-20260615 para una suite de regresión, un benchmark propio o flujos cuyo resultado debe mantenerse estable, v1.1 supone un cambio de comportamiento, no una mejora gratuita. Una nueva selección de modelos puede modificar tanto el enrutamiento como las salidas, y Sakana no ha publicado un documento de migración con las diferencias. Mantén el ID fijado, prueba primero v1.1 con tu propio conjunto de evaluación y actualiza cuando los resultados se sostengan.

Fugu frente a una gateway de API convencional

Fugu no es la única forma de acceder a muchos modelos frontier desde un único endpoint, así que conviene entender qué cubre ese precio.

Fugu es una capa de orquestación: decide a qué modelos llamar y cómo combinar sus respuestas. Una misma tarea puede distribuirse entre varios modelos, por lo que el coste real por tarea supera la tarifa base por token. Tiene sentido cuando el trabajo es realmente complejo y requiere varios pasos.

Si tu caso se parece más a «llamar de forma fiable y económica a un único modelo potente», una gateway de enrutamiento es una opción más sencilla. Servicios como OpenRouter reúnen muchos modelos tras un endpoint sin el recargo de la orquestación, y plataformas como AIReiter ofrecen acceso directo a las API de Claude y GPT por debajo del precio de lista. La prueba rápida es sencilla: si no puedes señalar una tarea en la que un modelo falle de forma consistente y la coordinación lo resuelva, probablemente estés pagando por una orquestación que no necesitas.

Preguntas frecuentes

¿Fugu-Ultra v1.1 es realmente mejor que v1.0?

Sakana asegura una mejora de hasta 7,9 puntos, concentrada en suites de programación agéntica como ProgramBench y Terminal Bench 2.1. No existe una tabla pública que compare ambos builds benchmark por benchmark, así que conviene confirmar la mejora en tus propias tareas antes de basarte en esa cifra.

¿Cómo puedo seguir usando la compilación v1.0?

Fija el ID de modelo fugu-ultra-20260615 en tus solicitudes, en lugar de fugu-ultra-v1.1 o del alias sin versión fugu-ultra. El alias sigue la compilación más reciente, por lo que dejarlo tal cual te moverá a v1.1.

¿Sakana Fugu es open source?

Solo en parte. El método y el código de apoyo son públicos —la orquestación de Sakana se describe en su trabajo TRINITY—, pero el servicio alojado y el enrutamiento Conductor que decide qué modelos llamar no lo son. Puedes estudiar cómo funciona, pero no autoalojar el orquestador de producción.

¿Puedo usar Fugu-Ultra v1.1 en la UE?

Todavía no. Sakana indica que Fugu no está disponible en la UE/EEE mientras trabaja en el cumplimiento del RGPD y de requisitos específicos de la Unión Europea.

¿Cambia el precio con v1.1?

No. Se lanza con las mismas tarifas que v1.0: $5 de entrada, $30 de salida y $0.50 de caché por millón de tokens, con el nivel superior de $10 / $45 por encima de 272K de contexto.

Lecturas relacionadas