Fugu-Ultra v1.1 : même prix, Sakana annonce un gain de 7,9 points

Dernière mise à jour: 2026-07-24 02:45:30

Pour les équipes qui font déjà passer leurs requêtes par Fugu-Ultra, la mise à jour du 24 juillet 2026 se résume assez simplement : le tarif ne bouge pas, les modèles mobilisés sont plus récents, et Sakana revendique jusqu’à 7,9 points de progrès. Reste à distinguer ce que cette promesse de benchmark permet réellement d’établir — et pourquoi certains utilisateurs auraient tort de migrer sans vérifier.

Fugu-Ultra n’est pas un modèle au sens habituel du terme. C’est l’offre haut de gamme de Sakana Fugu, une couche d’orchestration qui reçoit un appel API unique, le répartit entre plusieurs modèles de pointe en leur attribuant des rôles — planification, exécution ou vérification, par exemple — puis assemble leurs contributions en une réponse. La configuration est détaillée sur la page officielle de Fugu de Sakana, qui sert également de source aux informations de prix, de benchmarks et de disponibilité ci-dessous.

Page d’accueil de Sakana Fugu présentant le service comme une couche d’orchestration pilotant plusieurs modèles de pointe via une seule API

Fugu-Ultra v1.1 : ce qui évolue vraiment

Avec v1.1, Sakana remplace les modèles de pointe utilisés en arrière-plan par des versions plus récentes. Il s’agit d’un rafraîchissement plutôt que d’une refonte : le système d’orchestration reste identique, le pool de modèles qui exécute le travail est mis à niveau, et les trois offres — Fugu, Fugu-Ultra et Fugu-Cyber — sont conservées.

Dans son annonce de lancement, Sakana met en avant un gain pouvant atteindre 7,9 points par rapport à v1.0. Les plus fortes progressions concerneraient ProgramBench et Terminal Bench 2.1, deux suites de coding agentique en plusieurs étapes, où un modèle isolé perd plus facilement le fil. C’est précisément le type de tâche pour lequel l’orchestration a du sens, donc la tendance paraît cohérente. L’ampleur du gain reste toutefois un chiffre communiqué par Sakana : voici ce qu’il est possible, ou non, de contrôler publiquement.

Benchmarks : les chiffres disponibles et les zones d’ombre

Voici les scores actuellement publiés par Sakana pour Fugu-Ultra :

Graphique en barres des scores de benchmark de Fugu-Ultra : GPQA-Diamond 95.5, LiveCodeBench 93.2, MRCRv2 93.6, LiveCodeBench Pro 90.8, Terminal Bench 2.1 82.1, SWE-Bench Pro 73.7, Humanity's Last Exam 50.0

Avant de considérer le +7,9 comme acquis, deux éléments méritent attention.

Le tableau public des benchmarks ne distingue pas les versions. Il affiche des scores Fugu-Ultra, sans colonne v1.0 face à une colonne v1.1 : impossible, donc, de vérifier les écarts par benchmark derrière le chiffre de 7,9 points. Les résultats visibles — SWE-Bench Pro à 73.7, Terminal Bench 2.1 à 82.1 et LiveCodeBench à 93.2 — correspondent aux mêmes valeurs déjà publiées pour la version v1.0. Le tableau accessible aujourd’hui ne matérialise donc pas encore le gain annoncé.

ProgramBench, pourtant cité dans l’annonce comme l’un des benchmarks affichant les meilleurs progrès, est totalement absent de la fiche de scores publique.

Cela ne signifie pas que l’annonce est erronée. Mais pour choisir des modèles à partir de résultats chiffrés, la position honnête est la suivante : considérez le gain maximal de 7,9 points comme une affirmation du fournisseur et testez-le sur vos propres tâches avant de reprendre un écart que Sakana n’a pas documenté publiquement.

Tarifs et accès : rien ne change

La v1.1 n’entraîne aucune hausse tarifaire. Fugu-Ultra coûte $5 par million de tokens en entrée et $30 par million de tokens en sortie. Au-delà de 272K de contexte dans une requête, les tarifs passent à $10 / $45 ; les entrées en cache restent facturées $0.50 par million. Les abonnements à $20, $100 et $200 par mois sont également maintenus. Pour évaluer le coût réel une fois les surcoûts de l’orchestration pris en compte, notre guide des tarifs et de l’API Sakana Fugu est mis à jour par offre.

L’identifiant du modèle est fugu-ultra-v1.1 ; celui de la version précédente était fugu-ultra-20260615. Attention également si vous êtes hors des États-Unis : Sakana indique que Fugu n’est pas disponible dans l’UE/EEE pendant ses travaux de mise en conformité avec le RGPD.

Faut-il quitter la version v1.0 ?

Dans la plupart des configurations, la migration présente peu de risques. Même prix, même endpoint, même format de requête : il suffit de modifier l’identifiant du modèle. Si vous utilisez l’alias non versionné fugu-ultra, vous êtes probablement déjà passé à v1.1 sans intervention de votre part.

L’exception concerne la reproductibilité. Si vous aviez volontairement épinglé fugu-ultra-20260615 pour une suite de régression, un benchmark maison ou des sorties qui doivent rester stables, v1.1 constitue un changement de comportement, pas un simple gain gratuit. Un pool de modèles renouvelé peut modifier le routage comme les réponses, et Sakana n’a publié aucun diff de migration. Conservez l’identifiant épinglé, confrontez d’abord v1.1 à votre propre jeu d’évaluation, puis migrez lorsque les résultats sont satisfaisants.

Fugu face à une passerelle API classique

Fugu n’est pas le seul moyen d’accéder à de nombreux modèles de pointe depuis un endpoint unique. Il est donc utile de comprendre précisément ce que rémunère ce tarif.

Fugu est une couche d’orchestration : elle choisit quels modèles appeler et comment fusionner leurs résultats. Une même tâche peut être distribuée à plusieurs modèles, ce qui fait grimper le coût réel par tâche au-delà du prix de base par token. C’est un compromis pertinent lorsque le travail est réellement complexe et composé de plusieurs étapes.

Si votre besoin consiste plutôt à « appeler un seul modèle robuste, de façon fiable et économique », une passerelle de routage est plus simple. Des services comme OpenRouter donnent accès à de nombreux modèles via un endpoint unique sans surcoût d’orchestration, tandis que des plateformes telles qu’AIReiter proposent un accès direct aux API Claude et GPT sous le prix catalogue. Le test est simple : si vous ne pouvez pas identifier une tâche pour laquelle un modèle seul échoue régulièrement mais où la coordination résout le problème, vous payez sans doute pour une orchestration dont vous n’avez pas besoin.

FAQ

Fugu-Ultra v1.1 est-il réellement meilleur que v1.0 ?

Sakana annonce jusqu’à 7,9 points de gain, principalement sur des suites de coding agentique comme ProgramBench et Terminal Bench 2.1. Aucun tableau public ne compare les deux versions benchmark par benchmark : validez donc ce gain sur vos propres tâches avant de vous appuyer sur ce chiffre.

Comment rester sur l’ancienne version v1.0 ?

Épinglez l’identifiant fugu-ultra-20260615 dans vos requêtes, au lieu de fugu-ultra-v1.1 ou de l’alias non versionné fugu-ultra. Cet alias suit la version la plus récente : en le conservant, vous passerez à v1.1.

Sakana Fugu est-il open source ?

En partie. La méthode et le code d’accompagnement sont publiés — l’orchestration de Sakana est décrite dans ses travaux sur TRINITY — mais le service hébergé et le routage Conductor, qui décide quels modèles appeler, ne le sont pas. Il est possible d’étudier son fonctionnement, mais pas d’auto-héberger l’orchestrateur de production.

Puis-je utiliser Fugu-Ultra v1.1 dans l’UE ?

Pas encore. Sakana indique que Fugu est indisponible dans l’UE/EEE pendant la préparation de sa conformité au RGPD et aux exigences propres à l’Union européenne.

Le prix change-t-il avec v1.1 ?

Non. Les tarifs sont identiques à ceux de v1.0 : $5 en entrée, $30 en sortie et $0.50 pour le cache par million de tokens, avec le palier supérieur à $10 / $45 au-delà de 272K de contexte.

À lire aussi