Sakana Fugu non è un nuovo foundation model. È un livello di orchestrazione multi-agent che si trova dietro un endpoint compatibile con OpenAI (ID modello fugu-ultra-20260615), e instrada la tua richiesta verso il modello frontier sottostante più adatto a gestirla. Questa distinzione è importante per il pricing: il prezzo di listino per token non è il tuo costo reale, perché Fugu addebita anche il lavoro di coordinamento che avviene dietro le quinte. Se lo stai valutando per la produzione, prevedi un budget separato per l’overhead di orchestrazione rispetto alla tariffa indicata.
Cos’è realmente Fugu: un layer di orchestrazione, non un modello
Sakana AI è stata fondata da Llion Jones, coautore di "Attention Is All You Need", e David Ha, ex direttore di ricerca di Google Brain. Hanno chiamato il prodotto ispirandosi all’idea che un banco di pesci (*sakana*) superi qualsiasi singolo pesce, e che un fugu (pesce palla) sia l’unica specie che deve eseguire ogni mossa alla perfezione, altrimenti è fatale. La metafora è il messaggio: invece di puntare tutto sui punti deboli di un singolo modello, Fugu coordina più modelli.
Ci sono due livelli. Fugu è la versione quotidiana per attività di coding e chat. Fugu Ultra è pensato per lavori più difficili e multi-step, il tipo di attività in cui un singolo modello tende a deviare o a perdere il contesto durante una sessione lunga. Sotto il cofano, il livello di aggregazione esegue il rilevamento delle contraddizioni, il weighting della confidenza, la conservazione della chain-of-thought e il routing consapevole del dominio, quindi ti restituisce una sola risposta invece di diverse da dover riconciliare da solo.
Prezzi: il numero sulla pagina non è il numero che pagherai
Ecco i prezzi dei token pubblicati di Fugu Ultra, verificati sulla pagina ufficiale di Sakana:
| Livello | Input | Output | Input memorizzato nella cache |
|---|---|---|---|
| Contesto standard (≤272K token) | $5 / M token | $30 / M token | $0.50 / M token |
| Contesto esteso (>272K token) | $10 / M token | $45 / M token | $1.00 / M token |
I piani di abbonamento costano $20/mese (Standard), $100/mese (Pro, 10x the usage) e $200/mese (Max, 20x the usage). Iscriviti entro la fine di luglio 2026 e Sakana sta attualmente offrendo un secondo mese gratuito su qualsiasi piano, conviene bloccarlo ora se hai intenzione di testarlo in questo trimestre.
Base Fugu (non-Ultra) ha prezzi diversi a seconda di quanti agenti sono coinvolti: quando un singolo agente gestisce il task, paghi la tariffa standard di quel modello sottostante; quando più agenti coordinano il lavoro, Sakana dice che non somma mai le fee per modello una sopra l’altra — ti viene addebitata la tariffa del modello di fascia più alta utilizzato, non la somma di tutti.
Il costo di orchestrazione che nessuno calcola per te
Le pagine dei prezzi non lo spiegano chiaramente, quindi ecco il calcolo. Supponiamo che tu invii a Fugu Ultra un’attività che costerebbe $0.03 in una singola chiamata a GPT-5.5 (10K token in input, 2K token in output, alle tariffe di GPT-5.5). Fugu Ultra non la esegue una sola volta; può distribuire internamente il lavoro equivalente al prompt su 2-3 modelli candidati, eseguire un controllo di contraddizione e solo allora restituire la risposta riconciliata. Se questo aggiunge anche solo un round completo extra di token input+output alla tariffa di Fugu Ultra, stai guardando a circa $0.08-$0.12 per quello che, sull’etichetta, sembrava un lavoro da $0.03. Su una singola richiesta è rumore. Eseguilo su qualche migliaio di chiamate di produzione al mese e il divario tra la tariffa indicata e la fattura reale diventa la voce di bilancio che fa saltare la tua previsione di spesa.
L’insegnamento pratico: non stimare i costi di Fugu Ultra basandoti solo sulla tariffa per token. Durante un pilot, monitora il costo dei task completati — i dollari effettivi per ticket risolto o PR mergiata — non i token per chiamata, e confrontalo con ciò che costa il tuo attuale setup a modello singolo per lo stesso volume di lavoro concluso.
Benchmark: Fugu Ultra vs Claude Fable 5 vs GPT-5.5
| Benchmark | Fugu Ultra | Fugu | Claude Fable 5 | GPT-5.5 |
|---|---|---|---|---|
| SWE-Bench Pro | 73.7 | 59.0 | — | — |
| LiveCodeBench | 93.2 | 92.9 | 89.8 | 85.3 |
| TerminalBench 2.1 | 82.1 | 80.2 | — | — |
| GPQA-Diamond | 95.5 | 95.5 | — | — |
| Humanity's Last Exam | 53.3 | — | nell'intervallo 44.3-53.3 | nell'intervallo 44.3-53.3 |
La stessa impostazione di Sakana — e le prime segnalazioni di terze parti lo confermano — è che il divario si amplia nei workflow lunghi, disordinati e reali, piuttosto che in esecuzioni isolate di benchmark. In particolare, per la code review, è stato riferito che Fugu Ultra riesce a individuare bug che GPT-5.5 non nota e a fornire risposte più complete, il che coincide con quanto ci si aspetterebbe da un sistema che ricontrolla gli output di più modelli prima di rispondere, invece di affidarsi a un'unica passata. Se vuoi un quadro più completo di come GPT-5.5 si colloca rispetto al più recente livello GPT-5.6, oppure di come Claude Fable 5 si confronta con la linea Mythos di Anthropic, quelle analisi approfondiscono ciascun modello singolarmente.
Come accedervi: API diretta, oppure tramite un aggregatore
Fugu viene fornito come API compatibile con OpenAI, e la pagina ufficiale di Sakana elenca il supporto ufficiale per OpenRouter, Vercel, OpenCode, Creao e Merge — quindi, se già instradi il traffico tramite uno di questi, aggiungere Fugu è una modifica di configurazione, non una nuova integrazione.
Due cose da sapere prima di connetterti direttamente a Sakana:
- L'accesso da UE/SEE non è ancora disponibile. Sakana lo dichiara esplicitamente nella propria pagina dei prezzi, presentandolo come un lavoro di conformità in corso senza una tempistica indicata. Non esiste alcun workaround confermato; se un determinato aggregatore possa aggirare la restrizione dipende da dove si trova l'infrastruttura di quell'aggregatore, e Sakana non pubblica nulla nemmeno su questo, quindi non dare per scontato che sia risolto solo perché stai passando da una terza parte.
- La fatturazione passa tramite la dashboard di Sakana, separata da qualunque strumento tu stia già usando per le chiamate a Claude, GPT o Gemini — un'altra fattura da riconciliare se stai già gestendo più provider di modelli.
Poiché Fugu è compatibile con OpenAI, aggiungerlo a una configurazione esistente è solitamente una questione di sostituire l'URL di base e la stringa del modello in qualunque client tu stia già usando; nient'altro nella gestione di request/response deve cambiare. È anche per questo che aggregatori come AIReiter, che già si collocano davanti a Claude, GPT e Gemini, possono aggiungere un nuovo modello senza chiederti di toccare il codice della tua integrazione.
Dovresti usarlo?
Fugu Ultra ha senso quando l’accuratezza conta più della latenza o della prevedibilità dei costi — attività di coding di lunga durata, flussi di lavoro di ricerca in cui altrimenti controlleresti manualmente due o tre modelli, o qualsiasi cosa vicina al limite di ciò che un singolo modello può fare in modo affidabile da solo.
Avoidalo quando hai bisogno di risposte in tempo reale, quando il compito è abbastanza semplice da essere già risolto alla perfezione da un buon modello, oppure quando il tuo budget è fisso e non può assorbire la variabilità di orchestrazione descritta sopra. Per chiamate ad alto volume e bassa complessità, un singolo modello scelto con cura sarà quasi sempre più economico e più prevedibile.
FAQ
Sakana Fugu è gratuito?
No. Fugu Ultra ha un prezzo di $5/M per i token di input e $30/M per i token di output (contesto standard), oppure tramite abbonamento a partire da $20/mese. Sakana sta attualmente offrendo una promozione del secondo mese gratuito per le registrazioni effettuate prima della fine di luglio 2026.
Sakana Fugu è open source?
Sakana non ha pubblicato come open source i pesi di Fugu né il codice di orchestrazione. Vi si accede esclusivamente tramite la sua API ospitata compatibile con OpenAI.
Fugu è disponibile su OpenRouter?
Sì, è una delle cinque piattaforme che Sakana elenca ufficialmente (insieme a Vercel, OpenCode, Creao e Merge), quindi non hai bisogno di un account diretto con Sakana per provarla se sei già registrato su una di quelle.
Cosa significa "Fugu" in questo contesto?
Fugu è il pesce palla, un piatto innocuo se preparato correttamente e pericoloso se non lo è. Sakana ha scelto questo nome proprio per quella proprietà tutto-o-nulla: l’obiettivo progettuale dell’intero livello di orchestrazione è intercettare l’unico errore che un singolo modello avrebbe lasciato passare.
In sintesi
I guadagni del benchmark sono reali, e si vedono più nel lavoro multistep disordinato che nelle esecuzioni di test isolate. Quello che la maggior parte delle coperture di Fugu omette è che il numero nella pagina dei prezzi non è quello che ti verrà effettivamente addebitato una volta aggiunto l'overhead di orchestrazione, quindi considera la tariffa indicata come un minimo, non una stima, e fai un pilot sul costo per task completato prima di impegnare budget su di esso.
