Sakana Fugu ist kein neues Foundation Model. Es ist eine Multi-Agent-Orchestrierungsschicht, die hinter einem einzelnen OpenAI-kompatiblen Endpunkt sitzt (Model-ID fugu-ultra-20260615) und Ihre Anfrage an das jeweils passende zugrunde liegende Frontier-Model weiterleitet. Dieser Unterschied ist für die Preisgestaltung wichtig: Der angegebene Preis pro Token ist nicht Ihre tatsächlichen Kosten, denn Fugu berechnet auch die Koordinationsarbeit, die im Hintergrund stattfindet. Wenn Sie es für den produktiven Einsatz bewerten, kalkulieren Sie den Orchestrierungs-Overhead getrennt von dem genannten Tarif ein.
Was Fugu tatsächlich ist: eine Orchestrierungsschicht, kein Modell
Sakana AI wurde von Llion Jones, einem Mitautor von "Attention Is All You Need", und David Ha, dem ehemaligen Forschungsleiter von Google Brain, gegründet. Sie benannten das Produkt nach der Idee, dass ein Fischschwarm (*sakana*) jeden einzelnen Fisch übertrifft, und dass ein Fugu (Kugelfisch) die einzige Art ist, die jede Bewegung richtig machen muss, da es sonst tödlich ist. Die Metapher ist das Kernargument: Statt alles auf die Schwächen eines einzelnen Modells zu setzen, koordiniert Fugu mehrere.
Es gibt zwei Stufen. Fugu ist die Alltagsversion für Coding- und Chat-Aufgaben. Fugu Ultra ist für schwierigere, mehrstufige Arbeiten gebaut, also für Aufgaben, bei denen ein einzelnes Modell dazu neigt, im Verlauf oder über eine lange Sitzung den Kontext zu verlieren. Unter der Haube übernimmt die Aggregationsschicht Widerspruchserkennung, Konfidenzgewichtung, die Beibehaltung von Chain-of-Thought und domänenbewusstes Routing und liefert Ihnen dann eine einzige Antwort statt mehrerer, die Sie selbst abgleichen müssen.
Preisgestaltung: Die Zahl auf der Seite ist nicht die Zahl, die Sie zahlen werden
Hier sind die veröffentlichten Token-Preise von Fugu Ultra, verifiziert anhand der offiziellen Seite von Sakana:
| Stufe | Eingabe | Ausgabe | Zwischengespeicherte Eingabe |
|---|---|---|---|
| Standardkontext (≤272K Tokens) | $5 / M tokens | $30 / M tokens | $0.50 / M tokens |
| Erweiterter Kontext (>272K tokens) | $10 / M tokens | $45 / M tokens | $1.00 / M tokens |
Abonnementpläne kosten 20 $/Monat (Standard), 100 $/Monat (Pro, 10x die Nutzung) und 200 $/Monat (Max, 20x die Nutzung). Melden Sie sich vor Ende Juli 2026 an, und Sakana bietet derzeit einen kostenlosen zweiten Monat für jede Stufe an. Es lohnt sich, das jetzt zu sichern, wenn Sie planen, es in diesem Quartal zu testen.
Base Fugu (nicht-Ultra) wird je nach Anzahl der beteiligten Agents unterschiedlich bepreist: Wenn ein einzelner Agent die Aufgabe übernimmt, zahlen Sie den Standardtarif des zugrunde liegenden Modells; wenn mehrere Agents zusammenarbeiten, sagt Sakana, dass nie die Modellgebühren mehrerer Modelle addiert werden — abgerechnet wird zum Tarif des höchstklassigen verwendeten Modells, nicht zur Summe aller.
Die Orchestrierungskosten, die niemand für Sie beziffert
Die Preisseiten sagen das nicht eindeutig, also hier die Rechnung. Nehmen wir an, Sie senden Fugu Ultra eine Aufgabe, die bei einem einzelnen GPT-5.5-Aufruf 0,03 $ kosten würde (10K Input-Token, 2K Output-Token, zu den eigenen Tarifen von GPT-5.5). Fugu Ultra führt das nicht nur einmal aus; es kann dieselbe promptäquivalente Arbeit intern auf 2-3 Kandidatenmodelle verteilen, einen Widerspruchscheck ausführen und erst dann die abgestimmte Antwort zurückgeben. Wenn dadurch auch nur eine zusätzliche vollständige Runde aus Input- und Output-Token zum Tarif von Fugu Ultra hinzukommt, liegen Sie bei ungefähr 0,08 $-0,12 $ für etwas, das auf dem Etikett wie ein 0,03 $-Job aussah. Bei einer einzelnen Anfrage ist das kaum relevant. Wenn Sie das auf einige tausend Produktionsaufrufe pro Monat hochrechnen, wird die Differenz zwischen dem angegebenen Tarif und der tatsächlichen Rechnung zu dem Posten, der Ihre Budgetprognose sprengt.
Die praktische Erkenntnis: Schätzen Sie die Kosten von Fugu Ultra nicht allein anhand des Token-Preises pro Token. Verfolgen Sie während eines Piloten die Kosten abgeschlossener Aufgaben — die tatsächlichen Dollar pro gelöstem Ticket oder zusammengeführtem PR — nicht die Tokens pro Aufruf, und vergleichen Sie das mit den Kosten Ihres aktuellen Single-Model-Setups für dasselbe Volumen an erledigter Arbeit.
Benchmarks: Fugu Ultra vs Claude Fable 5 vs GPT-5.5
| Benchmark | Fugu Ultra | Fugu | Claude Fable 5 | GPT-5.5 |
|---|---|---|---|---|
| SWE-Bench Pro | 73.7 | 59.0 | — | — |
| LiveCodeBench | 93.2 | 92.9 | 89.8 | 85.3 |
| TerminalBench 2.1 | 82.1 | 80.2 | — | — |
| GPQA-Diamond | 95.5 | 95.5 | — | — |
| Humanity's Last Exam | 53.3 | — | im Bereich von 44.3-53.3 | im Bereich von 44.3-53.3 |
Sakanas eigene Darstellung — und frühe Berichte von Dritten stützen das — lautet, dass sich der Abstand in langen, unübersichtlichen Workflows aus der realen Welt vergrößert und nicht in isolierten Benchmark-Läufen. Gerade bei Code-Reviews soll Fugu Ultra Fehler entdecken, die GPT-5.5 übersieht, und vollständigere Antworten liefern; das passt zu dem, was man von einem System erwarten würde, das die Ausgaben mehrerer Modelle vor der Antwort gegeneinander prüft, statt sich auf einen einzigen Durchlauf festzulegen. Wenn Sie das vollständige Bild dazu wollen, wo GPT-5.5 im Vergleich zur neueren GPT-5.6-Stufe steht oder wie Claude Fable 5 im Vergleich zu Anthropics eigener Mythos-Linie abschneidet, gehen diese Aufschlüsselungen bei jedem Modell einzeln tiefer ins Detail.
Wie man darauf zugreift: direkt über die API oder über einen Aggregator
Fugu wird als OpenAI-kompatible API ausgeliefert, und Sakanas eigene Seite führt offizielle Unterstützung für OpenRouter, Vercel, OpenCode, Creao und Merge auf — wenn du den Traffic bereits über einen dieser Dienste leitest, ist das Hinzufügen von Fugu also eine Konfigurationsänderung und keine neue Integration.
Zwei Dinge, die Sie wissen sollten, bevor Sie sich direkt mit Sakana verbinden:
- Der Zugang aus der EU/EWR ist noch nicht verfügbar. Sakana weist darauf direkt auf der eigenen Preisseite hin und beschreibt dies als laufende Compliance-Arbeit ohne angegebenen Zeitplan. Es gibt keinen bestätigten Workaround; ob ein bestimmter Aggregator die Beschränkung umgehen kann, hängt davon ab, wo die Infrastruktur dieses Aggregators steht, und auch dazu veröffentlicht Sakana nichts. Gehen Sie also nicht davon aus, dass das Problem gelöst ist, nur weil Sie über einen Drittanbieter gehen.
- Die Abrechnung läuft über das eigene Dashboard von Sakana, getrennt von dem, was Sie bereits für Claude-, GPT- oder Gemini-Aufrufe verwenden — eine weitere Rechnung, die Sie abstimmen müssen, wenn Sie ohnehin mehrere Modellanbieter gleichzeitig verwalten.
Da Fugu OpenAI-kompatibel ist, besteht das Hinzufügen zu einem bestehenden Setup normalerweise nur darin, die Base-URL und den Modell-String in dem Client auszutauschen, den Sie bereits verwenden; nichts anderes an Ihrem Request-/Response-Handling muss geändert werden. Deshalb können auch Aggregatoren wie AIReiter, die bereits vor Claude, GPT und Gemini sitzen, ein neues Modell hinzufügen, ohne Sie zu bitten, Ihren Integrationscode anzufassen.
Sollten Sie es verwenden?
Fugu Ultra ist sinnvoll, wenn Genauigkeit wichtiger ist als Latenz oder Kostenplanbarkeit — langlaufende Codierungsaufgaben, Recherche-Workflows, bei denen Sie andernfalls zwei oder drei Modelle manuell gegeneinander prüfen würden, oder alles, was an die Grenze dessen heranreicht, was ein einzelnes Modell allein zuverlässig leisten kann.
Überspringe es, wenn du Echtzeit-Antworten benötigst, die Aufgabe einfach genug ist, dass ein gutes Modell sie bereits perfekt meistert, oder dein Budget fest ist und die oben beschriebene Orchestrierungsvarianz nicht auffangen kann. Bei Anrufen mit hohem Volumen und geringer Komplexität ist ein einzelnes, gut ausgewähltes Modell fast immer günstiger und besser vorhersehbar.
FAQ
Ist Sakana Fugu kostenlos?
Nein. Fugu Ultra kostet $5/M für Input- und $30/M für Output-Tokens (Standardkontext) oder per Abonnement ab $20/Monat. Sakana führt derzeit eine Aktion für den zweiten Monat kostenlos für Anmeldungen vor Ende Juli 2026 durch.
Ist Sakana Fugu Open Source?
Sakana hat Fugu's Gewichte oder Orchestrierungscode nicht als Open Source veröffentlicht. Der Zugriff erfolgt ausschließlich über die gehostete OpenAI-kompatible API.
Ist Fugu auf OpenRouter verfügbar?
Ja, es ist eine von fünf Plattformen, die Sakana offiziell aufführt (neben Vercel, OpenCode, Creao und Merge), sodass Sie kein direktes Konto bei Sakana benötigen, um es auszuprobieren, wenn Sie bereits auf einer dieser Plattformen eingerichtet sind.
Was bedeutet „Fugu“ in diesem Zusammenhang?
Fugu ist Kugelfisch, ein Gericht, das bei richtiger Zubereitung harmlos und andernfalls gefährlich ist. Sakana hat den Namen ganz bewusst wegen dieser Alles-oder-nichts-Eigenschaft gewählt: Das gesamte Designziel der Orchestrierungsschicht besteht darin, den einen Fehler abzufangen, den ein einzelnes Modell durchgelassen hätte.
Kurz gesagt
Die Benchmark-Gewinne sind real, und sie zeigen sich bei unübersichtlicher mehrstufiger Arbeit stärker als bei isolierten Testläufen. Was in der Berichterstattung über Fugu meist fehlt, ist, dass die Zahl auf der Preisseite nicht dem entspricht, was Ihnen am Ende tatsächlich berechnet wird, sobald der Orchestrierungs-Overhead hinzukommt. Behandeln Sie daher den angegebenen Preis als Untergrenze, nicht als Schätzung, und testen Sie mit den Kosten pro abgeschlossenem Task, bevor Sie dafür Budget verbindlich einplanen.
