Sakana Fugu não é um novo modelo de fundação. É uma camada de orquestração multiagente situada atrás de um endpoint compatível com a OpenAI (ID do modelo fugu-ultra-20260615), encaminhando sua solicitação para o modelo de fronteira subjacente que melhor a resolve. Essa distinção é importante para os preços: o preço de tabela por token não é o seu custo real, porque o Fugu também cobra pelo trabalho de coordenação que acontece nos bastidores. Se você estiver avaliando isso para produção, reserve orçamento para a sobrecarga de orquestração separadamente da taxa informada.
O que o Fugu realmente é: uma camada de orquestração, não um modelo
A Sakana AI foi fundada por Llion Jones, coautor de "Attention Is All You Need", e David Ha, ex-diretor de pesquisa do Google Brain. Eles nomearam o produto com base na ideia de que um cardume de peixes (*sakana*) supera qualquer peixe sozinho, e que um fugu (baiacu) é a única espécie que precisa acertar cada movimento, ou isso é fatal. A metáfora é a proposta: em vez de apostar tudo nas fraquezas de um único modelo, o Fugu coordena vários.
Há dois níveis. Fugu é a versão do dia a dia para tarefas de programação e no estilo de chat. Fugu Ultra foi desenvolvido para trabalhos mais difíceis, com várias etapas, o tipo de tarefa em que um único modelo tende a se desviar ou perder o contexto ao longo de uma sessão longa. Nos bastidores, a camada de agregação faz detecção de contradições, ponderação de confiança, retenção de chain-of-thought e roteamento ciente do domínio, e então entrega a você uma única resposta em vez de várias para que você mesmo as reconcili em.
Preços: o número na página não é o número que você pagará
Aqui está a precificação de tokens publicada do Fugu Ultra, verificada na página oficial da Sakana:
| Nível | Entrada | Saída | Entrada em cache |
|---|---|---|---|
| Contexto padrão (≤272K tokens) | $5 / M tokens | $30 / M tokens | $0.50 / M tokens |
| Contexto estendido (>272K tokens) | $10 / M tokens | $45 / M tokens | $1.00 / M tokens |
Os planos de assinatura custam US$20/mês (Standard), US$100/mês (Pro, 10x o uso) e US$200/mês (Max, 20x o uso). Inscreva-se antes do fim de julho de 2026 e a Sakana está atualmente oferecendo um segundo mês grátis em qualquer plano, vale a pena garantir agora se você pretende testá-lo neste trimestre.
O Base Fugu (não Ultra) tem preços diferentes dependendo de quantos agentes participam: quando um único agente lida com a tarefa, você paga a taxa padrão desse modelo subjacente; quando vários agentes coordenam, a Sakana diz que nunca acumula as taxas por modelo umas sobre as outras — você é cobrado pela taxa do modelo de nível mais alto usado, não pela soma de todos eles.
O custo de orquestração que ninguém calcula para você
As páginas de preços não explicam isso claramente, então aqui vai a conta. Suponha que você envie ao Fugu Ultra uma tarefa que custaria US$ 0,03 em uma única chamada ao GPT-5.5 (10K tokens de entrada, 2K tokens de saída, nas próprias taxas do GPT-5.5). O Fugu Ultra não executa isso uma vez; ele pode distribuir internamente o mesmo trabalho equivalente ao prompt entre 2-3 modelos candidatos, executar uma verificação de contradição e só então retornar a პასუხa reconciliada. Se isso acrescentar até mesmo uma rodada completa extra de tokens de entrada+saída na taxa do Fugu Ultra, você estará olhando para cerca de US$ 0,08-US$ 0,12 por aquilo que parecia um trabalho de US$ 0,03 no rótulo. Em uma única solicitação isso é ruído. Execute isso em alguns milhares de chamadas de produção por mês e a diferença entre a taxa cotada e a fatura real se torna o item que estoura sua previsão de orçamento.
A conclusão prática: não estime os custos do Fugu Ultra apenas pela tarifa por token. Acompanhe o custo por tarefa concluída durante um piloto — dólares reais por ticket resolvido ou PR mesclado — não tokens por chamada, e compare isso com o que sua configuração atual de modelo único custa para o mesmo volume de trabalho concluído.
Benchmarks: Fugu Ultra vs Claude Fable 5 vs GPT-5.5
| Benchmark | Fugu Ultra | Fugu | Claude Fable 5 | GPT-5.5 |
|---|---|---|---|---|
| SWE-Bench Pro | 73.7 | 59.0 | — | — |
| LiveCodeBench | 93.2 | 92.9 | 89.8 | 85.3 |
| TerminalBench 2.1 | 82.1 | 80.2 | — | — |
| GPQA-Diamond | 95.5 | 95.5 | — | — |
| Humanity's Last Exam | 53.3 | — | na faixa de 44.3-53.3 | na faixa de 44.3-53.3 |
A própria formulação da Sakana — e relatos iniciais de terceiros подтверждают isso — é que a diferença aumenta em fluxos de trabalho longos, confusos e do mundo real, em vez de em execuções isoladas de benchmarks. Especificamente em revisão de código, foi relatado que o Fugu Ultra detecta bugs que o GPT-5.5 não percebe e fornece respostas mais completas, o que está alinhado ao que se esperaria de um sistema que cruza as saídas de vários modelos antes de responder, em vez de se comprometer com uma única passagem. Se você quiser uma visão mais completa de onde o GPT-5.5 se posiciona em relação à nova categoria GPT-5.6, ou de como o Claude Fable 5 se compara à própria linha Mythos da Anthropic, essas análises se aprofundam em cada modelo individualmente.
Como acessar: API direta ou por meio de um agregador
Fugu é disponibilizado como uma API compatível com OpenAI, e a própria página da Sakana lista suporte oficial para OpenRouter, Vercel, OpenCode, Creao e Merge — então, se você já está roteando tráfego por meio de um desses, adicionar Fugu é uma mudança de configuração, não uma nova integração.
Duas coisas para saber antes de se conectar diretamente ao Sakana:
- O acesso da UE/EEE ainda não está disponível. A Sakana afirma isso diretamente em sua própria página de preços, enquadrando como trabalho contínuo de conformidade, sem prazo declarado. Não há uma alternativa confirmada; se um agregador específico consegue contornar a restrição depende de onde a infraestrutura desse agregador está localizada, e a Sakana também não publica nada sobre isso, então não presuma que está resolvido só porque você está passando por um terceiro.
- A cobrança é feita pelo próprio painel da Sakana, separadamente de qualquer coisa que você já esteja usando para chamadas ao Claude, GPT ou Gemini — mais uma fatura para conciliar se você já estiver lidando com vários provedores de modelos.
Como o Fugu é compatível com a OpenAI, adicioná-lo a uma configuração existente geralmente é apenas uma questão de trocar a URL base e a string do modelo no cliente que você já está usando; nada mais no tratamento de solicitação/resposta precisa mudar. É também por isso que agregadores como AIReiter, que já ficam na frente do Claude, GPT e Gemini, podem adicionar um novo modelo sem pedir que você toque no seu código de integração.
Deveria usá-lo?
Fugu Ultra faz sentido quando a precisão importa mais do que a latência ou a previsibilidade de custo — tarefas de codificação de longa duração, fluxos de trabalho de pesquisa em que você, de outra forma, faria a verificação manual de dois ou três modelos, ou qualquer coisa próxima ao limite do que um único modelo pode fazer de forma confiável sozinho.
Pule isso quando você precisar de respostas em tempo real, a tarefa for simples o suficiente para que um bom modelo já a resolva perfeitamente, ou seu orçamento for fixo e não puder absorver a variação de orquestração descrita acima. Para chamadas de alto volume e baixa complexidade, um único modelo bem escolhido quase sempre será mais barato e mais previsível.
Perguntas Frequentes
O Sakana Fugu é gratuito?
Não. O Fugu Ultra é precificado em US$ 5/M de tokens de entrada e US$ 30/M de tokens de saída (contexto padrão), ou por assinatura a partir de US$ 20/mês. A Sakana está atualmente realizando uma promoção de segundo mês grátis para inscrições feitas antes do fim de julho de 2026.
O Sakana Fugu é open source?
A Sakana não publicou os pesos do Fugu nem o código de orquestração como código aberto. O acesso é feito exclusivamente por meio de sua API hospedada compatível com OpenAI.
O Fugu está disponível no OpenRouter?
Sim, é uma das cinco plataformas que a Sakana lista oficialmente (junto com Vercel, OpenCode, Creao e Merge), então você não precisa de uma conta direta com a Sakana para testá-la se já estiver configurado em qualquer uma delas.
O que "Fugu" significa neste contexto?
Fugu é baiacu, um prato que é inofensivo quando preparado corretamente e perigoso quando não é. A Sakana escolheu o nome especificamente por essa característica de tudo ou nada: o objetivo de design de toda a camada de orquestração é detectar o único erro que um único modelo teria deixado passar.
Conclusão
Os ganhos do benchmark são reais, e eles aparecem mais em trabalhos complexos de várias etapas do que em execuções de teste isoladas. O que a maior parte da cobertura sobre o Fugu deixa passar é que o número na página de preços não é o que você realmente será cobrado depois que o overhead de orquestração for incluído; portanto, trate a taxa informada como um piso, não como uma estimativa, e faça um piloto com base no custo por tarefa concluída antes de comprometer orçamento com isso.
