Sakana Fugu 定价与 API 访问指南(2026)

最后更新: 2026-07-15 02:32:56

Sakana Fugu 不是一个新的基础模型。它是一个多代理编排层,位于一个与 OpenAI 兼容的端点后面(模型 ID fugu-ultra-20260615),会将你的请求路由到最适合处理它的底层前沿模型。这一区别对定价很重要:每个 token 的标价并不是你的真实成本,因为 Fugu 还会对幕后发生的协调工作计费。如果你要将其用于生产环境,请将编排开销与标注价格分开预算。

Fugu 实际上是什么:一个编排层,而不是一个模型

Sakana AI 由《Attention Is All You Need》的共同作者 Llion Jones 和前 Google Brain 研究总监 David Ha 创立。他们将产品命名为这一理念:一群鱼(*sakana*)的表现优于任何单独一条鱼,而河豚(fugu)是唯一一种必须每一步都做对,否则就会致命的物种。这个隐喻正是其主张:与其把一切都押在单一模型的弱点上,不如让 Fugu 协调多个模型。

有两个版本。Fugu 是用于编码和聊天式任务的日常版本。Fugu Ultra 则专为更困难的多步骤工作而设计,这类任务中,单一模型往往会在长会话中跑偏或遗漏上下文。其底层的聚合层会进行矛盾检测、置信度加权、思维链保留以及领域感知路由,然后直接交付给你一个答案,而不是多个需要你自行协调的答案。

定价:页面上的数字并不是你最终支付的数字

以下是 Fugu Ultra 的已发布 token 定价,已根据 Sakana 的官方页面进行验证:

层级输入输出缓存输入
标准上下文(≤272K tokens)$5 / M tokens$30 / M tokens$0.50 / M tokens
扩展上下文(>272K tokens)$10 / M tokens$45 / M tokens$1.00 / M tokens

订阅套餐价格为每月 $20(Standard)、每月 $100(Pro,使用量为 10 倍)和每月 $200(Max,使用量为 20 倍)。在 2026 年 7 月底之前注册,Sakana 目前会在任何套餐上赠送第二个月免费,若您计划在本季度试用,现在锁定非常值得。

Base Fugu(非 Ultra)的定价会根据参与的 agent 数量而不同:当由单个 agent 处理任务时,你支付该底层模型的标准费率;当多个 agent 协同工作时,Sakana 表示它从不将各个模型的费用叠加收取——你按所用最高等级模型的费率计费,而不是所有模型费用的总和。

没人替你估算的编排成本

定价页面没有把这一点说清楚,所以这里把算法算给你看。假设你向 Fugu Ultra 发送一个任务,如果只用一次 GPT-5.5 调用来完成,成本会是 $0.03(10K 输入 token、2K 输出 token,按 GPT-5.5 自己的费率计算)。Fugu Ultra 并不是只运行一次;它可能会在内部把同样的、等效于该提示词的工作分派给 2-3 个候选模型,运行一致性检查,然后才返回协调后的答案。如果这又额外增加了至少一轮完整的输入+输出 token,且按 Fugu Ultra 的费率计算,那么原本标价看起来是 $0.03 的工作,实际大约会变成 $0.08-$0.12。对于单次请求来说,这点差异可以忽略不计。但如果一个月把它用于几千次生产调用,标示费率与实际账单之间的差额就会变成足以冲垮预算预测的明细项。

实际可行的结论是:不要仅凭每 token 费率来估算 Fugu Ultra 的成本。在试点期间跟踪已完成任务的成本——按每个已解决工单或已合并 PR 的实际美元成本计算——而不是按每次调用的 token 数计算,并将其与当前单模型方案在相同完成工作量下的成本进行比较。

基准测试:Fugu Ultra vs Claude Fable 5 vs GPT-5.5

基准测试Fugu UltraFuguClaude Fable 5GPT-5.5
SWE-Bench Pro73.759.0
LiveCodeBench93.292.989.885.3
TerminalBench 2.182.180.2
GPQA-Diamond95.595.5
Humanity's Last Exam53.3在 44.3-53.3 范围内在 44.3-53.3 范围内

Sakana 自己的表述——以及早期第三方报道也证实了这一点——是,这种差距在漫长、繁琐、真实世界的工作流程中会扩大,而不是只在孤立的基准测试中体现。就代码审查而言,已有报道称 Fugu Ultra 能发现 GPT-5.5 漏掉的 bug,并给出更完整的答案,这与这样一种系统的预期相符:它在作答前会交叉核对多个模型的输出,而不是一次性就作出决定。如果你想更全面地了解 GPT-5.5 相较于更新的 GPT-5.6 层级处于什么位置,或者 Claude Fable 5 与 Anthropic 自家的 Mythos 系列相比如何,这些解析会更深入地分别讨论每个模型。

如何访问它:直接 API,还是通过聚合器

Fugu 作为与 OpenAI 兼容的 API 提供,Sakana 自己的页面还列出了对 OpenRouter, Vercel, OpenCode, Creao, and Merge 的官方支持——所以如果你已经通过这些中的某一个路由流量,添加 Fugu 只是一次配置更改,而不是新的集成。

在直接连接到 Sakana 之前,有两件事需要了解:

  • EU/EEA 访问目前尚不可用。 Sakana 在其自己的定价页面上直接说明了这一点,将其描述为持续进行中的合规工作,且没有给出明确时间表。没有已确认的变通方法;某个聚合器是否能够绕过该限制,取决于该聚合器的基础设施所在位置,而 Sakana 对此也没有发布任何信息,因此不要因为你是通过第三方接入就想当然地认为问题已经解决。
  • 计费通过 Sakana 自己的仪表板进行,与您已经用于 Claude、GPT 或 Gemini 调用的任何系统分开——如果您本来就在同时管理多个模型提供商,这就又多了一张需要对账的发票。

由于 Fugu 与 OpenAI 兼容,将它添加到现有设置中通常只需在你已经在使用的任意客户端里替换 base URL 和 model 字符串;你在请求/响应处理中的其他部分都无需更改。这也是像 AIReiter 这样已经位于 Claude、GPT 和 Gemini 之前的聚合器能够添加新模型,而无需你修改集成代码的原因。

你应该使用它吗?

当准确性比延迟或成本可预测性更重要时,Fugu Ultra 很有意义——比如长时间运行的编码任务、原本需要你手动交叉核对两到三个模型的研究工作流,或者任何接近单个模型单独能够可靠完成极限的任务。

当你需要实时响应、任务足够简单以至于一个高质量模型就已经能完美胜任,或者你的预算是固定的、无法承受上文所述的编排波动时,就跳过它。对于高频、低复杂度的调用,单个精心选择的模型几乎总是更便宜、也更可预测。

常见问题

Sakana Fugu 是免费的吗?

不。Fugu Ultra 的价格为每百万输入 token 5 美元、每百万输出 token 30 美元(标准上下文),或者通过订阅,起价为每月 20 美元。Sakana 目前正在为 2026 年 7 月底前注册的用户提供第二个月免费的促销活动。

Sakana Fugu 是开源的吗?

Sakana 尚未将 Fugu 的权重或编排代码开源。它仅通过其托管的 OpenAI 兼容 API 提供访问。

Fugu 在 OpenRouter 上可用吗?

是的,这是 Sakana 官方列出的五个平台之一(另外还有 Vercel、OpenCode、Creao 和 Merge),所以如果你已经在其中任何一个平台上完成了设置,就不需要直接拥有 Sakana 账户也可以试用。

在此上下文中,“Fugu”是什么意思?

Fugu 是河豚,是一道在正确处理时无害、处理不当时却很危险的菜。Sakana 特意选这个名字,正是因为它具有这种非黑即白的特性:编排层的整个设计目标,就是捕捉单个模型可能会放过的那一个错误。

结论

基准测试收益是真实存在的,而且在杂乱的多步骤工作中比在孤立的测试运行中体现得更明显。关于 Fugu 的大多数报道忽略了一点:定价页面上的数字并不是在计入编排开销后你实际会被收取的费用,所以要把标示费率当作下限,而不是估算值,并在承诺预算之前先以已完成任务成本进行试点。