Sakana Fugu 가격 및 API 액세스 가이드 (2026)

마지막 업데이트: 2026-07-15 02:33:10

Sakana Fugu는 새로운 foundation model이 아닙니다. 이는 하나의 OpenAI-compatible endpoint(fugu-ultra-20260615 모델 ID) 뒤에 위치한 multi-agent orchestration layer로, 요청을 가장 잘 처리할 수 있는 기반 frontier model로 라우팅합니다. 이 차이는 가격 책정에서 중요합니다. 토큰당 표시 가격이 실제 비용은 아니기 때문입니다. Fugu는 이면에서 수행되는 coordination work에 대해서도 요금을 청구합니다. 프로덕션용으로 평가한다면, 제시된 요율과는 별도로 orchestration overhead를 예산에 반영해야 합니다.

Fugu가 실제로 무엇인지: 모델이 아닌 오케스트레이션 계층

Sakana AI는 "Attention Is All You Need"의 공동 저자인 Llion Jones와 전 Google Brain 연구 디렉터 David Ha가 설립했습니다. 그들은 한 무리의 물고기(*sakana*)가 어떤 단일 물고기보다 더 뛰어난 성과를 낸다는 생각, 그리고 복어(fugu)는 모든 움직임을 정확히 해내지 못하면 치명적이라는 점에서 제품 이름을 붙였습니다. 이 비유가 바로 핵심 메시지입니다. 하나의 모델의 약점에 모든 것을 걸기보다, Fugu는 여러 모델을 조율합니다.

두 가지 티어가 있습니다. Fugu는 코딩과 채팅 스타일 작업을 위한 일상용 버전입니다. Fugu Ultra는 더 어려운 다단계 작업을 위해 설계되었으며, 단일 모델이 긴 세션에서 맥락을 놓치거나 흐트러지기 쉬운 유형의 작업에 적합합니다. 내부적으로는 aggregation layer가 모순 감지, 신뢰도 가중치 적용, chain-of-thought 유지, 도메인 인식 라우팅을 수행한 뒤, 사용자가 직접 여러 결과를 조율할 필요 없이 하나의 답변을 제공합니다.

가격: 페이지에 적힌 숫자가 실제로 지불할 금액은 아닙니다

다음은 Sakana의 공식 페이지에서 검증한 Fugu Ultra의 공개된 토큰 가격입니다:

등급입력출력캐시된 입력
표준 컨텍스트(≤272K tokens)$5 / M tokens$30 / M tokens$0.50 / M tokens
확장 컨텍스트(>272K tokens)$10 / M tokens$45 / M tokens$1.00 / M tokens

구독 요금제는 월 $20(Standard), 월 $100(Pro, 사용량 10배), 월 $200(Max, 사용량 20배)입니다. 2026년 7월 말 전에 가입하면 Sakana는 현재 어떤 요금제에서든 무료로 두 번째 달을 제공하고 있으므로, 이번 분기에 테스트할 계획이라면 지금 등록해 두는 것이 좋습니다.

Base Fugu(Ultra 아님)은 몇 명의 에이전트가 관여하는지에 따라 가격이 달라집니다. 단일 에이전트가 작업을 처리할 때는 해당 기반 모델의 표준 요금을 지불하고, 여러 에이전트가 협업할 때는 Sakana에 따르면 모델별 요금을 서로 겹쳐서 부과하지 않습니다. 즉, 사용된 모델들 중 가장 상위 등급 모델의 요금이 청구되며, 모든 요금의 합계가 청구되는 것은 아닙니다.

아무도 대신 산정해 주지 않는 오케스트레이션 비용

가격 페이지에는 이 내용이 명확하게 적혀 있지 않아서, 계산을 해보겠습니다. Fugu Ultra에 단일 GPT-5.5 호출에서 $0.03이 들 작업을 보낸다고 합시다(입력 토큰 10K, 출력 토큰 2K, GPT-5.5 자체 요금 기준). Fugu Ultra는 그 작업을 한 번만 실행하지 않습니다. 내부적으로 동일한 프롬프트에 준하는 작업을 2~3개의 후보 모델에 분산해 실행하고, 모순 검사도 수행한 다음에야 정리된 답변을 반환할 수 있습니다. 여기에 Fugu Ultra 요금 기준으로 입력+출력 토큰의 전체 한 라운드가 한 번 더 추가되기만 해도, 겉보기에 $0.03짜리 작업이 실제로는 대략 $0.08-$0.12가 됩니다. 단일 요청에서는 티도 안 날 정도입니다. 하지만 이걸 한 달에 수천 건의 프로덕션 호출에 적용하면, 안내된 요금과 실제 청구액의 차이는 예산 예측을 무너뜨리는 항목이 됩니다.

실질적인 핵심: Fugu Ultra 비용을 per-token rate만으로 추정하지 마세요. 파일럿 동안 완료된 작업 비용을 추적하세요 — 호출당 토큰이 아니라 해결된 티켓 또는 병합된 PR당 실제 달러 비용을 — 그리고 이를 현재의 단일 모델 설정이 동일한 작업 완료량에 드는 비용과 비교하세요.

벤치마크: Fugu Ultra vs Claude Fable 5 vs GPT-5.5

벤치마크Fugu UltraFuguClaude Fable 5GPT-5.5
SWE-Bench Pro73.759.0
LiveCodeBench93.292.989.885.3
TerminalBench 2.182.180.2
GPQA-Diamond95.595.5
Humanity's Last Exam53.344.3-53.3 범위44.3-53.3 범위

Sakana의 자체 설명은 — 그리고 초기 제3자 보도도 이를 뒷받침합니다 — 격차가 개별 벤치마크 실행보다 길고 복잡한 실제 워크플로에서 더 벌어진다는 것입니다. 특히 코드 리뷰에서는 Fugu Ultra가 GPT-5.5가 놓치는 버그를 잡아내고 더 완전한 답변을 제공한다는 보도가 있었으며, 이는 한 번의 응답에 바로 확정하지 않고 답변하기 전에 여러 모델의 출력을 교차 검증하는 시스템이라면 기대할 수 있는 바와도 들어맞습니다. GPT-5.5가 더 새로운 GPT-5.6 계층과 비교해 어느 정도인지, 또는 Claude Fable 5가 Anthropic의 Mythos 라인과 어떻게 비교되는지에 대한 더 자세한 그림을 원하신다면, 이러한 분석은 각 모델을 개별적으로 더 깊이 다룹니다.

접근 방법: 직접 API 또는 집계기를 통해

Fugu는 OpenAI 호환 API로 제공되며, Sakana의 자체 페이지에는 OpenRouter, Vercel, OpenCode, Creao, and Merge에 대한 공식 지원이 나와 있습니다. 따라서 이미 이들 중 하나를 통해 트래픽을 라우팅하고 있다면, Fugu를 추가하는 것은 새로운 통합이 아니라 설정 변경입니다.

사카나에 직접 연결하기 전에 알아야 할 두 가지:

  • EU/EEA 액세스는 아직 사용할 수 없습니다. Sakana는 자체 가격 페이지에서 이를 직접 밝히며, 현재 일정이 정해지지 않은 상태의 지속적인 규정 준수 작업으로 설명합니다. 확인된 우회 방법은 없으며, 특정 aggregator가 제한을 우회해 라우팅할 수 있는지는 해당 aggregator의 인프라가 어디에 위치하는지에 달려 있습니다. 또한 Sakana는 이에 대해서도 별도로 공개하는 내용이 없으므로, 제3자를 통해 이용한다고 해서 문제가 해결된 것으로 가정하지 마십시오.
  • 청구는 Sakana의 자체 대시보드를 통해 처리됩니다. Claude, GPT 또는 Gemini 호출에 이미 사용 중인 도구와는 별도로 운영되며, 이미 여러 모델 제공업체를 함께 사용하고 있다면 조정해야 할 송장이 하나 더 생깁니다.

Fugu는 OpenAI-compatible이므로, 기존 설정에 추가하는 일은 일반적으로 이미 사용 중인 어떤 클라이언트에서든 base URL과 model string을 바꾸는 것만으로 충분합니다. 요청/응답 처리의 다른 부분은 변경할 필요가 없습니다. 또한 이것이 바로 AIReiter처럼 이미 Claude, GPT, Gemini 앞단에 위치한 aggregator들이 통합 코드를 건드리지 않도록 하면서도 새로운 model을 추가할 수 있는 이유이기도 합니다.

사용해야 할까요?

Fugu Ultra는 정확성이 지연 시간이나 비용 예측 가능성보다 더 중요할 때 적합합니다 — 장시간 진행되는 코딩 작업, 원래라면 두세 개의 모델을 수동으로 교차 검토해야 하는 리서치 워크플로, 또는 단일 모델이 혼자서 안정적으로 수행할 수 있는 범위의 한계에 가까운 모든 작업에 적합합니다.

실시간 응답이 필요하거나, 작업이 충분히 단순해서 하나의 좋은 모델만으로도 이미 완벽하게 처리할 수 있거나, 예산이 고정되어 있어 위에서 설명한 오케스트레이션 변동성을 감당할 수 없을 때는 이를 건너뛰세요. 대량의 저복잡도 호출의 경우, 잘 선택한 단일 모델이 거의 항상 더 저렴하고 더 예측 가능합니다.

자주 묻는 질문

Sakana Fugu는 무료인가요?

아니요. Fugu Ultra는 표준 컨텍스트에서 입력 토큰 $5/M, 출력 토큰 $30/M의 가격이며, 또는 월 $20부터 시작하는 구독으로 이용할 수 있습니다. Sakana는 현재 2026년 7월 말 이전에 가입한 사용자에게 두 번째 달을 무료로 제공하는 프로모션을 진행 중입니다.

Sakana Fugu는 오픈 소스인가요?

Sakana는 Fugu의 가중치나 오케스트레이션 코드를 오픈 소스로 공개하지 않았습니다. 이는 호스팅된 OpenAI 호환 API를 통해서만 접근할 수 있습니다.

OpenRouter에서 Fugu를 사용할 수 있나요?

네, 그것은 Sakana가 공식적으로 나열한 다섯 개 플랫폼 중 하나이며(Vercel, OpenCode, Creao, Merge와 함께), 이미 그중 어느 하나를 사용 중이라면 Sakana와 직접 계정을 만들 필요 없이 사용해 볼 수 있습니다.

이 문맥에서 "Fugu"는 무엇을 의미하나요?

Fugu는 복어로, 제대로 조리하면 무해하지만 그렇지 않으면 위험한 요리입니다. Sakana는 바로 그 올 아니면 전무의 특성을 염두에 두고 이 이름을 선택했습니다. 오케스트레이션 레이어의 전체 설계 목표는 단일 모델이라면 그냥 통과시켰을 단 하나의 실수를 잡아내는 것입니다.

핵심 요약

벤치마크 성과는 실제이며, 고립된 테스트 실행보다 복잡한 다단계 작업에서 더 두드러집니다. Fugu에 대한 대부분의 보도에서 놓치는 점은, 가격 페이지에 표시된 숫자가 오케스트레이션 오버헤드가 추가되면 실제로 청구될 금액이 아니라는 것입니다. 따라서 제시된 요금을 추정치가 아닌 하한선으로 간주하고, 예산을 투입하기 전에 완료된 작업당 비용으로 먼저 시범 적용해 보세요.