Руководство по ценам и API-доступу Sakana Fugu (2026)

Последнее обновление: 2026-07-15 02:33:17

Sakana Fugu — это не новая базовая модель. Это многoагентный уровень оркестрации, работающий за одним OpenAI-совместимым endpoint (model ID fugu-ultra-20260615) и перенаправляющий ваш запрос к той базовой frontier-модели, которая лучше всего с ним справится. Это различие важно для ценообразования: указанная цена за token — это не ваша реальная стоимость, потому что Fugu также выставляет счёт за координационную работу, происходящую за кулисами. Если вы оцениваете его для production, закладывайте расходы на orchestration отдельно от указанной ставки.

Что на самом деле представляет собой Fugu: слой оркестрации, а не модель

Sakana AI была основана Ллионом Джонсом, соавтором «Attention Is All You Need», и Дэвидом Ха, бывшим директором по исследованиям Google Brain. Они назвали продукт в честь идеи о том, что косяк рыб (*sakana*) превосходит любую отдельную рыбу, а фугу (рыба-шар) — это тот самый вид, которому необходимо безошибочно выполнять каждое движение, иначе это смертельно. Эта метафора и есть суть: вместо того чтобы ставить всё на слабые стороны одной модели, Fugu координирует несколько.

Существует два уровня. Fugu — это повседневная версия для программирования и задач в формате чата. Fugu Ultra создан для более сложной многосоставной работы — для задач, где одна модель обычно начинает отклоняться или терять контекст в ходе длительной сессии. Под капотом слой агрегации выполняет обнаружение противоречий, взвешивание по уровню уверенности, сохранение chain-of-thought и маршрутизацию с учётом предметной области, а затем выдаёт вам один ответ вместо нескольких, которые пришлось бы сводить самостоятельно.

Ценообразование: цифра на странице — это не та цифра, которую вы заплатите

Вот опубликованные цены Fugu Ultra за токены, подтвержденные на официальной странице Sakana:

УровеньВводВыводКэшированный ввод
Стандартный контекст (≤272K tokens)$5 / M tokens$30 / M tokens$0.50 / M tokens
Расширенный контекст (>272K tokens)$10 / M tokens$45 / M tokens$1.00 / M tokens

Тарифные планы подписки стоят $20/month (Standard), $100/month (Pro, 10x the usage) и $200/month (Max, 20x the usage). Зарегистрируйтесь до конца июля 2026 года, и Sakana сейчас предлагает второй месяц бесплатно на любом тарифе — имеет смысл оформить сейчас, если вы планируете протестировать его в этом квартале.

Base Fugu (не Ultra) оценивается по-разному в зависимости от того, сколько агентов задействовано: когда задачу выполняет один агент, вы платите стандартную ставку базовой модели; когда несколько агентов координируют работу, Sakana говорит, что плата за отдельные модели никогда не суммируется — с вас взимается плата по ставке самой высокоуровневой модели, использованной в работе, а не по сумме всех моделей.

Стоимость оркестрации, которую никто для вас не просчитывает

На страницах с ценами это не объясняется явно, так что вот расчёт. Допустим, вы отправляете Fugu Ultra задачу, которая обошлась бы в $0.03 при одном вызове GPT-5.5 (10K входных токенов, 2K выходных токенов, по собственным тарифам GPT-5.5). Fugu Ultra не выполняет её один раз; он может внутренне распределить эквивалентную по смыслу работу по 2-3 кандидатным моделям, выполнить проверку на противоречия и только затем вернуть согласованный ответ. Если это добавляет хотя бы ещё один полный раунд входных+выходных токенов по тарифу Fugu Ultra, вы смотрите примерно на $0.08-$0.12 за то, что на ценнике выглядело как задача за $0.03. Для одного запроса это несущественно. Но если прогонять это через несколько тысяч production-вызовов в месяц, разница между заявленной ставкой и фактическим счётом становится той строкой расходов, которая ломает ваш бюджетный прогноз.

Практический вывод: не оценивайте затраты на Fugu Ultra только по ставке за токен. Отслеживайте стоимость выполненной задачи во время пилота — фактические доллары за закрытый тикет или слитый PR — а не токены за вызов, и сравнивайте это с тем, во сколько обходится ваша текущая одно-модельная схема при том же объёме завершённой работы.

Бенчмарки: Fugu Ultra против Claude Fable 5 против GPT-5.5

БенчмаркFugu UltraFuguClaude Fable 5GPT-5.5
SWE-Bench Pro73.759.0
LiveCodeBench93.292.989.885.3
TerminalBench 2.182.180.2
GPQA-Diamond95.595.5
Последний экзамен человечества53.3в диапазоне 44.3-53.3в диапазоне 44.3-53.3

Собственная формулировка Sakana — и ранние сторонние сообщения это подтверждают — заключается в том, что разрыв увеличивается в длинных, запутанных, реальных рабочих процессах, а не в изолированных бенчмарк-прогонах. Что касается именно code review, сообщалось, что Fugu Ultra находит баги, которые GPT-5.5 пропускает, и даёт более полные ответы, что согласуется с тем, чего можно ожидать от системы, которая перепроверяет результаты нескольких моделей перед ответом вместо того, чтобы полагаться на один проход. Если вам нужна более полная картина того, где GPT-5.5 стоит по сравнению с более новым уровнем GPT-5.6, или как Claude Fable 5 сопоставляется с собственной линейкой Anthropic Mythos, эти разборы глубже рассматривают каждую модель по отдельности.

Как получить к нему доступ: напрямую через API или через агрегатор

Fugu поставляется как API, совместимый с OpenAI, а на собственной странице Sakana указана официальная поддержка OpenRouter, Vercel, OpenCode, Creao и Merge — так что если вы уже направляете трафик через один из них, добавление Fugu — это изменение конфигурации, а не новая интеграция.

Две вещи, которые нужно знать, прежде чем подключаться напрямую к Sakana:

  • Доступ из ЕС/ЕЭЗ пока недоступен. Sakana прямо указывает это на своей странице с тарифами, описывая ситуацию как текущую работу по соблюдению требований без указанного срока. Подтверждённого обходного решения нет; может ли конкретный агрегатор обойти это ограничение, зависит от того, где расположена инфраструктура этого агрегатора, а Sakana ничего об этом тоже не публикует, так что не стоит считать проблему решённой только потому, что вы используете сторонний сервис.
  • Выставление счетов идёт через собственную панель управления Sakana, отдельно от того, что вы уже используете для запросов к Claude, GPT или Gemini — ещё один счёт, который придётся сверять, если вы и так работаете сразу с несколькими поставщиками моделей.

Поскольку Fugu совместим с OpenAI, добавить его в уже существующую настройку обычно можно, просто заменив базовый URL и строку модели в любом клиенте, который вы уже используете; больше ничего в обработке запросов/ответов менять не нужно. Именно поэтому агрегаторы вроде AIReiter, которые уже работают поверх Claude, GPT и Gemini, могут добавить новую модель, не прося вас трогать код интеграции.

Стоит ли его использовать?

Fugu Ultra имеет смысл, когда точность важнее задержки или предсказуемости затрат — длительные задачи по программированию, исследовательские рабочие процессы, где вы иначе вручную сверяли бы две или три модели, или что-либо, что находится на грани того, что одна модель может надежно выполнить сама.

Пропустите это, когда вам нужны ответы в реальном времени, задача достаточно проста, чтобы одна хорошая модель уже справлялась с ней, или ваш бюджет фиксирован и не может поглотить вариативность оркестрации, описанную выше. Для запросов с большим объёмом и низкой сложностью одна удачно выбранная модель почти всегда будет дешевле и более предсказуемой.

Часто задаваемые вопросы

Сакана Фугу бесплатен?

Нет. Fugu Ultra стоит $5/M за входные и $30/M за выходные токены (стандартный контекст) или доступен по подписке от $20/месяц. Sakana в настоящее время проводит акцию «второй месяц бесплатно» для пользователей, зарегистрировавшихся до конца июля 2026 года.

Открыт ли Sakana Fugu с исходным кодом?

Sakana не опубликовала веса Fugu или код оркестрации как open source. Доступ к нему осуществляется исключительно через их размещённый OpenAI-compatible API.

Доступен ли Fugu на OpenRouter?

Да, это одна из пяти платформ, которые Sakana официально перечисляет (наряду с Vercel, OpenCode, Creao и Merge), так что вам не нужна прямая учетная запись Sakana, чтобы попробовать её, если у вас уже есть доступ к любой из них.

Что означает "Fugu" в данном контексте?

Fugu — это рыба фугу, блюдо, которое безопасно при правильном приготовлении и опасно, если его приготовить неправильно. Sakana выбрала это название именно из-за этого свойства «всё или ничего»: вся цель архитектуры orchestration layer — поймать ту единственную ошибку, которую одна модель пропустила бы.

Итог

Преимущества бенчмарка реальны, и они проявляются в запутанной многошаговой работе сильнее, чем в изолированных тестовых прогонах. Чего чаще всего не хватает в обзорах Fugu, так это понимания, что цифра на странице с ценами — это не то, что вам в итоге выставят к оплате после добавления накладных расходов на оркестрацию, поэтому воспринимайте указанную ставку как нижнюю границу, а не как оценку, и сначала протестируйте стоимость за выполненную задачу, прежде чем выделять на это бюджет.