Fugu-Ultra v1.1: цена прежняя, Sakana заявляет прирост до 7,9 пункта

Последнее обновление: 2026-07-24 02:47:06

Обновление Fugu-Ultra от 24 июля 2026 года можно описать коротко: цена не изменилась, внутри появились более новые модели, а Sakana заявляет улучшение до 7,9 пункта. Но перед переходом стоит разобраться, что именно подтверждают опубликованные бенчмарки, а также почему некоторым пользователям не следует обновляться без проверки.

Fugu-Ultra — не модель в привычном смысле. Это старший тариф Sakana Fugu, слоя оркестрации: один API-вызов распределяется между набором frontier-моделей, которым назначаются роли планировщика, исполнителя или проверяющего, после чего система собирает единый ответ. Принцип работы описан на официальной странице Sakana Fugu; там же приведены данные о ценах, бенчмарках и доступности, на которые мы опираемся ниже.

Главная страница Sakana Fugu, где сервис описан как слой оркестрации для управления несколькими frontier-моделями через один API

Что изменилось в Fugu-Ultra v1.1

В v1.1 Sakana обновила набор используемых внутри frontier-моделей. Это скорее плановое обновление, чем переработка сервиса: сама система оркестрации осталась прежней, изменились модели, выполняющие задачи. Сохранились и все три уровня: Fugu, Fugu-Ultra и Fugu-Cyber.

Главное заявление из анонса Sakana — прирост до 7,9 пункта относительно v1.0. Наиболее заметные улучшения, по словам компании, пришлись на ProgramBench и Terminal Bench 2.1: это наборы многошаговых задач для агентного программирования, где одиночная модель легко теряет контекст работы. Именно для таких сценариев оркестрация и предназначена, поэтому направление улучшений выглядит логичным. Однако величина прироста — собственная оценка Sakana, и ниже разберём, что в ней можно проверить, а что пока нет.

Бенчмарки: что известно, а чего Sakana не раскрыла

Сейчас Sakana публикует для Fugu-Ultra следующие результаты:

Столбчатая диаграмма с результатами бенчмарков Fugu-Ultra: GPQA-Diamond 95.5, LiveCodeBench 93.2, MRCRv2 93.6, LiveCodeBench Pro 90.8, Terminal Bench 2.1 82.1, SWE-Bench Pro 73.7, Humanity's Last Exam 50.0

Прежде чем считать +7,9 уже доказанным результатом, важно учесть два момента.

В открытой таблице бенчмарков нет разбивки по версиям. Там указаны результаты Fugu-Ultra, но нет соседних столбцов для v1.0 и v1.1, поэтому проверить прирост по каждому бенчмарку, из которого складывается цифра 7,9 пункта, невозможно. Более того, видимые показатели — SWE-Bench Pro 73.7, Terminal Bench 2.1 82.1 и LiveCodeBench 93.2 — уже публиковались для сборки v1.0. То есть публичная таблица пока не демонстрирует заявленное улучшение.

ProgramBench, который в анонсе назван одним из бенчмарков с наибольшим приростом, в открытой таблице результатов вовсе отсутствует.

Это не означает, что заявление Sakana неверно. Но если выбор моделей для вас опирается на цифры, корректная позиция такая: прирост до 7,9 пункта следует считать заявлением поставщика и проверять на собственных задачах, прежде чем ссылаться на разницу, которую Sakana публично не раскрыла.

Цена и доступность остались прежними

С выходом v1.1 цены не изменились. Fugu-Ultra стоит $5 за миллион входных токенов и $30 за миллион выходных. Если запрос превышает 272K контекста, ставки возрастают до $10 / $45; кешированный ввод стоит $0.50 за миллион токенов. Без изменений остались и подписки за $20, $100 и $200 в месяц. О том, во что это выливается с учётом накладных расходов на оркестрацию, читайте в нашем регулярно обновляемом гайде по ценам и API Sakana Fugu с разбором каждого тарифа.

Идентификатор новой модели — fugu-ultra-v1.1, предыдущей сборки — fugu-ultra-20260615. Есть и ограничение по регионам: Sakana указывает, что Fugu недоступна в ЕС/ЕЭЗ, пока компания работает над соответствием GDPR.

Стоит ли переходить с v1.0?

Для большинства сценариев переход не несёт большого риска. Цена, endpoint и формат запросов те же: достаточно сменить ID модели. А если вы используете неверсионированный алиас fugu-ultra, то, вероятно, уже работаете с v1.1 — и никаких действий с вашей стороны не требовалось.

Исключение — воспроизводимость. Если вы намеренно закрепили fugu-ultra-20260615 для набора регрессионных тестов, собственного бенчмарка или сценария, где вывод должен быть стабильным, v1.1 нельзя считать бесплатным улучшением: это изменение поведения. Обновлённый пул моделей способен изменить маршрутизацию и ответы, а Sakana не публиковала описание различий для миграции. Оставьте закреплённый ID, сначала прогоните v1.1 на собственном наборе оценок и переходите только после успешной проверки.

Fugu и обычный API-шлюз: в чём разница

Fugu — не единственный способ получить доступ к нескольким frontier-моделям через единый endpoint. Поэтому полезно понимать, за что именно вы платите.

Fugu — это слой оркестрации. Он решает, какие модели вызывать и как объединять их результаты; одна задача может быть распределена между несколькими моделями. Поэтому фактическая стоимость задачи будет выше базовой цены токенов. Такой подход оправдан для действительно сложных многошаговых задач.

Если же задача сводится к тому, чтобы надёжно и недорого вызывать одну сильную модель, проще использовать маршрутизирующий шлюз. Сервисы наподобие OpenRouter дают доступ к множеству моделей через единый endpoint без наценки за оркестрацию, а платформы вроде AIReiter предлагают прямой доступ к API Claude и GPT дешевле официальной цены. Быстрый критерий такой: если вы не можете назвать задачу, в которой одна модель стабильно терпит неудачу, а координация нескольких моделей её решает, скорее всего, вы платите за ненужную вам оркестрацию.

FAQ

Fugu-Ultra v1.1 действительно лучше v1.0?

Sakana заявляет улучшение до 7,9 пункта, прежде всего на наборах агентных задач по программированию, таких как ProgramBench и Terminal Bench 2.1. Публичной таблицы с сопоставлением двух сборок по каждому бенчмарку нет, поэтому перед тем как полагаться на эту цифру, стоит проверить прирост на своих задачах.

Как остаться на старой сборке v1.0?

Закрепите в запросах ID модели fugu-ultra-20260615, а не fugu-ultra-v1.1 и не неверсионированный алиас fugu-ultra. Алиас отслеживает последнюю сборку, поэтому без изменений с вашей стороны он переведёт вас на v1.1.

Sakana Fugu имеет открытый исходный код?

Частично. Метод и вспомогательный код опубликованы — оркестрация Sakana описана в работе TRINITY, — однако хостинговый сервис и маршрутизация Conductor, которая решает, какие модели вызывать, закрыты. Вы можете изучить принцип работы, но не сможете самостоятельно развернуть production-оркестратор.

Можно ли использовать Fugu-Ultra v1.1 в ЕС?

Пока нет. Sakana указывает, что Fugu недоступна в ЕС/ЕЭЗ, пока компания работает над соблюдением GDPR и специфических для ЕС требований.

Изменилась ли цена в v1.1?

Нет. Тарифы те же, что и у v1.0: $5 за входные, $30 за выходные и $0.50 за кешированные токены на миллион, а после 272K контекста действует повышенная ставка $10 / $45.

Читайте также