Простая замена claude-fable-5 на claude-fable-5-1 может успешно пройти первый запрос — и лишь потом выяснится, что перестали работать маршрутизация инструментов или изменяемая история диалога. Для долгоживущих агентов с активным использованием кэша Fable 5.1 — более сильный вариант по умолчанию. Однако это не полностью бесшовная замена: базовые тарифы и лимиты не изменились, зато изменились три аспекта поведения API.
Кому стоит переходить на Fable 5.1
Claude Fable 5.1 — актуальная модель-преемник Claude Fable 5, и Anthropic рекомендует переходить на неё ради более высокой производительности. Выгода особенно заметна у агентов, которые многократно читают большой общий префикс промпта: чтение кэша подешевело с $1 до $0.25 за миллион токенов, тогда как обычный ввод и вывод по-прежнему стоят $10 и $50 за миллион токенов соответственно. (Обзор Fable 5.1 от Anthropic)
| Если ваша нагрузка… | Начните с… | Причина |
|---|---|---|
| Повторно использует длинный системный промпт, кодовую базу или контекст документов | Fable 5.1 | Чтение кэша обходится на 75% дешевле, а Anthropic заявляет более высокие результаты в агентных задачах. |
Использует принудительные вызовы инструментов, например tool_choice: {"type":"any"} | Сначала протестируйте Fable 5.1 | Fable 5.1 отклоняет принудительный выбор инструмента с ошибкой 400. |
| Редактирует или пересобирает ранние сообщения диалога | Оставьте Fable 5, пока не исправите слой истории | В Fable 5.1 thinking-блоки привязаны к предшествующему промпту, инструментам и истории. |
| Требует минимальной стандартной цены за токены | Ни одна из моделей Fable | Обе стоят $10 за миллион входных и $50 за миллион выходных токенов. |
| Работает с обычными промптами без кэша и имеет стабильную интеграцию Fable 5 | Сначала проведите оценку | Экономия по прайс-листу может быть небольшой, а прирост в бенчмарках зависит от типа задачи. |
Чем Fable 5.1 отличается от Fable 5
По ключевым возможностям Claude Fable 5.1 повторяет Claude Fable 5: контекстное окно на 1 миллион токенов, максимальный вывод 128 000 токенов и постоянно включённое адаптивное мышление. В документации отмечены различия по статусу жизненного цикла, дате отсечения знаний — июнь 2026 года вместо января 2026 года, более дешёвому чтению кэша и новому поведению API при работе с инструментами и thinking-блоками. (Обзор legacy-модели Fable 5; Обзор модели Fable 5.1)
| Характеристика | Claude Fable 5 | Claude Fable 5.1 |
|---|---|---|
| Идентификатор модели в API | claude-fable-5 | claude-fable-5-1 |
| Статус жизненного цикла | Активная, legacy | Активная, актуальная модель Fable |
| Дата выпуска | 9 июня 2026 года | 1 сентября 2026 года |
| Контекстное окно | 1M токенов | 1M токенов |
| Максимальный вывод | 128K токенов | 128K токенов |
| Мышление | Адаптивное, всегда включено | Адаптивное, всегда включено |
| Усилия по умолчанию | High | High |
| Надёжная дата отсечения знаний | Январь 2026 года | Июнь 2026 года |
| Цена ввода / вывода | $10 / $50 за MTok | $10 / $50 за MTok |
| Цена чтения кэша | $1 / MTok | $0.25 / MTok |
Fable 5.1 доступна через Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform on AWS. Anthropic указывает Fable 5 для тех же семейств платформ; её вывод из эксплуатации ожидается не ранее 9 июня 2027 года. Для Fable 5.1 дата вывода из эксплуатации назначена не ранее 1 сентября 2027 года. (Доступность и жизненный цикл Fable 5.1; Доступность и жизненный цикл Fable 5)
Экономия — в чтении кэша, а не в базовых тарифах
На новом входном токене или выходном токене Fable 5.1 не дешевле. Как и Fable 5, модель берёт $10 за миллион входных токенов и $50 за миллион выходных, но чтение кэша стоит $0.25 за миллион токенов вместо $1. (Документация Anthropic по ценам)
| Категория использования | Fable 5 | Fable 5.1 | Изменение |
|---|---|---|---|
| Новый вход | $10 / MTok | $10 / MTok | Нет |
| Вывод | $50 / MTok | $50 / MTok | Нет |
| Запись в кэш на 5 минут | $12.50 / MTok | $12.50 / MTok | Нет |
| Запись в кэш на 1 час | $20 / MTok | $20 / MTok | Нет |
| Чтение кэша | $1 / MTok | $0.25 / MTok | На 75% дешевле |
| Пакетный ввод / вывод | Скидка 50% | Скидка 50% | Та же заявленная скидка |
Для простого примера предположим, что агент десять раз читает закэшированный контекст проекта объёмом 1 миллион токенов, а затем генерирует 200 000 выходных токенов. На Fable 5 чтение кэша обойдётся в $10, на Fable 5.1 — в $2.50; вывод в обоих случаях стоит $10. В этих узких условиях токеновый счёт снижается с $20 до $12.50, то есть на 37.5%.
Реальная экономия зависит от попаданий в кэш, записей, длины вывода, повторных попыток, вызовов инструментов и маршрутизации на резервные модели. По оценке Anthropic, типичные нагрузки обходятся примерно на 25% дешевле, а высокоагентные сценарии — до примерно 45% дешевле. (Страница продукта Fable от Anthropic)
Использование по подписке — это отдельная экономика, не связанная напрямую с API. По данным справочного центра Anthropic, для Fable 5 и Fable 5.1 действуют одинаковые текущие правила тарифов: пользователи Max, а также премиальные места Team или legacy Enterprise могут расходовать на модели Fable до 50% недельного лимита, тогда как Pro и стандартные места используют кредиты pay-as-you-go. Более ранняя акция для Fable 5 завершилась 19 июля 2026 года, и Fable 5.1 в неё не входила. (Руководство Anthropic по тарифам)
Бенчмарки: заметный, но не одинаковый прирост
В опубликованном сравнении Anthropic Fable 5.1 уверенно опережает Fable 5 в нескольких агентных задачах и задачах компьютерного взаимодействия, но масштаб преимущества варьируется от умеренного до очень крупного. Это результаты, заявленные поставщиком и полученные в защищённых оценках конкретных версий моделей, поэтому их стоит воспринимать как ориентир и проверять на собственных промптах. (Таблица бенчмарков Anthropic)
| Бенчмарк | Fable 5.1 | Fable 5 | Разница |
|---|---|---|---|
| Terminal-Bench-Science 0.1 | 52.6% | 24.7% | +27.9 пункта |
| Terminal-Bench 4.0 | 55.8% | 42.0% | +13.8 пункта |
| GDPval-AA v2 | 1,853 Elo | 1,723 Elo | +130 Elo |
| OSWorld 2.0, частичный | 77.9% | 72.9% | +5.0 пункта |
| OSWorld 2.0, строгий | 41.7% | 36.1% | +5.6 пункта |
| Humanity’s Last Exam, без инструментов | 60.9% | 57.8% | +3.1 пункта |
| Humanity’s Last Exam, с инструментами | 65.0% | 63.8% | +1.2 пункта |
| AutomationBench | 31.4% | 17.1% | +14.3 пункта |
| CursorBench 3.2.0 | 73.4% | 70.5% | +2.9 пункта |
Самый большой опубликованный разрыв виден в Terminal-Bench-Science 0.1: заявленный результат Fable 5.1 более чем вдвое выше, чем у Fable 5. Существенный прирост также показан в AutomationBench и Terminal-Bench 4.0. Скромные различия в Humanity’s Last Exam и CursorBench позволяют сделать более аккуратный вывод: Fable 5.1 превосходит предшественника не с одинаковым отрывом на всех типах задач.
В таблице Anthropic для публичной Fable 5.1 указан результат 55.8% в Terminal-Bench 4.0, а Mythos 5.1 приведена отдельно с результатом 60.9%. Mythos 5.1 не является общедоступной заменой Fable 5.1. (Страница продукта Anthropic)
Миграция API: три сценария, которые нужно проверить
Anthropic описывает миграцию на Fable 5.1 как в основном бесшовную, но три изменения способны привести к сбоям в продакшене или незаметно поменять поведение агента. Проверьте их до массовой смены идентификатора модели во всех окружениях. (Руководство по миграции на Fable 5.1)
1. Принудительный выбор инструмента теперь даёт 400
Fable 5.1 принимает tool_choice: {"type":"auto"} и tool_choice: {"type":"none"}. Но {"type":"any"} и принудительный выбор именованного инструмента отклоняются с ошибкой 400 invalid_request_error. Это относится к Messages API, Message Batches API и endpoint подсчёта токенов.
Если приложению нужен корректный JSON, используйте structured outputs там, где они доступны, либо оставьте выбор инструмента в режиме auto, задав строгую схему и явную инструкцию. Когда на конкретном ходе требуется определённый инструмент, Anthropic предлагает заменяющий паттерн: добавляемую системную инструкцию, действующую только в рамках одного хода.
2. Thinking-блоки привязаны к модели, которая их создала
Fable 5.1 умеет читать сохранённые thinking-блоки, созданные Fable 5 и более ранними совместимыми моделями Claude. Обратной совместимости нет: старые модели не могут прочитать thinking-блоки Fable 5.1. Если резервный маршрут переводит диалог на старую модель, API удаляет нечитаемые блоки, и резервной модели приходится заново строить план.
Удалённые блоки не тарифицируются как входные, но повторное планирование может увеличить задержку и стоимость первого хода после смены модели. Для отладки Anthropic документирует beta-заголовок thinking-binding-controls-2026-08-01, сообщающий о преобразовании model_binding_mismatch.
3. Изменение ранней истории может сделать запрос невалидным
Для новых API-аккаунтов Fable 5.1 проверяет, не менялись ли системный промпт, инструменты или ранняя история сообщений перед сохранённым thinking-блоком. Редактирование, перестановка, удаление или пересборка этого префикса может вернуть ошибку 400 invalid-signature вместо ответа.
Безопасный вариант по умолчанию — история, в которую сообщения только добавляются. Вместо вставки краткого резюме в середину транскрипта используйте серверную компактификацию или редактирование контекста; для стабильности файлов между ходами применяйте file_id из Files API либо передавайте идентичные байты. Клиенту, который уже сохраняет точный префикс, может хватить смены ID модели. Если же клиент заново собирает сообщения на каждом ходе, сначала потребуется адаптер.
Полезные новые возможности
Fable 5.1 также добавляет механизмы, которые способны улучшить долгоживущего агента без полной переработки:
- Усилия для отдельного сообщения: можно менять
low,medium,high,xhighилиmaxна последующем ходе, не инвалидируя закэшированный префикс. - Системные сообщения на один ход: добавляйте инструкцию, действующую только для одного хода, не вставляя и не удаляя текст из раннего системного промпта.
- Индикаторы прогресса: запрашивайте понятные обновления между вызовами инструментов через документированные настройки отображения.
- Более дешёвое чтение кэша: сохраняйте повторяющийся префикс, но после миграции заново измерьте долю попаданий в кэш.
Уровень effort — не универсальная единица объёма работы. Начните с документированного значения по умолчанию high, затем на реальном наборе задач сравните качество, задержку и общее число токенов для medium и более высоких настроек.
Доступ, квоты и fallback меняют итоговую картину
Fable 5.1 широко доступна в платных тарифах Claude, через API Anthropic и на перечисленных облачных платформах, однако доступ в тарифе не означает безлимитное включённое использование. Пользователям Pro и стандартным местам Team кредиты на использование могут понадобиться уже с первого запроса, тогда как Max и премиальные места делят выделенную для Fable часть недельного пула. Для Fable 5.1 в Claude Code нужна версия 2.1.250 или новее; для Fable 5 — версия 2.1.170 или новее. (Руководство Anthropic по тарифам и доступу)
Автоматическое переключение моделей тоже может сделать сравнение Fable в приложении непохожим на сравнение через API. Anthropic сообщает, что чувствительные запросы по кибербезопасности и биологии могут маршрутизироваться на резервные модели Opus, а автоматическое переключение по умолчанию включено в интерфейсах Claude. В API fallback должны настроить разработчики: без дополнительной обработки отказ возвращается как успешный HTTP-ответ с причиной остановки отказа. (Руководство Anthropic по fallback)
Ранние отзывы пользователей носят анекдотический характер, но указывают на две метрики, которые стоит измерять в пилоте:
«5.1 вроде нормальная, но, похоже, работает медленнее». — u/BeowulfShaeffer, обсуждение релиза в r/ClaudeAI
«Я уже на 100% использования». — u/noeyb, обсуждение релиза в r/ClaudeAI
Эти комментарии не позволяют судить об общей производительности, но показывают, что наряду с качеством ответов стоит логировать фактическое время выполнения и расход квоты.
Как выбрать модель пользователю Fable 5
| Ситуация | Практический выбор |
|---|---|
| Новый агент с повторным чтением контекста | Fable 5.1, с логированием попаданий в кэш и задержек с первого дня |
| Существующий агент Fable 5 с историей только на добавление и автоматическими инструментами | Запустите пилот Fable 5.1 на репрезентативной части задач |
| Существующий агент принудительно выбирает именованные инструменты | Сначала исправьте выбор инструментов, затем тестируйте Fable 5.1 |
| Существующий клиент переписывает старые сообщения или системные промпты | Оставьте Fable 5 резервным вариантом, пока перерабатываете слой истории |
| Преимущественно новые промпты с редким повторным использованием кэша | Сравнивайте стоимость завершённой задачи, а не только цены токенов |
| Задачи, которые могут активировать защитные механизмы для кибербезопасности или биологии | Смоделируйте fallback-сценарий и цены Opus до миграции |
| Нужны более низкие стандартные цены ввода/вывода | Сравните другую модель Anthropic, поскольку у Fable 5.1 и Fable 5 одинаковые базовые тарифы |
Практический тест миграции может быть небольшим: воспроизведите 20–50 репрезентативных задач, зафиксируйте одинаковые инструменты и промпты, а затем запишите успешность, ошибки принудительного выбора инструментов, число fallback-переходов, токены чтения кэша, суммарные входные и выходные токены, задержку, расход квоты и стоимость завершённой задачи. Переводите нагрузку на Fable 5.1, только если модель проходит порог качества без неприемлемых проблем совместимости или квот.
Частые вопросы покупателей
Почему Claude переключился с Fable 5.1?
Классификатор защитных механизмов может включить автоматический fallback для некоторых запросов по кибербезопасности, биологии, извлечению рассуждений или разработке frontier-моделей. В приложениях Claude запрос могут повторно обработать на модели Opus; в API поведение fallback настраивает разработчик. (Руководство Anthropic по fallback)
Fable 5.1 — более подходящая цель для нового агента с длинным горизонтом работы и для сценариев Fable 5 со значительным повторным использованием кэша. На время пилота совместимости оставляйте Fable 5, если интеграция принудительно выбирает инструменты, редактирует историю сообщений или не может мириться с неопределённостью fallback и квот.