AIREITER
ДОКИ APIЦЕНЫ
ШАБЛОНЫ
  • AIReiter
  • Блог
  • Claude Fable 5: high, xhigh или max — какой уровень effort выбрать

Claude Fable 5: high, xhigh или max — какой уровень effort выбрать

Последнее обновление: 2026-07-29 10:57:46

Выбираете между high и max effort в Claude Fable 5? В подавляющем большинстве случаев оставляйте high. Для сложных задач программирования и агентных сценариев переходите на xhigh, а max держите как крайний вариант. На типовых задачах max обходится примерно вдвое дороже, при этом прирост качества трудно заметить — а иногда модель просто начинает слишком долго рассуждать. Важный нюанс, который часто упускают: между high и max есть уровень xhigh, и именно он обычно отвечает на вопрос, стоит ли повышать effort.

На что влияет настройка effort в Fable 5

Параметр effort (output_config.effort) имеет пять уровней: low, medium, high, xhigh и max. Для Fable 5 значением по умолчанию служит high. Как указано в документации Anthropic по effort, явно заданный high работает точно так же, как отсутствие этого параметра.

Здесь есть два неочевидных момента. Во-первых, effort — не просто регулятор глубины размышлений. Он определяет весь расход токенов: видимый текст ответа, extended thinking и вызовы инструментов в агентном цикле. На низких уровнях модель делает меньше и более объединённых вызовов инструментов, меньше предварительных пояснений и короче подтверждает действия. На высоких — чаще обращается к инструментам, подробнее планирует вслух и выдаёт более длинные итоги. Во-вторых, в Fable 5 thinking всегда включён: отключить его нельзя, попытка передать thinking: {type: "disabled"} завершится ошибкой. Поэтому глубина рассуждений регулируется именно effort. На high, xhigh и max Claude почти всегда рассуждает глубоко, а на low и medium может пропустить этот этап в простых задачах.

Между high и max есть ещё один важный уровень — xhigh

Сравнение «high против max» на деле включает три ступени: между ними находится xhigh, дающий более тонкую настройку баланса между глубиной рассуждений и задержкой. Инженер Anthropic Борис Черны назвал его «новым уровнем между high и max». Он доступен только в Fable 5, Mythos 5, Opus 4.8, Opus 4.7 и Sonnet 5. В более старых моделях, таких как Opus 4.6 и Sonnet 4.6, после high сразу идёт max.

Полная шкала и сценарии, которые Anthropic указывает для каждого уровня:

УровеньДля чего Anthropic рекомендует его использовать
lowПростые задачи, где важны максимальная скорость и минимальная стоимость, например сабагенты
mediumАгентные задачи с балансом скорости, стоимости и качества
highСложные рассуждения, трудное программирование и агентные задачи; значение по умолчанию
xhighДолгие агентные и coding-задачи от 30 минут, с бюджетом в миллионы токенов
maxМаксимально глубокие рассуждения без лимита на внутренние усилия; итоговый вывод всё равно ограничен max_tokens

Поэтому на вопрос, стоит ли запускать Fable 5 на max, сначала стоит ответить другим вопросом: а xhigh уже пробовали? Для самых тяжёлых задач программирования и агентных систем рекомендованный следующий шаг — именно xhigh, а не max.

Во что обойдётся повышение effort: стоимость и задержка

Повышение effort не меняет цену токена. Fable 5 тарифицируется одинаково на всех уровнях: $10 за миллион входных токенов и $50 за миллион выходных. Общая стоимость растёт только потому, что модель генерирует больше токенов.

Столбчатая диаграмма относительной стоимости задачи и качества результата на уровнях effort Claude Fable 5 от low до max: стоимость резко растёт, а качество постепенно выходит на плато

График иллюстративный, а не результат измерений: он показывает форму компромисса, описанного ниже, при нормализации обеих осей так, что max равен 1.0. Уже на high качество близко к своему потолку, тогда как стоимость при переходе вверх продолжает примерно удваиваться.

Именно на переходе с xhigh на max экономика становится невыгодной. Инженер-программист Ishu Agarwal сообщил 11 июля 2026 года, что переход high → xhigh обычно даёт менее 3% прироста качества, но стоит на 30–100% дороже, а на высоких уровнях effort модели склонны «слишком много думать». В широко разошедшемся посте от 14 июля утверждалось, что Fable 5 показал одинаковый результат на max и xhigh: «89.0 против 89.0 при примерно двойной стоимости». Это стоит воспринимать как ориентир из сообщества, а не как контролируемый бенчмарк. Но вывод согласуется с замечанием Anthropic: max «существенно повышает стоимость при относительно небольшом выигрыше в качестве», а в задачах со структурированным выводом или там, где интеллект модели не является ключевым фактором, может привести к избыточным рассуждениям.

С задержкой ситуация похожая. После тестирования уровней effort 11 июня 2026 года продакт-менеджер Pawel Huryn пришёл к выводу, что «ниже max время завершения почти не меняется», но в реальных задачах «время заметно растёт начиная с xhigh». Есть и ещё одна ловушка: токенизатор Fable 5, общий с последним поколением Opus, может выдавать до ~35% больше токенов для того же текста, чем старые модели Claude. Поэтому расчёты стоимости на основе предыдущей модели будут заниженными.

Как выбирать между high, xhigh и max

ЗадачаEffortКогда повышать
Рутинный кодинг, чат, извлечение данных, сабагентыlow / mediumКогда качество ответа заметно падает
Большинство задач на рассуждение, повседневный кодинг, агентные сценарииhigh (по умолчанию)Если сложная задача застряла или требует более глубокого планирования
Самые трудные задачи программирования и агентные сценарии, длинные запуски, интенсивное использование инструментовxhighЕсли xhigh действительно не справляется
Передовая исследовательская задача или баг, который не решил xhigh; корректность важнее стоимостиmax(Верхняя ступень шкалы)

high — оптимальная точка по соотношению качества и эффективности расхода токенов. xhigh добавляет реальную глубину анализа для самых тяжёлых задач. max — это ставка на то, что модель сможет решить проблему, с которой уже не справился xhigh. Нередко разумнее двигаться вниз: по данным Anthropic, Fable 5 и на низких уровнях effort сохраняет высокое качество и «часто превосходит производительность xhigh у предыдущих моделей». CTO Morgan Linton сформулировал это прямо: «примерно 95% моих задач по программированию требуют от Fable 5 только Low и Medium». Если запускать всё на high, когда Low или Medium дают тот же результат, лимиты тарифного плана закончатся быстрее.

Если для задачи не подходит сама модель, настройка effort этого не исправит: это вопрос выбора модели, а не уровня effort.

Три распространённых заблуждения об effort в Fable 5

Высокий effort не делает модель умнее. Этот параметр определяет, сколько работы Claude выполнит перед ответом: сколько будет рассуждать и как часто вызовет инструменты. Ответ на low и ответ на max генерирует одна и та же модель. Если задача ей не по силам, max лишь потратит больше ресурсов, чтобы прийти к тому же результату.

Значение по умолчанию в Claude Code и API различается. В Claude Code по умолчанию используется xhigh, а в API — high. Этим объясняется немалая часть вопросов в духе «почему здесь модель ведёт себя иначе»: в Claude Code та же модель выглядит более обстоятельной и обходится дороже исключительно из-за более высокого значения по умолчанию. Если нужно повторить поведение Claude Code через API, явно задайте xhigh.

ultracode — не уровень effort. Этот пункт есть в меню Claude Code, однако API принимает только значения от low до max. Ultracode сочетает xhigh с постоянным разрешением запускать многоагентные процессы. Такой режим активно расходует токены, и передать его в API нельзя.

Как задать effort и что учитывать в max_tokens

Effort указывается в output_config; beta-заголовок для этого не нужен. Поскольку thinking в Fable 5 всегда включён, параметр thinking лучше не передавать вовсе:

import anthropic

client = anthropic.Anthropic()

response = client.messages.create(
    model="claude-fable-5",
    max_tokens=64000,          # give room at xhigh/max (see note below)
    output_config={"effort": "xhigh"},   # low | medium | high | xhigh | max
    messages=[{"role": "user", "content": "Refactor this module and add tests."}],
)

max_tokens — жёсткий потолок для всего вывода: и thinking, и текста ответа. На xhigh или max рассуждения могут занять значительную часть бюджета, поэтому задавайте щедрый лимит — начните примерно с 64 000. Иначе ответ может оборваться в середине рассуждения. Fable 5 поддерживает контекст в 1M токенов и до 128K выходных токенов.

FAQ

Чем отличаются high и max effort в Fable 5?

high — значение по умолчанию: модель расходует столько ресурсов, сколько нужно для отличного результата. max снимает все ограничения ради максимально глубоких рассуждений. Однако наиболее полезным шагом вверх от high обычно становится расположенный между ними xhigh.

Стоит ли использовать max effort в Fable 5?

Редко. По сравнению с xhigh этот режим примерно удваивает стоимость при небольшом измеримом приросте качества и может заставить модель чрезмерно долго рассуждать. Оставьте его для передовых задач или бага, который xhigh не смог устранить.

Как изменить уровень effort?

Передайте output_config: {"effort": "..."}, выбрав low, medium, high, xhigh или max. В Claude Code используйте меню выбора effort.

Какой уровень effort используется по умолчанию?

В API это high; он эквивалентен отсутствию параметра. В Claude Code по умолчанию установлен xhigh.

Повышается ли цена одного токена при высоком effort?

Нет, тариф за токен остаётся одинаковым. Более высокий effort стоит дороже только потому, что модель генерирует больше токенов.

Совпадают ли уровни effort Fable 5 с Sonnet и Opus?

Параметр и названия уровней те же, но xhigh доступен только в Fable 5, Mythos 5, Opus 4.8, Opus 4.7 и Sonnet 5. Кроме того, рекомендуемые значения по умолчанию зависят от модели. Если выбираете между ними, смотрите сравнение Sonnet 5 и Fable 5.

>_Каталог моделей AIReiter

Быстрый API-доступ к моделям, связанным с этим гайдом

Claude Fable 5

Chat

Премиальная модель Claude для глубокого рассуждения и сложной объемной работы.

AnthropicСоздать API Key >

Claude Sonnet 5

Chat

Сбалансированная модель Claude для продвинутого рассуждения, программирования и повседневной работы.

AnthropicСоздать API Key >

GPT-5.6 Sol

Chat

Премиальная текстовая модель GPT-5.6 для требовательного программирования, рассуждений и длительной агентной работы.

OpenAIСоздать API Key >

Gemini 3.1 Pro

Chat
GoogleСоздать API Key >

Claude Sonnet 4.6

Chat
AnthropicСоздать API Key >

Недавние статьи

Обзор API GPT-6 Astra (2026): для агентов, а не простой замены

2026-09-07

Kling API: официальный доступ и агрегаторы — руководство по интеграции (2026)

2026-09-07

Suno API Key: где получить и сколько стоит в 2026 году

2026-09-07

Обзор GPT-6 Astra: оправдывает ли API-цена $10/$50 свою стоимость?

2026-09-06
AIREITER

Есть вопросы? Свяжитесь с нами
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI-видео

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI-изображения

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Блог

Посмотреть все →

Компания

Политика конфиденциальностиУсловия обслуживанияПолитика возврата

© 2026 AIReiter. Все права защищены.