Выбираете между high и max effort в Claude Fable 5? В подавляющем большинстве случаев оставляйте high. Для сложных задач программирования и агентных сценариев переходите на xhigh, а max держите как крайний вариант. На типовых задачах max обходится примерно вдвое дороже, при этом прирост качества трудно заметить — а иногда модель просто начинает слишком долго рассуждать. Важный нюанс, который часто упускают: между high и max есть уровень xhigh, и именно он обычно отвечает на вопрос, стоит ли повышать effort.
На что влияет настройка effort в Fable 5
Параметр effort (output_config.effort) имеет пять уровней: low, medium, high, xhigh и max. Для Fable 5 значением по умолчанию служит high. Как указано в документации Anthropic по effort, явно заданный high работает точно так же, как отсутствие этого параметра.
Здесь есть два неочевидных момента. Во-первых, effort — не просто регулятор глубины размышлений. Он определяет весь расход токенов: видимый текст ответа, extended thinking и вызовы инструментов в агентном цикле. На низких уровнях модель делает меньше и более объединённых вызовов инструментов, меньше предварительных пояснений и короче подтверждает действия. На высоких — чаще обращается к инструментам, подробнее планирует вслух и выдаёт более длинные итоги. Во-вторых, в Fable 5 thinking всегда включён: отключить его нельзя, попытка передать thinking: {type: "disabled"} завершится ошибкой. Поэтому глубина рассуждений регулируется именно effort. На high, xhigh и max Claude почти всегда рассуждает глубоко, а на low и medium может пропустить этот этап в простых задачах.
Между high и max есть ещё один важный уровень — xhigh
Сравнение «high против max» на деле включает три ступени: между ними находится xhigh, дающий более тонкую настройку баланса между глубиной рассуждений и задержкой. Инженер Anthropic Борис Черны назвал его «новым уровнем между high и max». Он доступен только в Fable 5, Mythos 5, Opus 4.8, Opus 4.7 и Sonnet 5. В более старых моделях, таких как Opus 4.6 и Sonnet 4.6, после high сразу идёт max.
Полная шкала и сценарии, которые Anthropic указывает для каждого уровня:
| Уровень | Для чего Anthropic рекомендует его использовать |
|---|---|
low | Простые задачи, где важны максимальная скорость и минимальная стоимость, например сабагенты |
medium | Агентные задачи с балансом скорости, стоимости и качества |
high | Сложные рассуждения, трудное программирование и агентные задачи; значение по умолчанию |
xhigh | Долгие агентные и coding-задачи от 30 минут, с бюджетом в миллионы токенов |
max | Максимально глубокие рассуждения без лимита на внутренние усилия; итоговый вывод всё равно ограничен max_tokens |
Поэтому на вопрос, стоит ли запускать Fable 5 на max, сначала стоит ответить другим вопросом: а xhigh уже пробовали? Для самых тяжёлых задач программирования и агентных систем рекомендованный следующий шаг — именно xhigh, а не max.
Во что обойдётся повышение effort: стоимость и задержка
Повышение effort не меняет цену токена. Fable 5 тарифицируется одинаково на всех уровнях: $10 за миллион входных токенов и $50 за миллион выходных. Общая стоимость растёт только потому, что модель генерирует больше токенов.
График иллюстративный, а не результат измерений: он показывает форму компромисса, описанного ниже, при нормализации обеих осей так, что max равен 1.0. Уже на high качество близко к своему потолку, тогда как стоимость при переходе вверх продолжает примерно удваиваться.
Именно на переходе с xhigh на max экономика становится невыгодной. Инженер-программист Ishu Agarwal сообщил 11 июля 2026 года, что переход high → xhigh обычно даёт менее 3% прироста качества, но стоит на 30–100% дороже, а на высоких уровнях effort модели склонны «слишком много думать». В широко разошедшемся посте от 14 июля утверждалось, что Fable 5 показал одинаковый результат на max и xhigh: «89.0 против 89.0 при примерно двойной стоимости». Это стоит воспринимать как ориентир из сообщества, а не как контролируемый бенчмарк. Но вывод согласуется с замечанием Anthropic: max «существенно повышает стоимость при относительно небольшом выигрыше в качестве», а в задачах со структурированным выводом или там, где интеллект модели не является ключевым фактором, может привести к избыточным рассуждениям.
С задержкой ситуация похожая. После тестирования уровней effort 11 июня 2026 года продакт-менеджер Pawel Huryn пришёл к выводу, что «ниже max время завершения почти не меняется», но в реальных задачах «время заметно растёт начиная с xhigh». Есть и ещё одна ловушка: токенизатор Fable 5, общий с последним поколением Opus, может выдавать до ~35% больше токенов для того же текста, чем старые модели Claude. Поэтому расчёты стоимости на основе предыдущей модели будут заниженными.
Как выбирать между high, xhigh и max
| Задача | Effort | Когда повышать |
|---|---|---|
| Рутинный кодинг, чат, извлечение данных, сабагенты | low / medium | Когда качество ответа заметно падает |
| Большинство задач на рассуждение, повседневный кодинг, агентные сценарии | high (по умолчанию) | Если сложная задача застряла или требует более глубокого планирования |
| Самые трудные задачи программирования и агентные сценарии, длинные запуски, интенсивное использование инструментов | xhigh | Если xhigh действительно не справляется |
Передовая исследовательская задача или баг, который не решил xhigh; корректность важнее стоимости | max | (Верхняя ступень шкалы) |
high — оптимальная точка по соотношению качества и эффективности расхода токенов. xhigh добавляет реальную глубину анализа для самых тяжёлых задач. max — это ставка на то, что модель сможет решить проблему, с которой уже не справился xhigh. Нередко разумнее двигаться вниз: по данным Anthropic, Fable 5 и на низких уровнях effort сохраняет высокое качество и «часто превосходит производительность xhigh у предыдущих моделей». CTO Morgan Linton сформулировал это прямо: «примерно 95% моих задач по программированию требуют от Fable 5 только Low и Medium». Если запускать всё на high, когда Low или Medium дают тот же результат, лимиты тарифного плана закончатся быстрее.
Если для задачи не подходит сама модель, настройка effort этого не исправит: это вопрос выбора модели, а не уровня effort.
Три распространённых заблуждения об effort в Fable 5
Высокий effort не делает модель умнее. Этот параметр определяет, сколько работы Claude выполнит перед ответом: сколько будет рассуждать и как часто вызовет инструменты. Ответ на low и ответ на max генерирует одна и та же модель. Если задача ей не по силам, max лишь потратит больше ресурсов, чтобы прийти к тому же результату.
Значение по умолчанию в Claude Code и API различается. В Claude Code по умолчанию используется xhigh, а в API — high. Этим объясняется немалая часть вопросов в духе «почему здесь модель ведёт себя иначе»: в Claude Code та же модель выглядит более обстоятельной и обходится дороже исключительно из-за более высокого значения по умолчанию. Если нужно повторить поведение Claude Code через API, явно задайте xhigh.
ultracode — не уровень effort. Этот пункт есть в меню Claude Code, однако API принимает только значения от low до max. Ultracode сочетает xhigh с постоянным разрешением запускать многоагентные процессы. Такой режим активно расходует токены, и передать его в API нельзя.
Как задать effort и что учитывать в max_tokens
Effort указывается в output_config; beta-заголовок для этого не нужен. Поскольку thinking в Fable 5 всегда включён, параметр thinking лучше не передавать вовсе:
import anthropic
client = anthropic.Anthropic()
response = client.messages.create(
model="claude-fable-5",
max_tokens=64000, # give room at xhigh/max (see note below)
output_config={"effort": "xhigh"}, # low | medium | high | xhigh | max
messages=[{"role": "user", "content": "Refactor this module and add tests."}],
)
max_tokens — жёсткий потолок для всего вывода: и thinking, и текста ответа. На xhigh или max рассуждения могут занять значительную часть бюджета, поэтому задавайте щедрый лимит — начните примерно с 64 000. Иначе ответ может оборваться в середине рассуждения. Fable 5 поддерживает контекст в 1M токенов и до 128K выходных токенов.
FAQ
Чем отличаются high и max effort в Fable 5?
high — значение по умолчанию: модель расходует столько ресурсов, сколько нужно для отличного результата. max снимает все ограничения ради максимально глубоких рассуждений. Однако наиболее полезным шагом вверх от high обычно становится расположенный между ними xhigh.
Стоит ли использовать max effort в Fable 5?
Редко. По сравнению с xhigh этот режим примерно удваивает стоимость при небольшом измеримом приросте качества и может заставить модель чрезмерно долго рассуждать. Оставьте его для передовых задач или бага, который xhigh не смог устранить.
Как изменить уровень effort?
Передайте output_config: {"effort": "..."}, выбрав low, medium, high, xhigh или max. В Claude Code используйте меню выбора effort.
Какой уровень effort используется по умолчанию?
В API это high; он эквивалентен отсутствию параметра. В Claude Code по умолчанию установлен xhigh.
Повышается ли цена одного токена при высоком effort?
Нет, тариф за токен остаётся одинаковым. Более высокий effort стоит дороже только потому, что модель генерирует больше токенов.
Совпадают ли уровни effort Fable 5 с Sonnet и Opus?
Параметр и названия уровней те же, но xhigh доступен только в Fable 5, Mythos 5, Opus 4.8, Opus 4.7 и Sonnet 5. Кроме того, рекомендуемые значения по умолчанию зависят от модели. Если выбираете между ними, смотрите сравнение Sonnet 5 и Fable 5.