Поменять claude-opus-4-8 на claude-opus-5 в конфиге можно одной строкой. Но стоимость и поведение после этого не останутся прежними. В четырёх небольших задачах на код и рассуждения мы отправили одинаковые промпты и сделали по одному запуску на каждую модель. Обе решили все четыре задачи верно, однако Opus 5 выдал 81, 94, 407 и 600 выходных токенов, а Opus 4.8 — 36, 35, 103 и 206. При одинаковой цене $25 за миллион это уже заметная разница.
Причина не в заявленном скачке способностей. В Opus 5 thinking работает по умолчанию, тогда как в 4.8 по умолчанию он был выключен. Поэтому за тот же запрос теперь могут тарифицироваться рассуждения, которых раньше не было. На счёт сильнее всего влияет не выбор модели, а параметр effort. Если у вас в продакшене уже работает claude-opus-4-8, вот главное:
- Есть одно жёсткое API-несовместимое изменение. В Opus 5 сочетание
thinking: {"type": "disabled"}с effortxhighилиmaxвозвращает 400. Opus 4.8 такую комбинацию принимал. - Цена за токен не изменилась. Обе модели стоят $5 за входной и $25 за выходной миллион токенов; расходы меняются только вместе с объёмом токенов.
- Thinking теперь включён по умолчанию. При этом
max_tokensпо-прежнему ограничивает суммарно и thinking, и видимый ответ. Лимиты, настроенные под 4.8, могут начать обрывать ответы. - Промпты опаснее самого изменения кода. Инструкции, просившие 4.8 перепроверять результат, могут заставить Opus 5 заниматься избыточной верификацией.
- Ни одна из моделей не устарела. Обе имеют статус Active, так что остаться на 4.8 до следующего релизного цикла — вполне оправданное решение.
Что проверить перед заменой model ID
В руководстве по миграции Anthropic называет Opus 5 «прямой заменой Claude Opus 4.8 по той же цене». API действительно почти не меняется: claude-opus-5 — фиксированный ID без даты в суффиксе, как и claude-opus-4-8. Но перед переключением продового маршрута всё же стоит проверить пять пунктов.
1. thinking: {"type": "disabled"} при effort xhigh или max возвращает 400. В официальном списке изменений поведения это прямо обозначено как breaking change относительно 4.8: раньше отключение thinking не зависело от effort. Валидация выполняется для каждого запроса, поэтому повышение effort в середине диалога будет отклонено, даже если предыдущие сообщения прошли. 2. max_tokens теперь должен учитывать thinking. Это по-прежнему жёсткий общий лимит на thinking и ответ. Задача, которая в 4.8 выполнялась с отключённым thinking и max_tokens: 4096, сохранит тот же потолок, но часть его теперь займут рассуждения. Для xhigh и max Anthropic рекомендует начинать с 64k. 3. Инструкции на верификацию дают обратный эффект. Opus 5 самостоятельно проверяет свою работу. В гайде по промптингу сказано, что указания вроде «добавь финальный шаг проверки» ведут к избыточной верификации, а их удаление «сокращает напрасные токены без потери качества». Ранний пользователь Allie K. Miller столкнулась с этим со стороны effort: «I often default to 'high' reasoning effort... I had to switch it down to medium.» 4. Skills и агентская обвязка могут начать работать иначе без API-ошибки. Anthropic утверждает, что Opus 5 «хорошо работает из коробки с существующими промптами Claude Opus 4.8». Один из практических отзывов расходится с этим: Dan Shipper из Every написал в день запуска, что модель «ломает обратную совместимость... Часто останавливается раньше или пропускает инструкции», поэтому команде пришлось пересобрать skills с нуля. Это опыт одной команды, но причина заново прогнать собственные evals веская: в логах такое изменение не отметится. 5. Anthropic указывает для Opus 5 отсечку знаний May 2026, против January 2026 у 4.8. Системные промпты с текстом «ваши знания заканчиваются January 2026, опирайтесь на retrieved context» теперь описывают не ту модель, а вместе с этой строкой смещается и привязанная к ней арифметика дат.
За первым пунктом скрывается ещё одна ловушка. При выключенном thinking Opus 5 иногда может записать вызов инструмента в видимый текст вместо блока tool_use либо раскрыть внутренние XML-теги. В агентских циклах такой текст остаётся в истории и загрязняет последующие ходы. Anthropic предлагает не отключать thinking, а контролировать стоимость более низким effort.
Какой запрос даёт 400 и как это исправить
Ниже — проблемная комбинация в виде diff, который можно сопоставить с телом собственного запроса:
# Rejected on claude-opus-5 with HTTP 400. Accepted on claude-opus-4-8.
{
"model": "claude-opus-5",
"max_tokens": 16000,
"thinking": { "type": "disabled" },
"output_config": { "effort": "xhigh" }
}
# Fix A - keep xhigh effort, let thinking run. Raise max_tokens, thinking counts against it.
{
"model": "claude-opus-5",
- "max_tokens": 16000,
+ "max_tokens": 65536,
- "thinking": { "type": "disabled" },
"output_config": { "effort": "xhigh" }
}
# Fix B - keep thinking off, cap effort at high or below.
{
"model": "claude-opus-5",
"max_tokens": 16000,
"thinking": { "type": "disabled" },
- "output_config": { "effort": "xhigh" }
+ "output_config": { "effort": "high" }
}
Вариант A подходит для агентских задач, работы с несколькими файлами и активного использования инструментов, где утечка вызова инструмента в текст обходится особенно дорого. Вариант B — для чувствительных к задержке endpoint’ов и извлечения данных в строгом формате: снижение effort с xhigh до high там обычно мало что отнимает.
Что даёт переход на Opus 5
Opus 5 вышел 2026-07-24 и сохранил два ключевых для сравнения Claude Opus 5 и Opus 4.8 параметра: $5/$25 и контекстное окно в 1M токенов. Подробности запуска и цен есть в материале о Claude Opus 5; для миграции важнее более узкий набор отличий.
Характеристики проверены 25 июля 2026 года:
| Claude Opus 4.8 | Claude Opus 5 | Что меняется для вас | |
|---|---|---|---|
| API model ID | claude-opus-4-8 | claude-opus-5 | Изменение в одну строку |
| Цена за MTok | $5 / $25 | $5 / $25 | Ничего |
| Контекст | 1M | 1M, по умолчанию и максимум | Не нужно подключать отдельный тариф |
| Шкала effort | до xhigh, по умолчанию high | от low до max, по умолчанию high | Повторите тесты всех уровней effort |
| Thinking по умолчанию | выключен, если не запрошен | включён, адаптивный | Пересмотрите max_tokens |
| Отключение thinking | любой effort | effort high или ниже | 400 выше high |
| Минимальный кэшируемый промпт | 1,024 токена | 512 токенов | Теперь кэшируются и короткие промпты |
| Отсечка знаний | Jan 2026 | May 2026 | Обновите формулировку об отсечке |
Помимо таблицы есть ещё два изменения, и лишь одно из них относится к бенчмаркам:
- Кэширование стало доступно для коротких промптов. Минимум снижен с 1,024 до 512 токенов. Значит, системный префикс на 600 токенов, который не кэшировался в 4.8, теперь на попаданиях в кэш стоит $0.50 за миллион вместо стандартных $5 за входные токены. Запись в кэш для элемента на 5 минут стоит $6.25 за миллион, поэтому префикс должен использоваться повторно, прежде чем это окупится.
- Данные о способностях — только от вендора. В анонсе Anthropic приводит относительные показатели без независимого воспроизведения: на Frontier-Bench v0.1 результат «more than double» от Opus 4.8 при меньшей стоимости задачи, а на CursorBench 3.2 модель отстаёт от пика Fable 5 менее чем на 0.5% при половине стоимости. Полезнее выглядят раскрытые слабые стороны: в кибербезопасности и биологии Opus 5 уступает Mythos 5.
Наши четыре задачи ничего не говорят о таком потолке возможностей: обе модели справились со всеми. На настолько маленьких заданиях прирост способностей не виден, а рост числа токенов — виден.
Расходы: тариф тот же, меняется объём токенов
Обе модели берут $25 за миллион выходных токенов. Поэтому при листинговой цене вопрос стоимости Claude Opus 5 относительно Opus 4.8 сводится к одному: сколько токенов каждая выдаёт для одинаковой задачи. В наших четырёх заданиях Opus 5 сгенерировал 1,182 токена против 380 у Opus 4.8 — соотношение 3.1x, примерно 3.0 цента против 0.95 цента.
У этой цифры есть три ограничения:
- По одному запуску каждой модели на каждую задачу, 2026-07-24. Это smoke test, а не бенчмарк.
- С обеих сторон использовались настройки по умолчанию: без поля
effort, без поляthinkingи без системного промпта. - Считались только выходные токены, потому что gateway для некоторых семейств моделей сообщал крайне непоследовательное число токенов промпта. Абсолютные суммы ничтожны, масштабируется лишь соотношение.
Направление изменения тоже не универсально. Две задачи были повторно запущены через first-party канал Claude Code, а не gateway:
| Запуск | Opus 5 | Opus 4.8 |
|---|---|---|
| Рефакторинг, first-party | 429 ток. | 220 ток. |
| Исправление бага, first-party | 36 ток. | 63 ток. |
| Исправление бага, gateway (график выше) | 81 ток. | 36 ток. |
В одном из этих трёх запусков Opus 5 оказался экономнее. На верхнем уровне effort Anthropic приводит противоположный пример: партнёр из юридической отрасли в среднем использовал на 26% меньше токенов при максимальном reasoning, но методология не опубликована.
Обе закономерности могут быть верными одновременно. Thinking по умолчанию и более длинные ответы Opus 5 раздувают выход там, где рассуждение — чистые накладные расходы. Но в многофайловой работе те же рассуждения могут заменить циклы повторных попыток: токенов на завершённую задачу станет меньше, хотя токенов на один вызов — больше. Ни один из наборов данных не измеряет это напрямую, поэтому бюджет лучше строить по собственной стоимости принятой задачи и помнить: главный рычаг — effort, а не модель.
- Сначала снижайте effort. Anthropic утверждает, что уровни
lowиmediumу Opus 5 превосходят те же настройки прежних моделей Opus, расходуя лишь часть токенов; для программирования и агентских задач рекомендуемой стартовой точкой остаётсяxhigh. - Проверьте унаследованные значения по умолчанию. Перенесённый
xhighна endpoint для классификации может быть самой дорогой строкой счёта без какого-либо выигрыша в качестве. - Если всё равно дорого — пересмотрите класс модели. В сравнении Opus 5 и Sonnet 5 при том же бюджете более дешёвой веткой оказывается Sonnet 5.
Когда разумнее остаться на Opus 4.8
В четырёх случаях 4.8 выигрывает в этом квартале:
- У вас есть обязательства по Priority Tier. В гайде по миграции указано, что Priority Tier не поддерживается Claude Opus 5, но сохраняется у Opus 4.8. Если вы купили зарезервированную мощность ради гарантий задержки, миграция означает отказ от неё — это уже вопрос закупок, а не разработки.
- Интеграции нужен отключённый thinking при effort выше
high. Если ваши evals требуют reasoning наxhighи одновременно вывод без thinking, сегодня оба условия выполняет только 4.8. - У вас есть тщательно настроенные skills, которые нельзя перепроверить в этом цикле. Зафиксированный маршрут на 4.8 лучше, чем наполовину перенесённый маршрут на Opus 5 с промптами для другой модели.
- Критична стоимость, а доступ идёт через relay. Сторонние OpenAI-совместимые gateway часто сильно дисконтируют старые модели: в списке моделей Anthropic у AIReiter Opus 4.8 стоит $1.56/$7.76 за миллион токенов — примерно на 69% ниже листинговой цены, тогда как
claude-opus-5ещё не добавлен. При разных каналах доступа ценовой паритет исчезает, и если 4.8 уже справляется, побеждает самая дешёвая корректная модель. Полное сравнение линеек по задачам есть в материале о лучшей модели Claude для программирования.
Страх скорого отключения модели в этот список не входит. На 25 июля 2026 года на странице Anthropic о прекращении поддержки моделей обе имели статус Active, а не Deprecated. То есть для них не назначена дата отключения; предварительно самая ранняя возможная дата — 28 мая 2027 года для 4.8 и 24 июля 2027 года для Opus 5.
Как раскатывать миграцию с возможностью отката
1. Сначала зафиксируйте базу 4.8. Соберите выходные токены, задержку и pass rate на 20–50 реальных запросах как минимум; для агентских задач с высокой вариативностью — больше. Включите и запросы, на которых 4.8 сейчас ошибается. Без этой базы регрессия неотличима от обычной разницы. 2. Сделайте grep до деплоя. Ищите "disabled" рядом с effort, значения max_tokens ниже 16k, а также строки «verify», «double-check» и «January 2026» в системных промптах. Четыре поиска покрывают breaking change и три тихих изменения. 3. Запустите один маршрут, а не глобальное переключение. Направьте часть трафика в claude-opus-5, задав model ID в конфигурации, а не разбросав по коду. Тогда откат будет изменением конфига, а не новым деплоем. 4. Заранее задайте числовые пороги для повышения доли трафика. Pass rate должен быть не ниже базы 4.8; валидность схемы и соблюдение вызовов инструментов — тоже. Стоимость принятой задачи должна укладываться в заранее выбранный лимит, p95 latency — в ваш SLO, а доля 400-ошибок должна быть нулевой. Не выполнен хотя бы один критерий — конфиг возвращается на claude-opus-4-8. 5. Логируйте отдельно запрошенную и фактически вернувшуюся модель. После подключения server-side fallback классификаторы кибербезопасности Opus 5 могут направлять отклонённые запросы в Opus 4.8. Поэтому запуск, который на дашборде выглядит как Opus 5, мог фактически обслуживаться 4.8.
Для большинства команд выбор между Claude Opus 5 и Opus 4.8 сводится к миграции в таком порядке и в пределах одного релизного цикла: повышайте долю только для того, что проходит пороги из пункта 4 относительно вашей базы 4.8. В первый же день уберите из промптов унаследованные инструкции на верификацию — именно там рост числа токенов превращается в реальный счёт, как указывает собственный гайд Anthropic.
FAQ
Можно ли считать Claude Opus 5 прямой заменой Opus 4.8?
Гайд Anthropic по миграции называет её прямым обновлением по той же цене, и на уровне API это верно: то же контекстное окно, тот же потолок вывода в 128k и одно breaking change, которое нужно проверить. На уровне промптов — нет. Нужен аудит инструкций на верификацию, значений effort по умолчанию, лимитов max_tokens и определений skills, настроенных под 4.8. Ошибкой они о себе не сообщат.
Почему запрос к Opus 5 возвращает ошибку 400?
Вероятнее всего, вы отправляете thinking: {"type": "disabled"} вместе с effort xhigh или max. Opus 5 отклоняет такую комбинацию в каждом запросе. Либо уберите поле thinking и сохраните уровень effort, либо оставьте thinking выключенным, но снизьте effort до high или ниже. Нестандартные значения temperature, top_p или top_k также дают 400 у всех моделей Claude, начиная с 4.7.
Claude Opus 4.8 снимают с поддержки?
Нет. На странице Anthropic о прекращении поддержки claude-opus-4-8 имеет статус Active; предварительная самая ранняя дата отключения — 28 мая 2027 года. Для публично выпущенных моделей компания обещает уведомление минимум за 60 дней. 4.8 также остаётся fallback-целью для отказов Opus 5 по киберкатегориям и поддерживает Priority Tier, которого нет у Opus 5.
Какая модель Claude Opus сейчас лучшая?
Claude Opus 5 — по данным самого Anthropic и ранним отзывам разработчиков, особенно для агентского программирования и задач с длинным горизонтом. Opus 4.8 остаётся лучшим выбором для нагрузок с Priority Tier, интеграций с отключённым thinking и effort выше high, а также стеков промптов, для которых у вас пока нет новой базы тестов.
Как переключиться на Opus 5 в Claude Code и приложениях Claude?
Opus 5 — новая модель по умолчанию в Claude Max и самая мощная модель в Claude Pro. Её можно выбрать в Claude Code, Claude Cowork, claude.ai, Amazon Bedrock как anthropic.claude-opus-5, Google Cloud и Microsoft Foundry.
В Claude Code effort по умолчанию — high, а глубина рассуждений теперь задаётся через effort, а не ручным переключателем extended thinking. Opus 4.8 по-прежнему доступен на этих поверхностях, поэтому откат возможен без изменений API-кода.
Claude Opus 5 дороже Opus 4.8?
Не по цене токена: обе модели стоят $5 за входной и $25 за выходной миллион токенов, $2.50/$12.50 в Batch API и $0.50 за миллион при попадании в кэш. Но в нашем тесте с одним запуском Opus 5 генерировал примерно в 3 раза больше выходных токенов на задачу, поэтому при одинаковом листинговом тарифе итоговый счёт может оказаться выше. Fast mode за $10/$50 и примерно 2.5x скорости доступен только в Claude API.
