AIREITER

Обзор Claude Sonnet 5.5 API и цены для команд разработки

Последнее обновление: 2026-09-30 00:43:52

Claude Sonnet 5.5 сочетает цену $2 за миллион входных токенов с заявленным результатом 70.6% в Terminal-Bench 4.0. Но в агентских запусках с максимальным уровнем усилий реальная стоимость принятого изменения может оказаться значительно выше. Для команд, которые выбирают модель для продакшен-разработки, Sonnet 5.5 — лучший кандидат на роль основного пилотного маршрута, но не безусловная замена Opus 5.5.

Итог для продакшена: Sonnet 5.5 стоит сделать основной моделью для кодинга

Начните с пилотирования Claude Sonnet 5.5 на ограниченных задачах: исправлении багов, рефакторинге, генерации тестов и работе с репозиториями через инструменты. Согласно опубликованным Anthropic данным, в Terminal-Bench 4.0 модель набрала 70.6% — против 66.4% у Claude Opus 5.5 и 10.3% у Claude Sonnet 5 в том же сравнении.

Но без предохранителей не обойтись: задавайте уровень усилий и лимиты вывода явно. Независимые анализы стоимости показывают, что Sonnet 5.5 на максимальном уровне усилий может обходиться дороже Opus 5.5 в расчёте на задачу бенчмарка, несмотря на более низкие заявленные тарифы Sonnet.

Что Claude Sonnet 5.5 меняет для API-команд

Claude Sonnet 5.5 вышла 28 сентября 2026 года. В официальной документации модели указаны ID модели claude-sonnet-5-5, контекстное окно на 1 миллион токенов, стандартный максимальный объём вывода 128 000 токенов, адаптивное рассуждение и высокий уровень усилий (high) по умолчанию в API.

Параметр для продакшенаClaude Sonnet 5.5
Дата выхода28 сентября 2026 года
ID моделиclaude-sonnet-5-5
Контекстное окно1M токенов
Стандартный максимальный вывод128K токенов
Максимальный вывод в Batch300K токенов с указанным в документации beta-заголовком
Уровень усилий в API по умолчаниюhigh

Anthropic обязуется не выводить модель из эксплуатации раньше 28 сентября 2027 года. Это нижняя граница жизненного цикла, а не обещанная окончательная дата отключения.

Настройки API, которые напрямую влияют на счёт за кодинг

Адаптивное рассуждение включено по умолчанию. При миграции с Sonnet 5 стоит протестировать between_tools, если нужно отключить предварительное рассуждение: в официальной документации сказано, что принудительное использование инструментов теперь приводит к ошибке, а значения temperature, top_p или top_k, отличные от стандартных, возвращают ошибки HTTP 400.

Текст, который модель генерирует между вызовами инструментов, может приходить в блоках thinking. Если потоковый клиент считает, что каждое промежуточное сообщение обязано быть обычным текстовым блоком, после миграции он может выглядеть «зависшим». До подключения Sonnet 5.5 к существующему кодинг-агенту обновите парсер.

Производительность в Terminal-Bench: для основной модели вполне достаточно

Главный упомянутый здесь бенчмарк для кодинг-агентов — Terminal-Bench 4.0. Он проверяет выполнение многошаговых задач через командную строку. По данным Anthropic, Sonnet 5.5 набрала 70.6%, Opus 5.5 — 66.4%, а Sonnet 5 — 10.3%.

МодельTerminal-Bench 4.0GDPval-AA EloCursorBench 4.0
Claude Sonnet 5.570.6%184455.5%
Claude Opus 5.566.4%184657.8%
Claude Sonnet 510.3%144934.1%

Приведённые выше цифры опубликованы в обзоре бенчмарков DataCamp, который ссылается на материалы Anthropic, посвящённые запуску модели. В сравнении терминального кодинга лидирует Sonnet 5.5, но в CursorBench и ряде более широких тестов на рассуждение и интеллектуальную работу впереди остаётся Opus 5.5.

Сравнение результатов Claude Sonnet 5.5 в кодинг-бенчмарках и стоимости индекса

Проверяйте модель на воспроизведённых задачах из реальных репозиториев: учитывайте прошедшие тесты, количество ходов с инструментами и принятые изменения, а не только получившийся diff.

Цены Claude Sonnet 5.5 API на реальных нагрузках

Тарифная сетка Anthropic выглядит просто, но кодинг-агент платит не только за видимый промпт. Токены рассуждения тарифицируются как выходные, а повторяющийся контекст репозитория в разных ходах может превращаться в чтение кэша.

Позиция в APIЦена Claude Sonnet 5.5
Входные токены$2 за 1M токенов
Выходные токены, включая рассуждение$10 за 1M токенов
Запись в кэш на 5 минут$2.50 за 1M токенов
Запись в кэш на 1 час$4 за 1M токенов
Чтение кэша$0.20 за 1M токенов
Входные токены в BatchСкидка 50%, то есть $1 за 1M
Выходные токены в BatchСкидка 50%, то есть $5 за 1M

В официальной документации указано, что минимальный кэшируемый промпт должен содержать 512 токенов, а Sonnet 5.5 использует адаптивное рассуждение. Согласно независимому анализу цен от eesel, у Sonnet 5.5 тот же токенизатор, что и у Sonnet 5, поэтому сама миграция автоматически не уменьшит количество токенов.

Запрос на 4 000 входных и 700 выходных токенов стоит около $0.015 без учёта прочих начислений: $0.008 за вход и $0.007 за выход. Кодинг-агент, который делает 20 ходов по 3 000 новых входных и 2 000 выходных токенов за ход, израсходует примерно $0.12 на новые входные токены и $0.40 на выходные — ещё до оплаты чтения и записи кэша, инструментов и повторных попыток. Это примеры для конкретных нагрузок, а не универсальная цена задачи.

Уровень усилий — главный регулятор стоимости

В анализе TokenCost по уровням усилий, основанном на измерениях Artificial Analysis Intelligence Index, для Sonnet 5.5 приведены следующие результаты:

Уровень усилийРезультатСтоимость полного индекса
Low35.8$544
Medium40.7$701
High46.7$1,176
Xhigh51.9$2,738
Max56.0$8,977

Максимальный уровень — повод насторожиться. В том же анализе Opus 5.5 на максимуме получил 57.6 при стоимости $8,708, а на уровне xhigh — 56.0 при $4,057. В этом тесте Sonnet 5.5 на максимальном уровне использовала примерно 193 000 выходных токенов на задачу.

Начните со среднего или высокого уровня, ограничьте число выходных токенов, а задачи, которые не удалось выполнить или которые несут повышенный риск, отправляйте на более дорогой маршрут. Не переносите настройки максимального уровня, использовавшиеся для Sonnet 5, в Sonnet 5.5 без повторной проверки стоимости и качества.

Чек-лист миграции на продакшен-модель для кодинга

  1. Закрепите claude-sonnet-5-5 в staging, не меняя глобально алиас.
  2. Прогоните на ваших репозиториях типичные исправления багов, рефакторинг, генерацию тестов и изменения в нескольких файлах.
  3. Задайте уровень усилий явно и фиксируйте число выходных токенов, чтений кэша, ходов с инструментами, полное время выполнения и долю принятых изменений.
  4. Замените thinking: disabled на поддерживаемое поведение between_tools, где это необходимо.
  5. Уберите предположения о принудительном использовании инструментов и протестируйте новое поведение выбора инструментов.
  6. Обновите потоковый код, чтобы он обрабатывал блоки thinking между вызовами инструментов.
  7. Повторно проверьте нестандартные параметры сэмплирования: в официальной документации указаны ошибки 400 для нестандартных temperature, top_p и top_k.
  8. Добавьте потолок расходов и условие аварийного завершения для неконтролируемого вывода или повторяющихся циклов с инструментами.
  9. Сравнивайте стоимость принятого изменения, а не стоимость запроса.
  10. Выкатывайте модель на небольшой процент трафика. Увеличивайте долю Sonnet только в том случае, если при согласованном допуске она сохраняет показатель принятых изменений на уровне текущей модели и снижает стоимость принятого изменения.

Сотрудник Anthropic @cjav_dev сообщил, что запросы с thinking: {"type":"disabled"} начали возвращать ошибки 400 и вместо этого должны использовать between_tools (публикация в X).

Когда выбирать Sonnet 5.5, Opus 5.5 или более дешёвую модель

НагрузкаЧто выбрать сначалаПочему
Локальные исправления и рефакторингSonnet 5.5 на medium/highСильный результат в терминальном бенчмарке при более низких тарифах за токены
Массовая классификация кода или простые правкиSonnet 5.5 на low/medium или более дешёвая модельНе стоит платить за ненужное рассуждение
Долго работающий агент для репозиторияSonnet 5.5 с кэшированием и жёсткими бюджетамиИтоговый счёт определяют кэш и количество ходов
Неоднозначная архитектура или финальное ревьюOpus 5.5Широта суждений важнее минимального тарифа
Офлайн-анализ кода без срочностиSonnet 5.5 Batch APIAPI даёт скидку 50% на входные и выходные токены
Эксперимент с максимальным уровнем усилий в терминалеSonnet 5.5 только после внутреннего бенчмаркаTerminal-Bench — сильная сторона модели, но максимум может быть дорогим

Используйте Sonnet для чётко определённых задач с измеримым результатом, а неоднозначную архитектурную работу передавайте Opus.

FAQ по Claude Sonnet 5.5 API

Сколько стоит Claude Sonnet 5.5 API?

Стандартная цена составляет $2 за миллион входных токенов и $10 за миллион выходных. Чтение кэша стоит $0.20 за миллион токенов, запись — $2.50 на пять минут или $4 на один час, а Batch API снижает стоимость входных и выходных токенов на 50%.

Sonnet 5.5 лучше Opus 5.5 для кодинга?

В опубликованном сравнении Terminal-Bench 4.0 Sonnet 5.5 лидирует с результатом 70.6% против 66.4% у Opus 5.5. В ряде других тестов Opus остаётся впереди, поэтому маршрутизацию стоит строить по типу задачи, а не воспринимать результат кодингового бенчмарка как универсальный рейтинг.

Какой ID у модели Sonnet 5.5?

В Claude API используйте claude-sonnet-5-5. Идентификаторы для конкретных провайдеров перечислены в документации моделей Anthropic.

Поддерживает ли Sonnet 5.5 контекстное окно на 1M токенов?

Да. Anthropic заявляет контекстное окно на 1 миллион токенов и стандартный максимальный вывод 128 000 токенов. В бета-версии Message Batches API можно получить 300 000 выходных токенов с указанным в документации beta-заголовком.

Что изменилось при миграции с Sonnet 5?

Изменились адаптивное рассуждение и поведение блоков ответа, принудительное использование инструментов может приводить к ошибке, нестандартные параметры сэмплирования могут возвращать ошибки 400, а thinking: disabled нужно заменить на поддерживаемое поведение. Перед выкатыванием в продакшен повторно прогоните тесты агента и потоковой обработки.

Проведите недельный пилот на задачах со средним и высоким уровнем усилий: измеряйте стоимость принятого изменения, а неудачные случаи отправляйте на Opus.