AIREITER
AnthropicText Chat

Claude Sonnet 5.5

Claude Sonnet 5.5 API вдвое дешевле тарифов Anthropic: $1 на вход, $5 на выход за 1 млн токенов. Что изменилось по сравнению с Sonnet 5, бенчмарки, критические изменения и примеры кода.

ВводОфициально $2.00 za 1 mln tokenovAIReiter $1.00 za 1 mln tokenovВыводОфициально $10.00 za 1 mln tokenovAIReiter $5.00 za 1 mln tokenovЧтение кэшаОфициально $0.20 za 1 mln tokenovAIReiter $0.10 za 1 mln tokenovСоздание кэшаОфициально $2.50 za 1 mln tokenovAIReiter $1.25 za 1 mln tokenov
Запустить через API

ВВОД

ВЫВОД

Example
Generated in
42.7 seconds
Входные Token
134
Выходные Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Сведения о модели

Используйте тот же ключ модели в Playground, запросах API и внутренних рабочих процессах.

ID модели
claude-sonnet-5-5
Провайдер
Anthropic
Протокол
Anthropic Messages
Окно контекста
1,000,000 токенов
Максимальный вывод
128,000 токенов
Входные Token
100 credits / 1 млн токенов
Выходные Token
500 credits / 1 млн токенов
Чтение кэша
10 credits / 1 млн токенов
Запись кэша
125 credits / 1 млн токенов

Что нового в Claude Sonnet 5.5

Anthropic выпустила Claude Sonnet 5.5 28 сентября 2026 года как прямое обновление Sonnet 5. Официальная цена осталась прежней, однако возможности модели и расход токенов на решение задач существенно изменились.

Почти на уровне Opus 5.5 в интеллектуальной работе

По данным Anthropic, Sonnet 5.5 набирает 1844 балла в GDPval-AA — всего на 2 балла меньше Opus 5.5 (1846) и примерно на 400 баллов больше Sonnet 5 (1449). Anthropic также отмечает, что Opus 5.5 по-прежнему заметно сильнее в открытых задачах, требующих глубоких и последовательных рассуждений.

Большой шаг вперед в программировании

В тесте CursorBench 4.0 Anthropic заявляет 55.5% для Sonnet 5.5 против 34.1% у Sonnet 5 и 57.8% у Opus 5.5. Anthropic позиционирует модель для четко очерченных повседневных задач: разработка функций, исправление ошибок, создание документов, презентаций и таблиц.

Меньше токенов на ту же задачу

Первые пользователи отметили экономию на реальных нагрузках: Slack зафиксировал сокращение исходящих токенов примерно на 14% без изменения промптов, а Balyasny Asset Management получили около 121 тыс. токенов на ответ против 497 тыс. у Sonnet 5 на выборке из 2441 финансовой задачи.

Быстрее генерация, тот же токенизатор

По заявлениям Anthropic, генерация более чем на 30% быстрее Sonnet 5; Artificial Analysis зафиксировали скорость около 139 выходных токенов в секунду. Токенизатор не изменился, поэтому один и тот же текст содержит одинаковое количество токенов в обеих моделях.

Claude Sonnet 5.5 против Sonnet 5 и Opus 5.5

Все три модели работают по одному API-ключу AIReiter. Вкратце: переходите с Sonnet 5, как только ваши запросы пройдут проверки миграции, описанные ниже, и оставьте Opus 5.5 для самых сложных открытых задач.

Sonnet 5.5 против Sonnet 5: та же цена, больше возможностей

Официальная цена обеих моделей — $2 на вход и $10 на выход за миллион токенов. Sonnet 5.5 показывает более высокие результаты в тестах на программирование и работу со знаниями и обычно тратит меньше токенов, поэтому решение тех же задач обходится дешевле.

Sonnet 5.5 против Opus 5.5: в два раза дешевле

У нас Sonnet 5.5 стоит $1.00 на вход и $5.00 на выход за миллион токенов, а Opus 5.5 — $2.00 и $10.00. Обе модели поддерживают контекстное окно в 1 млн токенов и до 128 тыс. токенов на выходе, так что для перехода достаточно лишь изменить поле model.

Когда все же стоит выбрать Opus 5.5

Для длительных, неоднозначных задач, где модели нужно самостоятельно планировать, замечать свои ошибки и продолжать работу. Base44 сообщили о 3.6 итерациях на сборку приложения с Sonnet 5.5 против 7.7 с Opus 5, поэтому сначала попробуйте Sonnet 5.5 и передавайте Opus только те задачи, с которыми она не справилась.

Когда пока лучше остаться на Sonnet 5

Если ваш код отключает thinking, принудительно задает определенный инструмент (tool) или выставляет temperature, такие запросы в Sonnet 5.5 будут завершаться с ошибкой, пока вы их не измените. Инструменты безопасности также могут чаще возвращать отказы. Сначала исправьте это, а затем переходите на новую модель.

Миграция с Sonnet 5: что теперь возвращает ошибку

Просто изменить строку модели на claude-sonnet-5-5 не всегда достаточно. Эти форматы запросов работали в Sonnet 5, но отклоняются в Sonnet 5.5.

thinking: disabled возвращает ошибку 400

Адаптивное мышление (adaptive thinking) включено всегда. Замените {"type": "disabled"} на {"type": "between_tools"} — минимальный режим, который пропускает этап мышления перед первым ответом. between_tools работает только при значениях effort: low, medium или high; для xhigh или max не указывайте thinking вовсе или отправьте {"type": "adaptive"}.

Ручной бюджет токенов на мышление возвращает ошибку 400

Параметр thinking: {"type": "enabled", "budget_tokens": N} отклоняется. Вместо этого управляйте глубиной с помощью параметра effort. Токены мышления по-прежнему вычитаются из max_tokens и тарифицируются как исходящие, поэтому увеличьте max_tokens, если ответы начинают обрезаться.

Принудительный выбор инструмента (tool_choice) отклоняется

Параметр tool_choice, принудительно вызывающий конкретный инструмент, теперь приводит к ошибке. Используйте автоматический выбор с точным описанием инструментов и позвольте модели самой решать, когда их вызывать.

Пользовательские temperature, top_p и top_k возвращают ошибку 400

Поддерживается только сэмплирование по умолчанию. Удалите эти поля из запроса вместо установки фиксированных значений. Одно изменение играет вам на руку: минимальный размер кэшируемого промпта снизился с 1024 до 512 токенов.

Выберите уровень effort до релиза в прод

Параметр effort теперь главный регулятор стоимости и задержки. Доступно пять уровней: low, medium, high, xhigh и max.

По умолчанию в API используется high

Если не передать параметр effort, API выполняет запрос со значением high. В Claude Code и приложениях Claude по умолчанию используется medium. Задавайте output_config.effort явно, чтобы ваш счет не зависел от значений по умолчанию.

max — это дорого

При уровне effort max компания Artificial Analysis зафиксировала $7.60 за задачу по базовому прайс-листу и 410M выходных токенов по всему индексу при медиане в 88M. Заявления Anthropic об эффективности относятся к более низким уровням, а не к max.

Начните с medium, измерьте и скорректируйте

Запустите реальные задачи на medium, проверьте качество и повышайте уровень только там, где его не хватает. Для чувствительных к задержке цепочек вызова инструментов режимы low или medium с thinking between_tools обеспечивают быстрые первые ответы.

Тарифы на API Claude Sonnet 5.5 на AIReiter

Все позиции тарифицируются со скидкой 50% от официального прайс-листа Anthropic. Та же модель, тот же протокол Messages.

Половина от официального прайса на все позиции

Входные: $1.00 (официальный $2.00). Выходные: $5.00 (официальный $10.00). Чтение кэша: $0.10 (официальный $0.20). Запись кэша: $1.25 (официальный $2.50). Все цены указаны за миллион токенов.

Реальный вызов: $1.50 вместо $3.00

Один миллион входных токенов плюс сто тысяч выходных токенов стоят $1.50 здесь и $3.00 по официальному прайс-листу Anthropic. Тот же вызов на Opus 5.5 здесь стоит $3.00.

Оплата только за фактически использованные токены

При начале вызова удерживается оценочная сумма, затем, после завершения ответа, происходит расчет по реальному количеству токенов, а разница возвращается. Тариф одинаков с первого до миллионного токена — наценки за длинный контекст нет.

Как вызывать API Claude Sonnet 5.5

Эндпоинт работает по протоколу Anthropic Messages, поэтому для существующего клиента Claude достаточно изменить базовый URL и ключ.

01

Получите ключ и перенаправьте клиент на AIReiter

Создайте API-ключ в панели управления AIReiter. В официальных SDK от Anthropic укажите базовый URL https://aireiter.com/api — SDK сам добавит путь /v1/messages.

02

Отправьте запрос с помощью curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-sonnet-5-5", "max_tokens": 4096, "output_config": {"effort": "medium"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

Или используйте Python SDK

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-sonnet-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(msg.content[0].text)

FAQ по Claude Sonnet 5.5 API

/ 01

Когда была выпущена Claude Sonnet 5.5 и какой у нее ID модели?

Anthropic выпустила ее 28 сентября 2026 года. ID модели в API — claude-sonnet-5-5, а дата отсечения знаний — июнь 2026 года.

/ 02

Какой размер контекстного окна и максимальный объем вывода?

Контекстное окно составляет 1M токенов, а максимальный объем вывода — до 128K токенов на запрос. Модель принимает текстовые и графические входные данные и возвращает текст.

/ 03

Сколько стоит API Claude Sonnet 5.5?

Anthropic указывает цену в $2 за входные и $10 за выходные токены за миллион, как и для Sonnet 5. AIReiter берет вдвое меньше: $1 за входные, $5 за выходные токены, $0.10 за чтение из кэша и $1.25 за запись в кэш.

/ 04

Можно ли отключить рассуждения (thinking)?

Не полностью. thinking disabled возвращает ошибку 400. Минимальная настройка — between_tools, которая работает с low, medium и high effort.

/ 05

Sonnet 5.5 лучше, чем Sonnet 5?

Судя по бенчмаркам Anthropic в программировании и интеллектуальной работе — да, с большим отрывом и по той же официальной цене. Перед переходом ознакомьтесь с изменениями миграции выше, так как некоторые структуры запросов Sonnet 5 теперь завершаются ошибкой.

/ 06

Почему мой запрос по безопасности был отклонен или на него ответил Sonnet 5?

Sonnet 5.5 — первая модель линейки Sonnet со встроенными механизмами защиты от киберугроз, используемыми в самых мощных моделях Anthropic. Некоторые запросы с повышенным риском перенаправляются на Sonnet 5, а безвредные задачи по безопасности могут чаще получать отказы. Это поведение исходного провайдера (upstream).

/ 07

Нужен ли мне аккаунт Anthropic?

Нет. Ключ AIReiter работает с эндпоинтом AIReiter, и вы можете протестировать модель в playground на этой странице перед написанием кода.

/ 08

Какие API поддерживаются?

Основным контрактом является Anthropic Messages по адресу /api/v1/messages со стримингом. Также поддерживаются OpenAI-совместимый Chat Completions и Responses API, а /api/v1/models возвращает список моделей, доступных для вашего ключа.