AIREITER
AnthropicText Chat

Claude Haiku 5.5

Claude Haiku 5.5 API за половину стоимости от Anthropic: $0.05 ввод, $0.25 вывод за 1M токенов при объеме до 100K. Тариф для длинного контекста, важные отличия от Haiku 4.5, примеры кода.

Входные TokenВводВыводЧтение кэшаСоздание кэша
≤ 100,000$0.05 za 1 mln tokenov$0.25 za 1 mln tokenov$0.005 za 1 mln tokenov$0.0625 za 1 mln tokenov
> 100,000$0.25 za 1 mln tokenov$1.25 za 1 mln tokenov$0.025 za 1 mln tokenov$0.3125 za 1 mln tokenov

Цены за миллион токенов. Тариф применяется ко всему запросу по общему числу входных токенов, включая чтение и запись кэша.

Запустить через API

ВВОД

ВЫВОД

Example
Generated in
42.7 seconds
Входные Token
134
Выходные Token
2354
Tokens per second
55.13 tokens / second
Time to first token
-

Сведения о модели

Используйте тот же ключ модели в Playground, запросах API и внутренних рабочих процессах.

ID модели
claude-haiku-5-5
Провайдер
Anthropic
Протокол
Anthropic Messages
Окно контекста
1,000,000 токенов
Максимальный вывод
128,000 токенов

Что нового в Claude Haiku 5.5

Anthropic представила Claude Haiku 5.5 7 октября 2026 года, спустя год после Haiku 4.5. Цена на короткие запросы упала на 90%, а возможности модели заметно приблизились к Sonnet.

Первая модель Haiku с контролем усилий (effort)

Haiku 5.5 поддерживает адаптивное мышление и пять уровней усилий (effort): low, medium, high, xhigh и max. По умолчанию установлен medium. В предыдущих версиях Haiku параметр effort отсутствовал.

Контекст 1M и вывод до 128K

Контекстное окно выросло с 200K токенов в Haiku 4.5 до 1M, а максимальный объем вывода — с 64K до 128K. Поддерживается ввод текста и изображений. Актуальность базы знаний — июнь 2026 года.

Заметный скачок в агентских и офисных задачах

При максимальном уровне effort Anthropic заявляет 72.4% в OSWorld 2.1 (против 15.7% у Haiku 4.5) и 1620 баллов Elo в GDPval-AA (против 735 у Haiku 4.5). При этом Sonnet 5.5 все еще опережает модель во всех опубликованных бенчмарках.

Независимая оценка

Artificial Analysis дает Haiku 5.5 43 балла в Intelligence Index при максимальном effort (по сравнению с 17 у Haiku 4.5) и 34 балла при стандартном уровне medium.

Claude Haiku 5.5 против Haiku 4.5 и Sonnet 5.5

Все эти модели доступны по одному API-ключу AIReiter — для переключения достаточно поменять значение поля model.

Haiku 5.5 против Haiku 4.5

Официальная цена Haiku 4.5 составляет $1 за ввод и $5 за вывод на миллион токенов. Haiku 5.5 стоит $0.10 и $0.50 для запросов объемом до 100K токенов. По оценке Anthropic, реальные задачи обходятся примерно на 75% дешевле даже с учетом нового токенизатора, создающего около 30% дополнительных токенов на тот же объем текста.

Haiku 5.5 против Sonnet 5.5

Sonnet 5.5 стоит здесь $1.00 за ввод и $5.00 за вывод на миллион токенов — в двадцать раз дороже базового тарифа Haiku 5.5. Для сложных задач программирования Anthropic по-прежнему рекомендует Sonnet 5.5 или Opus 5.5. Haiku 5.5 оптимален для классификации, извлечения данных, суммаризации, маршрутизации и вспомогательных шагов субагентов.

Haiku 5.5 против GPT-6 Luna

Официальная цена обеих моделей — $0.10 за ввод и $0.50 за вывод. По данным Anthropic, Haiku 5.5 опережает конкурента в OSWorld 2.1 (72.4% против 48.9%) и GDPval-AA (1620 против 1437). Artificial Analysis отмечает, что Haiku 5.5 расходует больше токенов на вывод для достижения сопоставимых результатов, поэтому рекомендуем провести сравнение на своих сценариях.

Цены на API Claude Haiku 5.5 в AIReiter

Все тарифы в два раза ниже официальных цен Anthropic (скидка 50%). Ставка рассчитывается в зависимости от количества входных токенов в конкретном запросе.

До 100K входных токенов

Ввод $0.05 (официальная цена $0.10). Вывод $0.25 (официальная цена $0.50). Чтение из кэша $0.005 (официальная цена $0.01). Запись в кэш $0.0625 (официальная цена $0.125). Все цены указаны за миллион токенов.

Более 100K входных токенов: все тарифы x5

Ввод $0.25 (официальная цена $0.50). Вывод $1.25 (официальная цена $2.50). Чтение из кэша $0.025 (официальная цена $0.05). Запись в кэш $0.3125 (официальная цена $0.625). Тарифный план определяется для каждого запроса по общему объему входа, включая кэшированные токены, и действует на весь запрос.

Два реальных примера

50K входных токенов и 5K на вывод стоят здесь $0.00375 (против $0.0075 по официальному прайсу). 200K входных токенов и 10K на вывод переходят на тариф длинного контекста и стоят $0.0625 (против $0.125 по официальному прайсу). Если разделить большую задачу на запросы объемом до 100K, стоимость будет в пять раз ниже.

Оплата только за фактически использованные токены

В начале запроса блокируется ориентировочная сумма, которая после завершения ответа пересчитывается по фактическому расходу токенов, а разница возвращается на баланс. Токены рассуждений (thinking tokens) оплачиваются как вывод.

Миграция с Haiku 4.5: что теперь вызывает ошибку

Просто изменить строку модели на claude-haiku-5-5 бывает недостаточно. Эти форматы запросов работали в Haiku 4.5, но отклоняются в Haiku 5.5.

Уберите temperature, top_p и top_k

Нестандартные значения сэмплинга возвращают ошибку 400 с сообщением «deprecated for this model». Удалите эти поля и управляйте выводом с помощью промпта и уровня effort.

Prefill для assistant не поддерживается

Диалог, заканчивающийся сообщением от assistant, возвращает ошибку 400. Последнее сообщение должно быть от пользователя. Чтобы задать нужный формат, используйте structured outputs или укажите это в промпте.

Замените бюджеты на thinking параметром effort

API Anthropic отклоняет thinking: {"type": "enabled", "budget_tokens": N} для этой модели, поэтому удалите его и укажите output_config.effort. Токены thinking по-прежнему расходуются из max_tokens, поэтому увеличьте max_tokens, если ответы обрезаются.

Отключение thinking ограничивает effort уровнем high

Параметр thinking: {"type": "disabled"} работает при effort со значениями low, medium и high. При xhigh или max возвращается 400. Режим размышления between_tools, используемый в Sonnet 5.5, не поддерживается в Haiku 5.5. Принудительный tool_choice по-прежнему работает.

Выберите уровень effort до релиза в прод

Параметр effort — главный регулятор качества, задержки и стоимости. В Haiku 5.5 разница между уровнями значительна.

Основные показатели приведены для max effort

Показатели Anthropic при релизе получены при max effort. При значении по умолчанию medium effort Anthropic сообщает о рейтинге GDPval-AA Elo 1277 вместо 1620. Оценивайте результаты бенчмарков с учетом уровня effort.

Уровень max потребляет много токенов

По данным Artificial Analysis, на задачу Intelligence Index при max effort уходит около 162K выходных токенов — примерно в три раза больше, чем у GPT-6 Luna на максимуме. При medium скорость генерации составила около 137 выходных токенов в секунду.

Начните с low или medium

Для классификации, извлечения данных и маршрутизации режимы low или medium с отключенным thinking позволяют снизить задержку и затраты. Повышайте уровень только для задач, где не хватает качества.

Как вызывать API Claude Haiku 5.5

Эндпоинт работает по протоколу Anthropic Messages, поэтому для существующего клиента Claude достаточно изменить базовый URL и ключ.

01

Получите ключ и перенаправьте клиент на AIReiter

Создайте API-ключ в панели управления AIReiter. В официальных SDK от Anthropic укажите базовый URL https://aireiter.com/api — SDK сам добавит путь /v1/messages.

02

Отправьте запрос с помощью curl

curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'

03

Или используйте Python SDK

from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))

Часто задаваемые вопросы по API Claude Haiku 5.5

/ 01

Когда вышла Claude Haiku 5.5 и какой у нее ID модели?

Anthropic выпустила её 7 октября 2026 года. ID модели в API — claude-haiku-5-5, а дата отсечения знаний — июнь 2026 года. По заявлению Anthropic, поддержка модели продлится как минимум до 7 октября 2027 года.

/ 02

Какой размер контекстного окна и максимальный объем вывода?

Контекстное окно составляет 1M токенов, а максимальный объем вывода — до 128K токенов на запрос. Модель принимает текстовые и графические входные данные и возвращает текст.

/ 03

Сколько стоит API Claude Haiku 5.5?

Тарифы Anthropic составляют $0,10 за входящие и $0,50 за исходящие на миллион токенов для запросов до 100K входных токенов и в пять раз больше при объеме свыше 100K. AIReiter берет вдвое меньше: $0,05 и $0,25, либо $0,25 и $1,25 при объеме свыше 100K.

/ 04

Почему один запрос стоил в пять раз дороже?

Общий объем входных данных превысил 100K токенов, поэтому весь запрос тарифицировался по ставке для длинного контекста. Кэшированные токены также учитываются в лимите 100K.

/ 05

Почему ответы начинаются с блока thinking?

Режим adaptive thinking включен по умолчанию, поэтому ответ может содержать блок thinking перед текстом. Считывайте блоки content по их типу, а не просто берите content[0], либо отключите thinking при effort на уровнях low, medium или high.

/ 06

Подходит ли Haiku 5.5 для написания кода?

Для небольших точечных правок и задач субагентов — зачастую да. Для сложной работы с несколькими файлами Anthropic рекомендует Sonnet 5.5 или Opus 5.5, которые доступны по тому же ключу.

/ 07

Нужен ли мне аккаунт Anthropic?

Нет. Ключ AIReiter работает с эндпоинтом AIReiter, и вы можете протестировать модель в playground на этой странице перед написанием кода.

/ 08

Какие API поддерживаются?

Основным контрактом является Anthropic Messages по адресу /api/v1/messages со стримингом. Также поддерживаются OpenAI-совместимый Chat Completions и Responses API, а /api/v1/models возвращает список моделей, доступных для вашего ключа.