Что нового в Claude Haiku 5.5
Anthropic представила Claude Haiku 5.5 7 октября 2026 года, спустя год после Haiku 4.5. Цена на короткие запросы упала на 90%, а возможности модели заметно приблизились к Sonnet.
Первая модель Haiku с контролем усилий (effort)
Haiku 5.5 поддерживает адаптивное мышление и пять уровней усилий (effort): low, medium, high, xhigh и max. По умолчанию установлен medium. В предыдущих версиях Haiku параметр effort отсутствовал.
Контекст 1M и вывод до 128K
Контекстное окно выросло с 200K токенов в Haiku 4.5 до 1M, а максимальный объем вывода — с 64K до 128K. Поддерживается ввод текста и изображений. Актуальность базы знаний — июнь 2026 года.
Заметный скачок в агентских и офисных задачах
При максимальном уровне effort Anthropic заявляет 72.4% в OSWorld 2.1 (против 15.7% у Haiku 4.5) и 1620 баллов Elo в GDPval-AA (против 735 у Haiku 4.5). При этом Sonnet 5.5 все еще опережает модель во всех опубликованных бенчмарках.
Независимая оценка
Artificial Analysis дает Haiku 5.5 43 балла в Intelligence Index при максимальном effort (по сравнению с 17 у Haiku 4.5) и 34 балла при стандартном уровне medium.
Claude Haiku 5.5 против Haiku 4.5 и Sonnet 5.5
Все эти модели доступны по одному API-ключу AIReiter — для переключения достаточно поменять значение поля model.
Haiku 5.5 против Haiku 4.5
Официальная цена Haiku 4.5 составляет $1 за ввод и $5 за вывод на миллион токенов. Haiku 5.5 стоит $0.10 и $0.50 для запросов объемом до 100K токенов. По оценке Anthropic, реальные задачи обходятся примерно на 75% дешевле даже с учетом нового токенизатора, создающего около 30% дополнительных токенов на тот же объем текста.
Haiku 5.5 против Sonnet 5.5
Sonnet 5.5 стоит здесь $1.00 за ввод и $5.00 за вывод на миллион токенов — в двадцать раз дороже базового тарифа Haiku 5.5. Для сложных задач программирования Anthropic по-прежнему рекомендует Sonnet 5.5 или Opus 5.5. Haiku 5.5 оптимален для классификации, извлечения данных, суммаризации, маршрутизации и вспомогательных шагов субагентов.
Haiku 5.5 против GPT-6 Luna
Официальная цена обеих моделей — $0.10 за ввод и $0.50 за вывод. По данным Anthropic, Haiku 5.5 опережает конкурента в OSWorld 2.1 (72.4% против 48.9%) и GDPval-AA (1620 против 1437). Artificial Analysis отмечает, что Haiku 5.5 расходует больше токенов на вывод для достижения сопоставимых результатов, поэтому рекомендуем провести сравнение на своих сценариях.
Цены на API Claude Haiku 5.5 в AIReiter
Все тарифы в два раза ниже официальных цен Anthropic (скидка 50%). Ставка рассчитывается в зависимости от количества входных токенов в конкретном запросе.
До 100K входных токенов
Ввод $0.05 (официальная цена $0.10). Вывод $0.25 (официальная цена $0.50). Чтение из кэша $0.005 (официальная цена $0.01). Запись в кэш $0.0625 (официальная цена $0.125). Все цены указаны за миллион токенов.
Более 100K входных токенов: все тарифы x5
Ввод $0.25 (официальная цена $0.50). Вывод $1.25 (официальная цена $2.50). Чтение из кэша $0.025 (официальная цена $0.05). Запись в кэш $0.3125 (официальная цена $0.625). Тарифный план определяется для каждого запроса по общему объему входа, включая кэшированные токены, и действует на весь запрос.
Два реальных примера
50K входных токенов и 5K на вывод стоят здесь $0.00375 (против $0.0075 по официальному прайсу). 200K входных токенов и 10K на вывод переходят на тариф длинного контекста и стоят $0.0625 (против $0.125 по официальному прайсу). Если разделить большую задачу на запросы объемом до 100K, стоимость будет в пять раз ниже.
Оплата только за фактически использованные токены
В начале запроса блокируется ориентировочная сумма, которая после завершения ответа пересчитывается по фактическому расходу токенов, а разница возвращается на баланс. Токены рассуждений (thinking tokens) оплачиваются как вывод.
Миграция с Haiku 4.5: что теперь вызывает ошибку
Просто изменить строку модели на claude-haiku-5-5 бывает недостаточно. Эти форматы запросов работали в Haiku 4.5, но отклоняются в Haiku 5.5.
Уберите temperature, top_p и top_k
Нестандартные значения сэмплинга возвращают ошибку 400 с сообщением «deprecated for this model». Удалите эти поля и управляйте выводом с помощью промпта и уровня effort.
Prefill для assistant не поддерживается
Диалог, заканчивающийся сообщением от assistant, возвращает ошибку 400. Последнее сообщение должно быть от пользователя. Чтобы задать нужный формат, используйте structured outputs или укажите это в промпте.
Замените бюджеты на thinking параметром effort
API Anthropic отклоняет thinking: {"type": "enabled", "budget_tokens": N} для этой модели, поэтому удалите его и укажите output_config.effort. Токены thinking по-прежнему расходуются из max_tokens, поэтому увеличьте max_tokens, если ответы обрезаются.
Отключение thinking ограничивает effort уровнем high
Параметр thinking: {"type": "disabled"} работает при effort со значениями low, medium и high. При xhigh или max возвращается 400. Режим размышления between_tools, используемый в Sonnet 5.5, не поддерживается в Haiku 5.5. Принудительный tool_choice по-прежнему работает.
Выберите уровень effort до релиза в прод
Параметр effort — главный регулятор качества, задержки и стоимости. В Haiku 5.5 разница между уровнями значительна.
Основные показатели приведены для max effort
Показатели Anthropic при релизе получены при max effort. При значении по умолчанию medium effort Anthropic сообщает о рейтинге GDPval-AA Elo 1277 вместо 1620. Оценивайте результаты бенчмарков с учетом уровня effort.
Уровень max потребляет много токенов
По данным Artificial Analysis, на задачу Intelligence Index при max effort уходит около 162K выходных токенов — примерно в три раза больше, чем у GPT-6 Luna на максимуме. При medium скорость генерации составила около 137 выходных токенов в секунду.
Начните с low или medium
Для классификации, извлечения данных и маршрутизации режимы low или medium с отключенным thinking позволяют снизить задержку и затраты. Повышайте уровень только для задач, где не хватает качества.
Как вызывать API Claude Haiku 5.5
Эндпоинт работает по протоколу Anthropic Messages, поэтому для существующего клиента Claude достаточно изменить базовый URL и ключ.
Получите ключ и перенаправьте клиент на AIReiter
Создайте API-ключ в панели управления AIReiter. В официальных SDK от Anthropic укажите базовый URL https://aireiter.com/api — SDK сам добавит путь /v1/messages.
Отправьте запрос с помощью curl
curl https://aireiter.com/api/v1/messages \ -H "x-api-key: $AIREITER_API_KEY" \ -H "anthropic-version: 2023-06-01" \ -H "content-type: application/json" \ -d '{ "model": "claude-haiku-5-5", "max_tokens": 4096, "output_config": {"effort": "low"}, "messages": [{"role": "user", "content": "Hello"}] }'
Или используйте Python SDK
from anthropic import Anthropic client = Anthropic(api_key="YOUR_AIREITER_KEY", base_url="https://aireiter.com/api") msg = client.messages.create( model="claude-haiku-5-5", max_tokens=4096, messages=[{"role": "user", "content": "Hello"}], ) print(next(b.text for b in msg.content if b.type == "text"))
Часто задаваемые вопросы по API Claude Haiku 5.5
/ 01Когда вышла Claude Haiku 5.5 и какой у нее ID модели?
Anthropic выпустила её 7 октября 2026 года. ID модели в API — claude-haiku-5-5, а дата отсечения знаний — июнь 2026 года. По заявлению Anthropic, поддержка модели продлится как минимум до 7 октября 2027 года.
/ 02Какой размер контекстного окна и максимальный объем вывода?
Контекстное окно составляет 1M токенов, а максимальный объем вывода — до 128K токенов на запрос. Модель принимает текстовые и графические входные данные и возвращает текст.
/ 03Сколько стоит API Claude Haiku 5.5?
Тарифы Anthropic составляют $0,10 за входящие и $0,50 за исходящие на миллион токенов для запросов до 100K входных токенов и в пять раз больше при объеме свыше 100K. AIReiter берет вдвое меньше: $0,05 и $0,25, либо $0,25 и $1,25 при объеме свыше 100K.
/ 04Почему один запрос стоил в пять раз дороже?
Общий объем входных данных превысил 100K токенов, поэтому весь запрос тарифицировался по ставке для длинного контекста. Кэшированные токены также учитываются в лимите 100K.
/ 05Почему ответы начинаются с блока thinking?
Режим adaptive thinking включен по умолчанию, поэтому ответ может содержать блок thinking перед текстом. Считывайте блоки content по их типу, а не просто берите content[0], либо отключите thinking при effort на уровнях low, medium или high.
/ 06Подходит ли Haiku 5.5 для написания кода?
Для небольших точечных правок и задач субагентов — зачастую да. Для сложной работы с несколькими файлами Anthropic рекомендует Sonnet 5.5 или Opus 5.5, которые доступны по тому же ключу.
/ 07Нужен ли мне аккаунт Anthropic?
Нет. Ключ AIReiter работает с эндпоинтом AIReiter, и вы можете протестировать модель в playground на этой странице перед написанием кода.
/ 08Какие API поддерживаются?
Основным контрактом является Anthropic Messages по адресу /api/v1/messages со стримингом. Также поддерживаются OpenAI-совместимый Chat Completions и Responses API, а /api/v1/models возвращает список моделей, доступных для вашего ключа.