Цены на Claude API начинаются от $1 за миллион токенов (вход Haiku 4.5) и доходят до $50 за миллион (выход Fable 5) по состоянию на июль 2026 года, и для каждой актуальной модели действует правило: выходные токены стоят в 5 раз дороже входных. Но указанная цена — это лишь самая простая часть. Новый токенизатор, маршрутизация только по США, быстрый режим и ловушка при выставлении счетов, которую большинство людей никогда не замечает, — всё это стоит между прайс-листом и вашим фактическим счетом; и есть способ покупать те же модели за долю от официальной цены.
Каждая цифра ниже взята с официальной страницы с ценами Anthropic; проверьте её, прежде чем окончательно утверждать бюджет, поскольку тарифы моделей меняются.
Цены на API Claude в 2026 году: все модели
Это текущие ставки за миллион токенов, проверенные по прайсингу Anthropic за июль 2026 года (официальный источник). Opus 4.8 был запущен 28 мая 2026 года по той же ставке, что и 4.7.
Модель | Ввод / 1M | Вывод / 1M | Контекст |
|---|---|---|---|
Claude Fable 5 | $10.00 | $50.00 | 1M |
Claude Opus 4.8 | $5.00 | $25.00 | 1M |
Claude Opus 4.7 | $5.00 | $25.00 | 1M |
Claude Opus 4.6 | $5.00 | $25.00 | 1M |
Claude Sonnet 4.6 | $3.00 | $15.00 | 1M |
Claude Haiku 4.5 | $1.00 | $5.00 | 200K |
Две вещи, в которых многие старые руководства ошибаются. Fable 5 — самая мощная модель Anthropic — находится выше уровня Opus по цене $10/$50, а вся линейка Opus 4.x (4.6, 4.7, 4.8) держится на уровне $5/$25. Эти $5 — это отдельная история: Opus 4.1 стоил $15/$75, а снижение до $5/$25 при запуске 4.6 стало снижением на 67% для флагманской модели, которое сохраняется уже на протяжении трех релизов с тех пор.
Устаревшие и бюджетные варианты
Если вам не нужны самые новые модели, старые по-прежнему доступны: Sonnet 4.5 ($3/$15), Opus 4.5 ($5/$25, 200K context), Haiku 3.5 ($0.80/$4) и Haiku 3 ($0.25/$1.25) для задач с максимальной чувствительностью к стоимости и большим объёмом.
Одна недооценённая деталь: Opus 4.6/4.7/4.8, Sonnet 4.6 и Fable 5 — все включают полный контекстное окно на 1 млн токенов по стандартной цене — без надбавки за длинный контекст. Запрос на 900 тыс. токенов стоит по той же ставке за токен, что и запрос на 9 тыс., тогда как несколько конкурентов взимают доплату после превышения порога длины.
Расходы, которых нет в прайс-листе
Таблица тарифов — это то место, где большинство статей о ценообразовании заканчиваются и где начинаются сюрпризы — потому что несколько факторов влияют на ваш фактический счёт, не меняя цену за токен.
Токенизатор, который незаметно добавляет токены
Opus 4.7 (и Opus 4.8, который использует его tokenizer) изменил способ разбиения текста на токены. Один и тот же ввод может приводить к примерно на 35% большему числу токенов, чем в Opus 4.6 — при той же ставке за токен. Больше всего страдают код, структурированные данные (JSON/XML) и текст не на английском, потому что ставка не изменилась, а изменилось количество токенов. Не воспринимайте 35% на веру: прежде чем доверять старому бюджету, прогоните ваши реальные промпты через token-counting endpoint в новой модели и сравните.
Мышление, быстрый режим и маршрутизация только для США
Согласно документации по ценам Anthropic:
Токены extended thinking тарифицируются как output, даже если вы их никогда не отображаете. Запрос с интенсивным reasoning незаметно увеличивает часть счета, относящуюся к output.
Fast mode (только Opus 4.8/4.7) запускает ту же модель до 2.5× быстрее по цене, в 2× выше стандартной.
US-only inference (data residency) добавляет множитель 1.1× к input и output; региональные endpoints AWS Bedrock или Vertex добавляют сверху еще примерно 10%.
Инструменты на стороне сервера
Инструменты, работающие на стороне Anthropic, оплачиваются отдельно, согласно тем же документам о тарифах: поиск в вебе стоит $10 за 1,000 поисков плюс токены на обработку результатов, а выполнение кода бесплатно в пределах ежемесячного лимита, затем около $0.05/час за контейнер. (Проверьте текущие значения на странице тарифов — ставки для серверных инструментов меняются.)
Подводный камень с оплатой, в который попадают пользователи Claude Code
Этого нет ни на одной ценовой карточке. Если у вас ANTHROPIC_API_KEY установлен в вашей оболочке, Claude Code выставляет счета через API с оплатой за токен вместо вашей подписки. Людей, ожидавших фиксированные $20–$200 в месяц, именно по этой причине неприятно удивляли почасовые или поминутные начисления. Проверьте свою среду перед длительной сессией.
Сколько на самом деле будет стоить Claude?
Тарифы мало что значат, пока вы не сопоставите их с рабочей нагрузкой. Три примера по текущим ценам, все при 10,000 запросов/день (2,000 входных + 500 выходных токенов каждый — 20M входных + 5M выходных токенов/день):
Чат-бот поддержки на Haiku 4.5 ($1/$5): 20M × $1 + 5M × $5 = $45/day, около $1,350/month.
Агент для программирования на Sonnet 4.6 ($3/$15): $60 + $75 = $135/day, около $4,050/month до оптимизации.
RAG-приложение с высоким контекстом на Opus 4.8 ($5/$25), где извлечённые документы сильно увеличивают input, выходит на уровень высоких четырёх- или пятизначных сумм в месяц, потому что объём input доминирует.
То же количество, три модели — один только выбор модели меняет счет примерно в 3 раза между Haiku и Sonnet.
Это не гипотетические пределы. Один тред на r/ClaudeAI отследил 31 пользователя Claude Code, чье использование обошлось бы примерно в $80,000/month по тарифам API, а самый активный пользователь — почти в $18,000; это оценка того, как их использование по подписке было бы тарифицировано по поминутному API, а не буквальный счет. Именно при интенсивных автономных нагрузках счет становится реальным, и именно там нижеописанные оптимизации дают эффект.
Ограничения по частоте запросов и уровни использования
Ценообразование — не единственное ограничение — то, как быстро вы можете его расходовать, зависит от уровня. Новые API-аккаунты начинают с консервативных лимитов запросов в минуту (RPM) и токенов в минуту (TPM), которые автоматически повышаются по мере «старения» аккаунта и роста ваших совокупных расходов (Tier 1 → 4). Новые аккаунты также получают $5 бесплатных кредитов для тестирования, без необходимости привязывать карту. Помимо пропускной способности, Anthropic предлагает уровни обслуживания, в которых есть компромисс между доступностью и ценой: стандартный уровень (по умолчанию), приоритетный уровень с гарантированной доступностью и batch-уровень со скидкой 50% для асинхронной обработки ниже. Перед тем как проектировать систему под масштаб, проверьте точные значения для вашего уровня в документации по rate-limits — квота, достаточная для пилотного трафика, может потребовать повышения уровня для production.
Подписка Claude vs API: что дешевле?
Самый распространённый практический вопрос, и ответ — это порог, а не вердикт.
Claude Pro стоит $20/месяц; Max — $100 или $200/месяц. Они включают приложения Claude и Claude Code в рамках лимита использования — без оплаты за каждый токен.
The API — это чистая модель pay-as-you-go, без минимального ежемесячного платежа и без потолка использования.
Переломный порог находится на уровне нескольких миллионов токенов в месяц — примерно 3–4 млн на модели среднего уровня (Sonnet), если предположить сбалансированное соотношение входа и выхода и что в противном случае вы укладывались бы в лимит использования Pro. На Haiku он смещается вверх, а на Opus — вниз, так что воспринимайте это как диапазон, а не как фиксированную границу. Ниже этого объёма подписка обычно дешевле и проще. Выше него — особенно при production traffic или интенсивном agentic coding — выигрывает почасовая ставка API за токен, и вы получаете контроль (rate limits, monitoring, multi-key billing), которого не даёт план. В частности, для кодинга в течение всего дня разработчики оценивают, что план Max может быть значительно дешевле, чем та же работа, оплачиваемая по токенам на Opus.
Практическое правило: прототипы и индивидуальное использование → подписка; масштабируемый трафик продукта → API. И помните о ловушке ANTHROPIC_API_KEY, описанной выше, иначе вы заплатите в обоих случаях.
Как платить меньше за API Claude
Три рычага сокращают стандартный счёт без изменения моделей.
1. Кэширование промптов (до 90% скидки на повторяющийся контекст)
Кэшируйте стабильный префикс — длинный системный prompt, извлечённые документы, few-shot примеры — и чтения из кэша стоят 0.1× от входной ставки, что даёт скидку 90%. Загвоздка в записи: запись в кэш на 5 минут стоит 1.25× и окупается после одного чтения; запись на 1 час стоит 2× и окупается после двух. Для всего, что имеет большой фиксированный пролог и многократно используется, это самый большой отдельный рычаг. (Документация по кэшированию.)
2. Пакетный API (50% скидка, в обоих направлениях)
Для всего, что не требует ответа в реальном времени, Batch API снижает стоимость входных и выходных данных на 50% и возвращает результат в течение 24 часов. У Sonnet 4.6 цена снижается до $1.50/$7.50; у Haiku 4.5 — до $0.50/$2.50. Кэширование и пакетная обработка суммируются, опуская эффективную стоимость значительно ниже половины базовой ставки.
3. Маршрутизация модели и ограничения вывода
Не запускайте каждый запрос на Opus. Перенаправляйте классификацию, суммаризацию и логику маршрутизации на Haiku, оставляйте Sonnet для задач среднего уровня и вызывайте Opus только тогда, когда задача действительно этого требует — обычно это само по себе даёт сокращение на 40–60%. И поскольку стоимость output в 5× выше, чем input, ограничение max_tokens — один из самых эффективных рычагов: снижение среднего объёма output с 800 до 500 токенов на миллионе вызовов экономит реальные деньги каждый месяц.
Официальный API vs relay-платформы: можно ли платить меньше?
Есть и четвёртый способ, о котором в официальной документации не упоминают: покупать те же модели Claude через relay. API relay (или агрегатор) находится между вами и Anthropic, предоставляет endpoint, совместимый с Anthropic, и взимает собственную плату.
Почему реле может быть дешевле? В основном три причины: реле закупают на объёмах с обязательством использования, что даёт скидки, недоступные отдельному аккаунту; они эффективно маршрутизируют трафик между регионами и провайдерами; и многие работают с минимальной маржой (или как убыточный продукт), чтобы привлечь разработчиков. Но такая глубокая скидка должна откуда-то браться — прежде чем на неё полагаться, разберитесь в модели платформы.
Скидки сильно различаются. Вот как три варианта сравниваются для одних и тех же моделей Claude:
Платформа | Скидка по сравнению с прайсом Anthropic | Покрытие моделей | Примечания |
|---|---|---|---|
Official Anthropic API | — (baseline) | All, incl. Fable 5 / Opus 4.8 | Caching, batch, every feature |
≈ list (passes provider price through) | Many models, multi-provider | Aggregator; convenience over savings | |
EvoLink | ~10% off | Up to Opus 4.7 | OpenAI-compatible endpoint |
~80% off | Up to Opus 4.6 | Anthropic-compatible; caching passes through |
AIReiter находится на более агрессивном конце. Вот как примерно 80% в заголовке выглядит для каждой модели:
Модель | Официально (вход / выход) | AIReiter (вход / выход) | Вы экономите |
|---|---|---|---|
Claude Haiku 4.5 | $1 / $5 | $0.20 / $1.00 | 80% |
Claude Sonnet 4.6 | $3 / $15 | $0.60 / $3.00 | 80% |
Claude Opus 4.6 | $5 / $25 | $1.00 / $5.00 | 80% |
Интеграция выполняется без изменений в коде: endpoint AIReiter совместим с Anthropic Messages API, поэтому официальный SDK anthropic работает после изменения двух строк — укажите base_url на https://aireiter.com/api и замените ключ:
client = anthropic.Anthropic(
api_key="YOUR_AIREITER_KEY",
base_url="https://aireiter.com/api",
)
Потоковая передача, многоходовость, vision и cache_control все проходят, поэтому скидка на кэширование 90% выше накладывается поверх более низкой базовой ставки.
FAQ
Почему Claude API такой дорогой?
Часто дело не в ставке за токен — а в проектировании рабочего процесса. Основные факторы затрат — запуск всего на Opus, когда подошли бы Haiku или Sonnet, повторяющийся некэшированный контекст, неограниченный объём вывода и токены рассуждений, за которые с вас берут плату, но которые вы никогда не видите. Исправление этого обычно важнее, чем заявленная цена.
Есть ли бесплатный тариф Claude API?
Постоянного бесплатного production-уровня нет, но новые аккаунты получают $5 бесплатных кредитов (карта не требуется) для тестирования. После этого оплата по мере использования.
Цены на Claude API vs ChatGPT — что дешевле?
Это зависит от сравниваемого тарифа. Примерно, за миллион токенов (вход / выход):
Claude | Сопоставимый OpenAI |
|---|---|
Haiku 4.5 — $1 / $5 | уровень GPT mini — низкие однозначные числа |
Sonnet 4.6 — $3 / $15 | средний уровень — сопоставимо |
Opus 4.8 — $5 / $25 | GPT-5.5 — ~$5 / $30 |
Как мне рассчитать мой ежемесячный счёт за Claude API?
Оцените это как: (requests × avg input tokens ÷ 1,000,000 × input rate) + (requests × avg output tokens ÷ 1,000,000 × output rate). Используйте endpoint подсчёта токенов для точного подсчёта на ваших реальных промптах — универсальный tokenizer может ошибаться на 15–35% в Claude.
Итог
Для большинства команд это разделение на три направления: прототипирование или индивидуальное использование → подписка Pro или Max (проще, дешевле при объёме ниже ~3–4 млн токенов/месяц); production на новейшем флагмане (Opus 4.8, Fable 5) → официальный API с включёнными caching, batching и routing; production, где достаточно Sonnet 4.6 или Opus 4.6 → надёжный relay вроде AIReiter может снизить тот же счёт до 80% при замене SDK без изменений в коде.
Что бы вы ни выбрали, большинство команд переплачивают не из-за неправильного тарифа, а из-за того, что пропускают оптимизации — так что включите все рычаги, прежде чем беспокоиться о прайс-листе.