Пользователь Claude Code пересчитал месяц работы на тарифе Max по открытым API-расценкам — и получил $7,470 вместо счёта на $200. Дело не в аномально высокой цене токена. Подписка просто незаметно ограничивает потребление, а агентские сценарии отправляют модели гораздо больше контекста, чем человек, набирающий сообщения в обычном чате.
Откуда берутся такие разрывы
Опубликованные пользователями соотношения выглядят огромными, но повторяются довольно стабильно. В обсуждении на r/ClaudeAI, где участники восстановили расходы по логам Claude Code, месяц использования Max оценили примерно в $7,470 по API-расценкам против $200 за подписку. В другом, более небольшом обсуждении подписки и API владелец тарифа за $200 оценил тот же сценарий в $5,000–$20,000 в месяц.
Это неаудированные оценки пользователей. Но в обоих случаях повторяется одна и та же самая затратная схема: агент снова и снова проходит по репозиторию.
«Я использую корпоративный API-тариф компании через Claude Code и могу на собственном опыте сказать: при обычной работе над крупными проектами легко потратить $100–$200 за одну сессию только на API». — u/andywidjaja, r/ClaudeAI
Подписка и API-ключ — разные продукты
Anthropic прямо разделяет эти сервисы. В статье справочного центра, обновлённой 16 марта 2026 года, компания называет тарифы Claude и Claude Console «разными продуктами, созданными для разных задач» и отдельно уточняет: платная подписка «не включает доступ к Claude API или Console». OpenAI придерживается той же схемы и разделяет биллинг ChatGPT и API-платформы.
Понять разницу проще, если посмотреть, что именно продаёт каждый вариант:
| Платный тариф для чата | API-ключ | |
|---|---|---|
| Единица продажи | Одно место для пользователя | Объём токенов |
| Ограничения | Плавающее 5-часовое окно и недельные лимиты | Пакетной квоты нет; действуют ограничения скорости и расходов |
| Доступ | Веб-, десктопное и мобильное приложения | Ваш собственный код |
| Модель оплаты | Фиксированная ежемесячная сумма | Переменная, за токены |
| Основа для собственного продукта | Не для этого продаётся | Именно для этого и предназначен |
На странице тарифов Claude указано, что Pro стоит $20 в месяц при помесячной оплате или $17 в месяц при оплате за год ($200 сразу), а Max начинается от $100 в месяц и даёт в 5 или 20 раз больше возможностей Pro в рамках одной пятичасовой сессии. Anthropic не публикует для этих тарифов количество сообщений: расход зависит от длины диалога, модели и используемых функций. Поэтому сравнивать приходится измеряемую величину с той, для которой точного лимита нет.
На той же странице есть ещё одна важная деталь: Claude Enterprise сочетает ежемесячную плату $20 за место с использованием, оплачиваемым по API-расценкам. То есть для активных клиентов счёт всё равно возвращается на поминутный — точнее, поточный — счётчик.
Сколько токенов на самом деле стоит $20 подписки
Если перевести стоимость тарифа в токены, разница становится наглядной. Ниже — официальные расценки за миллион токенов (MTok) из документации по ценам Claude и страницы тарифов API OpenAI, проверенные 1 октября 2026 года.
| Модель | Входные токены | Выходные токены | Чтение кэша | Пакетная обработка (вход/выход) |
|---|---|---|---|---|
| Claude Fable 5.1 | $10 | $50 | $0.25 | $5 / $25 |
| Claude Opus 5.5 | $4 | $20 | $0.20 | $2 / $10 |
| Claude Sonnet 5.5 | $2 | $10 | $0.20 | $1 / $5 |
| Claude Haiku 4.5 | $1 | $5 | $0.10 | $0.50 / $2.50 |
| GPT-6 Astra | $10 | $50 | $1.00 | $5 / $25 |
| GPT-6.1 Sol | $2 | $10 | $0.10 | $1 / $5 |
| GPT-6 Luna | $0.10 | $0.50 | $0.01 | $0.05 / $0.25 |
Для сценария, похожего на обычный чат, где в запросе несколько тысяч слов контекста, а в ответе — несколько сотен, кредитов Sonnet 5.5 на $20 хватит примерно на 10 миллионов входных или 2 миллиона выходных токенов. Собственный расход можно посчитать по четырём полям ответа API: (fresh input × input rate) + (cached input × cache-read rate) + (cache writes × write rate) + (output × output rate). Сверху могут добавляться коэффициенты за пакетную обработку, длинный контекст и регион. Если неделю записывать эти четыре показателя для каждого endpoint, получится месячная оценка, которую уже можно сопоставить со стоимостью места в подписке.
Куда уходят токены
Есть четыре распространённые причины, из-за которых расход оказывается выше ожидаемого. Последние три подробно разобраны в материале LLM Cost Lab о скрытых расходах API.
- История диалога отправляется заново на каждом шаге. В чат-интеграциях на основе запросов клиент пересылает историю, поэтому на двадцатом шаге вместе с новым сообщением уходят и первые девятнадцать. Если каждый ход добавляет примерно одинаковый объём контекста, количество входных токенов растёт примерно квадратично относительно длины диалога. Поэтому в том разборе 20-ходовая сессия стоит $0.163 вместо $0.063, которые получились бы при расчёте независимых запросов, — разница в 2.6 раза.
- Системный промпт дублируется в каждом запросе. Системный промпт на 2,000 токенов при 1 миллионе запросов — это 2 миллиарда входных токенов ещё до того, как пользователь что-либо напечатает.
- Скрытые токены рассуждений. В моделях, которые тарифицируют внутренние цепочки рассуждений как выходные токены, их объём может в несколько раз превышать длину видимого ответа. Если считать расходы только по возвращённым символам, итоговый счёт будет занижен.
- Результаты инструментов, повторы и отброшенные ответы. Если модель что-то сгенерировала, это оплачивается — в том числе ответ, который отклонил валидатор JSON, или параллельный запрос, результат которого вы выбрали не использовать.
Даже дешёвые токены способны составить основную часть счёта — именно это часто сбивает с толку при просмотре собственной статистики. В обсуждении с оценкой $7,470 один из участников заметил, что чтение из кэша составило 48% общей суммы, хотя это самый дешёвый тип токенов в тарифной таблице.
«Это и так самый дешёвый тип токенов в API. Если даже после применения стандартных расценок он остаётся основным, значит, рабочая нагрузка в основном перечитывает один и тот же контекст на каждом шаге». — u/YoanEdwin, r/ClaudeAI
Подставим расценки Opus 5.5 в агентский шаг, который содержит 150k токенов контекста репозитория. Картина сразу становится понятнее:
| Opus 5.5, сессия из 60 шагов, 150k контекста + 2k выходных токенов на шаг | Стоимость |
|---|---|
| Новые входные токены на каждом шаге, без попадания в кэш (150k @ $4) | $0.60 |
| Чтение из кэша вместо новых входных токенов (150k @ $0.20) | $0.03 |
| Выходные токены на каждом шаге (2k @ $20) | $0.04 |
| Одна запись в кэш на 1 час за сессию (150k @ $8) | $1.20 |
| Итого за сессию без кэша | $38.40 |
| Итого за сессию с кэшем | $5.40 |
Две сессии с кэшем в день в течение 22 рабочих дней обойдутся примерно в $238 — это уже больше тарифа за $200. Без кэша тот же месяц превысит $1,600. Цена токена не изменилась — изменилось только их количество.
На самом деле вариантов оплаты три
Большинство сравнений сводится к выбору между тарифом и API. Но есть и третий вариант, с которым пользователи сталкиваются после исчерпания квоты: дополнительные кредиты, продаваемые внутри подписочного продукта.
Судя по сообщениям в r/codex, этот вариант может оказаться дороже обычного API. Один пользователь Pro оценил примерно 16M использованных через купленные кредиты токенов в $40, а затем прикинул, что тот же объём по стандартным API-расценкам стоил бы около $12.
«Да, цены на кредиты уже на грани хищнических. $50 за одну лендинговую страницу — это абсурд, если через API она стоила бы около $2». — u/AbjectBug5885, r/codex
Это пользовательские оценки, а не универсальные тарифы: стоимость пополнения зависит от поставщика и конкретного плана. В приведённых случаях Codex третий вариант обходился примерно в 3 раза дороже сопоставимого объёма API по стандартному прайс-листу. Поэтому перед второй покупкой кредитов стоит сравнить их цену со своими фактическими расходами на ключ.
Пять способов уменьшить счёт
Для каждого из этих способов есть официальные расценки, так что расчёт можно проверить по странице поставщика.
- Кэширование промптов с учётом стоимости записи. В документации Anthropic указано, что запись в кэш на 5 минут стоит 1.25× базовой цены входных токенов, а на 1 час — 2×. Чтение обходится в 0.1× базовой цены (0.05× для Opus 5.5 и 0.025× для Fable 5.1). Запись на 5 минут окупается после одного чтения, запись на час — после двух. Если записать контекст и ни разу его не прочитать, кэширование окажется дороже полного отказа от него. Важно не только включить кэш, но и правильно выстроить промпт: стабильную часть нужно ставить в начало, а пользовательские изменения — в конец, иначе префикс перестанет совпадать. Диагностика попаданий в кэш разобрана в этом руководстве по кэшированию промптов.
- Всё, что может подождать, отправляйте пакетами. Оба поставщика снижают стандартную цену на 50% при асинхронной обработке: Opus 5.5 стоит $2/$10, а Sonnet 5.5 — $1/$5. Впрочем, такая возможность есть не везде: LLM Cost Lab насчитала только 26 из 83 отслеживаемых моделей с отдельным льготным пакетным тарифом. Проверьте поддержку для своей модели до того, как строить архитектуру вокруг этой скидки. Технические детали описаны в нашем разборе тарифов batch API.
- Подбирайте модель под задачу. Для классификации, маршрутизации и решений о поиске редко нужна флагманская модель. Haiku 4.5 стоит $1/$5, а Fable 5.1 — $10/$50. Для шагов, которые выдают по десять токенов, это десятикратная разница.
- Ограничивайте сам ответ, а не только
max_tokens. Почти во всех строках приведённой таблицы выходные токены в 5 раз дороже входных. Схема, запрещающая вступительный текст, добавляет немного структурных накладных расходов, зато убирает прозу, за которую иначе пришлось бы платить. Аmax_tokensлучше использовать как защитный потолок, а не как инструмент форматирования: оборванный ответ может потребовать ещё одного платного запроса. - Следите за дополнительными коэффициентами. У OpenAI режим длинного контекста удваивает цену входных токенов для короткого контекста, а Fast mode ещё раз удваивает стандартную стоимость. Anthropic взимает коэффициент 1.1× за инференс с привязкой к США, а в документации по ценам указано, что Claude 4.7 и более новые модели используют новый токенизатор, который создаёт примерно на 30% больше токенов для того же текста. Промпт не изменился — изменился счётчик.
Есть и отдельный архитектурный вариант: направлять программные запросы через одну тарифицируемую точку, а не поддерживать отдельные платёжные отношения с каждым поставщиком. Именно для этого предназначен endpoint Claude API от AIReiter. При стандартных расценках месяц дополнительной нагрузки в 40M входных токенов уровня Sonnet и 8M выходных будет стоить $80 + $80. Сравнить эту сумму со стоимостью ещё одного места можно примерно за минуту.
Что выбрать
| Ваша ситуация | Что покупать | Почему |
|---|---|---|
| Чаты, исследования и периодическое написание кода в приложении | Только платный тариф | Расходы ограничены, приложения входят в комплект, потребление заметно ниже лимитов тарифа |
| Автономное агентское программирование на одном компьютере | Сначала тариф, для превышения — ключ с оплатой по счётчику | Тариф покрывает основную работу, а ключ избавляет от ожидания недельного сброса |
| Вы выпускаете продукт для других пользователей | Только API | Одно место рассчитано на одного человека, а вашим пользователям нужен собственный объём запросов |
| Периодические массовые задачи: evals, бэкфиллы, классификация | API с пакетным тарифом | Скидка 50% от стандартной цены, задержка не важна |
| Дополнительные кредиты приходится покупать почти каждую неделю | Сравните стоимость превышения с ключом | По сообщениям пользователей, кредиты стоили дороже API по стандартному тарифу |
Частые вопросы
Включает ли платный тариф ChatGPT или Claude кредиты для API?
Нет. В справочном центре Anthropic прямо сказано, что платный тариф Claude «не включает доступ к Claude API или Console», а OpenAI проводит биллинг ChatGPT и API-платформы через разные системы. Оплата обоих сервисов означает две отдельные статьи расходов.
Нужно ли платить за скрытые токены рассуждений?
Да, если модель использует видимое или расширенное рассуждение и тарифицирует его. Такие токены оплачиваются по ставке выходных, но не отображаются в теле ответа, поэтому проверяйте объект usage.
Оплачивается ли весь диалог заново на каждом шаге?
Да, если повторяющийся префикс не попал в кэш. При отсутствии серверного механизма хранения состояния клиент пересылает модели нужную историю, а она тарифицируется как новые входные токены по ставке модели. Если префикс совпал, применяется цена чтения из кэша.
Нужно ли платить за неудачный или повторённый запрос?
Согласно разбору биллинга LLM Cost Lab, запрос оплачивается, если он дошёл до модели и получил ответ, даже когда приложение отбрасывает результат после ошибки схемы или тайм-аута клиента. Исключение — запросы, отклонённые до начала генерации.
Компромисс, для которого нет универсального решения
Тарифы ограничивают расходы, но одновременно дозируют доступ. Ключи с оплатой по факту работают наоборот. Поскольку поставщики не публикуют точное количество токенов, включённых в тарифную квоту, ответ на вопрос «что выгоднее именно для меня» можно получить только после недели работы со своей статистикой и расчёта по приведённой таблице.
Читайте также: Самый дешёвый API для LLM в 2026 году · Гид по ценам Claude API