Ориентироваться только на заголовок $10 за миллион входных токенов и $50 за миллион выходных не стоит. Запросы длиннее 272 000 входных токенов целиком переводятся на повышенный тариф, а доступ к GPT-6 Astra всё ещё подключается поэтапно. Поэтому наличие модели в документации ещё не означает, что аккаунт уже может её вызывать.
Цены GPT-6 Astra API: главное
Ниже — тарифы с официальной страницы модели OpenAI. Кэширование промптов, длинный контекст и режим Fast заметно меняют итоговую стоимость.
| Параметр | Актуальные данные |
|---|---|
| Идентификатор модели API | gpt-6-astra |
| Стандартный ввод | $10.00 / 1M токенов |
| Кэшированный ввод | $1.00 / 1M токенов |
| Запись в кэш | $12.50 / 1M токенов |
| Стандартный вывод | $50.00 / 1M токенов |
| Контекстное окно | 1 050 000 токенов |
| Максимальный объём вывода | 128 000 токенов |
| Дата отсечения знаний | 30 апреля 2026 года |
| Ввод/вывод | Текстовый и графический ввод; текстовый вывод |
| Бесплатный уровень API | Не поддерживается |
| Текущая доступность | Поэтапное подключение для компаний из Trusted Access; более широкий доступ к API и платным планам заявлен в ближайшие дни |
Эти цифры взяты со страницы модели GPT-6 Astra, а не из предварительной оценки. В руководстве по модели OpenAI также указано, что для вызова инструментов требуется Responses API.
Три правила тарификации, которые меняют итоговый счёт
У GPT-6 Astra четыре категории токенов и отдельные правила для сервисных режимов. Если считать модель просто как endpoint по схеме $10 за ввод / $50 за вывод, расходы на создание кэша, длинные промпты и ускоренную обработку окажутся заниженными.
Обычный ввод, кэшированные данные и запись в кэш
Обычный ввод стоит $10 за миллион, кэшированный — $1 за миллион, а запись в кэш — $12.50 за миллион. Если промпт используется повторно, после первоначальной записи каждый следующий запрос может обходиться заметно дешевле.
| Категория токенов | Стандартный тариф | Что сюда входит |
|---|---|---|
| Некэшированный ввод | $10.00 / 1M | Новые входные данные, обрабатываемые моделью |
| Кэшированный ввод | $1.00 / 1M | Ранее обработанные входные данные, полученные из кэша |
| Запись в кэш | $12.50 / 1M | Данные, добавляемые в кэш промпта |
| Вывод | $50.00 / 1M | Сгенерированные токены ответа |
Не нужно просто умножать размер контекстного окна на тариф входных токенов. Окно на 1,05 млн токенов — это ограничение вместимости, а не обещание, что все токены будут тарифицироваться по базовой ставке.
Порог 272K применяется ко всему запросу
Если в запросе больше 272 000 входных токенов, OpenAI указывает для всего запроса двукратные тарифы на ввод и кэш и тариф на вывод в размере 1,5x. В режиме длинного контекста это составляет $20 за миллион некэшированных входных токенов, $2 за миллион кэшированных, $25 за миллион записей в кэш и $75 за миллион выходных токенов.
| Тип запроса | Ввод | Кэшированный ввод | Запись в кэш | Вывод |
|---|---|---|---|---|
| До 272K входных токенов включительно | $10 | $1 | $12.50 | $50 |
| Больше 272K входных токенов | $20 | $2 | $25 | $75 |
Для запроса с 300K входных токенов все применимые входные, кэшированные и выходные токены оплачиваются по повышенным тарифам длинного контекста. Первые 272K не считаются по стандартной ставке.
Batch, Flex, Fast и региональные варианты развёртывания
OpenAI тарифицирует Batch и Flex в размере 50% от применимых ставок. В руководстве по модели сказано, что режим Fast стоит 2x от применимых тарифов, не имеет SLA по задержке и недоступен при выборе региона хранения данных в ЕС. Обработка Priority также недоступна при резидентности данных в ЕС.
| Режим | Стандартный ввод | Стандартный вывод | Как это понимать на практике |
|---|---|---|---|
| Standard | $10 / 1M | $50 / 1M | Режим по умолчанию для прямого API |
| Batch или Flex | $5 / 1M | $25 / 1M | Половина применимой ставки Standard |
| Fast | $20 / 1M | $100 / 1M | Вдвое дороже применимой ставки Standard |
| Standard с длинным контекстом | $20 / 1M | $75 / 1M | Применяется при объёме ввода свыше 272K |
| Fast с длинным контекстом | $40 / 1M | $150 / 1M | 2x от тарифов длинного контекста |
В таблице указаны только некэшированный ввод и вывод. Тарифы на чтение и запись кэша также умножаются на соответствующий коэффициент сервисного режима.
Для Microsoft Foundry опубликована отдельная таблица тарифов на развёртывание. В анонсе GPT-6 Astra указаны тарифы Global Standard для короткого контекста: $10 за ввод, $1 за кэшированный ввод, $12.50 за запись в кэш и $50 за вывод. Для U.S. Data Zone Standard это $11, $1.10, $13.75 и $55. В таблице длинного контекста указаны $20/$2/$25/$75 для Global и $22/$2.20/$27.50/$82.50 для U.S. Data Zone. Не переносите тарифную карту прямого OpenAI API в бюджет Azure.
Сколько на самом деле стоит запрос к Astra
В примерах используются прямые тарифы OpenAI для режима Standard; инструменты и повторные попытки не учитываются, а токены считаются некэшированными или кэшированными ровно так, как указано.
| Пример запроса | Расчёт | Расчётная стоимость токенов |
|---|---|---|
| 100K некэшированного ввода + 10K вывода | 0.1 × $10 + 0.01 × $50 | $1.50 |
| 200K кэшированного ввода + 20K вывода | 0.2 × $1 + 0.02 × $50 | $1.20 |
| 300K некэшированного ввода + 30K вывода | 0.3 × $20 + 0.03 × $75 | $8.25 |
Перед внедрением сценариев с длинным контекстом проверьте порог 272K. Сократить расходы на модель можно за счёт поиска по базе или сжатия контекста, но это добавит работы на стороне приложения.
Запись 200K токенов в кэш стоит $2.50, а последующее обращение к тем же 200K кэшированных токенов — $0.20. Окупаемость кэширования зависит от того, как часто данные переиспользуются.
В Microsoft Foundry запрос со 100K входных и 10K выходных токенов в таблице Global для короткого контекста также стоит $1.50 без учёта инструментов и повторных попыток. Вариант U.S. Data Zone обойдётся в $1.65: 0.1 × $11 + 0.01 × $55.
В руководстве OpenAI сказано, что Astra может обеспечивать меньшую расчётную стоимость выполненной задачи по сравнению с предыдущими моделями. Но это не независимый бенчмарк производственных расходов. В собственных трассировках учитывайте входные токены, попадания в кэш, выходные токены, вызовы инструментов, повторы и исправления человека.
Доступ, квоты и разделение ChatGPT/API
GPT-6 Astra постепенно подключают компаниям из Trusted Access Program; доступ к API, а также к планам Plus, Pro, Business и Enterprise должен появиться в ближайшие дни. В документации OpenClaw для провайдера OpenAI также отмечено, что доступность Astra определяется каталогом моделей конкретного аккаунта. Простое добавление имени модели в конфигурацию доступа не даёт.
Один из пользователей описал задержку с подключением так:
«Уже почти 2 часа ночи, и я ложусь спать в бешенстве. Я ЖДАЛ Astra ВЕСЬ ДЕНЬ. ... А потом выяснилось: Я ДАЖЕ НЕ МОГУ ЕЮ ПОЛЬЗОВАТЬСЯ». — @buildwithrajath, X
На странице модели указаны следующие API-лимиты для разных уровней использования:
| Уровень | RPM | TPM | Лимит очереди Batch |
|---|---|---|---|
| Free | Не поддерживается | Не поддерживается | Не поддерживается |
| Tier 1 | 500 | 500 000 | 1 500 000 |
| Tier 2 | 5 000 | 1 000 000 | 3 000 000 |
| Tier 3 | 5 000 | 2 000 000 | 100 000 000 |
| Tier 4 | 10 000 | 4 000 000 | 200 000 000 |
| Tier 5 | 15 000 | 40 000 000 | 15 000 000 000 |
Тарифная карта Astra относится только к API. В цитируемой документации не сказано, что планы ChatGPT включают кредиты API, поэтому использование Platform API нужно закладывать в бюджет отдельно.
Что проверить при миграции существующих агентов
В руководстве по модели OpenAI выделяет три проверки перед миграцией:
- Модель и API: укажите в параметре
modelзначениеgpt-6-astra, убедитесь, что модель видна в каталоге аккаунта, а для вызова инструментов используйте Responses API. - Параметры запроса: выберите
low,medium,high,xhighилиmax; Astra не поддерживает значениеnone. Удалите неподдерживаемые параметры сэмплирования и логарифмов вероятностей. - Кэширование и регион: при использовании рекомендаций OpenAI по миграции со старых моделей замените
prompt_cache_retentionнаprompt_cache_options.ttl: "30m", после чего отдельно проверьте настройки Fast и Priority для региона с резидентностью данных в ЕС.
Как планировать бюджет: маршрутизируйте по трассировкам, а не по цене токена
GPT-6 Astra проще всего оправдать для длинных, насыщенных инструментами или критичных к ошибкам задач, а также для сценариев, где мешает отсутствие удобного API. Для коротких и рутинных запросов это плохой вариант по умолчанию, если $50 за миллион выходных токенов не сокращают число повторных попыток и не улучшают результат.
- Сначала протестируйте Astra на исследованиях с длинным контекстом, компьютерным управлением, сложной разработке и сценариях с несколькими приложениями, где ошибка приводит к проверке или переделке результата.
- Оставьте более дешёвую модель по умолчанию для короткой классификации, извлечения данных, простых черновиков и предсказуемых преобразований.
- Используйте Batch или Flex, когда задержка не критична, а задача совместима с тарифом в размере 50% от стандартного.
- Не включайте Fast без необходимости. При цене $20 за вход и $100 за вывод на миллион токенов — ещё до применения множителя длинного контекста — этот режим должен давать измеримый прирост пропускной способности.
- Поставьте жёсткий ограничитель на 272K. Настройте предупреждение до пересечения порога: повышенный тариф применяется ко всему запросу.
Оценивайте стоимость принятой задачи по собственным логам трассировок, а не только по цене токенов. Для смежных расчётов сравните допущения в руководстве по ценам GPT-5.6 и руководстве по ценам OpenRouter, но не переносите их тарифные правила на Astra.
FAQ по ценам GPT-6 Astra API
Сколько стоит 1M токенов GPT-6 Astra?
Стандартный тариф составляет $10 за миллион некэшированных входных токенов, $1 за миллион кэшированных входных токенов, $12.50 за миллион токенов при записи в кэш и $50 за миллион выходных токенов.
Что происходит при объёме ввода свыше 272K токенов?
Тарифы на ввод и кэширование удваиваются, а стоимость вывода увеличивается на 50%: для всего запроса действуют ставки $20 за ввод, $2 за кэшированный ввод, $25 за запись в кэш и $75 за вывод на миллион токенов.
Кэшированный ввод — это то же самое, что запись в кэш?
Нет. Кэшированный ввод — это попадание в кэш, которое в стандартном режиме стоит $1 за миллион. Запись в кэш создаёт или обновляет кэшированный префикс и стоит $12.50 за миллион.
Batch или Flex вдвое снижают цену GPT-6 Astra?
OpenAI указывает для Batch и Flex тариф в размере 50% от применимых стандартных ставок, включая соответствующую ставку длинного контекста, если запрос пересекает этот порог.
Оправдана ли дополнительная плата за режим Fast?
Режим Fast стоит 2x от применимых тарифов и не имеет SLA по задержке. Используйте его только тогда, когда трассировки показывают достаточный прирост пропускной способности или ценности для пользователя, чтобы окупить переплату.
Можно ли уже пользоваться GPT-6 Astra через API?
Доступ подключается поэтапно, а не открывается всем сразу. OpenAI сначала указывает доступность для компаний из Trusted Access и сообщает, что более широкий доступ к API появится в ближайшие дни. Поэтому финальная проверка — каталог моделей конкретного аккаунта.
Включает ли ChatGPT Plus кредиты API для GPT-6 Astra?
В документации модели нет обещания, что план ChatGPT включает кредиты API. Пока явные условия биллинга вашего аккаунта не говорят обратного, считайте доступ к модели в платном плане и оплату Platform API отдельными вещами.
Какие изменения в API нужны для GPT-6 Astra?
Укажите в параметре model значение gpt-6-astra, используйте Responses API для вызова инструментов, выберите поддерживаемый уровень reasoning effort, удалите неподдерживаемые параметры сэмплирования и логарифмов вероятностей, а также проверьте TTL кэша и региональные ограничения режима Fast. До того как сделать Astra моделью по умолчанию, соберите для одного репрезентативного запуска данные о токенах, работе кэша, инструментах, повторных попытках и исправлениях человека.