AIREITER
ДОКИ APIЦЕНЫ
ШАБЛОНЫ
  • AIReiter
  • Блог
  • Цены GPT-6 Astra API (2026): стоимость, лимиты и доступ

Цены GPT-6 Astra API (2026): стоимость, лимиты и доступ

Последнее обновление: 2026-09-04 00:41:04

Ориентироваться только на заголовок $10 за миллион входных токенов и $50 за миллион выходных не стоит. Запросы длиннее 272 000 входных токенов целиком переводятся на повышенный тариф, а доступ к GPT-6 Astra всё ещё подключается поэтапно. Поэтому наличие модели в документации ещё не означает, что аккаунт уже может её вызывать.

Цены GPT-6 Astra API: главное

Ниже — тарифы с официальной страницы модели OpenAI. Кэширование промптов, длинный контекст и режим Fast заметно меняют итоговую стоимость.

ПараметрАктуальные данные
Идентификатор модели APIgpt-6-astra
Стандартный ввод$10.00 / 1M токенов
Кэшированный ввод$1.00 / 1M токенов
Запись в кэш$12.50 / 1M токенов
Стандартный вывод$50.00 / 1M токенов
Контекстное окно1 050 000 токенов
Максимальный объём вывода128 000 токенов
Дата отсечения знаний30 апреля 2026 года
Ввод/выводТекстовый и графический ввод; текстовый вывод
Бесплатный уровень APIНе поддерживается
Текущая доступностьПоэтапное подключение для компаний из Trusted Access; более широкий доступ к API и платным планам заявлен в ближайшие дни

Эти цифры взяты со страницы модели GPT-6 Astra, а не из предварительной оценки. В руководстве по модели OpenAI также указано, что для вызова инструментов требуется Responses API.

Цены GPT-6 Astra API на официальной странице модели OpenAI

Три правила тарификации, которые меняют итоговый счёт

У GPT-6 Astra четыре категории токенов и отдельные правила для сервисных режимов. Если считать модель просто как endpoint по схеме $10 за ввод / $50 за вывод, расходы на создание кэша, длинные промпты и ускоренную обработку окажутся заниженными.

Обычный ввод, кэшированные данные и запись в кэш

Обычный ввод стоит $10 за миллион, кэшированный — $1 за миллион, а запись в кэш — $12.50 за миллион. Если промпт используется повторно, после первоначальной записи каждый следующий запрос может обходиться заметно дешевле.

Категория токеновСтандартный тарифЧто сюда входит
Некэшированный ввод$10.00 / 1MНовые входные данные, обрабатываемые моделью
Кэшированный ввод$1.00 / 1MРанее обработанные входные данные, полученные из кэша
Запись в кэш$12.50 / 1MДанные, добавляемые в кэш промпта
Вывод$50.00 / 1MСгенерированные токены ответа

Не нужно просто умножать размер контекстного окна на тариф входных токенов. Окно на 1,05 млн токенов — это ограничение вместимости, а не обещание, что все токены будут тарифицироваться по базовой ставке.

Порог 272K применяется ко всему запросу

Если в запросе больше 272 000 входных токенов, OpenAI указывает для всего запроса двукратные тарифы на ввод и кэш и тариф на вывод в размере 1,5x. В режиме длинного контекста это составляет $20 за миллион некэшированных входных токенов, $2 за миллион кэшированных, $25 за миллион записей в кэш и $75 за миллион выходных токенов.

Тип запросаВводКэшированный вводЗапись в кэшВывод
До 272K входных токенов включительно$10$1$12.50$50
Больше 272K входных токенов$20$2$25$75

Для запроса с 300K входных токенов все применимые входные, кэшированные и выходные токены оплачиваются по повышенным тарифам длинного контекста. Первые 272K не считаются по стандартной ставке.

Цены GPT-6 Astra за входные и выходные токены в режимах Standard, длинного контекста и Fast

Batch, Flex, Fast и региональные варианты развёртывания

OpenAI тарифицирует Batch и Flex в размере 50% от применимых ставок. В руководстве по модели сказано, что режим Fast стоит 2x от применимых тарифов, не имеет SLA по задержке и недоступен при выборе региона хранения данных в ЕС. Обработка Priority также недоступна при резидентности данных в ЕС.

РежимСтандартный вводСтандартный выводКак это понимать на практике
Standard$10 / 1M$50 / 1MРежим по умолчанию для прямого API
Batch или Flex$5 / 1M$25 / 1MПоловина применимой ставки Standard
Fast$20 / 1M$100 / 1MВдвое дороже применимой ставки Standard
Standard с длинным контекстом$20 / 1M$75 / 1MПрименяется при объёме ввода свыше 272K
Fast с длинным контекстом$40 / 1M$150 / 1M2x от тарифов длинного контекста

В таблице указаны только некэшированный ввод и вывод. Тарифы на чтение и запись кэша также умножаются на соответствующий коэффициент сервисного режима.

Для Microsoft Foundry опубликована отдельная таблица тарифов на развёртывание. В анонсе GPT-6 Astra указаны тарифы Global Standard для короткого контекста: $10 за ввод, $1 за кэшированный ввод, $12.50 за запись в кэш и $50 за вывод. Для U.S. Data Zone Standard это $11, $1.10, $13.75 и $55. В таблице длинного контекста указаны $20/$2/$25/$75 для Global и $22/$2.20/$27.50/$82.50 для U.S. Data Zone. Не переносите тарифную карту прямого OpenAI API в бюджет Azure.

Сколько на самом деле стоит запрос к Astra

В примерах используются прямые тарифы OpenAI для режима Standard; инструменты и повторные попытки не учитываются, а токены считаются некэшированными или кэшированными ровно так, как указано.

Пример запросаРасчётРасчётная стоимость токенов
100K некэшированного ввода + 10K вывода0.1 × $10 + 0.01 × $50$1.50
200K кэшированного ввода + 20K вывода0.2 × $1 + 0.02 × $50$1.20
300K некэшированного ввода + 30K вывода0.3 × $20 + 0.03 × $75$8.25

Перед внедрением сценариев с длинным контекстом проверьте порог 272K. Сократить расходы на модель можно за счёт поиска по базе или сжатия контекста, но это добавит работы на стороне приложения.

Запись 200K токенов в кэш стоит $2.50, а последующее обращение к тем же 200K кэшированных токенов — $0.20. Окупаемость кэширования зависит от того, как часто данные переиспользуются.

В Microsoft Foundry запрос со 100K входных и 10K выходных токенов в таблице Global для короткого контекста также стоит $1.50 без учёта инструментов и повторных попыток. Вариант U.S. Data Zone обойдётся в $1.65: 0.1 × $11 + 0.01 × $55.

В руководстве OpenAI сказано, что Astra может обеспечивать меньшую расчётную стоимость выполненной задачи по сравнению с предыдущими моделями. Но это не независимый бенчмарк производственных расходов. В собственных трассировках учитывайте входные токены, попадания в кэш, выходные токены, вызовы инструментов, повторы и исправления человека.

Доступ, квоты и разделение ChatGPT/API

GPT-6 Astra постепенно подключают компаниям из Trusted Access Program; доступ к API, а также к планам Plus, Pro, Business и Enterprise должен появиться в ближайшие дни. В документации OpenClaw для провайдера OpenAI также отмечено, что доступность Astra определяется каталогом моделей конкретного аккаунта. Простое добавление имени модели в конфигурацию доступа не даёт.

Один из пользователей описал задержку с подключением так:

«Уже почти 2 часа ночи, и я ложусь спать в бешенстве. Я ЖДАЛ Astra ВЕСЬ ДЕНЬ. ... А потом выяснилось: Я ДАЖЕ НЕ МОГУ ЕЮ ПОЛЬЗОВАТЬСЯ». — @buildwithrajath, X

На странице модели указаны следующие API-лимиты для разных уровней использования:

УровеньRPMTPMЛимит очереди Batch
FreeНе поддерживаетсяНе поддерживаетсяНе поддерживается
Tier 1500500 0001 500 000
Tier 25 0001 000 0003 000 000
Tier 35 0002 000 000100 000 000
Tier 410 0004 000 000200 000 000
Tier 515 00040 000 00015 000 000 000

Тарифная карта Astra относится только к API. В цитируемой документации не сказано, что планы ChatGPT включают кредиты API, поэтому использование Platform API нужно закладывать в бюджет отдельно.

Что проверить при миграции существующих агентов

В руководстве по модели OpenAI выделяет три проверки перед миграцией:

  1. Модель и API: укажите в параметре model значение gpt-6-astra, убедитесь, что модель видна в каталоге аккаунта, а для вызова инструментов используйте Responses API.
  2. Параметры запроса: выберите low, medium, high, xhigh или max; Astra не поддерживает значение none. Удалите неподдерживаемые параметры сэмплирования и логарифмов вероятностей.
  3. Кэширование и регион: при использовании рекомендаций OpenAI по миграции со старых моделей замените prompt_cache_retention на prompt_cache_options.ttl: "30m", после чего отдельно проверьте настройки Fast и Priority для региона с резидентностью данных в ЕС.

Как планировать бюджет: маршрутизируйте по трассировкам, а не по цене токена

GPT-6 Astra проще всего оправдать для длинных, насыщенных инструментами или критичных к ошибкам задач, а также для сценариев, где мешает отсутствие удобного API. Для коротких и рутинных запросов это плохой вариант по умолчанию, если $50 за миллион выходных токенов не сокращают число повторных попыток и не улучшают результат.

  • Сначала протестируйте Astra на исследованиях с длинным контекстом, компьютерным управлением, сложной разработке и сценариях с несколькими приложениями, где ошибка приводит к проверке или переделке результата.
  • Оставьте более дешёвую модель по умолчанию для короткой классификации, извлечения данных, простых черновиков и предсказуемых преобразований.
  • Используйте Batch или Flex, когда задержка не критична, а задача совместима с тарифом в размере 50% от стандартного.
  • Не включайте Fast без необходимости. При цене $20 за вход и $100 за вывод на миллион токенов — ещё до применения множителя длинного контекста — этот режим должен давать измеримый прирост пропускной способности.
  • Поставьте жёсткий ограничитель на 272K. Настройте предупреждение до пересечения порога: повышенный тариф применяется ко всему запросу.

Оценивайте стоимость принятой задачи по собственным логам трассировок, а не только по цене токенов. Для смежных расчётов сравните допущения в руководстве по ценам GPT-5.6 и руководстве по ценам OpenRouter, но не переносите их тарифные правила на Astra.

FAQ по ценам GPT-6 Astra API

Сколько стоит 1M токенов GPT-6 Astra?

Стандартный тариф составляет $10 за миллион некэшированных входных токенов, $1 за миллион кэшированных входных токенов, $12.50 за миллион токенов при записи в кэш и $50 за миллион выходных токенов.

Что происходит при объёме ввода свыше 272K токенов?

Тарифы на ввод и кэширование удваиваются, а стоимость вывода увеличивается на 50%: для всего запроса действуют ставки $20 за ввод, $2 за кэшированный ввод, $25 за запись в кэш и $75 за вывод на миллион токенов.

Кэшированный ввод — это то же самое, что запись в кэш?

Нет. Кэшированный ввод — это попадание в кэш, которое в стандартном режиме стоит $1 за миллион. Запись в кэш создаёт или обновляет кэшированный префикс и стоит $12.50 за миллион.

Batch или Flex вдвое снижают цену GPT-6 Astra?

OpenAI указывает для Batch и Flex тариф в размере 50% от применимых стандартных ставок, включая соответствующую ставку длинного контекста, если запрос пересекает этот порог.

Оправдана ли дополнительная плата за режим Fast?

Режим Fast стоит 2x от применимых тарифов и не имеет SLA по задержке. Используйте его только тогда, когда трассировки показывают достаточный прирост пропускной способности или ценности для пользователя, чтобы окупить переплату.

Можно ли уже пользоваться GPT-6 Astra через API?

Доступ подключается поэтапно, а не открывается всем сразу. OpenAI сначала указывает доступность для компаний из Trusted Access и сообщает, что более широкий доступ к API появится в ближайшие дни. Поэтому финальная проверка — каталог моделей конкретного аккаунта.

Включает ли ChatGPT Plus кредиты API для GPT-6 Astra?

В документации модели нет обещания, что план ChatGPT включает кредиты API. Пока явные условия биллинга вашего аккаунта не говорят обратного, считайте доступ к модели в платном плане и оплату Platform API отдельными вещами.

Какие изменения в API нужны для GPT-6 Astra?

Укажите в параметре model значение gpt-6-astra, используйте Responses API для вызова инструментов, выберите поддерживаемый уровень reasoning effort, удалите неподдерживаемые параметры сэмплирования и логарифмов вероятностей, а также проверьте TTL кэша и региональные ограничения режима Fast. До того как сделать Astra моделью по умолчанию, соберите для одного репрезентативного запуска данные о токенах, работе кэша, инструментах, повторных попытках и исправлениях человека.

>_Каталог моделей AIReiter

Быстрый API-доступ к моделям, связанным с этим гайдом

GPT-5.6 Terra

Chat

Более мощная текстовая модель GPT-5.6 для задач кодирования и анализа, требующих глубокого рассуждения.

OpenAIСоздать API Key >

GPT-6 Astra

Chat

OpenAI frontier model for complex reasoning, coding, and long-context work.

OpenAIСоздать API Key >

Claude Fable 5

Chat

Премиальная модель Claude для глубокого рассуждения и сложной объемной работы.

AnthropicСоздать API Key >

Claude Fable 5.1

Chat

Mythos-class model for long-horizon coding, research, and knowledge work.

AnthropicСоздать API Key >

Claude Opus 4.8

Chat

Высокопроизводительная модель Claude для сложных задач, требующих глубоких рассуждений и профессиональной работы.

AnthropicСоздать API Key >

Недавние статьи

Обзор API GPT-6 Astra (2026): для агентов, а не простой замены

2026-09-07

Kling API: официальный доступ и агрегаторы — руководство по интеграции (2026)

2026-09-07

Suno API Key: где получить и сколько стоит в 2026 году

2026-09-07

Обзор GPT-6 Astra: оправдывает ли API-цена $10/$50 свою стоимость?

2026-09-06
AIREITER

Есть вопросы? Свяжитесь с нами
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI-видео

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI-изображения

Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image TurboKrea 2 Turbo

Блог

Посмотреть все →

Компания

Политика конфиденциальностиУсловия обслуживанияПолитика возврата

© 2026 AIReiter. Все права защищены.