AIREITER

Grok 4.7 API: цены и обзор возможностей для программирования

Последнее обновление: 2026-09-21 20:07:01

Если вы выбираете Grok 4.7 для API-сценария, заголовок про тариф $2/$6 верен, но не раскрывает всей картины: в документации xAI указана стандартная цена $2 за миллион входных токенов и $6 за миллион выходных. Официальный идентификатор модели — grok-4.7, однако итоговая сумма зависит от маршрута: на неё влияют шлюз-посредник, региональная маршрутизация в США, кэширование и работа с длинным контекстом.

Коротко: доступ подтверждён, но $2/$6 — лишь базовый прямой тариф

Grok 4.7 — не слух и не просто название чат-бота. На официальной странице xAI, обновлённой 21 сентября 2026 года, описан доступ к модели через Responses API и Chat Completions. Заявлены контекстное окно на 500 000 токенов, обработка текста и изображений, текстовый вывод, вызов функций, веб-поиск, поиск по X и выполнение кода.

Тариф $2/$6 подтверждён именно для стандартного прямого доступа:

Маршрут или режим использованияВходные токеныВыходные токеныЧто это означает
Прямой API xAI, стандартный тариф$2.00/M$6.00/MОфициальная базовая цена для grok-4.7
Региональный эндпоинт xAI для США$2.20/M*$6.60/M*На 10% дороже стандартного тарифа
Стандартный тариф OpenRouter$1.60/M$4.80/MЦена шлюза и провайдера, а не прямой тариф xAI
Промо-тариф Vercel AI Gateway$1.20/M$3.60/MПромо-цена действует, согласно странице, до 27 сентября 2026 года

*Цены для США рассчитаны по указанной xAI надбавке в 10%, а не взяты из отдельно опубликованного прайс-листа. Для прямого API закладывайте $2/$6; тарифы шлюзов считайте отдельными условиями маршрута и проверяйте их доступность.

Что именно официально предлагает xAI

Официальный идентификатор модели — grok-4.7. xAI показывает три совместимых варианта подключения: собственный SDK, OpenAI-совместимый клиент с адресом https://api.x.ai/v1 и прямой запрос POST к https://api.x.ai/v1/responses.

Для агентских сценариев особенно важны следующие характеристики:

ХарактеристикаЗначение по документации xAI
Контекстное окно500 000 токенов
Дата отсечения знанийМай 2026 года
Уровни рассужденияLow, medium, high, xhigh
Уровень рассуждения по умолчаниюHigh
Входные данныеТекст и изображения
Выходные данныеТекст
APIResponses API и Chat Completions
ИнструментыВызов функций, веб-поиск, поиск по X, выполнение кода
Стандартная цена входных токенов$2/M токенов
Стандартная цена выходных токенов$6/M токенов

В примере из документации модели предлагают найти и объяснить ошибку в JavaScript-функции вычисления медианы. Это подтверждает корректность подключения API, но ничего не говорит о качестве программирования. На странице нет независимой таблицы бенчмарков, замеров задержки, обязательств по доступности или показателя успешного выполнения задач.

Цены Grok 4.7 API: нюансы, которые меняют итоговый счёт

Прямой API и тарифы шлюзов — не одно и то же

Страница модели на OpenRouter указывает $1.60/M за входные токены, $4.80/M за выходные и $0.40/M за чтение из кэша. Страница Vercel AI Gateway показывает промоснижение на 40% — до $1.20/M и $3.60/M; акция заканчивается 27 сентября 2026 года.

Цены шлюзов могут учитывать временные акции или другой маршрут обработки. Поэтому сравнивайте полную стоимость запроса, а не только рекламные ставки за токены.

Региональная маршрутизация в США

xAI указывает https://us.api.x.ai/v1 как региональный эндпоинт для США с надбавкой 10% к стоимости токенов. При стандартном тарифе это $2.20/M за входные и $6.60/M за выходные токены.

При повторной отправке репозитория кэширование особенно важно

xAI рекомендует задавать идентификатор маршрутизации кэша: prompt_cache_key для Responses API или заголовок x-grok-conv-id для Chat Completions. Если направлять повторные обращения на один и тот же сервер, кэш будет срабатывать надёжнее. При холодном кэше входные токены оплачиваются по полной цене.

В таблице цен Cursor для Grok 4.7 приведён ориентир для размещённого сервиса: $0.50/M за чтение из кэша на стандартном уровне против $2/M за некэшированные входные токены. Это тарифная модель Cursor, а не обещание, что прямой API xAI использует те же цены на кэш.

Большой контекст тоже оплачивается

Cursor указывает 256k как стандартный размер контекста и 500k как максимальный. В документации сказано, что запросы объёмом более 256k тарифицируются по повышенным ставкам для длинного контекста: стандартный режим — с коэффициентом 2×, Fast — с коэффициентом 3×.

xAI подтверждает поддержку контекста на 500k, но в описании модели не публикует отдельный коэффициент для длинного контекста. Перед тем как считать 500k по базовой цене, проверьте правила биллинга именно для используемого маршрута.

Что подтверждают опубликованные данные о программировании — и чего они не доказывают

Главный сценарий Grok 4.7 по опубликованным материалам — длительная работа агентами. xAI, Cursor и OpenRouter позиционируют модель для программирования, продолжительных инженерных задач, самопроверки и работы с большим контекстом. Документация Cursor по модели перечисляет в агентской среде поиск и редактирование файлов, выполнение shell-команд, управление браузером, доступ к вебу, генерацию изображений и уточняющие вопросы.

Этого достаточно, чтобы запустить пилотный тест для разработки, но недостаточно, чтобы доказать превосходство в исправлении ошибок, прохождении тестов или стоимости одной задачи. Проведите воспроизводимую проверку на собственном репозитории и записывайте успешность задач, число повторных попыток, вызовы инструментов, время выполнения и общее количество токенов.

Уровень усилий можно менять от low до xhigh, при этом по умолчанию используется high. Более высокий уровень может увеличить время работы и расход токенов. Перед расчётом производственных затрат выясните, как ваш провайдер отображает и тарифицирует рассуждения.

Для актуальных знаний всё равно понадобится поиск

Grok 4.7 принимает изображения, поддерживает веб-поиск и поиск по X, а дата отсечения знаний у модели — май 2026 года. Для текущих исследований используйте поиск или другой механизм извлечения данных и оценивайте точность цитат, полноту охвата источников, число правок и время на проверку человеком — не только качество текста.

Сколько стоят два типичных агентских цикла

Для стандартного прямого тарифа можно использовать простую формулу:

стоимость = (входные_токены / 1 000 000 × $2) + (выходные_токены / 1 000 000 × $6)

Пример запросаСтоимость входных токеновСтоимость выходных токеновСтоимость токенов
100k входных + 20k выходных$0.20$0.12$0.32
500k входных + 50k выходных$1.00$0.30$1.30

Второй пример показывает только базовый тариф. Итог может вырасти из-за региональной надбавки, коэффициентов длинного контекста на размещённом маршруте, повторной отправки некэшированных промптов, особых правил тарификации рассуждений у провайдера и дополнительных запросов. Агент, который делает десять обращений к API, может обойтись значительно дороже одного запроса на 500k токенов.

Как проверить доступ до перехода на модель

  1. Используйте официальный идентификатор модели. Передавайте grok-4.7, а не предположительный псевдоним или имя, принятое только у конкретного шлюза.
  2. Начните с небольшого запроса к Responses API. В документации xAI приведён запрос POST https://api.x.ai/v1/responses с Bearer-аутентификацией и текстовым вводом.
  3. Сверяйте расход токенов с ответом API и счётом. Сохраняйте данные о входных и выходных токенах, расходе на рассуждения, если он отображается, вызовах инструментов и списанной сумме.
  4. Проверьте кэширование отдельно. Повторите один и тот же длинный системный промпт с prompt_cache_key и сравните стоимость входных токенов во втором запросе.
  5. Проверьте тарифный уровень контекста. Выполните один запуск с объёмом менее 256k токенов и другой — с объёмом выше 256k, если приложению нужен длинный контекст репозитория.
  6. Выбирайте эндпоинт осознанно. Для базовой оценки экономики используйте стандартный эндпоинт; региональный эндпоинт США имеет смысл подключать только тогда, когда преимущества размещения данных оправдывают надбавку в 10%.
  7. Считайте тарифы шлюзов отдельными продуктами. Перед тем как закладывать в прогноз $1.20/$3.60 или $1.60/$4.80, проверьте дату окончания акции, маршрутизацию провайдера, поведение при переключении на резервный маршрут, условия хранения данных и дополнительные сборы.
  8. Измеряйте завершённые задачи. Для программирования фиксируйте пройденные тесты, повторные попытки, вызовы инструментов, время выполнения и полную стоимость каждого принятого изменения.

Grok 4.7 API: часто задаваемые вопросы

Доступен ли Grok 4.7 через официальный API?

Да. В документации xAI модель grok-4.7 указана для Responses API и Chat Completions. Там же приведены примеры для SDK, OpenAI-совместимого клиента и cURL.

Подтверждён ли тариф $2 за входные и $6 за выходные токены?

Да, это стандартный тариф прямого API xAI, указанный в документации от 21 сентября 2026 года. Региональный эндпоинт для США добавляет 10%, а шлюзы могут показывать другие цены или промо-тарифы.

Подходит ли Grok 4.7 для программирования?

Это разумный кандидат для пилотного запуска в длительных агентских задачах: заявлены работа с инструментами, настраиваемый уровень рассуждений, рекомендации по сжатию контекста и контекст до 500k токенов. Доступные источники не доказывают независимое преимущество в программировании, поэтому тестируйте модель на задачах собственного репозитория.

Есть ли у Grok 4.7 контекстное окно на 500k токенов?

Да. xAI указывает 500 000 токенов. При этом Cursor отдельно описывает 256k как стандартный контекст и 500k как максимальный уровень, причём запросы свыше 256k тарифицируются дороже.

Доступен ли Grok 4.7 Fast через публичный API?

Нет. В документации xAI по Grok 4.7 сказано, что Grok 4.7 Fast — это та же модель на более быстрой инфраструктуре, но по цене вдвое выше стандартной. При этом через публичный API xAI она недоступна. Модель указана среди доступных вариантов для Cursor и Grok Build.

Итог: запускайте пилот, но считайте стоимость реального маршрута

Доступ к Grok 4.7 API и базовый тариф $2/$6 подтверждены, а преимущество модели в программировании — нет. Если приложение отправляет более 256k токенов, постоянно работает с некэшированным контекстом репозитория, использует маршрутизацию в США или генерирует много запросов с рассуждениями, стоимость выполненной задачи может заметно отличаться от базовой. Перед переносом рабочих процессов в продакшен начните с измеряемого пилота.