Если вы выбираете Grok 4.7 для API-сценария, заголовок про тариф $2/$6 верен, но не раскрывает всей картины: в документации xAI указана стандартная цена $2 за миллион входных токенов и $6 за миллион выходных. Официальный идентификатор модели — grok-4.7, однако итоговая сумма зависит от маршрута: на неё влияют шлюз-посредник, региональная маршрутизация в США, кэширование и работа с длинным контекстом.
Коротко: доступ подтверждён, но $2/$6 — лишь базовый прямой тариф
Grok 4.7 — не слух и не просто название чат-бота. На официальной странице xAI, обновлённой 21 сентября 2026 года, описан доступ к модели через Responses API и Chat Completions. Заявлены контекстное окно на 500 000 токенов, обработка текста и изображений, текстовый вывод, вызов функций, веб-поиск, поиск по X и выполнение кода.
Тариф $2/$6 подтверждён именно для стандартного прямого доступа:
| Маршрут или режим использования | Входные токены | Выходные токены | Что это означает |
|---|---|---|---|
| Прямой API xAI, стандартный тариф | $2.00/M | $6.00/M | Официальная базовая цена для grok-4.7 |
| Региональный эндпоинт xAI для США | $2.20/M* | $6.60/M* | На 10% дороже стандартного тарифа |
| Стандартный тариф OpenRouter | $1.60/M | $4.80/M | Цена шлюза и провайдера, а не прямой тариф xAI |
| Промо-тариф Vercel AI Gateway | $1.20/M | $3.60/M | Промо-цена действует, согласно странице, до 27 сентября 2026 года |
*Цены для США рассчитаны по указанной xAI надбавке в 10%, а не взяты из отдельно опубликованного прайс-листа. Для прямого API закладывайте $2/$6; тарифы шлюзов считайте отдельными условиями маршрута и проверяйте их доступность.
Что именно официально предлагает xAI
Официальный идентификатор модели — grok-4.7. xAI показывает три совместимых варианта подключения: собственный SDK, OpenAI-совместимый клиент с адресом https://api.x.ai/v1 и прямой запрос POST к https://api.x.ai/v1/responses.
Для агентских сценариев особенно важны следующие характеристики:
| Характеристика | Значение по документации xAI |
|---|---|
| Контекстное окно | 500 000 токенов |
| Дата отсечения знаний | Май 2026 года |
| Уровни рассуждения | Low, medium, high, xhigh |
| Уровень рассуждения по умолчанию | High |
| Входные данные | Текст и изображения |
| Выходные данные | Текст |
| API | Responses API и Chat Completions |
| Инструменты | Вызов функций, веб-поиск, поиск по X, выполнение кода |
| Стандартная цена входных токенов | $2/M токенов |
| Стандартная цена выходных токенов | $6/M токенов |
В примере из документации модели предлагают найти и объяснить ошибку в JavaScript-функции вычисления медианы. Это подтверждает корректность подключения API, но ничего не говорит о качестве программирования. На странице нет независимой таблицы бенчмарков, замеров задержки, обязательств по доступности или показателя успешного выполнения задач.
Цены Grok 4.7 API: нюансы, которые меняют итоговый счёт
Прямой API и тарифы шлюзов — не одно и то же
Страница модели на OpenRouter указывает $1.60/M за входные токены, $4.80/M за выходные и $0.40/M за чтение из кэша. Страница Vercel AI Gateway показывает промоснижение на 40% — до $1.20/M и $3.60/M; акция заканчивается 27 сентября 2026 года.
Цены шлюзов могут учитывать временные акции или другой маршрут обработки. Поэтому сравнивайте полную стоимость запроса, а не только рекламные ставки за токены.
Региональная маршрутизация в США
xAI указывает https://us.api.x.ai/v1 как региональный эндпоинт для США с надбавкой 10% к стоимости токенов. При стандартном тарифе это $2.20/M за входные и $6.60/M за выходные токены.
При повторной отправке репозитория кэширование особенно важно
xAI рекомендует задавать идентификатор маршрутизации кэша: prompt_cache_key для Responses API или заголовок x-grok-conv-id для Chat Completions. Если направлять повторные обращения на один и тот же сервер, кэш будет срабатывать надёжнее. При холодном кэше входные токены оплачиваются по полной цене.
В таблице цен Cursor для Grok 4.7 приведён ориентир для размещённого сервиса: $0.50/M за чтение из кэша на стандартном уровне против $2/M за некэшированные входные токены. Это тарифная модель Cursor, а не обещание, что прямой API xAI использует те же цены на кэш.
Большой контекст тоже оплачивается
Cursor указывает 256k как стандартный размер контекста и 500k как максимальный. В документации сказано, что запросы объёмом более 256k тарифицируются по повышенным ставкам для длинного контекста: стандартный режим — с коэффициентом 2×, Fast — с коэффициентом 3×.
xAI подтверждает поддержку контекста на 500k, но в описании модели не публикует отдельный коэффициент для длинного контекста. Перед тем как считать 500k по базовой цене, проверьте правила биллинга именно для используемого маршрута.
Что подтверждают опубликованные данные о программировании — и чего они не доказывают
Главный сценарий Grok 4.7 по опубликованным материалам — длительная работа агентами. xAI, Cursor и OpenRouter позиционируют модель для программирования, продолжительных инженерных задач, самопроверки и работы с большим контекстом. Документация Cursor по модели перечисляет в агентской среде поиск и редактирование файлов, выполнение shell-команд, управление браузером, доступ к вебу, генерацию изображений и уточняющие вопросы.
Этого достаточно, чтобы запустить пилотный тест для разработки, но недостаточно, чтобы доказать превосходство в исправлении ошибок, прохождении тестов или стоимости одной задачи. Проведите воспроизводимую проверку на собственном репозитории и записывайте успешность задач, число повторных попыток, вызовы инструментов, время выполнения и общее количество токенов.
Уровень усилий можно менять от low до xhigh, при этом по умолчанию используется high. Более высокий уровень может увеличить время работы и расход токенов. Перед расчётом производственных затрат выясните, как ваш провайдер отображает и тарифицирует рассуждения.
Для актуальных знаний всё равно понадобится поиск
Grok 4.7 принимает изображения, поддерживает веб-поиск и поиск по X, а дата отсечения знаний у модели — май 2026 года. Для текущих исследований используйте поиск или другой механизм извлечения данных и оценивайте точность цитат, полноту охвата источников, число правок и время на проверку человеком — не только качество текста.
Сколько стоят два типичных агентских цикла
Для стандартного прямого тарифа можно использовать простую формулу:
стоимость = (входные_токены / 1 000 000 × $2) + (выходные_токены / 1 000 000 × $6)
| Пример запроса | Стоимость входных токенов | Стоимость выходных токенов | Стоимость токенов |
|---|---|---|---|
| 100k входных + 20k выходных | $0.20 | $0.12 | $0.32 |
| 500k входных + 50k выходных | $1.00 | $0.30 | $1.30 |
Второй пример показывает только базовый тариф. Итог может вырасти из-за региональной надбавки, коэффициентов длинного контекста на размещённом маршруте, повторной отправки некэшированных промптов, особых правил тарификации рассуждений у провайдера и дополнительных запросов. Агент, который делает десять обращений к API, может обойтись значительно дороже одного запроса на 500k токенов.
Как проверить доступ до перехода на модель
- Используйте официальный идентификатор модели. Передавайте
grok-4.7, а не предположительный псевдоним или имя, принятое только у конкретного шлюза. - Начните с небольшого запроса к Responses API. В документации xAI приведён запрос
POST https://api.x.ai/v1/responsesс Bearer-аутентификацией и текстовым вводом. - Сверяйте расход токенов с ответом API и счётом. Сохраняйте данные о входных и выходных токенах, расходе на рассуждения, если он отображается, вызовах инструментов и списанной сумме.
- Проверьте кэширование отдельно. Повторите один и тот же длинный системный промпт с
prompt_cache_keyи сравните стоимость входных токенов во втором запросе. - Проверьте тарифный уровень контекста. Выполните один запуск с объёмом менее 256k токенов и другой — с объёмом выше 256k, если приложению нужен длинный контекст репозитория.
- Выбирайте эндпоинт осознанно. Для базовой оценки экономики используйте стандартный эндпоинт; региональный эндпоинт США имеет смысл подключать только тогда, когда преимущества размещения данных оправдывают надбавку в 10%.
- Считайте тарифы шлюзов отдельными продуктами. Перед тем как закладывать в прогноз $1.20/$3.60 или $1.60/$4.80, проверьте дату окончания акции, маршрутизацию провайдера, поведение при переключении на резервный маршрут, условия хранения данных и дополнительные сборы.
- Измеряйте завершённые задачи. Для программирования фиксируйте пройденные тесты, повторные попытки, вызовы инструментов, время выполнения и полную стоимость каждого принятого изменения.
Grok 4.7 API: часто задаваемые вопросы
Доступен ли Grok 4.7 через официальный API?
Да. В документации xAI модель grok-4.7 указана для Responses API и Chat Completions. Там же приведены примеры для SDK, OpenAI-совместимого клиента и cURL.
Подтверждён ли тариф $2 за входные и $6 за выходные токены?
Да, это стандартный тариф прямого API xAI, указанный в документации от 21 сентября 2026 года. Региональный эндпоинт для США добавляет 10%, а шлюзы могут показывать другие цены или промо-тарифы.
Подходит ли Grok 4.7 для программирования?
Это разумный кандидат для пилотного запуска в длительных агентских задачах: заявлены работа с инструментами, настраиваемый уровень рассуждений, рекомендации по сжатию контекста и контекст до 500k токенов. Доступные источники не доказывают независимое преимущество в программировании, поэтому тестируйте модель на задачах собственного репозитория.
Есть ли у Grok 4.7 контекстное окно на 500k токенов?
Да. xAI указывает 500 000 токенов. При этом Cursor отдельно описывает 256k как стандартный контекст и 500k как максимальный уровень, причём запросы свыше 256k тарифицируются дороже.
Доступен ли Grok 4.7 Fast через публичный API?
Нет. В документации xAI по Grok 4.7 сказано, что Grok 4.7 Fast — это та же модель на более быстрой инфраструктуре, но по цене вдвое выше стандартной. При этом через публичный API xAI она недоступна. Модель указана среди доступных вариантов для Cursor и Grok Build.
Итог: запускайте пилот, но считайте стоимость реального маршрута
Доступ к Grok 4.7 API и базовый тариф $2/$6 подтверждены, а преимущество модели в программировании — нет. Если приложение отправляет более 256k токенов, постоянно работает с некэшированным контекстом репозитория, использует маршрутизацию в США или генерирует много запросов с рассуждениями, стоимость выполненной задачи может заметно отличаться от базовой. Перед переносом рабочих процессов в продакшен начните с измеряемого пилота.