Grok 4.7をAPIワークフローに組み込むなら、よく見かける料金情報は正しいものの、それだけでは不十分です。xAIのドキュメントには、標準APIの料金として入力100万トークンあたり$2、出力100万トークンあたり$6と記載されています。公式のモデルIDはgrok-4.7ですが、ゲートウェイ経由の料金、米国リージョンへのルーティング、キャッシュ、長大なコンテキストの利用によって、実際の支払額は変わります。
結論:利用できる。ただし$2/$6は直接利用時の基準料金にすぎない
Grok 4.7は単なるうわさでも、チャット専用の呼び名でもありません。2026年9月21日更新のxAI公式ページでは、Responses APIとChat Completionsの両方からAPIを利用できることが案内されています。コンテキストウィンドウは500,000トークンで、テキストと画像の入力、テキスト出力、関数呼び出し、Web検索、X検索、コード実行に対応しています。
$2/$6という料金は、あくまで標準の直接利用料金として確認できます。
| 利用経路またはモード | 入力 | 出力 | 意味 |
|---|---|---|---|
| xAI APIを直接利用、標準料金 | $2.00/M | $6.00/M | grok-4.7の公式な基準料金 |
| xAI米国リージョンエンドポイント | $2.20/M* | $6.60/M* | 標準料金に10%上乗せ |
| OpenRouter標準掲載料金 | $1.60/M | $4.80/M | xAIの直接利用料金ではなく、ゲートウェイ/プロバイダー料金 |
| Vercel AI Gatewayのキャンペーン料金 | $1.20/M | $3.60/M | 2026年9月27日まで表示されるプロモーション料金 |
*米国リージョンの金額は、xAIが示す10%の上乗せ率から計算したもので、見出し料金として別途掲載されたものではありません。xAIを直接利用する場合は$2/$6を基準に予算を組み、ゲートウェイ料金は経路ごとに条件と利用可否を確認してください。
xAI公式が提供しているもの
公式のモデルIDはgrok-4.7です。xAIは、独自SDK、https://api.x.ai/v1を指定するOpenAI互換クライアント、そしてhttps://api.x.ai/v1/responsesへ直接POSTする方法という、3種類の利用パターンを示しています。
エージェント開発で重要になる仕様は次のとおりです。
| 仕様 | xAIのドキュメント上の値 |
|---|---|
| コンテキストウィンドウ | 500,000トークン |
| 知識カットオフ | 2026年5月 |
| 推論レベル | Low、medium、high、xhigh |
| デフォルトの推論レベル | High |
| 入力 | テキストと画像 |
| 出力 | テキスト |
| API | Responses APIとChat Completions |
| ツール | 関数呼び出し、Web検索、X検索、コード実行 |
| 標準入力料金 | トークン100万あたり$2 |
| 標準出力料金 | トークン100万あたり$6 |
ドキュメントのサンプルでは、JavaScriptで書かれた中央値計算関数のバグを見つけ、説明するようモデルに指示しています。これはAPIの接続方法を示す例であって、コーディング品質の証明ではありません。独立したベンチマーク表、レイテンシーの測定結果、稼働率の保証、タスク完了率も掲載されていません。
Grok 4.7 APIの料金で見落としやすいポイント
直接利用とゲートウェイ経由では料金の意味が違う
OpenRouterのモデルページでは、入力100万トークンあたり$1.60、出力100万トークンあたり$4.80、キャッシュ読み出し100万トークンあたり$0.40と案内されています。VercelのAI Gatewayページには、40%値引き後の料金として入力$1.20/M、出力$3.60/Mが掲載されています。このキャンペーンは2026年9月27日に終了します。
ゲートウェイ料金には、期間限定のキャンペーンや異なるルーティング条件が反映されている可能性があります。見出しにあるトークン単価だけでなく、リクエスト全体のコストを比較してください。
米国リージョンを選ぶと10%上乗せ
xAIは、https://us.api.x.ai/v1を米国リージョン向けのエンドポイントとして案内しており、トークン利用料に10%のプレミアムが加算されます。標準料金から計算すると、入力は$2.20/M、出力は$6.60/Mです。
リポジトリの同じプロンプトを繰り返すならキャッシュが効く
xAIは、キャッシュのルーティング用識別子として、Responses APIではprompt_cache_key、Chat Completionsではx-grok-conv-idヘッダーを推奨しています。同じサーバーへ繰り返しのターンを送るとキャッシュヒットが安定しやすくなります。一方、キャッシュが温まっていないリクエストでは、入力料金を満額支払うことになります。
CursorのGrok 4.7料金表には、ホスト型サービスでの参考値として、標準ティアのキャッシュ読み出し料金が$0.50/M、キャッシュされていない入力が$2/Mと記載されています。ただし、これはCursor側の課金であり、xAIの直接APIが同じキャッシュ料金を採用していることを意味しません。
長いコンテキストは無料ではない
Cursorでは、標準コンテキストを256k、最大コンテキストを500kとしています。ドキュメントによると、256kを超えるリクエストには、より高い長文コンテキスト料金が適用されます。標準利用では2倍、Fast利用では3倍です。
xAIは500kのコンテキストに対応することを明記していますが、モデル概要では長文コンテキスト向けの別個の倍率を公開していません。500kのコンテキストでも基本料金のままだと決めつけず、利用する経路の課金ルールを確認してください。
公開されているコーディング情報から分かること、分からないこと
Grok 4.7が想定しているのは、長時間動作するエージェントです。xAI、Cursor、OpenRouterはいずれも、コーディング、長時間にわたるソフトウェア開発、自己検証、長いコンテキストへの対応を強みとして位置付けています。Cursorのモデルドキュメントでは、エージェント環境でファイル検索、ファイル編集、シェルコマンド、ブラウザー操作、Webアクセス、画像生成、確認質問に対応すると説明されています。
これらの機能はコーディング用途で試す理由にはなりますが、バグ修正、テスト通過率、タスク単位の費用対効果が優れていることの証明ではありません。再現可能なリポジトリテストを用意し、タスク成功率、リトライ回数、ツール呼び出し回数、経過時間、総トークン数を記録してください。
推論の強度はlowからxhighまで設定でき、デフォルトはhighです。強度を上げると処理時間や利用量が変わる可能性があります。本番コストを見積もる前に、利用するプロバイダーが推論分の利用量をどう報告し、どう課金するのかを確認しましょう。
最新情報を扱うなら検索・取得機能が必要
Grok 4.7は画像を受け付け、Web検索とX検索に対応しています。一方、知識カットオフは2026年5月です。最新情報を調査する場合は、検索や外部情報の取得を使い、文章の読みやすさだけでなく、引用の正確さ、情報源の網羅性、修正回数、人間による訂正時間を評価してください。
エージェントの処理例ではいくらかかるか
標準の直接利用料金なら、次の式で概算できます。
cost = (input_tokens / 1,000,000 × $2) + (output_tokens / 1,000,000 × $6)
| リクエスト例 | 入力料金 | 出力料金 | トークン料金 |
|---|---|---|---|
| 入力100k + 出力20k | $0.20 | $0.12 | $0.32 |
| 入力500k + 出力50k | $1.00 | $0.30 | $1.30 |
2つ目の例は、基本料金だけで計算した目安です。米国リージョンのプレミアム、ホスト型経路での長文コンテキスト倍率、繰り返しプロンプトの未キャッシュ利用、プロバイダー固有の推論ルール、追加リクエストによって、料金はさらに上がります。コーディングエージェントが10回リクエストを送れば、500kトークンのリクエストを1回送る場合より大幅に高くなる可能性があります。
導入を決める前に利用可否を検証する方法
- 公式のモデルIDを使う。推測した別名やゲートウェイ固有の名前ではなく、
grok-4.7を指定します。 - 小さなResponses APIリクエストから始める。xAIは、Bearer認証とテキスト入力を使って
POST https://api.x.ai/v1/responsesを送る方法を案内しています。 - レスポンスと請求書の利用量を記録する。入力トークン、出力トークン、取得できる場合は推論利用量、ツール呼び出し回数、請求額を保存します。
- キャッシュは別途テストする。
prompt_cache_keyを指定して同じ長いシステムプロンプトを繰り返し送信し、2回目の入力料金を比較します。 - コンテキストの料金ティアを確認する。アプリケーションで長いリポジトリコンテキストが必要なら、256k未満の実行と256k超の実行をそれぞれ試します。
- エンドポイントを意図的に選ぶ。標準エンドポイントを基準コストの確認に使い、米国リージョンのデータ所在地というメリットが10%のプレミアムに見合う場合だけ、米国リージョンを選びます。
- ゲートウェイ料金は別のサービスとして扱う。$1.20/$3.60や$1.60/$4.80を予算に入れる前に、キャンペーンの終了日、プロバイダーのルーティング、フォールバック動作、データ保持条件、経路ごとの追加料金を確認します。
- 完了したタスクを測定する。コーディングでは、テスト通過数、リトライ回数、ツール呼び出し回数、経過時間、受け入れ可能な変更1件あたりの総コストを追跡します。
Grok 4.7 APIに関するFAQ
Grok 4.7は公式APIから利用できますか?
はい。xAIのドキュメントには、Responses APIとChat Completionsで利用できるgrok-4.7モデルが掲載されています。SDK、OpenAI互換クライアント、cURLの例も用意されています。
入力$2、出力$6という料金は確定していますか?
2026年9月21日に公開された標準のxAI直接利用料金としては、はい。米国リージョンのエンドポイントでは10%上乗せされ、ゲートウェイでは異なる料金やキャンペーン料金が表示される場合があります。
Grok 4.7はコーディングに向いていますか?
ツール利用、調整可能な推論、コンテキスト圧縮のガイダンス、最大500kのコンテキストに対応しているため、長時間動作するコーディングエージェントの試験候補としては妥当です。ただし、公開されている情報だけでコーディング性能の優位性が独立して証明されているわけではありません。自分のリポジトリ上のタスクで検証してください。
Grok 4.7のコンテキストウィンドウは500kですか?
はい。xAIは500,000トークンとしています。Cursorでは別途、標準コンテキストを256k、最大ティアを500kと説明しており、256kを超えると料金が高くなります。
Grok 4.7 Fastは公開APIから利用できますか?
いいえ。xAIのGrok 4.7ドキュメントでは、Grok 4.7 Fastを、より高速なインフラ上で動く同一モデルとして説明しており、標準料金の2倍としています。ただし、公開されているxAI APIでは利用できません。CursorとGrok Buildには掲載されています。
判断:試す価値はある。ただし実際に使う経路の料金で予算を組む
Grok 4.7のAPI利用と$2/$6という基準料金は確認できます。一方、コーディング性能の優位性はまだ証明されていません。256kを超えるトークンを送る、キャッシュされていないリポジトリコンテキストに依存する、米国リージョンを使う、推論リクエストを何度も発生させるといった条件では、タスク完了までの実コストが大きく変わります。本番の作業を移行する前に、まずは測定可能な小規模パイロットから始めましょう。