AIREITER

Grok 4.6 API:料金、ベンチマーク、変更点

最終更新日: 2026-08-13 02:30:12

Grok 4.6が登場したのは2026年8月12日。Elon Musk氏が示唆した「2週間」から5日遅れのリリースで、料金表だけを見ると入力1,000,000トークンあたり$2.00、出力$6.00、コンテキスト500Kと、Grok 4.5から変わっていない。だが、実際の請求額まで同じではない。キャッシュ入力は4.5比で67%高く、同じ作業を完了するために消費するトークンも、独立測定では増えている。

8月12日に提供されたもの

モデルIDはgrok-4.6。SpaceXAIのリリースノートによると、APIでの提供開始日は2026年8月12日だ。仕様は次のとおり。

項目Grok 4.6
モデルIDgrok-4.6
コンテキスト500Kトークン
入力テキスト、画像
出力テキストのみ、出力上限は明記なし
推論強度low、medium、high(デフォルト)、xhigh
知識カットオフ2026年2月1日
2026年8月12日付のSpaceXAIリリースノート。xAI APIでのGrok 4.6提供開始とコンテキスト長、料金を告知している

この表で新しいのは主に2点だ。ひとつはxhigh。Grok 4.5にはない第4の推論レベルで、4.5はhighまでとなる。もうひとつは、ドキュメントに2026年2月1日の知識カットオフが記載されたことだ。日付が重要な質問を投げる際、どの時点までがモデルの不得意な領域なのかを判断しやすくなる。

モデルカタログでは、Grok 4.6はコードとチャット向けのフラッグシップモデルとして掲載され、サイドバーではLatestと表示されている。ページの日付は2026年8月12日。Grok 4.5も廃止されたわけではなく、料金ページには現在も別料金のモデルとして残っている。

SpaceXAIの開発者向けドキュメント。Grok 4.6をNewとして表示し、コンテキスト500K、入力$2.00、出力$6.00の料金を示している

初日から提供先は広かった。SpaceXAIの発表ではCursorとGrok Buildを挙げ、どちらも最初の1週間は利用枠が2倍になるとしている。APIに加え、OpenRouter、Vercel、Cloudflareなどのパートナーも対象だ。また、価格が2倍になる高速版にも触れているが、現時点で公開料金ページにその料金行はない。したがって2倍という数字は、公開済みの料金ではなく発表文に記載された数字として扱うべきだ。

Grok 4.6の料金:表面上は同じ、キャッシュは値上がり

入力と出力の料金はGrok 4.5から据え置き。一方、キャッシュ入力の料金は変わった。

100万トークンあたりGrok 4.5Grok 4.6
入力(200K未満)$2.00$2.00
キャッシュ入力(200K未満)$0.30$0.50
出力(200K未満)$6.00$6.00
入力/キャッシュ/出力(200K以上)$4.00 / $0.60 / $12.00$4.00 / $1.00 / $12.00
200K未満のコンテキストで、Grok 4.5とGrok 4.6の入力、キャッシュ入力、出力料金を比較した棒グラフ

キャッシュ入力の割引率は85%から75%になった。100万トークンあたり20セントの値上げで、タスク数よりもエージェントのステップ数に応じて膨らみやすい項目だ。1日あたり50Mトークンをキャッシュから読み出すハーネスなら、4.5では$9.00、4.6では$15.00かかる。

長いコンテキストの扱いも変わっておらず、ここは今も見落とされやすい。リクエストのプロンプトが200Kトークンに達すると、そのリクエストの全トークンが高い料金帯で課金される。つまり210Kトークンの呼び出しは、2つの料金帯を混ぜて計算するのではなく、入力全体が100万トークンあたり$4.00だ。OpenRouterの公開モデル一覧にも同じ料金と200Kの切り替え条件が掲載されているため、サードパーティ経由にしても計算は変わらない。

公式評価で見えるGrok 4.6の得意分野と弱点

SpaceXAIは、Grok 4.5、GPT-5.6 Sol Max、Fable 5 Maxとの10項目比較を公開した。Grok 4.6がトップスコアを取ったのはGDPVal-AA v2(1753)、AA-Briefcase(1577)、Harvey LAB(15.8%)の3項目。残る7項目では首位を逃している。ルーティング判断に関係する8項目は次のとおりだ。

Grok 4.6、Grok 4.5、GPT-5.6 Sol、Fable 5を10種類のベンチマークで比較したSpaceXAI公式評価表
評価Grok 4.6Grok 4.5GPT-5.6 SolFable 5
AA Intelligence Index61566162
GDPVal-AA v21753152617281741
CursorBench v3.269.9%66.7%67.2%70.5%
DeepSWE v1.165.9%54%73%70%
FrontierCode v1.161.3%56.6%60.6%63.6%
APEX-Agents57.5%47.1%56.7%59.2%
Terminal-Bench v3.026%15.7%34.6%34.1%
AA-Briefcase1577131315021574

特に注目したいのがTerminal-Benchだ。Grok 4.6は26%で、GPT-5.6 Solの34.6%、Fable 5の34.1%に届かない。シェルを操作するエージェントに最も近い評価で、8ポイント差の3位に終わった。DeepSWEも数字は違うが同じ傾向で、Grok 4.6は65.9%、Solは73%。ターミナル操作型エージェントが中心のワークロードなら、ベンダー自身の表を見ても、Grok 4.6が先頭に立つモデルとは言いにくい。

とはいえ、Grok 4.5からの改善は明確で、一貫している。すべての項目でスコアが伸び、APEX-Agentsは47.1%から57.5%、Terminal-Benchは15.7%から26%へと、どちらも10ポイント以上向上した。SpaceXAIはその理由として、追加トレーニング期間の延長、SFT軌跡の再生成、コーディングおよび知識労働環境でのエージェント型RLを挙げている。ただし、発表で触れられていない点もある。パラメータ数だ。モデルに付随する2兆という数字はMusk氏によるもので、リリース資料に記載されたものではない。

性能向上にかかったコストを測る

ベンダーの評価表はスコアを示すが、そのスコアにいくらかかったかまでは分からない。Artificial Analysisは両方を公開しており、8月13日時点のデータからGrok 4.6の実際のトレードオフが見えてくる。

同じ指標での測定Grok 4.5(high)Grok 4.6(high)
Intelligence Index56(184モデル中16位)61(184モデル中6位)
出力速度56.9トークン/秒(102位)67.6トークン/秒(74位)
生成出力トークン数60M72M
評価全体のコスト$579.21$1,068.47
Artificial Analysis Intelligence Indexの実行コストをGrok 4.5とGrok 4.6で比較した棒グラフ

知能スコアを5ポイント上げるために、コストは1.8倍になった。表面上の料金は同じなのに、同じベンチマーク一式で請求額は$489多い。理由は、72M対60Mという出力トークン数の増加と、先ほどのキャッシュ料金改定の両方だ。Artificial Analysisは実行コストの内訳を公開していないため、1.8倍は観測された合計値であり、料金表から再計算できる公式ではない。

速度は改善している。出力速度は4.5の56.9トークン/秒から67.6トークン/秒へ上がり、同クラス184モデルの中で下位半分からおおむね中央値付近まで順位を上げた。

Musk氏の発言と、実際に出荷されたもの

このモデル名が最初に登場したのは、3語の返信だった。7月18日、@minchoiへの返信でMusk氏は「1.5Tモデルをあらゆる面で上回る2Tモデルは、来週初期トレーニングを終える。Kimiを超えられるかもしれないが、速度とトークン効率は1.5T(別名Grok 4.5)に近いものになるだろう」と投稿した。Andrew Curran氏から、それはGrok 4.6なのかと聞かれると、「Yeah, Grok 4.6」と答えている。

1.5TのGrok 4.5より優れた2Tモデルについて説明するElon Musk氏のX投稿と、その名称がGrok 4.6であることを確認する3語の返信

7月24日には、スケジュールについて「Grok 4.6は2週間後、Grok 4.7は4週間後」と投稿した。この日から2週間後なら8月7日前後だが、実際の出荷は5日遅い8月12日だった。

FrontierCodeのパレートフロンティア図への返信で、Grok 4.6は2週間後、Grok 4.7は4週間後と述べるElon Musk氏のX投稿

この投稿に含まれていた主張のうち、リリースでそのまま確認できなかったものは3つある。

  • 2兆パラメータは依然として未確認だ。SpaceXAIの発表、モデルドキュメント、リリースノートのいずれにも、Grok 4.6のパラメータ数は記載されていない。
  • 「Grok 4.5に近いトークン効率」という説明は、Artificial Analysisの測定と一致しない。同じ評価で、Grok 4.6は4.5の60Mに対して72Mの出力トークンを生成した。
  • 「Kimiを超えるかもしれない」という点は、SpaceXAIの表ではMoonshotのK3と比較されておらず、検証されていない。比較対象はGPT-5.6 SolとFable 5だけだ。

Grok 4.5からGrok 4.6へ移行すべきか

Grok 4.5からの移行であれば、エージェント型の処理や知識労働には有力な選択肢だ。ただし、移行時点で判断を終わらせず、1週間運用してトークン請求額を確認したい。Grok 4.5は従来料金のまま利用できるため、切り替えはいつでも戻せる。思い込みで移行するより、実測して決めるのがよい。

長時間のエージェント処理や知識タスクが中心なら、今の段階で移行してもよい。APEX-Agentsは10.4ポイント、GDPVal-AAは227向上しており、生成速度の改善も複数ステップの処理で効いてくる。一方、キャッシュ利用が多く価格を重視するなら4.5に残る選択がある。キャッシュ読み出しの67%値上げは明確な後退であり、4.6の登場によって4.5のスコアが下がったわけでもない。ターミナル操作型エージェントについては、SpaceXAI自身の表でGrok 4.6はGPT-5.6 SolとFable 5に8ポイント差をつけられているため、別モデルも検討したい。

本番のルートを切り替える前に、最低限次の3点を確認しておこう。

  1. 2つのIDがエイリアスだと理解する。SpaceXAIのエイリアス規則では、grok-4.6は最新の安定版、grok-4.6-latestは最新ビルドを指す。固定できるのは<modelname>-<date>形式の日付付きIDだけだが、モデルカタログにもOpenRouterにも日付付きの4.6は掲載されていない。現時点で再現性のあるワークフロー向けの固定IDは存在しない。
  2. 推論強度を再検証する。新しいxhighは無料の性能向上ではない。4.5より出力が冗長だと測定されたモデルで、さらに多くのトークンを消費する。4.5との条件をそろえた比較には、デフォルトのhighを使うべきだ。
  3. 利用するプロバイダーで提供されているか確認する。SpaceXAIで初日から使えても、すべてのサービスで同日提供とは限らない。8月13日に/v1/modelsへ問い合わせたところ、公式APIとOpenRouterはどちらもgrok-4.6を返した。一方、筆者が試したOpenAI互換のリセラーエンドポイントはgrok-4.5までしか対応しておらず、新しいIDにはmodel_not_foundを返した。実際にトラフィックを流す前に、自分のAPIキーで正確なIDが応答するか確認しておきたい。

FAQ

Grok 4.6 APIの料金はいくらですか?

コンテキスト200K未満では、入力が100万トークンあたり$2.00、出力が$6.00、キャッシュ入力が$0.50だ。プロンプトが200Kトークンを超えると、リクエスト全体が入力$4.00、キャッシュ入力$1.00、出力$12.00で課金される。発表では通常の2倍の料金となる高速版にも触れているが、公開料金ページには掲載されていない。

Grok 4.6はGrok 4.5より優れていますか?

SpaceXAIが公開したすべてのベンチマークでは、そう言える。AA Intelligence Indexは56から61になり、特にエージェント型の評価で大きく伸びた。ただし独立測定では、同じ評価でGrok 4.6が72Mの出力トークンを生成したのに対し、Grok 4.5は60Mだった。同じ作業でもコストは高くなる。

Grok 4.6のパラメータ数はいくつですか?

非公開だ。Musk氏は2026年7月18日に2兆パラメータのモデルについて説明し、その名称がGrok 4.6であることを確認した。しかしSpaceXAIのリリース資料には、パラメータ数、アーキテクチャの詳細、1トークンあたりに実際に有効化されるパラメータ数の記載はない。

Grok 4.6のコンテキストウィンドウと知識カットオフは?

コンテキストは500Kトークン。入力はテキストと画像に対応し、出力はテキストのみだ。ドキュメント上の知識カットオフは2026年2月1日で、それ以降の出来事を扱うにはサーバー側でWeb SearchまたはX Searchを有効にする必要がある。

Grokを開発しているのはxAIですか、それともSpaceXAIですか?

どちらも同じ会社を指している。開発者向けドキュメントのタイトルは「SpaceXAI Docs」で、発表のフッターには2026年のSpaceX傘下への移行後もX.AI LLCと記載されている。x.aiドメインとgrok-*モデルIDは変更されていない。

Grok 4.7はいつ登場しますか?

日付は発表されていない。Musk氏の7月24日の投稿ではGrok 4.7は約4週間後とされており、2026年8月21日前後を示していた。ただしGrok 4.6は、同モデルについて示された予定日より5日遅れて登場している。

関連記事

料金、モデルID、ベンチマークの数値は、2026年8月13日にSpaceXAIのドキュメント、Grok 4.6の発表、Artificial Analysisを照合して確認した。