如果你正考慮把 Grok 4.7 放進 API 工作流程,先別只看 $2/$6 這個標題數字:xAI 官方文件列出的標準 API 費率,確實是每百萬個輸入 token $2、每百萬個輸出 token $6。Grok 4.7 也已透過 grok-4.7 這個正式模型 ID 提供服務。不過,實際帳單還會受到閘道服務價格、美國區域路由、快取,以及長上下文使用方式影響。
先講結論:API 存取已確認,但 $2/$6 只是直接使用的基準價
Grok 4.7 不是傳聞,也不只是聊天產品裡的一個名稱。xAI 官方頁面於 September 21, 2026 更新,文件確認可透過 Responses API 與 Chat Completions 使用。規格包括 500,000-token 上下文視窗、文字與圖片輸入、文字輸出、函式呼叫、網頁搜尋、X 搜尋,以及程式碼執行。
$2/$6 這個說法,確認的是標準直接 API 費率:
| 路由或使用模式 | 輸入 | 輸出 | 代表意義 |
|---|---|---|---|
| 直接使用 xAI API,標準方案 | $2.00/M | $6.00/M | grok-4.7 的官方基準價 |
| xAI 美國區域端點 | $2.20/M* | $6.60/M* | 比標準價格高 10% |
| OpenRouter 標準列表 | $1.60/M | $4.80/M | 閘道/供應商價格,不是 xAI 直接 API 費率 |
| Vercel AI Gateway 促銷 | $1.20/M | $3.60/M | 促銷價顯示至 September 27, 2026 |
*美國區域價格是根據 xAI 文件所述的 10% 加價計算,並非頁面另外列出的標題價格。規劃直接使用 xAI 時,先以 $2/$6 編列預算;閘道服務則要視實際路由,並自行確認條款與供應狀態。
xAI 官方目前提供哪些能力
官方模型識別碼是 grok-4.7。xAI 提供三種相容的使用方式:使用官方 SDK、把 OpenAI 相容用戶端指向 https://api.x.ai/v1,或直接對 https://api.x.ai/v1/responses 發送 POST 請求。
對代理型工作來說,以下規格尤其值得注意:
| 規格 | xAI 文件列出的數值 |
|---|---|
| 上下文視窗 | 500,000 tokens |
| 知識截止時間 | May 2026 |
| 推理等級 | Low、medium、high、xhigh |
| 預設推理等級 | High |
| 輸入 | 文字與圖片 |
| 輸出 | 文字 |
| API | Responses API 與 Chat Completions |
| 工具 | 函式呼叫、網頁搜尋、X 搜尋、程式碼執行 |
| 標準輸入價格 | $2/M tokens |
| 標準輸出價格 | $6/M tokens |
官方文件的範例,是要求模型找出並解釋 JavaScript 中位數函式的錯誤。這能證明 API 串接方式可行,卻不能代表程式設計品質。該頁面沒有提供獨立的基準測試表、延遲結果、可用性承諾,也沒有任務完成率。
Grok 4.7 API 定價:這些細節會直接改變帳單
直接使用 API,和透過閘道服務,不是同一個價格
OpenRouter 的模型頁面列出每百萬輸入 $1.60、每百萬輸出 $4.80,以及每百萬快取讀取 $0.40。Vercel AI Gateway 頁面則顯示 40% 促銷折扣,價格降至每百萬輸入 $1.20、每百萬輸出 $3.60;促銷到 September 27, 2026 結束。
閘道價格可能包含促銷因素,也可能採用不同路由。評估時應比較完整請求的總成本,不要只看每 token 的醒目價格。
美國區域路由會加價
xAI 將 https://us.api.x.ai/v1 定義為美國區域端點,token 使用量加價 10%。按照標準費率計算,每百萬輸入是 $2.20,每百萬輸出是 $6.60。
重複送出大型儲存庫提示時,快取差異很大
xAI 建議設定快取路由識別碼:Responses API 使用 prompt_cache_key,Chat Completions 則使用 x-grok-conv-id 標頭。讓重複的對話回合持續路由到同一台伺服器,可以提高命中快取的機率;如果請求尚未建立快取,就可能必須按照完整輸入價格計費。
Cursor 的 Grok 4.7 定價表提供了一個託管服務參考:標準方案的快取讀取價格為每百萬 $0.50,未快取輸入則是每百萬 $2。這是 Cursor 自己的計費介面,不能據此推論直接使用 xAI API 時也一定採用相同的快取價格。
上下文越長,成本不會自動維持不變
Cursor 將 256k 列為標準上下文,500k 列為最大值。其文件指出,超過 256k 的請求會採用更高的長上下文費率:標準使用量是 2 倍,Fast 使用量則是 3 倍。
xAI 確認支援 500k 上下文,但模型摘要中沒有公布獨立的長上下文倍數。若你的路由需要使用 500k 上下文,先查清楚計費規則,不要直接假設仍按照基本費率計算。
目前公開的程式設計證據,能支持什麼、不能支持什麼
目前文件對 Grok 4.7 的定位,主要是長時間運作的代理型工作。xAI、Cursor 與 OpenRouter 都把它放在程式設計、長時間軟體工程、自我驗證與長上下文場景中。Cursor 的模型文件則列出其代理環境支援檔案搜尋、檔案編輯、Shell 指令、瀏覽器控制、網頁存取、圖片生成,以及主動提出澄清問題。
這些功能足以支持你進行程式設計試用,但還不能證明它更會修 bug、更容易通過測試,或每項任務的成本更低。建議使用可重現的儲存庫測試,並記錄任務成功率、重試次數、工具呼叫次數、實際耗時與 token 總量。
推理強度從 low 到 xhigh,預設值是 high。提高強度可能拉長處理時間,也會改變使用量;在預估正式環境成本前,先確認你的供應商如何回報及計費推理用量。
面對即時知識工作,仍然需要檢索能力
Grok 4.7 支援圖片、網頁搜尋與 X 搜尋,知識截止時間則是 May 2026。處理即時研究時,應搭配檢索或搜尋,並評估引用正確率、來源涵蓋度、修改次數與人工修正時間,而不是只看文字是否流暢。
兩種代理工作流程,實際會花多少錢
以直接使用標準價格為例,可以套用以下簡單公式:
cost = (input_tokens / 1,000,000 × $2) + (output_tokens / 1,000,000 × $6)
| 請求範例 | 輸入成本 | 輸出成本 | token 成本 |
|---|---|---|---|
| 100k 輸入 + 20k 輸出 | $0.20 | $0.12 | $0.32 |
| 500k 輸入 + 50k 輸出 | $1.00 | $0.30 | $1.30 |
第二個範例只是按照基本費率計算。若加入區域加價、託管路由的長上下文倍數、未命中快取的重複提示、供應商特有的推理計費規則,以及額外請求,實際成本都可能上升。會發出十次請求的程式設計代理,成本可能遠高於一次 500k token 的請求。
正式採用前,先這樣確認 API 是否可用
- 使用官方模型 ID。傳送
grok-4.7,不要自行猜測別名,也不要把閘道服務專用名稱當成模型 ID。 - 先送出一個小型 Responses API 請求。xAI 文件提供了
POST https://api.x.ai/v1/responses的範例,使用 Bearer 驗證並傳入文字。 - 同時記錄回應與發票中的用量。保存輸入 token、輸出 token、(如果有提供的話)推理用量、工具呼叫次數,以及實際帳單金額。
- 單獨測試快取。使用
prompt_cache_key重複送出相同的長系統提示,並比較第二次請求的輸入計費。 - 測試你的上下文層級。如果應用程式需要長篇儲存庫上下文,至少安排一次低於 256k token、另一次高於 256k token 的測試。
- 有意識地選擇端點。用標準端點建立基準成本;只有在資料位置的好處值得支付 10% 溢價時,才使用美國區域端點。
- 把閘道價格視為另一種產品。在預測中採用 $1.20/$3.60 或 $1.60/$4.80 前,先確認促銷截止時間、供應商路由、故障切換行為、資料保留條款與路由專屬費用。
- 以完成任務衡量價值。程式設計場景應追蹤通過的測試、重試次數、工具呼叫次數、實際耗時,以及每個已接受變更的總成本。
Grok 4.7 API 常見問題
Grok 4.7 能透過官方 API 使用嗎?
可以。xAI 文件列出 grok-4.7 模型,支援 Responses API 與 Chat Completions,並提供 SDK、OpenAI 相容用戶端與 cURL 範例。
輸入 $2、輸出 $6 是已確認的價格嗎?
是,這是 September 21, 2026 文件所載的標準直接 xAI API 費率。美國區域端點會加收 10%,閘道服務則可能顯示不同價格或促銷方案。
Grok 4.7 適合程式設計嗎?
它適合作為長時間運作程式設計代理的試用對象,因為公開規格包含工具使用、可調整推理強度、上下文壓縮指引,以及最高 500k 上下文。不過現有資料沒有獨立證明它在程式設計上勝出,仍應使用自己的儲存庫任務進行測試。
Grok 4.7 有 500k 上下文視窗嗎?
有。xAI 列出的上限是 500,000 tokens。Cursor 則另外將 256k 定義為標準上下文、500k 定義為最高層級,並指出超過 256k 後會採用更高價格。
Grok 4.7 Fast 能透過公開 API 使用嗎?
不能。xAI 的 Grok 4.7 文件指出,Grok 4.7 Fast 是在更快基礎架構上執行的相同模型,標準費率為兩倍,但目前無法透過公開 xAI API 使用。它目前列在 Cursor 與 Grok Build 中。
最後怎麼選:可以試,但要按照實際採用的路由編列預算
Grok 4.7 的 API 存取方式與 $2/$6 基準費率已獲確認,但它在程式設計上的優勢尚未獲得證明。如果你的工作流程會傳送超過 256k token、依賴未快取的儲存庫上下文、使用美國路由,或觸發大量推理請求,完成一項任務的成本可能完全不同。先做一輪有數據的試用,再決定是否將正式工作遷移過去。