AIREITER

Grok 4.7 API 价格与编程实测评估

最后更新: 2026-09-21 20:04:33

如果你正在为 API 工作流评估 Grok 4.7,先记住一个结论:常见的价格说法基本没错,但还不完整。xAI 官方文档列出的标准 API 价格是输入每百万 tokens 收费 $2,输出每百万 tokens 收费 $6。官方模型 ID 为 grok-4.7,但实际账单还可能受到网关价格、美国区域路由、缓存命中率以及长上下文使用方式的影响。

先说结论:API 确实可用,但 $2/$6 只是直连基准价

Grok 4.7 并不是传闻,也不只是一个聊天产品里的名称。xAI 官方页面于 2026 年 9 月 21 日更新,明确说明该模型可通过 Responses API 和 Chat Completions 调用。页面列出的能力包括 500,000-token 上下文窗口、文本和图像输入、文本输出、函数调用、网页搜索、X 搜索以及代码执行。

$2/$6 这个说法,准确来说对应的是标准直连价格:

调用路径或使用模式输入输出含义
直连 xAI API,标准价格$2.00/M$6.00/Mgrok-4.7 的官方基准价
xAI 美国区域端点$2.20/M*$6.60/M*比标准价格高 10%
OpenRouter 标准列表价$1.60/M$4.80/M网关/服务商价格,不是 xAI 直连价格
Vercel AI Gateway 促销价$1.20/M$3.60/M促销价显示至 2026 年 9 月 27 日

*美国区域价格是根据 xAI 文档中“加价 10%”计算得出,并非页面单独列出的 headline 价格。预算直连 xAI 时可按 $2/$6 估算;网关价格则应视为特定路由的报价,使用前务必核对条款和可用性。

xAI 官方到底开放了哪些能力

官方模型标识符是 grok-4.7。xAI 提供三种兼容的调用方式:使用其 SDK、将 OpenAI 兼容客户端指向 https://api.x.ai/v1,或者直接向 https://api.x.ai/v1/responses 发起 POST 请求。

官方规格对代理型开发尤其重要:

规格xAI 文档中的数值
上下文窗口500,000 tokens
知识截止时间2026 年 5 月
推理等级Low、medium、high、xhigh
默认推理等级High
输入文本和图像
输出文本
APIResponses API 和 Chat Completions
工具函数调用、网页搜索、X 搜索、代码执行
标准输入价格$2/M tokens
标准输出价格$6/M tokens

文档示例让模型查找并解释一个 JavaScript 中位数函数的 bug。这个例子能证明 API 已经接通,但不能证明模型的编程质量。页面没有提供独立的基准测试表、延迟数据、正常运行时间承诺或任务完成率。

Grok 4.7 API 价格:这些细节可能直接改变账单

直连 API 和网关价格不是一回事

OpenRouter 的模型页面列出输入 $1.60/M、输出 $4.80/M,以及缓存读取 $0.40/M。Vercel AI Gateway 页面则显示 40% 的促销折扣,价格降至输入 $1.20/M、输出 $3.60/M,促销截止日期为 2026 年 9 月 27 日。

网关价格可能包含促销因素,也可能对应不同的路由。比较时不要只盯着 token 单价,还要核算一次完整请求的总成本。

美国区域路由会加价

xAI 将 https://us.api.x.ai/v1 定义为美国区域端点,并规定 token 使用量加价 10%。按标准价格计算,就是输入 $2.20/M、输出 $6.60/M。

反复发送仓库上下文时,缓存影响很大

xAI 建议使用缓存路由标识符:Responses API 使用 prompt_cache_key,Chat Completions 使用 x-grok-conv-id 请求头。让连续请求尽量路由到同一台服务器,可以提高缓存命中概率;如果请求未命中缓存,输入部分可能按完整价格计费。

Cursor 的Grok 4.7 价格表提供了一个托管场景的参考:标准层级的缓存读取价格为 $0.50/M,而未缓存输入为 $2/M。不过,这是 Cursor 自己的计费口径,并不意味着 xAI 直连 API 也采用完全相同的缓存价格。

上下文越长,价格不一定还是基础价

Cursor 将 256k 列为标准上下文长度,500k 列为最大值。其文档说明,超过 256k 后会采用更高的长上下文价格:标准模式为 2 倍,Fast 模式为 3 倍。

xAI 确认支持 500k 上下文,但没有在模型摘要中公布单独的长上下文倍率。在默认 500k 仍按基础价格计费之前,先查清楚你所用路由的计费规则。

现有编程证据能说明什么,又不能说明什么

目前关于 Grok 4.7 的公开定位,重点是持续时间较长的代理型开发工作。xAI、Cursor 和 OpenRouter 都将它与编程、长时间软件工程任务、自我验证和长上下文联系在一起。Cursor 的模型文档还列出了其代理环境中的文件搜索、文件编辑、Shell 命令、浏览器控制、网页访问、图像生成和澄清问题能力。

这些能力足以支持一次编程试点,但不能据此断言它更擅长修 bug、通过测试,或者每个任务的成本更低。更可靠的做法是准备一套可复现的仓库测试,并记录任务是否成功、重试次数、工具调用次数、耗时和 token 总量。

工作量设置从 low 到 xhigh,默认值为 high。更高的工作量等级可能带来更长耗时和不同用量;在预测生产成本前,先确认你的服务商如何统计和计费推理用量。

处理最新知识工作,仍然需要检索

Grok 4.7 支持图像输入、网页搜索和 X 搜索,知识截止时间为 2026 年 5 月。对于需要最新信息的研究任务,应配合检索或搜索,并从引用准确性、来源覆盖度、修改次数和人工纠错时间等指标评估效果,而不是只看文字是否流畅。

两个代理循环示例,实际要花多少钱

按直连标准价格,可以使用下面这个简单公式:

cost = (input_tokens / 1,000,000 × $2) + (output_tokens / 1,000,000 × $6)

请求示例输入成本输出成本Token 成本
100k 输入 + 20k 输出$0.20$0.12$0.32
500k 输入 + 50k 输出$1.00$0.30$1.30

第二个例子只是按基础价格计算的示范。区域加价、托管路由的长上下文倍率、重复提示词未命中缓存、服务商特有的推理计费规则,以及额外请求,都会推高成本。一个会发起十次请求的编程代理,花费可能远高于一次 500k-token 请求。

正式投入前,先这样验证 API 是否可用

  1. 使用官方模型 ID。发送 grok-4.7,不要自行猜测别名,也不要直接套用网关专属名称。
  2. 先发起一个小型 Responses API 请求。xAI 文档给出了 POST https://api.x.ai/v1/responses 的调用方式,使用 Bearer 认证并提交文本输入。
  3. 同时记录响应和账单中的用量。保存输入 token、输出 token、接口返回的推理用量(如果有)、工具调用次数以及最终计费金额。
  4. 单独测试缓存。使用 prompt_cache_key 重复发送同一段较长的系统提示词,再比较第二次请求的输入计费。
  5. 测试自己的上下文档位。如果应用需要较长的仓库上下文,分别进行一次低于 256k tokens 和一次高于 256k tokens 的测试。
  6. 有意识地选择端点。用标准端点测算基础经济性;只有当数据位置方面的收益足以覆盖 10% 加价时,才使用美国区域端点。
  7. 把网关价格当成独立产品处理。在预算中使用 $1.20/$3.60 或 $1.60/$4.80 之前,先确认促销到期时间、服务商路由、故障回退行为、数据留存条款和特定路由费用。
  8. 以完成任务为单位衡量。编程场景应记录通过的测试、重试次数、工具调用次数、耗时,以及每个已接受修改的总成本。

Grok 4.7 API 常见问题

Grok 4.7 能通过官方 API 调用吗?

可以。xAI 文档列出了 grok-4.7 模型对 Responses API 和 Chat Completions 的支持,并提供 SDK、OpenAI 兼容客户端以及 cURL 示例。

输入 $2、输出 $6 是确认过的价格吗?

是的,这是 2026 年 9 月 21 日文档中公布的标准 xAI 直连 API 价格。美国区域端点会加价 10%,而网关可能显示不同价格或促销价格。

Grok 4.7 适合编程吗?

它适合作为长时间运行编程代理的试点候选,因为官方描述的设计包含工具调用、可调推理等级、上下文压缩指引,以及最高 500k 的上下文。但现有资料无法独立证明它在编程任务上一定胜出,最好用自己的仓库任务进行测试。

Grok 4.7 有 500k 上下文窗口吗?

有。xAI 列出的上限是 500,000 tokens。Cursor 则将 256k 作为标准上下文、500k 作为最大档位,并对超过 256k 的请求采用更高价格。

Grok 4.7 Fast 能通过公共 API 使用吗?

不能。xAI 的 Grok 4.7 文档将 Grok 4.7 Fast 描述为运行在更快基础设施上的同一模型,标准费率为两倍,但同时说明它无法通过公共 xAI API 使用。目前它被列为 Cursor 和 Grok Build 可用。

最终建议:可以试点,但预算要按实际使用的路由来算

Grok 4.7 的 API 可用性和 $2/$6 基准价格已经确认,但它在编程上的优势尚未得到证明。如果你的工作负载会发送超过 256k tokens、依赖未缓存的仓库上下文、使用美国区域路由,或者会触发大量推理调用,那么按已完成任务计算的成本可能与基础价格相差很大。迁移生产工作前,先做一次有数据记录的试点。