如果你正在为 API 工作流评估 Grok 4.7,先记住一个结论:常见的价格说法基本没错,但还不完整。xAI 官方文档列出的标准 API 价格是输入每百万 tokens 收费 $2,输出每百万 tokens 收费 $6。官方模型 ID 为 grok-4.7,但实际账单还可能受到网关价格、美国区域路由、缓存命中率以及长上下文使用方式的影响。
先说结论:API 确实可用,但 $2/$6 只是直连基准价
Grok 4.7 并不是传闻,也不只是一个聊天产品里的名称。xAI 官方页面于 2026 年 9 月 21 日更新,明确说明该模型可通过 Responses API 和 Chat Completions 调用。页面列出的能力包括 500,000-token 上下文窗口、文本和图像输入、文本输出、函数调用、网页搜索、X 搜索以及代码执行。
$2/$6 这个说法,准确来说对应的是标准直连价格:
| 调用路径或使用模式 | 输入 | 输出 | 含义 |
|---|---|---|---|
| 直连 xAI API,标准价格 | $2.00/M | $6.00/M | grok-4.7 的官方基准价 |
| xAI 美国区域端点 | $2.20/M* | $6.60/M* | 比标准价格高 10% |
| OpenRouter 标准列表价 | $1.60/M | $4.80/M | 网关/服务商价格,不是 xAI 直连价格 |
| Vercel AI Gateway 促销价 | $1.20/M | $3.60/M | 促销价显示至 2026 年 9 月 27 日 |
*美国区域价格是根据 xAI 文档中“加价 10%”计算得出,并非页面单独列出的 headline 价格。预算直连 xAI 时可按 $2/$6 估算;网关价格则应视为特定路由的报价,使用前务必核对条款和可用性。
xAI 官方到底开放了哪些能力
官方模型标识符是 grok-4.7。xAI 提供三种兼容的调用方式:使用其 SDK、将 OpenAI 兼容客户端指向 https://api.x.ai/v1,或者直接向 https://api.x.ai/v1/responses 发起 POST 请求。
官方规格对代理型开发尤其重要:
| 规格 | xAI 文档中的数值 |
|---|---|
| 上下文窗口 | 500,000 tokens |
| 知识截止时间 | 2026 年 5 月 |
| 推理等级 | Low、medium、high、xhigh |
| 默认推理等级 | High |
| 输入 | 文本和图像 |
| 输出 | 文本 |
| API | Responses API 和 Chat Completions |
| 工具 | 函数调用、网页搜索、X 搜索、代码执行 |
| 标准输入价格 | $2/M tokens |
| 标准输出价格 | $6/M tokens |
文档示例让模型查找并解释一个 JavaScript 中位数函数的 bug。这个例子能证明 API 已经接通,但不能证明模型的编程质量。页面没有提供独立的基准测试表、延迟数据、正常运行时间承诺或任务完成率。
Grok 4.7 API 价格:这些细节可能直接改变账单
直连 API 和网关价格不是一回事
OpenRouter 的模型页面列出输入 $1.60/M、输出 $4.80/M,以及缓存读取 $0.40/M。Vercel AI Gateway 页面则显示 40% 的促销折扣,价格降至输入 $1.20/M、输出 $3.60/M,促销截止日期为 2026 年 9 月 27 日。
网关价格可能包含促销因素,也可能对应不同的路由。比较时不要只盯着 token 单价,还要核算一次完整请求的总成本。
美国区域路由会加价
xAI 将 https://us.api.x.ai/v1 定义为美国区域端点,并规定 token 使用量加价 10%。按标准价格计算,就是输入 $2.20/M、输出 $6.60/M。
反复发送仓库上下文时,缓存影响很大
xAI 建议使用缓存路由标识符:Responses API 使用 prompt_cache_key,Chat Completions 使用 x-grok-conv-id 请求头。让连续请求尽量路由到同一台服务器,可以提高缓存命中概率;如果请求未命中缓存,输入部分可能按完整价格计费。
Cursor 的Grok 4.7 价格表提供了一个托管场景的参考:标准层级的缓存读取价格为 $0.50/M,而未缓存输入为 $2/M。不过,这是 Cursor 自己的计费口径,并不意味着 xAI 直连 API 也采用完全相同的缓存价格。
上下文越长,价格不一定还是基础价
Cursor 将 256k 列为标准上下文长度,500k 列为最大值。其文档说明,超过 256k 后会采用更高的长上下文价格:标准模式为 2 倍,Fast 模式为 3 倍。
xAI 确认支持 500k 上下文,但没有在模型摘要中公布单独的长上下文倍率。在默认 500k 仍按基础价格计费之前,先查清楚你所用路由的计费规则。
现有编程证据能说明什么,又不能说明什么
目前关于 Grok 4.7 的公开定位,重点是持续时间较长的代理型开发工作。xAI、Cursor 和 OpenRouter 都将它与编程、长时间软件工程任务、自我验证和长上下文联系在一起。Cursor 的模型文档还列出了其代理环境中的文件搜索、文件编辑、Shell 命令、浏览器控制、网页访问、图像生成和澄清问题能力。
这些能力足以支持一次编程试点,但不能据此断言它更擅长修 bug、通过测试,或者每个任务的成本更低。更可靠的做法是准备一套可复现的仓库测试,并记录任务是否成功、重试次数、工具调用次数、耗时和 token 总量。
工作量设置从 low 到 xhigh,默认值为 high。更高的工作量等级可能带来更长耗时和不同用量;在预测生产成本前,先确认你的服务商如何统计和计费推理用量。
处理最新知识工作,仍然需要检索
Grok 4.7 支持图像输入、网页搜索和 X 搜索,知识截止时间为 2026 年 5 月。对于需要最新信息的研究任务,应配合检索或搜索,并从引用准确性、来源覆盖度、修改次数和人工纠错时间等指标评估效果,而不是只看文字是否流畅。
两个代理循环示例,实际要花多少钱
按直连标准价格,可以使用下面这个简单公式:
cost = (input_tokens / 1,000,000 × $2) + (output_tokens / 1,000,000 × $6)
| 请求示例 | 输入成本 | 输出成本 | Token 成本 |
|---|---|---|---|
| 100k 输入 + 20k 输出 | $0.20 | $0.12 | $0.32 |
| 500k 输入 + 50k 输出 | $1.00 | $0.30 | $1.30 |
第二个例子只是按基础价格计算的示范。区域加价、托管路由的长上下文倍率、重复提示词未命中缓存、服务商特有的推理计费规则,以及额外请求,都会推高成本。一个会发起十次请求的编程代理,花费可能远高于一次 500k-token 请求。
正式投入前,先这样验证 API 是否可用
- 使用官方模型 ID。发送
grok-4.7,不要自行猜测别名,也不要直接套用网关专属名称。 - 先发起一个小型 Responses API 请求。xAI 文档给出了
POST https://api.x.ai/v1/responses的调用方式,使用 Bearer 认证并提交文本输入。 - 同时记录响应和账单中的用量。保存输入 token、输出 token、接口返回的推理用量(如果有)、工具调用次数以及最终计费金额。
- 单独测试缓存。使用
prompt_cache_key重复发送同一段较长的系统提示词,再比较第二次请求的输入计费。 - 测试自己的上下文档位。如果应用需要较长的仓库上下文,分别进行一次低于 256k tokens 和一次高于 256k tokens 的测试。
- 有意识地选择端点。用标准端点测算基础经济性;只有当数据位置方面的收益足以覆盖 10% 加价时,才使用美国区域端点。
- 把网关价格当成独立产品处理。在预算中使用 $1.20/$3.60 或 $1.60/$4.80 之前,先确认促销到期时间、服务商路由、故障回退行为、数据留存条款和特定路由费用。
- 以完成任务为单位衡量。编程场景应记录通过的测试、重试次数、工具调用次数、耗时,以及每个已接受修改的总成本。
Grok 4.7 API 常见问题
Grok 4.7 能通过官方 API 调用吗?
可以。xAI 文档列出了 grok-4.7 模型对 Responses API 和 Chat Completions 的支持,并提供 SDK、OpenAI 兼容客户端以及 cURL 示例。
输入 $2、输出 $6 是确认过的价格吗?
是的,这是 2026 年 9 月 21 日文档中公布的标准 xAI 直连 API 价格。美国区域端点会加价 10%,而网关可能显示不同价格或促销价格。
Grok 4.7 适合编程吗?
它适合作为长时间运行编程代理的试点候选,因为官方描述的设计包含工具调用、可调推理等级、上下文压缩指引,以及最高 500k 的上下文。但现有资料无法独立证明它在编程任务上一定胜出,最好用自己的仓库任务进行测试。
Grok 4.7 有 500k 上下文窗口吗?
有。xAI 列出的上限是 500,000 tokens。Cursor 则将 256k 作为标准上下文、500k 作为最大档位,并对超过 256k 的请求采用更高价格。
Grok 4.7 Fast 能通过公共 API 使用吗?
不能。xAI 的 Grok 4.7 文档将 Grok 4.7 Fast 描述为运行在更快基础设施上的同一模型,标准费率为两倍,但同时说明它无法通过公共 xAI API 使用。目前它被列为 Cursor 和 Grok Build 可用。
最终建议:可以试点,但预算要按实际使用的路由来算
Grok 4.7 的 API 可用性和 $2/$6 基准价格已经确认,但它在编程上的优势尚未得到证明。如果你的工作负载会发送超过 256k tokens、依赖未缓存的仓库上下文、使用美国区域路由,或者会触发大量推理调用,那么按已完成任务计算的成本可能与基础价格相差很大。迁移生产工作前,先做一次有数据记录的试点。