Grok 4.6 这个名字最早正式出现时,只有三个词。2026 年 7 月 18 日,有人询问 Elon Musk:他刚提到的 2 万亿参数模型是否就是 Grok 4.6?Musk 的回答是:“Yeah, Grok 4.6.” 六天后,他又给出了时间表。截至 2026 年 7 月 27 日,SpaceXAI 自有渠道中找不到第三条相关声明;而目前网上与该型号绑定的各项性能数字,实际上都来自 Grok 4.5。
Elon Musk 亲口确认了哪些 Grok 4.6 信息
目前能追溯到的只有两条帖子,间隔六天,而且都不是正式新闻稿。
在 7 月 18 日回复 @minchoi 时,Musk 写道:“Our 2T model, which is better than our 1.5T in every way, will finish initial training next week. It might be able to exceed Kimi, but with speed and token efficiency close to our 1.5T (aka Grok 4.5).” 当时他没有点名这款模型。随后 Andrew Curran 追问这是否为 Grok 4.6,Musk 在上述回复中给出了确认。
这里有两点常在转述中被忽略。第一,Musk 说的是“Kimi”,并没有明确说“Kimi K3”;将其理解为 Moonshot 当前旗舰模型是合理推断,但并非原话。第二,他谈及速度与 token 效率时,参照对象是 Grok 4.5,不是 Kimi。
7 月 24 日,Musk 给出了时间安排:“Grok 4.6 in 2 weeks and Grok 4.7 in 4 weeks.” 以该日期计算,两周后大约落在 8 月 7 日。这条帖子本身也是一则回复,其上文同样值得注意:Musk 刚发布了 FrontierCode 1.1 的得分与成本对比图,并称“Grok 4.5 and Opus 5 are alone on Pareto frontier”。换言之,这一时间表出现在关于成本效率的讨论串中。
据此,目前可以确认四件事:
- 参数规模:总参数约 2 万亿,高于 Grok 4.5 基于 V9 foundation 的 1.5T
- 能力目标:可能超过 Kimi;Moonshot 对 K3 的说明为总参数 2.8T
- 效率要求:速度和 token 效率接近 Grok 4.5
- 发布时间:以 7 月 24 日起算约两周,即 8 月初
架构尚未披露。2T 是稠密模型还是 mixture-of-experts、每个 token 实际激活多少参数,以及 V9 是继续扩展还是被替代,SpaceXAI 之外都无人知晓。在参数规模增加 33% 的情况下,吞吐量承诺是否有意义,要等这些关键细节公布后才能判断。
SpaceXAI API 目前还没有 Grok 4.6
先说明一个容易影响检索结果的命名问题。开发 Grok 的公司 2023 年成立时名为 xAI,2026 年并入 SpaceX 后改用 SpaceXAI 品牌。文档标题写作“SpaceXAI Docs”,Grok 4.5 公告称其为“SpaceXAI's smartest model”,Artificial Analysis 也将该模型列为 SpaceXAI 出品。不过域名没有迁移:x.ai、docs.x.ai 和 api.x.ai 都仍可访问,模型 ID 也未改变。
SpaceXAI 模型文档的侧边栏将 Grok 4.5 标为 Latest,正文则标为 New。其中没有 grok-4.6 条目。
截至 2026 年 7 月 27 日,文档列出了六个文本模型:
| 模型 ID | 上下文 | 输入 / 1M | 输出 / 1M |
|---|---|---|---|
grok-4.5 | 500K | $2.00 | $6.00 |
grok-4.3 | 1M | $1.25 | $2.50 |
grok-4.20-0309-reasoning | 1M | $1.25 | $2.50 |
grok-4.20-0309-non-reasoning | 1M | $1.25 | $2.50 |
grok-4.20-multi-agent-0309 | 1M | $1.25 | $2.50 |
grok-build-0.1 | 256K | $1.00 | $2.00 |
以上价格适用于上下文低于 200K 的请求。请求一旦超过 200K tokens,整次请求将按双倍价格计费。因此,一次 210K-token 的 Grok 4.5 调用,输入和输出价格分别为每百万 tokens $4.00 和 $12.00,而不是将两个价格档位混合计算。
目前没有任何公开的 SpaceXAI 文档或公开模型 ID 能证明 Grok 4.6 已可访问。除非第三方服务商能展示准确的 SpaceXAI 模型 ID 及带日期的 API 响应,否则其提供的 Grok 4.6 都应视为未经验证。对于生产环境路由而言,结论很直接:在模型 ID 出现之前,无需调整,Grok 4.5 仍是当前可选方案。
所有标注为 Grok 4.6 的性能数字,其实都属于 Grok 4.5
搜索结果中反复出现五项新模型数据,但它们全部是在介绍上一代产品时发布的:
| 数字 | 实际对应模型 |
|---|---|
| 每秒 80 笔事务 | Grok 4.5,SpaceXAI 的发布主张 |
| SWE Marathon 得分 29.0%,高于 Claude Opus 4.8 的 26.0% | Grok 4.5,SpaceXAI 的发布主张 |
| 每百万 tokens 输入 $2、输出 $6 | Grok 4.5,当前 API 价格 |
| 500K 上下文窗口 | Grok 4.5 |
| 1.5 万亿参数、V9 foundation | Grok 4.5 |
至于 Grok 4.6,SpaceXAI 尚未公布价格、上下文窗口、基准测试分数、模型 ID,也没有说明其是否支持视觉、音频或开放权重。
先看 Grok 4.5:目前唯一可用的独立实测基线
Grok 4.6 上线后必然会与 Grok 4.5 比较。因此,在发布前,上一代模型的实测数据才是唯一真正可执行的参考。
每秒 80 笔事务,不等于每秒 80 个 token
这两个指标经常被混为一谈,但其实完全不同。事务指一次完整完成的请求;每秒输出 token 数衡量的是单次回复中的生成速度。在不知道平均回复长度的情况下,两者无法互相换算。
Artificial Analysis 测得,在高推理强度下,Grok 4.5 的输出速度为每秒 58.3 个 tokens,在 190 个模型中排第 102 位;同价位模型的中位数为 73.0 t/s。其首 token 延迟为 8.31 秒,而中位数为 2.80 秒。以上是 2026 年 7 月 27 日读取的快照数据;该排行榜会持续复测,随着新模型加入,排名也会变化。
Grok 4.5 的优势在智能表现:在同一指数中得分 54,在 190 个模型中位列第 13;同类模型中位数为 32。它的画像很清晰:模型聪明,但首 token 较慢、生成也偏慢,不过输出价格低于 $10.00 的中位数。
Grok 4.5 本身也有两个流传的发布日期。Artificial Analysis 标注为 2026 年 7 月 8 日;SpaceXAI 公告页面及同期媒体报道则采用 7 月 16 日。
Grok 4.6 必须守住的成本基线
Grok 4.5 的缓存输入价格是每百万 tokens $0.30,相比 $2.00 的常规输入价低 85%。对于会反复重放长系统提示词的 agent 循环而言,这才是关键杠杆。按 Artificial Analysis 自己的方法论,在缓存命中、未缓存输入和输出按 7:2:1 混合的假设下,其报告的综合价格为每百万 tokens $1.35。
SpaceXAI 能否在 2T 参数规模下维持这些价格,将决定上文那项帕累托前沿主张能否经受住自家继任者的检验。当然,基准得分、延迟和上下文窗口也同样会改变这条线,而 4.6 的这些数据目前都还未知。
“2T 还能保持 Grok 4.5 速度”为何并不简单
若按字面理解,这项约束并不算激进。Grok 4.5 的生成速度本就低于同价位中位数,首 token 时间也接近中位数的三倍。在 2T 规模上维持这一水平,意味着延续“慢但便宜”的定位,并非冲击速度纪录。
但放在竞争目标下看,难度会更高,只是参数规模的表面差距并没有看上去那么决定性。Moonshot 将 Kimi K3 定义为总参数 2.8T 的稀疏 mixture-of-experts 架构,每个 token 从 896 个专家中激活 16 个。因此,它的推理成本主要取决于活跃部分,而不是完整的 2.8T。SpaceXAI 尚未说明 Grok 4.6 的 2T 是稠密还是稀疏设计,而这恰恰决定了两个参数数字是否具备可比性。K3 还标注了 1M-token 上下文和开放权重,价格为每百万 tokens 输入 $3、输出 $15;相比之下,Grok 4.5 为 500K、闭源权重及 $2/$6。
以上两方面都还没有实测结果。SpaceXAI 和其他任何机构均未对 Grok 4.6 做过基准测试。
Grok 4.6 真正上线时,如何第一时间确认
按以下顺序检查文档和实时接口:
1. docs.x.ai/developers/models 出现 grok-4.6 条目,并列明独立的上下文窗口与价格。2. API 模型列表返回新 ID。 一条请求即可确认:
curl https://api.x.ai/v1/models \
-H "Authorization: Bearer $XAI_API_KEY" | grep grok-4.6
返回该 ID 只能证明模型存在,并不代表你的账户已获得访问权限。因此,在将其加入路由前,仍应使用自己的 key 检查速率限制和价格。
3. SpaceXAI 发布模型卡,提供基准测试数据。厂商基准测试只能作为起点,调整路由策略前仍应等待第三方评测。
API 之外的分发渠道尚未公布。SpaceXAI 的公开套餐覆盖免费层、SuperGrok、Business 和 Enterprise。根据 4.5 的推出方式推测,Grok 4.6 可能会与 API 一同进入这些渠道,但这只是预期,并非 SpaceXAI 的承诺。
生产环境的路由决策可以暂缓:Grok 4.5 仍是 SpaceXAI 价格和上下文窗口均已明确的旗舰模型,Musk 自己的图表也将其与 Claude Opus 5 一同放在成本与得分的前沿位置。规划决策则是另一回事。如果你正在为 Q4 推理成本做预算,或在协商合同,那么一款预计于 8 月初发布、参数规模 2T 但价格未知的模型,是值得保留的变量。毕竟,“两周”也是 Musk 为自己定下的时间表。
常见问题
Grok 4.6 什么时候发布?
尚无正式发布日期。Musk 于 2026 年 7 月 24 日表示,Grok 4.6 约两周后推出,时间大约在 8 月 7 日;Grok 4.7 则大约再过两周。SpaceXAI 尚未在其自有渠道公布发布日期。
Grok 4.6 有多少参数?
根据 Musk 2026 年 7 月 18 日的说法,总参数约为 2 万亿。Grok 4.5 基于 V9 foundation,参数为 1.5T。Grok 4.6 是稠密模型还是 mixture-of-experts,以及每个 token 会激活多少参数,均未披露。
Grok 4.6 API 会怎么收费?
尚未公布。Grok 4.5 在上下文低于 200K 时,每百万输入 tokens 为 $2.00、每百万输出 tokens 为 $6.00;超过该门槛后价格翻倍,缓存输入为 $0.30。在 SpaceXAI 公布实际价格前,这些费率可作为合理的规划基线。
Grok 4.6 会比 Kimi K3 更强吗?
目前尚未经过任何机构测试。Musk 表示,这款 2T 模型“might be able to exceed Kimi”,同时速度和 token 效率接近 Grok 4.5;他没有特别点名 K3。Moonshot 标注 K3 的总参数为 2.8T,每个 token 激活 896 个专家中的 16 个。SpaceXAI 尚未披露 Grok 4.6 架构,因此两者的参数规模目前无法直接比较。
Grok 4.6 会登陆 Android 和 iOS 吗?
尚未公布。Grok 应用当前承载 SpaceXAI 的现有模型,因此模型发布后进入应用是预期路径,但没有明确日期。不同地区的上线时间则是另一变量:据报道,截至 2026 年 7 月 13 日,Grok 4.5 在欧盟的推出仍在等待中;SpaceXAI 尚未说明 4.6 是否会在首日全球上线。
Grok 是由 xAI 还是 SpaceXAI 开发的?
两者指向同一家公司。它于 2023 年以 xAI 名义成立,2026 年并入 SpaceX 后改用 SpaceXAI 品牌。Grok 4.6 是一款 SpaceXAI 模型。x.ai 域名和 grok-* 模型 ID 均未更名。
目前最新的 Grok 模型是什么?
是 Grok 4.5。它于 2026 年 7 月发布,截至 7 月 27 日在 SpaceXAI 文档中标记为 Latest。该模型提供 500K 上下文窗口、可配置推理,以及文本和图像输入。
延伸阅读
*价格和模型可用性已于 2026 年 7 月 27 日根据 SpaceXAI 文档核验。*
