AIREITER

Mistral Large 4 API 价格:预览版到底提供了什么

最后更新: 2026-10-06 18:54:41

百万级上下文窗口,加上每百万输入 Token 仅 0.68 美元的价格,让 Mistral Large 4 这款万亿参数模型显得格外便宜。但它目前仍只是公开预览版:折扣何时结束尚无明确说法,实际网关限制也未必等同于官方规格,未来开放权重的许可证更是尚未公布。

一分钟看懂是否值得用

如果你需要一款低成本、支持超长上下文的 API,用来处理文档、代码仓库或调用工具的工作流,现在可以测试 Mistral Large 4。但现阶段不适合把它当成稳定的本地部署替代方案,也不能仅凭发布时的数字,就认定它已经是编程任务的最佳选择。

你的需求建议
通过 API 测试长文档或大型代码库现在就试,同时统计缓存命中率和输出成本
需要长期且可预测的价格等待,或按更高价格做预算:输入 1.36 美元、输出 4.18 美元
需要私有化部署等待权重、许可证、量化方案和部署指南
需要最高的编程得分不要只看发布时的数字做决定;用自己的任务跑一套相同的测试

这次要做的是公开预览版 API 的选型判断,而不是给最终模型定论。Mistral 于 2026 年 10 月 6 日宣布推出预览版,公开资料称模型权重计划在 10 月底发布。(Mistral 公告)

10 月 6 日实际能用到什么

Mistral Large 4 目前以公开预览版 API 的形式,通过 Mistral Studio 提供。Mistral 将它描述为原生多模态混合专家模型,总参数量为 1.05 万亿,每个 Token 激活 490 亿参数。官方公告还列出了函数调用、结构化输出、文档问答、批处理、智能体和内置工具等能力。

在 OpenRouter 上也已经可以看到 mistralai/mistral-large-4-0,因此 OpenRouter 的访问不再只是发布当天的传闻。不过,不同路由的限制、延迟、计费方式和故障转移策略可能并不相同。

API 已经上线,但可下载权重和最终许可证尚未发布。在 Mistral 公布模型卡片和具体条款之前,不要把“开放权重”理解成不受限制的商业开源。

为什么价格会出现两套数字

Mistral 的模型文档目前列出的预览版价格相当有吸引力:

Token 类型预览版价格发布材料中列出的预览结束后可能价格
输入每百万 Token 0.68 美元每百万 Token 1.36 美元
缓存输入每百万 Token 0.07 美元每百万 Token 0.14 美元
输出每百万 Token 2.09 美元每百万 Token 4.18 美元

Vercel 的网关页面以及其他模型访问页面,将较低的价格标为预览期 50% 折扣,但没有说明结束时间。因此,0.68 美元和 2.09 美元应被视为当前价格,而不是永久有效的合同价格。

假设一次工作负载包含 500,000 个未缓存输入 Token 和 100,000 个输出 Token,预览期账单约为 0.55 美元:输入费用 0.34 美元,输出费用 0.209 美元。如果输入内容命中缓存,费用约为 0.244 美元:缓存输入 0.035 美元,加上输出 0.209 美元。在把生产流量迁移过去之前,应同时评估缓存复用率、输出量,以及这项折扣能持续多久。

上下文和能力取决于你走哪条路由

Mistral 的模型文档给出了 100 万 Token 的上下文窗口。但这是模型层面的规格,并不意味着每个网关都会开放相同的上限。

Vercel AI Gateway 页面目前显示,其 Mistral 提供商支持 524K 的共享上下文窗口,最大输出为 262K。页面还报告了 0.9 秒的 P50 首 Token 延迟、每秒 38 个 Token,以及根据网关流量统计出的 74% 缓存命中率。

Mistral Large 4 网关价格和提供商指标

这些是特定路由的数字,不是模型在所有场景下都能保证的统一指标。该页面记录了图像输入、工具调用、兼容 OpenAI 的 Chat Completions 和 Responses API,以及兼容 Anthropic 的 Messages 接口;它使用的网关 ID 是 mistral/mistral-large-4,与 OpenRouter 带提供商标识的 ID 不同。

在进行集成时,应逐项确认目标端点的共享上下文、输出上限、图像与 Token 的计费方式、工具行为、缓存策略、提供商路由和故障转移规则。百万 Token 的宣传规格可以帮助你做初筛,但不足以直接用于应用容量规划。

基准测试能说明什么,不能说明什么

TechsCurrent 的发布分析引用了 Mistral 公布的数据:DeepSWE v1.1 得分 61.7%,Terminal-Bench 4 得分 28.3%,AutomationBench 得分 59.9%。CellCog 的发布对比则称,DeepSeek V4.1 Flash 在 DeepSWE 上为 74.2,Mistral Large 4 为 61.7;同时,Mistral 在 AutomationBench 上的成绩高于对比表中的其他项目。这些只能作为厂商数据或跨来源信号,不能视为来自同一标准化排行榜的结果。

在把模型用于生产级智能体之前,建议先跑一套固定评测:

  1. 为 Mistral Large 4 和当前模型使用相同的代码仓库、提示词、工具和超时时间。
  2. 统计任务完成率、工具参数错误、重试次数、延迟、输出 Token 数和成本。
  3. 加入长上下文检索案例,分别测试答案出现在输入中部和接近末尾的情况。
  4. 分别使用缓存上下文和未缓存上下文重复测试。
  5. 将预览版结果与未来权重发布后的结果分开记录。

哪些团队现在适合用

需要反复发送大量上下文的 API 优先团队:现在就可以测试 Mistral Large 4。当智能体反复发送同一段策略、代码仓库或文档前缀时,每百万缓存输入 Token 仅 0.07 美元的价格可能很有价值。不过,鉴于更高价格仍有可能生效,实验阶段应设置明确的消费上限。

正在构建图像文档工作流的团队:应在计划部署的具体路由上测试图像输入和文档提取能力。模型支持图像输入,但不同路由的文件限制和计费细节仍需单独确认。

编程智能体团队:把它当作候选模型,而不是默认赢家。现有基准证据并不一致,实际可靠性还取决于工具调用、重试次数和任务完成率。

重视隐私或计划自托管的团队:等待权重和许可证。每个 Token 激活 490 亿参数,并不意味着完整检查点很小;整个模型仍需要存储和提供服务。硬件需求、量化方案、吞吐量和再分发权利目前都没有定论。

Mistral Large 4 API 常见问题

Mistral Large 4 现在已经开源了吗?

还没有。模型发布时,最终许可证和可下载权重都尚未提供。Mistral 计划在 2026 年 10 月底前发布权重,但“开放权重”本身并不能说明商业使用或再分发权利。

0.68 美元的价格是永久的吗?

没有公布结束时间。测试阶段可以按当前每百万输入 Token 0.68 美元、输出 Token 2.09 美元来计算,同时也要按照 1.36 美元和 4.18 美元做好预算模型。

上下文窗口到底是 1M 还是 524K?

Mistral 将模型上下文标为 1M Token;Vercel 则为其网关路由列出 524K 的共享上下文。最终应以你要调用的提供商和 API 格式所支持的限制为准。

它已经接入 OpenRouter 了吗?

是的,OpenRouter 目前列出了 mistralai/mistral-large-4-0。不过,预览版的路由可能调整,正式部署前应再次查看实时页面。

它能处理图像和工具调用吗?

官方文档和网关文档都介绍了图像输入和工具调用。你仍需要在选定的路由上测试请求格式、图像限制、Token 计费方式,以及工具调用格式错误时的行为。

权重发布后,我应该自托管吗?

不能直接这么决定。应先确认许可证、检查点格式、量化选项、内存需求、吞吐量数据,以及官方或参考部署方案。

下一步该怎么测

在接入真实流量前,先建立一套包含 20 个任务的评测集:5 个长上下文检索任务、5 个代码修改任务、5 个图像或文档问答任务,以及 5 个工具调用任务。记录成功率、重试次数、首 Token 延迟、总延迟、输入/缓存/输出 Token 数,以及每个已完成任务的实际成本。

来源:Mistral 模型文档、Mistral 公告、Vercel AI Gateway、OpenRouter 模型页面、TechsCurrent、CellCog。