AIREITER

Step 5 Preview API 价格与状态(2026 年 9 月)

最后更新: 2026-09-20 07:31:30

如果只看价格,Step 5 Preview 似乎非常划算:据报 Artificial Analysis 得分达到 44,但真正的采购决策远不止比较 Token 单价。StepFun 已经宣布这款模型并提供了 API 接入路径,可目前公开文档中仍看不到完整的模型页面、计费说明或生产环境服务条款。在这些信息明确之前,更适合把它当作试点对象,而不是默认 API 端点。

“可用”究竟指什么,答案并不一样

Step 5 Preview 已经不只是传闻。StepFun 官方账号于 2026 年 9 月 20 日宣布了这款模型,并表示计划在 10 月 15 日开放权重。不过,在 StepFun 公开平台页面中进行 Google 搜索时,仍主要看到通用门户和 Step 3.7 文档,没有找到清晰收录的 step-5-preview 说明。两者之间的区别很关键:官方宣布可以访问,不等于已经拥有文档完善、面向所有用户开放的生产级 API。

问题当前答案可信度
StepFun 是否已经宣布这款模型?是,通过官方 @StepFun_ai 公告宣布
是否已有 API 模型 ID?step-5-preview中;请在自己的账户中核实
是否已有公开 Token 价格?每 1M Token 输入 $1 / 输出 $2.70中;来自第三方测量或目录信息
现在能否下载权重?未找到公开权重截至 9 月 20 日为高
是否承诺开放权重?StepFun 公告称为 10 月 15 日承诺本身可信度高;实际交付仍待未来确认

StepFun 已确认什么,还有哪些信息没有验证

官方公告称,Step 5 Preview 是一款拥有 600B 参数、激活参数为 27B 的稀疏 MoE 模型,支持 1M Token 上下文窗口、文本和视觉输入,并重点面向 Agent 任务、软件工程和金融场景。不过,这些属于厂商声明,并不能独立证明所有宣传中的限制和能力都已在每条 API 路线上开放。

截至 2026 年 9 月 20 日,官方平台搜索没有返回专门的 Step 5 价格页面或 API 文档。这意味着速率限制、最大输出长度、函数调用、缓存计费和区域可用性等实际运营问题,目前都缺少一手来源。不要把第三方模型目录中的信息直接复制进生产配置,然后当成 StepFun 官方文档。

@xueyu1125 发布的一篇真实用户体验称,在简单 SVG 动画测试中,实际表现似乎不如 Artificial Analysis 的评分,尤其是在 3D 和推理任务上(来源)。这只是早期个人体验,并非基准测试结果,但它提醒我们:综合评分不能代表模型在所有任务上的能力。

“目前的简单使用体验是对不起Artifical Analysis的44 Index分数,至少在3D和思维能力这方面达不到GLM-5.3-Flash🤣” — @xueyu1125,分享早期上手测试结果(X

Step 5 Preview API 价格:可以参考,但别盲信

目前最常见的 Step 5 Preview API 报价是:每 1 million input tokens $1.00,每 1 million output tokens $2.70。Artificial Analysis 还给出了 95% 的缓存折扣,并按 70% 缓存命中、20% 输入、10% 输出这一特定比例,估算出每百万 Token $0.51 的混合成本。但这个混合价格建立在特定假设上,并不是所有账单都会采用的统一费率。

用量类型据报价格上线前需要核实
输入$1.00 / 1M tokens价格是否来自官方,以及是否因区域而异
输出$2.70 / 1M tokens推理 Token 是否计入输出
缓存命中按 95% 折扣计算约为 $0.05 / 1M缓存适用条件和写入缓存的规则
示例:100k 输入 + 20k 输出约 $0.154税费、最低消费、重试,以及隐藏的推理用量

基础计算并不复杂:(input tokens ÷ 1,000,000 × 1.00) + (output tokens ÷ 1,000,000 × 2.70)。因此,一次包含 100,000 个输入 Token 和 20,000 个输出 Token 的请求,在不考虑折扣或供应商额外收费的情况下,成本约为 $0.10 + $0.054 = $0.154

真正需要留意的是输出长度。Artificial Analysis 在 Intelligence Index 评测中统计到约 160 million output tokens,而可比模型的中位数为 92 million。即使输出单价较低,如果模型在推理或回答过程中消耗更多 Token,最终账单仍可能更高;一位早期用户还提醒,思考 Token 可能会被计入输出费用(来源)。

性能信号很强,但并不均衡

Artificial Analysis 给出的数据包括:44 Intelligence Index score、约 100 output tokens per second,以及 2.96 seconds to the first answer token。BenchLeader 则分别列出 1M-token context、每秒 100 个 Token 的输出速度和 23 秒的首个答案耗时。不同平台对延迟的定义并不一致,因此不能把仪表盘上的原始数字简单视为同一指标。

指标报告结果对采购方的意义
Intelligence Index44综合结果很强,但不代表每类任务都能达到同样水平
输出速度99.8 tokens/second开始生成后具备竞争力
首个答案 TokenArtificial Analysis 记录为 2.96 秒确认测量定义以及你所使用的访问线路
上下文窗口1M tokens确认实际部署的 API 限制,不要只看模型资料页
评测输出量160M tokens为较长输出和推理用量预留预算
长上下文结果88.3%,在 BenchLeader 榜单中排名 #2信号积极,但仍需结合具体基准设置判断

从基准测试来看,它的表现并非全面强势。BenchLeader 给出的 Step 5 Preview 58.9% SciCode score 排名 #8;但在 MMMU-Pro 上排名为 #64,并将多模态能力列为其综合表现最弱的类别。Artificial Analysis 报告称其支持图像输入,而 CloudPrice 的目录则将图像输入及多项能力标记为不可用。在 StepFun 发布明确的 API 能力矩阵之前,应用设计应按最保守的功能集合来假设。

先做可控试点,不要直接迁移生产环境

现有证据足以支持一次范围受控的评估,但还不足以支持无条件切换。建议先用一笔小额预算测试,让 API 自己证明那些第三方页面无法确认的关键属性。

  1. 在官方账户中确认端点和模型 ID。 使用 step-5-preview 发送一条无害请求,然后记录返回的模型名称、区域、状态码和速率限制响应头。
  2. 记录账单字段。 分别核对输入、输出、缓存和推理 Token 的用量。不要只根据公开的 $1/$2.70 数字推算最终账单。
  3. 分阶段测试长上下文。 先从 50K Token 开始,再测试 100K、350K;只有前一次请求成功后,才继续提高长度。记录首个 Token 的耗时、截断情况和报错行为。
  4. 把工具调用和文本质量分开测试。 检查函数名称、参数有效性、重试机制,以及模型在修改目标状态前是否会先读取目标状态。Intelligence Index 分数并不能证明工具调用可靠。
  5. 保留备用模型。 将失败、超时或格式错误的工具调用转发给技术栈中已经支持的模型。面向客户的工作流不应只依赖一个 Preview 端点。

如果采用多供应商架构,统一 API 网关可以让故障转移更容易实现,但这并不能替代对 StepFun 自身计费方式和限制的核实。真正需要做的是隔离风险:用预算、日志和经过测试的备用线路,把尚未验证的模型控制在可管理的范围内。

Step 5 Preview API 常见问题

Step 5 Preview 是正式发布了吗?

StepFun 已于 2026 年 9 月 20 日正式宣布 Step 5 Preview。至于公开文档和广泛的生产环境可用性,目前仍不够明确,因此“已宣布”不能等同于“文档完整且稳定可用”。

Step 5 Preview 的 API 模型 ID 是什么?

早期信息显示模型 ID 为 step-5-preview。在将其硬编码之前,请先在 StepFun 官方账户或 API 响应中确认确切标识符。

Step 5 Preview 多少钱?

第三方目录和 Artificial Analysis 报告的价格是每 1M input tokens $1.00、每 1M output tokens $2.70。请确认推理 Token、缓存写入、重试请求和区域费用是否采用不同的计费方式。

Step 5 Preview 现在开源了吗?

截至 2026 年 9 月 20 日,在已检查的来源中没有发现公开权重。StepFun 公告称计划于 10 月 15 日开放权重,但这属于未来承诺,并不代表当前已经可以获取。

它支持图像和 1M Token 上下文吗?

StepFun 公告和 Artificial Analysis 都报告了图像输入与 1M Token 上下文支持。但由于不同目录中的信息存在冲突,开发者仍应针对实际 API 线路进行测试,不能默认所有宣传能力都已在每个入口开放。

所以,决策其实很明确,尽管模型本身仍有不少未知:如果它的价格性能比符合你的工作负载,可以用小规模、可观测的方式进行试点;但在 StepFun 发布开发者安全运营所需的模型页面、计费规则、能力清单和限制之前,不要让 Step 5 Preview 成为生产环境依赖。

Step 5 Preview API 评测期间核查的 StepFun 开放平台状态