如果只看价格,Step 5 Preview 似乎非常划算:据报 Artificial Analysis 得分达到 44,但真正的采购决策远不止比较 Token 单价。StepFun 已经宣布这款模型并提供了 API 接入路径,可目前公开文档中仍看不到完整的模型页面、计费说明或生产环境服务条款。在这些信息明确之前,更适合把它当作试点对象,而不是默认 API 端点。
“可用”究竟指什么,答案并不一样
Step 5 Preview 已经不只是传闻。StepFun 官方账号于 2026 年 9 月 20 日宣布了这款模型,并表示计划在 10 月 15 日开放权重。不过,在 StepFun 公开平台页面中进行 Google 搜索时,仍主要看到通用门户和 Step 3.7 文档,没有找到清晰收录的 step-5-preview 说明。两者之间的区别很关键:官方宣布可以访问,不等于已经拥有文档完善、面向所有用户开放的生产级 API。
| 问题 | 当前答案 | 可信度 |
|---|---|---|
| StepFun 是否已经宣布这款模型? | 是,通过官方 @StepFun_ai 公告宣布 | 高 |
| 是否已有 API 模型 ID? | step-5-preview | 中;请在自己的账户中核实 |
| 是否已有公开 Token 价格? | 每 1M Token 输入 $1 / 输出 $2.70 | 中;来自第三方测量或目录信息 |
| 现在能否下载权重? | 未找到公开权重 | 截至 9 月 20 日为高 |
| 是否承诺开放权重? | StepFun 公告称为 10 月 15 日 | 承诺本身可信度高;实际交付仍待未来确认 |
StepFun 已确认什么,还有哪些信息没有验证
官方公告称,Step 5 Preview 是一款拥有 600B 参数、激活参数为 27B 的稀疏 MoE 模型,支持 1M Token 上下文窗口、文本和视觉输入,并重点面向 Agent 任务、软件工程和金融场景。不过,这些属于厂商声明,并不能独立证明所有宣传中的限制和能力都已在每条 API 路线上开放。
截至 2026 年 9 月 20 日,官方平台搜索没有返回专门的 Step 5 价格页面或 API 文档。这意味着速率限制、最大输出长度、函数调用、缓存计费和区域可用性等实际运营问题,目前都缺少一手来源。不要把第三方模型目录中的信息直接复制进生产配置,然后当成 StepFun 官方文档。
@xueyu1125 发布的一篇真实用户体验称,在简单 SVG 动画测试中,实际表现似乎不如 Artificial Analysis 的评分,尤其是在 3D 和推理任务上(来源)。这只是早期个人体验,并非基准测试结果,但它提醒我们:综合评分不能代表模型在所有任务上的能力。
“目前的简单使用体验是对不起Artifical Analysis的44 Index分数,至少在3D和思维能力这方面达不到GLM-5.3-Flash🤣” — @xueyu1125,分享早期上手测试结果(X)
Step 5 Preview API 价格:可以参考,但别盲信
目前最常见的 Step 5 Preview API 报价是:每 1 million input tokens $1.00,每 1 million output tokens $2.70。Artificial Analysis 还给出了 95% 的缓存折扣,并按 70% 缓存命中、20% 输入、10% 输出这一特定比例,估算出每百万 Token $0.51 的混合成本。但这个混合价格建立在特定假设上,并不是所有账单都会采用的统一费率。
| 用量类型 | 据报价格 | 上线前需要核实 |
|---|---|---|
| 输入 | $1.00 / 1M tokens | 价格是否来自官方,以及是否因区域而异 |
| 输出 | $2.70 / 1M tokens | 推理 Token 是否计入输出 |
| 缓存命中 | 按 95% 折扣计算约为 $0.05 / 1M | 缓存适用条件和写入缓存的规则 |
| 示例:100k 输入 + 20k 输出 | 约 $0.154 | 税费、最低消费、重试,以及隐藏的推理用量 |
基础计算并不复杂:(input tokens ÷ 1,000,000 × 1.00) + (output tokens ÷ 1,000,000 × 2.70)。因此,一次包含 100,000 个输入 Token 和 20,000 个输出 Token 的请求,在不考虑折扣或供应商额外收费的情况下,成本约为 $0.10 + $0.054 = $0.154。
真正需要留意的是输出长度。Artificial Analysis 在 Intelligence Index 评测中统计到约 160 million output tokens,而可比模型的中位数为 92 million。即使输出单价较低,如果模型在推理或回答过程中消耗更多 Token,最终账单仍可能更高;一位早期用户还提醒,思考 Token 可能会被计入输出费用(来源)。
性能信号很强,但并不均衡
Artificial Analysis 给出的数据包括:44 Intelligence Index score、约 100 output tokens per second,以及 2.96 seconds to the first answer token。BenchLeader 则分别列出 1M-token context、每秒 100 个 Token 的输出速度和 23 秒的首个答案耗时。不同平台对延迟的定义并不一致,因此不能把仪表盘上的原始数字简单视为同一指标。
| 指标 | 报告结果 | 对采购方的意义 |
|---|---|---|
| Intelligence Index | 44 | 综合结果很强,但不代表每类任务都能达到同样水平 |
| 输出速度 | 99.8 tokens/second | 开始生成后具备竞争力 |
| 首个答案 Token | Artificial Analysis 记录为 2.96 秒 | 确认测量定义以及你所使用的访问线路 |
| 上下文窗口 | 1M tokens | 确认实际部署的 API 限制,不要只看模型资料页 |
| 评测输出量 | 160M tokens | 为较长输出和推理用量预留预算 |
| 长上下文结果 | 88.3%,在 BenchLeader 榜单中排名 #2 | 信号积极,但仍需结合具体基准设置判断 |
从基准测试来看,它的表现并非全面强势。BenchLeader 给出的 Step 5 Preview 58.9% SciCode score 排名 #8;但在 MMMU-Pro 上排名为 #64,并将多模态能力列为其综合表现最弱的类别。Artificial Analysis 报告称其支持图像输入,而 CloudPrice 的目录则将图像输入及多项能力标记为不可用。在 StepFun 发布明确的 API 能力矩阵之前,应用设计应按最保守的功能集合来假设。
先做可控试点,不要直接迁移生产环境
现有证据足以支持一次范围受控的评估,但还不足以支持无条件切换。建议先用一笔小额预算测试,让 API 自己证明那些第三方页面无法确认的关键属性。
- 在官方账户中确认端点和模型 ID。 使用
step-5-preview发送一条无害请求,然后记录返回的模型名称、区域、状态码和速率限制响应头。 - 记录账单字段。 分别核对输入、输出、缓存和推理 Token 的用量。不要只根据公开的
$1/$2.70数字推算最终账单。 - 分阶段测试长上下文。 先从 50K Token 开始,再测试 100K、350K;只有前一次请求成功后,才继续提高长度。记录首个 Token 的耗时、截断情况和报错行为。
- 把工具调用和文本质量分开测试。 检查函数名称、参数有效性、重试机制,以及模型在修改目标状态前是否会先读取目标状态。Intelligence Index 分数并不能证明工具调用可靠。
- 保留备用模型。 将失败、超时或格式错误的工具调用转发给技术栈中已经支持的模型。面向客户的工作流不应只依赖一个 Preview 端点。
如果采用多供应商架构,统一 API 网关可以让故障转移更容易实现,但这并不能替代对 StepFun 自身计费方式和限制的核实。真正需要做的是隔离风险:用预算、日志和经过测试的备用线路,把尚未验证的模型控制在可管理的范围内。
Step 5 Preview API 常见问题
Step 5 Preview 是正式发布了吗?
StepFun 已于 2026 年 9 月 20 日正式宣布 Step 5 Preview。至于公开文档和广泛的生产环境可用性,目前仍不够明确,因此“已宣布”不能等同于“文档完整且稳定可用”。
Step 5 Preview 的 API 模型 ID 是什么?
早期信息显示模型 ID 为 step-5-preview。在将其硬编码之前,请先在 StepFun 官方账户或 API 响应中确认确切标识符。
Step 5 Preview 多少钱?
第三方目录和 Artificial Analysis 报告的价格是每 1M input tokens $1.00、每 1M output tokens $2.70。请确认推理 Token、缓存写入、重试请求和区域费用是否采用不同的计费方式。
Step 5 Preview 现在开源了吗?
截至 2026 年 9 月 20 日,在已检查的来源中没有发现公开权重。StepFun 公告称计划于 10 月 15 日开放权重,但这属于未来承诺,并不代表当前已经可以获取。
它支持图像和 1M Token 上下文吗?
StepFun 公告和 Artificial Analysis 都报告了图像输入与 1M Token 上下文支持。但由于不同目录中的信息存在冲突,开发者仍应针对实际 API 线路进行测试,不能默认所有宣传能力都已在每个入口开放。
所以,决策其实很明确,尽管模型本身仍有不少未知:如果它的价格性能比符合你的工作负载,可以用小规模、可观测的方式进行试点;但在 StepFun 发布开发者安全运营所需的模型页面、计费规则、能力清单和限制之前,不要让 Step 5 Preview 成为生产环境依赖。
