StepFun 已确认 Step 5 Preview 支持 API 调用,但目前最清晰的公开价格来自第三方目录,而不是一份完整的官方价目表。更稳妥的做法是把它当作受控试用模型,而不是默认的生产环境模型。
Step 5 Preview API 价格一览
Vercel AI Gateway 和 EmpirioLabs 均列出了 Step 5 Preview 的价格:每 1 million input tokens 收费 $1.00,每 1 million output tokens 收费 $2.70。Artificial Analysis 则按照其声明的工作负载比例,给出了每 1M token 综合估算价 $0.51。这些数字可作为市场参考,但并不是 StepFun 在相关公告中公布的官方完整价目表。
| 项目 | 当前报告值 | 证据状态 |
|---|---|---|
| 输入 token | $1.00 / 1M | Vercel 和 EmpirioLabs;请确认所用路由 |
| 输出 token | $2.70 / 1M | Vercel 和 EmpirioLabs;请确认计费细则 |
| 缓存输入 | $0.05 / 1M | 供应商目录;请确认缓存规则 |
| 可选网页搜索 | $0.013 / call | 仅 EmpirioLabs 提供;请确认路由计费 |
| 模型状态 | Preview | 供应商列表已确认 |
| API 访问 | 目前可用 | StepFun 已确认 |
StepFun 官方确认了哪些信息
StepFun 的官方 Step 5 Preview 公告确认 API 已可用,同时将2026 年 10 月 15 日列为计划中的开放权重日期。公告介绍称,该模型采用稀疏混合专家架构,拥有600 billion total parameters、27 billion active parameters和1-million-token context window,支持文本与视觉输入,面向智能体任务、软件工程和金融场景。以上属于供应商声明,具体路由未必开放全部能力,也未必提供相同限制。
Vercel 为其列出的 OpenAI Chat Completions、Responses 和 Anthropic-style 接口提供网关兼容层,模型标识为 stepfun/step-5-preview。EmpirioLabs 则记录了自有的 OpenAI-compatible endpoint,使用 step-5-preview,并列出 1.02M-token context、131,072 maximum output tokens、推理控制、结构化输出和可选网页搜索。这些都应视为特定端点的实现细节。
Step 5 Preview API 定价与计费注意事项
按照目前报告的基础费率,可以用下面的公式估算成本:
(input tokens / 1,000,000 × $1.00)
+ (output tokens / 1,000,000 × $2.70)
如果一次请求包含100,000 input tokens和20,000 output tokens,那么在不计税费、重试、网关加价或其他未报告用量的情况下,成本约为$0.154。
| 请求示例 | 输入 | 输出 | 预估模型 token 成本 |
|---|---|---|---|
| 短代码审查 | 60K | 4K | $0.0708 |
| 长上下文分析 | 100K | 20K | $0.1540 |
| 智能体运行 | 250K | 25K | $0.3175 |
目前报告的缓存输入价格为$0.05/M;在 EmpirioLabs 的端点上,推理按输出计费,网页搜索则为$0.013/call。请在实际使用的路由上分别确认这三项规则。由于输出价格是输入价格的2.7 倍,较长的回答或高强度推理很容易成为主要成本来源。
这个 API 能用于生产环境吗?
API 确实已经正式开放,但现有公开证据还不足以证明 Step 5 Preview 适合所有工作负载,也不宜直接将其作为生产环境默认模型。目前仍缺少路由级速率限制、SLA 条款、兼容性保证和完整计费规则等关键信息。
| 生产环境问题 | 公开信息已确认 | 仍需验证 |
|---|---|---|
| 现在可以调用吗? | StepFun 表示 API 已可用 | 账户、地区和路由资格 |
| 具体费用是多少? | 目录报告为每 1M token $1/$2.70 | 官方价目表和计费边界情况 |
| 模型 ID 是什么? | step-5-preview 或 stepfun/step-5-preview | 你的端点使用的准确标识符 |
| 上下文有多大? | 多个来源反复列出约 1M token | 实际请求上限和截断行为 |
| 支持工具调用或 JSON 吗? | 目录报告支持 | 路由级行为和错误处理 |
| 稳定吗? | 目前仍标记为 Preview | 兼容性、SLA 和变更政策 |
Artificial Analysis 报告的指标包括每秒 99.8 tokens、首个回答 token 延迟23.01 秒,以及按照其 7:2:1 缓存命中/输入/输出比例计算的每 1M token 综合估算价 $0.51。由于它只跟踪一家供应商,不要把这个综合价格当成通用费率。
现在适合谁使用 Step 5 Preview
Step 5 Preview 更适合能够控制预览版风险,并且有明确测试目标的团队。
适合范围明确的高上下文试点
长文档分析、代码仓库级审查、研究资料综合,以及内部智能体实验,都是比较合适的起点。这些场景既能利用较大的上下文窗口和较低的报告输入价格,也方便与备用模型进行复现和对比。
适合更看重成本而非生态成熟度的场景
对于大规模提示词、重复上下文和输出受控的任务,目前报告的 $1/$2.70 费率颇具吸引力。建议设置最大输出预算,不要让每个请求都消耗模型完整的推理额度。
预览版端点的使用边界
不要把它作为支付、账户变更、合规决策或不可逆工具调用的唯一模型。官方公告提到支持视觉输入,但不同目录对部分路由能力的描述并不一致,因此应分别测试图像处理、函数调用参数、结构化输出、重试和超时行为。
上线前的验证清单
- 确认端点和模型 ID。 使用供应商账户中显示的准确标识符发送一条无害请求,并记录返回的模型名称和地区。
- 保存用量对象和账单。 对比输入、输出、缓存和推理 token 字段。不要根据综合估算价推断实际账单。
- 逐步测试上下文容量。 在尝试更大的提示词前,依次测试 50K、100K 和 350K-token 输入,并记录延迟、截断和错误行为。
- 限制输出 token。 按目前报告的费率,输出价格为 $2.70/M;部分路由可能会将推理按输出计费。
- 测试工具调用并保留备用模型。 检查错误调用恢复、超时、涉及策略限制的任务以及重试行为。
Step 5 Preview API 常见问题
Step 5 Preview 的官方价格是多少?
请参考上面的价格表:Vercel 和 EmpirioLabs 报告的价格为每 1M input tokens $1、每 1M output tokens $2.70,但仍应在实际使用的路由上确认费率和计费字段。
开发者应该测试哪个模型 ID?
不同供应商或网关通常会列出 step-5-preview 和 stepfun/step-5-preview 这两个 ID。请以账户中显示的准确标识符为准,不要直接硬编码目录里的值。
推理 token 和缓存 token 会单独计费吗?
EmpirioLabs 表示推理 token 按输出 token 计算,并将缓存输入价格列为$0.05/M。在进行成本预测前,请先通过自己的用量记录确认这两项规则。