A StepFun confirma o acesso via API, mas os preços públicos mais claros vêm de catálogos de terceiros — não de uma tabela completa publicada pela própria empresa. Por isso, trate o Step 5 Preview como um piloto controlado, e não como modelo padrão para produção.
Preços da API do Step 5 Preview em resumo
O Vercel AI Gateway e a EmpirioLabs listam o Step 5 Preview por US$ 1,00 a cada 1 milhão de tokens de entrada e US$ 2,70 a cada 1 milhão de tokens de saída. A Artificial Analysis, por sua vez, reporta uma estimativa combinada de US$ 0,51 por 1M, baseada em uma composição de uso informada. São valores de referência do mercado, não uma tabela numérica publicada no anúncio da StepFun citado aqui.
| Item | Valor atualmente reportado | Status da evidência |
|---|---|---|
| Tokens de entrada | US$ 1,00 / 1M | Vercel e EmpirioLabs; verifique sua rota |
| Tokens de saída | US$ 2,70 / 1M | Vercel e EmpirioLabs; confirme os detalhes da cobrança |
| Entrada em cache | US$ 0,05 / 1M | Catálogos dos provedores; confirme as regras de cache |
| Pesquisa opcional na web | US$ 0,013 / chamada | Apenas EmpirioLabs; verifique a cobrança da rota |
| Status do modelo | Preview | Confirmado pelas listagens dos provedores |
| Acesso à API | Disponível agora | Confirmado pela StepFun |
O que a StepFun confirma oficialmente
O anúncio oficial do Step 5 Preview confirma que o acesso via API já está disponível e informa separadamente 15 de outubro de 2026 como a data planejada para o lançamento dos pesos abertos. A empresa descreve um modelo esparso de mistura de especialistas, com 600 bilhões de parâmetros totais, 27 bilhões de parâmetros ativos, uma janela de contexto de 1 milhão de tokens e entradas de texto e visão voltadas a tarefas com agentes, engenharia de software e finanças. Essas são afirmações do fornecedor; cada rota pode não oferecer todos os recursos ou limites.
A Vercel fornece a camada de compatibilidade do gateway para as interfaces listadas no padrão OpenAI Chat Completions, Responses e no estilo Anthropic, usando stepfun/step-5-preview. A EmpirioLabs documenta seu próprio endpoint compatível com OpenAI, com step-5-preview, contexto de 1,02 milhão de tokens, 131.072 tokens de saída máxima, controles de raciocínio, saída estruturada e pesquisa opcional na web. Considere esses dados como detalhes de implementação específicos de cada endpoint.
Preços e ressalvas de cobrança da API do Step 5 Preview
Com base nos valores informados, estime o custo assim:
(input tokens / 1,000,000 × $1.00)
+ (output tokens / 1,000,000 × $2.70)
Uma solicitação com 100.000 tokens de entrada e 20.000 tokens de saída custaria cerca de US$ 0,154, antes de impostos, novas tentativas, margens do gateway ou uso não informado.
| Exemplo de solicitação | Entrada | Saída | Custo estimado dos tokens do modelo |
|---|---|---|---|
| Revisão curta de código | 60K | 4K | US$ 0,0708 |
| Análise de contexto longo | 100K | 20K | US$ 0,1540 |
| Execução de agente | 250K | 25K | US$ 0,3175 |
A entrada em cache é reportada a US$ 0,05/M, enquanto a EmpirioLabs cobra o raciocínio como saída e a pesquisa na web a US$ 0,013/chamada em seu endpoint. Confirme as três regras na rota que você pretende usar. Como a saída custa 2,7 vezes mais que a entrada, respostas longas ou intensivas em raciocínio podem concentrar a maior parte dos gastos.
A API pode ser usada em produção?
A API está oficialmente disponível, mas as evidências públicas ainda não permitem afirmar que o Step 5 Preview seja a escolha padrão para produção em qualquer tipo de carga. Ainda faltam informações sobre limites de taxa específicos de cada rota, termos de SLA, garantias de compatibilidade e regras completas de cobrança.
| Questão para produção | O que já está estabelecido publicamente | O que ainda precisa ser verificado |
|---|---|---|
| Posso fazer chamadas agora? | A StepFun diz que o acesso à API está disponível | Elegibilidade da conta, região e rota |
| Quanto custa? | Os catálogos reportam US$ 1/US$ 2,70 por 1M | Tabela de preços oficial e casos específicos de cobrança |
| Qual é o ID do modelo? | step-5-preview ou stepfun/step-5-preview | Identificador exato no seu endpoint |
| Qual é o tamanho do contexto? | Cerca de 1M de tokens aparece repetidamente nas listagens | Limite real da solicitação e comportamento de truncamento |
| Há suporte a ferramentas ou JSON? | Os catálogos informam que há suporte | Comportamento e tratamento de erros no nível da rota |
| O modelo é estável? | Ele continua identificado como Preview | Compatibilidade, SLA e política de mudanças |
A Artificial Analysis reporta 99,8 tokens por segundo, 23,01 segundos até o primeiro token da resposta e uma estimativa combinada de US$ 0,51 por 1M, considerando sua composição de 7:2:1 entre acertos de cache, entrada e saída. O serviço acompanha apenas um provedor; portanto, não trate esse valor combinado como um preço universal.
Quem deve usar o Step 5 Preview agora
O Step 5 Preview faz sentido para equipes capazes de limitar os riscos de um modelo em prévia e que tenham um motivo mensurável para testá-lo.
Use em pilotos delimitados e com muito contexto
Análise de documentos extensos, revisão de código em nível de repositório, síntese de pesquisas e experimentos internos com agentes são bons pontos de partida. Esses cenários podem se beneficiar de uma janela de contexto ampla e do baixo preço de entrada reportado, sem deixar de ser simples repetir os testes com um modelo alternativo.
Use quando o custo importar mais que a maturidade do ecossistema
Os valores reportados de US$ 1/US$ 2,70 são atraentes para prompts grandes, contexto reutilizado e respostas com limite definido. Estabeleça um orçamento máximo de tokens de saída, em vez de permitir que cada solicitação consuma todo o limite de raciocínio do modelo.
Limitações de um endpoint em prévia
Evite usá-lo como único modelo para pagamentos, alterações de conta, decisões de conformidade ou chamadas irreversíveis de ferramentas. O anúncio oficial menciona entrada de visão, mas os catálogos divergem em alguns recursos específicos das rotas. Por isso, teste separadamente o processamento de imagens, os argumentos de chamadas de função, a saída estruturada, as novas tentativas e o comportamento em caso de timeout.
Checklist de verificação antes de colocar em produção
- Confirme o endpoint e o ID do modelo. Envie uma solicitação inofensiva usando o identificador exato exibido na conta do provedor. Registre o nome do modelo retornado e a região.
- Guarde os objetos de uso e as faturas. Compare os campos de entrada, saída, cache e tokens de raciocínio. Não deduza a cobrança a partir de uma estimativa combinada.
- Teste o contexto progressivamente. Faça testes com entradas de 50K, 100K e 350K tokens antes de tentar prompts maiores. Registre latência, truncamento e comportamento diante de erros.
- Limite os tokens de saída. A saída custa US$ 2,70/M no valor reportado, e o raciocínio pode ser cobrado como saída em algumas rotas.
- Teste chamadas de ferramentas e mantenha um modelo alternativo. Verifique a recuperação de chamadas malformadas, timeouts, tarefas sensíveis a políticas e o comportamento das novas tentativas.
Perguntas frequentes sobre a API do Step 5 Preview
Qual é o preço oficial do Step 5 Preview?
Consulte a tabela de preços acima: Vercel e EmpirioLabs reportam US$ 1 por 1M de tokens de entrada e US$ 2,70 por 1M de tokens de saída, mas confirme o valor e os campos de cobrança na rota que você utiliza.
Qual ID de modelo os desenvolvedores devem testar?
Os IDs mais comuns são step-5-preview e stepfun/step-5-preview, dependendo do provedor ou gateway. Confira o identificador exato na sua conta, em vez de fixar no código um valor de catálogo.
Tokens de raciocínio e tokens em cache são cobrados separadamente?
A EmpirioLabs informa que os tokens de raciocínio contam como tokens de saída e lista a entrada em cache a US$ 0,05/M. Confirme as duas regras nos seus próprios registros de uso antes de projetar os custos.