AIREITER

Preços da API do Step 5 Preview: disponibilidade e uso em produção

Última Atualização: 2026-09-20 19:27:49

A StepFun confirma o acesso via API, mas os preços públicos mais claros vêm de catálogos de terceiros — não de uma tabela completa publicada pela própria empresa. Por isso, trate o Step 5 Preview como um piloto controlado, e não como modelo padrão para produção.

Preços da API do Step 5 Preview em resumo

O Vercel AI Gateway e a EmpirioLabs listam o Step 5 Preview por US$ 1,00 a cada 1 milhão de tokens de entrada e US$ 2,70 a cada 1 milhão de tokens de saída. A Artificial Analysis, por sua vez, reporta uma estimativa combinada de US$ 0,51 por 1M, baseada em uma composição de uso informada. São valores de referência do mercado, não uma tabela numérica publicada no anúncio da StepFun citado aqui.

ItemValor atualmente reportadoStatus da evidência
Tokens de entradaUS$ 1,00 / 1MVercel e EmpirioLabs; verifique sua rota
Tokens de saídaUS$ 2,70 / 1MVercel e EmpirioLabs; confirme os detalhes da cobrança
Entrada em cacheUS$ 0,05 / 1MCatálogos dos provedores; confirme as regras de cache
Pesquisa opcional na webUS$ 0,013 / chamadaApenas EmpirioLabs; verifique a cobrança da rota
Status do modeloPreviewConfirmado pelas listagens dos provedores
Acesso à APIDisponível agoraConfirmado pela StepFun

O que a StepFun confirma oficialmente

O anúncio oficial do Step 5 Preview confirma que o acesso via API já está disponível e informa separadamente 15 de outubro de 2026 como a data planejada para o lançamento dos pesos abertos. A empresa descreve um modelo esparso de mistura de especialistas, com 600 bilhões de parâmetros totais, 27 bilhões de parâmetros ativos, uma janela de contexto de 1 milhão de tokens e entradas de texto e visão voltadas a tarefas com agentes, engenharia de software e finanças. Essas são afirmações do fornecedor; cada rota pode não oferecer todos os recursos ou limites.

A Vercel fornece a camada de compatibilidade do gateway para as interfaces listadas no padrão OpenAI Chat Completions, Responses e no estilo Anthropic, usando stepfun/step-5-preview. A EmpirioLabs documenta seu próprio endpoint compatível com OpenAI, com step-5-preview, contexto de 1,02 milhão de tokens, 131.072 tokens de saída máxima, controles de raciocínio, saída estruturada e pesquisa opcional na web. Considere esses dados como detalhes de implementação específicos de cada endpoint.

Preços e ressalvas de cobrança da API do Step 5 Preview

Com base nos valores informados, estime o custo assim:

(input tokens / 1,000,000 × $1.00)
+ (output tokens / 1,000,000 × $2.70)

Uma solicitação com 100.000 tokens de entrada e 20.000 tokens de saída custaria cerca de US$ 0,154, antes de impostos, novas tentativas, margens do gateway ou uso não informado.

Exemplo de solicitaçãoEntradaSaídaCusto estimado dos tokens do modelo
Revisão curta de código60K4KUS$ 0,0708
Análise de contexto longo100K20KUS$ 0,1540
Execução de agente250K25KUS$ 0,3175

A entrada em cache é reportada a US$ 0,05/M, enquanto a EmpirioLabs cobra o raciocínio como saída e a pesquisa na web a US$ 0,013/chamada em seu endpoint. Confirme as três regras na rota que você pretende usar. Como a saída custa 2,7 vezes mais que a entrada, respostas longas ou intensivas em raciocínio podem concentrar a maior parte dos gastos.

A API pode ser usada em produção?

A API está oficialmente disponível, mas as evidências públicas ainda não permitem afirmar que o Step 5 Preview seja a escolha padrão para produção em qualquer tipo de carga. Ainda faltam informações sobre limites de taxa específicos de cada rota, termos de SLA, garantias de compatibilidade e regras completas de cobrança.

Questão para produçãoO que já está estabelecido publicamenteO que ainda precisa ser verificado
Posso fazer chamadas agora?A StepFun diz que o acesso à API está disponívelElegibilidade da conta, região e rota
Quanto custa?Os catálogos reportam US$ 1/US$ 2,70 por 1MTabela de preços oficial e casos específicos de cobrança
Qual é o ID do modelo?step-5-preview ou stepfun/step-5-previewIdentificador exato no seu endpoint
Qual é o tamanho do contexto?Cerca de 1M de tokens aparece repetidamente nas listagensLimite real da solicitação e comportamento de truncamento
Há suporte a ferramentas ou JSON?Os catálogos informam que há suporteComportamento e tratamento de erros no nível da rota
O modelo é estável?Ele continua identificado como PreviewCompatibilidade, SLA e política de mudanças

A Artificial Analysis reporta 99,8 tokens por segundo, 23,01 segundos até o primeiro token da resposta e uma estimativa combinada de US$ 0,51 por 1M, considerando sua composição de 7:2:1 entre acertos de cache, entrada e saída. O serviço acompanha apenas um provedor; portanto, não trate esse valor combinado como um preço universal.

Quem deve usar o Step 5 Preview agora

O Step 5 Preview faz sentido para equipes capazes de limitar os riscos de um modelo em prévia e que tenham um motivo mensurável para testá-lo.

Use em pilotos delimitados e com muito contexto

Análise de documentos extensos, revisão de código em nível de repositório, síntese de pesquisas e experimentos internos com agentes são bons pontos de partida. Esses cenários podem se beneficiar de uma janela de contexto ampla e do baixo preço de entrada reportado, sem deixar de ser simples repetir os testes com um modelo alternativo.

Use quando o custo importar mais que a maturidade do ecossistema

Os valores reportados de US$ 1/US$ 2,70 são atraentes para prompts grandes, contexto reutilizado e respostas com limite definido. Estabeleça um orçamento máximo de tokens de saída, em vez de permitir que cada solicitação consuma todo o limite de raciocínio do modelo.

Limitações de um endpoint em prévia

Evite usá-lo como único modelo para pagamentos, alterações de conta, decisões de conformidade ou chamadas irreversíveis de ferramentas. O anúncio oficial menciona entrada de visão, mas os catálogos divergem em alguns recursos específicos das rotas. Por isso, teste separadamente o processamento de imagens, os argumentos de chamadas de função, a saída estruturada, as novas tentativas e o comportamento em caso de timeout.

Checklist de verificação antes de colocar em produção

  1. Confirme o endpoint e o ID do modelo. Envie uma solicitação inofensiva usando o identificador exato exibido na conta do provedor. Registre o nome do modelo retornado e a região.
  2. Guarde os objetos de uso e as faturas. Compare os campos de entrada, saída, cache e tokens de raciocínio. Não deduza a cobrança a partir de uma estimativa combinada.
  3. Teste o contexto progressivamente. Faça testes com entradas de 50K, 100K e 350K tokens antes de tentar prompts maiores. Registre latência, truncamento e comportamento diante de erros.
  4. Limite os tokens de saída. A saída custa US$ 2,70/M no valor reportado, e o raciocínio pode ser cobrado como saída em algumas rotas.
  5. Teste chamadas de ferramentas e mantenha um modelo alternativo. Verifique a recuperação de chamadas malformadas, timeouts, tarefas sensíveis a políticas e o comportamento das novas tentativas.

Perguntas frequentes sobre a API do Step 5 Preview

Qual é o preço oficial do Step 5 Preview?

Consulte a tabela de preços acima: Vercel e EmpirioLabs reportam US$ 1 por 1M de tokens de entrada e US$ 2,70 por 1M de tokens de saída, mas confirme o valor e os campos de cobrança na rota que você utiliza.

Qual ID de modelo os desenvolvedores devem testar?

Os IDs mais comuns são step-5-preview e stepfun/step-5-preview, dependendo do provedor ou gateway. Confira o identificador exato na sua conta, em vez de fixar no código um valor de catálogo.

Tokens de raciocínio e tokens em cache são cobrados separadamente?

A EmpirioLabs informa que os tokens de raciocínio contam como tokens de saída e lista a entrada em cache a US$ 0,05/M. Confirme as duas regras nos seus próprios registros de uso antes de projetar os custos.