StepFun confirme l’accès à l’API, mais les catalogues tiers — et non une grille tarifaire complète publiée par l’éditeur — fournissent les prix publics les plus précis à ce jour. Considérez Step 5 Preview comme un modèle à tester dans un périmètre maîtrisé, pas comme un choix par défaut pour la production.
Tarifs de l’API Step 5 Preview en bref
Vercel AI Gateway et EmpirioLabs indiquent un tarif de 1,00 $ par million de tokens en entrée et de 2,70 $ par million de tokens en sortie pour Step 5 Preview. De son côté, Artificial Analysis avance une estimation moyenne de 0,51 $ par million de tokens, calculée selon une répartition d’usage précisée par le site. Ces montants servent de références de marché : ils ne constituent pas une grille tarifaire chiffrée publiée par StepFun dans l’annonce citée.
| Élément | Valeur actuellement rapportée | Statut des informations |
|---|---|---|
| Tokens en entrée | 1,00 $ / 1 M | Vercel et EmpirioLabs ; vérifiez votre route |
| Tokens en sortie | 2,70 $ / 1 M | Vercel et EmpirioLabs ; vérifiez les détails de facturation |
| Entrée en cache | 0,05 $ / 1 M | Catalogues des fournisseurs ; confirmez les règles du cache |
| Recherche web facultative | 0,013 $ / appel | EmpirioLabs uniquement ; vérifiez la facturation de la route |
| Statut du modèle | Preview | Confirmé par les fiches des fournisseurs |
| Accès à l’API | Disponible dès maintenant | Confirmé par StepFun |
Ce que StepFun confirme officiellement
Dans son annonce officielle de Step 5 Preview, StepFun confirme que l’API est accessible dès maintenant et indique séparément le 15 octobre 2026 comme date prévue pour la disponibilité des poids ouverts. L’éditeur décrit un modèle à mélange parcimonieux d’experts, avec 600 milliards de paramètres au total, 27 milliards de paramètres actifs, une fenêtre de contexte d’un million de tokens, ainsi que des entrées texte et vision destinées aux agents, au développement logiciel et à la finance. Il s’agit de caractéristiques annoncées par le fournisseur : selon la route utilisée, toutes les fonctions ou limites ne seront pas forcément accessibles.
Vercel fournit une couche de compatibilité passerelle pour les interfaces OpenAI Chat Completions, Responses et celles de type Anthropic proposées dans son catalogue, avec l’identifiant stepfun/step-5-preview. EmpirioLabs documente de son côté un endpoint compatible OpenAI utilisant step-5-preview, avec un contexte de 1,02 million de tokens, un maximum de 131 072 tokens en sortie, des contrôles de raisonnement, la génération structurée et une recherche web facultative. Ces éléments doivent être considérés comme des détails propres à chaque endpoint.
Tarifs de l’API Step 5 Preview : ce qu’il faut savoir sur la facturation
Aux tarifs de base actuellement rapportés, le coût se calcule ainsi :
(input tokens / 1,000,000 × $1.00)
+ (output tokens / 1,000,000 × $2.70)
Une requête comprenant 100 000 tokens en entrée et 20 000 tokens en sortie coûterait environ 0,154 $, hors taxes, nouvelles tentatives, majorations éventuelles de la passerelle et consommation non signalée.
| Exemple de requête | Entrée | Sortie | Coût estimé des tokens du modèle |
|---|---|---|---|
| Courte revue de code | 60K | 4K | 0,0708 $ |
| Analyse avec long contexte | 100K | 20K | 0,1540 $ |
| Exécution d’un agent | 250K | 25K | 0,3175 $ |
L’entrée en cache est annoncée à 0,05 $/M, tandis qu’EmpirioLabs facture le raisonnement comme de la sortie et la recherche web 0,013 $/appel sur son endpoint. Confirmez ces trois règles pour la route que vous utilisez. Comme la sortie coûte 2,7 fois plus cher que l’entrée, les réponses longues ou fortement orientées raisonnement peuvent rapidement concentrer l’essentiel de la facture.
L’API est-elle exploitable en production ?
L’API est officiellement disponible, mais les informations publiques ne permettent pas encore de considérer Step 5 Preview comme un modèle de production fiable par défaut pour tous les usages. Il manque notamment les limites de débit propres à chaque route, les conditions de SLA, les garanties de compatibilité et l’ensemble des règles de facturation.
| Question pour la production | Ce qui est établi publiquement | Ce qui doit encore être vérifié |
|---|---|---|
| Puis-je l’appeler dès maintenant ? | StepFun indique que l’accès à l’API est disponible | Éligibilité du compte, de la région et de la route |
| Quel est le coût ? | Les catalogues indiquent 1 $/2,70 $ par million de tokens | Grille tarifaire officielle et cas particuliers de facturation |
| Quel est l’identifiant du modèle ? | step-5-preview ou stepfun/step-5-preview | Identifiant exact sur votre endpoint |
| Quelle est la taille du contexte ? | Environ 1 million de tokens est indiqué à plusieurs reprises | Limite réelle des requêtes et comportement en cas de troncature |
| Les outils ou le JSON sont-ils pris en charge ? | Les catalogues indiquent que oui | Comportement au niveau de la route et gestion des erreurs |
| Le modèle est-il stable ? | Il porte toujours le statut Preview | Compatibilité, SLA et politique de modification |
Artificial Analysis rapporte 99,8 tokens par seconde, 23,01 secondes avant le premier token de réponse et une estimation moyenne de 0,51 $ par million de tokens, selon sa répartition 7:2:1 entre tokens en cache, tokens en entrée et tokens en sortie. Le site ne suit qu’un seul fournisseur : ne considérez donc pas ce montant comme un tarif universel.
Qui devrait utiliser Step 5 Preview maintenant ?
Step 5 Preview s’adresse surtout aux équipes capables de contenir les risques liés à un modèle en préversion et disposant d’une raison mesurable de le tester.
Pour des pilotes ciblés à fort contexte
L’analyse de documents volumineux, la revue de code à l’échelle d’un dépôt, la synthèse de recherches et les expérimentations internes avec des agents constituent de bons points de départ. Ces usages peuvent tirer parti d’une vaste fenêtre de contexte et du faible tarif d’entrée rapporté, tout en restant faciles à rejouer avec un modèle de secours.
Quand le coût prime sur la maturité de l’écosystème
Les tarifs rapportés de 1 $/2,70 $ sont intéressants pour les prompts volumineux, le contexte réutilisé et les sorties plafonnées. Définissez un budget maximal de tokens en sortie au lieu de laisser chaque requête consommer toute la capacité de raisonnement du modèle.
Les limites d’un endpoint en préversion
Évitez d’en faire l’unique modèle pour les paiements, les modifications de compte, les décisions de conformité ou les appels d’outils irréversibles. L’annonce officielle mentionne les entrées vision, tandis que les catalogues ne s’accordent pas toujours sur les capacités propres à chaque route. Testez donc séparément la gestion des images, les arguments des appels de fonctions, la génération structurée, les nouvelles tentatives et le comportement en cas d’expiration.
Checklist de vérification avant la mise en ligne
- Confirmez l’endpoint et l’identifiant du modèle. Envoyez une requête sans risque avec l’identifiant exact affiché dans votre compte fournisseur. Notez le nom du modèle renvoyé et la région.
- Conservez les objets d’usage et les factures. Comparez les champs liés aux tokens en entrée, en sortie, en cache et au raisonnement. Ne déduisez pas la facturation à partir d’une moyenne pondérée.
- Testez progressivement la taille du contexte. Essayez des entrées de 50K, 100K et 350K tokens avant de passer à des prompts plus volumineux. Notez la latence, la troncature et le comportement en cas d’erreur.
- Plafonnez les tokens en sortie. La sortie coûte 2,70 $/M au tarif rapporté, et le raisonnement peut être facturé comme de la sortie sur certaines routes.
- Testez les appels d’outils et prévoyez un modèle de secours. Vérifiez la récupération après un appel malformé, les délais d’expiration, les tâches sensibles du point de vue des règles et le comportement des nouvelles tentatives.
FAQ sur l’API Step 5 Preview
Quel est le tarif officiel de Step 5 Preview ?
Reportez-vous au tableau tarifaire ci-dessus : Vercel et EmpirioLabs indiquent 1 $ par million de tokens en entrée et 2,70 $ par million de tokens en sortie. Vérifiez toutefois le tarif et les champs de facturation sur la route que vous utilisez.
Quel identifiant les développeurs doivent-ils tester ?
Les identifiants couramment listés sont step-5-preview et stepfun/step-5-preview, selon le fournisseur ou la passerelle. Vérifiez l’identifiant exact dans votre compte plutôt que d’intégrer en dur une valeur issue d’un catalogue.
Les tokens de raisonnement et les tokens en cache sont-ils facturés séparément ?
EmpirioLabs indique que les tokens de raisonnement sont comptabilisés comme des tokens en sortie et affiche l’entrée en cache à 0,05 $/M. Confirmez ces deux règles dans vos propres relevés d’usage avant d’établir une prévision de coût.