AIREITER

Tarifs et état de l’API Step 5 Preview (septembre 2026)

Dernière mise à jour: 2026-09-20 07:28:50

Avec un score de 44 rapporté par Artificial Analysis, Step 5 Preview semble étonnamment bon marché. Mais le tarif par token ne suffit pas pour décider. StepFun a bien annoncé le modèle et une voie d’accès par API, tandis que sa documentation publique ne propose toujours pas de fiche modèle complète, de règles de facturation détaillées ni de contrat de production clairement établi. À ce stade, mieux vaut le considérer comme un candidat pour un pilote que comme un endpoint par défaut.

Tout dépend de ce que l’on entend par « disponible »

Step 5 Preview n’est plus une simple rumeur : le compte officiel de StepFun l’a annoncé le 20 septembre 2026 et indique que les poids ouverts sont prévus pour le 15 octobre. Pourtant, une recherche Google dans les pages publiques de la plateforme StepFun renvoie encore vers le portail général et la documentation de Step 3.7, sans référence clairement indexée à step-5-preview. La nuance est importante : une annonce d’accès ne signifie pas que l’API est déjà documentée et largement accessible en libre-service pour la production.

QuestionRéponse actuelleNiveau de confiance
StepFun l’a-t-il annoncé ?Oui, via l’annonce officielle de @StepFun_aiÉlevé
Un identifiant de modèle API est-il mentionné ?step-5-previewMoyen ; à vérifier dans votre compte
Des tarifs publics par token sont-ils rapportés ?1 $ en entrée / 2,70 $ en sortie par million de tokensMoyen ; mesure ou référencement tiers
Les poids sont-ils téléchargeables aujourd’hui ?Aucun poids public n’a été trouvéÉlevé au 20 septembre
Des poids ouverts sont-ils promis ?Le 15 octobre, selon l’annonce de StepFunÉlevé pour la promesse ; livraison encore à venir

Ce que StepFun confirme — et ce qui reste à vérifier

L’annonce officielle décrit un modèle MoE sparse de 600 milliards de paramètres, dont 27 milliards actifs, avec une fenêtre de contexte d’un million de tokens, des entrées texte et image, ainsi que des points forts en matière d’agents, de développement logiciel et de finance. Il s’agit de déclarations du fournisseur, et non d’une preuve indépendante que chaque limite annoncée est disponible sur toutes les routes API.

Lors de la vérification effectuée le 20 septembre 2026, la recherche sur la plateforme officielle ne renvoyait aucune page dédiée aux tarifs ou à l’API de Step 5. Plusieurs questions opérationnelles restent donc sans source de première main : limites de débit, longueur maximale des sorties, appels de fonctions, facturation du cache ou disponibilité régionale. Ne recopiez pas dans une configuration de production les informations d’un annuaire de modèles tiers comme s’il s’agissait de la documentation StepFun.

Dans une publication, l’utilisateur @xueyu1125 explique qu’un test simple d’animation SVG lui a paru moins convaincant que ne le laisse penser le score d’Artificial Analysis, notamment pour la 3D et le raisonnement (source). Ce retour isolé ne constitue pas un benchmark, mais il rappelle utilement qu’un score agrégé ne garantit pas les mêmes performances dans tous les usages.

«目前的简单使用体验是对不起Artifical Analysis的44 Index分数,至少在3D和思维能力这方面达不到GLM-5.3-Flash🤣» — @xueyu1125, à propos d’un premier test pratique (X)

Tarifs de l’API Step 5 Preview : prenez les chiffres annoncés avec précaution

Le tarif le plus souvent cité pour l’API Step 5 Preview est de 1,00 $ par million de tokens en entrée et 2,70 $ par million de tokens en sortie. Artificial Analysis mentionne également une remise de 95 % sur les tokens mis en cache et une estimation moyenne de 0,51 $ par million de tokens avec une hypothèse de 70 % de cache hits, 20 % d’entrée et 10 % de sortie. Ce montant moyen repose sur un scénario précis : ce n’est pas un tarif universel appliqué à chaque facture.

UsageTarif rapportéÀ vérifier avant le lancement
Entrée1,00 $ / million de tokensLe caractère officiel du tarif et son éventuelle variation selon la région
Sortie2,70 $ / million de tokensLa façon dont les tokens de raisonnement sont comptabilisés
Cache hitEnviron 0,05 $ / million avec une remise de 95 %Les conditions d’éligibilité et les règles d’écriture dans le cache
Exemple : 100 000 tokens en entrée + 20 000 en sortieEnviron 0,154 $Les taxes, minimums de facturation, relances et tokens de raisonnement cachés

Le calcul de base est simple : (tokens d’entrée ÷ 1 000 000 × 1,00) + (tokens de sortie ÷ 1 000 000 × 2,70). Une requête de 100 000 tokens en entrée et 20 000 en sortie revient donc à environ 0,10 $ + 0,054 $ = 0,154 $, avant remise ou frais propres au fournisseur.

Le piège vient de la longueur des réponses. Dans son évaluation Intelligence Index, Artificial Analysis a mesuré environ 160 millions de tokens en sortie, contre une médiane de 92 millions pour les modèles comparables. Même avec un tarif de sortie bas, la facture peut grimper si le modèle consomme davantage de tokens pour raisonner ou répondre. Un premier utilisateur signale également que les tokens de réflexion pourraient apparaître dans la facturation de la sortie (source).

Un signal de performance solide, mais loin d’être homogène

Artificial Analysis attribue à Step 5 Preview un score Intelligence Index de 44, une vitesse d’environ 100 tokens par seconde en sortie et 2,96 secondes avant le premier token de réponse. De son côté, BenchLeader mentionne un contexte d’un million de tokens, un débit de 100 tokens par seconde et un délai de 23 secondes avant la première réponse. Ces écarts de définition montrent pourquoi il ne faut pas comparer directement les chiffres bruts de différents tableaux de bord.

IndicateurRésultat rapportéCe que cela signifie pour l’acheteur
Intelligence Index44Un résultat agrégé élevé, sans garantie pour chaque tâche
Vitesse de sortie99,8 tokens/secondeCompétitive une fois la génération lancée
Premier token de réponse2,96 secondes selon Artificial AnalysisVérifier la définition de la mesure et votre route d’accès
Fenêtre de contexte1 million de tokensConfirmer la limite de l’API déployée, pas seulement celle de la fiche modèle
Sortie de l’évaluation160 millions de tokensPrévoir une consommation importante liée à la verbosité et au raisonnement
Résultat en contexte long88,3 %, rang n° 2 dans le classement BenchLeaderPrometteur, mais les modalités du benchmark comptent

Les performances ne sont toutefois pas uniformément élevées. BenchLeader attribue à Step 5 Preview un score de 58,9 % à SciCode, au 8e rang, mais le place au 64e rang pour MMMU-Pro et identifie le multimodal comme sa catégorie agrégée la plus faible. Artificial Analysis indique une prise en charge des images, tandis que le catalogue de CloudPrice signale cette fonction, ainsi que plusieurs autres capacités, comme indisponible. Tant que StepFun n’aura pas publié une matrice précise des capacités de l’API, concevez votre application en partant de l’hypothèse la plus restrictive.

Un pilote maîtrisé plutôt qu’une migration en production

Les éléments disponibles justifient une évaluation encadrée, pas un basculement sans réserve. Commencez avec un budget limité et faites vérifier par l’API les points que les pages tierces ne permettent pas de trancher.

  1. Confirmez l’endpoint et l’identifiant du modèle dans le compte officiel. Envoyez une requête sans risque avec step-5-preview, puis consignez le nom de modèle renvoyé, la région, le code de statut et les en-têtes de limitation de débit.
  2. Examinez les informations de facturation. Comparez la consommation en entrée, en sortie, dans le cache et en tokens de raisonnement. Ne déduisez pas le montant de la facture des seuls chiffres publics 1 $/2,70 $.
  3. Testez le contexte long par paliers. Commencez à 50 000 tokens, puis passez à 100 000, 350 000 et davantage uniquement si la requête précédente aboutit. Mesurez le délai avant le premier token, les troncatures et le comportement en cas d’erreur.
  4. Évaluez les outils séparément de la qualité textuelle. Vérifiez les noms de fonctions, la validité des arguments, les relances et la capacité du modèle à lire l’état cible avant de le modifier. Le score Intelligence Index ne prouve pas que l’exécution d’outils sera fiable.
  5. Prévoyez une solution de repli. Redirigez les appels d’outils en échec, expirés ou mal formés vers un modèle déjà pris en charge par votre stack. Un endpoint en préversion ne doit pas être l’unique voie d’un parcours destiné aux clients.

Dans une architecture multi-fournisseurs, une passerelle API unifiée peut simplifier cette redirection, mais elle ne dispense pas de vérifier les règles de facturation et les limites propres à StepFun. L’objectif est de contenir le risque : garder un modèle encore non éprouvé derrière un budget, des logs et une route de secours testée.

FAQ sur l’API Step 5 Preview

Step 5 Preview est-il officiellement sorti ?

StepFun a officiellement annoncé Step 5 Preview le 20 septembre 2026. La documentation publique et la disponibilité à grande échelle en production restent moins claires. « Annoncé » ne signifie donc pas nécessairement « entièrement documenté et stable ».

Quel est l’identifiant du modèle API Step 5 Preview ?

Les premiers rapports indiquent step-5-preview. Vérifiez l’identifiant exact dans le compte officiel StepFun ou dans la réponse de l’API avant de l’inscrire en dur.

Combien coûte Step 5 Preview ?

Des annuaires tiers et Artificial Analysis rapportent un tarif de 1,00 $ par million de tokens en entrée et de 2,70 $ par million en sortie. Vérifiez si le raisonnement, les écritures dans le cache, les relances et les frais régionaux sont facturés différemment.

Step 5 Preview est-il open source aujourd’hui ?

Aucun poids public n’était disponible dans les sources consultées le 20 septembre 2026. L’annonce de StepFun prévoit des poids ouverts pour le 15 octobre : il s’agit d’un engagement à venir, pas d’une disponibilité actuelle.

Le modèle prend-il en charge les images et un contexte d’un million de tokens ?

L’annonce de StepFun et Artificial Analysis indiquent une prise en charge des images et un contexte d’un million de tokens. Les informations contradictoires des catalogues invitent toutefois à tester la route API exacte et à ne pas supposer que toutes les capacités annoncées sont activées partout.

La décision est donc assez simple, même si le modèle ne l’est pas encore : lancez un pilote limité et instrumenté si le rapport prix-performances correspond à votre charge ; ne faites pas de Step 5 Preview une dépendance de production tant que StepFun n’aura pas publié la fiche modèle, les règles de facturation, la liste des capacités et les limites nécessaires à une exploitation sûre.

État de la plateforme ouverte StepFun vérifié lors de l’évaluation de l’API Step 5 Preview