StepFun bestätigt den API-Zugriff, doch die derzeit aussagekräftigsten öffentlichen Preisangaben stammen aus Drittanbieter-Katalogen – nicht aus einer vollständigen offiziellen Preisliste. Wer Step 5 Preview einsetzt, sollte das Modell daher zunächst in einem kontrollierten Pilotprojekt testen und nicht als Standardmodell für die Produktion einplanen.
Step 5 Preview: API-Preise im Überblick
Vercel AI Gateway und EmpirioLabs führen Step 5 Preview mit 1,00 US-Dollar pro 1 Million Eingabe-Token und 2,70 US-Dollar pro 1 Million Ausgabe-Token. Artificial Analysis nennt unabhängig davon einen gemischten Schätzwert von 0,51 US-Dollar pro 1 Million Token, basierend auf einer festgelegten Nutzungsmischung. Dabei handelt es sich um Markt- und Referenzwerte – nicht um eine in der zitierten StepFun-Ankündigung veröffentlichte offizielle Preisliste.
| Posten | Aktuell gemeldeter Wert | Status der Quelle |
|---|---|---|
| Eingabe-Token | 1,00 $ / 1 Mio. | Vercel und EmpirioLabs; verwendete Route prüfen |
| Ausgabe-Token | 2,70 $ / 1 Mio. | Vercel und EmpirioLabs; Abrechnungsdetails prüfen |
| Gecachte Eingaben | 0,05 $ / 1 Mio. | Anbieter-Kataloge; Cache-Regeln bestätigen |
| Optionale Websuche | 0,013 $ / Aufruf | Nur EmpirioLabs; Abrechnung der Route prüfen |
| Modellstatus | Preview | Durch Anbieter-Listings bestätigt |
| API-Zugriff | Jetzt verfügbar | Von StepFun bestätigt |
Was StepFun offiziell bestätigt
Die offizielle Ankündigung von Step 5 Preview bestätigt, dass der API-Zugriff jetzt verfügbar ist. Als geplanten Termin für die Veröffentlichung der Open Weights nennt StepFun außerdem den 15. Oktober 2026. Beschrieben wird ein Sparse-Mixture-of-Experts-Modell mit insgesamt 600 Milliarden Parametern, davon 27 Milliarden aktive Parameter, einem Kontextfenster von 1 Million Token sowie Text- und Bildeingaben für agentische Aufgaben, Softwareentwicklung und Finanzanwendungen. Das sind Angaben des Anbieters; je nach Route müssen nicht alle Funktionen oder Limits verfügbar sein.
Vercel stellt für die aufgeführten OpenAI-Chat-Completions-, Responses- und Anthropic-kompatiblen Schnittstellen die Gateway-Kompatibilität bereit und verwendet dafür stepfun/step-5-preview. EmpirioLabs dokumentiert einen eigenen OpenAI-kompatiblen Endpunkt mit step-5-preview, einem Kontext von 1,02 Millionen Token, maximal 131.072 Ausgabe-Token, Steuerungsmöglichkeiten für Reasoning, strukturierten Ausgaben und optionaler Websuche. Diese Angaben sind als technische Details des jeweiligen Endpunkts zu verstehen.
Step 5 Preview: Preisberechnung und Fallstricke bei der Abrechnung
Auf Basis der derzeit gemeldeten Grundpreise lässt sich der Aufwand so schätzen:
(Eingabe-Token / 1.000.000 × 1,00 $)
+ (Ausgabe-Token / 1.000.000 × 2,70 $)
Eine Anfrage mit 100.000 Eingabe-Token und 20.000 Ausgabe-Token würde damit vor Steuern, Wiederholungsversuchen, Aufschlägen des Gateways oder nicht erfasster Nutzung ungefähr 0,154 US-Dollar kosten.
| Beispielanfrage | Eingabe | Ausgabe | Geschätzte Kosten für Modell-Token |
|---|---|---|---|
| Kurzes Code-Review | 60K | 4K | 0,0708 $ |
| Analyse mit langem Kontext | 100K | 20K | 0,1540 $ |
| Agentenlauf | 250K | 25K | 0,3175 $ |
Für gecachte Eingaben werden 0,05 $ pro Million Token genannt. EmpirioLabs berechnet auf seinem Endpunkt Reasoning als Ausgabe und die Websuche mit 0,013 $ pro Aufruf. Alle drei Regeln sollten für die jeweils verwendete Route bestätigt werden. Da Ausgaben 2,7-mal so teuer sind wie Eingaben, können lange oder besonders reasoning-intensive Antworten den größten Teil der Kosten verursachen.
Ist die API für den Produktionseinsatz geeignet?
Die API ist offiziell verfügbar. Die öffentlich zugänglichen Informationen reichen jedoch noch nicht aus, um Step 5 Preview für jede Art von Workload als produktionsreifes Standardmodell einzustufen. Unklar sind unter anderem routenspezifische Rate Limits, SLA-Bedingungen, Kompatibilitätsgarantien und die vollständigen Abrechnungsregeln.
| Frage für den Produktionseinsatz | Öffentlich belegt | Noch zu prüfen |
|---|---|---|
| Kann ich das Modell jetzt aufrufen? | StepFun nennt den API-Zugriff als verfügbar | Konto-, Regions- und Routenberechtigung |
| Was kostet es? | Kataloge nennen 1 bzw. 2,70 $ pro 1 Mio. | Offizielle Preisliste und Sonderfälle bei der Abrechnung |
| Wie lautet die Modell-ID? | step-5-preview oder stepfun/step-5-preview | Exakte Kennung auf dem eigenen Endpunkt |
| Wie groß ist der Kontext? | Rund 1 Mio. Token werden wiederholt genannt | Tatsächliches Request-Limit und Verhalten bei Kürzungen |
| Unterstützt das Modell Tools oder JSON? | Kataloge nennen entsprechende Unterstützung | Verhalten und Fehlerbehandlung auf Routenebene |
| Ist das Modell stabil? | Es bleibt als Preview gekennzeichnet | Kompatibilität, SLA und Änderungsrichtlinien |
Artificial Analysis misst 99,8 Token pro Sekunde, 23,01 Sekunden bis zum ersten Antwort-Token und einen gemischten Schätzwert von 0,51 US-Dollar pro 1 Million Token bei einer Mischung aus 7:2:1 für Cache-Treffer, Eingabe und Ausgabe. Da dort nur ein Anbieter erfasst wird, sollte dieser Mischwert nicht als allgemein gültiger Preis verstanden werden.
Für wen sich Step 5 Preview jetzt eignet
Step 5 Preview passt zu Teams, die das Risiko eines Preview-Modells begrenzen können und einen messbaren Grund für den Test haben.
Für klar abgegrenzte Piloten mit viel Kontext
Analysen umfangreicher Dokumente, Code-Reviews auf Repository-Ebene, die Zusammenfassung von Forschungsergebnissen und interne Experimente mit Agenten sind sinnvolle Einsatzfelder. Sie profitieren vom großen Kontextfenster und den vergleichsweise niedrigen gemeldeten Eingabepreisen, lassen sich aber weiterhin unkompliziert gegen ein Fallback-Modell testen.
Wenn niedrige Kosten wichtiger sind als ein ausgereiftes Ökosystem
Die gemeldeten Preise von 1 bzw. 2,70 US-Dollar sind für große Prompts, wiederverwendeten Kontext und begrenzte Ausgaben attraktiv. Statt jede Anfrage das vollständige Reasoning-Budget ausschöpfen zu lassen, sollte ein maximales Ausgabe-Budget festgelegt werden.
Die Grenzen eines Preview-Endpunkts
Für Zahlungen, Kontoänderungen, Compliance-Entscheidungen oder nicht rückgängig zu machende Tool-Aufrufe sollte das Modell nicht als einzige Absicherung dienen. Die offizielle Ankündigung nennt Bildeingaben, während sich die Kataloge bei einzelnen Funktionen auf Routenebene widersprechen. Bildverarbeitung, Argumente bei Funktionsaufrufen, strukturierte Ausgaben, Wiederholungsversuche und Timeouts sollten deshalb jeweils separat getestet werden.
Checkliste vor dem Produktiveinsatz
- Endpunkt und Modell-ID bestätigen. Eine unkritische Anfrage mit genau der Kennung senden, die im eigenen Anbieter-Konto angezeigt wird. Zurückgegebenen Modellnamen und Region dokumentieren.
- Nutzungsdaten und Rechnungen sichern. Felder für Eingabe, Ausgabe, Cache und Reasoning-Token vergleichen. Die Abrechnung nicht aus einem Mischwert ableiten.
- Kontext schrittweise testen. Vor größeren Prompts Eingaben mit 50K, 100K und 350K Token prüfen. Latenz, Kürzungen und Fehlverhalten dokumentieren.
- Ausgabe-Token begrenzen. Bei dem gemeldeten Preis kosten Ausgaben 2,70 $ pro Million Token. Auf manchen Routen kann Reasoning als Ausgabe berechnet werden.
- Tool-Aufrufe testen und ein Fallback-Modell bereithalten. Wiederherstellung nach fehlerhaften Aufrufen, Timeouts, richtlinienkritische Aufgaben und Verhalten bei Wiederholungsversuchen prüfen.
FAQ zur Step 5 Preview API
Wie hoch ist der offizielle Preis für Step 5 Preview?
Die Preistabelle oben fasst die derzeit verfügbaren Angaben zusammen: Vercel und EmpirioLabs nennen 1 $ pro 1 Million Eingabe-Token und 2,70 $ pro 1 Million Ausgabe-Token. Für die tatsächlich verwendete Route sollten Preis und Abrechnungsfelder trotzdem überprüft werden.
Welche Modell-ID sollten Entwickler testen?
Je nach Anbieter oder Gateway werden meist step-5-preview und stepfun/step-5-preview verwendet. Die exakte Kennung sollte im eigenen Konto geprüft werden, statt einen Katalogwert fest zu hinterlegen.
Werden Reasoning- und gecachte Token separat abgerechnet?
EmpirioLabs gibt an, dass Reasoning-Token als Ausgabe-Token zählen, und nennt für gecachte Eingaben 0,05 $ pro Million Token. Beide Regeln sollten vor einer Kostenprognose anhand der eigenen Nutzungsdaten bestätigt werden.