Wer Grok 4.7 für einen API-Workflow evaluieren möchte, sollte die Preisangabe von 2 und 6 US-Dollar nicht isoliert betrachten: In der Dokumentation von xAI stehen 2 US-Dollar pro Million Eingabe- und 6 US-Dollar pro Million Ausgabetokens für die reguläre API. Das Modell ist offiziell unter der ID grok-4.7 verfügbar. Je nach Gateway, US-regionalem Routing, Caching und Nutzung des langen Kontexts kann der tatsächliche Rechnungsbetrag jedoch abweichen.
Die Kurzfassung: Der Zugang ist real, 2/6 US-Dollar aber nur der direkte Basispreis
Grok 4.7 ist weder ein Gerücht noch bloß eine Bezeichnung für den Chat. Die offizielle xAI-Seite, aktualisiert am 21. September 2026, dokumentiert den API-Zugriff über die Responses API und Chat Completions. Genannt werden ein Kontextfenster mit 500.000 Tokens, Text- und Bildeingaben, Textausgaben, Function Calling, Websuche, X-Suche und Codeausführung.
Die Angabe von 2 beziehungsweise 6 US-Dollar gilt ausdrücklich für den regulären Direktzugang:
| Zugangsweg oder Nutzungsmodus | Eingabe | Ausgabe | Bedeutung |
|---|---|---|---|
| Direkte xAI-API, Standard | $2.00/M | $6.00/M | Offizieller Basispreis für grok-4.7 |
| Regionales xAI-Endpoint für die USA | $2.20/M* | $6.60/M* | 10 % Aufschlag auf den Standardpreis |
| OpenRouter-Standardangebot | $1.60/M | $4.80/M | Gateway-/Provider-Preis, nicht der direkte xAI-Tarif |
| Vercel-AI-Gateway-Aktion | $1.20/M | $3.60/M | Aktionspreis bis zum 27. September 2026 |
*Die US-Preise sind aus dem von xAI dokumentierten Aufschlag von 10 % berechnet und nicht als separate Richtwerte veröffentlicht. Für direkte xAI-Nutzung sollte man mit 2 beziehungsweise 6 US-Dollar kalkulieren. Gateway-Preise gelten jeweils nur für den konkreten Zugangsweg – ihre Bedingungen und Verfügbarkeit müssen separat geprüft werden.
Welche Funktionen xAI offiziell bereitstellt
Die offizielle Modell-ID lautet grok-4.7. xAI zeigt drei kompatible Zugriffsvarianten: das eigene SDK, einen OpenAI-kompatiblen Client mit https://api.x.ai/v1 als Ziel sowie einen direkten POST-Aufruf an https://api.x.ai/v1/responses.
Die dokumentierten technischen Eckdaten sind besonders für Agenten-Workflows relevant:
| Spezifikation | Von xAI dokumentierter Wert |
|---|---|
| Kontextfenster | 500.000 Tokens |
| Wissensstand | Mai 2026 |
| Reasoning-Stufen | Low, medium, high, xhigh |
| Standard-Reasoning | High |
| Eingabe | Text und Bilder |
| Ausgabe | Text |
| APIs | Responses API und Chat Completions |
| Tools | Function Calling, Websuche, X-Suche, Codeausführung |
| Regulärer Eingabepreis | $2/M Tokens |
| Regulärer Ausgabepreis | $6/M Tokens |
Das Beispiel in der Dokumentation fordert das Modell auf, einen Fehler in einer JavaScript-Funktion zur Berechnung des Medians zu finden und zu erklären. Das zeigt, wie die API angebunden wird – nicht, wie gut Grok tatsächlich programmiert. Eine unabhängige Benchmark-Tabelle, Latenzmessung, Verfügbarkeitszusage oder Erfolgsquote für Aufgaben enthält die Seite nicht.
Grok 4.7 API: Diese Preisdetails verändern die Rechnung
Direkte API und Gateway-Preise nicht vermischen
Die OpenRouter-Modellseite nennt 1,60 US-Dollar pro Million Eingabetokens, 4,80 US-Dollar pro Million Ausgabetokens und 0,40 US-Dollar pro Million Tokens für Cache-Lesezugriffe. Vercels AI-Gateway-Seite weist eine Reduzierung um 40 % auf 1,20 beziehungsweise 3,60 US-Dollar aus; diese Aktion endet am 27. September 2026.
Gateway-Preise können auf Aktionen oder einer anderen Weiterleitung beruhen. Für einen belastbaren Vergleich zählt deshalb der vollständige Preis pro Anfrage – nicht nur der auffällige Token-Tarif.
Regionales Routing in den USA
xAI dokumentiert https://us.api.x.ai/v1 als regionales US-Endpoint mit einem Aufschlag von 10 % auf die Token-Nutzung. Ausgehend vom Standardpreis ergeben sich 2,20 US-Dollar pro Million Eingabetokens und 6,60 US-Dollar pro Million Ausgabetokens.
Bei wiederholten Repository-Prompts zahlt sich Caching aus
xAI empfiehlt einen Bezeichner für das Cache-Routing: prompt_cache_key bei der Responses API oder den Header x-grok-conv-id bei Chat Completions. Werden aufeinanderfolgende Anfragen an denselben Server geleitet, steigt die Wahrscheinlichkeit von Cache-Treffern. Bei einem leeren Cache wird dagegen unter Umständen der volle Eingabepreis fällig.
Die Preistabelle von Cursor für Grok 4.7 liefert einen Praxisvergleich für gehostete Nutzung: 0,50 US-Dollar pro Million Tokens für Cache-Lesezugriffe in der Standardstufe gegenüber 2 US-Dollar für nicht gecachte Eingaben. Das ist Cursors Abrechnungsmodell und keine Zusage, dass die direkte xAI-API identische Cache-Preise verwendet.
Ein großer Kontext bleibt kostenpflichtig
Cursor nennt 256k als Standardkontext und 500k als Maximum. Laut Dokumentation gelten oberhalb von 256k höhere Preise für langen Kontext: Bei der Standardnutzung wird der Preis verdoppelt, bei Fast-Nutzung verdreifacht.
xAI bestätigt die Möglichkeit eines 500k-Kontexts, veröffentlicht in der Modellübersicht aber keinen eigenen Multiplikator für lange Kontexte. Vor der Kalkulation sollte deshalb geprüft werden, welche Abrechnungsregeln für den tatsächlich verwendeten Zugangsweg gelten.
Was die veröffentlichten Coding-Hinweise belegen – und was nicht
Die dokumentierte Stärke von Grok 4.7 liegt bei längeren Agenten-Workflows. xAI, Cursor und OpenRouter positionieren das Modell für Coding, lang laufende Softwareentwicklung, Selbstprüfung und große Kontextfenster. Cursors Modelldokumentation nennt in der Agentenumgebung Dateisuche, Dateibearbeitung, Shell-Befehle, Browsersteuerung, Webzugriff, Bildgenerierung und Rückfragen zur Klärung.
Das reicht für einen Coding-Piloten, beweist aber weder bessere Fehlerbehebung noch höhere Testquoten oder niedrigere Kosten pro Aufgabe. Für einen belastbaren Vergleich sollte ein reproduzierbarer Repository-Test durchgeführt werden. Dabei sollten erfolgreiche Aufgaben, Wiederholungen, Tool-Aufrufe, Laufzeit und die Gesamtzahl der Tokens erfasst werden.
Die Aufwandseinstellung reicht von low bis xhigh, standardmäßig ist high aktiviert. Ein höherer Aufwand kann die Laufzeit und den Verbrauch verändern. Vor einer Produktionsprognose sollte daher geklärt werden, wie der jeweilige Provider Reasoning-Nutzung ausweist und abrechnet.
Aktuelle Wissensarbeit braucht Retrieval
Grok 4.7 verarbeitet Bilder, unterstützt Web- und X-Suche und hat einen Wissensstand von Mai 2026. Für aktuelle Recherchen sollte Retrieval oder eine Suchfunktion eingesetzt werden. Bewertet werden sollten dabei nicht nur die Formulierungen, sondern auch Zitiergenauigkeit, Quellenabdeckung, Zahl der Überarbeitungen und der Zeitaufwand für menschliche Korrekturen.
Was zwei beispielhafte Agenten-Workflows kosten
Für die direkte Standardabrechnung genügt zunächst dieses einfache Modell:
Kosten = (Eingabetokens / 1.000.000 × $2) + (Ausgabetokens / 1.000.000 × $6)
| Beispielanfrage | Kosten Eingabe | Kosten Ausgabe | Tokenkosten |
|---|---|---|---|
| 100k Eingabe + 20k Ausgabe | $0.20 | $0.12 | $0.32 |
| 500k Eingabe + 50k Ausgabe | $1.00 | $0.30 | $1.30 |
Das zweite Beispiel rechnet mit den Basispreisen. Der Betrag kann durch einen regionalen Aufschlag, Multiplikatoren für lange Kontexte bei gehosteten Angeboten, wiederholte Prompts ohne Cache-Treffer, providerabhängige Reasoning-Regeln und zusätzliche Anfragen steigen. Ein Coding-Agent mit zehn Anfragen kann daher deutlich mehr kosten als eine einzelne Anfrage mit 500k Tokens.
So lässt sich der Zugang vorab überprüfen
- Die offizielle Modell-ID verwenden. Übermittelt werden sollte
grok-4.7– kein geratenes Alias und kein gatewayspezifischer Name. - Mit einer kleinen Anfrage an die Responses API beginnen. xAI dokumentiert dafür
POST https://api.x.ai/v1/responsesmit Bearer-Authentifizierung und einer Texteingabe. - Nutzung aus Antwort und Rechnung protokollieren. Erfasst werden sollten Eingabe- und Ausgabetokens, sofern verfügbar auch Reasoning-Verbrauch, Tool-Aufrufe und der abgerechnete Betrag.
- Caching separat testen. Einen langen System-Prompt mit
prompt_cache_keywiederholen und die Eingabekosten der zweiten Anfrage vergleichen. - Die verwendete Kontextstufe prüfen. Einen Lauf mit weniger als 256k Tokens und einen weiteren oberhalb dieser Grenze durchführen, wenn die Anwendung lange Repository-Kontexte benötigt.
- Das Endpoint bewusst auswählen. Für die Basiskalkulation das Standard-Endpoint verwenden. Das regionale US-Endpoint sollte nur eingesetzt werden, wenn der Vorteil beim Datenstandort den Aufpreis von 10 % rechtfertigt.
- Gateway-Preise als eigene Produkte behandeln. Vor der Verwendung von 1,20/3,60 oder 1,60/4,80 US-Dollar in einer Prognose müssen Aktionsende, Provider-Routing, Fallback-Verhalten, Aufbewahrungsregeln für Daten und route-spezifische Gebühren geprüft werden.
- Abgeschlossene Aufgaben messen. Beim Coding sollten bestandene Tests, Wiederholungen, Tool-Aufrufe, Laufzeit und Gesamtkosten pro akzeptierter Änderung erfasst werden.
Grok 4.7 API: Häufige Fragen
Ist Grok 4.7 über die offizielle API verfügbar?
Ja. Die Dokumentation von xAI führt das Modell grok-4.7 für die Responses API und Chat Completions auf und enthält Beispiele für SDK, OpenAI-kompatible Nutzung und cURL.
Sind 2 US-Dollar für Eingaben und 6 US-Dollar für Ausgaben der bestätigte Preis?
Ja, das gilt für den am 21. September 2026 dokumentierten Standardtarif der direkten xAI-API. Beim regionalen US-Endpoint kommen 10 % hinzu. Gateways können andere Preise oder zeitlich begrenzte Aktionen anzeigen.
Eignet sich Grok 4.7 zum Programmieren?
Für lang laufende Coding-Agenten ist das Modell ein sinnvoller Kandidat für einen Piloten, da die dokumentierte Ausstattung Tool-Nutzung, anpassbares Reasoning, Hinweise zur Kontextkomprimierung und bis zu 500k Tokens Kontext umfasst. Die verfügbaren Quellen belegen jedoch keinen unabhängigen Coding-Vorsprung. Dafür sind Tests mit den eigenen Repository-Aufgaben nötig.
Hat Grok 4.7 ein Kontextfenster mit 500k Tokens?
Ja. xAI nennt 500.000 Tokens. Cursor beschreibt separat 256k als Standardkontext und 500k als maximale Stufe, wobei oberhalb von 256k höhere Preise gelten.
Ist Grok 4.7 Fast über die öffentliche API verfügbar?
Nein. In der Grok-4.7-Dokumentation von xAI wird Grok 4.7 Fast als dasselbe Modell auf schnellerer Infrastruktur beschrieben, allerdings zum doppelten Standardpreis. Laut xAI ist es nicht über die öffentliche API verfügbar. Aufgeführt wird es für Cursor und Grok Build.
Die Entscheidung: Pilot starten, aber den tatsächlich genutzten Zugangsweg kalkulieren
Der API-Zugang zu Grok 4.7 und der Basispreis von 2 beziehungsweise 6 US-Dollar sind bestätigt – ein Coding-Vorsprung dagegen nicht. Wenn der Workflow mehr als 256k Tokens verarbeitet, auf nicht gecachten Repository-Kontext angewiesen ist, US-Routing nutzt oder viele Reasoning-Aufrufe auslöst, können die Kosten pro abgeschlossener Aufgabe deutlich anders aussehen. Vor einer Migration produktiver Workloads empfiehlt sich daher ein sauber gemessener Pilot.