Se stai valutando Grok 4.7 per un flusso di lavoro basato su API, il dato più citato è corretto, ma non racconta tutta la storia: la documentazione di xAI indica $2 per milione di token in input e $6 per milione di token in output per l’API standard. Il modello è ufficialmente disponibile con l’identificativo grok-4.7, ma instradamento tramite gateway, endpoint regionali statunitensi, caching e uso di contesti estesi possono modificare sensibilmente quanto pagherai davvero.
In breve: l’accesso è reale, ma $2/$6 è solo la base del listino diretto
Grok 4.7 non è una semplice voce di corridoio né un’etichetta riservata alla chat. La pagina ufficiale di xAI, aggiornata il 21 settembre 2026, documenta l’accesso API sia tramite Responses API sia tramite Chat Completions. Sono indicati una finestra di contesto da 500.000 token, input testuali e immagini, output testuale, function calling, ricerca web, ricerca su X ed esecuzione di codice.
La tariffa $2/$6 è confermata nello specifico come prezzo standard per l’accesso diretto:
| Percorso o modalità d’uso | Input | Output | Significato |
|---|---|---|---|
| API xAI diretta, standard | $2.00/M | $6.00/M | Prezzo ufficiale di riferimento per grok-4.7 |
| Endpoint regionale xAI negli Stati Uniti | $2.20/M* | $6.60/M* | Sovrapprezzo del 10% rispetto alla tariffa standard |
| Listino standard OpenRouter | $1.60/M | $4.80/M | Prezzo del gateway/provider, non tariffa diretta xAI |
| Promozione Vercel AI Gateway | $1.20/M | $3.60/M | Prezzo promozionale indicato fino al 27 settembre 2026 |
*I valori per gli Stati Uniti sono calcolati a partire dal sovrapprezzo del 10% documentato da xAI, non sono prezzi principali pubblicati separatamente. Per pianificare l’uso diretto di xAI, considera $2/$6; tratta invece le tariffe dei gateway come prezzi legati allo specifico percorso e verifica sempre condizioni e disponibilità.
Cosa offre ufficialmente xAI
L’identificativo ufficiale del modello è grok-4.7. xAI indica tre modalità compatibili per accedervi: il proprio SDK, un client compatibile con OpenAI configurato sull’endpoint https://api.x.ai/v1 e una richiesta POST diretta a https://api.x.ai/v1/responses.
Le specifiche documentate sono particolarmente interessanti per il lavoro con agenti:
| Specifiche | Valore documentato da xAI |
|---|---|
| Finestra di contesto | 500.000 token |
| Knowledge cutoff | Maggio 2026 |
| Livelli di ragionamento | Low, medium, high, xhigh |
| Ragionamento predefinito | High |
| Input | Testo e immagini |
| Output | Testo |
| API | Responses API e Chat Completions |
| Strumenti | Function calling, ricerca web, ricerca su X, esecuzione di codice |
| Prezzo standard input | $2/M token |
| Prezzo standard output | $6/M token |
L’esempio nella documentazione chiede al modello di trovare e spiegare un bug in una funzione JavaScript per calcolare la mediana. Dimostra il collegamento con l’API, non la qualità effettiva nel coding. La pagina non include una tabella di benchmark indipendente, risultati sulla latenza, un impegno sul livello di uptime o un tasso di completamento delle attività.
Prezzi API di Grok 4.7: i dettagli che possono cambiare il conto
API diretta e prezzi dei gateway non sono la stessa cosa
La pagina del modello su OpenRouter indica $1.60/M per l’input, $4.80/M per l’output e $0.40/M per le letture dalla cache. La pagina di Vercel AI Gateway mostra una riduzione promozionale del 40%, con prezzi pari a $1.20/M e $3.60/M; la promozione termina il 27 settembre 2026.
I prezzi dei gateway possono dipendere da promozioni o da modalità di instradamento differenti. Quando confronti le alternative, considera il costo complessivo della richiesta, non soltanto la tariffa per token mostrata in evidenza.
L’instradamento regionale negli Stati Uniti ha un costo aggiuntivo
xAI documenta https://us.api.x.ai/v1 come endpoint regionale per gli Stati Uniti, con un sovrapprezzo del 10% sul consumo di token. Applicando la tariffa standard, si arriva a $2.20/M per l’input e $6.60/M per l’output.
Con richieste ripetute sul repository, il caching fa la differenza
xAI consiglia di usare un identificativo per il routing della cache: prompt_cache_key con la Responses API oppure l’header x-grok-conv-id con Chat Completions. Inviare turni ripetuti allo stesso server rende più affidabili gli accessi alla cache, mentre le richieste senza dati in cache possono essere fatturate al prezzo pieno dell’input.
La tabella dei prezzi di Grok 4.7 su Cursor offre un riferimento per un servizio ospitato: $0.50/M per le letture dalla cache nel livello standard, contro $2/M per l’input non memorizzato. È il modello di fatturazione di Cursor, non la garanzia che l’API diretta xAI applichi prezzi identici alla cache.
Un contesto lungo non è un contesto gratuito
Cursor indica 256k come contesto standard e 500k come limite massimo. La documentazione specifica che le richieste oltre 256k utilizzano tariffe maggiorate per il contesto esteso: il consumo standard viene moltiplicato per 2, mentre quello Fast per 3.
xAI conferma la disponibilità di un contesto da 500k, ma nel riepilogo del modello non pubblica un moltiplicatore separato per i contesti lunghi. Prima di dare per scontato che 500k token rientrino nella tariffa base, controlla le regole di fatturazione del percorso che utilizzerai.
Cosa dimostrano — e cosa non dimostrano — le evidenze pubblicate sul coding
Il caso d’uso descritto per Grok 4.7 è il lavoro prolungato con agenti. xAI, Cursor e OpenRouter lo presentano come uno strumento per il coding, l’ingegneria del software su attività di lunga durata, l’autoverifica e la gestione di contesti estesi. La documentazione del modello di Cursor elenca ricerca nei file, modifica dei file, comandi shell, controllo del browser, accesso al web, generazione di immagini e domande di chiarimento nell’ambiente agent.
Queste funzioni sono sufficienti per giustificare un progetto pilota sul coding, ma non dimostrano che Grok 4.7 sia migliore nella correzione dei bug, nel superamento dei test o nell’economia per attività completata. Esegui un test riproducibile su un repository e registra successo dell’attività, tentativi, chiamate agli strumenti, tempo trascorso e token totali.
Il livello di impegno va da low a xhigh, con high come impostazione predefinita. Un livello più alto può richiedere più tempo e modificare i consumi; prima di stimare i costi in produzione, verifica come il provider espone e fattura l’uso del ragionamento.
Per il lavoro aggiornato serve il retrieval
Grok 4.7 accetta immagini, supporta la ricerca web e su X e ha un knowledge cutoff fissato a maggio 2026. Per le ricerche su temi attuali, usa retrieval o ricerca e valuta l’accuratezza delle citazioni, la copertura delle fonti, il numero di revisioni e il tempo dedicato alle correzioni umane, invece di giudicare soltanto la qualità della prosa.
Quanto costano due esempi di loop con agenti
Per la tariffa standard diretta, puoi usare questo modello semplice:
costo = (token_input / 1.000.000 × $2) + (token_output / 1.000.000 × $6)
| Richiesta di esempio | Costo input | Costo output | Costo dei token |
|---|---|---|---|
| 100k input + 20k output | $0.20 | $0.12 | $0.32 |
| 500k input + 50k output | $1.00 | $0.30 | $1.30 |
Il secondo esempio illustra la tariffa base. Il costo può aumentare in presenza di un sovrapprezzo regionale, dei moltiplicatori per il contesto esteso su un percorso ospitato, di prompt ripetuti non presenti in cache, di regole specifiche del provider per il ragionamento e di richieste aggiuntive. Un agente di coding che effettua dieci richieste può costare molto più di una singola richiesta con 500k token.
Come verificare l’accesso prima di impegnarsi
- Usa l’identificativo ufficiale del modello. Invia
grok-4.7, non un alias ipotizzato o un nome specifico di un gateway. - Comincia con una piccola richiesta alla Responses API. xAI documenta
POST https://api.x.ai/v1/responsescon autenticazione Bearer e un input testuale. - Registra i consumi dalla risposta e dalla fattura. Rileva token di input, token di output, consumo del ragionamento se esposto, chiamate agli strumenti e importo fatturato.
- Verifica il caching separatamente. Ripeti lo stesso prompt di sistema lungo usando
prompt_cache_keye confronta la fatturazione dell’input nella seconda richiesta. - Verifica il livello di contesto. Esegui un test sotto i 256k token e un altro sopra questa soglia se la tua applicazione richiede il contesto esteso di un repository.
- Scegli l’endpoint con cognizione. Usa l’endpoint standard per misurare l’economia di base; ricorri a quello regionale statunitense solo quando il vantaggio legato alla localizzazione dei dati giustifica il sovrapprezzo del 10%.
- Considera i prezzi dei gateway come prodotti separati. Prima di usare $1.20/$3.60 o $1.60/$4.80 nelle previsioni, verifica scadenza della promozione, instradamento del provider, comportamento in caso di fallback, condizioni di conservazione dei dati e costi specifici del percorso.
- Misura le attività completate. Per il coding, monitora test superati, tentativi, chiamate agli strumenti, tempo trascorso e costo totale per modifica accettata.
FAQ sulle API di Grok 4.7
Grok 4.7 è disponibile tramite l’API ufficiale?
Sì. La documentazione di xAI indica il modello grok-4.7 per Responses API e Chat Completions, con esempi per SDK, client compatibili con OpenAI e cURL.
Il prezzo confermato è $2 per l’input e $6 per l’output?
Sì, per la tariffa standard dell’API diretta xAI documentata il 21 settembre 2026. Un endpoint regionale statunitense aggiunge il 10%, mentre i gateway possono mostrare prezzi o promozioni differenti.
Grok 4.7 è valido per il coding?
È un candidato sensato per un progetto pilota con agenti di coding che lavorano a lungo, perché il design documentato include uso degli strumenti, ragionamento regolabile, indicazioni per la compattazione del contesto e fino a 500k token di contesto. Le fonti disponibili non dimostrano in modo indipendente un vantaggio nel coding: testalo quindi sulle attività del tuo repository.
Grok 4.7 ha una finestra di contesto da 500k?
Sì. xAI indica 500.000 token. Cursor descrive separatamente 256k come contesto standard e 500k come livello massimo, con prezzi più elevati oltre 256k.
Grok 4.7 Fast è disponibile tramite l’API pubblica?
No. La documentazione di xAI su Grok 4.7 descrive Grok 4.7 Fast come lo stesso modello eseguito su un’infrastruttura più veloce, al doppio delle tariffe standard, ma specifica che non è disponibile tramite l’API pubblica di xAI. È indicato per Cursor e Grok Build.
La decisione: provalo, ma pianifica i costi sul percorso che userai davvero
L’accesso API a Grok 4.7 e la tariffa base da $2/$6 sono confermati; il suo vantaggio nel coding, invece, non lo è. Se il tuo flusso invia più di 256k token, dipende da contesti di repository non presenti in cache, usa l’instradamento statunitense o attiva numerose chiamate di ragionamento, il costo per attività completata può essere molto diverso. Prima di spostare il lavoro in produzione, comincia con un progetto pilota misurabile.