Se il costo pesa sul budget, scegli DeepSeek V4 Pro; se conta soprattutto la latenza, Grok. È la distinzione emersa nei sette test eseguiti via API. C'è però una riserva importante: la stessa pagina dei prezzi di DeepSeek avverte di un aumento significativo imminente, che ridurrebbe gran parte del vantaggio su cui si basa questa raccomandazione.
Che cosa si sta davvero confrontando ad agosto 2026
Nella settimana che ha preceduto questo confronto, entrambi i modelli hanno cambiato identità. Grok 4.6 occupa ora lo slot Latest nella documentazione dei modelli xAI, dove viene presentato come il flagship "for code and everything else"; DeepSeek V4 Pro viene invece servito attraverso lo snapshot DeepSeek-V4-Pro-0813. Nessuno dei due cambiamenti è visibile nell'ID del modello API.
La stringa della versione DeepSeek compare soltanto nella riga MODEL VERSION della pagina dei prezzi. L'API continua a rispondere al semplice deepseek-v4-pro, senza suffisso con data: una richiesta inviata oggi e una inviata a luglio hanno quindi lo stesso aspetto nei log, pur potendo raggiungere pesi diversi.
Ecco il confronto completo tra specifiche e prezzi, ricavato dalla pagina dei prezzi di xAI e dalla pagina dei prezzi di DeepSeek il 13 agosto 2026:
| Grok 4.6 | DeepSeek V4 Pro (0813) | |
|---|---|---|
| Finestra di contesto | 500K | 1M |
| Output massimo | Non pubblicato | 384K |
| Input / 1M | $2.00 | $0.435 |
| Input in cache / 1M | $0.50 | $0.003625 |
| Output / 1M | $6.00 | $0.87 |
| Tariffa per contesto lungo | 2x su tutte le tariffe a ≥200K prompt | Nessuna |
| Input immagini | Sì | No |
| Chiamate di strumenti | Sì | Sì |
| Ragionamento | Configurabile | Thinking / non-thinking |
| Knowledge cutoff | 1 febbraio 2026 | Non pubblicato |
Grok 4.6 mantiene le tariffe principali di Grok 4.5, $2.00 e $6.00. L'unico prezzo cambiato è quello dell'input in cache: nella stessa tabella xAI indica $0.30 per Grok 4.5 e $0.50 per Grok 4.6. Riutilizzare la cache sul modello più nuovo costa quindi il 67% in più.
I gateway di terze parti servono ancora Grok 4.5
La presenza nella documentazione xAI non implica che il modello sia disponibile ovunque si acquistino token. Sul gateway usato per il test, grok-4.6 restituiva un errore model_not_found, mentre gli alias grok-latest e grok venivano entrambi risolti in grok-4.5-build. Se accedi a Grok tramite un rivenditore anziché dall'API di xAI, verifica a quale modello punta davvero l'alias prima di darne per certa la versione.
Questo ritardo spiega anche perché le misurazioni qui sotto sono state effettuate su grok-4.5 e non su 4.6. Dato che le due versioni hanno lo stesso prezzo per input e output, le conclusioni sui costi restano applicabili; i risultati di accuratezza per attività riguardano invece la 4.5.
La vera differenza è nel rispetto delle istruzioni
Su sette attività con verifica meccanica, sei sono finite in parità e una ha mostrato una separazione netta. Il compito chiedeva esattamente quattro righe, ciascuna conclusa da una descrizione di esattamente cinque parole. DeepSeek V4 Pro ha superato 5 tentativi su 5; Grok 0 su 5.
Gli errori di Grok non erano la replica dello stesso bug. In due esecuzioni ha emesso una chiamata allo strumento web_search grezza come testo della risposta anziché fornire una risposta. Una recitava per intero: "I need accurate information on the four stages of canary deployment. Let me search for that." In altre due esecuzioni ha rispettato la struttura di quattro righe, ma ha sbagliato il conteggio delle descrizioni, con quattro e sei parole. Un tentativo è arrivato a 130 secondi e 10,357 token di output, restituendo 331 righe.
La fuoriuscita della chiamata sembra probabilmente dovuta al gateway, non al modello: un prompt di 6 token viene riportato come 201 token di input, indizio di un preambolo iniettato che dichiara gli strumenti server-side di xAI. Gli errori nel conteggio delle parole sono un problema separato: quelle esecuzioni hanno risposto normalmente, ma hanno comunque ignorato il vincolo.
Metodo: deepseek-v4-pro e grok-4.5 attraverso lo stesso gateway compatibile con OpenAI, con impostazioni predefinite; una esecuzione per attività, tranne il test di formattazione, effettuato cinque volte per ciascun modello. Ogni attività aveva una risposta verificabile meccanicamente, quindi per la valutazione non è stato usato alcun modello giudice. Le sei attività terminate in parità sono elencate per nome nella tabella dei costi qui sotto.
Entrambi i modelli hanno accettato una premessa falsa
La settima attività inseriva due errori nel prompt: che DeepSeek V4 Pro avesse una finestra di contesto di 128K e che Grok 4.6 fosse stato lanciato a gennaio 2026 con 2M di contesto. Ho poi chiesto quale usare per un corpus da 900.000 token. Nessuno dei due modelli ha contestato le cifre. Entrambi hanno ragionato correttamente partendo dai numeri sbagliati, arrivando con sicurezza alla raccomandazione di Grok.
Se incolli nel prompt specifiche obsolete e chiedi una raccomandazione, entrambi i modelli possono consegnarti una risposta sbagliata ma ben argomentata, anziché correggere i dati di partenza.
Grok genera meno token, ma costa comunque 5,7x di più
Sulle sei attività completate da entrambi, Grok ha prodotto 5,275 token di output contro i 6,331 di DeepSeek, il 17% in meno. Applicando le tariffe ufficiali di output di ciascun modello, le stesse risposte costano $0.0317 con Grok e $0.0055 con DeepSeek: un divario di 5,7x a sfavore di Grok.
| Attività | Token DeepSeek | Token Grok | Costo DeepSeek | Costo Grok |
|---|---|---|---|---|
| JSON rigoroso | 147 | 219 | 0.013¢ | 0.131¢ |
| Unione di intervalli | 384 | 416 | 0.033¢ | 0.250¢ |
| Needle da 56K | 181 | 174 | 0.016¢ | 0.104¢ |
| Aritmetica dei prezzi | 520 | 647 | 0.045¢ | 0.388¢ |
| Parser di durata | 4,087 | 2,611 | 0.356¢ | 1.567¢ |
| Aggregazione SQL | 1,012 | 1,208 | 0.088¢ | 0.725¢ |
| Totale | 6,331 | 5,275 | 0.551¢ | 3.165¢ |
L'efficienza dei token è reale, ma non basta: nel parser di durata Grok è stato più conciso, con 2,611 token contro 4,087, eppure quella risposta è costata comunque quattro volte tanto.
Proiettando i dati su un mese di lavoro, il calcolo è semplice da rifare: 1,000 richieste da 50,000 token di input non in cache e 3,000 token di output ciascuna equivalgono a 50M di input e 3M di output. Con Grok 4.6 sono $100.00 più $18.00, cioè $118.00. Con DeepSeek V4 Pro sono $21.75 più $2.61, cioè $24.36.
Grok è stato più veloce in tutte e sei le attività e il margine cresceva con la lunghezza: 48.8 secondi contro 83.3 nel parser di durata, rispetto a 3.7 contro 5.4 nell'attività JSON. Si tratta di singole esecuzioni su un gateway condiviso: i divari piccoli vanno considerati rumore, quello ampio è indicativo della tendenza.
Due regole di fatturazione che le tabelle non mostrano
Due meccanismi tariffari incidono sulla bolletta reale più delle tariffe di listino, e nessuno dei due compare come colonna in una tabella delle specifiche.
La soglia per il contesto lungo di xAI è un gradino, non una progressione. Qualsiasi richiesta con un prompt che raggiunge 200,000 token viene fatturata al doppio della tariffa per ogni token della richiesta, non soltanto per quelli oltre la soglia. Un prompt da 199,000 token costa $0.398 in input; uno da 201,000 token costa $0.804. Superare la soglia dell'1% raddoppia il conto.
La cache di DeepSeek costa quasi nulla. Un cache hit costa $0.003625 per 1M token di input, contro i $0.50 di Grok 4.6: circa 138 volte meno. Nel lavoro ripetuto su una codebase stabile, è questo il dato che decide la fattura. Uno sviluppatore su Hacker News ha riportato:
L'API ufficiale di DeepSeek ha un cache hit rate superiore al 99% se la si usa in modo continuativo sulla stessa codebase durante sessioni lunghe, quindi è molto più economica dei modelli frontier. Ho un esempio di sessione da 200M token in claude code.
Il punto critico è che le tariffe DeepSeek sono dichiaratamente temporanee. La pagina dei prezzi include una nota: "Prevediamo di aumentare prossimamente il prezzo complessivo dei servizi API DeepSeek, con un aumento significativo atteso." Un'analisi su Hacker News dei prezzi promozionali di DeepSeek colloca le tariffe pre-sconto a $1.74 per l'input e $3.48 per l'output. Il calcolo è coerente, perché $0.435 e $0.87 corrispondono esattamente a un quarto di tali cifre, ma DeepSeek non ha pubblicato i termini della promozione.
Se l'aumento arrivasse a quei livelli, lo scenario mensile sopra passerebbe da $24.36 a $97.44, contro i $118.00 di Grok. Il divario nel prezzo dell'output si ridurrebbe da 6.9x a circa 1.7x, e una scelta basata esclusivamente sul prezzo non sarebbe più così evidente.
Quale modello usare
Scegli DeepSeek V4 Pro per carichi elevati, sensibili ai costi e con contesto ripetuto: elaborazioni batch, lunghe sessioni di coding agentico sulla stessa repository e qualsiasi attività oltre circa 200K token per prompt, dove la soglia di Grok raddoppia la tariffa. La finestra di contesto da 1M e la cache quasi gratuita giocano insieme a tuo favore, e il modello ha rispettato il vincolo di formato esatto in tutti e cinque i tentativi. Puoi usarlo direttamente dalla pagina API di DeepSeek V4 Pro.
Scegli Grok 4.6 per lavori sensibili alla latenza e multimodali. Grok è stato più rapido in ogni attività, anche se sia questo risultato sia quello sul formato sono stati misurati sulla 4.5, non sulla 4.6. Accetta input di immagini, dove DeepSeek non lo fa, e il suo knowledge cutoff pubblicato, 1 febbraio 2026, è quantomeno dichiarato. Se instradi le richieste attraverso un gateway, verifica di ricevere davvero la 4.6 e non la 4.5. Grok su AIReiter e ogni altro rivenditore ereditano la versione configurata a monte.
Non scegliere nessuno dei due basandoti su un prezzo annunciato. La nota di DeepSeek rende il vantaggio attuale un bersaglio mobile, e la tariffa per l'input in cache di Grok è già salita del 67% tra 4.5 e 4.6. Prima di vincolare un carico di lavoro, ripeti i calcoli sopra sulle pagine dei prezzi aggiornate.
FAQ
Grok 4.6 è stato effettivamente rilasciato?
Sì. Al 13 agosto 2026 Grok 4.6 compare nella documentazione dei modelli xAI nella posizione Latest, con prezzo pubblicato di $2.00 per l'input e $6.00 per l'output per 1M token e una finestra di contesto da 500K. I gateway di terze parti potrebbero però continuare a instradare grok-latest verso Grok 4.5.
Che cos'è DeepSeek-V4-Pro-0813?
È la stringa di versione del modello che DeepSeek serve attualmente dietro l'endpoint API deepseek-v4-pro, indicata nella riga MODEL VERSION della pagina ufficiale dei prezzi. L'ID API non ha un suffisso con data, quindi lo snapshot può cambiare senza alcuna modifica nella richiesta.
Quale modello ha la finestra di contesto più ampia?
DeepSeek V4 Pro, con 1M token contro i 500K di Grok 4.6. DeepSeek pubblica anche un output massimo di 384K; xAI non pubblica un valore massimo di output per Grok 4.6.
DeepSeek V4 Pro costa meno di Grok 4.6?
Ai prezzi di listino del 13 agosto 2026, sì: costa 4.6x meno per l'input e 6.9x meno per l'output. La pagina dei prezzi DeepSeek avverte di un aumento significativo e, alle tariffe pre-promozione individuate dagli sviluppatori, il divario sull'output scenderebbe a circa 1.7x.
Quale dei due segue le istruzioni con maggiore affidabilità?
Nell'unico test che li ha distinti, DeepSeek V4 Pro ha rispettato un vincolo di formato esatto in 5 tentativi su 5, mentre Grok in 0 su 5. Entrambi i modelli non hanno contestato specifiche false inserite nel prompt.
Approfondimenti correlati: GPT-5.6 Luna vs DeepSeek V4 Pro