Rilascio ufficiale di DeepSeek V4: cosa cambia e quando

Ultimo Aggiornamento: 2026-07-20 06:07:37

La prossima cosa da tenere d'occhio di DeepSeek non è R2 o V5. È il rilascio ufficiale di V4 stesso. Diverse testate riportano che DeepSeek punta a un lancio a metà luglio 2026 per la versione ufficiale e, a differenza di un semplice marchio cosmetico "GA", introduce due cambiamenti su cui puoi fare il budget: prezzi API nelle ore di punta e prestazioni più elevate in agentic, matematica e codice. Ciò che puoi chiamare oggi, deepseek-v4-pro e deepseek-v4-flash, è ancora l'anteprima del 24 aprile, e al 20 luglio 2026 la build ufficiale non è ancora apparsa nel registro delle modifiche di DeepSeek. Questo articolo esamina cosa cambia con la versione ufficiale, quando arriverà e se conviene sviluppare ora o aspettare.

Che cosa cambierà il DeepSeek V4 ufficiale

Due cose separano il prossimo rilascio ufficiale dall'anteprima che è online da aprile. Entrambe sono concrete, non marketing.

La tariffazione nelle ore di punta è il titolo principale. In una mossa ancora rara per un API di LLM all’avanguardia, DeepSeek si appresta a misurare V4 in base all’ora del giorno. Secondo InfoWorld e Let's Data Science, le chiamate durante le ore di punta lavorative di Pechino (09:00–12:00 e 14:00–18:00) costeranno il doppio della tariffa fuori punta, mentre i prezzi fuori punta resteranno invariati rispetto a oggi. Le cifre riportate indicano un output di V4-Pro a ¥6 per milione di token fuori punta contro ¥12 nelle ore di punta, e V4-Flash a ¥2 contro ¥4. DeepSeek la presenta come una distribuzione del carico per garantire stabilità, anziché come un aumento lineare, ma l’effetto pratico è lo stesso: il traffico interattivo diurno diventa più costoso, mentre i lavori batch o sensibili alla latenza eseguiti fuori punta restano economici. La tariffazione in base all’ora del giorno è normale nei mercati dell’elettricità e dello cloud spot; vederla su un API di LLM segnala che ora il vincolo principale di DeepSeek è la domanda di inferenza, non l’addestramento.

Le prestazioni migliorano. Lo stesso report afferma che la build ufficiale estende l’anteprima con capacità più solide di agentic, matematica e generazione di codice, e rende la finestra di contesto da 1M token standard in tutta la gamma. Considera la grandezza esatta come non verificata finché non arrivano benchmark indipendenti, ma la direzione è un incremento delle capacità su base degli stessi due ID di modello, non una nuova famiglia.

Cosa *non* cambia: i modelli restano open-weight e continui a chiamare deepseek-v4-pro o deepseek-v4-flash. Quindi il rilascio ufficiale è un evento di prezzo e qualità, non un evento di migrazione.

Quando arriverà la versione ufficiale?

La risposta breve: segnalato per una finestra di metà luglio 2026, ma non ancora confermato come rilasciato. Al 20 luglio 2026, quella finestra è arrivata o è appena passata, e nel registro ufficiale delle modifiche la voce datata più recente è ancora il 24 aprile 2026, l’anteprima. Quindi il chiacchiericcio su "V4 lancia a luglio" è solo in parte corretto: una build ufficiale è stata segnalata, ma non è ancora attiva nella documentazione.

DeepSeek API Change Log showing the April 24, 2026 V4 entry as the latest update, with the July 24 legacy-model deprecation notice

Due segnali affidabili ti diranno che la versione ufficiale è davvero online, e non solo un’altra voce: una nuova voce di registro delle modifiche datata e numeri aggiornati sulla pagina dei prezzi ufficiale. Quando questi cambiano, è stata rilasciata. Fino ad allora, sei nella preview.

Cosa costa V4 oggi e dopo il lancio ufficiale

Il prezzo è il punto in cui la release ufficiale diventa davvero incisiva, quindi vale la pena capire prima il riferimento attuale. Molti articoli citano ancora DeepSeek-V4-Pro a $3.48 per milione di token di output. Quello era il prezzo di lancio ed è ormai passato da tempo.

Ecco i prezzi attuali nella pagina ufficiale dei prezzi di DeepSeek, verificati il 20 luglio 2026 (tutti per 1M token, USD):

ModelloInput (cache hit)Input (cache miss)Output
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

Il motivo per cui Pro si trova a $0.87 e non a $3.48: uno sconto di lancio del 75% lo ha ridotto a un quarto del suo livello originale e, quando la promozione è terminata il 31 maggio 2026, DeepSeek ha mantenuto quella tariffa più bassa come nuovo standard invece di farla tornare al valore precedente.

Bar chart comparing DeepSeek V4 output token price at launch versus current, showing V4-Pro dropping from $3.48 to $0.87 while V4-Flash holds at $0.28

Ora sovrapponi il rilascio ufficiale. Una volta che il prezzo nelle ore di punta entra in vigore, gli attuali $0.87 diventano il prezzo minimo fuori punta per Pro, e le chiamate negli orari lavorativi raddoppiano circa. Per un chatbot che serve utenti dalle 9 alle 5, si tratta di un aumento reale; per una pipeline batch notturna, cambia quasi nulla. Due leve mantengono la spesa invariata: pianificare fuori punta i task tolleranti alla latenza e fare affidamento sul prezzo di input con cache-hit, che è circa 50 volte più economico di un cache miss su Pro. Se stai modellando un carico di lavoro reale, le dinamiche dei costi enterprise dell'esecuzione di DeepSeek dipendono più dal comportamento della cache, dalle finestre di picco e dai limiti di throughput che dal prezzo di listino.

La scadenza del 24 luglio che è già fissata

Un cambiamento con data certa non è una voce di corridoio: il 24 luglio 2026, 15:59 UTC, i nomi dei modelli legacy deepseek-chat e deepseek-reasoner andranno in pensione. Se il tuo codice li richiama ancora, dopo quella data si romperà.

La migrazione è piccola e farla ora ti allinea anche agli ID dei modelli che userà la release ufficiale:

  • Modifica il parametro model in deepseek-v4-flash o deepseek-v4-pro.
  • Mantieni lo stesso base_url (https://api.deepseek.com); non cambia.
  • Entrambi i modelli funzionano tramite l'interfaccia OpenAI ChatCompletions e l'interfaccia Anthropic, quindi la tua libreria client rimane invariata.

Durante la transizione i vecchi nomi mappano alle modalità non-thinking e thinking di deepseek-v4-flash, quindi sei già di fatto su V4 — gli alias semplicemente spariscono. Se instradi DeepSeek tramite un aggregatore, il cambiamento del nome del modello è lo stesso; piattaforme come AIReiter espongono gli ID V4 attraverso lo stesso endpoint compatibile con Anthropic.

Costruire subito sull'anteprima, o aspettare la versione ufficiale?

Per la maggior parte dei team, la risposta è costruire ora — con il rilascio ufficiale già considerato nel prezzo.

L'anteprima è sufficientemente stabile per la produzione e, a $0.87 per milione di token di output fuori picco, economica. V4-Pro alla sua impostazione massima di ragionamento (una modalità che DeepSeek etichetta Pro-Max) è stata riportata intorno all'80.6% su SWE-bench Verified, vicina ai modelli chiusi più forti; quei dati sono auto-riferiti o di terze parti, non i nostri test, quindi vanno considerati di conseguenza. Sul costo, un thread su Reddit ha riassunto l'attrattiva come "17x cheaper" rispetto a ciò che le persone pagavano altrove.

Attendere la build ufficiale garantisce un miglioramento delle prestazioni ma anche il sovrapprezzo delle ore di punta, e ritarda il lavoro per un lancio che, al 20 luglio, non è ancora stato pubblicato nel changelog. La strada pragmatica: rilasciare sulla preview, prevedere il pricing di punta per il traffico interattivo e ripetere i test quando saranno pubblicati i numeri ufficiali.

Quale modello? Gli sviluppatori su Reddit descrivono Flash come un "worker super economico" per compiti ben definiti e scelgono Pro per ragionamenti di livello frontier; i compromessi tra Flash e Pro si riducono a questa distinzione. Due avvertenze valgono in entrambi i casi: il throughput di V4-Pro è limitato dalla capacità (DeepSeek lo ha dichiarato esplicitamente), quindi Pro può essere più lento sotto carico, e V4 è solo testo — immagini, audio e video si trovano in linee DeepSeek separate (Janus, DeepSeek-VL2, DeepSeek-OCR), e non ci si aspetta che la release ufficiale cambi questo aspetto.

Che dire di R2 e V5?

Nemmeno questo è il racconto a breve termine, nonostante il volume di ricerca. R2 non è stato rilasciato e non c’è una data confermata; DeepSeek ha smentito finestre specifiche, e le “specifiche” trapelate si contraddicono a vicenda (un modello MoE da ~1,2T in una fuga di notizie, un modello dense da 32B in un’altra). V5 è ancora più inconsistente: l’affermazione virale “V5 il 24 luglio” è una lettura errata della data di ritiro dell’alias legacy. La prossima tappa credibile è quella di cui parla questo articolo — il V4 ufficiale — non una nuova generazione.

FAQ

Quando uscirà il DeepSeek V4 ufficiale?

Numerose fonti hanno riportato una finestra a metà luglio 2026, ma non era ancora comparsa nel registro delle modifiche dell'API al 20 luglio 2026. Controlla il registro delle modifiche e la pagina dei prezzi per confermare che sia effettivamente stata distribuita.

Cosa c'è di nuovo nella V4 ufficiale rispetto alla preview?

Due cose: prezzi API nelle ore di punta (le chiamate in orario lavorativo costano circa il doppio rispetto alla tariffa fuori punta) e prestazioni migliori in ambito agentic, matematica e codice, con contesto da 1M standard in tutta la gamma. Gli ID dei modelli e la licenza open-weight restano invariati.

Quanto costerà il DeepSeek V4 ufficiale?

Si prevede che il prezzo fuori picco corrisponda alla tariffa odierna: $0.87 per 1M token di output per V4-Pro, $0.28 per V4-Flash. Le chiamate nelle ore di punta costeranno circa il doppio. L'input con cache-hit è molto più economico in entrambi i casi.

DeepSeek V4 è utilizzabile adesso?

Sì. V4-Pro e V4-Flash sono stati pubblici, open-weight (con licenza MIT, sull’organizzazione Hugging Face di DeepSeek), e richiamabili dal 24 aprile 2026. Non è necessario attendere il rilascio ufficiale per sviluppare su di essi.

Devo eseguire la migrazione prima del 24 luglio 2026?

Solo se il tuo codice richiama ancora deepseek-chat o deepseek-reasoner. Sostituisci il nome del modello con deepseek-v4-flash o deepseek-v4-pro prima del 24 luglio 2026, 15:59 UTC; nient'altro nella tua richiesta cambia.