Sortie officielle de DeepSeek V4 : qu’est-ce qui change et quand

Dernière mise à jour: 2026-07-20 06:08:17

La prochaine chose à surveiller chez DeepSeek n’est ni R2 ni V5. C’est la sortie officielle de V4 elle-même. Plusieurs médias rapportent que DeepSeek vise un lancement à la mi-juillet 2026 pour la version officielle, et contrairement à un simple label "GA" cosmétique, elle apporte deux changements à intégrer dans votre budget : une tarification API aux heures de pointe et de meilleures performances agentiques, en mathématiques et en code. Ce que vous pouvez appeler aujourd’hui, deepseek-v4-pro et deepseek-v4-flash, reste encore l’aperçu du 24 avril, et au 20 juillet 2026, la version officielle n’apparaît toujours pas dans le journal des modifications de DeepSeek. Cet article examine ce que change la version officielle, quand elle arrivera, et s’il faut construire maintenant ou attendre.

Ce que le DeepSeek V4 officiel changera

Deux éléments distinguent la prochaine version officielle de l’aperçu qui est en ligne depuis avril. Les deux sont concrets, et non marketing.

La tarification aux heures de pointe est le point principal. Dans une initiative encore rare pour une API LLM de pointe, DeepSeek s’apprête à facturer V4 selon l’heure de la journée. Selon InfoWorld et Let's Data Science, les appels effectués pendant les heures de bureau de pointe à Pékin (09:00–12:00 et 14:00–18:00) coûteront deux fois le tarif hors pointe, tandis que les prix hors pointe resteront inchangés. Les chiffres rapportés situent la sortie de V4-Pro à 6 ¥ par million de tokens hors pointe contre 12 ¥ en période de pointe, et V4-Flash à 2 ¥ contre 4 ¥. DeepSeek présente cela comme une répartition de la charge pour améliorer la stabilité plutôt que comme une hausse uniforme, mais l’effet pratique est le même : le trafic interactif en journée devient plus coûteux, et les tâches tolérantes à la latence ou les lots exécutés hors pointe restent bon marché. La tarification selon l’heure est courante sur les marchés de l’électricité et du cloud spot ; le fait de la voir appliquée à une API LLM montre que la demande d’inférence, et non l’entraînement, est désormais la contrainte limitante de DeepSeek.

Les performances augmentent. Le même rapport indique que la version officielle étend l’aperçu avec de meilleures capacités agentiques, mathématiques et de génération de code, et rend la fenêtre de contexte de 1 M de tokens standard sur toute la gamme. Considérez l’ampleur exacte comme non vérifiée tant que des benchmarks indépendants n’auront pas été publiés, mais la tendance est à une amélioration des capacités, en plus des mêmes deux identifiants de modèle, et non à une nouvelle famille.

Ce qui ne change pas : les modèles restent open-weight, et vous continuez à appeler deepseek-v4-pro ou deepseek-v4-flash. Ainsi, la sortie officielle est un événement de tarification et de qualité, et non un événement de migration.

Quand la version officielle sera-t-elle disponible ?

La réponse courte : annoncé pour une fenêtre de mi-juillet 2026, mais pas encore confirmé comme déployé. Au 20 juillet 2026, cette fenêtre est atteinte ou tout juste dépassée, et dans le journal des modifications officiel, l’entrée datée la plus récente est toujours celle du 24 avril 2026, l’aperçu. Donc, les rumeurs sur « V4 lancée en juillet » sont à moitié vraies : une version officielle est annoncée, mais elle n’est pas encore en ligne dans la documentation.

DeepSeek API Change Log showing the April 24, 2026 V4 entry as the latest update, with the July 24 legacy-model deprecation notice

Deux signes fiables vous indiqueront que la version officielle est réellement en ligne, plutôt qu’une autre rumeur : une nouvelle entrée datée dans le journal des modifications et des chiffres mis à jour sur la page de tarification officielle. Quand ces éléments changent, c’est publié. D’ici là, vous êtes sur l’aperçu.

Ce que coûte V4 aujourd’hui, et après le lancement officiel

Le prix est là où la version officielle frappe fort, donc il vaut la peine de comprendre d’abord la base actuelle. Beaucoup d’articles citent encore DeepSeek-V4-Pro à 3,48 $ par million de tokens de sortie. C’était le prix de lancement et il appartient depuis longtemps au passé.

Voici les tarifs actuels sur la page tarifaire officielle de DeepSeek, vérifiés le 20 juillet 2026 (tous par 1M tokens, USD) :

ModèleEntrée (cache hit)Entrée (cache miss)Sortie
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

La raison pour laquelle Pro est à 0,87 $ et non à 3,48 $ : une réduction de lancement de 75 % l’a ramené à un quart de son niveau initial, et lorsque la promotion a pris fin le 31 mai 2026, DeepSeek a conservé ce tarif plus bas comme nouveau standard au lieu de le laisser revenir à son niveau précédent.

Bar chart comparing DeepSeek V4 output token price at launch versus current, showing V4-Pro dropping from $3.48 to $0.87 while V4-Flash holds at $0.28

Ajoutez maintenant la publication officielle par-dessus. Une fois la tarification aux heures de pointe mise en place, les 0,87 $ d’aujourd’hui deviennent le plancher hors pointe pour Pro, et les appels en heures ouvrées doublent environ. Pour un chatbot servant des utilisateurs de 9 h à 17 h, c’est une hausse réelle ; pour un pipeline batch de nuit, cela ne change presque rien. Deux leviers permettent de maintenir les dépenses stables : planifier les tâches tolérantes hors pointe, et miser sur la tarification des entrées avec cache-hit, qui est environ 50 fois moins chère qu’un cache miss sur Pro. Si vous modélisez une charge de travail réelle, les dynamiques de coûts en entreprise liées à l’exécution de DeepSeek dépendent davantage du comportement du cache, des fenêtres de pointe et des limites de débit que du prix affiché.

La date limite du 24 juillet qui est déjà fixée

Un changement daté n’est pas une rumeur : le 24 juillet 2026, 15:59 UTC, les anciens noms de modèle deepseek-chat et deepseek-reasoner prennent leur retraite. Si votre code les appelle encore, il cessera de fonctionner après cette date.

La migration est légère, et la faire maintenant vous place aussi sur les IDs de modèles que la version officielle utilisera :

  • Modifiez le paramètre model en deepseek-v4-flash ou deepseek-v4-pro.
  • Conservez la même base_url (https://api.deepseek.com) ; elle ne change pas.
  • Les deux modèles fonctionnent via l'interface OpenAI ChatCompletions et l'interface Anthropic, donc votre bibliothèque cliente reste en place.

Pendant la transition, les anciens noms correspondent aux modes non réfléchissant et réfléchissant de deepseek-v4-flash, donc vous êtes déjà en pratique sur V4 — les alias disparaissent simplement. Si vous acheminiez DeepSeek via un agrégateur, le changement de nom du modèle est le même ; des plateformes comme AIReiter exposent les identifiants V4 via le même endpoint compatible Anthropic.

Construire dès maintenant sur la version d’aperçu, ou attendre la version officielle ?

Pour la plupart des équipes, la réponse est construire maintenant — avec la version officielle intégrée dans le prix.

L’aperçu est suffisamment stable pour la production et, à 0,87 $ par million de jetons de sortie hors pointe, peu coûteux. V4-Pro, avec son réglage de raisonnement maximal (un mode que DeepSeek appelle Pro-Max), aurait atteint environ 80,6 % sur SWE-bench Verified, soit presque le niveau des modèles fermés les plus performants ; ces chiffres sont auto-déclarés ou proviennent de tiers, pas de nos propres tests, donc il faut les interpréter en conséquence. En matière de coût, un fil Reddit a résumé l’attrait par « 17 fois moins cher » que ce que les gens payaient ailleurs.

Attendre la version officielle vous apporte un gain de performances, mais aussi la surtaxe des heures de pointe, et cela retarde le travail pour un lancement qui, au 20 juillet, n’a pas encore été publié dans le journal des modifications. L’approche pragmatique : livrer sur la version d’aperçu, prévoir le tarif des heures de pointe pour le trafic interactif, et re-tester lorsque les chiffres officiels seront publiés.

Quel modèle ? Les développeurs sur Reddit décrivent Flash comme un « super worker à bas coût » pour des tâches bien délimitées et se tournent vers Pro pour un raisonnement de niveau frontier ; les compromis Flash contre Pro se résument à cette répartition. Deux réserves s’appliquent dans tous les cas : le débit de V4-Pro est limité par la capacité (DeepSeek l’a dit explicitement), donc Pro peut être plus lent sous charge, et V4 est uniquement textuel — l’image, l’audio et la vidéo relèvent de lignes DeepSeek séparées (Janus, DeepSeek-VL2, DeepSeek-OCR), et la version officielle ne devrait pas changer cela.

Qu’en est-il de R2 et V5 ?

Aucune des deux n’est donc l’histoire à court terme, malgré le volume de recherche. R2 n’est pas encore sorti et aucune date n’est confirmée ; DeepSeek a démenti des fenêtres précises, et les « spécifications » divulguées se contredisent (un modèle MoE d’environ 1,2T dans une fuite, un modèle dense de 32B dans une autre). V5 l’est encore davantage : l’affirmation virale selon laquelle « V5 arriverait le 24 juillet » est une mauvaise interprétation de la date de retrait de l’ancien alias. La prochaine étape crédible est celle dont parle cet article — le V4 officiel — et non une nouvelle génération.

FAQ

Quand la version officielle de DeepSeek V4 sera-t-elle disponible ?

Plusieurs médias ont signalé une fenêtre à la mi-juillet 2026, mais elle n’apparaissait pas dans le journal des modifications de l’API au 20 juillet 2026. Consultez le journal des modifications et la page de tarification pour confirmer qu’elle a bien été lancée.

Quoi de neuf dans la version officielle V4 par rapport à la version d’aperçu ?

Deux choses : la tarification API en heures de pointe (les appels pendant les heures ouvrables coûtent environ le double du tarif hors pointe) et de meilleures performances agentiques, en mathématiques et en code, avec un contexte de 1M standard sur toute la gamme. Les ID de modèle et la licence open-weight restent inchangés.

Combien coûtera le DeepSeek V4 officiel ?

La tarification hors pointe devrait correspondre au tarif actuel : 0,87 $ par 1M de jetons de sortie pour V4-Pro, 0,28 $ pour V4-Flash. Les appels pendant les heures de pointe devraient coûter environ deux fois plus. Les entrées avec cache-hit sont bien moins chères dans les deux cas.

DeepSeek V4 est-il utilisable dès maintenant ?

Oui. V4-Pro et V4-Flash sont publics, open-weight (sous licence MIT, sur l’organisation Hugging Face de DeepSeek), et appelables depuis le 24 avril 2026. Vous n’avez pas besoin d’attendre la sortie officielle pour les utiliser.

Dois-je migrer avant le 24 juillet 2026 ?

Seulement si votre code appelle encore deepseek-chat ou deepseek-reasoner. Passez le nom du modèle à deepseek-v4-flash ou deepseek-v4-pro avant le 24 juillet 2026 à 15:59 UTC ; rien d’autre dans votre requête ne change.