Offizielle Veröffentlichung von DeepSeek V4: Was sich ändert und wann

Zuletzt aktualisiert: 2026-07-20 06:07:38

Das Nächste, worauf man bei DeepSeek achten sollte, ist nicht R2 oder V5. Es ist die offizielle Veröffentlichung von V4 selbst. Mehrere Medien berichten, dass DeepSeek einen Start der offiziellen Version Mitte Juli 2026 anstrebt, und anders als ein rein kosmetisches „GA“-Label bringt sie zwei Änderungen mit, auf die man bei der Budgetplanung zählen kann: API-Preise zu Spitzenzeiten und stärkere Performance bei Agentik, Mathematik und Code. Was man heute aufrufen kann, deepseek-v4-pro und deepseek-v4-flash, ist weiterhin die Vorschau vom 24. April, und Stand 20. Juli 2026 ist der offizielle Build in DeepSeeks Änderungsprotokoll noch nicht erschienen. Dieser Artikel betrachtet, was die offizielle Version ändert, wann sie erscheint und ob man jetzt bauen oder warten sollte.

Was das offizielle DeepSeek V4 ändern wird

Zwei Dinge unterscheiden die bevorstehende offizielle Veröffentlichung von der Vorschau, die seit April live ist. Beide sind konkret, nicht Marketing.

Spitzenzeitpreise sind die Schlagzeile. In einem für eine Frontier-LLM-API noch immer seltenen Schritt wird DeepSeek V4 offenbar nach Tageszeit abrechnen. Laut InfoWorld und Let's Data Science werden Aufrufe während der Spitzen-Businesszeiten in Beijing (09:00–12:00 und 14:00–18:00) doppelt so viel kosten wie der Tarif außerhalb der Spitzenzeiten, während die Preise außerhalb der Spitzenzeiten unverändert bleiben. Die gemeldeten Zahlen setzen die Ausgabe von V4-Pro bei ¥6 pro Million Tokens außerhalb der Spitzenzeiten und bei ¥12 zur Spitzenzeit an, und V4-Flash bei ¥2 beziehungsweise ¥4. DeepSeek stellt dies als Lastverteilung zur Stabilisierung dar und nicht als pauschale Preiserhöhung, aber die praktische Wirkung ist dieselbe: Interaktiver Tagesverkehr wird teurer, und latenzunempfindliche oder Batch-Jobs, die außerhalb der Spitzenzeiten laufen, bleiben günstig. Tageszeitabhängige Preise sind bei Strom- und Cloud-Spot-Märkten normal; dass man sie bei einer LLM-API sieht, signalisiert, dass nun die Inferenznachfrage und nicht das Training DeepSeeks bindender Engpass ist.

Die Leistung steigt. Der gleiche Bericht sagt, dass der offizielle Build die Vorschau mit stärkerer agentischer, mathematischer und Code-Generierungsfähigkeit erweitert und das 1M-Token-Kontextfenster in der gesamten Produktreihe zum Standard macht. Behandeln Sie den genauen Umfang als unbestätigt, bis unabhängige Benchmarks vorliegen, aber die Tendenz geht in Richtung einer Fähigkeitssteigerung auf Basis derselben zwei Modell-IDs, nicht einer neuen Familie.

Was sich nicht ändert: Die Modelle bleiben Open-Weight, und Sie rufen weiterhin deepseek-v4-pro oder deepseek-v4-flash auf. Die offizielle Veröffentlichung ist also ein Preis-und-Qualitäts-Event, kein Migrations-Event.

Wann kommt die offizielle Version?

Die kurze Antwort: Für ein Zeitfenster Mitte Juli 2026 gemeldet, aber noch nicht als ausgeliefert bestätigt. Stand 20. Juli 2026 liegt dieses Zeitfenster bei oder bereits knapp hinter uns, und im offiziellen Änderungsprotokoll ist der neueste datierte Eintrag immer noch der 24. April 2026, die Vorschau. Das Gerede über „V4 startet im Juli“ ist also halb richtig: Ein offizieller Build wurde gemeldet, aber er ist in den Docs noch nicht live.

DeepSeek API Change Log showing the April 24, 2026 V4 entry as the latest update, with the July 24 legacy-model deprecation notice

Zwei verlässliche Signale zeigen dir, dass die offizielle Version tatsächlich live ist und nicht nur ein weiteres Gerücht: ein neuer datierten Änderungsprotokoll-Eintrag und aktualisierte Zahlen auf der offiziellen Preisseite. Wenn sich diese ändern, wurde sie veröffentlicht. Bis dahin befindest du dich in der Vorschau.

Was V4 heute kostet und nach dem offiziellen Start

Die Preisgestaltung ist der Punkt, an dem die offizielle Veröffentlichung zuschlägt, daher lohnt es sich, zunächst die aktuelle Basis zu verstehen. Viele Berichte nennen DeepSeek-V4-Pro immer noch mit 3,48 $ pro Million Ausgabe-Token. Das war der Einführungspreis und ist längst vorbei.

Hier ist die aktuelle Preisgestaltung auf der offiziellen Preisseite von DeepSeek, geprüft am 20. Juli 2026 (alle Preise pro 1 Mio. Tokens, USD):

ModellEingabe (Cache-Treffer)Eingabe (Cache-Fehlschlag)Ausgabe
deepseek-v4-flash$0.0028$0.14$0.28
deepseek-v4-pro$0.003625$0.435$0.87

Der Grund, warum Pro bei $0.87 und nicht bei $3.48 liegt: Ein 75% Einführungsrabatt senkte den Preis auf ein Viertel des ursprünglichen Niveaus, und als die Aktion am May 31, 2026 endete, behielt DeepSeek diesen niedrigeren Satz als neuen Standard bei, statt ihn wieder anzuheben.

Bar chart comparing DeepSeek V4 output token price at launch versus current, showing V4-Pro dropping from $3.48 to $0.87 while V4-Flash holds at $0.28

Nun die offizielle Veröffentlichung obendrauf. Sobald die Spitzenzeiten-Preisgestaltung greift, werden die heutigen 0,87 $ zum Tiefstpreis außerhalb der Spitzenzeiten für Pro, und Anrufe während der Geschäftszeiten verdoppeln sich ungefähr. Für einen Chatbot, der Nutzer von 9 bis 5 bedient, ist das ein echter Anstieg; für eine nächtliche Batch-Pipeline ändert sich fast nichts. Zwei Hebel halten die Ausgaben konstant: tolerante Arbeit außerhalb der Spitzenzeiten einplanen und auf die Eingabepreisgestaltung bei Cache-Treffern setzen, die bei Pro etwa 50-mal günstiger ist als ein Cache-Miss. Wenn Sie eine reale Arbeitslast modellieren, hängen die Unternehmenskostendynamiken beim Betrieb von DeepSeek eher von Cache-Verhalten, Spitzenfenstern und Durchsatzgrenzen ab als vom Listenpreis.

Die Frist vom 24. Juli, die bereits festgelegt ist

Eine fest terminierte Änderung ist kein Gerücht: Am 24. Juli 2026, 15:59 UTC werden die alten Modellnamen deepseek-chat und deepseek-reasoner eingestellt. Wenn Ihr Code sie noch aufruft, funktioniert er danach nicht mehr.

Die Migration ist klein, und wenn Sie sie jetzt durchführen, verwenden Sie auch die Modell-IDs, die die offizielle Veröffentlichung nutzen wird:

  • Ändern Sie den model-Parameter auf deepseek-v4-flash oder deepseek-v4-pro.
  • Behalten Sie die gleiche base_url (https://api.deepseek.com); sie ändert sich nicht.
  • Beide Modelle funktionieren über die OpenAI ChatCompletions-Schnittstelle und die Anthropic-Schnittstelle, sodass Ihre Client-Bibliothek unverändert bleibt.

Während der Umstellung werden die alten Namen den non-thinking- und thinking-Modi von deepseek-v4-flash zugeordnet, sodass Sie faktisch bereits auf V4 sind — die Aliase entfallen lediglich. Wenn Sie DeepSeek über einen Aggregator leiten, ist die Änderung des Modellnamens dieselbe; Plattformen wie AIReiter stellen die V4-IDs über denselben Anthropic-kompatiblen Endpunkt bereit.

Auf der Vorschau jetzt aufbauen oder auf die offizielle Version warten?

Für die meisten Teams lautet die Antwort jetzt bauen — mit der offiziellen Veröffentlichung einkalkuliert.

Die Vorschau ist stabil genug für den Produktionseinsatz und mit $0.87 pro Million Output-Tokens außerhalb der Spitzenzeiten günstig. V4-Pro hat bei der höchsten Reasoning-Einstellung (einem Modus, den DeepSeek Pro-Max nennt) Berichten zufolge etwa 80.6% auf SWE-bench Verified erreicht, nahe an den stärksten geschlossenen Modellen; diese Zahlen sind selbst berichtet oder von Dritten, nicht unsere eigenen Tests, also sollten Sie sie entsprechend gewichten. Was die Kosten betrifft, fasste ein Reddit-Thread den Anreiz mit „17x günstiger“ zusammen als das, was die Leute anderswo zahlten.

Das Warten auf den offiziellen Build bringt Ihnen zwar einen Leistungsschub, aber auch den Spitzenstundenzuschlag, und es verzögert die Arbeit an einem Launch, der Stand 20. Juli noch nicht im Änderungsprotokoll veröffentlicht wurde. Der pragmatische Weg: auf der Vorschau ausliefern, Spitzenpreise für interaktiven Traffic einplanen und erneut testen, wenn die offiziellen Zahlen veröffentlicht werden.

Welches Modell? Entwickler auf Reddit beschreiben Flash als einen „super billigen Worker“ für klar abgegrenzte Aufgaben und greifen bei erstklassigem Reasoning zu Pro; die Flash-vs.-Pro-Abwägungen laufen auf diese Aufteilung hinaus. Zwei Vorbehalte gelten in beiden Fällen: Der Durchsatz von V4-Pro ist durch die Kapazität begrenzt (DeepSeek hat das selbst so gesagt), daher kann Pro unter Last langsamer sein, und V4 ist nur Text — Bilder, Audio und Video werden in separaten DeepSeek-Linien behandelt (Janus, DeepSeek-VL2, DeepSeek-OCR), und vom offiziellen Release wird nicht erwartet, dass sich daran etwas ändert.

Was ist mit R2 und V5?

Auch das ist nicht die kurzfristige Geschichte, trotz des Suchvolumens. R2 ist noch nicht veröffentlicht und hat kein bestätigtes Datum; DeepSeek hat konkrete Zeitfenster dementiert, und die geleakten „Specs“ widersprechen sich gegenseitig (ein ~1.2T MoE-Modell in einem Leak, ein 32B-dichtes Modell in einem anderen). V5 ist noch dünner: Die virale Behauptung „V5 am 24. Juli“ ist eine Fehlinterpretation des Auslaufdatums des Legacy-Alias. Der glaubwürdige nächste Meilenstein ist der, um den es in diesem Artikel geht — das offizielle V4 — und nicht eine neue Generation.

FAQ

Wann erscheint das offizielle DeepSeek V4?

Mehrere Medien berichteten über ein Zeitfenster Mitte Juli 2026, aber es war bis zum 20. Juli 2026 noch nicht im API-Änderungsprotokoll aufgetaucht. Beobachten Sie das Änderungsprotokoll und die Preisseite, um die Bestätigung zu erhalten, dass es tatsächlich veröffentlicht wurde.

Was ist neu in der offiziellen V4 im Vergleich zur Vorschau?

Zwei Dinge: API-Preise zu Spitzenzeiten (Anrufe während der Geschäftszeiten kosten ungefähr das Doppelte des Tarifs außerhalb der Spitzenzeiten) und stärkere agentische, mathematische und Code-Leistung, mit 1M Kontext standardmäßig über die gesamte Produktreihe. Die Modell-IDs und die Open-Weight-Lizenzierung bleiben gleich.

Wie viel wird die offizielle DeepSeek V4 kosten?

Es wird erwartet, dass die Off-Peak-Preisgestaltung dem heutigen Satz entspricht: $0.87 pro 1M Output-Tokens für V4-Pro, $0.28 für V4-Flash. Anrufe zu Spitzenzeiten werden voraussichtlich etwa doppelt so viel kosten. Cache-Treffer-Eingaben sind bei beiden deutlich günstiger.

Ist DeepSeek V4 derzeit nutzbar?

Ja. V4-Pro und V4-Flash sind seit dem 24. April 2026 öffentlich, Open-Weight (MIT-lizenziert, in DeepSeeks Hugging-Face-Organisation) und aufrufbar. Sie müssen nicht auf die offizielle Veröffentlichung warten, um darauf aufzubauen.

Muss ich vor dem 24. Juli 2026 migrieren?

Nur wenn Ihr Code weiterhin deepseek-chat oder deepseek-reasoner aufruft. Wechseln Sie den Modellnamen vor dem 24. Juli 2026, 15:59 UTC zu deepseek-v4-flash oder deepseek-v4-pro; sonst ändert sich an Ihrer Anfrage nichts.