Qwen3.8 Open Weights: Erscheinungsdatum, Leaks & was zu erwarten ist

Zuletzt aktualisiert: 2026-07-20 03:24:53

Alibabas offizieller Qwen-Account auf X kündigte am 19. Juli 2026 Qwen3.8-Max-Preview an und sagte, dass die Open Weights „coming soon“ seien, ohne ein Datum zu nennen. Das Modell, das Sie heute ausprobieren können, ist also eine gehostete Vorschau, kein Download. Die Open-Weight-Veröffentlichung ist das, worauf die Leute eigentlich warten, und im Moment sind die Zeitangaben widersprüchlich, während die Schlagzeile mit 2,4 Billionen Parametern die Zahl verbirgt, die wirklich zählt. Die bestätigten Details sind spärlich, die geleakte Zeitleiste weist in drei verschiedene Richtungen, und die eine Zahl, die die tatsächlichen Kosten bestimmt, wurde bisher überhaupt nicht veröffentlicht.

Was Qwen3.8-Max-Preview tatsächlich ist

Qwen3.8-Max-Preview ist die gehostete Early-Access-Version von Alibabas nächstem Flaggschiff. Der Qwen-Account von Alibaba beschreibt es als ein 2,4-Billionen-Parameter umfassendes, vollständig multimodales Modell (Text, Bild und mehr in einem Modell), das es als „nur an zweiter Stelle nach“ Anthropics Claude Fable 5 positioniert.

Sie können es jetzt testen, aber nur an bestimmten Orten: im Token-Plan-Abonnement von Alibaba Cloud sowie auf den agentischen Plattformen Qoder und QoderWork. Es ist nicht die Standardeinstellung in der kostenlosen Qwen Chat-Web-App, die weiterhin Qwen3.7-Plus, die vorherige Generation, lädt.

Qwen Chat web app showing Qwen3.7-Plus as the default model, not Qwen3.8

"Vorschau" ist hier eine wörtliche Warnung. Alibaba sagt, dass sich die Fähigkeiten des Modells während des Vorschauzeitraums weiter ändern werden, sodass sich jede Punktzahl oder jedes Verhalten, das Sie heute sehen, ändern kann, bevor die Gewichte ausgeliefert werden.

Der "Kaleb"-Stealth-Test, der es verriet

Die Vorschau kam nicht aus dem Nichts. Vor der offiziellen Enthüllung hatten Tester auf X darauf hingewiesen, dass Qwen3.8-Max auf der öffentlichen Modellvergleichs-Arena von LMArena unter dem getarnten Codenamen „Kaleb“ gelaufen war. Labs verwenden anonyme Codenamen, um blinde direkte Vergleichsvoten zu sammeln, bevor sie ihre Marke mit einem Modell verknüpfen.

Dieses Detail ist aus einem Grund wichtig: Die frühe Begeisterung darüber, dass das Modell bei der Frontend-Codegenerierung stark sei, lässt sich auf diese blinden Kaleb-Matchups zurückführen, nicht auf Alibabas Marketing. Es ist derzeit das Nächste an einem Signal von Dritten, auch wenn bislang niemand ein archiviertes Kaleb-Ergebnis veröffentlicht hat, um die Identität zu bestätigen, also behandle es eher als eine starke Behauptung aus der Community und nicht als Beweis.

Wann erscheinen die offenen Gewichte von Qwen3.8?

Drei verschiedene Zeitpläne kursieren, und sie stimmen nicht überein:

QuelleBehaupteter Zeitplan
Alibaba Qwen, offizieller Beitrag auf X"Open-weight bald," kein Datum
Leak-Posts am Tag der Einführung auf XGlobale Einführung bis Ende Juli 2026
Reddit r/Qwen_AI (aus zweiter Hand, Alibaba-Mitarbeiter auf einer Konferenz in Paris)August 2026

"Bald", "Ende Juli" und "August" sind nicht dasselbe Versprechen. Die Behauptung vom Ende Juli stammt aus Leak-Posts vom Launch-Tag auf X. Die August-Angabe ist ein Bericht aus zweiter Hand über einen Kommentar eines Alibaba-Mitarbeiters, der auf Reddit gemeldet wurde, und sollte als die unverbindlichste der drei behandelt werden.

Außerdem gibt es ein Problem mit der Erfolgsbilanz. Alibabas zwei jüngste Flaggschiff-Max-Modelle wurden am ersten Tag nicht mit offenen Gewichten veröffentlicht, und die vorherige Generation blieb nach dem Start eine Zeit lang geschlossen. Ein an eine Vorschau geknüpftes Versprechen für offene Gewichte ist ein Versprechen, keine Veröffentlichung.

Zum Vergleich: Moonshot hat den konkurrierenden Kimi-K3-Weights ein konkretes Kalenderdatum zugewiesen statt eines vagen „bald“. Das genaue Datum und die Hardware-Berechnungen finden sich in unserer Aufschlüsselung zu den Kimi K3 open weights. Qwen3.8 hat bislang noch kein entsprechendes festes Datum.

Die Zahl 2,4T ist nicht die entscheidende

"2,4 Billionen Parameter" ist die Schlagzeile, aber für ein Mixture-of-Experts-(MoE)-Modell ist sie die am wenigsten nützliche Zahl. MoE-Modelle leiten jedes Token nur durch einen Bruchteil ihrer gesamten Parameter, die "aktiven Parameter" pro Token, sodass die Gesamtzahl Ihnen fast nichts über Geschwindigkeit oder Serving-Kosten sagt.

Alibaba hat die Anzahl der aktiven Parameter nicht veröffentlicht. Bis sie das tut, können Sie nicht abschätzen, wie teuer der Betrieb des Modells ist, wie schnell es sein wird oder welche Hardware eine selbst gehostete Kopie benötigt. Eine Gesamtzahl von 2,4T könnte pro Token irgendwo zwischen einigen zehn und einigen hundert Milliarden Parametern aktivieren, und jedes dieser Szenarien hat sehr unterschiedliche Kostenauswirkungen.

Dies ist die mit Abstand wichtigste Lücke für alle, die planen, selbst zu hosten. Ein Tester auf X machte scherzhaft Witze darüber, mehrere RTX 6000 Pro-Karten zu benötigen, um eine 4-bit quantisierte Version auszuführen, und das bleibt Spekulation, bis die Anzahl der aktiven Parameter und die eigentlichen Weight-Dateien existieren.

Was frühe Tester tatsächlich sehen

Da die Vorschau live ist, liegen bereits direkte Reaktionen vor, und sie gehen bei Benchmarks und im tatsächlichen Einsatz stark auseinander.

Auf der Benchmark-Seite ordnen von der Community gemeldete KingBench-3-Zahlen Qwen3.8-Max über Opus 4.8 und Kimi K3 ein, nur Fable 5 liegt davor. Ein Entwickler, der auf X als @Leo_R_UK postete, sagte, eine über die direkte API ausgeführte Coding-Agent-Suite mit sechs Aufgaben habe 59/60 erreicht, das höchste Ergebnis, das er je festgehalten habe.

Community-reported KingBench 3 scores placing Qwen3.8-Max-Preview second behind Claude Fable 5

Betrachten Sie dieses Diagramm als von Anbieter und Community behauptet, nicht verifiziert. Alibaba hat keine offiziellen Benchmark-Tabellen veröffentlicht, daher ist jede Zahl hier entweder eine eigene Behauptung oder eine von Nutzern durchgeführte Evaluation auf einer kleinen Stichprobe.

Die Berichte aus der Praxis sind ernüchternder. Tester wie @synthwavedd und @VoltraceGG auf X sagten, dass sich das Modell im alltäglichen Agenten-Einsatz eine Stufe unter seinen Scores anfühlt. Einer beschrieb es in der Praxis als hinter Kimi K3 zurückliegend, trotz des Benchmark-Vorsprungs, und andere führten private Evals durch, bei denen es „nicht einmal ansatzweise“ an Fable 5 herankam. Ein häufiger Hinweis: Es ist schnell, manchmal verdächtig schnell, und seine Frontend-Design-Ausgabe liegt eher auf GLM-5.2-Niveau als an der Spitze. Genau diese Lücke zwischen Leaderboard und tatsächlicher Erfahrung ist das, worauf man achten sollte, sobald die Gewichte offen sind und jeder die Tests reproduzieren kann.

Wie man den Moment erkennt, in dem die Gewichte echt sind

"Bald" wird durch konkrete Artefakte zu "ausgeliefert", nicht durch eine weitere Ankündigung. Achten Sie auf all dies, bevor Sie Qwen3.8 als ein Open-Weight-Modell betrachten, auf dem Sie aufbauen können:

  • Eine offizielle Alibaba/Qwen-Ankündigung zur Veröffentlichung, die auf einen Download verweist, nicht nur ein „demnächst verfügbar“-Beitrag.
  • Ein Hugging-Face-Repo mit echten Gewichtsdateien unter Alibabas Qwen-Organisation, plus eine Lizenzdatei, die du gelesen hast (Open Weights und Open-Source-Lizenzen sind nicht dasselbe).
  • Eine Model Card, die aktive Parameter, Kontextlänge und Modalitäten aufführt, nicht nur die 2,4T insgesamt.
  • Unabhängige Benchmarks von Dritten von jemandem, der nicht Alibaba ist, ausgeführt mit den veröffentlichten Gewichten statt mit der Vorschau.
  • Stabile API-Preise für die gehostete Version, damit du die Kosten pro Token mit Kimi K3 und Claude vergleichen kannst.

Wenn Sie heute ein Modell zum Aufbau auswählen, deckt unser Überblick über die besten Open-Source-LLMs für Coding Optionen ab, deren Gewichte bereits herunterladbar sind. Sobald die Gewichte von Qwen3.8 und eine stabile API verfügbar sind, wird es auch über Anthropic-kompatible API-Gateways wie AIReiter zusammen mit den anderen Frontier-Modellen erreichbar sein, sodass Sie es per A/B-Test gegen Ihr aktuelles Modell testen können, ohne Ihre Integration neu schreiben zu müssen.

FAQ

Ist Qwen Open Weight?

Frühere Qwen-Modelle wurden mit offenen Gewichten veröffentlicht, aber jede Veröffentlichung ist eine separate Entscheidung. Die Gewichte von Qwen3.8 sind angekündigt, aber noch nicht verfügbar, und Alibabas zwei jüngste Flaggschiffe blieben zum Start geschlossen, sodass „Qwen ist offen“ nicht automatisch für 3.8 gilt.

Ist Qwen3.8 kostenlos nutzbar?

Im Moment nicht. Qwen3.8-Max-Preview steckt hinter dem kostenpflichtigen Token-Plan von Alibaba Cloud und den Qoder-Plattformen. Die kostenlose Qwen-Chat-App läuft weiterhin mit dem älteren Qwen3.7-Plus.

Ist Qwen3.8 besser als DeepSeek oder Claude?

Bei den von der Community gemeldeten KingBench-3-Werten liegt Qwen3.8-Max knapp vor Opus 4.8 und hinter Fable 5. Aber das sind unbestätigte Behauptungen, und mehrere Tester fanden, dass seine reale Agentenleistung unter seinem Benchmark-Rang liegt. Es gibt bisher noch keinen unabhängigen direkten Vergleich mit DeepSeek V4 oder Claude auf den veröffentlichten Gewichten, da die Gewichte nicht veröffentlicht sind.

Was ist das Veröffentlichungsdatum der offenen Gewichte von Qwen3.8?

Alibaba hat nur „bald“ gesagt. Leaks zum Starttermin deuten auf einen Rollout Ende Juli 2026 hin, und ein zweiter Reddit-Bericht legt August nahe. Von Alibaba wurde kein verbindliches Datum bestätigt.