Alibaba hat Qwen3.8-Max-Preview am 19. Juli 2026 über den offiziellen Qwen-Account auf X angekündigt. Die offenen Gewichte sollen „bald“ folgen – ein konkretes Datum nannte das Unternehmen jedoch nicht. Was sich derzeit ausprobieren lässt, ist also ein gehosteter Preview-Zugang und kein Modell zum Herunterladen. Genau auf die Open Weights wartet die Community. Der Zeitplan ist widersprüchlich, und die prominent kommunizierten 2,4 Billionen Parameter verschleiern die Kennzahl, auf die es in der Praxis ankommt. Verlässliche Informationen sind rar, die Leaks deuten in mehrere Richtungen, und die entscheidende Zahl für die laufenden Kosten fehlt bislang komplett.
Was Qwen3.8-Max-Preview derzeit bietet
Qwen3.8-Max-Preview ist der gehostete Early-Access-Ableger von Alibabas nächstem Flaggschiffmodell. Laut dem Qwen-Account handelt es sich um ein vollständig multimodales Modell mit 2,4 Billionen Parametern, das Text, Bilder und weitere Eingaben in einem Modell verarbeitet. Alibaba ordnet es als „nur hinter“ Anthropic Claude Fable 5 ein.
Testen lässt es sich bereits, allerdings nur über bestimmte Zugänge: den Token-Plan von Alibaba Cloud sowie die agentischen Plattformen Qoder und QoderWork. In der kostenlosen Web-App Qwen Chat ist es nicht das Standardmodell. Dort wird weiterhin Qwen3.7-Plus geladen, also die vorherige Generation.
Die Bezeichnung „Preview“ ist hier wörtlich zu nehmen. Alibaba weist darauf hin, dass sich die Fähigkeiten des Modells während der Preview-Phase weiter verändern werden. Bewertungen und Verhaltensweisen, die heute auffallen, können sich also noch verschieben, bevor die Gewichte erscheinen.
Der verdeckte „Kaleb“-Test auf LMArena
Die Preview kam nicht völlig überraschend. Noch vor der offiziellen Ankündigung bemerkten Tester auf X, dass Qwen3.8-Max offenbar unter dem Tarnnamen „Kaleb“ in der öffentlichen Modellvergleichs-Arena LMArena lief. Solche anonymen Codenamen nutzen Labs, um vor der Markenenthüllung blinde Direktvergleiche und Abstimmungen zu sammeln.
Relevant ist das vor allem aus einem Grund: Der frühe Hype um die starke Frontend-Codegenerierung des Modells geht auf diese blinden Kaleb-Duelle zurück – nicht auf Alibabas Marketing. Das ist bislang das stärkste Signal von Dritten. Einen archivierten Kaleb-Test, der die Identität zweifelsfrei belegt, hat allerdings niemand veröffentlicht. Daher ist es eine gut gestützte Community-Behauptung, kein Beweis.
Wann kommen die offenen Gewichte von Qwen3.8?
Derzeit kursieren drei Zeitpläne, die nicht miteinander übereinstimmen:
| Quelle | Genannter Zeitraum |
|---|---|
| Alibaba Qwen, offizieller Beitrag auf X | „Open Weights bald“, ohne Datum |
| Leak-Posts auf X am Launch-Tag | Globaler Rollout bis Ende Juli 2026 |
| Reddit r/Qwen_AI (aus zweiter Hand, Alibaba-Mitarbeiter auf einer Konferenz in Paris) | August 2026 |
„Bald“, „Ende Juli“ und „August“ sind drei unterschiedliche Aussagen. Die Angabe Ende Juli stammt aus Leak-Posts auf X vom Tag der Ankündigung. Der August-Termin geht auf einen Reddit-Bericht aus zweiter Hand über die Aussage eines Alibaba-Mitarbeiters zurück und ist damit die schwächste der drei Quellen.
Auch Alibabas bisherige Veröffentlichungen mahnen zur Vorsicht: Die zwei jüngsten Max-Flaggschiffe erschienen nicht am ersten Tag mit offenen Gewichten, und die vorherige Generation blieb nach dem Start zunächst geschlossen. Das Versprechen offener Gewichte für eine Preview ist eben noch kein Release.
Zum Vergleich: Moonshot nannte für die Gewichte des konkurrierenden Kimi K3 ein konkretes Kalenderdatum statt eines vagen „bald“. Das genaue Datum und die Hardware-Rechnung finden sich in unserer Analyse zu Kimi K3 open weights. Für Qwen3.8 gibt es bislang kein vergleichbar verbindliches Datum.
Warum 2,4 Billionen Parameter wenig aussagen
Die 2,4 Billionen Parameter sind die Schlagzeilenzahl, bei einem Mixture-of-Experts-Modell (MoE) aber die am wenigsten hilfreiche. MoE-Modelle leiten jedes Token nur durch einen Teil ihrer gesamten Parameter – die sogenannten aktiven Parameter pro Token. Die Gesamtzahl verrät deshalb fast nichts über Geschwindigkeit oder Kosten beim Betrieb.
Alibaba hat die Zahl der aktiven Parameter noch nicht veröffentlicht. Ohne sie lässt sich weder abschätzen, wie teuer das Modell im Betrieb wird, wie schnell es arbeitet noch welche Hardware für Self-Hosting nötig wäre. Bei insgesamt 2,4 Billionen Parametern könnten pro Token einige zehn bis einige hundert Milliarden Parameter aktiv sein – mit jeweils deutlich unterschiedlichen Kostenfolgen.
Für alle, die Self-Hosting planen, ist das die wichtigste offene Frage. Ein Tester auf X scherzte, für eine 4-Bit-quantisierte Version mehrere RTX 6000 Pro zu benötigen. Solange die Zahl der aktiven Parameter und die tatsächlichen Gewichtedateien fehlen, bleibt das reine Spekulation.
Was erste Tester tatsächlich berichten
Da die Preview bereits läuft, gibt es erste Erfahrungen aus der Praxis. Sie zeichnen allerdings ein deutlich uneinheitlicheres Bild als die Benchmark-Werte.
Bei Benchmarks liegen die Community-gemeldeten KingBench-3-Ergebnisse von Qwen3.8-Max vor Opus 4.8 und Kimi K3; nur Fable 5 liegt darüber. Ein Entwickler mit dem X-Account @Leo_R_UK berichtete, dass eine Suite aus sechs Coding-Agent-Aufgaben über die direkte API 59 von 60 Punkten erreicht habe – sein bislang höchstes Ergebnis.
Diese Grafik sollte als Hersteller- und Community-Angabe verstanden werden, nicht als verifizierter Nachweis. Alibaba hat keine offiziellen Benchmark-Tabellen veröffentlicht. Jede Zahl stammt daher entweder aus einer Eigenangabe oder aus einer Nutzer-Evaluierung mit kleiner Stichprobe.
Die Berichte aus dem Alltag fallen zurückhaltender aus. Tester wie @synthwavedd und @VoltraceGG auf X schreiben, dass sich das Modell bei täglicher Agentenarbeit schwächer anfühle, als die Scores erwarten lassen. Einer sah es trotz Benchmark-Vorsprung in der Praxis hinter Kimi K3; andere kamen in privaten Evaluierungen zu dem Ergebnis, es sei „nicht einmal annähernd“ an Fable 5. Wiederkehrende Eindrücke: Das Modell ist schnell, mitunter auffällig schnell, und seine Frontend-Design-Ausgabe bewegt sich eher auf dem Niveau von GLM-5.2 als an der Spitze. Genau diese Lücke zwischen Leaderboard und Praxiserfahrung wird interessant, sobald die Gewichte offen sind und Tests reproduziert werden können.
Woran ihr den echten Release erkennt
Aus „bald“ wird nicht durch die nächste Ankündigung ein echter Release, sondern durch konkrete Artefakte. Erst wenn diese Punkte vorliegen, sollte Qwen3.8 als Open-Weights-Modell gelten, auf dem sich aufbauen lässt:
- Offizielle Release-Ankündigung von Alibaba/Qwen: Sie muss auf einen Download verweisen, nicht nur erneut „coming soon“ sagen.
- Hugging-Face-Repository mit echten Gewichtedateien: Es sollte unter Alibabas Qwen-Organisation liegen und eine Lizenzdatei enthalten, die ihr gelesen habt. Open Weights und Open-Source-Lizenzen sind nicht dasselbe.
- Modellkarte mit aktiven Parametern: Sie sollte Kontextlänge und Modalitäten nennen – nicht nur die Gesamtsumme von 2,4 Billionen Parametern.
- Unabhängige Benchmarks: Sie müssen von Dritten stammen und auf den veröffentlichten Gewichten laufen, nicht auf der Preview.
- Stabile API-Preise: Erst dann lassen sich die Kosten pro Token sinnvoll mit Kimi K3 und Claude vergleichen.
Wer schon heute ein Modell für ein Projekt auswählen muss, findet in unserer Übersicht der best open-source LLMs for coding Optionen, deren Gewichte bereits herunterladbar sind. Sobald Qwen3.8-Gewichte und eine stabile API verfügbar sind, wird das Modell neben den anderen Frontier-Modellen auch über Anthropic-kompatible API-Gateways wie AIReiter erreichbar sein. Damit lässt es sich gegen das bisherige Modell A/B-testen, ohne die Integration umzuschreiben.
FAQ
Hat Qwen offene Gewichte?
Frühere Qwen-Modelle wurden mit offenen Gewichten veröffentlicht, doch jede Veröffentlichung ist eine eigene Entscheidung. Die Gewichte für Qwen3.8 sind angekündigt, aber noch nicht verfügbar. Da Alibabas zwei jüngste Flaggschiffe beim Start geschlossen blieben, gilt „Qwen ist offen“ nicht automatisch für Version 3.8.
Ist Qwen3.8 kostenlos nutzbar?
Derzeit nicht. Qwen3.8-Max-Preview ist nur über den kostenpflichtigen Token Plan von Alibaba Cloud und die Qoder-Plattformen zugänglich. Die kostenlose Qwen-Chat-App verwendet weiterhin das ältere Qwen3.7-Plus.
Ist Qwen3.8 besser als DeepSeek oder Claude?
Nach den Community-gemeldeten KingBench-3-Werten liegt Qwen3.8-Max knapp vor Opus 4.8 und hinter Fable 5. Diese Angaben sind jedoch nicht verifiziert, und mehrere Tester sahen die reale Agentenleistung unterhalb des Benchmark-Rangs. Einen unabhängigen Direktvergleich mit DeepSeek V4 oder Claude auf Basis veröffentlichter Gewichte gibt es noch nicht, weil die Gewichte noch nicht erschienen sind.
Wann erscheinen die Open Weights von Qwen3.8?
Alibaba spricht bislang nur von „bald“. Leaks vom Launch-Tag deuten auf einen Rollout Ende Juli 2026, ein Reddit-Bericht aus zweiter Hand nennt August. Ein verbindliches Datum hat Alibaba nicht bestätigt.