GLM-5.3 lässt weiter auf sich warten. Stand 20. Juli 2026 hat Z.ai (Zhipu AI) weder Release Notes noch Model Card, Benchmarks oder einen Termin veröffentlicht. Das aktuellste verfügbare Modell ist GLM-5.2 vom 16. Juni. Alles, was derzeit über GLM-5.3 kursiert, geht auf einen Hinweis des Gründers oder Spekulationen aus der Community zurück. Dieser Artikel trennt beides sauber: belastbare Rückschlüsse aus bisherigen Release-Abständen, Signale, die sich zu beobachten lohnen, wahrscheinliche Änderungen und das Modell, das du bis dahin bereits nutzen kannst.
Ist GLM-5.3 schon verfügbar?
Nein. Den eindeutigsten Beleg liefert die eigene Release-Notes-Seite von Z.ai: Dort ist GLM-5.2 vom 16. Juni 2026 als jüngstes Modell aufgeführt. Einen Eintrag für GLM-5.3, eine Model Card oder eine Benchmark-Tabelle gibt es nicht.
Auch die z.ai-Startseite formuliert es unmissverständlich: Der Assistent wird von „GLM-5.2“ betrieben. „GLM-5.3“ ist damit derzeit nur die in der Community verwendete Bezeichnung für das erwartete nächste inkrementelle Release der GLM-5-Reihe – kein Modell, das sich heute bereits aufrufen lässt. Beiträge, die etwas anderes behaupten, bleiben unbestätigt, bis die Release-Notes-Seite entsprechend aktualisiert wird.
Wann könnte GLM-5.3 erscheinen?
Z.ai hat keinen Termin genannt. Die ehrlichste Schätzung ergibt sich daher aus dem bisherigen Veröffentlichungsrhythmus. Die GLM-5-Reihe folgte bislang ungefähr einem Zwei-Monats-Takt:
- GLM-5: 12. Februar 2026
- GLM-5.1: 7. April 2026 (54 Tage später)
- GLM-5.2: 16. Juni 2026 (70 Tage später)
Die ersten beiden Balken zeigen reale Release-Abstände. Der dritte ist lediglich eine Projektion – der Mittelwert zwischen 54 und 70 Tagen –, kein bestätigter Termin.
Rechnet man den Abstand von 54 bis 70 Tagen ab dem Start von GLM-5.2 am 16. Juni weiter, ergibt sich ein Fenster von Mitte bis Ende August 2026 – ungefähr vom 9. bis 25. August. Das passt zu Spekulationen auf X, wo Accounts wie @AndAtzx und @PrKingLondon einen August-Release ins Spiel gebracht haben. Zwei Zeitabstände sind allerdings eine dünne Grundlage für eine Prognose. Diese Spanne ist daher mit geringer Sicherheit zu bewerten, nicht als Countdown. Zhipu könnte den Termin verschieben, eine .3-Version auslassen oder direkt zu einer anderen Versionsnummer wechseln.
Diese Hinweise sind wirklich relevant
Nicht jeder Post mit der Aussage „GLM-5.3 kommt bald“ ist gleich aussagekräftig. So lassen sich die aktuellen Signale einordnen.
Die Vision-Umfrage des Gründers: das stärkste indirekte Signal
Am 29. Juni stellte Zhipu-Mitgründer Jie Tang Entwicklern öffentlich die Frage, ob das nächste GLM Vision-Funktionen enthalten sollte. Die Antwort fiel nahezu einstimmig positiv aus, wie TechTimes berichtete. Das ist Community-Feedback, keine Produktankündigung – und eine Abstimmung über ein gewünschtes Feature garantiert nicht, dass es schon im nächsten nummerierten Release erscheint. Dennoch ist es der bislang klarste Roadmap-Hinweis von jemandem, der diese Roadmap mitbestimmt. Multimodalität steht damit eindeutig im Raum.
Gerüchte auf GitHub und X richtig einordnen
Im GLM-5-GitHub-Repository gibt es bereits offene Issues mit „GLM-5.3“ im Titel. Ein genauer Blick ist wichtig: Mindestens ein viel beachtetes Issue ist ein Vorschlag eines externen Forschers, kein durchgesickerter Zhipu-Entwurf. Im Text geht es zudem um Interna von GLM-5.2 statt um bestätigte Features von 5.3. Das zeigt, dass die Community auf 5.3 hinarbeitet – nicht, dass GLM-5.3 geleakt wurde. Auch auf X dominieren Erwartungen wie „GLM 5.3 Soon!“, nicht Erfahrungsberichte. Zum Zeitpunkt dieses Artikels sind weder 5.3-Gewichte noch Konfigurationsdateien oder funktionierender API-Zugang in offiziellen Z.ai-Repositories oder den geprüften öffentlichen X-Posts aufgetaucht.
So wurde die letzte Version vorab entdeckt
Es gibt einen Präzedenzfall für frühe Hinweise auf GLM-Releases: GLM-5 wurde vor dem Start über GitHub-Pull-Requests und ein Sternzeichen-Easter-Egg im Code entdeckt, während Zhipu mitten im IPO-Prozess war. Das ist ein einzelner früherer Hinweis, kein garantiertes Muster. Dennoch sind Repository-Aktivitäten der erste Ort, den es für eine frühe GLM-5.3-Sichtung zu prüfen gilt.
Was sich mit GLM-5.3 voraussichtlich ändern könnte
Alle folgenden Punkte sind Erwartungen, keine bestätigten Spezifikationen. Die Tabelle trennt die jeweilige Annahme von den zugrunde liegenden Hinweisen und ihrer Aussagekraft.
| Erwartete Änderung | Hinweise dafür | Vertrauen |
|---|---|---|
| Native Vision-Funktionen / Multimodalität | Vision-Umfrage des Gründers vom 29. Juni; bestehende multimodale GLM-5V-Reihe | Mittel |
| Stabileres Verhalten bei langem Kontext | GLM-5.2 bietet bereits 1M verlustfreien Kontext; .x-Releases festigen meist die vorherige Version | Mittel |
| Zuverlässigeres agentisches Coding | Die gesamte GLM-5-Reihe wird für „agentic engineering“ positioniert; bekannte Lücke zwischen Benchmark-Werten und Robustheit im Alltag | Niedrig bis mittel |
| Preise weiterhin im günstigen Segment | GLM-5-Tokens mit offenen Gewichten waren günstig; für 5.3 gibt es noch keine bestätigten Preise | Niedrig |
Sollte GLM-5.3 ohne Vision-Funktionen erscheinen, wäre das der wichtigste Punkt, den man am Signal aus der Umfrage überprüfen muss.
Was du heute nutzen kannst: GLM-5.2
Auf GLM-5.3 zu warten heißt nicht, Entwicklungsarbeit aufzuschieben. GLM-5.2 ist das aktuelle Flaggschiff mit offenen Gewichten. Als schneller Praxistest rief ich am 20. Juli das Modell glm-5.2 über einen Anthropic-kompatiblen Relay-Endpunkt auf: eine Funktion zum Zusammenführen überlappender Intervalle plus eine schrittweise Herleitung für [[1,3],[2,6],[8,10],[15,18]]. Beim ersten Versuch lieferte es in etwa 31 Sekunden das korrekte Ergebnis [[1,6],[8,10],[15,18]]. Der Code berücksichtigte zudem, dass die Eingabeliste nicht verändert werden sollte. Das ist ein einzelner informeller Aufruf, kein Benchmark. Eine Aufgabe zum Zusammenführen von Intervallen sagt nichts über agentische Fähigkeiten oder Leistung bei langen Kontexten aus. Als Sanity Check zeigt sie lediglich, dass das aktuelle Modell eine gewöhnliche Coding-Anfrage sauber verarbeitet.
Laut Datenblatt bietet GLM-5.2 1M Token verlustfreien Kontext und erzielt nach eigenen Release Notes von Z.ai Open-Source-SOTA-Ergebnisse bei Coding- und Long-Horizon-Benchmarks. Bei den Kosten liegt GLM-5 – die Basis der Reihe – laut Artificial Analysis bei etwa 0,66 US-Dollar pro 1M Tokens im Mischpreis und damit deutlich unter geschlossenen Frontier-Modellen derselben Klasse. Auf dieser Grundlage wird GLM-5.3 aufbauen. Statt Projekte aufzuhalten, ist GLM-5.2 deshalb eine vernünftige Standardwahl für den Moment.
Ob du GLM-5.2 direkt einsetzen oder auf GLM-5.3 warten solltest, hängt vom konkreten Bedarf ab:
| Nutze GLM-5.2 jetzt, wenn … | Warte auf GLM-5.3, wenn … |
|---|---|
| du heute stabiles, produktionsreifes Verhalten brauchst | du einige Wochen für einen möglichen Release Ende August pausieren kannst |
| deine Workloads aus Text und Code bestehen | native Vision-Funktionen oder Multimodalität zwingend erforderlich sind |
| du die niedrigsten Token-Kosten in dieser Klasse möchtest | du vor einer Entscheidung die neuesten Benchmark-Zahlen sehen willst |
| du eine Pipeline entwickelst, die sich nach einem Upgrade erneut testen lässt | du nur experimentierst und unbedingt das allerneueste Modell willst |
Der offizielle Weg führt über die eigene Model API von Z.ai. Wer kein separates Z.ai-Konto verwalten möchte, erreicht GLM-5.2 auch über Anthropic-kompatible Relay-Endpunkte: Siehe die Einrichtung der GLM-5.2 API und wie sich GLM-5.2 in Claude Code nutzen lässt. Neue GLM-Modelle waren nach ihrem Start auch über dieselben Kanäle verfügbar. Einen Versionswechsel solltest du dennoch als echte Änderung behandeln: Führe Regressionstests erneut aus, bevor du Modellnamen austauschst. Kontextlimits, Tool-Calling-Verhalten und Preise können sich zwischen Versionen ändern.
GLM-5.3 möglichst früh mitbekommen
Wenn ein früher Zugriff wichtig ist, beobachte diese vier Stellen in dieser Reihenfolge nach Zuverlässigkeit:
1. Z.ai Release Notes (docs.z.ai): die maßgebliche Quelle, auf der Model Card und Datum zuerst erscheinen. 2. Hugging Face, zai-org: Hier werden offene Gewichte veröffentlicht, häufig noch am selben Tag. 3. GitHub, zai-org: PRs und Commits waren bereits beim letzten Release vor der Ankündigung aufschlussreich. 4. Social Posts von Jie Tang: Der Gründer deutet die Richtung an – wie bei der Vision-Umfrage –, bevor die offiziellen Kanäle aktualisiert werden.
Aggregator-Posts über angebliche Leaks kannst du ignorieren, sofern sie nicht auf eine dieser Quellen zurückverweisen. Bei ganz neuen chinesischen Modell-Releases liegt X meist hinter den offiziellen Kanälen zurück, nicht davor.
FAQ
Wie prüfe ich, ob GLM-5.3 veröffentlicht wurde?
Prüfe die Release Notes von Z.ai und die zai-org-Organisation auf Hugging Face. Wenn keine der beiden Quellen eine GLM-5.3-Model-Card zeigt, ist das Modell noch nicht erschienen – unabhängig davon, was Aggregator-Posts behaupten. Stand 20. Juli 2026 ist GLM-5.2 das jüngste gelistete Modell.
Wann wird GLM-5.3 veröffentlicht?
Ein Termin ist nicht bestätigt. Ausgehend von dem Zwei-Monats-Rhythmus von Z.ai ist ein Zeitfenster Ende August 2026 eine plausible Schätzung mit geringer Sicherheit, keine Ankündigung.
Wird GLM-5.3 Vision-Funktionen haben?
Möglich. Mitgründer Jie Tang fragte in seiner Entwicklerumfrage vom 29. Juni genau danach, und die Community sprach sich überwältigend dafür aus. Eine Feature-Umfrage ist jedoch keine bestätigte Spezifikation.
Wird GLM-5.3 Open Source sein?
Sehr wahrscheinlich. Jedes bisherige GLM-5-Modell erschien mit offenen Gewichten auf Hugging Face, und Z.ai vermarktet die Reihe als Open-Source-SOTA. Solange das Unternehmen nichts anderes signalisiert, ist für 5.3 mit demselben Vorgehen zu rechnen.
Was wird GLM-5.3 kosten?
Preise gibt es noch nicht. GLM-5 lag bei etwa 0,66 US-Dollar pro 1M Tokens im Mischpreis (Artificial Analysis) und damit weit unter geschlossenen Frontier-Modellen. GLM-5.3 wird daher voraussichtlich in diesem günstigen Segment bleiben.
