Am 17. Juli stellte MiniMax auf der World Artificial Intelligence Conference in Shanghai ein Modell namens M3.1 auf die Bühne. Doch einen Monat später lässt es sich offiziell nirgends beziehen: Weder im MiniMax-Blog noch in der API-Preisdokumentation oder bei OpenRouter taucht das Modell auf.
Die Ankündigung von MiniMax M3.1 ist real. Stand 18. August 2026 bleibt jedoch M3 das MiniMax-Modell, das sich aufrufen, herunterladen oder bezahlen lässt – inzwischen dauerhaft zum halben API-Preis.
Was MiniMax auf der WAIC 2026 tatsächlich zu M3.1 gesagt hat
Alle konkreten Aussagen zu M3.1 gehen auf die WAIC-Veranstaltung zurück, nicht auf einen technischen Bericht, eine Model Card oder eine Preisseite. Im Mittelpunkt stehen zwei Verbesserungen gegenüber M3: eine deutlich stärkere native Multimodalität sowie ein Kontextfenster im „Millionenbereich“, das die Dokumentation und das Code-Repository eines gesamten Projekts in einem Durchgang erfassen soll. Auch die Positionierung hat sich verschoben – weg von Coding-Agenten, hin zu Enterprise-Einsätzen in industrieller Fertigung, Lieferketten-Kollaboration und Engineering.
„Seine nativen multimodalen Fähigkeiten haben sich besonders deutlich verbessert … der lange Kontext im Millionenbereich kann die Dokumente und das Code-Repository eines kompletten Projekts vollständig verstehen.“ — Tech-Blogger IT 九熙, von der WAIC berichtet über Sina News, 17. Juli 2026
Der gleiche Sina-Bericht beschreibt am WAIC-Stand KI-Kopfhörer und KI-Brillen auf M3-Basis, die komplexe Anweisungen in ausführbare Schritte zerlegen. In einer Folgeberichterstattung vom 19. Juli ist zudem von einer „MiniMax M3.1 series“ mit besserem multimodalem Verständnis und stärkerem Reasoning die Rede. Parameterzahl, Benchmark-Ergebnisse, API-Angaben zum Kontextfenster oder Preise nennt keine der zitierten WAIC-Quellen.
Ist MiniMax M3.1 schon verfügbar? Der Status vom 18. August
In keinem der vier unten verlinkten offiziellen Kataloge und Distributionskanäle war MiniMax M3.1 am 18. August 2026 gelistet:
| Kanal | Status von M3.1 | Was dort gelistet ist |
|---|---|---|
| Offizieller MiniMax-Blog | Kein Beitrag zu M3.1 | Neueste Einträge: Music 3.0 (13. Aug.), H3 (31. Juli), M3 (1. Juni) |
| MiniMax API-Preisdokumentation | Keine Modell-ID für M3.1 | Die Textmodell-Liste reicht bis MiniMax-M3, dazu M2.7 und ältere Modelle |
| OpenRouter-MiniMax-Katalog | Nicht gelistet | 13 MiniMax-Modelle; für M3 stehen 1,05 Mio. Kontext und $0.23/M Input |
| Hugging Face (MiniMaxAI) | Keine M3.1-Gewichte | Die M3-Gewichte sind verfügbar: 428B Parameter insgesamt / 23B aktive Parameter |
Das ist ein Katalogabgleich, keine Aussage über jeden denkbaren Reseller. Die meisten Behauptungen, M3.1 sei bereits verfügbar, dürften ohnehin auf Selbstbezeichnungen des Modells zurückgehen. Am 27. Juli fragte ein Nutzer bei r/MiniMax_AI, ob M3.1 veröffentlicht worden sei, nachdem eine AnythingLLM-Sitzung mit einem MiniMax-Token-Plan-Key geantwortet hatte:
„It replied Iam minimiax 3.1“ — u/ahmedranaa, r/MiniMax_AI
Kein Kommentator konnte diese Bezeichnung reproduzieren. Die vom Modell selbst ausgegebene Versionsnummer ist generierter Text und kein Release-Nachweis. Meldungen nach dem Muster „Das Modell sagte, es sei 3.1“ sind daher Rauschen, bis eine Modell-ID in einem offiziellen Katalog auftaucht.
M3.1 gegen M3: Was sich ändern soll – und was noch niemand gemessen hat
MiniMax M3.1 wird als schrittweises Upgrade von MiniMax M3 eingeordnet, das am 1. Juni 2026 erschien, nicht als neue Architekturgeneration. Die bislang veröffentlichten Informationen widersprechen dieser Lesart nicht.
| Bereich | MiniMax M3 (bestätigt) | MiniMax M3.1 (angekündigt) |
|---|---|---|
| Architektur | 428B insgesamt / 23B aktive MoE-Parameter, MiniMax Sparse Attention (MSA) | Nicht offengelegt |
| Kontextfenster | Maximal 1 Mio. Token, per API 512K garantiert | Angabe „Millionenbereich“, keine API-Konditionen |
| Multimodalität | Native Bild- und Videoeingabe, Desktop-Computer-Nutzung | „Deutlich verbesserte“ Multimodalität, keine Benchmarks |
| Positionierung | Coding und agentische Workflows | Enterprise: Fertigung, Lieferkette |
| Zugang | API, OpenRouter, Token-Pläne, offene Gewichte | Noch keiner |
Die Grundlage von M3 ist im MSA-Design-Paper dokumentiert: Bei einem Kontext von 1 Mio. Token benötigt M3 pro Token ungefähr 1/20 der Rechenleistung der vorherigen MiniMax-Generation; das Prefill läuft mehr als 9-mal schneller, das Decoding 15-mal schneller. Ob M3.1 diese Architektur erweitert, müsste eine Model Card klären – bislang gibt es keine.
M3.1, M3 Pro und die Spur zur 2,7T-Gerüchteküche
„MiniMax M3.1“ und „MiniMax M3 Pro“ sind zwei Namen, die für benachbarte Roadmap-Punkte kursieren. Unübersichtlich wurde die Benennung durch Berichte vor der Ankündigung. Vor der WAIC berichtete Sohu, MiniMax’ nächstes Release könne entweder M3.1 oder M3 Pro heißen. Daneben standen Behauptungen über ein separates Modell im 3T-Maßstab und einen ersten heimischen Trainingscluster. Berichte aus zweiter Hand – The Informations Meldung, weitergegeben in unserer Vorschau zum Release-Datum von M3 Pro – deuten auf ein Modell mit 2,7 Billionen Parametern hin, dessen Gewichte möglicherweise bereits im dritten Quartal 2026 offen verfügbar werden könnten.
Kommentatoren im selben r/MiniMax_AI-Thread verwenden „Pro“, „2.7T“ und „M3.1“ austauschbar. Die naheliegendste Lesart: M3.1 ist das kurzfristige Refresh, das auf der WAIC tatsächlich gezeigt wurde, während M3 Pro ein unbestätigter größerer Nachfolger bleibt. Diese Trennung ist eine redaktionelle Einordnung, keine Aussage von MiniMax.
Was MiniMax M3 kostet, während M3.1 auf sich warten lässt
Für die aktuelle Budgetplanung ist MiniMax M3 relevant. Die am 18. August geprüfte Preisdokumentation von MiniMax weist die halbierten Tarife inzwischen als dauerhaft aus, nicht mehr als zeitlich begrenzte Aktion.
| Kanal | Input / 1M | Output / 1M | Cache Read / 1M | Hinweise |
|---|---|---|---|---|
| MiniMax API, ≤512K Input | $0.30 | $1.20 | $0.06 | Dauerhaft 50 % unter der Juni-Preisliste von $0.60/$2.40 |
| MiniMax API, >512K Input | $0.60 | $2.40 | $0.12 | Tarif für langen Kontext |
| MiniMax API, Priority-Tarif | $0.45 | $1.80 | $0.09 | 1,5× Standardtarif, service_tier=priority |
| OpenRouter (M3) | $0.23 | $0.96 | — | 1,05 Mio. Kontext gelistet |
| OpenRouter (M3 Batch) | $0.15 | $0.60 | — | 524K Kontext |
| Token-Pläne | — | — | — | $20/Monat ≈ 1,7B, $50 ≈ 5,1B, $120 ≈ 9,8B Token (Launch-Beitrag) |
Ein Rechenbeispiel: Ein Repository mit 400K Token in eine Anfrage zu geben und 50K Token Output zu erzeugen, kostet im Standardtarif ungefähr $0.12 + $0.06 = $0.18. Oberhalb der Grenze von 512K Input verdoppeln sich alle aufgeführten M3-Tarife. Gerade Long-Context-Jobs sollten deshalb sorgfältig gebatcht werden.
Nach den eigenen Launch-Benchmarks von MiniMax erhält man dafür ein Modell, das bei SWE-Bench Pro (59.0 gegenüber 64.3 und 58.6) und MCP Atlas (74.2) nur wenige Punkte hinter Claude Opus 4.7 und GPT-5.5 liegt. Bei BrowseComp kommt M3 auf 83.5 und liegt damit vor Opus 4.7 mit 79.3. Deutlichere Abstände gibt es bei Terminal-Bench 2.1 (66.0 gegenüber 78.2 bei GPT-5.5) und OSWorld-Verified (70.2 gegenüber 82.8 bei Opus 4.7). Sämtliche Werte stammen vom Anbieter; Details zu Scaffolding und Sandbox sind im Methodik-Abschnitt des Launch-Beitrags offengelegt.
Warten oder bauen? Die Entscheidung zwischen M3.1 und M3
Die meisten Teams sollten jetzt mit M3 entwickeln, denn zu M3.1 lässt sich bislang nichts messen: keine Benchmarks, keine Preise, keine API. Preise, Lizenzierung und Migrationsbedingungen von M3.1 sind unbekannt. Das Modell gehört damit auf die Watchlist, nicht ins Budget.
Wer in diesem Quartal Bild- oder Videoverständnis innerhalb eines sehr großen Kontexts benötigt, bekommt das bereits mit M3: native Bild- und Videoeingabe bei garantiertem 512K-Fenster und maximal 1 Mio. Token. Bevor Integrationscode entsteht, lässt sich MiniMax M3 direkt ausprobieren. Wer auf Benchmark-Zahlen zu M3.1 wartet, sollte abwarten und erst budgetieren, wenn eine offizielle Modell-ID, Preise und Zugangsbedingungen vorliegen. Für Self-Hosting stehen die M3-Gewichte bereits unter der MiniMax Community License bereit; M3.1-Gewichte gibt es nicht.
Die Community-Erfahrungen mit M3 sind gespalten – und zeigen damit, woran sich M3.1 messen lassen muss:
„M3 ist mit 430B auch nicht klein, aber ein absolutes Biest; im richtigen Harness liefert das Modell erstaunlich gute Ergebnisse.“ — u/ExcitementSubject361, r/MiniMax_AI
„Jedenfalls ist es mein Arbeitspferd für Orchestrierung, Architektur und Planung – für nur $20/m.“ — u/respectful_stimulus, derselbe Thread
Der Autor desselben Threads argumentiert dagegen, M3s Coding-Output sei „weit schlechter, als es Hardware und Parameterspezifikation erwarten ließen“. Starke Orchestrierung, umstrittene Coding-Leistung – an genau dieser Trennung wird sich ein echtes M3.1-Release messen lassen müssen.
| Ihre Situation | Jetzt sinnvoll |
|---|---|
| Multimodale Long-Context-Arbeit, noch in diesem Quartal live | M3 im Standardtarif; Inputs nach Möglichkeit bei ≤512K halten |
| Heute Spitzenwerte bei agentischem Coding nötig | M3 liegt nahe dran (SWE-Bench Pro 59.0), führt aber nicht; vor einer Festlegung benchmarken |
| Self-Hosting oder Anforderungen an Datenresidenz | Offene M3-Gewichte unter der Community License; keine M3.1-Gewichte verfügbar |
| Es soll ausschließlich das „neueste MiniMax“ sein | Auf eine offizielle M3.1-Modell-ID warten und mit der Status-Tabelle abgleichen |
FAQ zu MiniMax M3.1
Ist MiniMax M3.1 veröffentlicht?
Auf der WAIC am 17. Juli 2026 angekündigt, aber in keiner kostenpflichtig verfügbaren Form veröffentlicht. Stand 18. August gibt es nichts zu kaufen, aufzurufen oder herunterzuladen.
Ist MiniMax M3.1 Open Source?
Das wurde in keine Richtung angekündigt; öffentliche M3.1-Gewichte existieren nicht. Die Gewichte von MiniMax M3 mit 428B Parametern insgesamt und 23B aktiven Parametern lassen sich bei Hugging Face unter der MiniMax Community License herunterladen.
Was kostet die MiniMax-M3.1-API?
Es wurden keine Preise veröffentlicht. Als Referenz dient M3 mit $0.30/M Input und $1.20/M Output für Anfragen bis 512K Token, nachdem MiniMax den Rabatt von 50 % dauerhaft gemacht hat.
Ist MiniMax M3.1 dasselbe wie M3 Pro?
Das ist nicht bestätigt. Berichte vor der WAIC führten beide Namen als mögliche Bezeichnungen für MiniMax’ nächstes Release auf. Öffentlich gezeigt wurde bislang nur M3.1, während M3 Pro mit 2,7T Parametern unbestätigt bleibt.
Wie groß ist das Kontextfenster von MiniMax M3.1?
Laut den WAIC-Angaben liegt es im „Millionenbereich“ und damit in derselben Klasse wie das Maximum von 1 Mio. Token bei M3. Eine per API bestätigte Zahl gibt es noch nicht.
Weiterführende Artikel: MiniMax M3 Pro: Release Date, Specs & What to Expect · MiniMax M3 vs DeepSeek V4 Pro