Alibaba a dévoilé Qwen3.8-Max-Preview le 19 juillet 2026 via le compte officiel Qwen sur X, en promettant des open weights « coming soon » sans avancer de date. Le modèle accessible aujourd'hui est donc une preview hébergée, pas un téléchargement. Or c'est bien la publication des weights que tout le monde attend. Entre calendriers contradictoires, informations officielles limitées et chiffre accrocheur de 2,4 billions de paramètres, il manque surtout la donnée qui déterminera son coût réel d'exploitation.
Ce qu'est réellement Qwen3.8-Max-Preview
Qwen3.8-Max-Preview est la version hébergée, en accès anticipé, du prochain modèle phare d'Alibaba. Le compte Qwen d'Alibaba le présente comme un modèle entièrement multimodal de 2,4 billions de paramètres — texte, image et davantage au sein d'un même modèle — qu'il place comme « second only to » Claude Fable 5 d'Anthropic.
Il est déjà possible de le tester, mais dans un périmètre précis : l'abonnement Token Plan d'Alibaba Cloud, ainsi que les plateformes agentiques Qoder et QoderWork. Il n'est pas proposé par défaut dans l'application web gratuite Qwen Chat, qui charge encore Qwen3.7-Plus, la génération précédente.
Le terme « Preview » doit être pris au pied de la lettre. Alibaba indique que les capacités du modèle continueront d'évoluer pendant cette phase ; ses scores comme son comportement peuvent donc changer avant la livraison des weights.
« Kaleb », le test discret qui a vendu la mèche
La preview n'est pas arrivée sans signaux préalables. Avant l'annonce officielle, des testeurs sur X avaient repéré Qwen3.8-Max dans l'arène publique de comparaison de modèles LMArena, sous le nom de code discret « Kaleb ». Les laboratoires utilisent ce type de pseudonyme pour recueillir des votes en duel à l'aveugle avant d'associer leur marque à un modèle.
Ce point est important pour une raison : l'engouement initial autour de ses capacités de génération de code frontend vient de ces confrontations Kaleb à l'aveugle, et non du marketing d'Alibaba. C'est à ce stade le signal tiers le plus solide, même si aucun résultat Kaleb archivé n'a été publié pour confirmer l'identité du modèle. Il faut donc y voir une affirmation communautaire crédible, pas une preuve.
À quand la sortie des open weights de Qwen3.8 ?
Trois calendriers circulent actuellement, sans se recouper :
| Source | Calendrier avancé |
|---|---|
| Alibaba Qwen, publication officielle sur X | « Open-weight soon », sans date |
| Publications de fuite sur X le jour du lancement | Déploiement mondial d'ici fin juillet 2026 |
| Reddit r/Qwen_AI (information indirecte, employé Alibaba lors d'une conférence à Paris) | Août 2026 |
« Soon », « fin juillet » et « août » ne recouvrent pas la même promesse. L'hypothèse d'une sortie fin juillet provient de publications de fuite sur X le jour du lancement. La date d'août est rapportée de seconde main sur Reddit, à partir du commentaire attribué à un employé d'Alibaba : c'est donc l'information la moins robuste des trois.
Le précédent d'Alibaba invite aussi à la prudence. Ses deux derniers modèles phares Max n'ont pas publié leurs open weights le jour du lancement, et la génération précédente est restée fermée quelque temps après sa sortie. Une promesse d'open weights liée à une preview reste une promesse, pas une livraison.
À titre de comparaison, Moonshot a associé une date précise à la publication des weights de son concurrent Kimi K3, plutôt qu'un vague « soon ». Retrouvez cette date et les calculs matériels dans notre analyse des open weights de Kimi K3. Qwen3.8 n'a pas encore d'échéance ferme équivalente.
Les 2,4 T de paramètres ne disent pas l'essentiel
Les « 2,4 billions de paramètres » font un bon titre, mais c'est la donnée la moins utile pour un modèle mixture-of-experts (MoE). Ces modèles n'activent pour chaque token qu'une fraction de leurs paramètres totaux — les « paramètres actifs » par token. Le total renseigne donc très peu sur la vitesse ou le coût de serving.
Alibaba n'a pas communiqué le nombre de paramètres actifs. Tant qu'il restera inconnu, impossible d'estimer le coût d'exécution du modèle, sa rapidité ou le matériel nécessaire à l'auto-hébergement. Un total de 2,4 T peut correspondre à l'activation de quelques dizaines à quelques centaines de milliards de paramètres par token, avec des conséquences radicalement différentes sur les coûts.
C'est le principal angle mort pour quiconque prévoit de l'héberger soi-même. Un testeur sur X a plaisanté sur la nécessité de plusieurs RTX 6000 Pro pour faire tourner une version quantifiée en 4 bits ; cela restera de la spéculation tant que le nombre de paramètres actifs et les fichiers de weights réels ne seront pas disponibles.
Ce que remontent les premiers testeurs
La preview étant en ligne, les premiers retours directs affluent déjà, avec un contraste marqué entre benchmarks et usage réel.
Du côté des benchmarks, des chiffres KingBench 3 rapportés par la communauté placent Qwen3.8-Max devant Opus 4.8 et Kimi K3, seul Fable 5 le dépassant. Un développeur publiant sous le nom @Leo_R_UK sur X affirme avoir obtenu 59/60, son meilleur résultat à ce jour, sur une suite de six tâches d'agents de code exécutée via l'API directe.
Ce graphique doit être considéré comme une affirmation du fournisseur et de la communauté, non comme un résultat vérifié. Alibaba n'a publié aucun tableau de benchmarks officiel : chaque chiffre provient soit de ses propres déclarations, soit d'une évaluation utilisateur menée sur un échantillon limité.
Les retours en conditions réelles sont plus nuancés. Des testeurs comme @synthwavedd et @VoltraceGG sur X estiment que le modèle se situe un cran sous ses scores dans le travail agentique quotidien. L'un le juge derrière Kimi K3 en pratique malgré son avance dans les benchmarks ; d'autres ont mené des évaluations privées où il n'était « not even remotely close » de Fable 5. Un constat revient souvent : il est rapide, parfois même étrangement rapide, tandis que ses résultats en conception frontend se situent plutôt au niveau de GLM-5.2 qu'à la frontière de l'état de l'art. Cet écart entre classement et expérience sera à surveiller une fois les weights publiés, lorsque chacun pourra reproduire les tests.
Comment confirmer que les weights sont vraiment disponibles
Le passage de « soon » à « sorti » se mesurera à des éléments concrets, pas à une nouvelle annonce. Avant de considérer Qwen3.8 comme un modèle open-weight exploitable, surveillez tous les points suivants :
- Une annonce officielle d'Alibaba/Qwen renvoyant vers un téléchargement, et non vers un simple message « coming soon ».
- Un dépôt Hugging Face contenant les fichiers de weights sous l'organisation Qwen d'Alibaba, accompagné d'un fichier de licence que vous aurez lu : open weights et licence open source ne sont pas synonymes.
- Une model card indiquant les paramètres actifs, la longueur de contexte et les modalités, au-delà du seul total de 2,4 T.
- Des benchmarks tiers réalisés par une entité autre qu'Alibaba, sur les weights publiés plutôt que sur la preview.
- Une tarification API stable pour la version hébergée, afin de comparer le coût par token avec Kimi K3 et Claude.
Si vous devez choisir dès aujourd'hui un modèle sur lequel construire, notre sélection des meilleurs LLM open source pour le code couvre des options dont les weights sont déjà téléchargeables. Lorsque les weights de Qwen3.8 et une API stable seront disponibles, il sera aussi accessible, aux côtés des autres modèles de pointe, via des passerelles API compatibles Anthropic comme AIReiter. Vous pourrez alors le comparer en A/B à votre modèle actuel sans réécrire votre intégration.
FAQ
Qwen est-il open weight ?
Des modèles Qwen antérieurs ont bien été publiés avec des open weights, mais chaque sortie fait l'objet d'une décision distincte. Les weights de Qwen3.8 sont promis mais pas encore disponibles ; les deux derniers modèles phares d'Alibaba étaient fermés à leur lancement. Dire que « Qwen est ouvert » ne s'applique donc pas automatiquement à la version 3.8.
Qwen3.8 est-il gratuit ?
Pas pour le moment. Qwen3.8-Max-Preview est réservé au Token Plan payant d'Alibaba Cloud et aux plateformes Qoder. L'application gratuite Qwen Chat utilise encore l'ancien Qwen3.7-Plus.
Qwen3.8 est-il meilleur que DeepSeek ou Claude ?
Selon les scores KingBench 3 rapportés par la communauté, Qwen3.8-Max devance légèrement Opus 4.8 et reste derrière Fable 5. Mais ces affirmations ne sont pas vérifiées, et plusieurs testeurs ont trouvé ses performances agentiques réelles inférieures à son rang dans les benchmarks. Il n'existe pas encore de comparaison indépendante face à DeepSeek V4 ou Claude sur les weights publiés, puisqu'ils ne sont pas encore sortis.
Quelle est la date de sortie des open weights de Qwen3.8 ?
Alibaba s'est limité à annoncer « soon ». Des fuites publiées le jour du lancement évoquent un déploiement fin juillet 2026, tandis qu'un rapport Reddit de seconde main mentionne août. Alibaba n'a confirmé aucune date ferme.