Qwen3.8 Open Weights : date de sortie, fuites et à quoi s’attendre

Dernière mise à jour: 2026-07-20 03:25:04

Le compte officiel Qwen d'Alibaba sur X a annoncé Qwen3.8-Max-Preview le 19 juillet 2026 et a indiqué que les open weights « arrivent bientôt », sans donner de date. Ainsi, le modèle que vous pouvez tester aujourd'hui est un aperçu hébergé, pas un téléchargement. La publication des open weights est ce que les gens attendent vraiment, et pour l'instant le calendrier est contradictoire, tandis que le chiffre vedette de 2,4 billions de paramètres masque le nombre qui compte vraiment. Les détails confirmés sont maigres, le calendrier divulgué pointe dans trois directions différentes, et le seul chiffre qui détermine le coût réel n'a pas du tout été publié.

Ce qu'est réellement Qwen3.8-Max-Preview

Qwen3.8-Max-Preview est la version hébergée en accès anticipé du prochain modèle phare d'Alibaba. Le compte Qwen d'Alibaba le décrit comme un modèle entièrement multimodal de 2,4 billions de paramètres (texte, image et plus encore dans un seul modèle), qu'il présente comme « juste derrière » Claude Fable 5 d'Anthropic.

Vous pouvez le tester dès maintenant, mais uniquement dans des endroits spécifiques : l'abonnement Token Plan d'Alibaba Cloud, ainsi que les plateformes agentiques Qoder et QoderWork. Ce n'est pas le modèle par défaut dans l'application web gratuite Qwen Chat, qui charge encore Qwen3.7-Plus, la génération précédente.

Qwen Chat web app showing Qwen3.7-Plus as the default model, not Qwen3.8

"Aperçu" est ici un avertissement littéral. Alibaba indique que les capacités du modèle continueront d'évoluer pendant la période d'aperçu, de sorte que tout score ou comportement que vous voyez aujourd'hui peut changer avant la publication des poids.

Le test de furtivité « Kaleb » qui l'a mis sur la voie

L’aperçu n’est pas sorti de nulle part. Avant la révélation officielle, des testeurs sur X ont signalé que Qwen3.8-Max fonctionnait sur l’arène publique de comparaison de modèles LMArena sous le nom de code furtif « Kaleb ». Les laboratoires utilisent des noms de code anonymes pour recueillir des votes à l’aveugle en face à face avant d’associer leur marque à un modèle.

Ce détail compte pour une raison : l’engouement initial autour du fait que le modèle soit performant en génération de code frontend remonte à ces confrontations à l’aveugle de Kaleb, et non au marketing d’Alibaba. C’est ce qui se rapproche le plus d’un signal tiers à ce stade, même si personne n’a publié de résultat archivé de Kaleb pour confirmer l’identité, alors considérez cela comme une affirmation forte de la communauté plutôt que comme une preuve.

Quand les poids ouverts Qwen3.8 seront-ils disponibles ?

Trois calendriers différents circulent, et ils ne sont pas d'accord :

SourceCalendrier annoncé
Alibaba Qwen, publication officielle sur X« Open-weight bientôt », sans date
Publications de fuite du jour du lancement sur XLancement mondial d’ici fin juillet 2026
Reddit r/Qwen_AI (de seconde main, employé d’Alibaba lors d’une conférence à Paris)Août 2026

« Bientôt », « fin juillet » et « août » ne sont pas la même promesse. L’affirmation de fin juillet provient de publications de fuites le jour du lancement sur X. La date d’août est un compte rendu de seconde main du commentaire d’un employé d’Alibaba rapporté sur Reddit et doit être considérée comme la plus incertaine des trois.

Il y a aussi un problème de bilan. Les deux modèles phares Max les plus récents d’Alibaba n’ont pas été publiés avec des poids ouverts dès le premier jour, et la génération précédente est restée fermée pendant un certain temps après son lancement. Une promesse de poids ouverts associée à une preview est une promesse, pas une publication.

En contraste, Moonshot a associé une date de calendrier précise à ses poids concurrents Kimi K3 plutôt qu’un vague « bientôt ». La date exacte et les calculs matériels se trouvent dans notre analyse des poids ouverts de Kimi K3. Qwen3.8 n’a pas encore de date butoir équivalente.

Le chiffre de 2,4 T n’est pas celui qui compte

"2.4 trillion parameters" est le chiffre principal, mais pour un modèle à mélange d'experts (MoE), c'est le moins utile. Les modèles MoE acheminent chaque token uniquement à travers une fraction de leurs paramètres totaux, les "paramètres actifs" par token, donc le nombre total ne vous dit presque rien sur la vitesse ou le coût de service.

Alibaba n’a pas publié le nombre de paramètres actifs. Tant qu’il ne le fera pas, vous ne pouvez pas estimer le coût d’exécution du modèle, sa vitesse, ni le matériel nécessaire pour une copie auto-hébergée. Un total de 2,4T pourrait activer, par token, de quelques dizaines à quelques centaines de milliards de paramètres, et chacun de ces scénarios a des implications de coût très différentes.

C’est l’écart le plus important pour quiconque envisage d’auto-héberger. Un testeur sur X a plaisanté en disant qu’il faudrait plusieurs cartes RTX 6000 Pro pour exécuter une version quantifiée en 4 bits, et cela reste de la spéculation tant que le nombre de paramètres actifs et les fichiers de poids réels n’existent pas.

Ce que les premiers testeurs voient réellement

Parce que l’aperçu est en direct, les premières réactions sont déjà là, et elles se divisent nettement entre les benchmarks et l’utilisation réelle.

Du côté des benchmarks, les chiffres KingBench 3 signalés par la communauté placent Qwen3.8-Max au-dessus d'Opus 4.8 et de Kimi K3, avec seulement Fable 5 devant. Un développeur publiant sous le nom de @Leo_R_UK sur X a déclaré qu'une suite d'agents de codage à six tâches exécutée via l'API directe avait obtenu 59/60, le meilleur résultat qu'il ait enregistré.

Community-reported KingBench 3 scores placing Qwen3.8-Max-Preview second behind Claude Fable 5

Considérez ce tableau comme revendiqué par le fournisseur et la communauté, et non vérifié. Alibaba n’a publié aucun tableau officiel de benchmarks, donc chaque chiffre ici est soit sa propre affirmation, soit une évaluation réalisée par un utilisateur sur un petit échantillon.

Les rapports du monde réel sont plus mitigés. Des testeurs comme @synthwavedd et @VoltraceGG sur X ont indiqué que le modèle semble un cran en dessous de ses scores dans le travail d’agent au quotidien. L’un l’a décrit comme étant en retard sur Kimi K3 en pratique malgré son avance dans les benchmarks, et d’autres ont mené des évaluations privées où il s’est révélé « même pas de près » comparable à Fable 5. Un point revient souvent : il est rapide, parfois de façon подозrieusement rapide, et sa production en conception frontend se situe autour du niveau de GLM-5.2 plutôt qu’à la pointe. C’est cet écart entre le classement et l’expérience qu’il faudra surveiller une fois les poids ouverts et que chacun pourra reproduire les tests.

Comment savoir à quel moment les poids sont réels

"Bientôt" deviendra "livré" grâce à des artefacts concrets, et non à une autre annonce. Surveillez tous les éléments suivants avant de considérer Qwen3.8 comme un modèle à poids ouverts sur lequel vous pouvez vous appuyer :

  • Une annonce officielle de sortie d'Alibaba/Qwen pointant vers un téléchargement, et pas seulement une publication « bientôt disponible ».
  • Un dépôt Hugging Face avec des fichiers de poids réels sous l'organisation Qwen d'Alibaba, ainsi qu'un fichier de licence que vous avez lu (les poids ouverts et les licences open source ne sont pas la même chose).
  • Une fiche modèle qui liste les paramètres actifs, la longueur de contexte et les modalités, et pas seulement le total de 2,4T.
  • Des benchmarks tiers réalisés par quelqu'un qui n'est pas Alibaba, exécutés sur les poids publiés plutôt que sur l'aperçu.
  • Une tarification API stable pour la version hébergée, afin que vous puissiez comparer le coût par token avec Kimi K3 et Claude.

Si vous choisissez aujourd’hui un modèle sur lequel construire, notre sélection des meilleurs LLM open source pour le codage couvre des options dont les weights sont déjà téléchargeables. Une fois que les weights de Qwen3.8 et une API stable seront disponibles, il sera également accessible via des passerelles API compatibles avec Anthropic comme AIReiter, aux côtés des autres modèles de pointe, afin que vous puissiez le comparer en A/B test à votre modèle actuel sans réécrire votre intégration.

FAQ

Qwen est-il en open weight ?

Les modèles Qwen précédents ont été publiés avec des poids ouverts, mais chaque sortie est une décision distincte. Les poids de Qwen3.8 sont promis mais ne sont pas encore disponibles, et les deux derniers fleurons d’Alibaba sont restés fermés au lancement, donc « Qwen est open » ne s’applique pas automatiquement à 3.8.

Qwen3.8 est-il gratuit à utiliser ?

Pas pour le moment. Qwen3.8-Max-Preview est derrière le plan payant Token Plan d'Alibaba Cloud et les plateformes Qoder. L'application gratuite Qwen Chat utilise toujours l'ancien Qwen3.7-Plus.

Qwen3.8 est-il meilleur que DeepSeek ou Claude ?

Sur les scores KingBench 3 rapportés par la communauté, Qwen3.8-Max devance légèrement Opus 4.8 et se place derrière Fable 5. Mais il s’agit d’affirmations non vérifiées, et plusieurs testeurs ont constaté que ses performances d’agent en परिस्थित реlles étaient inférieures à son rang sur les benchmarks. Il n’existe pas encore de confrontation indépendante en tête-à-tête avec DeepSeek V4 ou Claude sur les poids publiés, car les poids n’ont pas été publiés.

Quelle est la date de sortie de la version à poids ouverts de Qwen3.8 ?

Alibaba a seulement dit « bientôt ». Des fuites du jour du lancement indiquent un déploiement fin juillet 2026, et un rapport de seconde main sur Reddit suggère août. Aucune date ferme n’a été confirmée par Alibaba.