AIREITER
DOCS APITARIFS
MODÈLES
  • AIReiter
  • Blog
  • Qwen3.8 Open Weights : date de sortie, fuites et attentes

Qwen3.8 Open Weights : date de sortie, fuites et attentes

Dernière mise à jour: 2026-07-29 11:13:07

Alibaba a dévoilé Qwen3.8-Max-Preview le 19 juillet 2026 via le compte officiel Qwen sur X, en promettant des open weights « coming soon » sans avancer de date. Le modèle accessible aujourd'hui est donc une preview hébergée, pas un téléchargement. Or c'est bien la publication des weights que tout le monde attend. Entre calendriers contradictoires, informations officielles limitées et chiffre accrocheur de 2,4 billions de paramètres, il manque surtout la donnée qui déterminera son coût réel d'exploitation.

Ce qu'est réellement Qwen3.8-Max-Preview

Qwen3.8-Max-Preview est la version hébergée, en accès anticipé, du prochain modèle phare d'Alibaba. Le compte Qwen d'Alibaba le présente comme un modèle entièrement multimodal de 2,4 billions de paramètres — texte, image et davantage au sein d'un même modèle — qu'il place comme « second only to » Claude Fable 5 d'Anthropic.

Il est déjà possible de le tester, mais dans un périmètre précis : l'abonnement Token Plan d'Alibaba Cloud, ainsi que les plateformes agentiques Qoder et QoderWork. Il n'est pas proposé par défaut dans l'application web gratuite Qwen Chat, qui charge encore Qwen3.7-Plus, la génération précédente.

L'application web Qwen Chat affiche Qwen3.7-Plus comme modèle par défaut, et non Qwen3.8

Le terme « Preview » doit être pris au pied de la lettre. Alibaba indique que les capacités du modèle continueront d'évoluer pendant cette phase ; ses scores comme son comportement peuvent donc changer avant la livraison des weights.

« Kaleb », le test discret qui a vendu la mèche

La preview n'est pas arrivée sans signaux préalables. Avant l'annonce officielle, des testeurs sur X avaient repéré Qwen3.8-Max dans l'arène publique de comparaison de modèles LMArena, sous le nom de code discret « Kaleb ». Les laboratoires utilisent ce type de pseudonyme pour recueillir des votes en duel à l'aveugle avant d'associer leur marque à un modèle.

Ce point est important pour une raison : l'engouement initial autour de ses capacités de génération de code frontend vient de ces confrontations Kaleb à l'aveugle, et non du marketing d'Alibaba. C'est à ce stade le signal tiers le plus solide, même si aucun résultat Kaleb archivé n'a été publié pour confirmer l'identité du modèle. Il faut donc y voir une affirmation communautaire crédible, pas une preuve.

À quand la sortie des open weights de Qwen3.8 ?

Trois calendriers circulent actuellement, sans se recouper :

SourceCalendrier avancé
Alibaba Qwen, publication officielle sur X« Open-weight soon », sans date
Publications de fuite sur X le jour du lancementDéploiement mondial d'ici fin juillet 2026
Reddit r/Qwen_AI (information indirecte, employé Alibaba lors d'une conférence à Paris)Août 2026

« Soon », « fin juillet » et « août » ne recouvrent pas la même promesse. L'hypothèse d'une sortie fin juillet provient de publications de fuite sur X le jour du lancement. La date d'août est rapportée de seconde main sur Reddit, à partir du commentaire attribué à un employé d'Alibaba : c'est donc l'information la moins robuste des trois.

Le précédent d'Alibaba invite aussi à la prudence. Ses deux derniers modèles phares Max n'ont pas publié leurs open weights le jour du lancement, et la génération précédente est restée fermée quelque temps après sa sortie. Une promesse d'open weights liée à une preview reste une promesse, pas une livraison.

À titre de comparaison, Moonshot a associé une date précise à la publication des weights de son concurrent Kimi K3, plutôt qu'un vague « soon ». Retrouvez cette date et les calculs matériels dans notre analyse des open weights de Kimi K3. Qwen3.8 n'a pas encore d'échéance ferme équivalente.

Les 2,4 T de paramètres ne disent pas l'essentiel

Les « 2,4 billions de paramètres » font un bon titre, mais c'est la donnée la moins utile pour un modèle mixture-of-experts (MoE). Ces modèles n'activent pour chaque token qu'une fraction de leurs paramètres totaux — les « paramètres actifs » par token. Le total renseigne donc très peu sur la vitesse ou le coût de serving.

Alibaba n'a pas communiqué le nombre de paramètres actifs. Tant qu'il restera inconnu, impossible d'estimer le coût d'exécution du modèle, sa rapidité ou le matériel nécessaire à l'auto-hébergement. Un total de 2,4 T peut correspondre à l'activation de quelques dizaines à quelques centaines de milliards de paramètres par token, avec des conséquences radicalement différentes sur les coûts.

C'est le principal angle mort pour quiconque prévoit de l'héberger soi-même. Un testeur sur X a plaisanté sur la nécessité de plusieurs RTX 6000 Pro pour faire tourner une version quantifiée en 4 bits ; cela restera de la spéculation tant que le nombre de paramètres actifs et les fichiers de weights réels ne seront pas disponibles.

Ce que remontent les premiers testeurs

La preview étant en ligne, les premiers retours directs affluent déjà, avec un contraste marqué entre benchmarks et usage réel.

Du côté des benchmarks, des chiffres KingBench 3 rapportés par la communauté placent Qwen3.8-Max devant Opus 4.8 et Kimi K3, seul Fable 5 le dépassant. Un développeur publiant sous le nom @Leo_R_UK sur X affirme avoir obtenu 59/60, son meilleur résultat à ce jour, sur une suite de six tâches d'agents de code exécutée via l'API directe.

Scores KingBench 3 rapportés par la communauté, plaçant Qwen3.8-Max-Preview en deuxième position derrière Claude Fable 5

Ce graphique doit être considéré comme une affirmation du fournisseur et de la communauté, non comme un résultat vérifié. Alibaba n'a publié aucun tableau de benchmarks officiel : chaque chiffre provient soit de ses propres déclarations, soit d'une évaluation utilisateur menée sur un échantillon limité.

Les retours en conditions réelles sont plus nuancés. Des testeurs comme @synthwavedd et @VoltraceGG sur X estiment que le modèle se situe un cran sous ses scores dans le travail agentique quotidien. L'un le juge derrière Kimi K3 en pratique malgré son avance dans les benchmarks ; d'autres ont mené des évaluations privées où il n'était « not even remotely close » de Fable 5. Un constat revient souvent : il est rapide, parfois même étrangement rapide, tandis que ses résultats en conception frontend se situent plutôt au niveau de GLM-5.2 qu'à la frontière de l'état de l'art. Cet écart entre classement et expérience sera à surveiller une fois les weights publiés, lorsque chacun pourra reproduire les tests.

Comment confirmer que les weights sont vraiment disponibles

Le passage de « soon » à « sorti » se mesurera à des éléments concrets, pas à une nouvelle annonce. Avant de considérer Qwen3.8 comme un modèle open-weight exploitable, surveillez tous les points suivants :

  • Une annonce officielle d'Alibaba/Qwen renvoyant vers un téléchargement, et non vers un simple message « coming soon ».
  • Un dépôt Hugging Face contenant les fichiers de weights sous l'organisation Qwen d'Alibaba, accompagné d'un fichier de licence que vous aurez lu : open weights et licence open source ne sont pas synonymes.
  • Une model card indiquant les paramètres actifs, la longueur de contexte et les modalités, au-delà du seul total de 2,4 T.
  • Des benchmarks tiers réalisés par une entité autre qu'Alibaba, sur les weights publiés plutôt que sur la preview.
  • Une tarification API stable pour la version hébergée, afin de comparer le coût par token avec Kimi K3 et Claude.

Si vous devez choisir dès aujourd'hui un modèle sur lequel construire, notre sélection des meilleurs LLM open source pour le code couvre des options dont les weights sont déjà téléchargeables. Lorsque les weights de Qwen3.8 et une API stable seront disponibles, il sera aussi accessible, aux côtés des autres modèles de pointe, via des passerelles API compatibles Anthropic comme AIReiter. Vous pourrez alors le comparer en A/B à votre modèle actuel sans réécrire votre intégration.

FAQ

Qwen est-il open weight ?

Des modèles Qwen antérieurs ont bien été publiés avec des open weights, mais chaque sortie fait l'objet d'une décision distincte. Les weights de Qwen3.8 sont promis mais pas encore disponibles ; les deux derniers modèles phares d'Alibaba étaient fermés à leur lancement. Dire que « Qwen est ouvert » ne s'applique donc pas automatiquement à la version 3.8.

Qwen3.8 est-il gratuit ?

Pas pour le moment. Qwen3.8-Max-Preview est réservé au Token Plan payant d'Alibaba Cloud et aux plateformes Qoder. L'application gratuite Qwen Chat utilise encore l'ancien Qwen3.7-Plus.

Qwen3.8 est-il meilleur que DeepSeek ou Claude ?

Selon les scores KingBench 3 rapportés par la communauté, Qwen3.8-Max devance légèrement Opus 4.8 et reste derrière Fable 5. Mais ces affirmations ne sont pas vérifiées, et plusieurs testeurs ont trouvé ses performances agentiques réelles inférieures à son rang dans les benchmarks. Il n'existe pas encore de comparaison indépendante face à DeepSeek V4 ou Claude sur les weights publiés, puisqu'ils ne sont pas encore sortis.

Quelle est la date de sortie des open weights de Qwen3.8 ?

Alibaba s'est limité à annoncer « soon ». Des fuites publiées le jour du lancement évoquent un déploiement fin juillet 2026, tandis qu'un rapport Reddit de seconde main mentionne août. Alibaba n'a confirmé aucune date ferme.

>_Répertoire des modèles AIReiter

Accès API rapide aux modèles liés à ce guide

Kimi K3

Chat

Un modèle de raisonnement à long contexte pour le codage, l’écriture, l’analyse et les workflows d’agents.

MoonshotCréer une API Key >

Claude Fable 5

Chat

Un modèle Claude premium pour le raisonnement approfondi et le travail long et complexe.

AnthropicCréer une API Key >

GPT-5.6 Sol

Chat

Un modèle de texte GPT-5.6 haut de gamme pour le codage exigeant, le raisonnement et les travaux d’agent au long cours.

OpenAICréer une API Key >

Gemini 3.1 Pro

Chat
GoogleCréer une API Key >

Claude Sonnet 4.6

Chat
AnthropicCréer une API Key >

Articles récents

API OpenRouter Fusion Flash : disponibilité, configuration et résolution des erreurs 400

2026-09-11

Tarification d’OpenRouter Fusion : taille du panel et coût des tokens

2026-09-11

Revue de la bêta de Cursor Projects : utile pour les migrations de grande ampleur ?

2026-09-11

OpenAI Agents API en bêta publique : tarifs, sandbox et limites

2026-09-11
AIREITER

Des questions ? Contactez-nous à
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

Vidéo IA

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

Image IA

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

Blog

Voir tout →

Entreprise

Politique de confidentialitéConditions d'utilisationPolitique de remboursement

© 2026 AIReiter. Tous droits réservés.