Alibabaの公式QwenアカウントはX上で、2026年7月19日にQwen3.8-Max-Previewを発表し、オープンウェイトは日付未定で「近日公開」と述べました。つまり、今日試せるモデルはダウンロード版ではなく、ホストされたプレビューです。オープンウェイト版のリリースこそ人々が実際に待っているもので、現時点ではスケジュールに矛盾があり、見出しの2.4兆パラメータという数字は重要な数値を隠しています。確認できている詳細は乏しく、リークされたタイムラインは3つの異なる方向を示しており、実際のコストを左右する唯一の数字はまだまったく公表されていません。
Qwen3.8-Max-Preview が実際に何であるか
Qwen3.8-Max-Preview は、Alibaba の次期フラッグシップのホスト版の早期アクセス版です。Alibaba の Qwen アカウントでは、これは 2.4 兆パラメータの完全なマルチモーダルモデル(テキスト、画像などを 1 つのモデルで扱う)であり、Anthropic の Claude Fable 5 に「次ぐ」と位置づけられていると説明されています。
現在はテストできますが、利用できるのは特定の場所に限られます。Alibaba Cloud の Token Plan サブスクリプションと、Qoder および QoderWork の agentic プラットフォームです。無料の Qwen Chat ウェブアプリではデフォルトではなく、こちらは引き続き前世代の Qwen3.7-Plus を読み込みます。
「Preview」はここでは文字どおりの警告です。Alibaba は、プレビュー期間中にモデルの機能は継続的に変化し続けるため、現在見えているスコアや挙動は、weights の出荷前に変わる可能性があると述べています。
それを見抜くきっかけとなった「Kaleb」のステルステスト
プレビューは突然出てきたわけではありません。正式発表の前に、X上のテスターたちが、Qwen3.8-MaxがLMArenaの公開モデル比較アリーナで、ステルスのコードネーム「Kaleb」の下で動作していたことを指摘していました。研究所は、自社のブランドをモデルに付ける前に、匿名のコードネームを使ってブラインドの一対一投票を集めます。
その詳細が重要なのは1つの理由によります。モデルがフロントエンドのコード生成に強いという初期の評判は、Alibabaのマーケティングではなく、あのブラインドのKaleb対戦に端を発しています。これまでに存在する第三者シグナルとしては最も近いものですが、本人確認を裏づけるアーカイブ済みのKaleb結果を公開した人はまだいないため、証拠というよりはコミュニティの強い主張として扱うべきです。
Qwen3.8 のオープンウェイトはいつ公開されますか?
3つの異なるタイムラインが出回っており、互いに一致していません:
| ソース | 主張された予定 |
|---|---|
| Alibaba Qwen、Xでの公式投稿 | 「Open-weight soon」、日付なし |
| X上のローンチ当日のリーク投稿 | 2026年7月末までにグローバル展開 |
| Reddit r/Qwen_AI(また聞き、パリのカンファレンスにいたAlibaba社員) | 2026年8月 |
「まもなく」「7月末」「8月」は同じ約束ではありません。7月末という主張は、X上のローンチ当日のリーク投稿に由来します。8月という数字は、Redditで報告されたAlibabaの従業員のコメントについての伝聞であり、3つの中で最も確度の低いものとして扱うべきです。
実績にも問題があります。Alibabaの直近2つのフラッグシップMaxモデルは、どちらも初日にオープンウェイトとして公開されず、前世代もリリース後しばらくクローズドのままでした。プレビューに付けられたオープンウェイトの約束は、約束であって、リリースではありません。
対照的に、Moonshotは競合するKimi K3のweightsに、曖昧な「soon」ではなく具体的な暦日を付けました。正確な日付とハードウェアの計算については、Kimi K3 open weights の解説をご覧ください。Qwen3.8には、まだ同等の確定日付はありません。
重要なのは2.4Tという数値ではありません
「2.4兆パラメータ」は見出しとなる数値ですが、mixture-of-experts(MoE)モデルにとっては最も役に立たない指標です。MoEモデルは各トークンを総パラメータの一部だけ、つまりトークンごとの「アクティブパラメータ」に通すため、総数だけでは速度や推論コストについてほとんど何も分かりません。
Alibabaはアクティブパラメータ数を公開していません。公開されるまでは、このモデルの運用コストがどの程度か、速度がどのくらいか、自己ホスト版にどのようなハードウェアが必要かを見積もることはできません。総計2.4Tという値からは、トークンごとに有効化されるパラメータ数が数十億から数千億の範囲まであり得ますが、それぞれのケースでコスト面の影響は大きく異なります。
これは、自前でホストしようと考えている人にとって最も重要なギャップです。X上のあるテスターは、4ビット量子化版を動かすには複数のRTX 6000 Proカードが必要だと冗談を言っていましたが、アクティブパラメータ数と実際の重みファイルが存在するまでは、それは推測の域を出ません。
初期テスターが実際に見ているもの
プレビューは公開中のため、すでに直接の反応が寄せられており、ベンチマークと実運用の間で大きく意見が分かれています。
ベンチマーク面では、コミュニティ報告の KingBench 3 の数値では、Qwen3.8-Max は Opus 4.8 と Kimi K3 を上回り、Fable 5 だけが先行していました。X で @Leo_R_UK として投稿しているある開発者は、direct API を通して実行した6タスクの coding-agent スイートで 59/60 を記録し、これまでに記録した中で最高の結果だったと述べました。
そのチャートは、ベンダーおよびコミュニティによる主張として扱い、検証済みではないものとしてください。Alibaba は公式のベンチマーク表を公開していないため、ここにある各数値は、同社自身の主張か、小規模サンプルで実施されたユーザーによる評価のいずれかです。
実際の現場での報告のほうがもっと興味深いです。X上の@synthwaveddや@VoltraceGGのようなテスターは、このモデルは日常的なエージェント作業ではスコアより一段下に感じると述べました。ある人は、ベンチマークでは先行しているにもかかわらず、実運用ではKimi K3に後れを取っていると表現し、ほかの人たちは非公開の評価を行い、Fable 5には「まったく及ばない」と結論づけました。共通していた指摘は、速い、時には疑わしいほど速いということ、そしてフロントエンドデザインの出力は最先端というよりGLM-5.2程度にとどまるということです。このリーダーボード上の成績と実体験のギャップこそ、重みが公開されて誰でもテストを再現できるようになったときに注目すべき点です。
重みが本物だと見分ける方法
「Soon」は、さらなる発表ではなく、具体的な成果物を通じて「shipped」へと変わります。Qwen3.8を構築の土台にできるオープンウェイトモデルとして扱う前に、以下のすべてを確認してください:
- ダウンロード先を示すAlibaba/Qwenの公式リリース発表であり、単なる「近日公開」投稿ではないもの。
- AlibabaのQwen組織配下にある、実際の重みファイルを含むHugging Faceリポジトリと、あなたが確認済みのライセンスファイル(オープンウェイトとオープンソースライセンスは同じではありません)。
- 有効パラメータ数、コンテキスト長、モダリティを記載したモデルカードで、2.4Tの総数だけではないもの。
- Alibaba以外の第三者ベンチマークで、プレビュー版ではなく公開された重みを用いて実行されたもの。
- ホスト版の安定したAPI価格で、Kimi K3やClaudeとトークン単価を比較できるもの。
今日、構築のベースにするモデルを選ぶなら、コーディング向けの最良のオープンソースLLMに関する私たちのまとめでは、すでに重みをダウンロードできる विकल्पを紹介しています。Qwen3.8 の重みと安定した API が公開されれば、他のフロンティアモデルと並んで、AIReiter のような Anthropic 互換 API ゲートウェイ経由でも利用できるようになり、統合を作り直すことなく、現在のモデルと A/B テストで比較できます。
よくある質問
Qwenはオープンウェイトですか?
これまでのQwenモデルはオープンウェイトで提供されてきましたが、各リリースは個別の判断です。Qwen3.8のウェイトは提供予定とされていますが、まだ公開されておらず、Alibabaの直近2つのフラッグシップもリリース時点ではクローズドのままでした。そのため、「Qwenはオープンである」ということが自動的に3.8にも当てはまるわけではありません。
Qwen3.8は無料で使えますか?
今はまだです。Qwen3.8-Max-Previewは、Alibaba Cloudの有料Token PlanとQoderプラットフォームの背後にあります。無料のQwen Chatアプリは、引き続き以前のQwen3.7-Plusを使用しています。
Qwen3.8 は DeepSeek や Claude より優れていますか?
コミュニティ報告のKingBench 3スコアでは、Qwen3.8-MaxはOpus 4.8をわずかに上回り、Fable 5の下に位置しています。しかし、これらは未検証の主張であり、複数のテスターは、実世界でのエージェント性能がベンチマーク上の順位を下回ると指摘しました。公開済みのweightsに対してDeepSeek V4やClaudeとの独立した直接比較はまだありません。というのも、weightsは公開されていないからです。
Qwen3.8 のオープンウェイト版のリリース日はいつですか?
Alibabaは「soon」としか述べていません。発売日のリーク情報は2026年7月下旬の展開を示しており、Redditの二次情報では8月を示唆しています。Alibabaによって確定した日付はまだありません。
