AIREITER
API 文件價格
範本
  • AIReiter
  • 部落格
  • Qwen3.8 Open Weights:發布日期、爆料與後續重點

Qwen3.8 Open Weights:發布日期、爆料與後續重點

最近更新: 2026-07-29 11:14:34

Alibaba 官方 Qwen 帳號在 2026 年 7 月 19 日於 X 宣布 Qwen3.8-Max-Preview,並表示 open weights「coming soon」,但沒有給出日期。換句話說,目前能實際試用的是託管式預覽版,不是可下載的模型權重。大家真正等待的是 open-weight 版本;然而現階段的發布時程說法彼此衝突,而醒目的 2.4 兆參數數字,也掩蓋了真正左右部署成本的關鍵資料。官方已確認的資訊不多,流出消息指向三種不同時間點,至於決定實務成本的那個數字,Alibaba 至今尚未公開。

Qwen3.8-Max-Preview 到底是什麼?

Qwen3.8-Max-Preview 是 Alibaba 下一代旗艦模型的託管式搶先體驗版本。Alibaba 的 Qwen 帳號將它描述為一個擁有 2.4 兆參數、完整多模態的模型,也就是能在同一模型內處理文字、圖片等內容,並稱其能力「second only to」Anthropic 的 Claude Fable 5。

目前可以試用,但僅限特定管道:Alibaba Cloud 的 Token Plan 訂閱,以及 Qoder 與 QoderWork 兩個 agentic 平台。免費版 Qwen Chat 網頁應用程式尚未將它設為預設模型,仍會載入上一代的 Qwen3.7-Plus。

Qwen Chat 網頁應用程式顯示預設模型為 Qwen3.7-Plus,而非 Qwen3.8

這裡的「Preview」不是裝飾字眼。Alibaba 表示,模型能力會在預覽期間持續調整,因此現在看到的分數或使用表現,都可能在權重正式發布前改變。

「Kaleb」匿名測試如何讓 Qwen3.8 提前曝光

這次預覽版並非毫無預兆。正式公開前,X 上的測試者就發現 Qwen3.8-Max 疑似以「Kaleb」這個匿名代號,出現在 LMArena 公開模型對戰平台。實驗室常會先用未掛牌的代號進行盲測對決,蒐集使用者的直接投票,再將品牌名稱與模型綁定。

這件事的重要性在於:早期關於它擅長前端程式碼生成的討論,主要來自 Kaleb 的盲測對局,而非 Alibaba 自己的宣傳。這算是目前最接近第三方訊號的資料;不過尚未有人公開保存的 Kaleb 測試結果來確認其身分,因此較適合視為可信度高的社群說法,而不是已被證實的事實。

Qwen3.8 open weights 何時發布?

目前流傳三種不同時程,而且彼此對不上:

來源宣稱時程
Alibaba Qwen 在 X 的官方貼文「Open-weight soon」,未提供日期
X 上的發布當日爆料貼文2026 年 7 月底前全球推出
Reddit r/Qwen_AI(轉述巴黎會議上一名 Alibaba 員工的說法)2026 年 8 月

「soon」、「7 月底」和「8 月」顯然不是同一個承諾。7 月底推出的說法來自 X 上發布當日的爆料;8 月的時間點則是 Reddit 轉述 Alibaba 員工在巴黎會議上的評論,三者之中可信度最弱。

另外還得看過往紀錄。Alibaba 最近兩款旗艦 Max 模型都沒有在首日釋出 open weights,前一代模型在推出後也維持封閉一段時間。預覽版附帶的 open-weight 承諾終究只是承諾,不等於已經發布。

作為對照,Moonshot 為競爭產品 Kimi K3 的權重直接給出明確日曆日期,而不是模糊地說「soon」。確切日期與硬體需求的計算方式,可參考我們的 Kimi K3 open weights 解析。Qwen3.8 目前還沒有相應的明確發布日期。

2.4T 不是最該看的參數數字

「2.4 兆參數」是最吸睛的宣傳數字,但對 mixture-of-experts(MoE)模型來說,反而是最不具參考價值的一項。MoE 每次處理一個 token,只會路由到全體參數中的一部分,也就是每 token 的「active parameters」;因此總參數量幾乎無法說明模型速度或推論服務成本。

Alibaba 尚未公布 active-parameter count。在這項資料出來前,無法估算模型運行成本、推論速度,也不知道自行部署需要什麼等級的硬體。2.4T 的總參數模型,每個 token 可能只啟用數百億到數千億參數,而不同情境的成本差異會非常大。

對有意自行部署的人來說,這正是最關鍵的資訊缺口。有測試者在 X 上開玩笑說,若要跑 4-bit 量化版本,可能得準備多張 RTX 6000 Pro;但在 active-parameter 數字與實際權重檔案公開前,這些都只是猜測。

早期測試者實際觀察到什麼?

由於預覽版已經可用,第一手使用回饋也開始出現;不過,跑分與實際體驗之間的落差相當明顯。

在 benchmark 方面,社群回報的 KingBench 3 成績顯示,Qwen3.8-Max 高於 Opus 4.8 與 Kimi K3,僅落後 Fable 5。在 X 上使用 @Leo_R_UK 帳號的一名開發者表示,他透過直接 API 執行一套六項任務的 coding-agent 測試,取得 59/60,是他記錄過的最高成績。

社群回報的 KingBench 3 分數顯示 Qwen3.8-Max-Preview 僅次於 Claude Fable 5,排名第二

不過,這張圖表應視為廠商與社群宣稱,並非已驗證的結果。Alibaba 尚未發布正式 benchmark 表格,因此其中每個數字不是自行宣稱,就是使用者以小樣本執行的評測。

實務使用回饋則更保留。X 上的 @synthwavedd、@VoltraceGG 等測試者表示,這個模型在日常 agent 工作中的表現,比分數所呈現的水準低了一截。有人認為它雖然 benchmark 領先,實際用起來卻落後 Kimi K3;也有人在私有評測中發現,它和 Fable 5「not even remotely close」。常見評價是速度很快,有時甚至快得可疑;前端設計輸出則大約落在 GLM-5.2 水準,還稱不上前沿。等權重開放後,任何人都能重現測試,這種排行榜與真實體驗的落差將是最值得追蹤的重點。

如何確認權重真的發布了?

「soon」要變成「已發布」,靠的不是另一則公告,而是具體可取得的產物。在將 Qwen3.8 視為可用於正式開發的 open-weight 模型前,請留意以下所有訊號:

  • Alibaba/Qwen 的正式發布公告,而且內容必須指向可下載項目,不只是另一篇「coming soon」貼文。
  • Hugging Face 上有實際權重檔案的 repo,需位於 Alibaba 的 Qwen 組織帳號下,並附有你已閱讀的授權檔案;open weights 與 open-source 授權並不是同一件事。
  • 列出 active parameters 的 model card,內容還應包含 context length 與模態支援,而非只寫 2.4T 總參數。
  • 第三方 benchmark 成績,由 Alibaba 以外的人以已發布權重執行,而不是拿預覽版測試。
  • 託管版穩定的 API 定價,如此才能與 Kimi K3、Claude 比較每 token 成本。

如果你現在就要選擇可用於開發的模型,我們整理的 best open-source LLMs for coding 涵蓋了已經能下載權重的選項。待 Qwen3.8 的權重與穩定 API 上線後,也能透過 AIReiter 這類相容於 Anthropic 的 API gateway 存取,並與其他前沿模型並列;你就能在不改寫既有整合的情況下,直接拿它與目前使用的模型做 A/B 測試。

常見問題

Qwen 是 open weight 模型嗎?

較早期的 Qwen 模型曾發布 open weights,但每次發布都是獨立決策。Qwen3.8 的權重雖已承諾推出,卻尚未發布;而 Alibaba 最近兩款旗艦模型在上市時都維持封閉,因此不能因為「Qwen 是開放的」就自動套用到 3.8。

Qwen3.8 可以免費使用嗎?

目前不行。Qwen3.8-Max-Preview 需要透過 Alibaba Cloud 的付費 Token Plan 或 Qoder 平台使用。免費 Qwen Chat 應用程式仍採用較舊的 Qwen3.7-Plus。

Qwen3.8 比 DeepSeek 或 Claude 更好嗎?

依社群回報的 KingBench 3 分數,Qwen3.8-Max 略高於 Opus 4.8,並排在 Fable 5 之後。但這些都是未驗證的宣稱,且多名測試者認為它的實際 agent 表現低於 benchmark 排名。目前也沒有以已發布權重進行的獨立對比,可與 DeepSeek V4 或 Claude 直接比較,因為權重尚未發布。

Qwen3.8 open weights 的發布日期是何時?

Alibaba 目前只說「soon」。發布當日的爆料指向 2026 年 7 月底推出,另一則 Reddit 的轉述消息則稱為 8 月。Alibaba 尚未確認任何明確日期。

>_AIReiter 模型目錄

快速存取與本指南相關的模型 API

Kimi K3

Chat

一款適用於程式碼撰寫、寫作、分析與 agent 工作流程的長上下文推理模型。

Moonshot取得 API Key >

Claude Fable 5

Chat

一款適合深度推理與複雜長篇工作的高級 Claude 模型。

Anthropic取得 API Key >

GPT-5.6 Sol

Chat

一款高級 GPT-5.6 文字模型,適用於高要求的程式設計、推理與長篇代理工作。

OpenAI取得 API Key >

Gemini 3.1 Pro

Chat
Google取得 API Key >

Claude Sonnet 4.6

Chat
Anthropic取得 API Key >

最新文章

OpenRouter Fusion Flash API:狀態、設定與 400 錯誤排解

2026-09-11

OpenRouter Fusion 定價:面板規模與 Token 成本

2026-09-11

Cursor Projects Beta 評測:適合大型遷移嗎?

2026-09-11

OpenAI Agents API 公開 Beta:定價、沙盒與採用注意事項

2026-09-11
AIREITER

有問題?請聯絡我們
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI 影片

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI 圖片

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

部落格

查看全部 →

公司

隱私政策服務條款退款政策

© 2026 AIReiter。保留所有權利。