AIREITER
API 文档价格
模板
  • AIReiter
  • 博客
  • Qwen3.8 开放权重:发布时间、泄露消息与值得关注的信号

Qwen3.8 开放权重:发布时间、泄露消息与值得关注的信号

最后更新: 2026-07-29 11:14:01

阿里巴巴官方 Qwen 账号于 2026 年 7 月 19 日在 X 上发布了 Qwen3.8-Max-Preview,并表示开放权重“即将推出”,但没有给出具体日期。换句话说,现在能体验到的是托管的预览版,并不是可下载的模型权重。真正受关注的开放权重何时到来,眼下仍没有一致答案;而“2.4 万亿参数”这个醒目的数字,也掩盖了一个更影响实际使用成本的关键数据。官方已确认的信息不多,泄露消息给出了三个不同方向的时间表,决定部署成本的核心参数则完全没有公布。

Qwen3.8-Max-Preview 到底是什么

Qwen3.8-Max-Preview 是阿里巴巴下一代旗舰模型的托管式早期体验版本。阿里巴巴 Qwen 账号称,它是一款总参数量达 2.4 万亿的全模态模型,可处理文本、图像等多种输入,并将其定位为“仅次于” Anthropic 的 Claude Fable 5。

目前可以体验该模型,但入口有限:阿里云 Token Plan 订阅,以及 Qoder 和 QoderWork 两个智能体平台。免费版 Qwen Chat 网页端并未默认使用它,仍然加载上一代的 Qwen3.7-Plus。

Qwen Chat 网页应用默认显示 Qwen3.7-Plus,而非 Qwen3.8

这里的“Preview”并非只是名称。阿里巴巴明确表示,模型能力会在预览期间持续调整,因此现在看到的分数和实际表现,都可能在权重发布前发生变化。

“Kaleb”匿名测试:预览版发布前就已露出踪迹

Qwen3.8-Max-Preview 并非毫无征兆地出现。在正式公布前,X 上已有测试者发现,Qwen3.8-Max 曾以“Kaleb”这一匿名代号参与 LMArena 的公开模型对比竞技场。实验室常用这类匿名代号收集盲测对战票数,再为模型挂上正式品牌。

这一线索之所以值得注意,是因为早期关于它前端代码生成能力很强的讨论,源头来自这些匿名 Kaleb 对局,而不是阿里巴巴自己的宣传。这可以算是目前最接近第三方信号的依据。不过,尚未有人公开留存的 Kaleb 测试结果来确认其身份,因此更适合将其视为可信度较高的社区说法,而非确凿证据。

Qwen3.8 开放权重究竟何时发布?

目前流传着三种彼此不一致的时间表:

来源声称的时间
阿里巴巴 Qwen 官方 X 帖文“开放权重即将推出”,未给日期
发布当天的 X 泄露帖文2026 年 7 月底前全球推出
Reddit r/Qwen_AI(二手消息,据称来自巴黎会议上的阿里巴巴员工)2026 年 8 月

“即将推出”“7 月底前”和“8 月”显然不是同一种承诺。7 月底这一说法来自发布当天 X 上的泄露帖文;至于 8 月,则是 Reddit 对一名阿里巴巴员工发言的二手转述,三者中可信度最弱。

此外还有过往记录的问题。阿里巴巴最近两款旗舰 Max 模型都没有在首发当天开放权重,上一代在发布后也维持了一段时间的闭源状态。预览版附带的开放权重承诺,终究只是承诺,不等于已经发布。

相比之下,Moonshot 为竞争产品 Kimi K3 的权重给出了明确日历日期,而不是模糊地说“即将推出”。具体日期和硬件需求计算可参考我们的 Kimi K3 open weights 解析。Qwen3.8 目前还没有对应的确定日期。

2.4T 并不是最该关注的参数

“2.4 万亿参数”很适合作为宣传标题,但对于混合专家模型(MoE)而言,它却是最不实用的指标之一。MoE 会让每个 token 只经过总参数中的一部分,也就是每 token 的“激活参数”;因此,总参数量几乎无法直接说明推理速度或服务成本。

阿里巴巴尚未公布激活参数量。在这项数据出现前,外界无法估算模型运行成本、速度,以及自部署所需的硬件配置。总量为 2.4T 的模型,每个 token 可能激活数百亿到数千亿参数,成本差异会非常大。

对于计划自部署的人来说,这正是最重要的信息缺口。X 上有测试者开玩笑说,运行 4-bit 量化版本可能需要多张 RTX 6000 Pro;但在激活参数量和实际权重文件公布前,这都只能算猜测。

早期测试者的实际反馈如何

预览版已经开放体验,第一手反馈也开始出现,但基准成绩与实际使用感受之间的差异相当明显。

在基准测试方面,社区流传的 KingBench 3 数据显示,Qwen3.8-Max 超过了 Opus 4.8 和 Kimi K3,仅排在 Fable 5 之后。X 用户 @Leo_R_UK 表示,他们通过直连 API 运行了一套包含六项任务的编码智能体测试,得分为 59/60,是其记录中的最高成绩。

社区报告的 KingBench 3 成绩:Qwen3.8-Max-Preview 排在 Claude Fable 5 之后

但这张图应被视为厂商与社区的自行声明,而不是经过验证的结论。阿里巴巴没有发布官方基准测试表,其中每个数字要么来自自身说法,要么来自用户在较小样本上的评测。

真实工作流中的反馈则更冷静。X 上的 @synthwavedd、@VoltraceGG 等测试者认为,这个模型在日常智能体任务中的表现比跑分低一个档次。有人称,尽管它在基准测试中领先,实战却不如 Kimi K3;也有人在私有评测中发现,它与 Fable 5“完全谈不上接近”。较常见的评价是:它很快,有时快得让人怀疑;前端设计输出大致处于 GLM-5.2 的水平,而非真正前沿。等到权重开放后,任何人都能复现实验,届时排行榜与实际体验之间的落差才是最值得观察的部分。

如何确认开放权重真的已经发布

“即将推出”要变成“已经发布”,靠的不是又一条公告,而是具体可用的交付物。在把 Qwen3.8 当作可用于项目的开放权重模型前,至少应看到以下信号:

  • 阿里巴巴/Qwen 的正式发布公告:公告应直接指向下载地址,而不只是再说一次“即将推出”。
  • Hugging Face 上真实可下载的权重仓库:仓库应位于阿里巴巴的 Qwen 组织名下,并附带你已阅读的许可证文件。开放权重与开源许可证并不是一回事。
  • 列明激活参数的模型卡:除了 2.4T 总参数量,还应包含上下文长度和支持的模态。
  • 第三方基准测试:评测方不应是阿里巴巴,且必须基于已发布的权重,而不是预览版。
  • 稳定的 API 定价:这样才能将每 token 成本与 Kimi K3、Claude 进行比较。

如果你现在就要选择一个可用于开发的模型,我们整理的 best open-source LLMs for coding 涵盖了已可下载权重的选项。等到 Qwen3.8 的权重和稳定 API 上线后,它也能像其他前沿模型一样,通过 AIReiter 等兼容 Anthropic API 的网关接入;届时无需重写集成,就能与当前模型进行 A/B 对比。

常见问题

Qwen 是开放权重模型吗?

此前的 Qwen 模型曾发布开放权重,但每一代是否开放都是独立决定。Qwen3.8 的权重虽已承诺开放,却尚未发布;而且阿里巴巴最近两款旗舰模型在发布时均保持闭源。因此,“Qwen 是开放的”这一结论不能自动套用到 3.8。

Qwen3.8 可以免费使用吗?

目前不可以。Qwen3.8-Max-Preview 需要通过阿里云付费 Token Plan 或 Qoder 平台使用。免费 Qwen Chat 应用仍在运行较早的 Qwen3.7-Plus。

Qwen3.8 比 DeepSeek 或 Claude 更强吗?

按社区报告的 KingBench 3 成绩,Qwen3.8-Max 略高于 Opus 4.8,但低于 Fable 5。不过这些都尚未得到验证,且多位测试者认为它在真实智能体任务中的表现低于基准排名。由于权重尚未发布,目前也不存在基于已发布权重、与 DeepSeek V4 或 Claude 的独立正面对比。

Qwen3.8 开放权重的发布日期是什么时候?

阿里巴巴目前只表示“即将推出”。发布当天的泄露消息指向 2026 年 7 月下旬,而 Reddit 上的一则二手消息称可能是 8 月。阿里巴巴尚未确认具体日期。

>_AIReiter 模型目录

快速访问与本指南相关的模型 API

Kimi K3

Chat

用于编码、写作、分析和智能体工作流的长上下文推理模型。

Moonshot获取 API Key >

Claude Fable 5

Chat

一款用于深度推理和复杂长篇任务的高级 Claude 模型。

Anthropic获取 API Key >

GPT-5.6 Sol

Chat

一款高级的 GPT-5.6 文本模型,适用于高要求的编程、推理和长篇 agent 工作。

OpenAI获取 API Key >

Gemini 3.1 Pro

Chat
Google获取 API Key >

Claude Sonnet 4.6

Chat
Anthropic获取 API Key >

最新文章

OpenRouter Fusion Flash API:状态、配置与 400 错误排查

2026-09-11

OpenRouter Fusion 定价:面板规模与 Token 成本

2026-09-11

Cursor Projects Beta 评测:它适合大型迁移吗?

2026-09-11

OpenAI Agents API 公测:价格、沙箱与使用注意事项

2026-09-11
AIREITER

有问题?请联系我们
[email protected]

新速率有限公司NEWRATE LIMITED香港九龍花園街 2-16 號好景商業中心 2304 室Room 2304, Haojing Commercial Center, 2-16 Garden Street, Kowloon, Hong Kong

LLM

GPT-6 AstraGemini 3.8 FlashClaude Fable 5.1GLM-5.3 FlashGemini 3.6 Flash

AI 视频

Gemini Omni 1.1 Flash ExtMiniMax H3Kling 3.0 Motion ControlKling 3.0 TurboKling 3.0

AI 图片

GPT-Image 2.5Grok Imagine Image 2.0Midjourney V8.1Midjourney V7Z-Image Turbo

博客

查看全部 →

公司

隐私政策服务条款退款政策

© 2026 AIReiter。保留所有权利。