AIREITER

Qwen3.8-Omni-Flash API 定价:从费率表看实际成本

最后更新: 2026-09-18 07:05:17

Qwen3.8-Omni-Flash 的价格取决于输入模态和输出模式。以下费率来自 Alibaba Cloud 公布的新加坡/国际区域价目表,其中音频输入的价格几乎是文本输入的 9 倍。

一张表看懂费率

Alibaba Cloud 的模型与定价文档是确认具体端点费率的权威来源。国际区域价目表没有为 Qwen3.8-Omni-Flash 设定一个统一的综合 token 价格,而是分别列出了文本、音频、图像/视频输入,以及输出的收费标准。

计费项目新加坡/国际区域每 100 万 token 价格
文本输入$0.43
音频输入$3.81
图像或视频输入$0.78
纯文本输入后的文本输出$1.66
多模态输入后的文本输出$3.06

以上数据来自 Alibaba Cloud Model Studio 官方定价文档。制定预算前,请在控制台确认所用的模型 ID 和区域一致,因为其他 Qwen 模型或部署方式可能采用不同费率。

Qwen3.8-Omni-Flash 不等于 Qwen3.8-Flash

搜索结果中经常会出现三个相似的名称,但它们的费率和能力并不能混用。使用任何价目表中的数字前,都要先核对完整的模型 ID。

名称应该如何理解对定价的影响
Qwen3.8-Omni-Flash本文讨论的模型分别采用文本、音频、图像/视频和输出费率
Qwen3-Omni-Flash不同的一代模型不要套用它的费率表
Qwen3.8-Flash另一条 Flash 模型产品线它的文本 token 价格不是 Omni 的价格

Qwen 发布公告将 Qwen3.8-Omni-Flash 定义为原生多模态模型。不过在采购和部署时,具体端点的文档才是确认限制条件和支持功能的最终依据。

如何计算一次混合媒体请求

估算成本时,应针对每个计费类别分别套用对应费率。假设一次新加坡区域请求包含 100,000 个文本输入 token、20,000 个音频输入 token,并在接收多模态输入后生成 10,000 个输出 token。

  1. 文本输入:0.1 x $0.43 = $0.043
  2. 音频输入:0.02 x $3.81 = $0.0762
  3. 多模态请求输出:0.01 x $3.06 = $0.0306
  4. 预计总成本:$0.1498,不含税费或账户层面的调整。

音频输入的费率约为文本输入的 8.9 倍($3.81 / $0.43)。因此,即使输出内容很短,只按文本输入估算,也会低估以语音为主的工作负载成本。

这些计费细节会直接改变总价

Qwen3.8-Omni-Flash API 的成本不只是总 token 数量的问题。输入类型,以及请求是否包含多模态内容,都会决定费率表中的哪些项目生效。

音频必须单独估算

在列出的输入费率中,音频最高。如果是会议纪要或通话分析场景,应把音频 token 与文本提示词分开记录,不要把所有输入都按每百万 token $0.43 计算。

多模态输入会提高输出费率

纯文本输入后的文本输出价格为每百万 token $1.66,而在输入包含图像、音频或视频后,输出价格为每百万 token $3.06。如果只核算输入费用,就会漏掉这项 84% 的输出费率涨幅

区域也要纳入成本模型

Alibaba Cloud 提供按区域区分的部署信息,因此成本表中应将区域与完整模型 ID 一并记录。上面的新加坡费率只适用于新加坡区域,不能视为 Qwen 的统一全球价格。

公开标价不等于最终账单

税费、抵扣金、促销活动和账户条款都可能改变最终扣款金额。本文引用的公开价目表提供的是基础 token 费率;任何折扣或免费额度都应在账户控制台中确认,不要默认它们一定适用。

上线前只需核对四项信息

如果工作负载需要同时理解文本、音频、图像或视频,Qwen3.8-Omni-Flash 值得纳入评估。在让真实用户接入之前,先锁定下面四项信息,避免因模型名称或端点不一致而让成本估算失效:

  1. 完整模型 ID,包括代际信息和标点符号。
  2. API key 关联的区域和端点。
  3. 该端点标注的上下文、输出、速率限制和工具支持上限。
  4. 账户当前有效的抵扣金、促销活动及到期日期。

建议先运行一次具有代表性的请求,再通过返回的用量数据或控制台指标,分别记录文本、音频、图像/视频和输出 token。将实际用量代入费率表,比在没有文档依据的情况下把媒体时长换算成 token 更可靠。

Qwen3.8-Omni-Flash API 常见问题

Qwen3.8-Omni-Flash API 的价格是多少?

在新加坡区域,官方价目表显示:文本输入为每百万 token $0.43,音频输入为 $3.81,图像/视频输入为 $0.78;文本输出则根据输入是纯文本还是多模态内容,分别为 $1.66/M 或 $3.06/M。

Qwen3.8-Omni-Flash 和 Qwen3-Omni-Flash、Qwen3.8-Flash 是同一个模型吗?

不是。它们属于不同的模型产品线或代际。套用费率前,务必核对完整模型 ID。

音频如何计费?

按照本文引用的新加坡区域价目表,音频输入按 token 计费,价格为每百万 token $3.81。该价目表没有将音频列为按分钟收取的固定费用。

图像或视频输入会改变输出价格吗?

会。纯文本输入时,输出费率为每百万 token $1.66;当请求包含图像、音频或视频时,输出费率会上升到 $3.06/M。

实际该怎么选

如果多模态理解能力足以证明音频输入和多模态输出的费率合理,就可以考虑使用 Qwen3.8-Omni-Flash。先测试一个有代表性的工作负载,按模态查看实际用量,再比较每项任务的最终成本,而不是只盯着文本输入价格。

参考资料