Qwen3.8-Omni-Flash 的價格會隨輸入模態與輸出模式而變動。以下採用 Alibaba Cloud 公布的新加坡/國際版價格;其中音訊輸入的費率,幾乎是文字輸入的九倍。
一張表看懂官方費率
端點專屬的費率,應以 Alibaba Cloud 的模型與定價文件為準。國際版價目表並沒有替 Qwen3.8-Omni-Flash 提供單一的混合 token 價格,而是分別列出文字、音訊、圖片/影片,以及輸出的費用。
| 計費項目 | 新加坡/國際版每 1M tokens 價格 |
|---|---|
| 文字輸入 | $0.43 |
| 音訊輸入 | $3.81 |
| 圖片或影片輸入 | $0.78 |
| 純文字輸入後的文字輸出 | $1.66 |
| 多模態輸入後的文字輸出 | $3.06 |
以上數字來自 Alibaba Cloud Model Studio 官方定價文件。開始編列預算前,仍應在控制台確認相同的模型 ID 與區域,因為其他 Qwen 模型或部署方式可能採用不同費率。
Qwen3.8-Omni-Flash 不等於 Qwen3.8-Flash
搜尋結果中常會出現三個相近的名稱,但它們的費率與能力並不能互相套用。從任何價目表引用數字前,務必先核對完整模型 ID。
| 名稱 | 應如何理解 | 對定價的影響 |
|---|---|---|
| Qwen3.8-Omni-Flash | 本文介紹的模型 | 分別採用文字、音訊、圖片/影片與輸出費率 |
| Qwen3-Omni-Flash | 不同世代的模型 | 不可直接沿用它的價目表 |
| Qwen3.8-Flash | 另一條 Flash 模型產品線 | 它的文字 token 價格不是 Omni 的價格 |
Qwen 的發布公告將 Qwen3.8-Omni-Flash 定義為原生多模態模型。不過在採購與部署決策上,端點文件仍是確認使用限制與支援功能的最終依據。
混合媒體請求怎麼算
估算費用時,最實用的方法是針對每個計量類別套用各自的費率。假設一個新加坡請求包含 100,000 個文字輸入 tokens、20,000 個音訊輸入 tokens,並在接收多模態輸入後產生 10,000 個輸出 tokens。
- 文字輸入:0.1 x $0.43 = $0.043。
- 音訊輸入:0.02 x $3.81 = $0.0762。
- 多模態請求輸出:0.01 x $3.06 = $0.0306。
- 預估總費用:$0.1498,未計稅項或帳戶專屬調整。
音訊輸入的費率約是文字輸入的 8.9 倍($3.81 / $0.43)。因此,即使輸出內容很短,只要工作負載以語音為主,單純按照文字輸入估算就會低估成本。
這些計費陷阱會直接推高總額
Qwen3.8-Omni-Flash API 的價格不只取決於 token 總數。輸入類型,以及請求是否包含多模態內容,會決定價目表中的哪些費率真正適用。
音訊必須獨立估算
在列出的輸入費率中,音訊最高。如果是會議或通話分析工作流程,應把音訊 tokens 與文字提示分開記錄,不要把所有輸入都以每 M $0.43 計算。
多模態輸入會提高輸出費率
純文字輸入後的文字輸出為每 M $1.66;加入圖片、音訊或影片輸入後,則是每 M $3.06。如果只檢查輸入費用,就會漏算這項 84% 的輸出費率增幅。
區域也要放進成本模型
Alibaba Cloud 提供按區域區分的部署資訊,因此成本表應在精確模型 ID 旁註明所在區域。上面的新加坡數字就是新加坡費率,不應視為所有 Qwen 部署都適用的通用價格。
公開牌價不等於最終帳單
稅項、額度、促銷活動與帳戶條款,都可能改變實際扣款金額。本文引用的公開價目表只提供基本 token 費率;任何折扣或免費額度,都應在帳戶控制台確認,不要預設一定適用。
正式上線前,先確認四個欄位
如果工作負載需要同時理解文字、音訊、圖片或影片,Qwen3.8-Omni-Flash 值得納入評估。不過在接入真實使用者前,應先鎖定以下四項資料,避免模型名稱或端點對不上,導致成本估算失真:
- 完整模型 ID,包括世代名稱與標點符號。
- API key 所連接的區域與端點。
- 該端點列出的 context、輸出、速率限制與工具支援上限。
- 帳戶目前有效的額度、促銷方案與到期日。
先執行一個具代表性的請求,再利用回傳的使用量資料或控制台指標,分別記錄文字、音訊、圖片/影片與輸出 tokens。直接套用實際使用量,比採用未公開說明的假設,把媒體分鐘數換算成 tokens 更可靠。
Qwen3.8-Omni-Flash API 常見問題
Qwen3.8-Omni-Flash API 的價格是多少?
以新加坡為例,官方價目表列出的費率為:文字輸入每 M $0.43、音訊輸入每 M $3.81、圖片/影片輸入每 M $0.78;文字輸出則視輸入是純文字還是多模態,分別為每 M $1.66 或 $3.06。
Qwen3.8-Omni-Flash 和 Qwen3-Omni-Flash、Qwen3.8-Flash 是同一個模型嗎?
不是。它們屬於不同的模型產品線或世代。套用任何列出的費率前,都要先核對完整模型 ID。
音訊如何計費?
根據本文引用的新加坡價目表,音訊輸入按 tokens 計費,每 M $3.81,並不是以固定的每分鐘費用呈現。
圖片或影片輸入會改變輸出價格嗎?
會。純文字輸入的輸出費率為每 M $1.66;當請求包含圖片、音訊或影片時,列出的輸出費率會提高到每 M $3.06。
實際該怎麼選
如果多模態理解能力足以抵銷音訊與多模態輸出的較高費率,就可以考慮 Qwen3.8-Omni-Flash。先測試一個具代表性的工作負載,按模態檢查實際用量,再比較每個任務完成所需的成本,不要只看文字輸入價格。