阿里巴巴已公布 Qwen Image 3 Pro 的官方 API 定價:北京區 1K 級圖片每張 ¥0.25(約 $0.035),升到 2K 則加倍為 ¥0.5;同解析度下,價格是標準版 qwen-image-3.0 的 2.8 倍。若你要產生文字密集的版面,這筆溢價有其道理;但官方模型頁上的另一個數字,可能會徹底改變你的使用規劃:速率限制只有每分鐘 1 次請求。
Qwen Image 3 Pro 比 qwen-image-3.0 多了什麼?
Qwen Image 3 Pro(qwen-image-3.0-pro)是阿里巴巴 Qwen-Image-3.0 系列的高品質版本,於 2026 年 7 月 21 日推出。它與標準版 qwen-image-3.0 共用同一套 API,可做文字生成圖片與圖片編輯,尺寸限制也完全一致。真正的差別在輸出品質,以及 2K 圖片的計費方式。
3.0 系列共通的主要能力包括:
- 4.5k token 提示詞:相較前一代約 1k token 大幅提升,一次就能交代完整報紙版面、3×3 資訊圖表網格,或 UI 裡再嵌 UI 的複雜構圖
- 10px 小字渲染:即使是 LaTeX 公式、上標與定理編號,仍能維持可讀性
- 原生支援 12 種語言、20 種以上字體:也能模擬網頁、遊戲與直播介面
兩者的定位才是分水嶺。阿里巴巴自己的模型選型指南,將複雜版面生成、精準小字渲染與多語言字體工作導向 Pro;標準版則主打品質與速度的平衡。除此之外,兩個模型 ID 的規格表相同:輸出總像素介於 512×512 與 2048×2048、長寬比可從 1:8 到 8:1,編輯時可帶入 1–3 張參考圖,輸出格式為 PNG。
官方 API 定價:截至 2026 年 8 月的核實結果
阿里雲 Model Studio 列出 qwen-image-3.0-pro 在兩個區域的單張計價。以下依 2026 年 8 月 5 日的官方價目表核對:
| 計費項目 | 北京(人民幣) | 新加坡國際站(人民幣) | 約當美元 |
|---|---|---|---|
| 圖片輸入(每張) | ¥0.02 | ¥0.022483 | ~$0.003 |
| 1K 輸出(每張) | ¥0.25 | ¥0.299768 | ~$0.035–0.042 |
| 2K 輸出(每張) | ¥0.5 | ¥0.562065 | ~$0.070–0.079 |
1K 與 2K 的分界看的是像素面積:不超過 2,250,000 像素皆按 1K 價格計費,超過就按 2K 計。標準版 qwen-image-3.0 不論哪種解析度,單張輸出一律 ¥0.18(約 $0.025)。因此出現一個頗特別的情況:2K 時 Pro 是標準版的 2.8 倍,1K 時差距則只有 1.4 倍。
還有兩個值得留意的註記。北京區提供 10 張免費額度,輸入與輸出合併計算,啟用後 90 天內有效;足以拿自己的提示詞測試排版能力,卻不夠用來做任何正式產品。另外,至少有一個第三方閘道目前將模型標示為免費,但模型卡明確註明那是限時且有額度上限的試用。看到 $0 定價時,應將它視為體驗管道,而非正式價格。
真正決定使用方式的限制:每分鐘 1 次請求
官方模型頁列出的 RPM(每分鐘請求數)是 1。無論北京或新加坡區域,也不論 Pro 或標準版,限制都一樣。這比成熟圖片 API 常見的 60–600 RPM 低了一到兩個數量級。
這個數字也解釋了早期使用者回報的現象:連續呼叫立刻收到 429 錯誤、兩個程序共用同一把 key 時兩邊都失敗,只有嚴格序列化請求並保留充足退避時間,才能穩定執行。一項在 7 月 23 日發布、經由閘道進行的測試,早在官方文件列出限制前就量到了完全相同的模式。
實際影響如下:
- 別想做批次生成。1 RPM 代表每把 key 每天理論上限約為 1,440 次請求,而且必須依序執行,完全沒有突發流量空間;每次請求可透過
n回傳最多 6 張圖,但仍按每張計費。 - 共用 key 的團隊會互相卡住。兩位開發者同時迭代提示詞就會撞限流;若不得不共用,應將生成工作放進單一 worker 的佇列。
- 重試迴圈只會雪上加霜。請以 45–60 秒為間隔退避,不要持續猛打 API。
這項限制看起來比較像受控推出期間的節流,而非永久政策;不過在阿里巴巴上調前,qwen-image-3.0-pro 是互動式工具,不是可放入自動化管線的元件。
文字渲染表現:擅長之處與失手邊界
文字排版能力正是這款模型最值得關注的理由,獨立測試也大致證實了這點,不過界線相當明確。在一份已發布的測試中,未經加工的 Pro 輸出成功渲染義式咖啡機規格表,所有數值正確,連約等同 8pt 的細小序號文字「Serial AT-2026-0731 / Made in Suzhou」也完整無誤;雙語招牌中的英文與中文也都正確。它失手的地方則是程式碼編輯器模擬圖,行號變成 1、3、3、4、6。單字與標籤能穩住,但遞增序列與程式運算子不可靠。
作為對照,我在 2026 年 8 月 5 日以相同的規格表提示詞結構,測試了 Nano Banana Pro(Gemini 3 Pro Image):虛構的 AROMA-9 義式咖啡機規格表,內含四個必須精準呈現的表格數值與一行細小序號文字,使用預設設定。只跑一次、不重試,耗時 65 秒:
四列規格都答對了,但細小文字把城市拼成「Suzheu」。而這正是據稱 Qwen 能穩定處理的字級範圍。單一圖片不能證明太多,但它符合一個明顯趨勢:小字正確性本來就很難,而這正是 Qwen 選擇主攻的競爭點。社群看法也沿著同一條線分歧:
「Qwen 的表現遠超它應有的量級。Gemini 3 Pro 在材質真實感與『精緻度』方面仍有優勢。」— r/QwenImageGen,比較前一代 Qwen 圖像生成與 Gemini 3 Pro Image
若文字必須完全正確,例如程式碼截圖、編號座標軸或連續資料,現階段沒有任何圖片模型可稱安全,這款也不例外。
如何呼叫 qwen-image-3.0-pro API
免費使用途徑是 Qwen Studio,登入後選擇圖片生成,再把預設模型切換為 3.0 即可。若要走 API,需透過阿里雲 Model Studio 並使用 DashScope API key。以下範例採用新加坡國際站端點;北京區必須使用自己的端點與另一把 API key。
curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-d '{
"model": "qwen-image-3.0-pro",
"input": {"messages": [{"role": "user", "content": [
{"text": "A four-row product spec table, fine print at the bottom..."}
]}]},
"parameters": {"size": "1024*1536", "prompt_extend": true}
}'
以下是依官方 API 參考文件整理、幾個與其他圖片 API 用法不同的參數:
| 參數 | 行為 |
|---|---|
size | 可自由指定 width*height;總像素面積可介於 512² 至 2048²,長寬比 1:8–8:1。不填時,模型會從提示詞自行決定解析度 |
| 圖片編輯 | 在文字前傳入 1–3 個 {"image": "..."} 物件,可用 URL 或 base64;僅支援單輪操作 |
prompt_extend | 提示詞改寫功能,預設開啟;agent 模式僅供文字生成圖片使用 |
n | 每次請求可生成 1–6 張圖片 |
watermark | 預設關閉 |
| 結果 URL | PNG 位於有效期 24 小時的簽名 URL 後方;請立即下載,絕不可儲存該 URL |
沒有開放權重:「下載」實際會找到什麼?
你無法下載 Qwen Image 3 Pro。不同於以 Apache 2.0 授權釋出權重的 Qwen-Image 1.0 與 2.0 時代編輯模型,3.0 系列推出時沒有釋出任何權重、技術報告或基準測試分數。團隊最新的開放權重 checkpoint 仍是 2025 年 12 月的 Qwen/Qwen-Image-2512。搜尋「download」最終找到的,就是它與 QwenLM/Qwen-Image GitHub repo。
缺少基準成績很重要。團隊本身維護一套評測集 Qwen-Image-Bench,但尚未公布 3.0 系列的分數。因此,上述所有品質判斷都來自展示範例與第三方抽樣測試,而不是系統性的評估。
值得為 Pro 支付溢價嗎?
| 你的工作類型 | 建議 |
|---|---|
| 文字密集版面:規格表、海報、考卷、多語言招牌 | Pro:2.8 倍溢價買到的正是這項能力,而且 10 張免費額度足以用來試鏡 |
| 一般插畫、主視覺、需要反覆迭代的草稿 | 標準版 qwen-image-3.0:任何解析度皆固定 ¥0.18,尺寸限制也相同 |
| 文字量大的 2K 最終成品 | Pro,但請編列每張 ¥0.5 的預算,並記得 2.25MP 的像素面積分界 |
| 批次管線、延遲 SLA、任何無人值守的工作 | 兩者都不適合:1 RPM 直接淘汰兩者;請使用成熟的圖片 API,僅在 Qwen 佔優勢的文字排版情境保留它 |
| 本機執行 | Qwen-Image-2512:這是最新開放 checkpoint;3.0 沒有釋出權重 |
坦白說,qwen-image-3.0-pro 的價值全押在密集文字渲染上;第三方抽查表現確實站得住腳,但 1 RPM 的限制讓它在營運層面嚴重受限,只能當成專業工具。先用免費額度測試你最棘手的排版提示詞;在速率限制調高前,正式流量仍應留在你既有的運行平台。
常見問題
Qwen Image 3 Pro 可以免費使用嗎?
部分可以。Qwen Studio 登入後提供免費互動式使用;北京 API 區域則有 10 張免費圖片額度,有效期為 90 天。部分閘道提供限時免費層級,但模型卡明確標示為有額度上限的試用。
我可以下載 qwen-image-3.0-pro 或在本機執行嗎?
不行。3.0 系列沒有公開權重。目前最新的開放權重 Qwen 圖像模型是 2025 年 12 月推出的 Qwen-Image-2512,可在 Hugging Face 取得,採 Apache 2.0 授權。
qwen-image-3.0-pro 和 qwen-image-2.0-pro 有何不同?
3.0 Pro 將提示詞容量提升至 4.5k token(2.0 約為 1k),新增 10px 小字渲染與 12 種語言支援。依官方價目表,兩者在北京區的 2K 都是 ¥0.5;但 3.0 Pro 的 1K 輸出是 ¥0.25,2.0 Pro 則固定為 ¥0.5。
Qwen Image 3 Pro 支援圖片編輯嗎?
支援。同一個 qwen-image-3.0-pro 模型 ID 可接收 1–3 張參考圖片,再搭配指令進行圖生圖編輯。請注意,至少有一個第三方 OpenAI 相容閘道被回報其參考圖輸入功能失效,因此應先透過原生 DashScope API 測試編輯功能。