如果你的圖像生成需求不只是「畫得好看」,還包括海報文字、多語素材與複雜版面,模型之間的差異很快就會放大。Qwen Image 3 Pro 於 2026 年 8 月 5 日在 Qwen Cloud 上線,API 採每張固定 $0.04 的計價方式,規格明確瞄準結構化商業內容:10 像素文字可讀性、4,500 token 提示詞,以及 12 種語言的原生生成。GPT Image 2 則自 2026 年 4 月起透過 OpenAI API 提供服務,低品質圖像每張最低只要 $0.006,但成本會隨解析度與提示詞長度上升。
若是快速產出商品情境照、探索創意方向,GPT Image 2 目前依然更快也更便宜;但面對文字密集的海報、多語行銷素材或文件式版面,Qwen Image 3 Pro 的固定價格與長提示詞支援,會讓成本結構完全不同。
文字生成能力:差距最大的戰場
Qwen 官方部落格用一個 3,700 token 的提示詞示範生成 3×3 資訊圖表:九個內容各異的格子一次完成,包含中英文文字、LaTeX 公式與插圖。
我則用 GPT Image 2 測試高密度資訊圖表提示詞,要求它製作一張「5 Tips for Better Sleep」海報,內有五項編號建議、指定溫度「65–68°F」,以及「after 2 PM」等時間資訊。
GPT Image 2 正確生成了標題與大部分內文,較長的行句只有些微字距問題。不過,當版面變成多區塊、高密度的資訊配置時,差距便開始浮現;而這正是 Qwen 的 4,500 token 提示詞上限與 10px 文字規格所要解決的情境。
「Qwen 和 ChatGPT 很相似。我把 Qwen Image 用在 berserk 分鏡上,整個分鏡與草圖都維持原樣。」— r/ChatGPT comparison thread(基礎 Qwen Image 3.0 模型)
有一點需要先說明:本文準備期間,Qwen Image 3 Pro 的 API 無法直接測試,kie 供應商回傳了 500 錯誤。因此,上述文字生成能力的判斷是根據 Qwen 官方示範,並非我自己做出的並排測試結果。待 API 存取穩定後,我會補上相同條件下的生成範例。
單張圖到底要花多少錢?
Qwen Image 3 Pro 與 Standard 的固定單價
Qwen Cloud 採單張固定計價,以下為 Alibaba Cloud Model Studio 定價頁所列價格:
| 級別 | 模型 ID | 每張圖片價格 |
|---|---|---|
| Pro | qwen-image-3.0-pro | $0.04 |
| Standard | qwen-image-3.0-standard | $0.03 |
不論提示詞是 4,500 token 或只有 50 token,費用都是 $0.04,不需要另外計算 token 成本。
GPT Image 2:依 token 計費
GPT Image 2 採 token 計價,以下是 OpenAI API 定價:
| 項目 | 費率(每 1M tokens) |
|---|---|
| 文字輸入 | $5.00 |
| 圖片輸入 | $8.00 |
| 圖片輸出 | $30.00 |
實際單張成本取決於品質與解析度。低品質 1024×1024 圖像約為 $0.006;高品質 4096×4096 圖像則約為 $0.19。提示詞越長,文字輸入部分的費用也會增加。
| 情境(100 張圖片) | GPT Image 2 | Qwen Image 3 Pro |
|---|---|---|
| 低品質草稿(1K、短提示詞) | ~$0.60 | $4.00 |
| 高品質正式產出(4K、中等長度提示詞) | ~$8–$19 | $4.00 |
| 文字密集資訊圖表(4K、長提示詞) | ~$12–$19 | $4.00 |
GPT Image 2 的估算依據 OpenAI token 定價及常見的提示詞/輸出大小。實際費用會隨提示詞長度與品質設定而異。
做草稿時,GPT Image 2 顯然更有價格優勢;若是使用複雜提示詞的正式產出,Qwen Image 3 Pro 更划算,因為固定價格不會隨提示詞變長而墊高 token 帳單。
商品照實測:GPT Image 2 的表現
我給 GPT Image 2 相同的提示詞:陶瓷馬克杯、「DESIGN LAB 2026」、晨間光線、蒸氣與散景。
畫面自然,文字正確,蒸氣也有真實感。Qwen 的官方示範呈現出相近的細節,但商業視覺感更乾淨俐落。若只是一般商品照,兩者都已經具備正式上線使用的水準。
Qwen Image 3 Pro 領先的地方
長提示詞與複雜版面
依Qwen 官方部落格資料,4,500 token 足以描述下列內容:
- 含標題、內文、圖片說明與照片預留區的完整報紙版面
- 每個分格都有獨立描述的 3×3 分鏡腳本
- 同時包含公式、圖表與說明文字的考卷
GPT Image 2 足以應付中等複雜度的版面,但若要單次生成由多個區段組成的文件,Qwen 更長的提示詞視窗具備結構性的優勢。
多語文字
依官方發布資訊,Qwen Image 3 Pro 可原生生成 12 種語言的文字,包括中文、日文、韓文、阿拉伯文、西班牙文,以及另外七種語言。GPT Image 2 相較 GPT Image 1.5 改善了 CJK 文字生成,但尚未公布支援語言數量,也沒有提供最小可讀字體尺寸規格。
如果你的工作流程需要處理多種文字系統,Qwen 有明確文件佐證的語言涵蓋範圍就很重要。
高密度資訊圖表
Qwen 官方示範包含:
- 鯨鯊知識資訊圖表,放入物種資料、尺寸數據與密集內文,小尺寸下仍可辨讀
- 完整的學術論文頁面,含有 LaTeX 下標、上標、分數線與希臘字母,沒有出現亂碼符號
GPT Image 2 也能處理資訊圖表,但它更傾向創意詮釋,而非像素等級精確的資料呈現。
GPT Image 2 更適合的情境
對話式編修
GPT Image 2 能直接融入 ChatGPT 的多輪操作流程:先生成圖片,再要求它「把 logo 往左移」、「讓背景暖一點」或「加上陰影」,每次修改都會以前一次結果為基礎。
Qwen Image 3 Pro 也提供指令式編修,並有專用的 Edit 模型;Qwen 團隊表示,它比完整重新生成更快。不過它沒有對話記憶,多步驟修改時仍需每次重新寫出指令。
創作風格廣度
水彩、油畫、動漫、新聞攝影、超現實主義,GPT Image 2 不太需要複雜的提示詞工程,就能處理各種風格。Qwen Image 3 Pro 的「Deep Knowledge」功能可模擬 UI 介面與直播版面,但它的設計重心仍是結構化的商業產出。
速度與速率限制
在我的測試中,GPT Image 2 約 5–10 秒可回傳結果。Qwen Image 3 Pro 的 Qwen Cloud API 目前設有較嚴格的速率限制;本站的 Qwen Image 3 Pro 價格解析記錄了測試期間觀察到約每分鐘 1 次請求的上限。對批次生成工作流程來說,這是實際存在的限制。
API 規格對照
| 項目 | Qwen Image 3 Pro | GPT Image 2 |
|---|---|---|
| 模型 ID | qwen-image-3.0-pro | gpt-image-2 |
| 供應商 | Alibaba Cloud Model Studio | OpenAI |
| 計費方式 | $0.04/image(固定) | 依 token 計費(~$0.006–$0.19) |
| 速率限制 | ~1 req/min(實測觀察) | 標準 OpenAI 級別限制 |
| 提示詞上限 | ~4,500 tokens(官方資料) | 精簡提示詞效果最佳 |
| 最大輸出 | 最高 2K | 最高 4K(較高成本級別) |
| 編修方式 | 指令式 | 對話式 + 指令式 |
| 文字語言 | 12 種原生支援 | 支援多語,CJK 已改善 |
想看完整的 Qwen Image 3 Pro API 操作說明,包括設定方式、速率限制,以及 Pro 相對 Standard 多了哪些內容,可參考 Qwen Image 3 Pro 價格與限制解析。
該選哪一個模型?
| 工作流程 | 建議選擇 | 原因 |
|---|---|---|
| 文字密集海報、資訊圖表 | Qwen Image 3 Pro | 10px 文字規格、4,500-token 提示詞 |
| 多語行銷素材 | Qwen Image 3 Pro | 12 種語言原生生成 |
| 快速商品照草稿 | GPT Image 2 | ~$0.006/image、5–10 秒生成 |
| 創意人像探索 | GPT Image 2 | 風格範圍更廣、多輪編修 |
| 高量批次生成 | GPT Image 2 | 速率限制較高 |
| 複雜文件版面 | Qwen Image 3 Pro | 可單次生成多區段內容 |
| 正式環境 API(生態系較成熟) | GPT Image 2 | 已歷經四個月實戰驗證 |
如果你的流程同時需要這兩類輸出,兩個模型一起使用才是最實際的做法。
常見問題
Qwen Image 3 Pro 是免費的嗎?
Qwen Image 3.0 可在 chat.qwen.ai 免費透過瀏覽器生成圖片。Pro API 級別每張 $0.04,Standard 級別每張 $0.03,透過 Alibaba Cloud Model Studio 提供。
GPT Image 2 可以生成中文文字嗎?
可以。GPT Image 2 相較 GPT Image 1.5 改善了 CJK 文字生成,在標題尺寸下可處理中文、日文與韓文。但若是密集的小尺寸 CJK 文字,Qwen Image 3 Pro 的 10px 可讀性規格更具優勢。
哪一個比較適合商品攝影?
兩者都能生成專業品質的商品照。GPT Image 2 的畫面通常更溫暖,也更偏生活風格;Qwen Image 3 Pro 則較乾淨、商業感更強。若商品本身印有文字,例如標籤、價格或品牌名稱,Qwen 的可靠度更高。
兩者都支援圖片編修嗎?
支援。GPT Image 2 可透過 ChatGPT 進行對話式編修,也能透過 API 使用指令式編修。Qwen Image 3 Pro 則透過專用 Edit 模型提供指令式編修。