Qwen Image 3 ProのAPI料金は、北京リージョンで1K画像あたり¥0.25(約$0.035)、2Kでは¥0.5です。同じ解像度で比べると、標準のqwen-image-3.0より最大2.8倍高くなります。細かな文字を詰め込んだレイアウトなら、この上乗せには納得できる場面もあります。ただし、導入計画を根本から左右する数字があります。公式モデルページに記載されたレート制限は、わずか1分あたり1リクエストです。
qwen-image-3.0-proで強化された点
Qwen Image 3 Pro(qwen-image-3.0-pro)は、2026年7月21日に公開されたAlibabaのQwen-Image-3.0シリーズにおける上位モデルです。標準モデルのqwen-image-3.0と同じAPIで、テキストからの画像生成と画像編集に対応します。対応サイズの範囲も共通です。主な違いは出力品質と、2K出力時の課金体系にあります。
3.0シリーズ全体に共通する主な機能は次のとおりです。
- 最大4.5Kトークンのプロンプト:前世代の約1Kトークンから大幅に拡張。新聞1ページ、3×3のインフォグラフィック、UIの中にUIを配置するような複雑な構図も一度に指定できます
- 10px級の文字描画:LaTeX数式、上付き文字、定理番号を含め、小さな文字も判読できる形で描画
- 12言語・20種類以上のフォント:Web、ゲーム、ライブ配信のUIを模した表現にも対応
両者の棲み分けは明確です。Alibaba自身のモデル選択ガイドでは、複雑なレイアウト、小さな文字の正確な描画、多言語・多フォントの表現をPro向けとしています。一方、標準モデルは品質と速度のバランスを取る位置付けです。それ以外の仕様は両モデルIDで同じで、出力は512×512〜2048×2048ピクセル、アスペクト比は1:8〜8:1、編集では参照画像を1〜3枚使用でき、出力形式はPNGです。
公式API料金を確認:2026年8月時点
Alibaba Cloud Model Studioの公式価格表を2026年8月5日に確認したところ、qwen-image-3.0-proの画像単価はリージョンごとに以下のとおりでした。
| 課金項目 | 北京(CNY) | シンガポール国際(CNY) | 米ドル換算の目安 |
|---|---|---|---|
| 画像入力(1枚あたり) | ¥0.02 | ¥0.022483 | 約$0.003 |
| 1K出力(1枚あたり) | ¥0.25 | ¥0.299768 | 約$0.035〜0.042 |
| 2K出力(1枚あたり) | ¥0.5 | ¥0.562065 | 約$0.070〜0.079 |
1Kと2Kの境界は辺の長さではなく、総ピクセル数です。2,250,000ピクセル以下は1K料金、これを超えると2K料金になります。標準のqwen-image-3.0は解像度にかかわらず出力1枚あたり一律¥0.18(約$0.025)です。このため、1KではProとの差が約1.4倍にとどまる一方、2KではProが標準モデルの2.8倍という少し変わった料金差になります。
実用上、見落とせない注記が2つあります。北京リージョンには、有効化から90日間使える10枚分の無料枠があります。入力と出力を合算した枠なので、文字描画の実力を手元のプロンプトで試すには足りますが、本格的な開発には足りません。また、少なくとも1つのサードパーティーゲートウェイでは現在このモデルを無料として掲載しています。ただしモデルカードには、期間限定かつクォータ制限付きのトライアルと明記されています。$0という表示は正式な価格ではなく、デモ用の経路と考えるべきです。
最大の制約は1 RPM:運用設計が変わる
公式モデルページでは、Pro・標準版ともに北京とシンガポールのRPM(1分あたりのリクエスト数)が1とされています。一般的な画像生成APIで見られる60〜600 RPMと比べると、1〜2桁低い水準です。
初期ユーザーから報告された挙動も、この数値で説明できます。連続して呼び出すと即座に429エラーになる、同じキーを2プロセスで使うと両方のリクエストが失敗する、十分なバックオフを取りながら厳密に直列化した場合だけ安定して動く、といったものです。公式制限が文書化される前の7月23日には、あるテストがゲートウェイ経由でまさにこのパターンを計測していました。
運用への影響は大きいです。
- バッチ生成には向きません。 1 RPMなら、1キーあたりの上限は直列実行で1日約1,440リクエストです。バーストは許容されません。
nを使えば1リクエストで最大6枚を返せますが、課金は画像単位です - キーを共有するチームでは互いに詰まります。 2人の開発者がプロンプトを試すだけでも競合します。共有が必要なら、生成処理は単一ワーカーのキューの後ろに置くべきです
- 安易なリトライは逆効果です。 連打せず、45〜60秒刻みでバックオフしてください
この制限は恒久的な方針というより、段階的な提供に伴うスロットリングに見えます。ただしAlibabaが上限を引き上げるまでは、qwen-image-3.0-proはパイプラインの部品ではなく、対話的に使うツールです。
文字描画の実力と苦手なケース
このモデルを注目すべき理由は文字描画にあり、第三者テストでもその強みは確認されています。ただし、明確な限界もあります。公開テストのPro生出力では、エスプレッソマシンのスペックシートで細かなシリアル表記「Serial AT-2026-0731 / Made in Suzhou」まで、約8pt相当のサイズで全項目を正しく描画しました。英中併記の看板も両言語とも正確です。一方、コードエディターのモックアップでは行番号が1、3、3、4、6となりました。単語やラベルは維持できても、単調増加する連番やコード演算子は苦手です。
比較の基準として、2026年8月5日にNano Banana Pro(Gemini 3 Pro Image)でも同じ構成のスペックシート用プロンプトを実行しました。架空のAROMA-9エスプレッソマシンについて、表に正確な4つの値と細かなシリアル表記を指定し、設定はデフォルト。リトライなしの1回だけで、生成時間は65秒でした。
4つのスペック行はすべて正しかったものの、細かな表記では都市名が「Suzheu」と誤記されました。ここはQwenが維持できたと報告された、まさに文字サイズの領域です。もちろん画像1枚だけで結論は出せません。それでも、小さな文字の忠実度が難所であり、そこをQwenが競争軸として選んでいるという見方には合致します。コミュニティの評価も同じ方向で割れています。
「Qwenは価格帯を大きく超えた実力を出している。Gemini 3 Proはテクスチャの忠実度と『仕上がりの良さ』で優位だ」 — r/QwenImageGen、前世代のQwen画像生成とGemini 3 Pro Imageの比較より
コードのスクリーンショット、番号付きの軸、連続データなど、文字が文字どおり正確でなければならない用途では、Qwenを含め現行の画像モデルに任せるのは安全ではありません。
qwen-image-3.0-proをAPIから呼び出す
無料で試すなら、ログインが必要なQwen Studioが手軽です。画像生成を選び、デフォルトモデルから3.0へ切り替えます。APIはAlibaba Cloud Model Studio経由で利用し、DashScope APIキーが必要です。以下はシンガポール国際エンドポイントの例です。北京リージョンを使う場合は、専用エンドポイントと別のAPIキーが必要になります。
curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-d '{
"model": "qwen-image-3.0-pro",
"input": {"messages": [{"role": "user", "content": [
{"text": "A four-row product spec table, fine print at the bottom..."}
]}]},
"parameters": {"size": "1024*1536", "prompt_extend": true}
}'
公式APIリファレンスに基づく、他の画像生成APIと異なる主なパラメータは以下のとおりです。
| パラメータ | 挙動 |
|---|---|
size | width*height形式で自由に指定。総ピクセル数は512²〜2048²、アスペクト比は1:8〜8:1です。省略すると、モデルがプロンプトから解像度を選択します |
| 画像編集 | テキストの前に1〜3個の{"image": "..."}オブジェクトを渡します。URLまたはbase64に対応し、単一ターンのみです |
prompt_extend | プロンプトの書き換え機能で、デフォルトで有効です。agentモードはテキストからの画像生成でのみ利用できます |
n | 1リクエストあたり1〜6枚 |
watermark | デフォルトでは無効 |
| 結果URL | PNGは24時間で失効する署名付きURLで返されます。すぐにダウンロードし、URL自体を保存してはいけません |
重みは非公開:「ダウンロード」で手に入るもの
Qwen Image 3 Proはダウンロードできません。Apache 2.0ライセンスで重みが公開されたQwen-Image 1.0や2.0世代の編集モデルとは異なり、3.0世代は重み、技術レポート、ベンチマークスコアのいずれも公開せずに登場しました。チームが公開した最新のオープンウェイト・チェックポイントは、現在もQwen/Qwen-Image-2512(2025年12月)です。「download」で検索して辿り着くのは、これとQwenLM/Qwen-Image GitHubリポジトリです。
ベンチマークがないことも重要です。チームは独自評価スイートのQwen-Image-Benchを維持していますが、3.0世代のスコアは公開していません。つまり、ここまでの品質評価は体系的なベンチマークではなく、デモと第三者によるスポットチェックに基づくものです。
Proの追加料金を払うべきか
| 用途 | 判断 |
|---|---|
| スペックシート、ポスター、試験問題、多言語サインなど、文字量の多いレイアウト | Pro:2.8倍のプレミアムで得るものはここです。無料の10枚枠でも適性を確認できます |
| 日常的なイラスト、ヒーロー画像、反復して詰める下書き | 標準のqwen-image-3.0:解像度を問わず一律¥0.18で、対応サイズ範囲も同じです |
| 文字量の多い成果物を2Kで仕上げる | Pro:ただし1枚¥0.5を見込み、2.25MPのピクセル面積境界に注意してください |
| バッチ処理、レイテンシSLA、無人運用 | どちらも不向き:1 RPMでは両モデルとも条件を満たせません。実績のある画像生成APIを使い、Qwenは文字描画が勝てるケースに絞るべきです |
| ローカル実行 | Qwen-Image-2512:最新のオープン・チェックポイントです。3.0には重みがありません |
率直に言えば、qwen-image-3.0-proの価値は文字量の多い画像にあります。第三者のスポットチェックでも、その強みは一定程度裏付けられています。しかし1 RPMという制限のため、運用面では専門用途向けの道具です。まずは無料枠で、最も難しい文字組みプロンプトを試してください。本番トラフィックは、レート制限が緩和されるまで現在の基盤に置いたままにするのが妥当です。
FAQ
Qwen Image 3 Proは無料で使えますか?
一部は無料です。Qwen Studioではログイン後に無料で対話的に利用でき、北京リージョンのAPIには90日間有効な10枚分の無料枠があります。一部ゲートウェイには期間限定の無料枠もありますが、モデルカードでクォータ制限付きトライアルと明記されています。
qwen-image-3.0-proをダウンロードしてローカル実行できますか?
できません。3.0世代の重みは公開されていません。最新のオープンウェイトQwen画像モデルは、Apache 2.0でHugging Faceに公開されている2025年12月版のQwen-Image-2512です。
qwen-image-3.0-proとqwen-image-2.0-proの違いは?
3.0 Proではプロンプト容量が4.5Kトークンへ拡大しました。2.0は約1Kトークンです。また、10px級の小さな文字描画と12言語対応が追加されています。公式価格表では、北京リージョンの2K出力はどちらも¥0.5です。ただし3.0 Proの1K出力は¥0.25で、2.0 Proは解像度を問わず¥0.5です。
Qwen Image 3 Proは画像編集に対応していますか?
対応しています。同じqwen-image-3.0-proモデルIDに、1〜3枚の参照画像と指示を渡せば、画像から画像への編集を行えます。ただし、少なくとも1つのOpenAI互換サードパーティーゲートウェイでは参照画像入力が動作しないという報告があります。画像編集は、まずネイティブのDashScope APIで試すのが安全です。