AIREITER

Qwen Image 3 Pro : tarifs API vérifiés, limites, apports de Pro

Dernière mise à jour: 2026-08-05 04:02:58

Alibaba a enfin publié les tarifs API officiels de Qwen Image 3 Pro. Dans la région de Pékin, une image au palier 1K coûte ¥0.25 (environ $0.035), contre ¥0.5 en 2K. À résolution équivalente, cela représente jusqu'à 2.8× le prix de qwen-image-3.0 standard. Pour les compositions chargées en texte, ce surcoût peut se défendre. Reste un chiffre, affiché sur la page officielle du modèle, qui rebat les cartes : la limite est fixée à 1 requête par minute.

Ce que Qwen Image 3 Pro apporte face à qwen-image-3.0

Qwen Image 3 Pro (qwen-image-3.0-pro) correspond au niveau de qualité supérieur de la génération Qwen-Image-3.0 d'Alibaba, lancée le 21 juillet 2026. Comme le modèle standard qwen-image-3.0, il prend en charge la génération texte-vers-image et la retouche d'image via la même API, avec des limites de taille identiques. Les écarts portent sur la qualité de sortie et sur la facturation du 2K.

Les fonctionnalités mises en avant sont communes à toute la famille 3.0 :

  • Prompts de 4.5k tokens, contre environ 1k pour la génération précédente : de quoi décrire en une passe une page de journal complète, une grille d'infographie 3×3 ou une interface imbriquée dans une autre interface
  • Rendu de texte à 10 px, suffisamment lisible pour les formules LaTeX, les exposants et la numérotation de théorèmes
  • 12 langues et plus de 20 polices rendues nativement, ainsi que des interfaces web, de jeu vidéo ou de livestream simulées
Annonce officielle de Qwen-Image-3.0 sur qwen.ai, publiée le 21 juillet 2026

La différence se joue dans le positionnement. Les recommandations de sélection de modèle d'Alibaba orientent vers Pro pour les mises en page complexes, le rendu très précis de petits caractères et le travail multilingue avec différentes polices. Le modèle standard est, lui, présenté comme un compromis entre qualité et rapidité. Pour le reste, les spécifications des deux identifiants sont les mêmes : sorties de 512×512 à 2048×2048 pixels au total, ratios de 1:8 à 8:1, 1 à 3 images de référence pour la retouche et export PNG.

Tarifs API officiels, vérifiés en août 2026

Alibaba Cloud Model Studio affiche les prix par image de qwen-image-3.0-pro dans deux régions. Ils ont été vérifiés dans la grille tarifaire officielle le 5 août 2026 :

Élément facturéPékin (CNY)Singapour international (CNY)Équivalent USD approximatif
Image en entrée (par image)¥0.02¥0.022483~$0.003
Sortie 1K (par image)¥0.25¥0.299768~$0.035–0.042
Sortie 2K (par image)¥0.5¥0.562065~$0.070–0.079

La frontière entre 1K et 2K dépend de la surface en pixels : jusqu'à 2,250,000 pixels, la sortie est facturée au tarif 1K ; au-delà, elle passe au tarif 2K. Le modèle standard qwen-image-3.0 applique un tarif unique de ¥0.18 (environ $0.025) par image générée, quelle que soit la résolution. Situation un peu étrange : en 2K, Pro coûte 2.8× plus cher que le modèle standard ; en 1K, l'écart n'est que de 1.4×.

Tableau des prix pour qwen-image-3.0-pro dans la région de Pékin sur Alibaba Cloud Model Studio, capturé le 5 août 2026 Prix de sortie par image : qwen-image-3.0 à ¥0.18 fixe, contre Pro à ¥0.25 en 1K et ¥0.5 en 2K

Deux précisions importantes. La région de Pékin comprend un quota gratuit de 10 images, entrées et sorties confondues, valable 90 jours après activation. C'est suffisant pour éprouver les promesses typographiques sur vos propres prompts, pas pour bâtir un produit. Par ailleurs, au moins une passerelle tierce référence actuellement le modèle comme gratuit, mais sa fiche précise qu'il s'agit d'un essai temporaire plafonné par quota. Une mention à $0 doit donc être considérée comme un canal de démonstration, non comme un tarif.

La limite qui dicte tout : 1 requête par minute

La page officielle indique un RPM, ou nombre de requêtes par minute, de 1 dans les régions de Pékin comme de Singapour, aussi bien pour Pro que pour le modèle standard. C'est un à deux ordres de grandeur sous les 60 à 600 RPM habituellement proposés par les API d'image bien établies.

Ce chiffre explique les retours des premiers utilisateurs : erreurs 429 immédiates lors d'appels rapprochés, deux requêtes en échec dès que deux processus partagent une même clé, et exécutions fiables uniquement lorsque les requêtes sont strictement sérialisées avec un backoff généreux. Un test publié le 23 juillet a mesuré exactement ce comportement via une passerelle, avant que la limite officielle ne soit documentée.

En pratique :

  • La génération par lots n'est pas envisageable. À 1 RPM, le plafond atteint environ 1,440 requêtes par jour et par clé, en séquentiel, sans aucune tolérance aux rafales. Chaque requête peut toutefois renvoyer jusqu'à 6 images via n, facturées individuellement.
  • Une clé partagée devient un goulot d'étranglement. Deux développeurs qui itèrent sur leurs prompts se gêneront mutuellement ; en cas de partage, placez la génération derrière une file avec un unique worker.
  • Les boucles de retry aggravent le problème. Préférez des paliers de backoff de 45 à 60 secondes plutôt que de marteler l'API.

Cette limite évoque davantage un bridage de déploiement progressif qu'une politique définitive. Mais tant qu'Alibaba ne la relève pas, qwen-image-3.0-pro reste un outil interactif, pas un composant de pipeline.

Rendu de texte : ses forces et ses failles

La typographie est la principale raison de s'intéresser à ce modèle, et les tests indépendants confirment en partie la promesse — avec une limite nette. Dans des tests publiés sur des sorties Pro brutes, une fiche technique de machine à espresso reproduisait correctement toutes les valeurs, jusqu'à une ligne de numéro de série en très petits caractères (« Serial AT-2026-0731 / Made in Suzhou »), à l'équivalent d'environ 8 pt. Une signalétique bilingue affichait également sans erreur l'anglais et le chinois. En revanche, une maquette d'éditeur de code générait les numéros de ligne 1, 3, 3, 4, 6. Les mots et les libellés tiennent ; les séquences monotones et les opérateurs de code, beaucoup moins.

Pour situer le niveau, j'ai soumis la même structure de prompt de fiche technique à Nano Banana Pro (Gemini 3 Pro Image) le 5 août 2026 : une fiche fictive d'espresso AROMA-9, avec quatre valeurs exactes dans un tableau et une ligne de série en petit corps, paramètres par défaut. Un seul essai, sans relance, en 65 secondes :

Sortie de Nano Banana Pro pour le même prompt de fiche technique d'espresso : les quatre lignes du tableau sont correctes, mais la mention en petits caractères affiche "Made in Suzheu"

Les quatre lignes de spécifications étaient justes, mais le nom de la ville dans la ligne en petits caractères était mal orthographié : « Suzheu ». Or c'est précisément à cette taille que le rendu de Qwen aurait tenu. Une seule image ne prouve pas grand-chose ; elle s'inscrit toutefois dans une tendance claire : la fidélité des très petits caractères reste difficile, et c'est le terrain spécifique sur lequel Qwen a choisi de se mesurer à ses rivaux. Le sentiment de la communauté suit la même ligne :

« Qwen joue bien au-dessus de sa catégorie. Gemini 3 Pro garde l'avantage sur la fidélité des textures et le “polish”. » — r/QwenImageGen, à propos de la précédente génération d'images Qwen face à Gemini 3 Pro Image

Si votre texte doit être littéralement exact — captures de code, axes numérotés, données séquentielles — aucun modèle d'image actuel n'est fiable, y compris celui-ci.

Appeler qwen-image-3.0-pro via l'API

La voie gratuite passe par Qwen Studio, après connexion : choisissez la génération d'image, puis remplacez le modèle par défaut par 3.0. Pour l'API, il faut passer par Alibaba Cloud Model Studio et utiliser une clé API DashScope. L'exemple ci-dessous utilise le point de terminaison international de Singapour ; Pékin requiert son propre endpoint et une clé API distincte.

curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -d '{
    "model": "qwen-image-3.0-pro",
    "input": {"messages": [{"role": "user", "content": [
      {"text": "A four-row product spec table, fine print at the bottom..."}
    ]}]},
    "parameters": {"size": "1024*1536", "prompt_extend": true}
  }'

Quelques paramètres diffèrent des autres API d'image, selon la référence API officielle :

ParamètreComportement
sizeFormat libre width*height ; surface totale comprise entre 512² et 2048² pixels, ratio de 1:8 à 8:1. Sans ce paramètre, le modèle choisit une résolution à partir du prompt
Retouche d'imagePlacez 1 à 3 objets {"image": "..."} — URL ou base64 — avant le texte ; un seul tour est pris en charge
prompt_extendRéécriture de prompt, activée par défaut ; le mode agent existe uniquement pour la génération texte-vers-image
n1 à 6 images par requête
watermarkDésactivé par défaut
URL du résultatPNG servi via une URL signée qui expire après 24 heures ; téléchargez-le immédiatement et ne conservez jamais l'URL

Pas de poids ouverts : ce que vous téléchargez réellement

Qwen Image 3 Pro ne peut pas être téléchargé. À la différence de Qwen-Image 1.0 et des modèles de retouche de l'ère 2.0, dont les poids étaient publiés sous licence Apache 2.0, la génération 3.0 est sortie sans poids, sans rapport technique et sans scores de benchmark. Le checkpoint open weight le plus récent de l'équipe reste Qwen/Qwen-Image-2512, de décembre 2025. C'est ce modèle, avec le dépôt GitHub QwenLM/Qwen-Image, que vous trouverez en recherchant un téléchargement.

L'absence de benchmarks compte. L'équipe maintient sa propre suite d'évaluation, Qwen-Image-Bench, mais n'a publié aucun score pour la génération 3.0. Toutes les affirmations de qualité ci-dessus reposent donc sur des démonstrations et des vérifications ponctuelles par des tiers, pas sur une évaluation systématique.

Faut-il payer le surcoût de Pro ?

Votre usageVerdict
Mises en page denses en texte : fiches techniques, affiches, sujets d'examen, signalétique multilinguePro : c'est précisément ce que finance le surcoût de 2.8×, et le quota gratuit de 10 images suffit pour l'évaluer
Illustration courante, hero images, brouillons à itérerqwen-image-3.0 standard : ¥0.18 fixe quelle que soit la résolution, avec les mêmes limites de taille
Versions finales 2K de créations riches en textePro, mais prévoyez ¥0.5/image et gardez en tête le seuil de surface de 2.25MP
Pipelines par lots, SLA de latence, tout usage sans supervisionAucun des deux : 1 RPM élimine les deux options ; utilisez une API d'image établie et réservez Qwen aux cas typographiques où il l'emporte
Exécution localeQwen-Image-2512, le checkpoint ouvert le plus récent ; 3.0 ne fournit aucun poids

Le constat honnête est le suivant : qwen-image-3.0-pro fonde sa valeur sur le rendu de compositions riches en texte, résiste aux vérifications ponctuelles de tiers, mais son exploitation est sévèrement limitée par un plafond de 1 RPM. Testez-le avec votre prompt typographique le plus exigeant grâce au quota gratuit ; conservez votre trafic de production sur votre infrastructure habituelle tant que cette limite ne bouge pas.

FAQ

Qwen Image 3 Pro est-il gratuit ?

En partie. Qwen Studio permet une utilisation interactive gratuite après connexion, et l'API de la région de Pékin inclut 10 images gratuites valables 90 jours. Certaines passerelles proposent aussi une offre gratuite temporaire, que la fiche du modèle décrit explicitement comme un essai plafonné par quota.

Puis-je télécharger qwen-image-3.0-pro ou l'exécuter localement ?

Non. La génération 3.0 n'a pas de poids publiés. Le modèle d'image Qwen open weight le plus récent est Qwen-Image-2512, de décembre 2025, disponible sur Hugging Face sous Apache 2.0.

Quelle différence entre qwen-image-3.0-pro et qwen-image-2.0-pro ?

3.0 Pro porte la capacité de prompt à 4.5k tokens, contre environ 1k pour 2.0, et ajoute le rendu de petits textes à 10 px ainsi que la prise en charge de 12 langues. Dans la grille tarifaire officielle, les deux sont facturés ¥0.5 en 2K à Pékin. En revanche, la sortie 1K de 3.0 Pro coûte ¥0.25, contre ¥0.5 au tarif fixe de 2.0 Pro.

Qwen Image 3 Pro prend-il en charge la retouche d'image ?

Oui. Le même identifiant qwen-image-3.0-pro accepte 1 à 3 images de référence accompagnées d'une instruction pour la retouche image-vers-image. Attention : l'entrée d'images de référence aurait été défaillante via au moins une passerelle tierce compatible OpenAI. Testez donc d'abord la retouche avec l'API DashScope native.

À lire aussi