Alibaba a enfin publié les tarifs API officiels de Qwen Image 3 Pro. Dans la région de Pékin, une image au palier 1K coûte ¥0.25 (environ $0.035), contre ¥0.5 en 2K. À résolution équivalente, cela représente jusqu'à 2.8× le prix de qwen-image-3.0 standard. Pour les compositions chargées en texte, ce surcoût peut se défendre. Reste un chiffre, affiché sur la page officielle du modèle, qui rebat les cartes : la limite est fixée à 1 requête par minute.
Ce que Qwen Image 3 Pro apporte face à qwen-image-3.0
Qwen Image 3 Pro (qwen-image-3.0-pro) correspond au niveau de qualité supérieur de la génération Qwen-Image-3.0 d'Alibaba, lancée le 21 juillet 2026. Comme le modèle standard qwen-image-3.0, il prend en charge la génération texte-vers-image et la retouche d'image via la même API, avec des limites de taille identiques. Les écarts portent sur la qualité de sortie et sur la facturation du 2K.
Les fonctionnalités mises en avant sont communes à toute la famille 3.0 :
- Prompts de 4.5k tokens, contre environ 1k pour la génération précédente : de quoi décrire en une passe une page de journal complète, une grille d'infographie 3×3 ou une interface imbriquée dans une autre interface
- Rendu de texte à 10 px, suffisamment lisible pour les formules LaTeX, les exposants et la numérotation de théorèmes
- 12 langues et plus de 20 polices rendues nativement, ainsi que des interfaces web, de jeu vidéo ou de livestream simulées
La différence se joue dans le positionnement. Les recommandations de sélection de modèle d'Alibaba orientent vers Pro pour les mises en page complexes, le rendu très précis de petits caractères et le travail multilingue avec différentes polices. Le modèle standard est, lui, présenté comme un compromis entre qualité et rapidité. Pour le reste, les spécifications des deux identifiants sont les mêmes : sorties de 512×512 à 2048×2048 pixels au total, ratios de 1:8 à 8:1, 1 à 3 images de référence pour la retouche et export PNG.
Tarifs API officiels, vérifiés en août 2026
Alibaba Cloud Model Studio affiche les prix par image de qwen-image-3.0-pro dans deux régions. Ils ont été vérifiés dans la grille tarifaire officielle le 5 août 2026 :
| Élément facturé | Pékin (CNY) | Singapour international (CNY) | Équivalent USD approximatif |
|---|---|---|---|
| Image en entrée (par image) | ¥0.02 | ¥0.022483 | ~$0.003 |
| Sortie 1K (par image) | ¥0.25 | ¥0.299768 | ~$0.035–0.042 |
| Sortie 2K (par image) | ¥0.5 | ¥0.562065 | ~$0.070–0.079 |
La frontière entre 1K et 2K dépend de la surface en pixels : jusqu'à 2,250,000 pixels, la sortie est facturée au tarif 1K ; au-delà, elle passe au tarif 2K. Le modèle standard qwen-image-3.0 applique un tarif unique de ¥0.18 (environ $0.025) par image générée, quelle que soit la résolution. Situation un peu étrange : en 2K, Pro coûte 2.8× plus cher que le modèle standard ; en 1K, l'écart n'est que de 1.4×.
Deux précisions importantes. La région de Pékin comprend un quota gratuit de 10 images, entrées et sorties confondues, valable 90 jours après activation. C'est suffisant pour éprouver les promesses typographiques sur vos propres prompts, pas pour bâtir un produit. Par ailleurs, au moins une passerelle tierce référence actuellement le modèle comme gratuit, mais sa fiche précise qu'il s'agit d'un essai temporaire plafonné par quota. Une mention à $0 doit donc être considérée comme un canal de démonstration, non comme un tarif.
La limite qui dicte tout : 1 requête par minute
La page officielle indique un RPM, ou nombre de requêtes par minute, de 1 dans les régions de Pékin comme de Singapour, aussi bien pour Pro que pour le modèle standard. C'est un à deux ordres de grandeur sous les 60 à 600 RPM habituellement proposés par les API d'image bien établies.
Ce chiffre explique les retours des premiers utilisateurs : erreurs 429 immédiates lors d'appels rapprochés, deux requêtes en échec dès que deux processus partagent une même clé, et exécutions fiables uniquement lorsque les requêtes sont strictement sérialisées avec un backoff généreux. Un test publié le 23 juillet a mesuré exactement ce comportement via une passerelle, avant que la limite officielle ne soit documentée.
En pratique :
- La génération par lots n'est pas envisageable. À 1 RPM, le plafond atteint environ 1,440 requêtes par jour et par clé, en séquentiel, sans aucune tolérance aux rafales. Chaque requête peut toutefois renvoyer jusqu'à 6 images via
n, facturées individuellement. - Une clé partagée devient un goulot d'étranglement. Deux développeurs qui itèrent sur leurs prompts se gêneront mutuellement ; en cas de partage, placez la génération derrière une file avec un unique worker.
- Les boucles de retry aggravent le problème. Préférez des paliers de backoff de 45 à 60 secondes plutôt que de marteler l'API.
Cette limite évoque davantage un bridage de déploiement progressif qu'une politique définitive. Mais tant qu'Alibaba ne la relève pas, qwen-image-3.0-pro reste un outil interactif, pas un composant de pipeline.
Rendu de texte : ses forces et ses failles
La typographie est la principale raison de s'intéresser à ce modèle, et les tests indépendants confirment en partie la promesse — avec une limite nette. Dans des tests publiés sur des sorties Pro brutes, une fiche technique de machine à espresso reproduisait correctement toutes les valeurs, jusqu'à une ligne de numéro de série en très petits caractères (« Serial AT-2026-0731 / Made in Suzhou »), à l'équivalent d'environ 8 pt. Une signalétique bilingue affichait également sans erreur l'anglais et le chinois. En revanche, une maquette d'éditeur de code générait les numéros de ligne 1, 3, 3, 4, 6. Les mots et les libellés tiennent ; les séquences monotones et les opérateurs de code, beaucoup moins.
Pour situer le niveau, j'ai soumis la même structure de prompt de fiche technique à Nano Banana Pro (Gemini 3 Pro Image) le 5 août 2026 : une fiche fictive d'espresso AROMA-9, avec quatre valeurs exactes dans un tableau et une ligne de série en petit corps, paramètres par défaut. Un seul essai, sans relance, en 65 secondes :
Les quatre lignes de spécifications étaient justes, mais le nom de la ville dans la ligne en petits caractères était mal orthographié : « Suzheu ». Or c'est précisément à cette taille que le rendu de Qwen aurait tenu. Une seule image ne prouve pas grand-chose ; elle s'inscrit toutefois dans une tendance claire : la fidélité des très petits caractères reste difficile, et c'est le terrain spécifique sur lequel Qwen a choisi de se mesurer à ses rivaux. Le sentiment de la communauté suit la même ligne :
« Qwen joue bien au-dessus de sa catégorie. Gemini 3 Pro garde l'avantage sur la fidélité des textures et le “polish”. » — r/QwenImageGen, à propos de la précédente génération d'images Qwen face à Gemini 3 Pro Image
Si votre texte doit être littéralement exact — captures de code, axes numérotés, données séquentielles — aucun modèle d'image actuel n'est fiable, y compris celui-ci.
Appeler qwen-image-3.0-pro via l'API
La voie gratuite passe par Qwen Studio, après connexion : choisissez la génération d'image, puis remplacez le modèle par défaut par 3.0. Pour l'API, il faut passer par Alibaba Cloud Model Studio et utiliser une clé API DashScope. L'exemple ci-dessous utilise le point de terminaison international de Singapour ; Pékin requiert son propre endpoint et une clé API distincte.
curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-d '{
"model": "qwen-image-3.0-pro",
"input": {"messages": [{"role": "user", "content": [
{"text": "A four-row product spec table, fine print at the bottom..."}
]}]},
"parameters": {"size": "1024*1536", "prompt_extend": true}
}'
Quelques paramètres diffèrent des autres API d'image, selon la référence API officielle :
| Paramètre | Comportement |
|---|---|
size | Format libre width*height ; surface totale comprise entre 512² et 2048² pixels, ratio de 1:8 à 8:1. Sans ce paramètre, le modèle choisit une résolution à partir du prompt |
| Retouche d'image | Placez 1 à 3 objets {"image": "..."} — URL ou base64 — avant le texte ; un seul tour est pris en charge |
prompt_extend | Réécriture de prompt, activée par défaut ; le mode agent existe uniquement pour la génération texte-vers-image |
n | 1 à 6 images par requête |
watermark | Désactivé par défaut |
| URL du résultat | PNG servi via une URL signée qui expire après 24 heures ; téléchargez-le immédiatement et ne conservez jamais l'URL |
Pas de poids ouverts : ce que vous téléchargez réellement
Qwen Image 3 Pro ne peut pas être téléchargé. À la différence de Qwen-Image 1.0 et des modèles de retouche de l'ère 2.0, dont les poids étaient publiés sous licence Apache 2.0, la génération 3.0 est sortie sans poids, sans rapport technique et sans scores de benchmark. Le checkpoint open weight le plus récent de l'équipe reste Qwen/Qwen-Image-2512, de décembre 2025. C'est ce modèle, avec le dépôt GitHub QwenLM/Qwen-Image, que vous trouverez en recherchant un téléchargement.
L'absence de benchmarks compte. L'équipe maintient sa propre suite d'évaluation, Qwen-Image-Bench, mais n'a publié aucun score pour la génération 3.0. Toutes les affirmations de qualité ci-dessus reposent donc sur des démonstrations et des vérifications ponctuelles par des tiers, pas sur une évaluation systématique.
Faut-il payer le surcoût de Pro ?
| Votre usage | Verdict |
|---|---|
| Mises en page denses en texte : fiches techniques, affiches, sujets d'examen, signalétique multilingue | Pro : c'est précisément ce que finance le surcoût de 2.8×, et le quota gratuit de 10 images suffit pour l'évaluer |
| Illustration courante, hero images, brouillons à itérer | qwen-image-3.0 standard : ¥0.18 fixe quelle que soit la résolution, avec les mêmes limites de taille |
| Versions finales 2K de créations riches en texte | Pro, mais prévoyez ¥0.5/image et gardez en tête le seuil de surface de 2.25MP |
| Pipelines par lots, SLA de latence, tout usage sans supervision | Aucun des deux : 1 RPM élimine les deux options ; utilisez une API d'image établie et réservez Qwen aux cas typographiques où il l'emporte |
| Exécution locale | Qwen-Image-2512, le checkpoint ouvert le plus récent ; 3.0 ne fournit aucun poids |
Le constat honnête est le suivant : qwen-image-3.0-pro fonde sa valeur sur le rendu de compositions riches en texte, résiste aux vérifications ponctuelles de tiers, mais son exploitation est sévèrement limitée par un plafond de 1 RPM. Testez-le avec votre prompt typographique le plus exigeant grâce au quota gratuit ; conservez votre trafic de production sur votre infrastructure habituelle tant que cette limite ne bouge pas.
FAQ
Qwen Image 3 Pro est-il gratuit ?
En partie. Qwen Studio permet une utilisation interactive gratuite après connexion, et l'API de la région de Pékin inclut 10 images gratuites valables 90 jours. Certaines passerelles proposent aussi une offre gratuite temporaire, que la fiche du modèle décrit explicitement comme un essai plafonné par quota.
Puis-je télécharger qwen-image-3.0-pro ou l'exécuter localement ?
Non. La génération 3.0 n'a pas de poids publiés. Le modèle d'image Qwen open weight le plus récent est Qwen-Image-2512, de décembre 2025, disponible sur Hugging Face sous Apache 2.0.
Quelle différence entre qwen-image-3.0-pro et qwen-image-2.0-pro ?
3.0 Pro porte la capacité de prompt à 4.5k tokens, contre environ 1k pour 2.0, et ajoute le rendu de petits textes à 10 px ainsi que la prise en charge de 12 langues. Dans la grille tarifaire officielle, les deux sont facturés ¥0.5 en 2K à Pékin. En revanche, la sortie 1K de 3.0 Pro coûte ¥0.25, contre ¥0.5 au tarif fixe de 2.0 Pro.
Qwen Image 3 Pro prend-il en charge la retouche d'image ?
Oui. Le même identifiant qwen-image-3.0-pro accepte 1 à 3 images de référence accompagnées d'une instruction pour la retouche image-vers-image. Attention : l'entrée d'images de référence aurait été défaillante via au moins une passerelle tierce compatible OpenAI. Testez donc d'abord la retouche avec l'API DashScope native.