Lancé sur Qwen Cloud le 5 août 2026, Qwen Image 3 Pro adopte un tarif API fixe de 0,04 $ par image. Sa fiche technique vise clairement les contenus commerciaux structurés : texte lisible à partir de 10 pixels, prompts de 4 500 tokens et rendu natif dans 12 langues. Disponible depuis avril 2026 via l’API OpenAI, GPT Image 2 peut descendre à 0,006 $ l’image en basse qualité, mais son coût augmente avec la résolution et la longueur du prompt.
Pour générer rapidement des visuels produit ou explorer des pistes créatives, GPT Image 2 reste plus rapide et moins cher. En revanche, dès qu’il faut produire des affiches très textuelles, des assets multilingues ou des mises en page proches d’un document, le prix fixe et les prompts longs de Qwen Image 3 Pro changent l’équation.
Rendu du texte : l’écart le plus net
Le blog de Qwen illustre ces capacités avec une infographie en grille 3×3, créée à partir d’un unique prompt de 3 700 tokens : neuf cases distinctes réunissant du texte chinois et anglais, des formules LaTeX et des illustrations, en une seule génération.
J’ai soumis à GPT Image 2 un prompt d’infographie dense : une affiche « 5 Tips for Better Sleep » avec cinq conseils numérotés, des températures précises (« 65–68°F ») et des repères horaires (« after 2 PM »).
GPT Image 2 a correctement rendu le titre et l’essentiel du texte, avec quelques petits problèmes d’espacement sur les lignes longues. La différence se creuse dans les compositions denses à plusieurs blocs, précisément le terrain pour lequel les prompts de 4 500 tokens et la spécification de texte à 10 px de Qwen ont été pensés.
« Qwen was very similar to ChatGPT, Qwen image, applied it to the berserk panel, keeping the whole panel and the sketch the same. » — fil de comparaison r/ChatGPT (modèle Qwen Image 3.0 de base)
Une limite importante : l’API de Qwen Image 3 Pro n’était pas disponible pour un test direct pendant la préparation de cet article, le fournisseur kie renvoyant des erreurs 500. Les observations sur le rendu du texte reposent donc sur les démos officielles de Qwen, et non sur mes propres sorties comparatives. Cette section sera mise à jour avec des exemples équivalents dès que l’accès à l’API sera stabilisé.
Le prix réel de chaque image
Qwen Image 3 Pro et Standard
Qwen Cloud affiche un prix fixe par image (source : Alibaba Cloud Model Studio) :
| Offre | ID du modèle | Prix par image |
|---|---|---|
| Pro | qwen-image-3.0-pro | 0,04 $ |
| Standard | qwen-image-3.0-standard | 0,03 $ |
Un prompt de 4 500 tokens coûte les mêmes 0,04 $ qu’un prompt de 50 tokens. Aucun calcul de tokens à faire.
GPT Image 2
GPT Image 2 applique une facturation basée sur les tokens (source : tarifs de l’API OpenAI) :
| Composant | Tarif (par million de tokens) |
|---|---|
| Entrée texte | 5,00 $ |
| Entrée image | 8,00 $ |
| Sortie image | 30,00 $ |
Le coût par image dépend de la qualité et de la résolution. Comptez environ 0,006 $ en basse qualité (1024×1024), et environ 0,19 $ en haute qualité (4096×4096). Les prompts longs font grimper la part liée à l’entrée texte.
| Scénario (100 images) | GPT Image 2 | Qwen Image 3 Pro |
|---|---|---|
| Brouillons basse qualité (1K, prompt court) | ~0,60 $ | 4,00 $ |
| Production haute qualité (4K, prompt moyen) | ~8–19 $ | 4,00 $ |
| Infographies très textuelles (4K, prompt long) | ~12–19 $ | 4,00 $ |
Estimations GPT Image 2 basées sur les tarifs par token d’OpenAI ainsi que sur des tailles habituelles de prompts et de sorties. Le coût exact varie selon la longueur du prompt et le réglage de qualité.
GPT Image 2 l’emporte pour les brouillons. Qwen Image 3 Pro devient plus avantageux pour les productions avec prompts complexes : son tarif fixe absorbe une longueur de prompt qui alourdirait la facture tokenisée de GPT.
Test sur une photo produit
Voici le même prompt envoyé à GPT Image 2 : tasse en céramique, « DESIGN LAB 2026 », lumière matinale, vapeur et bokeh.
La scène est naturelle, le texte correct et la vapeur réaliste. Les démos officielles de Qwen montrent un niveau de détail comparable, avec un rendu commercial plus épuré. Pour des photos produit simples, les deux modèles sont prêts pour la production.
Les domaines où Qwen Image 3 Pro prend l’avantage
Prompts longs et mises en page complexes
Avec 4 500 tokens (selon le blog officiel de Qwen), il est possible de décrire :
- Une page complète de journal avec titres, texte courant, légendes et emplacements réservés aux photos
- Un storyboard 3×3 dont chaque vignette possède sa description propre
- Un sujet d’examen mêlant formules, schémas et consignes
GPT Image 2 gère une complexité de mise en page modérée. Mais pour créer en un seul passage des documents organisés en plusieurs sections, la fenêtre de prompt plus longue de Qwen constitue un avantage structurel.
Texte multilingue
Qwen Image 3 Pro rend nativement le texte dans 12 langues (d’après l’annonce officielle) : chinois, japonais, coréen, arabe, espagnol et sept autres. GPT Image 2 a amélioré le rendu CJK par rapport à GPT Image 1.5, mais OpenAI n’a publié ni nombre de langues prises en charge ni spécification de taille minimale de texte lisible.
Pour un pipeline qui couvre plusieurs systèmes d’écriture, la couverture linguistique documentée de Qwen a son importance.
Infographies denses
Les démos officielles de Qwen présentent notamment :
- Une infographie pédagogique sur le requin-baleine avec données sur l’espèce, mesures et texte dense, le tout lisible à petite taille
- Une page complète d’article académique avec du LaTeX : indices, exposants, barres de fraction, lettres grecques et aucun symbole corrompu
GPT Image 2 sait générer des infographies, mais privilégie davantage l’interprétation créative que l’affichage de données avec une précision au pixel.
Les points forts de GPT Image 2
Retouches en conversation
GPT Image 2 s’intègre au flux multi-tour de ChatGPT : on génère, puis on demande « move the logo left », « make the background warmer » ou « add a shadow ». Chaque retouche s’appuie sur la précédente.
Qwen Image 3 Pro propose lui aussi l’édition par instruction, via un modèle Edit dédié que l’équipe Qwen présente comme plus rapide qu’une régénération complète. En revanche, il n’y a pas de mémoire conversationnelle : chaque étape d’une retouche en plusieurs temps doit être reformulée depuis le début.
Variété créative
Aquarelle, peinture à l’huile, anime, photojournalisme ou surréalisme : GPT Image 2 couvre ces styles sans prompt engineering poussé. La fonction « Deep Knowledge » de Qwen Image 3 Pro simule des interfaces UI et des mises en page de livestream, mais le modèle est avant tout conçu pour des sorties commerciales structurées.
Vitesse et limites de débit
Lors de mes tests, GPT Image 2 renvoyait une image en environ 5 à 10 secondes. L’API Qwen Cloud de Qwen Image 3 Pro impose actuellement des limites de débit plus strictes : le détail des prix de Qwen Image 3 Pro publié sur ce site documente un plafond observé d’environ 1 requête/minute pendant les tests. C’est une contrainte réelle pour les workflows par lots.
Comparatif des API
| Détail | Qwen Image 3 Pro | GPT Image 2 |
|---|---|---|
| ID du modèle | qwen-image-3.0-pro | gpt-image-2 |
| Fournisseur | Alibaba Cloud Model Studio | OpenAI |
| Facturation | 0,04 $/image (fixe) | Basée sur les tokens (~0,006–0,19 $) |
| Limite de débit | ~1 req/min (observée) | Limites standard des niveaux OpenAI |
| Prompt maximal | ~4 500 tokens (officiel) | Optimal avec des prompts concis |
| Sortie maximale | Jusqu’à 2K | Jusqu’à 4K (palier tarifaire supérieur) |
| Édition | Par instruction | Conversationnelle + par instruction |
| Langues du texte | 12 en rendu natif | Multilingue, CJK amélioré |
Pour le guide complet de l’API Qwen Image 3 Pro — configuration, limites de débit et différences entre Pro et Standard — consultez le détail des prix et limites de Qwen Image 3 Pro.
Quel modèle choisir ?
| Workflow | Choix | Pourquoi |
|---|---|---|
| Affiches et infographies très textuelles | Qwen Image 3 Pro | Spécification de texte à 10 px, prompts de 4 500 tokens |
| Assets marketing multilingues | Qwen Image 3 Pro | Rendu natif dans 12 langues |
| Brouillons rapides de photos produit | GPT Image 2 | ~0,006 $/image, génération en 5–10 s |
| Exploration créative de portraits | GPT Image 2 | Palette de styles plus large, édition multi-tour |
| Génération par lots à fort volume | GPT Image 2 | Limites de débit plus élevées |
| Mises en page documentaires complexes | Qwen Image 3 Pro | Génération multi-section en un seul passage |
| API de production (écosystème mature) | GPT Image 2 | Quatre mois d’épreuve du terrain |
Utilisez les deux si votre pipeline produit ces deux types de visuels.
FAQ
Qwen Image 3 Pro est-il gratuit ?
Qwen Image 3.0 est gratuit sur chat.qwen.ai pour la génération dans le navigateur. L’offre API Pro coûte 0,04 $ par image et l’offre Standard 0,03 $ par image via Alibaba Cloud Model Studio.
GPT Image 2 peut-il rendre du texte chinois ?
Oui. GPT Image 2 améliore le rendu CJK par rapport à GPT Image 1.5 et gère le chinois, le japonais et le coréen pour des titres. Pour du texte CJK dense et de petite taille, la spécification de lisibilité à 10 px de Qwen Image 3 Pro lui donne un avantage.
Quel modèle choisir pour la photographie produit ?
Les deux produisent des photos produit de qualité professionnelle. GPT Image 2 tend vers un rendu plus chaud et orienté lifestyle. Qwen Image 3 Pro privilégie un style plus propre et commercial. Pour les produits comportant du texte imprimé — étiquettes, prix ou noms de marque — Qwen est plus fiable.
Les deux modèles prennent-ils en charge l’édition d’images ?
Oui. GPT Image 2 permet l’édition conversationnelle dans ChatGPT et l’édition par instruction via API. Qwen Image 3 Pro propose l’édition par instruction à l’aide d’un modèle Edit dédié.