AIREITER

Qwen Image 3 Pro: API-Preise, Limits und die Vorteile gegenüber qwen-image-3.0

Zuletzt aktualisiert: 2026-08-05 04:01:28

Für Qwen Image 3 Pro hat Alibaba nun offizielle API-Preise veröffentlicht: In der Region Beijing kostet ein Bild der 1K-Stufe ¥0.25 (etwa $0.035), bei 2K verdoppelt sich der Preis auf ¥0.5. Damit ist Pro bei gleicher Auflösung 2.8× teurer als das Standardmodell qwen-image-3.0. Für Layouts mit viel Text kann dieser Aufpreis gerechtfertigt sein. Ein Wert auf der offiziellen Modellseite stellt allerdings jede Einsatzplanung infrage: Das Rate Limit liegt bei nur 1 Request pro Minute.

Das unterscheidet Qwen Image 3 Pro von qwen-image-3.0

Qwen Image 3 Pro (qwen-image-3.0-pro) ist Alibabas Qualitätsstufe oberhalb von Qwen-Image-3.0 und erschien am 21. Juli 2026. Pro und das reguläre qwen-image-3.0 beherrschen über dieselbe API sowohl Text-zu-Bild als auch Bildbearbeitung und haben identische Größenlimits. Unterschiede gibt es bei der Ergebnisqualität und bei der Abrechnung von 2K-Ausgaben.

Die zentralen Fähigkeiten gelten für die gesamte 3.0-Familie:

  • Prompts mit 4.5k Tokens statt ungefähr 1k in der vorherigen Generation – genug für eine komplette Zeitungsseite, ein 3×3-Infografikraster oder eine verschachtelte UI-in-UI-Komposition in einem Durchlauf
  • Textrendering bis 10px, das lesbar bleiben soll, einschließlich LaTeX-Formeln, Hochstellungen und Theoremnummerierungen
  • 12 Sprachen und mehr als 20 Schriftarten, nativ gerendert, dazu simulierte Web-, Spiele- und Livestream-Oberflächen
Offizielle Ankündigung von Qwen-Image-3.0 auf qwen.ai, veröffentlicht am 21. Juli 2026

Bei der Positionierung gehen die Modelle auseinander. Alibabas eigene Modellauswahl-Hilfe empfiehlt Pro für komplexe Layouts, präzises Rendering kleiner Texte und mehrsprachige Schriftarbeiten. Das Standardmodell wird als Ausgleich zwischen Qualität und Geschwindigkeit beschrieben. Ansonsten sind die technischen Daten für beide Modell-IDs gleich: Ausgaben von 512×512 bis 2048×2048 Gesamtpixeln, Seitenverhältnisse von 1:8 bis 8:1, 1–3 Referenzbilder bei der Bearbeitung sowie PNG-Ausgabe.

Offizielle API-Preise, geprüft im August 2026

Alibaba Cloud Model Studio führt die Preise pro Bild für qwen-image-3.0-pro in zwei Regionen. Abgeglichen wurden sie am 5. August 2026 mit der offiziellen Preisliste:

AbrechnungspostenBeijing (CNY)Singapore intl. (CNY)Ca. USD
Bildeingabe (pro Bild)¥0.02¥0.022483~$0.003
1K-Ausgabe (pro Bild)¥0.25¥0.299768~$0.035–0.042
2K-Ausgabe (pro Bild)¥0.5¥0.562065~$0.070–0.079

Die Grenze zwischen 1K und 2K richtet sich nach der Pixelzahl: Bis einschließlich 2,250,000 Pixel wird der 1K-Preis berechnet, darüber der 2K-Preis. Das Standardmodell qwen-image-3.0 verlangt unabhängig von der Auflösung pauschal ¥0.18 (etwa $0.025) pro Ausgabebild. Daraus ergibt sich die ungewöhnliche Konstellation: Bei 2K kostet Pro 2.8× so viel wie das Standardmodell, bei 1K beträgt der Abstand nur 1.4×.

Preistabelle für qwen-image-3.0-pro in der Region Beijing bei Alibaba Cloud Model Studio, aufgenommen am 5. August 2026 Ausgabepreis pro Bild: qwen-image-3.0 pauschal ¥0.18 gegenüber Pro mit ¥0.25 bei 1K und ¥0.5 bei 2K

Zwei wichtige Fußnoten: In der Region Beijing gibt es ein kostenloses Kontingent von 10 Bildern, Eingaben und Ausgaben zusammengezählt, das ab Aktivierung 90 Tage gültig ist. Das reicht, um die Typografie-Versprechen mit eigenen Prompts zu prüfen, aber nicht für einen produktiven Aufbau. Außerdem führt mindestens ein Drittanbieter-Gateway das Modell derzeit kostenlos. Die Modellkarte kennzeichnet dies jedoch als zeitlich begrenzten Test mit gedeckeltem Kontingent. Ein $0-Angebot sollte daher als Demokanal gelten, nicht als Preis.

Das entscheidende Limit: 1 Request pro Minute

Auf der offiziellen Modellseite ist für Pro wie auch für das Standardmodell in Beijing und Singapore ein RPM-Wert von 1 angegeben. Das liegt ein bis zwei Größenordnungen unter den 60–600 RPM, die bei etablierten Bild-APIs üblich sind.

Dieser einzelne Wert erklärt die Berichte früher Nutzer: Sofortige 429-Fehler bei aufeinanderfolgenden Requests, zwei fehlgeschlagene Anfragen, sobald zwei Prozesse denselben Key nutzten, und saubere Durchläufe nur bei strikt serieller Verarbeitung mit großzügigem Backoff. Ein am 23. Juli veröffentlichter Test maß genau dieses Muster über ein Gateway, noch bevor das offizielle Limit dokumentiert war.

In der Praxis bedeutet das:

  • Batch-Generierung fällt aus. Mit 1 RPM liegt das Maximum bei etwa 1,440 Requests pro Tag und Key, strikt nacheinander und ohne Burst-Spielraum. Über n kann jede Anfrage bis zu 6 Bilder liefern, abgerechnet wird jedoch pro Bild.
  • Teams mit gemeinsamem Key bremsen sich gegenseitig aus. Zwei Entwickler, die Prompts iterieren, geraten zwangsläufig aneinander. Falls ein gemeinsamer Key nötig ist, sollte die Generierung über eine Queue mit nur einem Worker laufen.
  • Retry-Schleifen verschärfen das Problem. Statt weiterzuhämmern, sollte der Backoff in Schritten von 45–60 Sekunden erfolgen.

Das Limit wirkt eher wie ein kontrolliertes Rollout-Throttling als wie eine dauerhafte Regel. Solange Alibaba es nicht anhebt, ist qwen-image-3.0-pro aber ein interaktives Werkzeug und kein Baustein für Pipelines.

Textrendering: stark bei Wörtern, schwach bei Folgen

Die Typografie ist der Hauptgrund, sich dieses Modell anzusehen – und unabhängige Tests bestätigen den Anspruch, allerdings mit einer klaren Grenze. In veröffentlichten Tests mit unverarbeiteten Pro-Ausgaben wurden auf einem Datenblatt für eine Espressomaschine alle Werte korrekt wiedergegeben, einschließlich einer kleingedruckten Serienzeile ("Serial AT-2026-0731 / Made in Suzhou") in etwa 8pt-Entsprechung. Auch ein zweisprachiges Schild traf Englisch und Chinesisch korrekt. Der Bruch kam bei einem Code-Editor-Mockup: Die Zeilennummern lauteten 1, 3, 3, 4, 6. Wörter und Beschriftungen funktionieren, monotone Sequenzen und Code-Operatoren nicht zuverlässig.

Zur Einordnung habe ich dieselbe Prompt-Struktur für ein Datenblatt auf Nano Banana Pro (Gemini 3 Pro Image) am 5. August 2026 ausgeführt: ein fiktives AROMA-9-Espresso-Datenblatt mit vier exakten Tabellenwerten und einer kleingedruckten Serienzeile, mit Standardeinstellungen. Ein Versuch, keine Wiederholungen, 65 Sekunden:

Nano-Banana-Pro-Ausgabe für denselben Prompt eines Espresso-Datenblatts: Alle vier Tabellenzeilen korrekt, aber im Kleingedruckten steht "Made in Suzheu"

Alle vier Datenzeilen waren korrekt, doch in der kleingedruckten Zeile wurde der Ortsname als "Suzheu" falsch geschrieben – genau die Textgröße, bei der Qwens Rendering Berichten zufolge standhielt. Ein einzelnes Bild beweist wenig. Es passt jedoch zu einem klaren Muster: Kleingedrucktes zuverlässig zu rendern ist schwierig, und genau dort will Qwen konkurrieren. Auch die Stimmung in der Community verläuft entlang dieser Linie:

"Qwen is punching way above its weight class. Gemini 3 Pro has the edge on texture fidelity and 'polish'" — r/QwenImageGen, Vergleich der vorherigen Qwen-Bildgenerierung mit Gemini 3 Pro Image

Wenn Text buchstäblich korrekt sein muss – etwa in Code-Screenshots, nummerierten Achsen oder fortlaufenden Datenreihen –, ist aktuell kein Bildmodell verlässlich genug. Dieses eingeschlossen.

qwen-image-3.0-pro per API aufrufen

Der kostenlose Weg führt über Qwen Studio und erfordert einen Login: Bildgenerierung auswählen und das Standardmodell auf 3.0 umstellen. Für die API wird Alibaba Cloud Model Studio mit einem DashScope-API-Key verwendet. Das folgende Beispiel nutzt den internationalen Endpoint in Singapore; Beijing benötigt einen eigenen Endpoint und einen separaten API-Key.

curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -d '{
    "model": "qwen-image-3.0-pro",
    "input": {"messages": [{"role": "user", "content": [
      {"text": "A four-row product spec table, fine print at the bottom..."}
    ]}]},
    "parameters": {"size": "1024*1536", "prompt_extend": true}
  }'

Einige Parameter weichen von anderen Bild-APIs ab. Die Details stammen aus der offiziellen API-Referenz:

ParameterVerhalten
sizeFreies Format width*height; jede Gesamtpixelzahl von 512² bis 2048² bei einem Seitenverhältnis von 1:8–8:1. Ohne Angabe wählt das Modell die Auflösung anhand des Prompts.
Bildbearbeitung1–3 {"image": "..."}-Objekte, als URL oder Base64, vor dem Text übergeben; nur Single-Turn
prompt_extendPrompt-Umschreibung, standardmäßig aktiviert; der Modus agent ist nur für Text-zu-Bild verfügbar
n1–6 Bilder pro Request
watermarkStandardmäßig deaktiviert
Ergebnis-URLPNG hinter einer signierten URL, die nach 24 Stunden abläuft; sofort herunterladen und die URL niemals speichern

Keine offenen Gewichte: Was ein „Download“ tatsächlich liefert

Qwen Image 3 Pro lässt sich nicht herunterladen. Anders als Qwen-Image 1.0 und die Bearbeitungsmodelle der 2.0-Ära, deren Gewichte unter Apache 2.0 veröffentlicht wurden, startete die 3.0-Generation ohne Gewichte, technischen Bericht und Benchmark-Ergebnisse. Der neueste Open-Weight-Checkpoint des Teams bleibt Qwen/Qwen-Image-2512 aus dem Dezember 2025. Darauf – und auf das GitHub-Repository QwenLM/Qwen-Image – stoßen Suchen nach einem Download.

Die fehlenden Benchmarks sind relevant. Das Team pflegt mit Qwen-Image-Bench zwar eine eigene Evaluierungssuite, hat für die 3.0-Generation aber keine Ergebnisse veröffentlicht. Sämtliche Qualitätsaussagen oben beruhen deshalb auf Demos und punktuellen Tests Dritter, nicht auf einer systematischen Bewertung.

Lohnt sich der Pro-Aufpreis?

AufgabeEmpfehlung
Textdichte Layouts: Datenblätter, Poster, Prüfungsbögen, mehrsprachige BeschilderungPro: Dafür ist der 2.8×-Aufpreis gedacht, und das kostenlose Kontingent von 10 Bildern reicht für den Test.
Alltägliche Illustrationen, Hero Images, Entwürfe mit mehreren IterationenStandard qwen-image-3.0: pauschal ¥0.18 bei jeder Auflösung, identische Größenlimits
2K-Finalversionen textlastiger ArbeitenPro, aber mit ¥0.5 pro Bild kalkulieren und die Pixelgrenze bei 2.25MP beachten
Batch-Pipelines, Latenz-SLAs, alles ohne BetreuungKeines von beiden: 1 RPM disqualifiziert beide Modelle; besser eine etablierte Bild-API nutzen und Qwen für die Typografie-Fälle reservieren, bei denen es gewinnt
Lokaler BetriebQwen-Image-2512, der neueste offene Checkpoint; für 3.0 gibt es keine Gewichte

Die nüchterne Einschätzung: qwen-image-3.0-pro begründet seinen Wert mit dichtem Textrendering, hält in punktuellen Tests Dritter stand, wird operativ aber durch das Limit von 1 RPM zu einem Spezialwerkzeug. Teste es im kostenlosen Kontingent mit deinem schwierigsten Typografie-Prompt. Produktivtraffic sollte dort bleiben, wo er bereits läuft – zumindest bis sich das Rate Limit bewegt.

FAQ

Ist Qwen Image 3 Pro kostenlos nutzbar?

Teilweise. Qwen Studio bietet nach dem Login kostenlose interaktive Nutzung, und die API-Region Beijing enthält 10 kostenlose Bilder, die 90 Tage gültig sind. Einige Gateways führen einen zeitlich begrenzten kostenlosen Tarif, den die Modellkarte ausdrücklich als Test mit gedeckeltem Kontingent ausweist.

Kann ich qwen-image-3.0-pro herunterladen oder lokal ausführen?

Nein. Für die 3.0-Generation wurden keine Gewichte veröffentlicht. Das neueste Open-Weight-Bildmodell von Qwen ist Qwen-Image-2512 vom Dezember 2025, verfügbar auf Hugging Face unter Apache 2.0.

Was ist der Unterschied zwischen qwen-image-3.0-pro und qwen-image-2.0-pro?

3.0 Pro erhöht die Prompt-Kapazität auf 4.5k Tokens, während 2.0 bei ungefähr 1k lag, und ergänzt 10px-Kleinsttextrendering sowie Unterstützung für 12 Sprachen. In der offiziellen Preisliste werden beide in Beijing bei 2K mit ¥0.5 berechnet. Für 1K verlangt 3.0 Pro jedoch ¥0.25, während 2.0 Pro pauschal ¥0.5 kostet.

Unterstützt Qwen Image 3 Pro Bildbearbeitung?

Ja. Dieselbe Modell-ID qwen-image-3.0-pro akzeptiert 1–3 Referenzbilder zusammen mit einer Anweisung für Bild-zu-Bild-Bearbeitung. Berichten zufolge funktioniert die Referenzbild-Eingabe allerdings über mindestens ein OpenAI-kompatibles Gateway eines Drittanbieters nicht. Bildbearbeitung daher zunächst über die native DashScope-API testen.

Weiterführende Artikel