Qwen Image 3 Pro cuesta ¥0.25 (~$0.035) por imagen en el nivel 1K de la región de Pekín y ¥0.5 en 2K, según las tarifas oficiales de Alibaba. En 2K, eso equivale a 2.8× el precio de qwen-image-3.0 para la misma resolución. Si trabajas con composiciones cargadas de texto, el sobrecoste puede tener sentido. El problema es que hay una cifra que condiciona cualquier uso real del modelo: su límite es de 1 solicitud por minuto.
Qué mejora Qwen Image 3 Pro frente a qwen-image-3.0
Qwen Image 3 Pro (qwen-image-3.0-pro) es la variante orientada a máxima calidad de la generación Qwen-Image-3.0 de Alibaba, presentada el 21 de julio de 2026. Comparte API, funciones de texto a imagen y edición de imágenes, así como los mismos límites de tamaño, con el modelo estándar qwen-image-3.0. La diferencia está en la calidad de salida y en el coste de generar a 2K.
Las principales capacidades son comunes a toda la familia 3.0:
- Prompts de hasta 4.5k tokens, frente a alrededor de 1k en la generación anterior: suficiente para describir en una sola pasada una página de periódico completa, una cuadrícula infográfica de 3×3 o una interfaz anidada dentro de otra interfaz
- Texto legible a 10 px, incluidas fórmulas LaTeX, superíndices y numeración de teoremas
- 12 idiomas y más de 20 fuentes renderizados de forma nativa, además de interfaces simuladas de webs, juegos y retransmisiones en directo
La separación entre ambos llega en el posicionamiento. La propia guía de selección de modelos de Alibaba recomienda Pro para diseños complejos, texto pequeño que requiera precisión y trabajos multilingües con fuentes; el modelo estándar se presenta como el equilibrio entre calidad y velocidad. Por lo demás, las especificaciones son iguales en ambos IDs: salidas de entre 512×512 y 2048×2048 píxeles totales, relaciones de aspecto de 1:8 a 8:1, entre 1 y 3 imágenes de referencia para edición y salida en PNG.
Precio oficial de la API, comprobado en agosto de 2026
Alibaba Cloud Model Studio publica precios por imagen para qwen-image-3.0-pro en dos regiones. Estas cifras se comprobaron en la lista oficial de precios el 5 de agosto de 2026:
| Concepto facturado | Pekín (CNY) | Singapur internacional (CNY) | USD aprox. |
|---|---|---|---|
| Imagen de entrada (por imagen) | ¥0.02 | ¥0.022483 | ~$0.003 |
| Salida 1K (por imagen) | ¥0.25 | ¥0.299768 | ~$0.035–0.042 |
| Salida 2K (por imagen) | ¥0.5 | ¥0.562065 | ~$0.070–0.079 |
El corte entre 1K y 2K depende del área de píxeles: hasta 2,250,000 píxeles se factura a tarifa 1K; por encima, a tarifa 2K. El modelo estándar qwen-image-3.0 tiene un precio plano de ¥0.18 (~$0.025) por imagen de salida en cualquiera de las dos resoluciones. De ahí esta situación algo peculiar: en 2K, Pro cuesta 2.8× más que el modelo estándar, mientras que en 1K la diferencia se reduce a 1.4×.
Hay dos notas al pie importantes. La región de Pekín incluye una cuota gratuita de 10 imágenes, sumando entradas y salidas, válida durante 90 días tras la activación. Sirve para poner a prueba las promesas tipográficas con tus propios prompts, pero no para construir nada. Además, al menos una pasarela de terceros muestra actualmente el modelo como gratuito, aunque su tarjeta indica que es una prueba temporal con cuota limitada. Cualquier precio de $0 debe entenderse como un canal de demostración, no como una tarifa real.
El límite que lo condiciona todo: 1 solicitud por minuto
La página oficial del modelo fija el RPM, es decir, las solicitudes por minuto, en 1 tanto en Pekín como en Singapur, y tanto para Pro como para el modelo estándar. Es entre uno y dos órdenes de magnitud menos que los 60–600 RPM habituales en APIs de imagen ya consolidadas.
Esa única cifra explica lo que reportaron los primeros usuarios: errores 429 inmediatos al lanzar llamadas consecutivas, fallos en ambas solicitudes cuando dos procesos compartían una clave y ejecuciones limpias solo al serializar estrictamente las peticiones con un backoff generoso. Una prueba publicada el 23 de julio midió exactamente este patrón mediante una pasarela antes de que se documentara el límite oficial.
En la práctica, esto implica lo siguiente:
- Olvídate de la generación por lotes. Con 1 RPM, el techo es de ~1,440 solicitudes al día por clave, siempre de forma secuencial y sin tolerancia a ráfagas. Cada solicitud puede devolver hasta 6 imágenes con
n, facturadas por imagen. - Los equipos que comparten clave se bloquean entre sí. Dos desarrolladores iterando prompts acabarán chocando. Si no queda otra que compartirla, coloca la generación detrás de una cola con un único worker.
- Los reintentos agresivos empeoran el problema. Aplica backoff en intervalos de 45–60 segundos en vez de insistir sin pausa.
El límite parece más propio de un despliegue gestionado y gradual que de una política permanente. Pero mientras Alibaba no lo aumente, qwen-image-3.0-pro es una herramienta interactiva, no un componente para pipelines.
Renderizado de texto: dónde cumple y dónde falla
La tipografía es el principal motivo para prestar atención a este modelo, y las pruebas independientes respaldan la promesa, aunque con un límite claro. En pruebas publicadas con salida directa de Pro, una ficha técnica de una máquina de espresso reprodujo correctamente todos los valores, incluida una línea de número de serie en letra pequeña ("Serial AT-2026-0731 / Made in Suzhou") equivalente a unos 8 pt. Un cartel bilingüe también resolvió bien tanto el inglés como el chino. El fallo apareció en una maqueta de editor de código: los números de línea fueron 1, 3, 3, 4, 6. Las palabras y etiquetas se mantienen; las secuencias monótonas y los operadores de código, no.
Como referencia, ejecuté la misma estructura de prompt de ficha técnica en Nano Banana Pro (Gemini 3 Pro Image) el 5 de agosto de 2026: una ficha ficticia de espresso AROMA-9 con cuatro valores exactos en tabla y una línea de serie en letra pequeña, usando la configuración predeterminada. Un único intento, sin reintentos, en 65 segundos:
Las cuatro filas de especificaciones salieron correctas, pero la línea en letra pequeña escribió mal la ciudad como "Suzheu", justo el rango de tamaño en el que, según se informa, Qwen sí se sostuvo. Una imagen prueba poco; el patrón encaja con la idea de que la fidelidad en texto diminuto sigue siendo difícil y es precisamente el terreno en el que Qwen ha decidido competir. La opinión de la comunidad sigue una línea similar:
"Qwen está rindiendo muy por encima de lo esperado. Gemini 3 Pro tiene ventaja en fidelidad de texturas y acabado" — r/QwenImageGen, comparando la generación de imágenes anterior de Qwen con Gemini 3 Pro Image
Si el texto debe ser literalmente correcto —capturas de código, ejes numerados o datos secuenciales— ningún modelo de imagen actual es una apuesta segura, incluido este.
Cómo llamar a qwen-image-3.0-pro
La opción gratuita es Qwen Studio, con inicio de sesión obligatorio: selecciona generación de imágenes y cambia el modelo predeterminado por 3.0. Para usar la API, necesitas Alibaba Cloud Model Studio y una clave de API de DashScope. El ejemplo siguiente utiliza el endpoint internacional de Singapur; Pekín requiere su propio endpoint y una clave de API independiente.
curl -X POST "https://dashscope-intl.aliyuncs.com/api/v1/services/aigc/multimodal-generation/generation" \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $DASHSCOPE_API_KEY" \
-d '{
"model": "qwen-image-3.0-pro",
"input": {"messages": [{"role": "user", "content": [
{"text": "A four-row product spec table, fine print at the bottom..."}
]}]},
"parameters": {"size": "1024*1536", "prompt_extend": true}
}'
Detalles de parámetros que difieren de otras APIs de imagen, según la referencia oficial de la API:
| Parámetro | Comportamiento |
|---|---|
size | Formato libre width*height; cualquier área total entre 512² y 2048² píxeles, con aspecto de 1:8–8:1. Si se omite, el modelo elige la resolución a partir del prompt |
| Edición de imagen | Pasa de 1 a 3 objetos {"image": "..."} —URL o base64— antes del texto; solo admite un turno |
prompt_extend | Reescritura del prompt, activada por defecto; el modo agent solo está disponible para texto a imagen |
n | De 1 a 6 imágenes por solicitud |
watermark | Desactivada por defecto |
| URL del resultado | PNG alojado tras una URL firmada que caduca en 24 horas; descárgalo de inmediato y no guardes la URL |
Sin pesos abiertos: qué obtienes al buscar una descarga
No puedes descargar Qwen Image 3 Pro. A diferencia de Qwen-Image 1.0 y de los modelos de edición de la era 2.0, que publicaron sus pesos bajo Apache 2.0, la generación 3.0 llegó sin pesos, sin informe técnico y sin puntuaciones de benchmarks. El checkpoint abierto más reciente del equipo sigue siendo Qwen/Qwen-Image-2512, de diciembre de 2025. Eso, junto con el repositorio de GitHub QwenLM/Qwen-Image, es a donde lleva una búsqueda de "download".
La ausencia de benchmarks importa. El equipo mantiene su propia suite de evaluación, Qwen-Image-Bench, pero no ha publicado resultados para la generación 3.0. Por tanto, todas las afirmaciones de calidad anteriores se apoyan en demostraciones y comprobaciones puntuales de terceros, no en una evaluación sistemática.
¿Merece la pena pagar el extra de Pro?
| Tu caso de uso | Veredicto |
|---|---|
| Diseños con mucho texto: fichas técnicas, pósteres, exámenes y señalética multilingüe | Pro: esto es lo que compra el sobrecoste de 2.8×, y la cuota gratuita de 10 imágenes basta para probarlo |
| Ilustración cotidiana, imágenes hero y borradores que vas a iterar | qwen-image-3.0 estándar: ¥0.18 fijos a cualquier resolución y los mismos límites de tamaño |
| Resultados finales en 2K con mucho texto | Pro, pero cuenta con ¥0.5 por imagen y recuerda el umbral de área de píxeles de 2.25 MP |
| Pipelines por lotes, SLA de latencia o cualquier proceso sin supervisión | Ninguno: 1 RPM descarta ambos; usa una API de imagen consolidada y reserva Qwen para los casos tipográficos en los que destaca |
| Ejecución local | Qwen-Image-2512, el checkpoint abierto más reciente; 3.0 no tiene pesos |
La lectura honesta es esta: qwen-image-3.0-pro basa su valor en el renderizado de composiciones densas de texto, responde bien en comprobaciones puntuales de terceros, pero queda limitado operativamente por 1 RPM, lo que lo convierte en una herramienta especializada. Pruébalo con la cuota gratuita usando tu prompt tipográfico más exigente; mantén el tráfico de producción donde ya lo tengas hasta que el límite de velocidad cambie.
Preguntas frecuentes
¿Qwen Image 3 Pro se puede usar gratis?
En parte. Qwen Studio ofrece uso interactivo gratuito tras iniciar sesión, y la región de API de Pekín incluye 10 imágenes gratuitas válidas durante 90 días. Algunas pasarelas muestran un nivel gratuito temporal, que la tarjeta del modelo identifica explícitamente como una prueba con cuota limitada.
¿Puedo descargar qwen-image-3.0-pro o ejecutarlo en local?
No. La generación 3.0 no tiene pesos publicados. El modelo de imágenes Qwen con pesos abiertos más reciente es Qwen-Image-2512, de diciembre de 2025, disponible en Hugging Face bajo Apache 2.0.
¿Qué diferencia hay entre qwen-image-3.0-pro y qwen-image-2.0-pro?
3.0 Pro eleva la capacidad de prompt a 4.5k tokens —2.0 rondaba 1k— y añade renderizado de texto pequeño a 10 px y compatibilidad con 12 idiomas. En la lista oficial de precios, ambos facturan ¥0.5 en 2K en Pekín, pero 3.0 Pro cobra ¥0.25 por salida 1K frente a la tarifa plana de ¥0.5 de 2.0 Pro.
¿Qwen Image 3 Pro admite edición de imágenes?
Sí. El mismo ID de modelo, qwen-image-3.0-pro, acepta entre 1 y 3 imágenes de referencia junto con una instrucción para edición de imagen a imagen. Ten en cuenta que se ha informado de que la entrada de imágenes de referencia no funciona mediante al menos una pasarela de terceros compatible con OpenAI, así que conviene probar primero la edición con la API nativa de DashScope.