AIREITER

El mejor modelo GPT para generar imágenes: Image 2 vs 1.5 (probado)

Última actualización: 2026-08-06 02:14:32

GPT Image 2 encabeza los tres mayores rankings de generación de imágenes basados en votaciones a ciegas, con 1.340 Elo en Artificial Analysis: 78 puntos por delante de GPT Image 1.5. A cambio, una imagen en calidad alta puede costar hasta $0.21, mientras que gpt-image-1-mini baja de $0.01. Si vas a crear recursos para campañas, prototipos a gran escala o editar fotos de producto, la elección cambia: esta guía enfrenta los modelos de imagen actuales de OpenAI en calidad, precio, resolución y capacidades de edición para que puedas decidir con criterio.

Alcance: esta página cubre exclusivamente la gama de generación de imágenes de OpenAI (GPT Image 2, GPT Image 1.5, gpt-image-1-mini y el veterano GPT-4o). Para comparativas entre ecosistemas que incluyen Midjourney, FLUX y Stable Diffusion, consulta nuestra comparativa de generadores de imágenes con IA de 2026.

Los modelos de imagen de OpenAI disponibles hoy

OpenAI ofrece cuatro modelos de generación de imágenes mediante su API, documentados en su guía de prompting. Cada uno está pensado para una combinación distinta de calidad y coste.

GPT Image 2 se lanzó el 21 de abril de 2026 como el modelo insignia de OpenAI. Según la guía de OpenAI, es «el modelo más potente en términos generales»: incorpora un paso de razonamiento, admite resoluciones flexibles de hasta ~4K experimental y permite cualquier relación de aspecto dentro de sus límites de píxeles. OpenAI lo recomienda «como opción predeterminada para la mayoría de flujos de producción».

GPT Image 1.5 llegó en diciembre de 2025. No incorpora el paso de razonamiento, pero cuenta con el parámetro input_fidelity (low/high), que permite controlar cuánto detalle de la imagen original se conserva durante las ediciones. La resolución está limitada a tamaños fijos: 1024×1024, 1024×1536, 1536×1024 o auto. La guía de OpenAI recomienda conservarlo «solo por compatibilidad retroactiva mientras validas las migraciones de prompts».

gpt-image-1-mini es la opción económica, optimizada para «coste y rendimiento» según la documentación de OpenAI: generación de variantes por lotes, ideación rápida, previsualizaciones y recursos provisionales que no necesitan calidad de primer nivel.

La generación de imágenes de GPT-4o —el ChatGPT Images original— sigue funcionando en la aplicación de consumo. El modelo de API que lo respalda, GPT Image 1, está clasificado por OpenAI como «solo para compatibilidad heredada», con una recomendación explícita de migrar a GPT Image 2.

Calidad y seguimiento del prompt: la distancia en Elo

Los rankings de votación a ciegas son lo más parecido a una métrica objetiva de calidad visual: evaluadores humanos eligen el mejor resultado sin saber qué modelo lo ha generado.

A fecha de agosto de 2026, GPT Image 2 ocupa el número 1 en los tres principales rankings:

RankingGPT Image 2GPT Image 1.5Diferencia
Artificial Analysis (13.289 votos)1.340 Elo1.262 Elo78 pts
arena.ai (LMArena)610–631 EloSin clasificación independiente—
llm-stats.com (13.552 votos)661 de puntuación Arena333 de puntuación Arena328 pts

La ventaja de 78 puntos en Artificial Analysis es la mayor diferencia entre el primer y el segundo clasificado que ha registrado este ranking.

La representación de texto es donde más se nota la diferencia. GPT Image 2 maneja texto multilingüe —latino y CJK— con una precisión que Artificial Analysis califica de «casi perfecta». Por eso es la opción predeterminada para logotipos, infografías y cualquier imagen con palabras. GPT Image 1.5 resuelve bien los diseños de texto sencillos, pero pierde caracteres en composiciones densas con varias tipografías.

«GPT-Image-2 ha salido y el modelo es increíblemente bueno renderizando texto y generando todos los pequeños detalles en interfaces de software complejas» — u/Glittering-Neck-2505, r/singularity

El fotorrealismo ha mejorado, aunque con una contrapartida. Usuarios de Reddit han señalado que GPT Image 2 logra un realismo muy impactante a primera vista, pero a veces genera «patrones/texturas repetitivos» en elementos naturales. Un usuario describió las texturas de roca como «texturas generadas proceduralmente en un videojuego». GPT Image 1.5 no presenta este artefacto concreto, aunque su nivel general de detalle es inferior.

Esta es una prueba que hice con GPT Image 2: una cafetería de Tokio con un rótulo de neón que dice «COFFEE», pensada para poner a prueba el renderizado de texto (gpt-image-2, calidad alta, 16:9):

Prueba de GPT Image 2: cafetería de Tokio de noche con ventana cubierta de lluvia y rótulo de neón COFFEE

El texto de neón salió correcto al primer intento, y las gotas de lluvia muestran detalle individual en lugar de una mancha uniforme.

Cuánto cuesta cada modelo GPT de imagen

OpenAI cobra sus modelos de imagen por token, no por imagen. A continuación se muestran las tarifas por token de la página de precios de OpenAI (verificadas en agosto de 2026), junto con estimaciones de coste por imagen.

Tarifas por token (por 1 millón de tokens)

ModeloEntrada de textoEntrada de imagenEntrada de imagen en cachéSalida de imagen
gpt-image-2$5.00$8.00$2.00$30.00
gpt-image-1.5$5.00$8.00$2.00$32.00
gpt-image-1-mini$2.00$2.50$0.25$8.00

Coste estimado por imagen según la calidad

Las estimaciones parten de generación de texto a imagen a 1024×1024, con un prompt de 50–100 palabras. El coste real aumenta según la resolución y la complejidad del prompt.

Calidadgpt-image-2gpt-image-1.5gpt-image-1-mini
Baja~$0.006~$0.009~$0.003
Media~$0.03–0.07~$0.04–0.08~$0.01
Alta~$0.10–0.21~$0.10–0.20~$0.03–0.05

«Low», «medium» y «high» corresponden al parámetro quality de la solicitud de API, por ejemplo, quality="low". Cada ajuste determina el presupuesto de tokens que el modelo dedica a renderizar detalle: el nivel bajo genera menos tokens de salida y, por tanto, cuesta menos.

Gráfico comparativo de precios de los modelos GPT de imagen

Hay un detalle poco intuitivo: los tokens de salida de GPT Image 1.5 cuestan $32/1M, frente a los $30/1M de GPT Image 2. Para prototipado rápido en calidad baja, GPT Image 2 cuesta $0.006 por imagen, menos que los $0.009 de GPT Image 1.5.

gpt-image-1-mini cuesta aproximadamente un tercio. En flujos de gran volumen —por ejemplo, 10.000 previsualizaciones de variantes de producto—, la diferencia entre $0.003 y $0.006 ahorra $30 por lote.

Resolución y posibilidades de edición

GPT Image 2 admite cualquier resolución mediante el parámetro size, siempre que cumpla estas condiciones de la documentación de OpenAI:

  • Lado máximo < 3.840 px
  • Ambos lados deben ser múltiplos de 16
  • Relación de aspecto ≤ 3:1
  • Total de píxeles entre 655.360 y 8.294.400

Objetivos habituales: 1024×1024 (cuadrado), 2560×1440 (2K fiable), 3824×2144 (casi 4K experimental). OpenAI advierte de que los resultados por encima de 2K son «más variables».

GPT Image 1.5 está limitado a cuatro tamaños fijos: 1024×1024, 1024×1536, 1536×1024 o auto. No admite resoluciones personalizadas.

En edición, GPT Image 2 lidera el ranking de edición de imágenes de Artificial Analysis con 1.255 Elo, por delante de Nano Banana Pro de Google, con 1.247. El parámetro input_fidelity de GPT Image 1.5 permite controlar de forma explícita la preservación de la imagen original durante las ediciones; GPT Image 2 no admite este parámetro porque, según OpenAI, «la salida ya tiene alta fidelidad de forma predeterminada».

Funcióngpt-image-2gpt-image-1.5gpt-image-1-mini
Resolución máxima~4K (experimental)1536×1024 (fija)1536×1024 (fija)
Relaciones de aspecto personalizadasSíNo (4 preajustes + auto)No (4 preajustes + auto)
Paso de razonamientoSíNoNo
input_fidelityDesactivado (siempre alto)Bajo / AltoBajo / Alto
Elo en el ranking de edición1.255 (#1)Sin clasificación independienteSin clasificación

Qué modelo GPT elegir para cada tarea

Marketing y creatividad publicitaria

Usa GPT Image 2 en calidad media o alta. Su paso de razonamiento produce composiciones y textos más precisos a partir de prompts redactados como un briefing creativo. La guía de OpenAI recomienda escribir para este modelo prompts «como un briefing creativo, en lugar de una especificación técnica de imagen puramente técnica».

Mockups de producto y comercio electrónico

GPT Image 2 para imágenes principales; gpt-image-1-mini para previsualizar variantes. Utiliza GPT Image 2 en calidad alta para la imagen principal de producto —su resolución flexible se adapta a las dimensiones exactas de la tienda— y gpt-image-1-mini para variantes de color, ángulo o fondo a $0.003 cada una. Una línea de 50 SKU con 5 variantes por SKU cuesta aproximadamente $0.75 en total con mini en calidad baja.

Infografías e imágenes con mucho texto

GPT Image 2. Según Artificial Analysis, ofrece una representación de texto casi perfecta en escrituras latinas y CJK. GPT Image 1.5 maneja texto sencillo, pero pierde caracteres en diseños densos con varias fuentes. Elige calidad media o alta: la legibilidad del texto cae en calidad baja con todos los modelos.

Generación por lotes a gran escala

gpt-image-1-mini en calidad baja. A $0.003 por imagen, 100.000 imágenes cuestan $300. GPT Image 2 en nivel bajo ($0.006) es una alternativa razonable cuando la calidad importa más que el rendimiento. GPT Image 1.5 no ofrece ninguna ventaja de coste aquí: sus tokens de salida cuestan $2/1M más que los de GPT Image 2.

Flujos de edición iterativa

GPT Image 2 para edición general; GPT Image 1.5 si necesitas controlar input_fidelity. GPT Image 2 lidera el ranking de edición, pero el ajuste de fidelidad de GPT Image 1.5 permite alternar entre «conservarlo todo» y «reinterpretar con libertad». Si tu flujo depende de ese control, GPT Image 1.5 cuenta con una ventaja estructural.

Preguntas frecuentes

¿GPT Image 2 siempre es mejor que GPT Image 1.5?

No en todos los flujos. GPT Image 1.5 ofrece control de input_fidelity para edición, y su salida evita los artefactos de texturas repetitivas que algunos usuarios han reportado en GPT Image 2 para escenas naturales, como rocas, vegetación o pelo. Cuando necesitas preservar estrictamente la imagen original, GPT Image 1.5 puede ser mejor. Para renderizado de texto, seguimiento del prompt y fotorrealismo, gana GPT Image 2.

¿Sigue teniendo sentido usar GPT-4o para generar imágenes?

No, salvo que necesites la interfaz de consumo de ChatGPT y no tengas acceso a la API. OpenAI clasifica GPT Image 1 —el modelo detrás de GPT-4o— como «solo para compatibilidad heredada» y recomienda migrar a GPT Image 2.

¿Puedo usar GPT Image 2 gratis?

La generación limitada de imágenes está disponible en el plan gratuito de ChatGPT y en el plan Go de $8/mes. Para acceder a la API, las cuentas nuevas de OpenAI reciben $5 en créditos gratuitos, suficientes para aproximadamente 25–800 imágenes según el ajuste de calidad.

¿Para qué sirve gpt-image-1-mini?

Para trabajo de gran volumen y sensible al coste: ideación rápida, variantes para pruebas A/B, recursos de marcador de posición, previsualizaciones de miniaturas y personalización por lotes. A ~$0.003 por imagen en calidad baja, es aproximadamente 10× más barato que GPT Image 2 en calidad media. Evítalo para imágenes con mucho texto o recursos de cara al cliente, donde una buena calidad al primer intento reduce los ciclos de revisión.