AIREITER

API de imágenes FLUX 3: guía de 4K y referencias múltiples

Última actualización: 2026-10-02 00:29:39

FLUX 3 Image ya se puede utilizar mediante un modelo de Black Forest Labs alojado en Replicate y varios endpoints de partners. Ofrece salida 4K y edición con hasta 10 imágenes de referencia. La documentación nativa de BFL sigue centrada en FLUX 3 Video, mientras que los proveedores de imágenes aplican esquemas, límites y sistemas de facturación distintos.

¿Está realmente disponible la API de imágenes FLUX 3?

La API de imágenes FLUX 3 está disponible, aunque conviene precisar qué entendemos por «oficial». La prueba más sólida es el listado activo black-forest-labs/flux-3-image, propiedad de Black Forest Labs en Replicate. Acepta solicitudes de generación, pasa al modo de edición cuando se proporciona una imagen y ofrece 4k como opción de resolución.

Superficie comprobada el 2 de octubre de 2026Qué está disponibleQué demuestra
BFL en Replicateblack-forest-labs/flux-3-imageModelo propiedad de BFL; generación desde texto, edición, 4K y hasta 10 referencias
Endpoint de fal para partnersblackforestlabs/flux-3/edit-imageEndpoint comercial de edición, entre 1 y 10 referencias, API en cola y facturación según la resolución
Documentación de Layer APIbfl-flux-3-imageGeneración y edición en 1K, 2K y 4K mediante una API de workspace asíncrona
Documentación de la API nativa de BFLFLUX 3 Video documentadoNo aparecía ninguna ruta nativa equivalente para FLUX 3 Image al realizar la comprobación
flux3api.com y wrappers de la comunidadServicios independientes de tercerosUn nombre coincidente no demuestra que el servicio sea propiedad de BFL ni que ofrezca acceso actual a FLUX 3 Image
Página del modelo FLUX 3 Image de Black Forest Labs en Replicate

El artículo de ayuda de BFL sobre FLUX 3 solo describe el modelo de vídeo; el listado independiente de Replicate, propiedad de BFL, y los endpoints de partners confirman la disponibilidad de la edición de imágenes.

Antes de que apareciera el endpoint, el usuario de Reddit u/rerri ya anticipaba un lanzamiento centrado en la API:

«I wouldn't be surprised if the API-only Flux 3 Image launches first.» — u/rerri en r/StableDiffusion

El despliegue encaja con esa predicción, pero tener acceso a la API no significa que los pesos abiertos estén disponibles.

Qué implican en la práctica la edición 4K y las referencias múltiples

FLUX 3 Image ofrece una opción de salida 4k y admite hasta 10 imágenes de referencia. Ninguno de esos parámetros garantiza que el resultado conserve perfectamente cada identidad, detalle del producto o línea pequeña de texto. Las páginas de los proveedores muestran controles y ejemplos, pero no puntuaciones de calidad independientes.

El README de Replicate, propiedad de BFL, enumera 768sq, 1k, 1.5k, 2k y 4k. Los archivos de referencia pueden estar en JPEG, PNG, GIF o WebP, deben medir al menos 256 por 256 píxeles y no superar los 16 megapíxeles. Con aspect_ratio: auto, la primera referencia determina la relación de aspecto de la edición.

El esquema de edición de fal es parecido, aunque no idéntico. Acepta entre 1 y 10 URL o data URI, limita cada entrada a 4 megapíxeles, admite desde 512sq hasta 4k y avisa de que una operación en 4K puede tardar varios minutos. El orden de las referencias tiene significado: «imagen 1» corresponde al primer elemento de image_urls.

ControlReplicatefalConsecuencia en producción
Máximo de referencias1010Indica explícitamente el número de cada entrada en el prompt
Tamaño máximo de entrada16 MP4 MP por imagenValida los archivos antes de enviarlos a un proveedor
Opciones de salida768sq, 1K, 1.5K, 2K, 4K512sq, 768sq, 1K, 2K, 4KNo compartas un único enum sin validar entre proveedores
Relación automáticaLa primera referencia guía la relaciónLa primera referencia guía la relaciónColoca primero la referencia que define el encuadre
Formatos de salidaWebP, JPG, PNGJPEG, PNGNormaliza el tratamiento de archivos en los pasos posteriores
Latencia declarada en 4KNo se ha publicado una latencia medidaPuede tardar varios minutosMantén el 4K fuera de los flujos de previsualización interactiva

En las ediciones con varias referencias, asigna una función concreta a cada entrada: composición base, identidad del sujeto, producto o estilo. La propia documentación de fal recomienda hacer una edición por solicitud. Un prompt como «Usa la imagen 1 como base; sustituye únicamente la botella por el producto de la imagen 2; conserva el ángulo de cámara, las manos, la iluminación y el fondo» resulta mucho más fácil de revisar que otro que cambie a la vez la ropa, la tipografía y la ubicación.

Un flujo práctico con una API en cola

En producción, la API de imágenes FLUX 3 debería tratar la generación como un trabajo asíncrono. La aplicación sube URL estables, envía una solicitud concreta, guarda el ID de la petición, consulta el estado aplicando esperas progresivas y copia el resultado final a su propio almacenamiento.

El ejemplo siguiente utiliza el identificador del endpoint y los campos documentados por fal. Es una plantilla de integración, no una afirmación de que la solicitud se ejecutara durante esta revisión.

import os
import time
import requests

ENDPOINT = "https://queue.fal.run/blackforestlabs/flux-3/edit-image"
headers = {
    "Authorization": f"Key {os.environ['FAL_KEY']}",
    "Content-Type": "application/json",
}
payload = {
    "prompt": (
        "Use image 1 as the base. Replace only its package with the product "
        "from image 2. Preserve the hands, camera angle, shadows, and background."
    ),
    "image_urls": [
        "https://cdn.example.com/base.jpg",
        "https://cdn.example.com/product.png",
    ],
    "resolution": "1k",
    "aspect_ratio": "auto",
    "output_format": "png",
    "safety_tolerance": 2,
}

submitted = requests.post(ENDPOINT, headers=headers, json=payload, timeout=30)
submitted.raise_for_status()
job = submitted.json()

status_url = job["status_url"]
response_url = job["response_url"]
while True:
    status = requests.get(status_url, headers=headers, timeout=30)
    status.raise_for_status()
    state = status.json().get("status")
    if state == "COMPLETED":
        break
    if state in {"FAILED", "CANCELLED"}:
        raise RuntimeError(status.text)
    time.sleep(2)

result = requests.get(response_url, headers=headers, timeout=30)
result.raise_for_status()
print(result.json())

La documentación de la cola de fal enlazada desde la página del modelo también ofrece sync_mode, pero la ejecución en cola es el valor predeterminado más seguro para 4K, ya que una renderización puede superar el tiempo de espera habitual de una solicitud HTTP. Layer hace explícito este contrato asíncrono: el envío devuelve HTTP 202, un inference_id y un intervalo de consulta recomendado. También admite claves de idempotencia reutilizables durante 24 horas, lo que ayuda a evitar cargos duplicados después de reintentos de red.

Antes de activar tráfico real:

  1. Rechaza imágenes de menos de 256 píxeles por lado y aplica el límite de megapíxeles del proveedor elegido.
  2. Conserva el orden del array y genera prompts que se refieran a image 1, image 2, etc.
  3. Utiliza una clave de idempotencia única cuando el proveedor la admita; si no, persiste la solicitud antes de reintentarlo.
  4. Establece un tiempo máximo de consulta y muestra un estado pendiente en lugar de mantener abierta la solicitud de la aplicación.
  5. Copia los archivos terminados a un almacenamiento bajo tu control, ya que las URL alojadas pueden no ajustarse a la política de retención de la aplicación.
  6. Registra el ID del modelo, el proveedor, la resolución, el número de referencias, el coste indicado, el tiempo transcurrido y el resultado de moderación de cada trabajo.

El equilibrio real entre coste y calidad

La comparación de costes debe ser prudente porque los proveedores no habían publicado una tabla completa por resolución en las páginas consultadas. fal anunciaba un precio promocional de 0,024 $ por imagen en 1K, que subía a 0,048 $ después de la promoción; también indicaba que el número de referencias no modifica el cargo. La página del modelo no mostraba los precios exactos de 2K y 4K, así que no es posible calcular un presupuesto de 4K a partir de la cifra de 1K.

Página del modelo FLUX 3 Image Edit API en fal

En lugar de asumir que 4K siempre es la mejor opción, utiliza una política en dos fases:

FaseResoluciónObjetivoRegla de promoción
Validación del prompt y las referencias1KComprobar composición, identidad, forma del producto y textoRechazar o revisar antes de generar la salida más cara
Recurso final2K o 4KProducir el entregable aprobadoSubir de resolución solo cuando el canal de destino necesite esos píxeles

Una resolución mayor aporta píxeles, no una edición más fiel: un mal resultado en 1K se convierte en un fallo más grande en 4K. Reserva el 4K para ediciones aprobadas destinadas a impresión, composiciones para vallas publicitarias o recortes agresivos.

Al iniciar la aplicación, envía un trabajo de prueba mínimo y válido o consulta la información de precios del proveedor. Registra el importe indicado y desactiva el 4K si no hay una cotización o si supera el presupuesto del trabajo. La respuesta inicial de Layer puede incluir estimated_price_creative_units; su página pública del modelo no ofrecía una conversión a dólares. La página recuperada de Replicate documentaba las entradas, pero no un precio fijo. Son aspectos de contratación que debes resolver en el panel de la cuenta antes del lanzamiento, no cifras que convenga adivinar en el código.

Elige el endpoint que mejor encaje con tu operación

La elección del proveedor debe responder al contrato que necesita tu aplicación. Que el modelo sea el mismo no convierte automáticamente sus esquemas en intercambiables.

  • Replicate: elige el listado propiedad de BFL si la procedencia es prioritaria y tu stack ya utiliza el flujo de predicciones de Replicate. Aquí documenta el límite de entrada más amplio, 16 MP, e incluye grounding opcional con web e imágenes.
  • fal: elige el endpoint de edición del partner si valoras unos controles claros para editar imágenes, un flujo en cola y un precio visible para 1K. Su límite de entrada de 4 MP obliga a reducir el tamaño antes.
  • Layer: elígelo si necesitas organizar workspaces, un contrato HTTP 202 formal, indicaciones de consulta e idempotencia durante 24 horas. Confirma cómo se convierten las Creative Units en dólares antes de fijar un presupuesto.

No identifiques un proveedor solo porque incluya «FLUX3» en el dominio o en el nombre del repositorio. Verifica el ID del modelo, la etiqueta de propietario o partner, los valores actuales de los enums, las condiciones comerciales y una solicitud real de bajo coste. El wrapper Anil-matcha/Flux-3-Dev-API, que aparecía entre los primeros resultados, seguía marcando sus rutas de imagen como «coming soon» al realizar la comprobación, mientras que las rutas de Replicate propiedad de BFL y de fal como partner estaban activas.

Lista de comprobación antes de pasar a producción

FLUX 3 Image ya es apto para pruebas controladas mediante API, incluido el uso de 4K y hasta 10 referencias. Antes de publicarlo, comprueba que el endpoint elegido supera el mismo conjunto representativo de ediciones tanto en 1K como en la resolución final.

ComprobaciónCondición de aprobación
ProcedenciaID exacto de un modelo propiedad de BFL o de un partner verificado
DisponibilidadUna solicitud real de bajo coste se completa; no basta con que la ruta esté documentada
Comportamiento de las referenciasEl orden de entrada y las funciones asignadas se mantienen en casos representativos de 2, 5 y 10 imágenes
CalidadLa identidad, la geometría del producto, el texto y las zonas intactas cumplen los umbrales de revisión definidos
CosteEl proveedor devuelve o muestra un precio aceptable para cada resolución habilitada
LatenciaLos tiempos medidos de cola y renderización encajan con los objetivos de los servicios de previsualización y procesamiento por lotes
FiabilidadLos reintentos no generan trabajos ni cargos duplicados que queden sin registrar
AlmacenamientoLas salidas se copian antes de que caduquen las URL del proveedor o cambien sus políticas

La recomendación práctica es empezar con edición en 1K, registrar los datos de coste y latencia, y habilitar 2K o 4K solo para los resultados finales aprobados. Así puedes aprovechar las capacidades más destacadas y documentadas del modelo sin asumir de antemano nada sobre la calidad o el coste de las salidas de alta resolución.

Lecturas relacionadas