FLUX 3 Image ya se puede utilizar mediante un modelo de Black Forest Labs alojado en Replicate y varios endpoints de partners. Ofrece salida 4K y edición con hasta 10 imágenes de referencia. La documentación nativa de BFL sigue centrada en FLUX 3 Video, mientras que los proveedores de imágenes aplican esquemas, límites y sistemas de facturación distintos.
¿Está realmente disponible la API de imágenes FLUX 3?
La API de imágenes FLUX 3 está disponible, aunque conviene precisar qué entendemos por «oficial». La prueba más sólida es el listado activo black-forest-labs/flux-3-image, propiedad de Black Forest Labs en Replicate. Acepta solicitudes de generación, pasa al modo de edición cuando se proporciona una imagen y ofrece 4k como opción de resolución.
| Superficie comprobada el 2 de octubre de 2026 | Qué está disponible | Qué demuestra |
|---|---|---|
| BFL en Replicate | black-forest-labs/flux-3-image | Modelo propiedad de BFL; generación desde texto, edición, 4K y hasta 10 referencias |
| Endpoint de fal para partners | blackforestlabs/flux-3/edit-image | Endpoint comercial de edición, entre 1 y 10 referencias, API en cola y facturación según la resolución |
| Documentación de Layer API | bfl-flux-3-image | Generación y edición en 1K, 2K y 4K mediante una API de workspace asíncrona |
| Documentación de la API nativa de BFL | FLUX 3 Video documentado | No aparecía ninguna ruta nativa equivalente para FLUX 3 Image al realizar la comprobación |
flux3api.com y wrappers de la comunidad | Servicios independientes de terceros | Un nombre coincidente no demuestra que el servicio sea propiedad de BFL ni que ofrezca acceso actual a FLUX 3 Image |
El artículo de ayuda de BFL sobre FLUX 3 solo describe el modelo de vídeo; el listado independiente de Replicate, propiedad de BFL, y los endpoints de partners confirman la disponibilidad de la edición de imágenes.
Antes de que apareciera el endpoint, el usuario de Reddit u/rerri ya anticipaba un lanzamiento centrado en la API:
«I wouldn't be surprised if the API-only Flux 3 Image launches first.» — u/rerri en r/StableDiffusion
El despliegue encaja con esa predicción, pero tener acceso a la API no significa que los pesos abiertos estén disponibles.
Qué implican en la práctica la edición 4K y las referencias múltiples
FLUX 3 Image ofrece una opción de salida 4k y admite hasta 10 imágenes de referencia. Ninguno de esos parámetros garantiza que el resultado conserve perfectamente cada identidad, detalle del producto o línea pequeña de texto. Las páginas de los proveedores muestran controles y ejemplos, pero no puntuaciones de calidad independientes.
El README de Replicate, propiedad de BFL, enumera 768sq, 1k, 1.5k, 2k y 4k. Los archivos de referencia pueden estar en JPEG, PNG, GIF o WebP, deben medir al menos 256 por 256 píxeles y no superar los 16 megapíxeles. Con aspect_ratio: auto, la primera referencia determina la relación de aspecto de la edición.
El esquema de edición de fal es parecido, aunque no idéntico. Acepta entre 1 y 10 URL o data URI, limita cada entrada a 4 megapíxeles, admite desde 512sq hasta 4k y avisa de que una operación en 4K puede tardar varios minutos. El orden de las referencias tiene significado: «imagen 1» corresponde al primer elemento de image_urls.
| Control | Replicate | fal | Consecuencia en producción |
|---|---|---|---|
| Máximo de referencias | 10 | 10 | Indica explícitamente el número de cada entrada en el prompt |
| Tamaño máximo de entrada | 16 MP | 4 MP por imagen | Valida los archivos antes de enviarlos a un proveedor |
| Opciones de salida | 768sq, 1K, 1.5K, 2K, 4K | 512sq, 768sq, 1K, 2K, 4K | No compartas un único enum sin validar entre proveedores |
| Relación automática | La primera referencia guía la relación | La primera referencia guía la relación | Coloca primero la referencia que define el encuadre |
| Formatos de salida | WebP, JPG, PNG | JPEG, PNG | Normaliza el tratamiento de archivos en los pasos posteriores |
| Latencia declarada en 4K | No se ha publicado una latencia medida | Puede tardar varios minutos | Mantén el 4K fuera de los flujos de previsualización interactiva |
En las ediciones con varias referencias, asigna una función concreta a cada entrada: composición base, identidad del sujeto, producto o estilo. La propia documentación de fal recomienda hacer una edición por solicitud. Un prompt como «Usa la imagen 1 como base; sustituye únicamente la botella por el producto de la imagen 2; conserva el ángulo de cámara, las manos, la iluminación y el fondo» resulta mucho más fácil de revisar que otro que cambie a la vez la ropa, la tipografía y la ubicación.
Un flujo práctico con una API en cola
En producción, la API de imágenes FLUX 3 debería tratar la generación como un trabajo asíncrono. La aplicación sube URL estables, envía una solicitud concreta, guarda el ID de la petición, consulta el estado aplicando esperas progresivas y copia el resultado final a su propio almacenamiento.
El ejemplo siguiente utiliza el identificador del endpoint y los campos documentados por fal. Es una plantilla de integración, no una afirmación de que la solicitud se ejecutara durante esta revisión.
import os
import time
import requests
ENDPOINT = "https://queue.fal.run/blackforestlabs/flux-3/edit-image"
headers = {
"Authorization": f"Key {os.environ['FAL_KEY']}",
"Content-Type": "application/json",
}
payload = {
"prompt": (
"Use image 1 as the base. Replace only its package with the product "
"from image 2. Preserve the hands, camera angle, shadows, and background."
),
"image_urls": [
"https://cdn.example.com/base.jpg",
"https://cdn.example.com/product.png",
],
"resolution": "1k",
"aspect_ratio": "auto",
"output_format": "png",
"safety_tolerance": 2,
}
submitted = requests.post(ENDPOINT, headers=headers, json=payload, timeout=30)
submitted.raise_for_status()
job = submitted.json()
status_url = job["status_url"]
response_url = job["response_url"]
while True:
status = requests.get(status_url, headers=headers, timeout=30)
status.raise_for_status()
state = status.json().get("status")
if state == "COMPLETED":
break
if state in {"FAILED", "CANCELLED"}:
raise RuntimeError(status.text)
time.sleep(2)
result = requests.get(response_url, headers=headers, timeout=30)
result.raise_for_status()
print(result.json())
La documentación de la cola de fal enlazada desde la página del modelo también ofrece sync_mode, pero la ejecución en cola es el valor predeterminado más seguro para 4K, ya que una renderización puede superar el tiempo de espera habitual de una solicitud HTTP. Layer hace explícito este contrato asíncrono: el envío devuelve HTTP 202, un inference_id y un intervalo de consulta recomendado. También admite claves de idempotencia reutilizables durante 24 horas, lo que ayuda a evitar cargos duplicados después de reintentos de red.
Antes de activar tráfico real:
- Rechaza imágenes de menos de 256 píxeles por lado y aplica el límite de megapíxeles del proveedor elegido.
- Conserva el orden del array y genera prompts que se refieran a
image 1,image 2, etc. - Utiliza una clave de idempotencia única cuando el proveedor la admita; si no, persiste la solicitud antes de reintentarlo.
- Establece un tiempo máximo de consulta y muestra un estado pendiente en lugar de mantener abierta la solicitud de la aplicación.
- Copia los archivos terminados a un almacenamiento bajo tu control, ya que las URL alojadas pueden no ajustarse a la política de retención de la aplicación.
- Registra el ID del modelo, el proveedor, la resolución, el número de referencias, el coste indicado, el tiempo transcurrido y el resultado de moderación de cada trabajo.
El equilibrio real entre coste y calidad
La comparación de costes debe ser prudente porque los proveedores no habían publicado una tabla completa por resolución en las páginas consultadas. fal anunciaba un precio promocional de 0,024 $ por imagen en 1K, que subía a 0,048 $ después de la promoción; también indicaba que el número de referencias no modifica el cargo. La página del modelo no mostraba los precios exactos de 2K y 4K, así que no es posible calcular un presupuesto de 4K a partir de la cifra de 1K.
En lugar de asumir que 4K siempre es la mejor opción, utiliza una política en dos fases:
| Fase | Resolución | Objetivo | Regla de promoción |
|---|---|---|---|
| Validación del prompt y las referencias | 1K | Comprobar composición, identidad, forma del producto y texto | Rechazar o revisar antes de generar la salida más cara |
| Recurso final | 2K o 4K | Producir el entregable aprobado | Subir de resolución solo cuando el canal de destino necesite esos píxeles |
Una resolución mayor aporta píxeles, no una edición más fiel: un mal resultado en 1K se convierte en un fallo más grande en 4K. Reserva el 4K para ediciones aprobadas destinadas a impresión, composiciones para vallas publicitarias o recortes agresivos.
Al iniciar la aplicación, envía un trabajo de prueba mínimo y válido o consulta la información de precios del proveedor. Registra el importe indicado y desactiva el 4K si no hay una cotización o si supera el presupuesto del trabajo. La respuesta inicial de Layer puede incluir estimated_price_creative_units; su página pública del modelo no ofrecía una conversión a dólares. La página recuperada de Replicate documentaba las entradas, pero no un precio fijo. Son aspectos de contratación que debes resolver en el panel de la cuenta antes del lanzamiento, no cifras que convenga adivinar en el código.
Elige el endpoint que mejor encaje con tu operación
La elección del proveedor debe responder al contrato que necesita tu aplicación. Que el modelo sea el mismo no convierte automáticamente sus esquemas en intercambiables.
- Replicate: elige el listado propiedad de BFL si la procedencia es prioritaria y tu stack ya utiliza el flujo de predicciones de Replicate. Aquí documenta el límite de entrada más amplio, 16 MP, e incluye grounding opcional con web e imágenes.
- fal: elige el endpoint de edición del partner si valoras unos controles claros para editar imágenes, un flujo en cola y un precio visible para 1K. Su límite de entrada de 4 MP obliga a reducir el tamaño antes.
- Layer: elígelo si necesitas organizar workspaces, un contrato HTTP
202formal, indicaciones de consulta e idempotencia durante 24 horas. Confirma cómo se convierten las Creative Units en dólares antes de fijar un presupuesto.
No identifiques un proveedor solo porque incluya «FLUX3» en el dominio o en el nombre del repositorio. Verifica el ID del modelo, la etiqueta de propietario o partner, los valores actuales de los enums, las condiciones comerciales y una solicitud real de bajo coste. El wrapper Anil-matcha/Flux-3-Dev-API, que aparecía entre los primeros resultados, seguía marcando sus rutas de imagen como «coming soon» al realizar la comprobación, mientras que las rutas de Replicate propiedad de BFL y de fal como partner estaban activas.
Lista de comprobación antes de pasar a producción
FLUX 3 Image ya es apto para pruebas controladas mediante API, incluido el uso de 4K y hasta 10 referencias. Antes de publicarlo, comprueba que el endpoint elegido supera el mismo conjunto representativo de ediciones tanto en 1K como en la resolución final.
| Comprobación | Condición de aprobación |
|---|---|
| Procedencia | ID exacto de un modelo propiedad de BFL o de un partner verificado |
| Disponibilidad | Una solicitud real de bajo coste se completa; no basta con que la ruta esté documentada |
| Comportamiento de las referencias | El orden de entrada y las funciones asignadas se mantienen en casos representativos de 2, 5 y 10 imágenes |
| Calidad | La identidad, la geometría del producto, el texto y las zonas intactas cumplen los umbrales de revisión definidos |
| Coste | El proveedor devuelve o muestra un precio aceptable para cada resolución habilitada |
| Latencia | Los tiempos medidos de cola y renderización encajan con los objetivos de los servicios de previsualización y procesamiento por lotes |
| Fiabilidad | Los reintentos no generan trabajos ni cargos duplicados que queden sin registrar |
| Almacenamiento | Las salidas se copian antes de que caduquen las URL del proveedor o cambien sus políticas |
La recomendación práctica es empezar con edición en 1K, registrar los datos de coste y latencia, y habilitar 2K o 4K solo para los resultados finales aprobados. Así puedes aprovechar las capacidades más destacadas y documentadas del modelo sin asumir de antemano nada sobre la calidad o el coste de las salidas de alta resolución.