InicioCentro de noticias de LBank
Black Forest Labs presenta FLUX 3 AI: Abandona las imágenes fijas por el video —Y manos robóticas
black-forest-labs-flux-3-image-video-robot-hands
Black Forest Labs presenta FLUX 3 AI: Abandona las imágenes fijas por el video —Y manos robóticas
FLUX 3 es el primer modelo de video del laboratorio alemán de IA, y el mismo sistema ya está enseñando a robots a trabajar en una línea de montaje de Audi.
2026-07-23 Fuente:decrypt.co

En breve

  • Black Forest Labs ha lanzado FLUX 3 en acceso anticipado, su primer modelo que genera video, produciendo clips de hasta 20 segundos con audio sincronizado.
  • La misma base impulsa a FLUX-mimic, un modelo de robótica construido con mimic robotics que Audi ya está probando en su línea de producción.
  • Solo la versión de "desarrollo" de código abierto ("Dev") está prevista para finales de 2026; Video y Action se mantienen por ahora tras las API y acceso a socios, y la generación de imágenes seguirá en las próximas semanas.

Black Forest Labs lanzó FLUX 3 el jueves y, por primera vez, el modelo insignia de la compañía genera video en lugar de solo imágenes fijas. El laboratorio alemán de IA, conocido por la línea FLUX de generadores de imágenes, entrenó el nuevo sistema con imágenes, video y audio simultáneamente, dentro de un sistema compartido.

Esto es lo que se conoce como multimodalidad: un modelo que aprende varios tipos de información juntos en lugar de herramientas separadas unidas lado a lado.

La parte de video es la característica principal. FLUX 3 produce clips de hasta 20 segundos de duración, con audio generado junto a la imagen y sincronizado con lo que sucede en pantalla: diálogos, efectos de sonido, ruido ambiental. En evaluaciones iniciales, los revisores humanos prefirieron la salida de FLUX 3 sobre Runway Gen-4.5 en el 77% de las comparaciones directas y sobre Luma Ray 3.2 en el 93%. Parece ser ligeramente mejor que Gemini Omni y Seedance, superando a esos modelos en el 52% de las evaluaciones.

Por supuesto, se trata de una prueba de preferencia, no de una rúbrica de puntuación fija: los evaluadores simplemente ven dos clips y eligen el que parece y suena más convincente, y BFL cuenta con qué frecuencia gana FLUX 3.

Aparte de eso, el modelo también parece ser muy competente en imágenes fijas, siguiendo su legado. BFL compartió algunas imágenes, y FLUX 3 parece ser muy versátil y capaz de generar una amplia variedad de estilos más allá del fotorrealismo.

BFL lo enmarca como algo más que una herramienta de contenido. "Un modelo que solo aprende imágenes solo puede generar imágenes", dijo el cofundador y CEO Robin Rombach. La apuesta de la compañía es que aprender a predecir videos también significa aprender la física subyacente (peso, contacto, tiempo), que es exactamente lo que una máquina necesita para moverse en el mundo físico.

Esa apuesta tiene un nombre: FLUX-mimic. Construido con la empresa de robótica mimic robotics, con sede en Zúrich, toma el motor de predicción de video de FLUX 3 y le añade un "decodificador" ligero, un pequeño componente adicional que traduce el sentido interno del modelo de cómo se mueven las cosas en movimientos reales de robot. El fabricante de automóviles Audi ya lo está probando en tareas como el montaje de sellos de puertas flexibles, un trabajo que la automatización convencional ha tenido dificultades para manejar.

“Audi representa el tipo de socio de fabricación para el que construimos FLUX-mimic”, dijo Stephan-Daniel Gravert, cofundador de mimic. Christoph Schneider de Audi afirmó que los robots ahora “resuelven trabajos complejos de manipulación de cuerpos blandos” que las máquinas más antiguas no podían abordar. BFL dice que el sistema completo reacciona en unos 101 milisegundos, en el rango de los reflejos visuales humanos.

El ascenso de FLUX no ocurrió de la nada. Fundada en agosto de 2024 por investigadores veteranos que habían ayudado a construir los modelos originales de Stable Diffusion en Stability AI, Black Forest Labs lanzó modelos Flux que superaron a MidJourney y eclipsaron la decepcionante Stable Diffusion 3 de Stability.

Los modelos de código abierto Flux Dev y Schnell se hicieron con el título de "mejor generador de imágenes de código abierto" que los artistas de IA esperaban que Stable Diffusion 3.5, el relanzamiento de Stability, recuperara eventualmente.

Nunca lo hizo. FLUX 1.1 Pro llegó a la cima del arena de imágenes de Artificial Analysis ese octubre. Sin embargo, ese no era de código abierto.

BFL lanzó FLUX.2 en noviembre de 2025, pero no fue tan popular. La corona de código abierto que ostentaba el Flux original duró hasta que el Z-Image Turbo de Alibaba lo destronó a finales de 2025, igualando su calidad en tarjetas gráficas de consumo de gama baja. "Esto es lo que se suponía que debía ser SD3", escribió un usuario de CivitAI en ese momento.

FLUX 3 es el regreso de BFL, y aún no está completamente abierto. Video y Action están en acceso anticipado a través de API y socios seleccionados, entre ellos mimic robotics, y la generación de imágenes seguirá "en las próximas semanas", según BFL. La versión Dev de código abierto, el único nivel que BFL planea lanzar para uso local, no está prevista hasta finales de 2026.