BerandaPusat Berita LBank
Black Forest Labs Meluncurkan FLUX 3 AI: Beralih dari Gambar Diam ke Video—Dan Tangan Robot
black-forest-labs-flux-3-image-video-robot-hands
Black Forest Labs Meluncurkan FLUX 3 AI: Beralih dari Gambar Diam ke Video—Dan Tangan Robot
FLUX 3 adalah model video pertama dari laboratorium AI Jerman tersebut, dan sistem yang sama sudah melatih robot untuk bekerja di lini perakitan Audi.
2026-07-23 Sumber:decrypt.co

Secara singkat

  • Black Forest Labs telah meluncurkan FLUX 3 dalam akses awal, model pertamanya yang menghasilkan video, memproduksi klip berdurasi hingga 20 detik dengan audio tersinkronisasi.
  • Fondasi yang sama menggerakkan FLUX-mimic, model robotika yang dibangun dengan robotika mimic yang sudah diuji Audi di lini produksinya.
  • Hanya versi “Dev” dengan bobot terbuka yang direncanakan untuk dirilis akhir 2026; Video dan Aksi saat ini tetap berada di balik API dan akses mitra, dengan Image menyusul dalam beberapa minggu mendatang.

Black Forest Labs merilis FLUX 3 pada hari Kamis, dan untuk pertama kalinya, model unggulan perusahaan ini menghasilkan video, bukan hanya gambar diam. Laboratorium AI Jerman tersebut, yang dikenal dengan lini generator gambar FLUX, melatih sistem baru ini pada gambar, video, dan audio secara bersamaan, di dalam satu sistem bersama.

Itulah yang dikenal sebagai multimodality: satu model mempelajari beberapa jenis informasi secara bersamaan daripada menggunakan alat terpisah yang disambungkan secara berdampingan.

Sisi video adalah fitur utama. FLUX 3 menghasilkan klip berdurasi hingga 20 detik, dengan audio yang dihasilkan bersamaan dengan gambar dan disinkronkan dengan apa yang terjadi di layar—dialog, efek suara, kebisingan sekitar. Dalam evaluasi awal, peninjau manusia lebih menyukai output FLUX 3 dibandingkan Runway Gen-4.5 dalam 77% perbandingan head-to-head dan dibandingkan Luma Ray 3.2 dalam 93%. Tampaknya sedikit lebih baik daripada Gemini Omni dan Seedance, mengalahkan model-model tersebut dalam 52% evaluasi.

Tentu saja, itu adalah tes preferensi, bukan rubrik penilaian tetap: evaluator hanya menonton dua klip dan memilih yang terlihat dan terdengar lebih meyakinkan, dan BFL menghitung seberapa sering FLUX 3 menang.

Selain itu, model ini juga tampaknya sangat kompeten dalam menghasilkan gambar diam, meneruskan warisannya. BFL membagikan beberapa gambar, dan FLUX 3 tampaknya sangat serbaguna serta mampu menghasilkan berbagai gaya yang luas di luar fotorealisme.

BFL menganggap ini lebih dari sekadar alat konten. “Model yang hanya mempelajari gambar hanya dapat menghasilkan gambar,” kata salah satu pendiri dan CEO Robin Rombach. Taruhan perusahaan adalah bahwa belajar memprediksi video juga berarti belajar fisika di baliknya—berat, kontak, waktu—yang persis dibutuhkan mesin untuk bergerak melalui dunia fisik.

Taruhan tersebut memiliki nama: FLUX-mimic. Dibangun bersama mimic robotics yang berbasis di Zurich, FLUX-mimic mengambil mesin prediksi video FLUX 3 dan menambahkan “decoder” ringan—komponen tambahan kecil yang menerjemahkan pemahaman internal model tentang cara benda bergerak menjadi gerakan robot yang sebenarnya. Produsen mobil Audi sudah mengujinya untuk tugas-tugas seperti memasang segel pintu fleksibel, pekerjaan yang sulit ditangani oleh otomatisasi konvensional.

“Audi mewakili jenis mitra manufaktur yang kami bangun FLUX-mimic untuknya,” kata salah satu pendiri mimic, Stephan-Daniel Gravert. Christoph Schneider dari Audi mengatakan robot-robot itu kini “menyelesaikan pekerjaan manipulasi benda lunak yang kompleks” yang tidak dapat disentuh oleh mesin lama. BFL menyatakan sistem lengkap ini bereaksi dalam sekitar 101 milidetik, mendekati refleks visual manusia.

Kebangkitan FLUX tidak terjadi begitu saja. Didirikan pada Agustus 2024 oleh peneliti veteran yang telah membantu membangun model Stable Diffusion asli di Stability AI, Black Forest Labs meluncurkan model Flux yang mengalahkan MidJourney dan melampaui Stable Diffusion 3 milik Stability yang kurang memuaskan.

Model open-source Flux Dev dan Schnell merebut gelar “generator gambar open source terbaik” yang diharapkan seniman AI akan direbut kembali oleh Stable Diffusion 3.5, versi perbaikan dari Stability.

Namun, itu tidak pernah terjadi. FLUX 1.1 Pro kemudian menduduki puncak arena gambar Artificial Analysis pada bulan Oktober itu. Meskipun demikian, model itu bukan open source.

BFL merilis FLUX.2 pada November 2025 tetapi tidak sepopuler itu. Mahkota open-source yang dipegang oleh Flux asli bertahan hingga Z-Image Turbo milik Alibaba menggulingkannya pada akhir 2025, menyamai kualitasnya pada kartu grafis konsumen kelas bawah. “Inilah yang seharusnya menjadi SD3,” tulis seorang pengguna CivitAI saat itu.

FLUX 3 adalah kebangkitan BFL, dan belum sepenuhnya open source. Video dan Aksi kini dalam akses awal melalui API dan mitra tertentu, termasuk mimic robotics, dengan generasi gambar menyusul “dalam beberapa minggu mendatang,” menurut BFL. Versi Dev dengan bobot terbuka, satu-satunya tingkatan yang direncanakan BFL untuk dirilis guna penggunaan lokal, baru akan tersedia akhir 2026.