
أصدرت Black Forest Labs نموذج FLUX 3 يوم الخميس، ولأول مرة، يقوم النموذج الرائد للشركة بتوليد الفيديو بدلاً من مجرد الصور الثابتة. قام مختبر الذكاء الاصطناعي الألماني، المعروف بسلسلة FLUX من مولدات الصور، بتدريب النظام الجديد على الصور والفيديو والصوت في آن واحد، داخل نظام مشترك واحد.
هذا ما يُعرف بالنمطية المتعددة (multimodality): نموذج واحد يتعلم عدة أنواع من المعلومات معًا بدلاً من أدوات منفصلة مثبتة جنبًا إلى جنب.
يُعد جانب الفيديو الميزة الرئيسية. ينتج FLUX 3 مقاطع تصل مدتها إلى 20 ثانية، مع صوت يتم توليده جنبًا إلى جنب مع الصورة ومتزامنًا مع ما يحدث على الشاشة—حوار، مؤثرات صوتية، ضوضاء محيطة. في التقييمات المبكرة، فضل المراجعون البشريون مخرجات FLUX 3 على Runway Gen-4.5 في 77% من المقارنات المباشرة وعلى Luma Ray 3.2 في 93%. ويبدو أنه أفضل قليلاً من Gemini Omni و Seedance، متفوقًا على هذه النماذج في 52% من التقييمات.
بالطبع، هذا اختبار تفضيلي، وليس معيار تقييم ثابتًا: يقوم المقيمون ببساطة بمشاهدة مقطعين ويختارون المقطع الذي يبدو ويبدو أكثر إقناعًا، وتحصي BFL عدد المرات التي يفوز فيها FLUX 3.
وبخلاف ذلك، يبدو النموذج كفؤًا للغاية في الصور الثابتة أيضًا، مواصلًا إرثه. شاركت BFL بعض الصور، ويبدو أن FLUX 3 متعدد الاستخدامات للغاية وقادر على توليد مجموعة واسعة من الأنماط تتجاوز الواقعية الفوتوغرافية.
تعتبر BFL هذا أكثر من مجرد أداة محتوى. صرح المؤسس المشارك والرئيس التنفيذي روبن رومباخ: "النموذج الذي يتعلم الصور فقط يمكنه فقط توليد الصور". رهان الشركة هو أن تعلم توقع الفيديو يعني أيضًا تعلم الفيزياء الكامنة وراءه—الوزن، والتلامس، والتوقيت—وهو بالضبط ما تحتاجه الآلة للتحرك في العالم المادي.
هذا الرهان له اسم: FLUX-mimic. تم بناؤه بالتعاون مع شركة mimic robotics ومقرها زيورخ، وهو يأخذ محرك توقع الفيديو الخاص بـ FLUX 3 ويضيف "مُفكك تشفير" خفيف الوزن — مكون إضافي صغير يترجم الإحساس الداخلي للنموذج بكيفية تحرك الأشياء إلى حركات روبوتية فعلية. تقوم شركة تصنيع السيارات أودي بالفعل باختباره في مهام مثل تركيب موانع التسرب المرنة للأبواب، وهو عمل واجهت فيه الأتمتة التقليدية صعوبة في التعامل معه.
صرح ستيفان-دانييل جرافيرت، المؤسس المشارك لـ mimic: "تمثل أودي نوع الشريك الصناعي الذي بنينا FLUX-mimic من أجله". وقال كريستوف شنايدر من أودي إن الروبوتات الآن "تحل أعمال التلاعب بالأجسام اللينة المعقدة" التي لم تتمكن الآلات القديمة من لمسها. وتقول BFL إن النظام الكامل يتفاعل في حوالي 101 ميلي ثانية، وهو قريب من ردود الفعل البصرية البشرية.
لم يحدث صعود FLUX من فراغ. تأسست Black Forest Labs في أغسطس 2024 على يد باحثين مخضرمين ساعدوا في بناء نماذج Stable Diffusion الأصلية في Stability AI، وأطلقت نماذج Flux التي تفوقت على MidJourney وتجاوزت أداء Stable Diffusion 3 المخيب للآمال من Stability.
حصلت نماذج Flux Dev و Schnell مفتوحة المصدر على لقب "أفضل مولد صور مفتوح المصدر" الذي كان فنانو الذكاء الاصطناعي يتوقعون أن تستعيده Stable Diffusion 3.5، وهي النسخة المعدلة من Stability، في نهاية المطاف.
لم يحدث ذلك أبدًا. تصدر FLUX 1.1 Pro بعد ذلك ساحة صور Artificial Analysis في أكتوبر من ذلك العام. لكن هذا النموذج لم يكن مفتوح المصدر.
أصدرت BFL نموذج FLUX.2 في نوفمبر 2025 لكنه لم يكن بنفس شعبية سابقه. استمر تاج المصدر المفتوح الذي كان يحمله Flux الأصلي حتى أطاح به Z-Image Turbo من Alibaba في أواخر عام 2025، حيث تطابقت جودته على بطاقات الرسوميات الاستهلاكية منخفضة التكلفة. كتب أحد مستخدمي CivitAI في ذلك الوقت: "هذا ما كان يُفترض أن يكون عليه SD3".
يمثل FLUX 3 عودة BFL، وهو ليس مفتوح المصدر بالكامل بعد. يتوفر الفيديو والحركة (Action) حاليًا في مرحلة الوصول المبكر عبر واجهات برمجة التطبيقات والشركاء المختارين، ومن بينهم mimic robotics، مع إطلاق توليد الصور "في الأسابيع القادمة"، وفقًا لـ BFL. أما النسخة مفتوحة الوزن "Dev"، وهي الفئة الوحيدة التي تخطط BFL لإطلاقها للاستخدام المحلي، فمن المقرر إصدارها في وقت لاحق من عام 2026.





