مراجعة FLUX 3: الفيديو والصوت والأسعار وطرق الوصول

مراجعة برنامج Flux-3-Video

إجابة سريعة: FLUX 3 هو النموذج الأساسي متعدد الوسائط من Black Forest Labs المخصص للصور والفيديو والصوت وتوقع الحركات. اعتبارًا من 11 أغسطس 2026، أدرجت BFL نموذج FLUX 3 Video في مرحلة ’الوصول المبكر» (Early Access) مع مقاطع تصل مدتها إلى 20 ثانية، وصوت أصلي اختياري، وأسعار عامة تُحسب بالثانية. كما أن GlobalGPT لديها مسار FLUX 3 Video مُثبت. في الاختبار الذي أجريناه ثلاث مرات، تم إكمال كل مهمة وإرجاع ملف MP4 مدته 5.04 ثانية مع دفق صوتي، لكن التحكم الدقيق في المدة، وتباعد الحروف، واتساق الكائنات لم تكن مثالية.

لا يزال يتعين صياغة هذا الوضع بعناية. إن منشور الإطلاق الرسمي و الصفحة الرسمية للطراز يُصنف «FLUX 3 Video» على أنه في مرحلة «الوصول المبكر»، في حين تنشر صفحة التسعير الخاصة بـ BFL الآن أسعار خدمات الفيديو. ويكشف «GlobalGPT» عن مسار منفصل للمنصة مدعوم بهذا النموذج. ولا يعني الوصول عبر هذا المسار أن كل واجهة برمجة تطبيقات (API) تابعة لـ BFL، أو خيار الأوزان الخاصة، أو نموذج «Image»، أو نموذج «Action»، أو إصدار «FLUX 3 Dev» متاح بشكل عام.

يضيف هذا التحديث فحصًا عمليًّا بسيطًا: ثلاثة أجيال في 11 أغسطس باستخدام بيئة الاختبار flux-3-video معرّف النموذج، بما في ذلك تكرار واحد دقيق للموجه. ويكفي ذلك لتوثيق السلوك الفعلي ونقاط الفشل الظاهرة، لكن ثلاث مخرجات لا تشكل معيارًا شاملاً.

لمحة عامة عن المراجعة

ثلاث عمليات تشغيل لبرنامج FLUX 3 Video من الشركة المصنعة نفسها — ولا يُعد ذلك مقياسًا شاملاً للأداء.

الجولاتالمدة المُرجعةالقرارالصوت
3/3 نجحت5.04 ثانية لكل مقطع1280 × 704البيانات التي تم فك تشفيرها في جميع الملفات

ما هو FLUX 3؟

FLUX 3 هو نموذج أساسي متعدد الوسائط من شركة Black Forest Labs. وعلى عكس الأنظمة التي يتم تدريبها على تحويل النص إلى صور فقط، تقول شركة BFL إن هذا النموذج يتعلم بشكل متكامل من الصور والفيديو والصوت ضمن بنية واحدة. والهدف من ذلك هو بناء تمثيلات تربط بين البنية المكانية والحركة والصوت والسبب والفعل، بدلاً من التعامل مع كل وسيط على أنه سمة منفصلة.

الصفحة الرسمية لـ FLUX 3 التي تعرض الصور والفيديو والصوت وتوقعات الإجراءات
تقدم شركة Black Forest Labs نموذج «FLUX 3» باعتباره نموذجًا متعدد الوسائط يشمل الصور والفيديو والصوت وتوقع الحركات.

قد يبدو الاسم وكأنه مجرد نسخة روتينية تلي FLUX.1 وFLUX.2، لكن نطاقه أوسع بكثير. لا تزال FLUX.2 مجموعة برامج حالية لتوليد الصور وتحريرها؛ أما دليل FLUX 2 Pro ويغطي هذا الجيل سير عمل الصور، وسياق التسعير، والتوجيهات. ويُعتبر FLUX 3 بمثابة العمود الفقري المشترك لإنشاء المحتوى والتنبؤ بالأفعال.

تستخدم BFL مصطلح “نموذج العالم” لوصف هذا الاتجاه. وهنا، لا يعني ذلك أن الشركة قد أعلنت عن ذكاء عام. بل يعني أن النموذج يهدف إلى تعلم كيفية ارتباط الأجسام المرئية والحركة والصوت والإجراءات عبر الزمن. وهذا التمييز مهم لأن الادعاء الأكثر إثارة للاهتمام بشأن FLUX 3 لا يقتصر على مجرد “صور أفضل”؛ بل هو نموذج أساسي واحد يخدم عدة أنواع من التوليد والتحكم.

لماذا يُعد FLUX 3 أكثر من مجرد أداة لتوليد الصور

لا تزال معظم منتجات الذكاء الاصطناعي الإبداعية تُستخدم كأدوات منفصلة: فهناك نموذج يُنتج الصور، وآخر يُنتج الفيديو، وثالث يُضيف الكلام أو المؤثرات الصوتية. أما FLUX 3 فقد صُمم بناءً على فكرة مختلفة. فإذا تعلمت بنية واحدة هذه الأنماط معًا، فمن المحتمل أن تشترك المطالبة والصورة المرجعية وتسلسل الحركة والموسيقى التصويرية في نفس الفهم الداخلي.

  • توفر الصور مساحة: الأشكال، والتكوين، والملمس، والطباعة، والعلاقات البصرية.
  • المدة الإضافية للفيديو: الحركة، والاستمرارية، والتواصل، والعلاقة السببية عبر الإطارات.
  • يضيف الصوت إشارة متزامنة أخرى: الكلام، والأجواء، والأصوات المرتبطة بالأحداث المرئية.
  • يربط التنبؤ بالحركة بين الإدراك والتحكم: يمكن تكييف تمثيل النموذج للتنبؤ بما ينبغي أن يفعله الروبوت بعد ذلك.

بالنسبة للمبدعين، تكمن الميزة العملية في تقليل عدد مراحل التسليم بين مراحل الإنتاج. ويكتسب الصوت الأصلي أهمية خاصة لأنه يمكن أن يقلل الفجوة بين إنتاج المقطع وإنتاج الحوار والمؤثرات الصوتية والمزامنة بشكل منفصل. إذا كان الصوت هو شاغلك الرئيسي، فإن الوضع الحالي Veo 3.1 دليل الصوت يوضح كيف تتعامل إحدى العائلات الرائدة الأخرى في مجال الفيديو مع الصوت الأصلي في الوقت الحالي.

نظرة عامة على إمكانيات FLUX 3

القدرةما أعلنته شركة BFLالحالة في 11 أغسطس 2026
فيديو FLUX 3إنشاء مقاطع الفيديو وتحريرها مع إمكانية إضافة صوت أصلي اختياري، بما في ذلك الكلام والمؤثرات والأنماط والخطوط وسير العمل متعدد اللقطاتالوصول المبكر إلى BFL؛ نشر الأسعار الرسمية؛ مسار GlobalGPT المؤكد
صورة FLUX 3إنشاء الصور وتحريرها من خلال واجهات برمجة التطبيقات (API) والوصول إلى الأوزان الخاصةتم الإعلان عن الإصدار التجريبي المبكر؛ ولم يتم اختباره في هذا المقال
FLUX 3 Actionالتنبؤ بالحركة الأصلية بالإضافة إلى النماذج المتخصصة التي تم إنشاؤها استنادًا إلى البنية الأساسية للفيديوالبدء مع شركاء مختارين
FLUX 3 Devشبكة أساسية متعددة الوسائط ومفتوحة الحجم مخطط لها لتوقع مقاطع الفيديو والصوت والصور والحركاتتم الإعلان عنه؛ لم يتم نشر التاريخ والترخيص

يُعد «FLUX 3 Video» المنتج الأكثر وضوحًا على المدى القريب. وتقول شركة BFL إنه يدعم تحويل النص إلى فيديو والتحرير، والصوت المتزامن، والحوار متعدد اللغات، ونسب العرض إلى الارتفاع المتنوعة، وتصميم الخطوط، والمقاطع المتسلسلة. وتضعه هذه الميزات في سوق يزداد ازدحامًا؛ حيث إن أفضل مقارنة بين برامج إنشاء مقاطع الفيديو باستخدام الذكاء الاصطناعي يقدم معلومات مفيدة حول ما يمكن للمبدعين استخدامه بالفعل في الوقت الذي لا يزال فيه الوصول إلى FLUX 3 محدودًا.

كما يصف المنشور الخاص بالإطلاق مقاطع فيديو مدتها 10 ثوانٍ بدقة 720p تم إنشاؤها من نصوص مصحوبة بصوت، وذلك في إطار تقييماتها الأولية. وتشير BFL صراحةً إلى أن النموذج ومجموعة أدوات التقييم لا تزال قيد التطوير. وهذا يجعل هذه الأرقام مفيدة كدليل أولي أعلنت عنه الشركة، لكنها لا تُعد بديلاً عن الاختبارات المستقلة القابلة للتكرار بعد توسيع نطاق الوصول العام.

وتذهب صفحة النموذج الحالية إلى أبعد من ذلك: فهي تشير إلى أن «FLUX 3 Video» يمكنه إنتاج ما يصل إلى 20 ثانية في عملية واحدة، مع إمكانية إضافة الصوت بشكل اختياري، بالإضافة إلى إنتاج خطابات متعددة اللغات وتأثيرات صوتية وأجواء صوتية مع الإطارات. وهذه هي الحدود الرسمية للقدرات؛ أما الاختبار العملي الوارد أدناه فيسجل ما أرجعته مسار المنصة المتصلة فعليًّا استجابةً لمطالباتنا.

هل أصبح FLUX 3 متاحًا الآن؟

نعم، ولكن فقط من خلال برنامج «الوصول المبكر» على مراحل. قامت BFL بفتح مسار للتقديم بدلاً من إطلاق خدمة ذاتية واسعة النطاق. وبالتالي، يمكن للشركة العمل مع مستخدمين وشركاء مختارين في الوقت الذي لا تزال فيه النماذج وواجهات برمجة التطبيقات (APIs) وخيارات التقييم الخاصة وعملية التقييم قيد التغيير.

خطة الإطلاق الرسمية لـ FLUX 3 لكل من الفيديو والصور و«Action» و«Dev»
تقسم خطة إطلاق BFL إصدارات FLUX 3 Video وImage وAction وDev إلى إصدارات متدرجة في مرحلة الوصول المبكر.
سؤالمعروفلا تزال محدودة أو غير معروفة
هل يمكن للناس التقدم بطلب للالتحاق ببرنامج BFL؟نعم، من خلال نموذج الطلب الرسميمعايير القبول ووقت الاستجابة
هل يمكن للمستخدمين تجربة تطبيق FLUX 3 Video على جهاز GlobalGPT؟نعم؛ الرابط الخاص بمسار المنتجات التي تم التحقق منها موجود أدناهتعتمد حدود المسارات والحصص على حساب المنصة
ما هو السعر المعلن لـ BFL؟معدلات تحويل النص/الصورة إلى فيديو، والمتابعة، والمسودة، وHD، وFHDشروط الاستخدام الخاص وشروط الاستخدام المؤسسي
هل ستكون هناك فئات أوزان مفتوحة؟من المقرر أن تُقام بطولة FLUX 3 Dev في فئة الوزن المفتوحتاريخ الإصدار، والترخيص، ومتطلبات الأجهزة
مسار منتج الفيديو GlobalGPT FLUX 3 الذي يوضح إمكانية تحويل النص إلى فيديو والصورة إلى فيديو
تتضمن مسار المنتج GlobalGPT الذي تم التحقق منه برنامج FLUX 3 Video مع ميزات تحويل النص إلى فيديو، وتحويل الصورة إلى فيديو، وتحديد موضع الصوت الأصلي.

التفسير الأكثر أمانًا بسيط: FLUX 3 موجود بالفعل وعملية طرحه جارية، لكن لا ينبغي إعادة صياغة عبارة “الوصول المبكر” لتصبح “متاح للجميع”. إذا كنت بحاجة إلى موعد نهائي للإنتاج، فانتظر حتى تحصل على تأكيد كتابي بالوصول والشروط قبل تصميم سير العمل بناءً عليه.

فيديو «اختبرنا FLUX 3»: ثلاث تجارب، نتائج حقيقية

3/3المهام المنجزة
5.04 ثانيةكل مقطع تم إرجاعه
1280 × 704كل ملف MP4
الصوت متوفريتم فك تشفيرها في كل ملف

إعداد الاختبار: أجرينا الاختبارات في 11 أغسطس 2026 عبر بيئة اختبار المهام «Broly» المرتبطة بالمنصة، باستخدام معرّف النموذج نفسه flux-3-video. احتوى كل طلب على معرّف النموذج والموجه فقط. وقد أرسلنا ثلاث مهام: موجهًا لإعلان منتج، وموجهًا للاتساق الزمني، وتكرارًا مطابقًا تمامًا للموجه الأول. أبلغت واجهة برمجة تطبيقات المهام (API) عن أوقات معالجة فعلية بلغت 88 و190 و77 ثانية على التوالي. ونظرًا لأن عمليات التشغيل كانت متزامنة وما زال المسار قيد التطوير، فلا ينبغي اعتبار هذه الأوقات معيارًا لقياس زمن الاستجابة.

الاختبار 1: الطباعة، والتحويل، والصوت الأصلي

معرّف المهمة: task_tl5xE4BIOv2ojEb0VOMFnVT56YtvzhZ8. طلبت المهمة إنتاج إعلان عن عطر مدته ثماني ثوانٍ يتألف من لقطتين، مع النص الدقيق المكتوب على الملصق، وتحويل الزجاجة إلى مدينة، وصوت طقطقة الزجاج، وصوت هبوب، وجملة منطوقة واحدة.

PROMPTموضوع الاختبار 1
إنشاء إعلان تجاري سينمائي للمنتج مدته 8 ثوانٍ بنسبة عرض إلى ارتفاع 16:9، يتألف من لقطتين مترابطتين. اللقطة 1: على طاولة استوديو مظلمة، تدور زجاجة عطر شفافة بلون أزرق كوبالت ببطء تحت ضوء كشاف أبيض ضيق؛ ويجب أن تحمل الملصقة الأمامية عبارة 'FLUX 3' بالضبط بحروف بيضاء نظيفة من نوع 'سانس سيريف'، دون أي نص آخر. اللقطة 2: تنفتح الزجاجة لتكشف عن شريط من الضوء الأزرق يتحول إلى أفق مدينة ليلي، بينما تظل الزجاجة نفسها في الوسط ويمكن التعرف عليها. استخدم حركة كاميرا سلسة وعالية الجودة، وانعكاسات زجاجية واقعية، وصوتًا متزامنًا: صوت طقطقة زجاجية خفيفة عند رفع الغطاء، وصوت صفير إلكتروني متصاعد أثناء التحول، وصوت هادئ يقول بالضبط «اجعل اللحظة تتحرك». لا تضف ترجمات أو شعارات أو علامات مائية أو نصوصًا إضافية.

اختر المطالبة يدويًّا إذا كان إعداد ووردبريس الخاص بك يعطل ميزة النسخ التلقائي.

اختبار عملي لـ FLUX 3، الجزء الأول: فيديو إعلان المنتج الذي تم إرجاعه.
خمسة إطارات تم أخذها كعينات من اختبار الطباعة والصوت الخاص بـ FLUX 3
تُظهر خمس لقطات الملصق، ودوران الزجاجة، والانتقال إلى الضوء الأزرق، والكشف عن المدينة.

ما حدث أكمل الناتج القوس البصري المطلوب وحافظ على وضوح مفهوم العطر الأزرق في كلا المشهدين. ظلت العلامة واضحة، لكنها قلصت بصريًّا المساحة المطلوبة وبدت أقرب إلى “FLUX3” منها إلى “FLUX 3” بالضبط. كما تغير شكل غطاء الزجاجة وجسمها أثناء عملية التحويل. احتوى ملف MP4 على بيانات صوتية تم فك تشفيرها، لكن نظام الفحص الآلي الخاص بنا لم يقم بنسخ السطر المنطوق، لذا لن نقوم بتقييم الحوار كلمة بكلمة. والأهم من ذلك، أن مدة المقطع الذي تم إرجاعه كانت 5.04 ثانية بدلاً من الثماني ثوانٍ المطلوبة.

الاختبار 2: الحركة في لقطة واحدة واتساق الكائنات

معرّف المهمة: task_izFhE8RhTeA5Tb1EaESJqbb7sP6wCwoE. أزالت هذه التعليمات تغييرات المشاهد وطلبت من روبوت واحد يعمل بالزنبرك أن يعبر ثلاث علامات بترتيب محدد مع الحفاظ على سماته المميزة.

PROMPTموضوع الاختبار رقم 2
قم بإنشاء لقطة متابعة واحدة متواصلة مدتها 8 ثوانٍ بنسبة عرض إلى ارتفاع 16:9 دون أي قطع. يمشي روبوت أحمر صغير يعمل باللف، له رأس مربع وعينان فضيتان مستديرتان ومفتاح نحاسي واحد على ظهره وحذاء أبيض، من اليسار إلى اليمين عبر ثلاث علامات أرضية بالترتيب التالي بالضبط: الأصفر، ثم الأزرق، ثم الأخضر. تتبع الكاميرا الروبوت على ارتفاع الخصر، بينما يحافظ الروبوت على نفس شكل الجسم والألوان وعدد العيون والمفتاح الموجود على ظهره واتجاه المشي طوال اللقطة بأكملها. أضف أصوات خطوات معدنية متزامنة وصوتًا هادئًا للغرفة. لا يوجد حوار، ولا نص، ولا شخصيات إضافية، ولا قطع للكاميرا، ولا تغيير في الأزياء.

اختر المطالبة يدويًّا إذا كان إعداد ووردبريس الخاص بك يعطل ميزة النسخ التلقائي.

اختبار عملي لـ FLUX 3 (الجزء الثاني): فيديو الروبوت الذي يعمل بمرة واحدة والذي تم إرجاعه.
خمسة إطارات تم أخذها كعينة من اختبار الاتساق الزمني لـ FLUX 3
يتحرك الروبوت من اليسار إلى اليمين عبر الألوان الأصفر والأزرق والأخضر، مع الحفاظ على جسمه الأحمر وعينيه وحذائه الأبيض ومفتاحه الخلفي.

ما حدث كانت هذه هي النتيجة الأكثر دقة. تحرك الروبوت في الاتجاه المطلوب ومرّ عبر العلامات الصفراء والزرقاء والخضراء بالترتيب. وظلت تفاصيله المميزة الرئيسية مرئية طوال اللقطة، دون أي شخصية إضافية أو قطع واضح في تصوير الكاميرا. بدت الحركة بسيطة أكثر منها سينمائية، لكن هذه البساطة سهّلت تقييم مدى الاتساق. استغرقت المخرجات مرة أخرى 5.04 ثوانٍ وتضمنت بيانات صوتية تم فك تشفيرها.

الاختبار 3: تكرار دقيق للموجه الأول

معرّف المهمة: task_JsnPFkB0Yqf55EwaoPU8BShBRkGLJT44. أرسلنا المطالبة الأولى مرة أخرى دون تغيير أي كلمة.

PROMPTإعادة عرض المطالبة
إنشاء إعلان تجاري سينمائي للمنتج مدته 8 ثوانٍ بنسبة عرض إلى ارتفاع 16:9، يتألف من لقطتين مترابطتين. اللقطة 1: على طاولة استوديو مظلمة، تدور زجاجة عطر شفافة بلون أزرق كوبالت ببطء تحت ضوء كشاف أبيض ضيق؛ ويجب أن تحمل الملصقة الأمامية عبارة 'FLUX 3' بالضبط بحروف بيضاء نظيفة من نوع 'سانس سيريف'، دون أي نص آخر. اللقطة 2: تنفتح الزجاجة لتكشف عن شريط من الضوء الأزرق يتحول إلى أفق مدينة ليلي، بينما تظل الزجاجة نفسها في الوسط ويمكن التعرف عليها. استخدم حركة كاميرا سلسة وعالية الجودة، وانعكاسات زجاجية واقعية، وصوتًا متزامنًا: صوت طقطقة زجاجية خفيفة عند رفع الغطاء، وصوت صفير إلكتروني متصاعد أثناء التحول، وصوت هادئ يقول بالضبط «اجعل اللحظة تتحرك». لا تضف ترجمات أو شعارات أو علامات مائية أو نصوصًا إضافية.

اختر المطالبة يدويًّا إذا كان إعداد ووردبريس الخاص بك يعطل ميزة النسخ التلقائي.

خمسة إطارات تم أخذها كعينة من الإعلان المتكرر لمنتج FLUX 3
أدى تكرار المطالبة إلى إنتاج نفس القصة ذات المستوى الرفيع، لكن بتصميم مختلف للزجاجة والغطاء ومسار الكاميرا وكيفية الكشف عن المدينة.

ما حدث وقد حافظت عملية التكرار على المفهوم بدلاً من النتيجة الدقيقة. فقد أظهرت مرة أخرى زجاجة زرقاء، وكتابة واضحة تقول “FLUX3”، وشريطًا من الضوء، وأفقًا ليليًّا، لكن الشكل الهندسي للزجاجة، والغطاء، والإطار، والانتقالات كانت مختلفة. وهذا أمر طبيعي بالنسبة لتوليد عشوائي، لكنه يكتسب أهمية عندما يتوقع فريق العلامة التجارية تفاصيل منتج قابلة للتكرار.

أبعاد الاختبارالنتيجة الملاحظةالنقطة العملية التي يمكن استخلاصها
إنجاز المهمةتم إنجاز 3 مهام من أصل 3كان المسار المتصل قيد التشغيل خلال هذا الاختبار
التحكم في المدةطلبت جميع المطالبات الثلاث 8 ثوانٍ؛ وأظهرت جميعها نتيجة 5.04 ثانيةالتحقق من ضوابط المدة على مستوى المسار قبل بدء التشغيل الفعلي
الطباعةالملصق واضح، لكن التباعد الدقيق بين حروف “FLUX 3” لم يتم الحفاظ عليهوضع خطة لإعادة المحاولة أو مرحلة ما بعد الإنتاج فيما يتعلق بنصوص العلامة التجارية
الاتساق الزمنيحافظ الروبوت البسيط على سماته المميزة وترتيب العلاماتيمكن أن تحقق المطالبات المقيدة ذات المحاولة الواحدة أداءً جيدًا
التكرارنفس القصة، لكن مع اختلاف في تصميم المنتج وخيارات الكاميراالتكرار الدقيق للنص ليس تكرارًا بصريًّا دقيقًا
الصوتتضمنت كل ملفات MP4 بيانات صوتية تم فك تشفيرها؛ ولم يتم تدوين الحوار تلقائيًاالاستماع إلى التسجيل ومراجعة التزامن يدويًّا قبل الموافقة عليه

رأينا: تبع فيديو «FLUX 3» منطق المشهد العام بشكل أفضل مقارنة بالقيود الإنتاجية الدقيقة. وكان التحول السلس للمنتج وحركة الروبوت المنظمة أمرين مشجعين. ويُعد وقت العودة الثابت البالغ 5.04 ثانية، والتباعد غير المثالي بين أحرف النص، وانحراف شكل الزجاجة أسبابًا تدعو إلى اختبار سير العمل الخاص بك قبل البدء في التنفيذ. وهذه إشارة عملية مفيدة، وليست تقييمًا شاملاً للنموذج بأكمله.

FLUX 3 مقابل FLUX.2: ما الذي تغير فعليًّا؟

المساحةFLUX.2FLUX 3
الهوية العامة الأساسيةمجموعة برامج إنشاء الصور وتحريرهانموذج أساسي متعدد الوسائط
الطرائقالصور وسير عمل تحرير الصورالصور والفيديو والصوت وتوقع الأحداث
الوصول الحالينماذج واجهة برمجة التطبيقات (API) المنشورة وأسعارهاالوصول المبكر إلى فيديو BFL، والأسعار الرسمية للفيديو، ومسار GlobalGPT المؤكد
اتجاه النموذج المفتوحالعديد من متغيرات FLUX.2 ونقاط النهاية الموثقةالإعلان عن الأوزان المفتوحة لبطولة FLUX 3 Dev، التفاصيل قيد الإعلان
حكم عادل بشأن الأداءيمكن اختباره كنموذج تصويري اليوميمكن اختبار الفيديو؛ لكن إصدار حكم شامل على مستوى الأسرة بأكملها لا يزال أمراً سابقاً لأوانه

التغيير الأكبر يكمن في النطاق، وليس في نسبة تحسن مؤكدة. فـ FLUX 3 ليس مجرد نسخة من FLUX.2 مع درجة جديدة لجودة الصورة؛ بل يهدف إلى توحيد التوليد الإبداعي والعمل المادي في عائلة واحدة. بالنسبة لقرار حالي يعتمد على الصورة فقط، فإن مقارنة بين FLUX 2 و Nano Banana Pro وهو أكثر قابلية للتطبيق لأن كلا الجانبين يمكن تقييمهما اليوم باعتبارهما أدوات تصويرية.

لا تزال المقارنة الشاملة بين FLUX 3 وFLUX.2 بحاجة إلى توجيهات صور متطابقة، وتعديلات مرجعية، وتصميم خطوط، والالتزام بالتوجيهات، وزمن الاستجابة، والتكلفة. ويُقلل الفحص المرئي المكون من ثلاث جولات المذكور أعلاه من فجوة الأدلة، كما أن BFL تنشر الآن أسعار FLUX 3 للفيديو، لكنها لا تقارن نموذج الصور أو المتغيرات ذات الوزن المفتوح.

ما تظهره النتائج الرسمية لمسابقات «ديموس» و«الروبوتات»

تُظهر مواد الإطلاق الخاصة بـ BFL مقاطع فيديو مُولَّدة، وصوتًا متزامنًا، وأنماطًا بصرية، ونصوصًا متحركة، وأنماطًا أولية للتحرير. وهي توضح التوجه العام للمنتج وأنواع المخرجات التي تستهدفها الشركة. ونظرًا لأن هذه أمثلة رسمية مختارة، فإنها لا توضح لنا مدى تكرار تمكن المستخدم العادي من تحقيق نفس الجودة، أو المدة التي يستغرقها عملية التوليد، أو التكلفة التي ستتكبدها كل نتيجة.

جدول معايير أداء مجموعات الأجسام اللينة المقلدة لنظام FLUX
في مخطط تجميع الأجسام اللينة الخاص بشركة BFL، يُظهر نظام FLUX-mimic معدل نجاح متوسط يبلغ 95% عبر 20 تجربة تشغيل ذاتي.

أما العمل في مجال الروبوتات فهو أكثر تحديدًا. في تقرير FLUX 3 × mimic, ، تصف تقنيات BFL و«mimic robotics» كيفية تكييف البنية الأساسية للفيديو FLUX 3 من أجل التنبؤ بحركات الروبوتات. ويُظهر مخطط تجميع الأجسام المرنة المعروض معدل نجاح متوسط يبلغ 95% لنظام FLUX-mimic، حيث يستند كل متوسط مرسوم بخط متقطع إلى 20 تجربة ذاتية.

هذه نتيجة في مجال الروبوتات، وليست معيارًا لقياس جودة الصور أو مقاطع الفيديو. وتكمن أهميتها في الجانب النظري: حيث ترى شركة BFL أن «العمود الفقري» الذي تم تدريبه على نمذجة الحركة والتلامس والوزن والسبب يمكن أن يكشف عن تمثيلات مفيدة في المهام المادية. أما ما إذا كان هذا النهج نفسه قابلاً للتعميم على الروبوتات والمصانع والمهام المختلفة، فهذا الأمر يتطلب أدلة مستقلة أوسع نطاقًا.

ردود الفعل الأولية من المجتمع على منصتي «X» و«Reddit»

اجتذب مشروع «FLUX 3» اهتمامًا فوريًّا. في اللقطة التحققية التي تم التقاطها في 27 يوليو، فإن الإعلان الرسمي لشركة BFL على X سجلت 6,088 إعجابًا، و862 مشاركة، و365 اقتباسًا، و314 ردًّا. وتُعد هذه الأرقام مؤشرًا على مدى الاهتمام عند الإطلاق، وليست مؤشرًا على موثوقية الطراز، وستستمر في التغير.

منشور من Black Forest Labs X يعلن عن الإصدار المبكر من FLUX 3
يصف المنشور الذي أعلن فيه BFL عن إطلاق FLUX 3 هذا النموذج بأنه نموذج موحد للتنبؤ بالصور والفيديو والصوت والحركات.

A منشور على موقع Reddit في قسم r/StableDiffusion المنشور الذي يحمل عنوان “Flux 3 يبدو مذهلاً. كانت هذه موجهة واحدة” سجل 370 تصويتًا إيجابيًا و63 تعليقًا في نافذة التحقق نفسها. تستخدم العينة المعروضة على الشاشة المقسمة في المنشور موجهة معقدة، لكنها تظل مجرد مثال واحد تمت مشاركته وليس معيارًا قياسيًّا خاضعًا للرقابة.

منشور نموذجي على Reddit FLUX 3 يحتوي على فيديو بشاشة مقسمة
نشر أحد مستخدمي موقع «ريديت» موجهًا صعبًا لـ«FLUX 3» على شاشة مقسمة؛ وحظي المنشور بـ63 تعليقًا وعنوانًا حماسيًّا.

الاستنتاج الصحيح هو أن المبدعين يهتمون بمدى تعقيد الأوامر، والحركة، والصوت الأصلي، والاتساق البصري. وبمجرد توسيع نطاق الوصول، ينبغي أن تصبح قابلية تكرار الأوامر اختبارًا أساسيًا. وفي غضون ذلك، فإن صيغة المطالبة Kling 3.0 يُعد مرجعًا مفيدًا لتنظيم المشاهد وسلوك الكاميرا والحركة والقيود في أدوات الفيديو المتاحة حاليًا.

واجهة برمجة تطبيقات FLUX 3، والأسعار، و«الأوزان المفتوحة»

اعتبارًا من 11 أغسطس، فإن شركة BFL وثائق الأسعار المنشورة يشمل خدمة FLUX 3 Video. كل وحدة ائتمان تعادل $0.01. تبلغ تكلفة تحويل النص إلى فيديو والصورة إلى فيديو $0.17 في الثانية بدقة HD أو $0.29 في الثانية بدقة FHD، بينما تبلغ تكلفة المسودات بدقة HD $0.06 في الثانية. تبلغ تكلفة استمرار الفيديو $0.43 في الثانية بدقة HD أو $0.54 في الثانية بدقة FHD، بينما تبلغ تكلفة المسودات $0.12 في الثانية.

البندمنشور أو تم التحقق منهلا تزال محدودة أو غير معروفة
أسعار فيديو FLUX 3T2V/I2V: $0.17/s HD، $0.29/s FHD؛ المسودة: $0.06/s. المتابعة: $0.43/s HD، $0.54/s FHD؛ المسودة: $0.12/sشروط الاستخدام الخاص وشروط الاستخدام المؤسسي
الوصول إلى BFLتم الإعلان عن «الوصول المبكر» للفيديو، ونظرة عامة على الطراز، والأسعارالقبول العام لواجهة برمجة التطبيقات (API)، والحصص، والحدود الخاصة بكل حساب
الوصول إلى GlobalGPTتم التحقق من مسار منتج الفيديو FLUX 3 ونجاح اختبار المهمة الذي أُجري ثلاث مراتقد تختلف حصص الحسابات وضوابط مستوى المسار عن العرض المباشر الذي تقدمه شركة BFL
FLUX 3 Devتم تصميمه ليكون شبكة أساسية متعددة الوسائط مفتوحة الوزنتاريخ الإصدار، والترخيص، وحجم المعلمات، ومتطلبات الأجهزة

لا تخلط بين مصطلح “الوزن المفتوح” ومصطلح “المصدر المفتوح”. فقد تختلف شروط الوصول إلى كل من الأوزان، والرمز البرمجي، وبيانات التدريب، والترخيص. ولا يمكن إصدار حكم ملموس بشأن «الوزن المفتوح» إلا بعد أن تنشر BFL الإصدار الفعلي لـ FLUX 3 Dev والترخيص الخاص به.

كيفية طلب الوصول المبكر إلى FLUX 3

  1. افتح الصفحة الرسمية لنموذج FLUX 3 ومراجعة تصنيفات القدرات الحالية.
  2. انقر على زر «طلب» للانتقال إلى نموذج «FLUX 3» الرسمي للوصول المبكر.
  3. صف الإمكانية التي تحتاجها — الفيديو، أو الصورة، أو الإجراء، أو الأوزان الخاصة، أو وصول المطور — بالإضافة إلى سير العمل الذي ترغب في إنشائه.
  4. يرجى تضمين حالة استخدام واقعية، والحجم المتوقع، وتفاصيل المؤسسة، وأسباب أهمية الوصول المبكر للمشروع.
  5. انتظر حتى تتلقى تأكيدًا كتابيًا قبل أن تفترض أي شيء بخصوص حق الوصول أو الأسعار أو الحدود أو تاريخ التسليم.

التقديم الدقيق أقوى من مجرد قول عام مثل “أريد تجربة ذلك”. على سبيل المثال، يمكن لاستوديو ما أن يوضح أنه يحتاج إلى حوارات متعددة اللغات وتأثيرات متزامنة لمقاطع فيديو قصيرة تروّج للعلامة التجارية، في حين يمكن لفريق متخصص في الروبوتات أن يصف مهمة التحكم التي يعمل عليها، ومنصة الروبوت، والبيانات، وبيئة النشر.

إذا كان الهدف هو الحوار، فخطط لسلسلة العمليات بأكملها بدلاً من الاكتفاء بكتابة المطالبة الأولية فقط. إن Veo 3.1 سير عمل الحوار ومزامنة الشفاه يسلط الضوء على الجوانب العملية — مثل توقيت المتحدث، واتساق الصوت، وتصميم اللقطات، وإعادة الإنتاج — التي ستكون ذات أهمية أيضًا عند تقييم FLUX 3 Video.

من ينبغي أن يشاهد مسلسل «FLUX 3»؟

  • منشئو مقاطع الفيديو باستخدام الذكاء الاصطناعي ينبغي الانتباه إلى الصوت الأصلي، والحوار متعدد اللغات، والمونتاج، وتسلسل اللقطات المتعددة، والاتساق، والسرعة، والسعر النهائي.
  • مبدعو الصور ينبغي انتظار إجراء مقارنات قابلة للتكرار تشمل الالتزام الفوري بالتعليمات، وتحرير النصوص المرجعية، والطباعة، والتكلفة. وحتى ذلك الحين، فإن أفضل برامج توليد الصور بالذكاء الاصطناعي التي تم اختبارها في عام 2026 هي القائمة المختصرة الأكثر عملية.
  • المطورون ينبغي مراقبة معرّفات النماذج العامة، وحدود معدلات الاستخدام، ودعم حزمة تطوير التطبيقات (SDK)، وشروط الترجيح الخاص، والترخيص النهائي لـ FLUX 3 Dev.
  • فرق الروبوتات والذكاء الاصطناعي الفيزيائي ينبغي دراسة ما إذا كان نهج «FLUX-mimic» قابلاً للتطبيق خارج نطاق المهمة المنشورة، ومدى الحاجة إلى تكييف البيانات وفقًا لخصائص المهمة.

قبل البدء في تنفيذ سير عمل الإنتاج، استخدم فحص الجاهزية المكون من أربعة معايير في نظام FLUX 3. يمكن أن يؤدي عرض توضيحي للتشغيل إلى تلبية معيار «القدرة» دون تلبية معايير «الوصول» أو «الجوانب الاقتصادية» أو «الأدلة».

البوابةما يجب أن يكون صحيحًاالأدلة التي يجب جمعها
الوصوللدى فريقك موافقة خطية على الكفاءة المطلوبةدعوة إنشاء الحساب، والشروط، والمنطقة، والحصص، وبيانات الاتصال بالدعم الفني
القدرةهذا النموذج يُنجز مهمتك الفعلية، وليس مجرد مثال توضيحيالمطالبات المطابقة، والمدخلات المرجعية، وحالات الفشل، وعمليات التشغيل المتكررة
الاقتصادتتوافق التكلفة ومدة التنفيذ مع خطة الإنتاجالسعر، ووقت التوليد، ومعدل إعادة المحاولة، وحدود الحجم، والبنية التحتية
الأدلةتظل النتائج موثوقة خارج نطاق أمثلة الإطلاق المختارةاختبارات مستقلة، وإعدادات قابلة للتكرار، ومخرجات محددة الإصدار

هل ترغب في تجربة النموذج الذي استخدمناه في اختبارنا؟ افتح فيديو FLUX 3 على GlobalGPT. تم تفعيل مسار المنتج، وأكملت بيئة المهام المرتبطة به جميع الدورات الثلاث في 11 أغسطس 2026. يرجى التحقق من عناصر التحكم والحصص الموضحة في حسابك الخاص قبل بدء تشغيل دفعة إنتاجية.

الأسئلة الشائعة حول FLUX 3

متى تم الإعلان عن FLUX 3؟

أعلنت شركة «بلاك فورست لابز» عن إطلاق «FLUX 3» في 23 يوليو 2026. وقدمت منشورة الإطلاق نموذجًا أساسيًّا متعدد الوسائط يشمل الصور والفيديو والصوت وتوقع الإجراءات، على أن يتم طرح إمكانياته عبر برنامج «الوصول المبكر» على مراحل بدلاً من إصدار عام واحد واسع النطاق.

هل برنامج FLUX 3 متاح للجمهور؟

تقدم BFL خدمة «FLUX 3 Video» من خلال برنامج «الوصول المبكر»، وتعلن الآن عن أسعار هذه الخدمة. كما أن GlobalGPT تمتلك مسارًا معتمدًا لمنتج «FLUX 3 Video». ولا يعني ذلك أن خدمات «FLUX 3 Image» و«Action» و«private weights» أو «FLUX 3 Dev» أصبحت متاحة للجميع عبر الخدمة الذاتية؛ فكل ميزة لا تزال تخضع لجدول طرحها الخاص وشروطها الخاصة.

هل يمكن لبرنامج FLUX 3 إنشاء مقاطع فيديو بصوت أصلي؟

نعم. تقول شركة BFL إن برنامج FLUX 3 Video قادر على إنشاء حوارات متعددة اللغات وتأثيرات صوتية وأجواء صوتية مصاحبة للإطارات. وقد احتوت ملفات MP4 الثلاثة التي شملها اختبارنا الذي أُجري في 11 أغسطس على بيانات صوتية تم فك تشفيرها. ولم نقم بتحويل المسارات الصوتية إلى نصوص تلقائيًّا، لذا فإن الاختبار يؤكد وجود الصوت وليس دقة الحوار من حيث الكلمات.

هل يُعد FLUX 3 نموذجًا للصور أيضًا؟

نعم. يُعد إنشاء الصور وتحريرها جزءًا من عائلة FLUX 3، لكن شركة BFL ذكرت أن برنامج «FLUX 3 Image Early Access» سيُتاح في الأسابيع التي تلي الإعلان الأولي. ولم يتم الإعلان عن أسماء نقاط النهاية العامة، وموعد التوفر النهائي، والأسعار حتى وقت كتابة هذا التحديث.

هل برنامج FLUX 3 مفتوح المصدر أم مفتوح الوزن؟

أعلنت شركة BFL عن توفير إمكانية الوصول إلى الوزن المفتوح في المستقبل من خلال FLUX 3 Dev. ولم تنشر بعد تاريخ الإصدار، أو الترخيص، أو حجم المعلمات، أو نطاق الكود، أو متطلبات الأجهزة. وإلى أن تتوفر هذه التفاصيل، من الأصح استخدام مصطلح “الوزن المفتوح المخطط” بدلاً من “المصدر المفتوح”.”

ما الفرق بين FLUX 3 وFLUX.2؟

تُعد FLUX.2 في المقام الأول مجموعة حالية لتوليد الصور وتحريرها، مع نقاط نهاية وأسعار منشورة. أما FLUX 3 فهي أساس متعدد الوسائط أوسع نطاقًا يهدف إلى ربط الصور والفيديو والصوت وتوقع الإجراءات. ولا يمكن إجراء مقارنة عادلة بين الجودة والتكلفة إلا بعد توفر وصول أوسع نطاقًا إلى FLUX 3.

ماذا أظهر الاختبار العملي لجهاز FLUX 3؟

تم إنجاز ثلاث مهام من أصل ثلاث بنجاح باستخدام flux-3-video معرّف النموذج. اتبعت النتائج المشاهد عالية المستوى المطلوبة، وحافظ اختبار الروبوت على تسلسل حركاته وخصائصه الرئيسية. كانت مدة المقاطع الثلاثة جميعها 5.04 ثوانٍ على الرغم من أن المطالبات كانت مدتها ثماني ثوانٍ؛ ولم تكن المسافات الدقيقة بين العلامات وهندسة المنتج المتكررة مثالية.

هل يمكنني استخدام FLUX 3 على GlobalGPT؟

نعم. المسار الذي تم التحقق منه هو فيديو FLUX 3 على GlobalGPT. كما أتممنا ثلاثة أجيال عبر بيئة المهام المتصلة في 11 أغسطس 2026. ويُعد الوصول إلى المنصة منفصلاً عن الوصول المباشر إلى واجهة برمجة تطبيقات BFL أو الوصول إلى الأوزان الخاصة.

الخلاصة النهائية

لم يعد FLUX 3 مجرد وعد على صفحة الإطلاق. فقد نشرت BFL تفاصيل حول إمكانيات الفيديو والأسعار، وأصبح لدى GlobalGPT مسار مُثبت، كما أنتجت تجاربنا الثلاث ملفات MP4 قابلة للاستخدام مع تدفقات صوتية. تعامل النموذج جيدًا مع منطق المشهد والحركة المقيدة، لكنه لم يلتزم بالمدة المطلوبة، كما خفف من دقة النص واتساق المنتج. جرب المطالبة الحقيقية الخاصة بك قبل التوسع، واستمر في متابعة FLUX 3 Image وAction والأوزان الخاصة وترخيص FLUX 3 Dev مع نضوج هذه الأجزاء من العائلة.

شارك المنشور:

منشورات ذات صلة