تخطَّ إلى المحتوى الرئيسي
Vantaige
FLUX screenshot
FLUX logo

FLUX

مجاني جزئيًا

FLUX هو نموذج مفتوح الأوزان لتحويل النص إلى صورة من تطوير Black Forest Labs، الفريق الذي يقف وراء Stable Diffusion. تم إطلاقه في أغسطس 2024 بثلاث فئات، وتفوق على Stable Diffusion 3 و Midjourney v6 في لوحات الصدارة المعيارية، ويُعد ركيزة أساسية لواحد من أكبر أنظمة LoRA البيئية في مجال توليد الصور بالذكاء الاصطناعي.

حالات الاستخدام:الصور والفنون
الميزات:APIOpen Source

FLUX هي عائلة من نماذج تحويل النص إلى صورة وتحرير الصور، طورتها شركة Black Forest Labs (BFL)، وهي شركة تأسست عام 2024 ويقع مقرها الرئيسي في فرايبورغ إم برايسغاو، ألمانيا. أسس BFL كل من Robin Rombach و Andreas Blattmann و Patrick Esser، وهم الباحثون الذين قاموا ببناء Stable Diffusion في LMU Munich تحت إشراف Bjorn Ommer، وقادوا لاحقاً أبحاث توليد الصور في Stability AI. جمعت الشركة 31 مليون دولار من Andreessen Horowitz وآخرين خصيصاً لبناء جيل جديد من نماذج الصور مفتوحة الأوزان. تم إطلاق FLUX في 1 أغسطس 2024 كمجموعة من ثلاث فئات: schnell (بترخيص Apache 2.0، مفتوح بالكامل)، و dev (أوزان مفتوحة للاستخدام غير التجاري)، و pro (مغلق، متاح عبر واجهة برمجة التطبيقات API فقط). وبحلول نهاية يومه الأول، احتل كل من FLUX.1 [dev] و [pro] المركزين الأول والثاني في لوحة صدارة Artificial Analysis Text to Image Arena، متفوقين على Stable Diffusion 3 Ultra و Midjourney v6.0.

تعتمد البنية الأساسية لـ FLUX.1 على محول تدفق مصحح (rectified flow transformer) تم توسيعه ليصل إلى 12 مليار معلمة، ويجمع بين كتل محولات الانتشار المتوازية ومتعددة الوسائط. توفر هذه البنية التزاماً أقوى بكثير بالمطالبات النصية مقارنة بنماذج الانتشار الكامن (latent diffusion) السابقة، وتتعامل مع عرض النصوص داخل الصور المُولدة، وتشريح اليدين، والمشاهد المعقدة متعددة العناصر بموثوقية أكبر بكثير من Stable Diffusion XL. واعتباراً من أبريل 2026، توسعت عائلة النماذج لتشمل FLUX.1.1 [pro] (أكتوبر 2024)، و FLUX.1 Tools للتحرير الموجه (نوفمبر 2024)، و FLUX.1 Kontext لتحرير الصور المدرك للسياق (مايو 2025)، و FLUX.2 الذي يتميز بنموذج dev مفتوح الأوزان بـ 32 مليار معلمة (نوفمبر 2025). يتوفر FLUX للاستضافة الذاتية المحلية عبر Hugging Face، أو عبر الاستدلال المستضاف على Fal.ai و Replicate و Together.ai وواجهة برمجة التطبيقات (API) الخاصة بـ BFL. كما تتوفر الآلاف من نماذج LoRA المجتمعية على Civitai لضبط الأنماط المخصصة.

ما يقدمه FLUX في أبريل 2026

يغطي FLUX جيلين من النماذج بقدرات متميزة. تتمحور عائلة FLUX.1 حول محول التدفق المصحح بـ 12 مليار معلمة. يعمل FLUX.1 [schnell] (بترخيص Apache 2.0) في 3-6 خطوات استدلال ويولد الصور في أقل من ثانيتين على الأجهزة الحديثة، وهو سريع بما يكفي للنماذج الأولية في الوقت الفعلي على وحدة معالجة رسومات (GPU) قوية مخصصة للألعاب. يستخدم FLUX.1 [dev] نفس القاعدة بـ 12 مليار معلمة مع تقطير التوجيه (guidance distillation)، مما ينتج عنه نتائج عالية الجودة على حساب المزيد من الخطوات؛ ويتطلب حوالي 16 جيجابايت من ذاكرة VRAM بالدقة الكاملة، مع نسخ مكممة (quantized) تتناسب مع بطاقات 8 جيجابايت. أما FLUX.1 [pro] فهو الفئة المغلقة المتاحة عبر API فقط، والتي تقدم أفضل جودة للصورة الفردية في العائلة.

تضيف مجموعة FLUX.1 Tools أربعة أوضاع توليد موجهة: fill (الرسم الداخلي inpainting)، و canny (التوليد الموجه بالحواف)، و depth (التوليد المشروط بخريطة العمق)، و redux (نقل النمط من الصور المرجعية). قدم FLUX.1 Kontext، الذي تم إطلاقه في مايو 2025، التحرير المدرك للسياق: قم بتحميل صورة، واكتب "تغيير السترة إلى اللون الأحمر"، وسيقوم النموذج بإجراء تعديل محلي مستهدف دون المساس بأي شيء آخر في الإطار. يدعم Kontext أيضاً اتساق الشخصيات، مما يسمح لنفس الشخص أو الكائن بالبقاء متسقاً عبر مشاهد مختلفة، وهو أمر مفيد لبناء روايات بصرية متسقة أو حملات منتجات. وتدعي BFL أن Kontext يعمل أسرع بـ 8 مرات من GPT-Image في مهام التحرير.

يعمل FLUX.2 [dev]، الذي تم إطلاقه في 25 نوفمبر 2025، على توسيع البنية لتصل إلى 32 مليار معلمة وهو متاح كأوزان مفتوحة على Hugging Face. تصفه BFL بأنه "أقوى نموذج مفتوح الأوزان لتوليد وتحرير الصور متاح حالياً". أما FLUX.2 [klein]، الذي تم إصداره في 15 يناير 2026 بموجب ترخيص Apache 2.0، فهو نسخة مصغرة الحجم تولد الصور في أقل من ثانية على وحدات معالجة الرسومات الاستهلاكية، ويتوفر بمتغيرات 4 مليار و 9 مليار معلمة. تدعم جميع أجيال FLUX المخرجات بدقات قياسية تصل إلى 1 ميجابكسل لمعظم الفئات، مع وصول FLUX.2 [pro] Ultra إلى 4 ميجابكسل عبر Fal.ai.

موقع FLUX مقارنة بـ Stable Diffusion 3.5 و Midjourney

المقارنتان الطبيعيتان لـ FLUX هما Stable Diffusion 3.5 (الخيار الرئيسي الآخر مفتوح الأوزان) و Midjourney (النموذج التجاري المغلق المهيمن). الاختلافات الآلية بينها كبيرة.

FLUX مقابل Stable Diffusion 3.5 Large: يستخدم SD3.5 Large بنية MMDiT (محول الانتشار متعدد الوسائط) مع مكدس تشفير نصي ثلاثي: CLIP-L و CLIP-G و T5 XXL. وبحجم 8.1 مليار معلمة في متغير large-turbo الخاص به، فإنه يعمل بجدول استدلال ثابت من 20 خطوة، مقارنة بـ 3-6 خطوات في FLUX schnell. يتفوق FLUX بسهولة في الالتزام بالمطالبات، وعرض النصوص داخل الصور المُولدة، والتشريح الصحيح لليدين، وهي أمور لا يزال SD3 يعاني منها. أثار موضوع نُشر في فبراير 2025 على r/StableDiffusion مخاوف إضافية من أن متغيرات SD3.5 المتوسطة والكبيرة كانت "غير قابلة للتدريب" لضبط LoRA الدقيق، مما أحبط المطورين ودفع الكثير من الطاقة الإبداعية للمجتمع نحو FLUX. يضم كتالوج FLUX LoRA على Civitai الآن الآلاف من النماذج. يحتفظ SD3.5 بميزة في بعض توافقات مسارات العمل (عقد ComfyUI القديمة ومسارات عمل AUTOMATIC1111) ويمكن تشغيله على أجهزة ذات ذاكرة VRAM أقل بأحجام أصغر.

FLUX مقابل Midjourney: يظل Midjourney رائداً في الجودة الأسلوبية للجماليات الفنية والرسومية، لكن قيوده الهيكلية هي عكس قيود FLUX. يُعد Midjourney مغلق المصدر ولا يوفر واجهة برمجة تطبيقات (API) عامة لمعظم المستخدمين، ولا يدعم النشر المحلي، ولا الضبط الدقيق لـ LoRA، ويقتصر الوصول إليه على Discord أو واجهة الويب الخاصة به. لا يمكنك دمج Midjourney في مسار عمل تطبيقك الخاص. في المقابل، تتيح أوزان FLUX المفتوحة وواجهة برمجة تطبيقات BFL وصولاً برمجياً كاملاً، وضبطاً دقيقاً مخصصاً، ونشراً ذاتي الاستضافة، وهي ميزات لا يدعمها Midjourney. في لوحات الصدارة المعيارية (Artificial Analysis Arena)، يتبادل FLUX [pro] و Midjourney المراكز اعتماداً على فئة التقييم؛ حيث يفوز FLUX في دقة المطالبات وعرض النصوص، بينما يحتفظ Midjourney بالأفضلية في بعض الأنماط الفنية المنسقة.

"التزام ممتاز بالمطالبات، وقدرة قوية على تتبع أجزاء متعددة من المشهد، إنه مثير للإعجاب من الناحية الفنية. ومع ذلك، يبدو أنه لم يتلق أي تدريب على الفنون الكلاسيكية."، vessenes، Hacker News، أكتوبر 2024
"يتمتع FLUX.1 بأحدث تقنيات الالتزام بالمطالبات، ويمكنه التعامل مع النصوص، وهو مفتوح المصدر. الجمالية العامة للنموذج محبوبة جداً. يمكنه إنشاء صور واقعية أو فنية ولديه فهم جيد للألوان والإضاءة.". مراجعة مدونة Stablecog، 2024

التكلفة الحقيقية لتشغيل FLUX

بالنسبة للمستضيفين الذاتيين، يتوفر FLUX.1 [schnell] بترخيص Apache 2.0 وهو مجاني تماماً. لا توجد تكلفة ترخيص؛ أنت تدفع فقط تكلفة الكهرباء واستهلاك الأجهزة. كما أن FLUX.1 [dev] مجاني للاستخدام الشخصي غير التجاري عبر إصدار Hugging Face مفتوح الأوزان. تجعل هاتان الفئتان FLUX في متناول أي شخص يمتلك وحدة معالجة رسومات (GPU) قادرة: وهي ميزة كبيرة مقارنة بالنماذج التجارية فقط.

عند استخدام واجهة برمجة التطبيقات (API) المستضافة من BFL، يعتمد التسعير على الأرصدة: 1 رصيد = 0.01 دولار أمريكي. الأسعار الرئيسية اعتباراً من أوائل عام 2026:

  • FLUX.2 [pro]: حوالي 0.03 دولار/صورة

  • FLUX.1 [pro] / FLUX.1.1 [pro]: 0.04 دولار/صورة (4 أرصدة)

  • FLUX.1 Kontext [pro]: 0.08 دولار/صورة (أعلى بسبب تعقيد التحرير)

  • Fal.ai FLUX1.1 [pro] Ultra (4MP): 0.06 دولار/صورة

لا يوجد اشتراك شهري ثابت من BFL؛ بل هو نظام دفع مقابل كل صورة بناءً على الأرصدة. تمتلك جهات الاستضافة الخارجية (Replicate و Fal.ai و Together.ai) هياكل تسعير خاصة بها وقد تختلف ببضعة سنتات. بالنسبة لأعباء عمل الإنتاج التي تولد آلاف الصور شهرياً، تتراكم التكاليف لكل صورة بسرعة؛ يجب على الفرق التي تقوم بأحجام عمل كبيرة مقارنة أعداد التوليد الفعلية بالبدائل مثل الاستضافة الذاتية لـ Stable Diffusion على مثيلات السحابة الفورية (spot cloud instances). يبدأ الحد الأدنى لتكلفة استخدام واجهة برمجة التطبيقات (API) من حوالي 0.014 دولار/صورة على الفئات الأخف، مما يجعل FLUX متاحاً للاختبارات صغيرة النطاق دون التزامات مسبقة كبيرة.

أين يفشل FLUX بشكل متكرر

يحتوي FLUX على قيود حقيقية تظهر باستمرار عبر نقاشات المجتمع. أبرزها الفن الكلاسيكي والأنماط الرسومية. عند إدخال مطالبات مثل "لوحة زيتية، ضربات فرشاة سميكة، إضاءة انطباعية"، أو طلب إنتاج شيء بأسلوب Degas أو Monet، يميل FLUX إلى إرجاع نتائج متأثرة بالأنمي أو رقمية مفرطة بدلاً من الأنماط الرسومية. تعزو تكهنات المجتمع على HN ذلك إلى التنظيم المتعمد لبيانات التدريب: تجنبت BFL جمع البيانات بكثافة من الفنانين الأحياء بعد ردود الفعل العنيفة التي واجهها Stable Diffusion. والنتيجة هي نموذج يتمتع بواقعية استثنائية ولكن بنطاق فني أضيق من نظام Stable Diffusion SDXL الأقدم.

أثار نسيج بشرة الصور الشخصية (البورتريه) انتقادات مستمرة في مواضيع r/StableDiffusion: جودة "بلاستيكية" أو ناعمة بشكل مفرط في الوجوه القريبة تبدو اصطناعية. يخفف الضبط الدقيق باستخدام نماذج LoRA المخصصة للصور الشخصية من هذه المشكلة، لكن النموذج الأساسي يظهرها في التوليد غير الموجه.

لا يزال التكوين المكاني المعقد والنفي غير محلولين. المطالبات التي تتطلب مواضيع متعددة في علاقات مكانية محددة ("ثلاثة شخصيات، أحدهم يجلس خلف الاثنين الآخرين")، أو النفي ("غرفة بلا نوافذ")، لا تزال تنتج أخطاء. هذا ليس فريداً في FLUX؛ بل هو قيد على مستوى البنية لنماذج مطابقة التدفق الحالية، ولكن يجدر الإشارة إليه لمسارات العمل التي تتطلب تحكماً تركيبياً دقيقاً.

تُعد متطلبات ذاكرة VRAM نقطة احتكاك عملية. يحتاج FLUX.1 [dev] بالدقة الكاملة إلى 16 جيجابايت من ذاكرة VRAM؛ بينما تضحي النسخ المكممة (quantized) التي تتناسب مع بطاقات 8 جيجابايت بالجودة في المشاهد المعقدة. ويُعد FLUX.2 [dev] بحجم 32 مليار معلمة أكثر تطلباً. سيصل المستخدمون المحليون العاديون على أجهزة الألعاب متوسطة المدى (RTX 3060، 12 جيجابايت) إلى الحدود القصوى وقد يحصلون على نتائج عملية أفضل من schnell بالدقة الكاملة مقارنة بـ dev بإعدادات مكممة بشكل كبير.

يخلق الترخيص غير التجاري لـ FLUX.1 [dev] فخاً خفياً: لا يمكن استخدام النموذج مفتوح الأوزان الأعلى جودة بشكل قانوني في المنتجات التجارية دون التبديل إلى واجهة برمجة التطبيقات (API) المدفوعة. يجب على المستخدمين الذين يبدأون بـ dev للنماذج الأولية ويرغبون في إطلاق منتج إما الانتقال إلى schnell (جودة أقل) أو الدفع مقابل واجهة برمجة التطبيقات.

لمن تم تصميم FLUX، ومن يجب عليه اختيار شيء آخر

يُعد FLUX الخيار الصحيح للمطورين الذين يدمجون توليد الصور في التطبيقات، والباحثين الذين يحتاجون إلى أوزان مفتوحة قابلة للاستضافة الذاتية، وفناني الذكاء الاصطناعي الذين يديرون مسارات عمل ComfyUI المحلية، وأي شخص يريد حرية الضبط الدقيق باستخدام LoRAs على نموذج أساسي متطور (SOTA). أصبح نظام Civitai البيئي لـ FLUX LoRAs ناضجاً الآن: توجد آلاف المحولات المدربة من قبل المجتمع لأنماط الصور الشخصية، والجماليات المحددة، وتصوير المنتجات، والمزيد. إذا كنت ترغب في بناء شيء مخصص يعتمد على توليد الصور، فإن FLUX هو الأساس مفتوح الأوزان الأكثر قدرة المتاح اعتباراً من أبريل 2026.

يُعد FLUX أيضاً الخيار المناسب للشركات التي تحتاج إلى وصول عبر واجهة برمجة التطبيقات (API) إلى توليد صور على مستوى الإنتاج بتسعير لكل صورة، دون التقيد ببيئة Midjourney الاحتكارية المغلقة.

تجاوز FLUX إذا كنت مستخدماً عادياً يريد تطبيق ويب استهلاكي بسيط لتوليد الصور من حين لآخر: لا يمتلك FLUX منتجاً استهلاكياً مصقولاً خاصاً به. ستحتاج إلى استخدام واجهة مستخدم لجهة خارجية (Fal.ai، أو واجهة ويب Replicate، أو إعداد ComfyUI محلي). تجاوزه أيضاً إذا كانت حالة الاستخدام الأساسية لديك هي تكرار جماليات الرسم الكلاسيكي؛ فالنموذج به فجوات موثقة هناك، وقد يكون نموذج SDXL المضبوط بدقة شديدة خياراً أفضل. إذا كانت ذاكرة VRAM تمثل قيداً عند 8 جيجابايت، فاختبر schnell بعناية قبل الالتزام: فهو سريع ومجاني ولكنه ينتج نتائج أقل تفصيلاً من [dev] في المشاهد المعقدة.

تقييمات المستخدمين

لا توجد تقييمات بعد. كن أول من يشارك تجربته!

سجّل الدخول لكتابة تقييم.

ظهرت في مجموعات

قوائم منتقاة تتضمّن FLUX.

مقالات ذات صلة

أدلة ومقالات ذات صلة بـ FLUX.