تدريب LoRA مخصص على Flux 2: كيف تُجري الضبط الدقيق لنموذجك الخاص

دليل عملي لتدريب LoRA مخصص على Flux 2، يغطي كل شيء من تنظيم مجموعة البيانات وكتابة التسميات التوضيحية، إلى معاملات التدريب ومراقبة الخسارة وتشغيل النموذج بأوزانك المضبوطة على أي منصة.

تدريب LoRA مخصص على Flux 2: كيف تُجري الضبط الدقيق لنموذجك الخاص
Cristian Da Conceicao
مؤسس Picasso IA

تُعد عملية تدريب LoRA مخصص على Flux 2-Dev من أقوى ما يمكنك فعله مع نماذج الانتشار الحديثة. سواء أردت محاكاة نمط فني محدد، أو تعليم النموذج التعرف على وجهك، أو التقاط منتج بثبات مثالي على مستوى البكسل، فإن الضبط الدقيق بتقنية LoRA يمنحك هذا التحكم دون قضاء أسابيع وإنفاق الآلاف على تدريب النموذج كاملًا. أصبحت العملية أسهل بكثير في 2027، وترشدك هذه المقالة خطوة بخطوة، من مجموعة البيانات الخام حتى أول تشغيل ناجح للنموذج.

ما الذي يفعله تدريب LoRA فعليًا

LoRA، واختصارها Low-Rank Adaptation، لا يعيد تدريب النموذج بالكامل. بل يُدخل مصفوفات أوزان صغيرة قابلة للتدريب في طبقات محددة من النموذج الأساسي المجمّد، ويدرّب تلك المصفوفات فقط. والنتيجة ملف محوّل مدمج يتراوح حجمه عادةً بين 50 ميغابايت و300 ميغابايت، وعند تحميله مع النموذج الأساسي فإنه يُزيح مخرجاته نحو أي نمط أو موضوع أو مفهوم دربته عليه.

LoRA مقابل الضبط الدقيق الكامل

الطريقةحجم الملفتكلفة التدريبسقف الجودة
Full Fine-Tune10+ GBعالية جدًاالأعلى
DreamBooth2-8 GBعاليةعالٍ
LoRA50-300 MBمنخفضةعالٍ
LyCORIS100-500 MBمتوسطةعالٍ جدًا

الجدوى الاقتصادية هنا واضحة. يتيح لك LoRA أن تكرر التجارب بسرعة، وأن تجرب مجموعات بيانات مختلفة، وأن تشارك أوزانك المدربة دون مشاركة النموذج كاملًا. وبالنسبة لمعظم المبدعين والمطورين، فهي الأداة الصحيحة.

لماذا يستجيب Flux 2 بشكل أفضل

كانت بنى الانتشار الأقدم تستجيب بشكل غير متسق لتدريب LoRA. وكان الحصول على نقل أسلوب نظيف باستخدام SDXL يتطلب في كثير من الأحيان مئات الصور المختارة بعناية، وجلسات متعددة لضبط المعاملات الفائقة. أما Flux 2-Dev فيختلف جوهريًا. فبنيته القائمة على مطابقة التدفق تستجيب بشكل أكثر مباشرة للتكيفات منخفضة الرتبة، وهذا يعني أنك تستطيع تحقيق التقاط قوي للمفهوم بعدد يتراوح بين 10 و20 صورة لشخص واحد، وبعدد إجمالي أقل من خطوات التدريب. كما أن سقف الجودة أعلى، إذ ينتج Flux 2-Pro وFlux 2-Max مخرجات أكثر حدة واتساقًا بشكل ملحوظ مقارنةً بسابقيهما عند تطبيق LoRA بصورة صحيحة.

تجهيز مجموعة البيانات لتدريب LoRA

بناء مجموعة بيانات التدريب

مجموعة البيانات هي العامل الأهم في تدريب LoRA المخصص. فالبيانات السيئة تنتج LoRA سيئًا، ولا يمكن لأي قدر من الإعدادات الذكية أن يصلح مجموعة بيانات معطوبة.

عدد الصور وجودتها

بالنسبة إلى التوليد المرتكز على الموضوع (تدريب شخص أو شخصية أو كائن محدد):

  • الحد الأدنى: 10 صور
  • المثالي: من 20 إلى 30 صورة
  • بالنسبة إلى تدريب الأنماط: من 50 إلى 150 صورة هي الأفضل

يجب أن تكون كل صورة حادة ومضاءة جيدًا. فالصور الضبابية وعيوب الضغط الشديد والدقات المختلطة كلها تُضعف قدرة LoRA على استخلاص المفهوم بوضوح. التقط الصور بدقة 512x512 على الأقل، والأفضل 1024x1024 لملفات LoRA الخاصة بنموذج Flux 2.

💡 التنوع أهم من الكمية. عشر صور حادة ومتنوعة تتفوق على خمسين صورة متشابهة. ضمّن زوايا وظروف إضاءة وخلفيات مختلفة لمنع LoRA من تثبيت سياق بيئي واحد.

كيف تكتب التسميات التوضيحية للصور بالشكل الصحيح

التسمية التوضيحية هي المكان الذي يفقد فيه المبتدئون الجودة غالبًا. تحتاج كل صورة تدريب إلى تسمية نصية تصف كل ما في الصورة باستثناء المفهوم الذي تعلّمه. ويجب أن يُمثَّل المفهوم نفسه بكلمة تفعيل فريدة لا توجد أصلًا في مفردات النموذج الأساسي.

على سبيل المثال، عند تدريب شخص اسمه Sarah:

  • تسمية ضعيفة: "صورة تُظهر Sarah وهي تبتسم"
  • تسمية قوية: "صورة تُظهر الشخص sks يبتسم في حديقة، بضوء بعد الظهيرة الدافئ، وبملابس عادية"

تصبح كلمة التفعيل sks (أو أي رمز قصير وفريد تختاره) المرساة. وعندما تكتب sks person لاحقًا في الأمر النصي، يفهم النموذج تمامًا أي شخص محدد يجب توليده.

أدوات التسمية التلقائية:

  • WD-1.4 Tagger للشخصيات الأنمي والموضوعات المنمّطة
  • BLIP-2 للموضوعات الواقعية كالصور الفوتوغرافية
  • LLaVA / Qwen-VL للأوصاف التفصيلية للمشاهد

ما يجب تجنبه في مجموعة البيانات

  • الصور ذات العلامات المائية
  • لقطات الشاشة أو الصور التي عليها نصوص متراكبة
  • الصور التي تحتوي على عدة أشخاص عند تدريب موضوع واحد
  • القصّات المفرطة أو الخلفيات المتجانسة بشكل مبالغ فيه
  • أكثر من 15% من الصور من جلسة تصوير واحدة

مراقبة تقدم تدريب LoRA على Flux 2

معاملات التدريب الصحيحة

تتأثر عملية تدريب LoRA على Flux 2 بعدد قليل من المعاملات الأساسية. وضبط هذه المعاملات بشكل صحيح يفصل بين LoRA محكم وقابل للاستخدام، وآخر ضبابي أو مفرط التخصص.

النقطة المثالية لمعدل التعلم

يتحكم معدل التعلم (LR) في مدى قوة تغيّر أوزان النموذج مع كل خطوة تدريب. فإذا كان مرتفعًا جدًا، يفرط LoRA في التخصص بسرعة. وإذا كان منخفضًا جدًا، يكاد النموذج لا يستجيب لبياناتك.

نوع LoRAمعدل التعلم الموصى بهالمجدول
الموضوع / الشخص1e-4 إلى 4e-4Cosine مع إعادة التشغيل
النمط الفني5e-5 إلى 2e-4Constant مع الإحماء (warmup)
الكائن / المنتج1e-4 إلى 3e-4Cosine

يُعد التخفيض الجيبي (Cosine) الخيار العام الأكثر أمانًا. يبدأ من معدل التعلم الذي حددته، ويتناقص بسلاسة، ويتجنب الانخفاضات المفاجئة التي قد تزعزع التدريب نحو الخطوات الأخيرة.

الخطوات والرتبة والألفا

تتراوح خطوات التدريب لملفات LoRA على نموذج Flux 2 عادةً بين 500 و2000. اضرب عدد صورك في 100 كنقطة بداية تقريبية (20 صورة = 2000 خطوة). راقب منحنى الخسارة، وأوقف التدريب مبكرًا إذا استقر أو بدأ في الارتفاع.

رتبة LoRA (تُكتب r) تتحكم في تعقيد المحوّل:

  • الرتبة 4-8: صغيرة وسريعة، وجيدة للمفاهيم البسيطة
  • الرتبة 16: متوازنة، وتعمل جيدًا مع معظم الموضوعات
  • الرتبة 32-64: التقاط تفاصيل أعلى، وملف أكبر، وتدريب أبطأ

الألفا تتحكم في تحجيم معدل التعلم الفعلي. والممارسة الشائعة هي ضبط الألفا مساوية للرتبة (الألفا = 16 عندما تكون الرتبة 16)، أو نصف الرتبة للحصول على تكيّف أكثر خفوتًا.

حجم الدفعة والدقة

بالنسبة لمعظم إعدادات GPU الاستهلاكية (RTX 3090 / RTX 4090 بذاكرة VRAM سعتها 24 جيجابايت):

  • حجم الدفعة: من 1 إلى 4
  • الدقة: 1024x1024 (الدقة الأصلية لنموذج Flux 2)
  • تراكم التدرجات: 4 خطوات عندما يكون حجم الدفعة 1

التدريب بدقة 512 بكسل يوفر ذاكرة VRAM لكنه ينتج نتائج أنعم بشكل ملحوظ. ونموذج Flux 2 مُحسَّن لمخرجات 1024 بكسل، وتؤدي محوّلات LoRA المدربة بتلك الدقة أداءً أفضل بكثير أثناء التشغيل.

مقارنة النتائج قبل وبعد الضبط الدقيق بـ LoRA

تدريب LoRA على Flux 2: خطوة بخطوة

إطار التدريب الأكثر استخدامًا لملفات LoRA على نموذج Flux 2 في 2027 هو SimpleTuner، رغم أن kohya-ss/sd-scripts مع فرع Flux 2 يعمل جيدًا أيضًا للمستخدمين المعتادين على ذلك النظام البيئي.

إعداد البيئة

# Clone SimpleTuner
git clone https://github.com/bghira/SimpleTuner
cd SimpleTuner

# Create Python environment
python -m venv venv
source venv/bin/activate

# Install dependencies
pip install -r requirements.txt

ما تحتاجه:

  • Python 3.10 أو أحدث
  • CUDA 12.1 أو أحدث
  • ذاكرة VRAM بسعة 24 جيجابايت على الأقل (أو الوصول إلى Kaggle / Colab A100)
  • أوزان النموذج الأساسي Flux 2-Dev المحمّلة من Hugging Face

تنظيم مجموعة صور مخصصة لتدريب LoRA

تشغيل عملية التدريب

أنشئ config.json في مجلد التدريب الخاص بك مع هذه الإعدادات كنقطة بداية:

{
  "model_type": "flux",
  "pretrained_model_name_or_path": "black-forest-labs/FLUX.1-dev",
  "output_dir": "./output/my-lora",
  "train_batch_size": 1,
  "gradient_accumulation_steps": 4,
  "learning_rate": 1e-4,
  "lr_scheduler": "cosine",
  "max_train_steps": 1500,
  "lora_rank": 16,
  "lora_alpha": 16,
  "resolution": 1024,
  "mixed_precision": "bf16"
}

ثم ابدأ التدريب:

python train_network.py --config_file config.json

يستغرق التدريب على RTX 4090 واحدة بهذه الإعدادات نحو 30 إلى 90 دقيقة، حسب عدد الخطوات وحجم مجموعة البيانات.

تشغيل أوامر تدريب LoRA في الطرفية

قراءة منحنيات الخسارة

تخبرك منحنيات الخسارة ما إذا كان LoRA يتعلم فعليًا. في عملية تدريب سليمة:

  • تنخفض الخسارة بحدة في أول 200 إلى 300 خطوة
  • ثم تستقر عند قيمة منخفضة وثابتة
  • الخسارة التي تواصل الانخفاض دون أن تستقر تشير إلى الإفراط في التخصص (overfitting)

💡 احفظ نقاط التحقق (checkpoints) كل 250 إلى 500 خطوة. نادرًا ما يكون أفضل LoRA في الخطوة الأخيرة. اختبر نقاط التحقق الوسيطة بعدد قليل من الأوامر النصية لتجد النقطة المثالية قبل أن يفرط النموذج في التخصص.

تُعد خسارة التدريب بين 0.05 و0.15 نموذجية لملفات LoRA الخاصة بالموضوعات في نموذج Flux 2. أما LoRA الخاصة بالأنماط فتستقر عادةً بين 0.08 و0.20، حسب البعد الأسلوبي عن توزيع التدريب الأصلي للنموذج الأساسي.

اختبار النموذج المضبوط

مراجعة النتائج المولدة بالذكاء الاصطناعي من LoRA مخصص

أول اختبار تشغيل

بعد اكتمال التدريب، حمّل ملف LoRA الخاص بك .safetensors مع Flux 2-Dev أو Flux 2-Pro باستخدام إطار التشغيل الذي تفضله. يتعامل إعداد ComfyUI أو Automatic1111 مع الإضافة الخاصة بـ Flux 2 مباشرةً مع هذا الأمر.

ابدأ بأمر نصي بسيط يتضمن كلمة التفعيل:

a portrait of sks person in a coffee shop, natural light, 85mm lens

إذا أنتج النموذج تمثيلًا يمكن التعرف عليه للموضوع الذي دربته، فإن LoRA يعمل. أما إذا جاءت النتائج عامة أو غير متسقة، فغالبًا ما يحتاج موضع كلمة التفعيل أو التسميات التوضيحية إلى مراجعة.

كلمات التفعيل الفعّالة

حالة الاستخداممثال على موضع كلمة التفعيل
شخص"صورة لشخص sks"
نمط فني"بأسلوب myart"
منتج / كائن"منتج brd على طاولة بيضاء"
شخصية"شخصية mychar تقف في الهواء الطلق"

ضع دائمًا كلمة التفعيل مبكرًا في أمرك النصي، واقرنها بوصف سياقي واضح. فالنموذج يستجيب للسياق الدلالي الكامل المحيط بكلمة التفعيل، لا للرمز وحده.

كيفية استخدام نماذج LoRA على PicassoIA

تمنحك PicassoIA وصولًا مباشرًا إلى نماذج Flux 2 المدعومة بتقنية LoRA دون أي إعداد محلي. وإذا أردت اختبار مخرجات Flux 2 المضبوطة فور انتهاء التدريب، فإن المنصة توفر عدة خيارات جاهزة للاستخدام.

ملاحظات مكتوبة بخط اليد عن معاملات تدريب LoRA

النماذج المتوافقة مع LoRA على المنصة

أكثر النماذج صلة بالتوليد المعتمد على LoRA على PicassoIA هي:

  • flux-dev-lora: الإصدار الرسمي Flux Dev مع دعم LoRA مدمج. حمّل أوزان .safetensors الخاصة بك مباشرةً من رابط HuggingFace، وشغّل النموذج فورًا دون الحاجة إلى GPU من جهتك.
  • p-image-lora: نسخة مُشذَّبة ومحسّنة من مسار Flux مع دعم محوّل LoRA. تعمل أسرع دون فقدان كبير في الجودة، وهي مثالية للتكرار السريع واختبار عدة checkpoints.
  • sdxl-multi-controlnet-lora: يجمع LoRA مع تكييف multi-ControlNet لتوليد منظّم يراعي الوضعية، انطلاقًا من SDXL الأساسي.

يمكنك أيضًا استخدام Flux 2-Dev، وFlux 2-Pro، وFlux 2-Flex، وFlux 2-Max للتشغيل الأساسي عالي الجودة، لتقييم جودة المخرجات قبل نشر LoRA الخاص بك على نطاق أوسع.

خطوة بخطوة: استخدام flux-dev-lora على PicassoIA

  1. افتح صفحة نموذج flux-dev-lora على PicassoIA
  2. في حقل LoRA URL، الصق رابط HuggingFace العام لملف .safetensors المدرَّب الخاص بك
  3. اضبط LoRA Scale: ابدأ بالقيمة 0.8 للحصول على تأثير قوي، واخفضها إلى 0.5 لمزج أكثر خفوتًا
  4. اكتب أمرك النصي مع كلمة التفعيل في بدايته تقريبًا
  5. اضبط مقياس التوجيه بين 3.5 و4.5 (يستخدم Flux 2 قيم توجيه أقل من SDXL)
  6. ولّد الصورة وقيّم المخرج مقابل المفهوم الذي دربته

💡 نصيحة LoRA Scale: القيمة التي تتجاوز 1.0 تميل إلى تشبيع المفهوم وإنتاج عيوب. التزم بين 0.6 و0.9 لمعظم الحالات.

نصائح الأوامر النصية لـ LoRA المخصص

كتابة أمر نصي فعّال لملف LoRA مخصص تختلف عن كتابة الأوامر النصية العادية. إليك بعض القواعد التي تحسّن الجودة باستمرار:

  • ابدأ بكلمة التفعيل في الجملة الأولى من أمرك النصي
  • صف الموقف، لا الشخص فقط: "sks person hiking in golden hour forest light" يتفوق باستمرار على "sks person" المكتوبة وحدها
  • الأوامر النصية السلبية ما زالت مفيدة: "blurry, low quality, distorted face" يقلل العيوب حتى مع تفعيل LoRA
  • مقياس التوجيه مهم: يعمل Flux 2 بأفضل شكل عند 3.5 إلى 5.0 لتشغيل LoRA، وهي قيم أقل مما قد تعتاد عليه في سير عمل SDXL

عرض مخرجات LoRA المضبوطة على لوحة إعلانات

3 أخطاء تُفسد جودة LoRA

1. التدريب على صور متشابهة أكثر من اللازم. إذا كانت 80% من صورك البالغ عددها 20 مُلتقطةً في الغرفة نفسها وبالإضاءة نفسها، فإن LoRA يُفرط في التكيف مع ذلك السياق. يدمج النموذج البيئة كجزء من المفهوم ذاته. نوّع الخلفيات والإضاءة والكادرات بقوة عبر مجموعة بياناتك.

2. تخطي مراجعة التسميات التوضيحية. تقدم كثير من خطوط التدريب التسمية التلقائية، ويثق بها المستخدمون دون مراجعة المخرجات. وغالبًا ما تضمّن التسميات التلقائية السمات المميزة للشخص في النص الوصفي بدلًا من عزلها في كلمة التفعيل. راجع التسميات وصحّحها يدويًا دائمًا قبل التدريب.

3. عدم اختبار نقاط التحقق الوسيطة. لا تفشل LoRA المفرطة في التخصص فجأة، بل تتدهور تدريجيًا بعد عدد معين من الخطوات. فالنسخة عند الخطوة 1000 غالبًا ما تكون أفضل بكثير من النسخة عند الخطوة 2000 بالنسبة إلى LoRA الخاصة بالموضوعات. ادمج تقييم نقاط التحقق في سير عملك منذ البداية.

💡 اختبار سريع للجودة: ولّد 5 صور باستخدام كلمة التفعيل بأوامر نصية مختلفة تمامًا. يحافظ LoRA القوي على الموضوع في الصور الخمس. أما الضعيف فلا يعمل إلا عندما يحاكي الأمر النصي الظروف الدقيقة لصور التدريب.

ابنِ شيئًا لا يشبه أي شيء آخر

استخدام واجهة توليد الذكاء الاصطناعي لاختبار LoRA مخصص

تدريب LoRA المخصص هو ما يجعلك تتوقف عن اعتبار الذكاء الاصطناعي آلةً عامة لتوليد الصور، وتبدأ في استخدامه كأداة تعكس رؤيتك الإبداعية الخاصة. سواء كان أسلوبك في التصوير الفوتوغرافي، أو شخصية خيالية، أو خط منتجات، أو وجهًا لم يره النموذج من قبل، فإن سير العمل أعلاه يمنحك كل ما تحتاجه لتحقيق ذلك.

تضم مجموعة النماذج المتوافقة مع LoRA على PicassoIA، ومنها flux-dev-lora وp-image-lora وعائلة Flux 2 كاملةً، وتتيح لك اختبار أوزانك المدربة فورًا في السحابة دون الحاجة إلى GPU عالي الأداء محلي. اختر نموذجًا، وحمّل LoRA الخاص بك، واكتب كلمة التفعيل، وشاهد ما يفعله النموذج بما دربته عليه.

أفضل طريقة لتتقن هذا هي أن تدرّب شيئًا، ثم تقيّمه بصدق، وتحدد مواضع إخفاقه، ثم تدربه من جديد ببيانات أفضل. كل تكرار يكشف أمرًا لا يستطيع أي مصدر مكتوب أن يستنسخه بالكامل.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة