كيف تدمج صورتين في صورة واحدة بالذكاء الاصطناعي (نتائج مثالية في كل مرة)

كان دمج صورتين في صورة واحدة يستغرق ساعات في Photoshop. أما اليوم، فتستطيع أدوات الدمج بالذكاء الاصطناعي إنجاز ذلك في ثوانٍ بدقة واقعية كالصور الفوتوغرافية. يرشدك هذا المقال إلى أفضل نماذج الذكاء الاصطناعي وسير العمل ونصائح كتابة الأوامر النصية للحصول على تركيبات صور سلسة في كل مرة.

كيف تدمج صورتين في صورة واحدة بالذكاء الاصطناعي (نتائج مثالية في كل مرة)
Cristian Da Conceicao
مؤسس Picasso IA

لديك صورتان. ربما تكون بورتريهًا وخلفية طبيعية مثالية. أو وجهين تريد دمجهما لمشروع إبداعي. أو صورة منتج تحتاج إلى سياق نمط حياة لم تُلتقط فيه أصلًا. مهما كان استخدامك، فإن دمج صورتين في صورة واحدة باستخدام أدوات تقليدية مثل Photoshop يتطلب مهارة ووقتًا وكثيرًا من المحاولة والخطأ. أما مع الذكاء الاصطناعي، فتحصل على النتيجة نفسها في ثوانٍ، وتكون النتيجة واقعية بما يكفي لخداع العين.

لا يتعلق الأمر هنا بالفلاتر أو الطبقات الشفافة. يعمل دمج الصور الحديث بالذكاء الاصطناعي على مستوى بنيوي، إذ يطابق الإضاءة والظلال والعمق والمنظور عبر الصورتين المصدر، بحيث تبدو النتيجة النهائية كأنها صورة فوتوغرافية واحدة منذ البداية. وقد توسّعت التقنية وراء ذلك توسعًا كبيرًا خلال عامي 2024 و2025، وتوجد اليوم نماذج مصممة خصيصًا للتركيب متعدد الصور.

لماذا كان دمج الصور صعبًا في الماضي

مشكلة Photoshop القديمة

من أمضى ساعات في قص الشعر بدقة في Photoshop يعرف هذا العذاب جيدًا. الأقنعة اليدوية، وطبقات التعديل، ومطابقة درجات حرارة الألوان، وتصحيح اتجاهات الظلال، ومحاربة تأثيرات الهالة عند الحواف. حتى المحررون ذوو الخبرة يقضون ما بين 30 دقيقة إلى 2 ساعة على صورة مركبة واحدة جيدة. وهذا قبل احتساب مستوى المهارة.

وكانت النتيجة أن المصممين والمصورين أصحاب المهارة العالية في Photoshop وحدهم كانوا قادرين على إنشاء صور مدمجة مقنعة. أما الآخرون، فكانوا يحصلون على قصاصات محرجة بإضاءة غير متطابقة وفواصل واضحة.

ما الذي يجعل الدمج يبدو واقعيًا فعلًا

يتطلب الدمج الواقعي للصور تحقق عدة شروط في الوقت نفسه:

  • تناسق الإضاءة: يجب أن تبدو الصورتان مضاءتين من الاتجاه نفسه وبدرجة حرارة الألوان نفسها.
  • مطابقة المنظور: يجب أن تتوافق خطوط الأفق ونقاط التلاشي والمقياس.
  • جودة الحواف: تحتاج الحدود بين الأشخاص أو الأشياء إلى نعومة طبيعية، لا إلى قصاصة رقمية حادة.
  • منطق الظلال والانعكاسات: يجب أن تسقط الظلال في اتجاهات منطقية من الناحية الفيزيائية.
  • مطابقة الحبيبات والملمس: يجب أن تكون حبيبات الفيلم والضوضاء وملمس السطح متسقة في المصدرين.

تعالج الأدوات التقليدية كل واحد من هذه الشروط يدويًا. أما الذكاء الاصطناعي فيعالجها جميعًا في الوقت نفسه، في عملية تشغيل واحدة للنموذج.

مصورة محترفة تراجع صورتين في مكان عملها، وتستعد لدمجهما في صورة مركّبة واحدة

النماذج المناسبة للمهمة

Multi Image Kontext Pro: مصمم للدمج

الأداة الأكثر تخصصًا لسير العمل هذا هي Multi Image Kontext Pro. تقبل الأداة صورتين مرجعيتين أو أكثر وتستخدمها كمرتكزات بصرية لتوليد صورة جديدة تدمج عناصر من الصورتين. أنت لا تكتفي بوضع صورتين فوق بعضهما، بل يعيد النموذج توليد المشهد بوعي كامل بالمدخلين، ولهذا تبدو النتائج طبيعية جدًا.

وهي جزء من عائلة Flux Kontext، التي تُعد حاليًا البنية الرائدة لتوليد الصور القائم على التعليمات. وتميّزها قدرة "تعدد الصور" عن مولّدات تحويل النص إلى صورة العادية.

💡 الأنسب لاستخدام: تركيبات البورتريه مع الخلفية، ودمج المنتج مع نمط الحياة، وبناء مشهد يضم شخصين.

Flux Kontext Dev لإعادة صياغة صورة واحدة

إذا كان لديك مصدر واحد فقط وتريد دمجه ببيئة جديدة موصوفة نصيًا، فإن Flux Kontext Dev هو الأداة المناسبة. تغذيها بصورة وتعليمة نصية، فتعدّل الصورة مع الحفاظ على هوية الشخص وسياق الإضاءة.

يعمل هذا جيدًا بصفة خاصة في استبدال الخلفيات ونقل الأساليب الفنية، حين تريد أن يبقى الشخص الأصلي كما هو.

💡 الأنسب لاستخدام: تعديلات من نوع "ضع هذا الشخص في شارع في باريس وقت الساعة الذهبية".

Qwen Image Edit Plus لتحرير المشاهد

تتعامل Qwen Image Edit Plus مع الصورة كأنها لوحة قماشية، وتتبع التعليمات باللغة الطبيعية لإضافة العناصر أو إزالتها أو تعديلها. في سير عمل الدمج، تكون قوية عندما تريد إدراج عنصر محدد من وصف نصي داخل صورة موجودة.

وهناك أيضًا Qwen Image Edit Plus LoRA Fusion، المصمم خصيصًا لسيناريوهات دمج المنتجات. يضع العناصر من صورة في مشهد صورة أخرى بدقة على مستوى المنتج.

بورتريه بالتعريض المزدوج لامرأة تظهر كظل أمام غابة من أشجار الصنوبر، يوضح دمج الصور السلس بالذكاء الاصطناعي

كيف تدمج صورتين خطوة بخطوة

الخطوة 1: اختر صورتيك المصدر

ليست كل أزواج الصور تندمج جيدًا. الحيلة هي اختيار صور تشترك في عنصر متوافق واحد على الأقل:

العاملما الذي تبحث عنه
اتجاه الإضاءةإضاءة من الجهة نفسها تقريبًا
درجة حرارة الألواندافئتان معًا أو باردتان معًا
الدقةميغابكسل متقارب، بقدر الإمكان
المنظورمستوى نظر أو ارتفاع كاميرا متطابق

إذا اشتركت الصورتان في اثنين على الأقل من هذه العوامل الأربعة، فسيبدو دمجك بالذكاء الاصطناعي أكثر إقناعًا بشكل ملحوظ.

الخطوة 2: ارفع الصورتين إلى Multi Image Kontext Pro

افتح Multi Image Kontext Pro على Picasso IA. تقبل الواجهة رفع صور متعددة. اسحب صورتيك إلى خانات الإدخال.

لا تحتاج في هذه المرحلة إلى أي تحرير مسبق. يستقبل النموذج الصور الخام مباشرة.

الخطوة 3: اكتب تعليمة الدمج

هنا يقع معظم الناس في الخطأ. فالأمر النصي ليس وصفًا لما تريد رؤيته، بل تعليمة للنموذج عن كيفية دمج المدخلين.

بنى جيدة للأوامر النصية:

  • "ادمج الشخص من الصورة 1 في المشهد من الصورة 2، مع مطابقة اتجاه الإضاءة والحفاظ على جودة واقعية كالصور الفوتوغرافية"
  • "ضع المرأة من الصورة 1 واقفة في الحديقة من الصورة 2، واضبط الظلال لتتناسب مع ضوء شمس بعد الظهر"
  • "ادمج البورتريهين في تعريض مزدوج واحد سلس، مع إبراز الوجه من الصورة 1 في المنتصف"

ما يجب تجنبه:

  • "صورتان مدمجتان معًا" (عام جدًا، ولا توجد فيه تعليمة)
  • "اجعلها تبدو جميلة" (لا يوجد توجيه قابل للتنفيذ)
  • "دمج بالذكاء الاصطناعي" (ليست تعليمة حقيقية)

الخطوة 4: اضبط إعدادات الإخراج

اضبط نسبة العرض إلى الارتفاع على 16:9 للتركيبات الأفقية، أو على 1:1 للمخرجات المربعة لمنصات التواصل الاجتماعي. شغّل بأعلى إعدادات الجودة للمخرجات النهائية.

مقارنة قبل وبعد تُظهر صورتين مطبوعتين منفصلتين على اليسار، وتركيب الذكاء الاصطناعي المدمج بإتقان على اليمين

الخطوة 5: راجع وحسّن

نادرًا ما تكون المخرجات الأولى مثالية. فيما يلي المشكلات الشائعة وحلولها:

  • هالة حول الشخص: أضف "بلا تشوهات في الحواف، تكامل سلس، حواف طبيعية ناعمة" إلى الأمر النصي.
  • إضاءة غير متطابقة: أضف "طابق الإضاءة من الصورة 2، ضوء شمس دافئ من بعد الظهر من اليسار".
  • مقياس خاطئ: أضف "يجب أن يظهر الشخص بالمقياس نفسه لبقية العناصر في المشهد".
  • عدم تطابق الألوان: أضف "تدرج ألوان موحد، ودرجة حرارة ألوان متسقة في كل المشهد".

عادةً ما يكفي مرور واحد أو اثنان للتحسين.

5 أنواع من دمج الصور تنجح

من البورتريه إلى المنظر الطبيعي

هذه أكثر حالات الاستخدام شيوعًا. يُوضع شخص صُوّر في استوديو أو على خلفية سادة في بيئة واقعية محددة. يحافظ الذكاء الاصطناعي على مظهر الشخص الدقيق، مع توليد تفاعل واقعي مع المحيط: ظلال تسقط على الأرض، وضوء البيئة ينعكس على البشرة، ومطابقة عمق الميدان.

يعمل هذا بأفضل شكل مع Multi Image Kontext Pro.

بورتريهات التعريض المزدوج

وجهان، أو وجه ومنظر طبيعي، يشغلان الإطار نفسه بأسلوب تصويري لكنه واقعي. يُملأ ظل أحد الشخصين بملمس المشهد أو بيئة الآخر.

كان هذا التأثير يتطلب في السابق إخفاءً دقيقًا في Photoshop. أما مع الذكاء الاصطناعي، فيكفي وصفه مباشرة: "أنشئ تعريضًا مزدوجًا يُملأ فيه ظل المرأة بمنظر الغابة من الصورة 2، مع الحفاظ على تفاصيل واقعية كالصور الفوتوغرافية في كل المشهد."

مدير إبداعي في محطة تحرير احترافية، وعلى الشاشة اليسرى صورتان منفصلتان، وعلى اليمنى النتيجة المدمجة بالذكاء الاصطناعي

استبدال الخلفيات مع الحفاظ على الشخص

استبدل خلفية مسطحة أو مشتتة بأخرى سينمائية. يبقى الشخص كما هو، وتتكيف ظلاله وانعكاساته وتفاعلاته مع الإضاءة مع البيئة الجديدة.

كل من Flux Kontext Dev وFlux Fill Pro ممتازان هنا. ويفيد Flux Fill Pro بصفة خاصة عندما تريد توسيع اللوحة أولًا وملء الحواف الجديدة بمحتوى متطابق قبل الدمج.

تقسيمات البيئة المزدوجة

صورة واحدة تُظهر بيئتين مختلفتين تمامًا في الوقت نفسه، مقسّمة أفقيًا أو عموديًا عند المنتصف مع انتقال سلس. مدينة تلتقي بغابة. صيف يلتقي بشتاء. داخل يلتقي بخارج.

تعمل هذه الصور كبيانات فنية، وتحقق أداءً جيدًا جدًا على منصات التواصل الاجتماعي. يتولى الذكاء الاصطناعي تلقائيًا معالجة اختلاف المنظور والإضاءة بين البيئتين.

امرأة بفستان عاجي تقف عند الشاطئ حيث ينتقل الرمل بسلاسة إلى مرج جبلي مغطى بالثلج، دمج مذهل للصور بالذكاء الاصطناعي

دمج المنتج مع نمط الحياة

يُوضع منتج صُوّر في استوديو داخل مشهد نمط حياة واقعي. عطر على طاولة رخامية. أحذية رياضية على شارع في المدينة. منتج للعناية بالبشرة في غابة مطيرة.

صُمّم Qwen Image Edit Plus LoRA Fusion خصيصًا لهذا السير المحدد، وينتج نتائج صالحة للاستخدام التجاري. تُعالج الانعكاسات البيئية على أسطح المنتج والظلال المتطابقة تلقائيًا.

أوامر نصية تحقق النتائج فعلًا

تشريح أمر نصي جيد للدمج

تتبع الأوامر النصية القوية للدمج هذا النمط:

[Action verb] + [Subject from Image 1/2] + [Into/with Scene] + [Lighting instruction] + [Quality directive]

مثال: "ضع المرأة من الصورة 1 واقفة بشكل طبيعي على مسار الغابة في الصورة 2. طابق ضوء الصباح المتقطع الآتي من الأعلى. حافظ على ملمس بشرة واقعي كالصور الفوتوغرافية وظل ناعم تحت قدميها. تكامل سلس، بلا أي آثار مرئية للدمج."

كلما كنت أدق في اتجاه الضوء ومنطق الظلال، كان أداء النموذج أفضل.

أخطاء شائعة تُفسد الدمج

الخطأما الذي يحدثالحل
عدم وجود تعليمة للإضاءةاتجاهات ضوء غير متسقةحدّد "ضوء من [الاتجاه]"
الإفراط في وصف الأسلوبالنموذج يتجاهل تعليمات الدمجاجعل تعليمات الأسلوب في النهاية
بيئات متعارضةنتيجة غير واقعيةاختر بيئات تشترك في عنصر واحد
إغفال ذكر الظلأشخاص أو أشياء تبدو عائمةأضف "ظل طبيعي أسفل الشخص"
مصطلحات جودة عامةلا أثر لهااستخدم "واقعي كالصور الفوتوغرافية، 8K، حبيبات الفيلم"

لقطة مقربة لشاشة هاتف ذكي تعرض واجهة تطبيق لدمج الصور بالذكاء الاصطناعي، مع دمج بورتريهين في تركيب واحد

متى تستخدم أدوات أخرى في سير العمل

Flux Fill Pro لمشكلات الحواف

أحيانًا يكون الدمج مثاليًا تقريبًا، باستثناء تشوهات أو حواف غير طبيعية عند حدود الشخص. يعالج Flux Fill Pro هذه المشكلة. ارفع النتيجة المدمجة، وارسم قناعًا فوق الحواف المشكلة، ثم وجّه النموذج إلى ملئها بطريقة طبيعية. يقرأ النموذج السياق المحيط ويولّد بكسلات بديلة سلسة.

كما يتعامل مع توسيع الصورة، وهو مفيد عندما يكون الشخص في التركيب قريبًا جدًا من حافة الإطار ويحتاج إلى مساحة أكبر في اللوحة.

Realistic Vision لتفاصيل البورتريه

عندما يتضمن الدمج وجوهًا وتريد أقصى جودة واقعية كالصور الفوتوغرافية في البشرة، فإن Realistic Vision v5.1 ممتاز لمرور نهائي. أعد تغذية البورتريه المدمج مع تعليمات لزيادة التفاصيل في ملامح الوجه دون تغيير التكوين.

Flux 2 Pro للمخرجات عالية المخاطر

للمخرجات النهائية التي يجب أن تكون بجودة الطباعة أو تُستخدم في حملات احترافية، ينتج Flux 2 Pro أعلى دقة وأكثر النتائج واقعية كالصور الفوتوغرافية. استخدمه في مرور التوليد النهائي بعد التأكد من مفهوم التكوين باستخدام نماذج أسرع.

تقاطع شارع حيوي في مدينة نيويورك يندمج بسلاسة في منتصفه مع مسار غابة يابانية هادئ، تركيب مثالي لبيئتين مزدوجتين بالذكاء الاصطناعي

كيف تبدو النتائج فعلًا

لقد توسّع نطاق ما يستطيع دمج الصور بالذكاء الاصطناعي إنتاجه توسعًا كبيرًا. فيما يلي أمثلة حقيقية لأنواع من الدمج تنتج نتائج واقعية كالصور الفوتوغرافية وبجودة صالحة للنشر اليوم:

  • عارضة أزياء صُوّرت داخل منزل، ووُضعت على سطح منزل في سانتوريني مشمس، مع إبراز صحيح للبشرة ومحاذاة سليمة للأفق
  • صورتان لمبنيين معماريين مختلفين مدمجتان في واجهة موحدة واحدة تبدو منطقية فيزيائيًا
  • صورة منتج لساعة يدوية موضوعة على معصم عارضة من جلسة تصوير منفصلة تمامًا، مع تطابق لون البشرة وظل طبيعي
  • بورتريه لحيوان أليف وُضع في منظر طبيعي محدد من صورة سفر، مع تفاعل صحيح بين العشب وسطح الأرض

هذه ليست نتائج خيالية. إنها مخرجات يمكن تكرارها باستخدام الجيل الحالي من النماذج المتاحة على Picasso IA.

وجهان لعارضتين أزياء يقفان متقابلين، يندمجان تدريجيًا في المنتصف في وجه واحد موحد بسلاسة، يوضح دمج البورتريه المزدوج بالذكاء الاصطناعي

3 أمور لا تزال توقع الناس في الخطأ

نموذج خاطئ للمهمة

ليست كل النماذج تتعامل مع كل أنواع الدمج بالتساوي. استخدام نموذج عام لتحويل النص إلى صورة، مثل Flux Dev، لتركيب متعدد الصور تحتاج فيه إلى الحفاظ على الشخصين الأصليين، سيعطيك تفسيرًا عامًا لا دمجًا أمينًا. اختر النموذج الذي يناسب المهمة:

صور مصدر تتعارض مع بعضها

إذا حاولت دمج صورة التُقطت تحت شمس منتصف النهار الحارقة من الأعلى مع صورة التُقطت تحت ضوء استوديو ناعم وغائم، فلن ينتج أي نموذج نتيجة مقنعة، لأن الفيزياء ببساطة لا تتوافق. اختر صور مصدر تشترك في عالم ضوئي قابل للتصديق.

توقّع الكمال من المحاولة الأولى

عملية الدمج تكرارية. التوليد الأول يؤكد التكوين، والثاني يؤكد الإضاءة، والثالث يؤكد جودة الحواف. ثلاثة توليدات هي سير عمل طبيعي، وليست علامة على أن الأداة لا تعمل.

الآن دورك

لدى كل مصور ومصمم وعلامة تجارية ومبدع صور تنتظر دون استخدام لأنها لا تعمل بشكل جيد بمفردها. يغيّر دمج الصور بالذكاء الاصطناعي هذه المعادلة تمامًا. ذلك البورتريه المحرج بخلفية مملة يصبح صورة حملة سينمائية. وصورتا المنتج من جلستين مختلفتين تتحولان إلى مادة بصرية متماسكة واحدة.

النماذج على Picasso IA متاحة الآن. وMulti Image Kontext Pro هو أسرع طريقة لبدء دمج الصور الحقيقية في دقائق. ارفع صورتيك المصدر، واكتب تعليمة دمج واضحة باستخدام بنية الأوامر النصية الموضحة أعلاه، ثم شغّل أول توليد لك. العملية بسيطة فعلًا بمجرد أن تدرك أن جودة الأمر النصي هي ما يحدد جودة الدمج.

اختر صورتين من مكتبتك، وافتح Picasso IA، وشاهد ما يحدث عندما تتوقف عن التعامل مع صورك كأصول منفصلة، وتبدأ في التعامل معها كمكونات.

منتج عناية بالبشرة فاخر مدموج بإتقان فني داخل مشهد غابة مطيرة خضراء، يوضح دمج الصور بالذكاء الاصطناعي لمنتجات ونمط حياة بشكل احترافي

شارك هذا المقال

اختر لغتك

مقالات ذات صلة