كيف تصلح الوجوه المشوّهة في فيديو الذكاء الاصطناعي (دون فقدان الجودة)

تنتج الوجوه المشوّهة في فيديو الذكاء الاصطناعي عن عدم الاتساق الزمني، وضعف تكييف النقاط المرجعية للوجه، وانجراف الهوية بين الإطارات. يستعرض هذا المقال كل طرق الإصلاح المتاحة، من محررات الفيديو القائمة على الأوامر النصية إلى أدوات رفع الدقة على مستوى الإطارات، مع تعليمات خطوة بخطوة لإصلاح أي نوع من تشوّه الوجه بسرعة عبر أدوات إلكترونية على PicassoIA، دون تثبيت أي برنامج.

كيف تصلح الوجوه المشوّهة في فيديو الذكاء الاصطناعي (دون فقدان الجودة)
Cristian Da Conceicao
مؤسس Picasso IA

يعاني توليد فيديو الذكاء الاصطناعي من نقطة ضعف معروفة: الوجوه. سواء كنت تستخدم نموذج تحويل النص إلى فيديو لإنشاء مقطع قصير، أو ترفع دقة لقطات قديمة، فإن تشوّه ملامح الوجه هو الشكوى الأولى من صانعي المحتوى بخصوص الجودة. عيون تبتعد عن بعضها بين الإطارات، وفكوك تذوب في الرقبة، وشفاه تقفز إلى أوضاع مختلفة في منتصف الجملة، وهذه ليست أعطالًا عشوائية. إنها تتبع أنماطًا يمكن التنبؤ بها، وبمجرد أن تعرف أسبابها الجذرية، يمكنك إصلاحها بسرعة.

يغطي هذا المقال كل نهج عملي متاح اليوم: الوقاية قبل التوليد، وسير عمل الإصلاح بعد التوليد، والنماذج على PicassoIA المصممة خصيصًا لاستعادة جودة الوجه في فيديو الذكاء الاصطناعي والفيديو الحقيقي على حد سواء.

لماذا تشوّه فيديوهات الذكاء الاصطناعي الوجوه؟

السبب الجذري: عدم الاتساق الزمني

تعمل نماذج توليد الفيديو إطارًا تلو الآخر، أو عبر تسلسلات كامنة قصيرة. على عكس مولّد الصور الثابتة الذي يرسم الوجه مرة واحدة ثم يتوقف، يجب على نموذج الفيديو أن يحافظ على ذلك الوجه عبر عشرات أو مئات الإطارات. كل إطار هو خطوة تشغيل جديدة، وتتراكم الاختلافات الصغيرة في أوزان الانتباه وضوضاء الكامن والتكييف الزمني لتتحول إلى انجراف مرئي.

النتيجة: وجه يبدو صحيحًا في الإطار 1 ثم يبدأ بالتشوّه عند الإطار 15. وتتفاقم المشكلة مع المقاطع الأطول، والحركة الأسرع، والنماذج التي لم تُدرَّب على مجموعات بيانات كثيفة بالوجوه.

متى يحدث ذلك أكثر؟

تشوّه الوجه ليس عشوائيًا. إنه يتركّز حول ظروف محددة:

  • دوران الرأس وميلانه: الانتقال من الوجه بزاوية 3/4 إلى الوجه الأمامي الكامل يكشف عجز النموذج عن الحفاظ على الطوبولوجيا ثلاثية الأبعاد للوجه عبر الزمن.
  • الكلام أو حركة الفم: تتطلب حركة الشفاه دقة على مستوى الإطار تفتقر إليها معظم النماذج عند إعدادات الجودة القياسية.
  • التوليد بدقة منخفضة: تضغط الفضاءات الكامنة الصغيرة تفاصيل الوجه في كتل غير واضحة، ولا يمكن لرفع الدقة لاحقًا أن يستعيدها إلا جزئيًا.
  • تسلسلات التوليد الطويلة: أي مقطع يتجاوز 4 إلى 5 ثوانٍ يحتوي على وجه بارز معرّض لخطر الانجراف الزمني.
  • ضعف تحديد الأمر النصي: الأوامر النصية الغامضة تترك النموذج يستكمل ملامح الوجه بحرية بين الإطارات.

مقارنة وجه بالذكاء الاصطناعي على شاشة تعرض الوجه المشوّه والوجه المُصلح جنبًا إلى جنب

3 أنواع من تشوّه الوجه في فيديو الذكاء الاصطناعي

معرفة نوع التشوّه بدقة تغيّر استراتيجية الإصلاح تمامًا.

التشوّه حول حدود الوجه

هذا هو النوع الأكثر شيوعًا. يتسرّب الوجه نحو الخارج، وتتحرك عظام الخدّين، ويستدير خط الفك أو يصبح أكثر حدة بين الإطارات دون منطق واضح. وعلى الشاشة يبدو الوجه كأنه طين ناعم يُعاد تشكيله باستمرار. يسببه ضعف تكييف النقاط المرجعية في طبقات الانتباه الزمني للنموذج.

نهج الإصلاح: التعديل الموضعي على مستوى الإطار بنموذج يدرك الوجه، أو إعادة توليد كاملة مع تكييف أقوى للهوية.

الوميض بين الإطارات

يبدو الوجه صحيحًا في معظمه لكنه يومض في السطوع أو اللون أو التفاصيل الدقيقة. يتغيّر لون البشرة بين الإطارات. ويتغيّر لون العين لحظات قصيرة. وهذا فشل في الاتساق الزمني على مستوى الملمس، لا على مستوى الهندسة.

نهج الإصلاح: التنعيم الزمني عبر أدوات رفع دقة الفيديو، أو رفع الدقة بنموذج يتضمن إزالة الضوضاء الزمنية.

فقدان الهوية بين الإطارات

يبدو الشخص في الإطار 1 مختلفًا بوضوح عن الشخص في الإطار 30. الشعر نفسه، لكن الأنف مختلف. وهذه مشكلة انجراف في الهوية، إذ فقد النموذج الهوية الوجهية المحددة للشخص أثناء التوليد.

نهج الإصلاح: إعادة التوليد مع تكييف بصورة مرجعية، أو إعادة تحرير على مستوى المقاطع باستخدام أدوات مثل LTX 2 Retake التي تتيح لك استهداف مقاطع زمنية محددة من الفيديو.

خط زمني لتحرير الفيديو يعرض مفاتيح تصحيح الوجه ودرجات ثقة اكتشاف الذكاء الاصطناعي

أصلِح الأمر قبل التوليد

الإصلاح الأرخص هو الوقاية. هذه التغييرات في سير عمل التوليد تقلل تشوّه الوجه بشكل كبير قبل أن تحتاج إلى إصلاح أي شيء.

هندسة الأوامر من أجل وجوه مستقرة

يكتب معظم صانعي المحتوى أوامر تصف المشهد لكنها لا تصف الوجه. وهذا يجبر النموذج على تخيّل تفاصيل الوجه، ما يؤدي مباشرة إلى عدم الاتساق. نهج أفضل:

  • كن محددًا بشأن بنية الوجه: عبارة "عظام خدّين حادة ومحددة، وجه بيضاوي متماثل، عينان بنيتان فاتحتان مع تفاصيل واضحة للقزحية" تمنح النموذج نقاط ارتكاز يحتفظ بها عبر الإطارات.
  • تجنّب أفعال الحركة التي تسبب تحريك الرأس: عبارة "ينظر مباشرة إلى الكاميرا، ابتسامة خفيفة، دون حركة في الرأس" تحافظ على ثبات الوجه.
  • أضف مرتكزات للجودة: عبارة "ملمس بشرة واقعي كالصور الفوتوغرافية، تفاصيل مسام طبيعية، تناسب ثابت للوجه عبر الإطارات" تُشير للنموذج بأن جودة الوجه أولوية في المخرجات.

💡 نصيحة: الأوامر النصية السلبية أهم للوجوه منها للخلفيات. أضف "وجه مشوّه، عينان غير متماثلتين، فك متحوّل الشكل، ملامح ضبابية، بشرة منخفضة التفاصيل" إلى الأمر النصي السلبي في كل توليد.

قفل البذرة وتكييف الهوية

إذا كان النموذج يتيح التحكم في قيمة البذرة، فإن تثبيتها بين محاولات التوليد يمنحك ضوضاء بداية متسقة. وبالجمع مع مدخلات الصور المرجعية، يمكنك تثبيت النموذج على هوية وجهية محددة طوال المقطع.

تدعم بعض النماذج تكييف الصورة، حيث تزوّد النموذج بصورة شخصية كإطار مرجعي. وهذا يقلل انجراف الهوية بشكل كبير عبر التسلسلات الأطول. تتيح أدوات مثل P Video Edit تعديلات موجّهة بالنص تثبّت مناطق الوجه عبر تعليمات بلغة طبيعية دون إعادة التوليد من الصفر.

منظر علوي من الأعلى لمكتب محرر فيديو مع شبكة سلكية لاستعادة الوجه على الشاشات

طرق الإصلاح بعد التوليد

عندما يكون الفيديو قد وُلّد بالفعل والوجوه مشوّهة، لديك ثلاثة مسارات رئيسية للإصلاح.

الاستعادة إطارًا بإطار

استخرج الإطارات الفردية من الفيديو، واستعِدْ كل وجه على حدة باستخدام نموذج استعادة الصور، ثم أعد تجميعها. هذه أدق طريقة لكنها الأبطأ أيضًا. وتعمل بشكل أفضل مع المقاطع القصيرة التي تقل عن 10 ثوانٍ، حيث تكون السلاسة الزمنية أقل أهمية.

الخطوات:

  1. صدّر الفيديو كإطارات PNG فردية.
  2. مرّر كل إطار عبر نموذج استعادة الوجه.
  3. استخدم Real ESRGAN Video لرفع دقة متسقة إلى 4K عبر جميع الإطارات.
  4. أعد تجميع الإطارات في فيديو مع الصوت الأصلي.

بالنسبة لخطوة استعادة الصورة على الإطارات الفردية، تنتج Clarity Pro Upscaler استعادة ممتازة لتفاصيل الوجه لأنها تعامل البنية الدقيقة للوجه كمخرجات ذات أولوية. أما Crystal Upscaler فمُعدّة خصيصًا لرفع دقة صور البورتريه، وتعمل بشكل جيد بصورة خاصة على الوجوه، إذ تستعيد تفاصيل دقيقة مثل المسام وأهداب العين وملمس الشفاه التي تدمّرها عيوب التمويه.

محررات فيديو الذكاء الاصطناعي التي تعيد كتابة الوجوه

النهج الأسرع هو محرر فيديو زمني يمكنه إعادة كتابة مناطق محددة عبر جميع الإطارات في آن واحد. تستخدم هذه الأدوات أوامر نصية أو صورًا مرجعية لتوجيه الإصلاح.

الأداةالنهجأفضل استخدام
Aleph 2تعديل إطار واحد ونشره على الفيديو كاملًاثبات الهوية
LTX 2 Retakeاستهداف مقاطع محددة وإعادة تصييرهاالتشوّه الموضعي
P Video Editتعديلات موجّهة بالأوامر النصيةإصلاحات عامة سريعة
Lucy Edit 2تعديلات تحويل النص إلى فيديو في الوقت الفعليإصلاحات أسلوبية سريعة
Kling o1إعادة كتابة الفيديو كاملًا من مرجعحالات التشوّه الشديد

💡 رؤية احترافية: للتشوّه الشديد، تقدم Gen 4 Aleph إعادة صياغة بجودة سينمائية مع ثبات أقوى للوجه بكثير من نماذج تحويل النص إلى فيديو القياسية. وقد صُمّمت خصيصًا لسير عمل إعادة القص وإعادة الصياغة، حيث يجب الحفاظ على البنية الأصلية مع تصحيح الوجه.

أيدي على لوحة مفاتيح ميكانيكية مع ظهور اكتشاف النقاط المرجعية للوجه على الشاشة الخلفية

رفع الدقة لاستعادة التفاصيل

الدقة هي أبسط بُعد للإصلاح، ولها تأثير حقيقي على جودة الوجه المُدرَكة. وجه بدقة 480p مع تمويه زمني يبدو مزعجًا. أما الوجه نفسه بدقة 4K مع ملمس مستعاد فيبدو مقبولًا حتى لو كانت الهندسة مختلّة قليلًا.

يُعد Video Upscale by Topaz Labs المعيار الصناعي لهذا الغرض. يستخدم رفعًا للدقة بالذكاء الاصطناعي مدرّبًا خصيصًا للفيديو الحقيقي، لا للصور الثابتة فقط، ويتعامل مع الوجوه بشكل جيد لأن بيانات تدريبه تتضمن محتوى كثيف بالوجوه. ويولي النموذج اهتمامًا خاصًا للتفاصيل الوجهية عالية التردد: أهداب العين، والتجاعيد الدقيقة للبشرة، وأنماط القزحية.

يتبع Upscale v1 by RunwayML نهجًا مختلفًا باستخدام رفع الدقة في الفضاء الكامن، ما يحافظ على الطابع الزمني للتوليد الأصلي مع رفع الدقة. وكلاهما متاح مباشرة على PicassoIA دون تثبيت أي برنامج.

أدوات PicassoIA التي تصلح الوجوه المشوّهة

تضم PicassoIA عدة أدوات تعالج جودة الوجه في الفيديو مباشرة. إليك كيفية استخدام كل واحدة منها بشكل استراتيجي.

Video Upscale لاستعادة التفاصيل

يأخذ Video Upscale by Topaz Labs الفيديو الخاص بك ويطبّق نموذج رفع دقة مدرّبًا يتخصص في استعادة التفاصيل الوجهية الدقيقة: المسام، وخصلات الشعر الرفيعة، وملمس القزحية، ووضوح الشفاه. وهذا لا يصلح التشوّه الهندسي مثل الفكوك الذائبة أو العيون المتحركة، لكنه يقلل بشكل كبير الحدة المرئية للوميض الزمني وعيوب التمويه.

متى تستخدمه: بعد أي توليد لفيديو بالذكاء الاصطناعي، وقبل التصدير النهائي. حتى الفيديوهات التي لا يظهر فيها تشوّه مرئي تستفيد من هذه الخطوة، لأنها تستعيد التفاصيل الدقيقة التي تضيع أثناء التوليد.

امرأة راضية تشاهد فيديو الذكاء الاصطناعي المُستعاد على حاسوب محمول، مع ضوء نافذة الصباح خلفها

P Video Edit للإصلاحات الموجّهة بالنص

يقبل P Video Edit أمرًا نصيًا يصف ما ينبغي تغييره. يمكنك أن تكتب "أصلح تناسب الوجه، وحدّد خط الفك، وثبّت العينين عبر الإطارات" فيطبق النموذج هذه التصحيحات مع الحفاظ على كل شيء آخر في المقطع.

هذا هو أسرع مسار إصلاح للتشوه الخفيف إلى المتوسط. ويعمل بأفضل شكل عندما:

  • تكون بنية الوجه صحيحة في معظمها لكنها تحتاج إلى زيادة الحدة.
  • يحتاج وميض لون البشرة إلى تثبيت.
  • يلزم تصحيح انجراف طفيف في معالم الوجه دون إعادة توليد كاملة.

Aleph 2 و LTX 2 Retake

يستخدم Aleph 2 سير عمل "تعديل الإطار الواحد": تصحّح إطارًا واحدًا ليبدو تمامًا كما تريد، فينشر النموذج هذا التصحيح إلى الخلف والأمام عبر المقطع كله. وبالنسبة لتشوّه الوجه حيث يكون إطار واحد صحيحًا والآخرون ينجرفون، فإن هذا النهج فعّال للغاية.

يعمل LTX 2 Retake على أساس المقاطع. تحدد نطاقًا زمنيًا، مثل من 2.3 ثانية إلى 4.7 ثانية، ثم تعيد تصيير تلك الإطارات فقط بمعاملات جديدة. وهذا مثالي للمقاطع التي يكون معظم الفيديو فيها سليمًا لكن لحظة واحدة محددة فيها ارتفاع حاد في تشوّه الوجه. فتتجنب إعادة توليد المقطع كله مع الحصول على نتيجة نظيفة.

لقطة مقرّبة كبيرة لوجه واقعي كالصور الفوتوغرافية مُستعاد بإتقان على شاشة عالية الدقة

Real ESRGAN Video

Real ESRGAN Video أداة رفع دقة على مستوى الإطار، فهي تعالج كل إطار على حدة ثم تعيد دمج الإطارات. وعلى خلاف أدوات رفع الدقة المصممة للفيديو أصلًا، ليس لديها إدراك زمني، ما يعني أنها قد تُحدث وميضًا طفيفًا في بعض المحتوى. لكنها في استعادة الوجوه تحديدًا تزيد حدة التفاصيل بقوة أكبر من أدوات رفع الدقة الزمنية، فتكون الخيار المناسب عندما تكون أقصى حدة للوجه أولوية على سلاسة الحركة.

أفضل حالة استخدام: لقطات الوجوه الثابتة أو بطيئة الحركة حيث تكون الحدة أهم من السلاسة الزمنية.

Video Increase Resolution

يرفع Video Increase Resolution by Bria الدقة إلى 8K ويتضمن معالجة مدمجة لاستعادة الوجه. وهو أسهل الأدوات للصانعين الذين يريدون حلًا بخطوة واحدة: ارفع الفيديو، واحصل على نسخة بدقة أعلى مع جودة وجه محسّنة، دون أي إعدادات يدوية. وبالنسبة لمن يبدأ في إصلاح الفيديو، فهذه هي نقطة البداية الصحيحة.

ثلاثة محررين فيديو يتعاونون حول شاشة منحنية تعرض شبكة تقييم جودة تصحيح الوجه

الإصلاح خطوة بخطوة على PicassoIA

إليك سير عمل الإصلاح الكامل لفيديو ذكاء اصطناعي يحتوي على وجه مشوّه باستخدام أدوات PicassoIA.

الخطوة 1: تحديد نوع التشوّه

شغّل الفيديو بسرعة 0.25x. حدّد ما إذا كانت المشكلة:

  • هندسية (فكوك أو عيون تتحرك موضعها بين الإطارات)
  • ملمسية (وميض البشرة، أو التمويه، أو عدم اتساق اللون)
  • متعلقة بالهوية (وجه الشخص يتغير عبر المقطع)

الخطوة 2: اختيار مسار الإصلاح

الخطوة 3: تشغيل الإصلاح

ارفع الفيديو الخاص بك إلى PicassoIA، واختر النموذج المناسب، واضبط الأمر النصي أو المعاملات بحسب نوع التشوّه، ثم أرسل. تعيد معظم النماذج النتائج في أقل من دقيقتين للمقاطع التي تصل إلى 30 ثانية.

الخطوة 4: تطبيق رفع الدقة النهائي

بغض النظر عن نموذج الإصلاح الذي استخدمته، شغّل المخرجات دائمًا عبر Video Upscale أو Real ESRGAN Video كخطوة أخيرة. فهذا يسوّي ما تبقى من العيوب الدقيقة ويمنح المخرجات النهائية مظهرًا مصقولًا بجودة البث.

💡 اجمع أدواتك: تأتي أفضل النتائج من الجمع بين أداة إصلاح هندسية (Aleph 2 أو P Video Edit) ورافع دقة (Topaz Video Upscale) بالتتابع. كل أداة تعالج بُعدًا مختلفًا من المشكلة.

الخطوة 5: فحص الجودة

صدّر مقطعًا قصيرًا أولًا. شاهده بالحجم الكامل على شاشة كبيرة. وتحقق من:

  • ثبات الفك وعظام الخدّين عبر المقطع كله.
  • ثبات موضع العينين بين الإطارات.
  • تجانس لون البشرة دون وميض.
  • نطق الفم الذي يطابق سرعة الحركة الطبيعية.

إذا فشل أي من هذه الفحوص، فحدّد النطاق الزمني الأسوأ واستخدم LTX 2 Retake لإعادة تصيير ذلك المقطع تحديدًا.

إعداد استوديو منزلي بشاشتين يعرض وجهًا مشوّهًا على اليسار ووجهًا مصححًا على اليمين

متى تعيد التوليد ومتى تصلح؟

ليس كل فيديو مشوّه يستحق الإصلاح. بعضها يُفضّل إعادة توليده من الصفر. يساعدك جدول القرار هذا على الاختيار:

الحالةالإجراء
الوجه صحيح في أول ثانيتين لكنه ينجرف بعد ذلكأصلحه باستخدام LTX 2 Retake على الجزء المنجرف
الوجه مشوّه منذ الإطار الأولأعد التوليد بتهيئة أفضل للأمر النصي
التشوه نسيجي بحت (ضبابية أو وميض)أصلحه باستخدام Video Upscale
تتغير الهوية كليًا في منتصف الفيديوأعد التوليد باستخدام صورة مرجعية كمدخل
تلألؤ طفيف على البشرة فقطأصلحه باستخدام Video Increase Resolution
يذوب الفك في 30% أو أكثر من الإطاراتأعد التوليد، فهو أسرع من الإصلاح

💡 قاعدة عامة: إذا كان الإصلاح سيستغرق وقتًا أطول من إعادة التوليد، فأعد التوليد. مع نماذج التوليد السريعة اليوم على PicassoIA، يمكن إعادة توليد مقطع مدته 5 ثوانٍ في أقل من دقيقة بمعاملات معدّلة.

عندما تعيد التوليد، فإن أكثر تغيير مؤثر يمكنك إجراؤه هو إضافة صورة شخصية مرجعية. النماذج التي تقبل مدخلات الصور لتكييف هوية الوجه، مثل Luma Modify Video أو Wan 2.7 Videoedit، تحافظ على ثبات الوجه بشكل أفضل بكثير من التوليد بالنص فقط، لأن لديها مرتكزًا بصريًا تعود إليه في كل إطار.

وبالنسبة للمشكلات الملمسية البحتة، يعمل مسار رفع دقة الصور جيدًا أيضًا على الإطارات المستخرجة. يستعيد P Image Upscale التفاصيل في أقل من ثانية لكل إطار، ويوفر Real ESRGAN بعامل 4x حدة قوية للوجه عندما تحتاج إلى استعادة قوية للتفاصيل في مادة مصدر ضبابية أو منخفضة الدقة بشكل خاص.

شخص يحمل هاتفًا ذكيًا يعرض تصحيح الوجه بالذكاء الاصطناعي مطبّقًا في الوقت الفعلي داخل شقة

أصلِح الوجوه المشوّهة الآن على PicassoIA

تتوفر كل الأدوات المذكورة في هذا المقال على PicassoIA دون الحاجة إلى تنزيل أي برنامج، أو إعداد GPU، أو أي ضبط تقني. ارفع الفيديو الخاص بك، واختر نموذجًا، واحصل على النتائج خلال ثوانٍ.

من أجل استعادة الوجه تحديدًا، فإن أسرع المسارات هي:

  1. P Video Edit لإصلاحات الأوامر النصية للتشوّه الخفيف إلى المتوسط.
  2. Video Upscale لاستعادة الحدة والتفاصيل في أي مقطع.
  3. Aleph 2 لإصلاحات الاتساق من إطار واحد إلى الفيديو كاملًا.

هذه الأدوات الثلاث، عند استخدامها بالتتابع، تحل الغالبية العظمى من حالات تشوّه الوجه دون أي تحرير يدوي للإطارات. كما تتيح لك PicassoIA الوصول إلى مجموعة كاملة من نماذج رفع دقة الصور الفائقة، بما في ذلك Clarity Pro Upscaler و P Image Upscale، وهي مفيدة عندما تحتاج إلى إصلاح إطارات فردية مستخرجة من مقطع مشوّه وتريد أقصى حدة قبل إعادة التجميع.

يتطور مجال جودة فيديو الذكاء الاصطناعي بسرعة. النماذج التي تواجه صعوبة في ثبات الوجه اليوم يجري استبدالها ببنى أحدث تعامل ثبات الوجه الزمني كمتطلب أساسي للمخرجات. وفي الأثناء، تمنحك الأدوات أعلاه كل ما تحتاجه لإنتاج نتائج نظيفة خالية من التشوّه الآن.

أحضر فيديو الذكاء الاصطناعي المشوّه الخاص بك إلى PicassoIA وشاهد الفرق الذي يحدثه سير عمل الإصلاح الصحيح.

مؤلف ألوان محترف في استوديو سينمائي داكن يعمل على تدرج جودة الوجه عبر أربع شاشات

شارك هذا المقال

اختر لغتك

مقالات ذات صلة