كيف تنشئ فيديوهات ذكاء اصطناعي بشخصيات ثابتة في Veo 3.1

يمكن لنموذج Veo 3.1 توليد فيديوهات ذكاء اصطناعي تحافظ على ثبات الشخصيات عند استخدامه مع بنية أوامر نصية مناسبة. يشرح هذا المقال طريقة "كتاب الشخصية"، وتقنيات تثبيت قيمة البذرة، وسير العمل متعدد المشاهد، وأفضل نماذج PicassoIA للحفاظ على الهوية البصرية في كل مقطع تنشئه.

كيف تنشئ فيديوهات ذكاء اصطناعي بشخصيات ثابتة في Veo 3.1
Cristian Da Conceicao
مؤسس Picasso IA

الحفاظ على الشخصية نفسها عبر عدة مقاطع فيديو بالذكاء الاصطناعي من أصعب المشكلات في إنتاج فيديو الذكاء الاصطناعي حاليًا. في مشهد تكون بطلتك ذات عينين بنيتين دافئتين وشعر داكن يصل إلى الكتفين. وفي المشهد التالي تكون عيناها أفتح، وشكل فكها مختلف، وملابسها تغيّرت تمامًا. يحدث هذا في شبه كل النماذج، ولكل من يبني سلسلة أو فيلمًا قصيرًا أو حملة لعلامة تجارية، فإن هذا التباين يُفسد العمل قبل أن يصل إلى الجمهور.

مخرج إبداعي يدرس واجهة تحويل النص إلى فيديو في استوديو منزلي بسيط

يعالج Veo 3.1 هذه المشكلة بشكل أكثر مباشرة من سابقيه. لكنه لا يحلّها بالكامل تلقائيًا، غير أنك باستخدام استراتيجيات الأوامر النصية الصحيحة، وأنظمة المراجع للشخصيات، وانضباط سير العمل، يمكنك إنتاج فيديوهات ذكاء اصطناعي متعددة المشاهد تبدو فيها شخصياتك كأنها الشخص نفسه في كل مقطع.

هذا بالضبط ما سنشرحه الآن.

لماذا تتغير الشخصيات بين المشاهد

السبب الجذري في نماذج تحويل النص إلى فيديو

تولّد نماذج تحويل النص إلى فيديو كل مقطع كعملية أخذ عينات مستقلة. ولا تحتفظ بذاكرة لشكل الشخصية في توليد سابق ما لم تمنحها مراسي واضحة ومنظمة. يفسّر النموذج أمرك النصي من جديد في كل مرة. وتغيير بسيط في الصياغة، حتى مجرد نقل عبارة إلى موضع مختلف داخل الأمر، قد يغيّر وجه الشخصية ولون بشرتها وتناسب ملامحها بشكل ملحوظ.

تتفاقم المشكلة مع الأوصاف الغامضة. فكتابة "امرأة بشعر داكن" تمنح النموذج مساحة واسعة جدًا. فالشعر الداكن قد يكون أسود فاحمًا أو بنيًا شوكولاتيًا. وقد يكون قصيرًا أو طويلًا، مجعدًا أو مستقيمًا. يختار النموذج ما يناسب توزيعه الاحتمالي في تلك اللحظة، وهذا يتغير مع كل تصيير.

ما الذي يفعله Veo 3.1 بشكل مختلف

قدّم Veo 3.1 تماسكًا زمنيًا محسّنًا، أي أن النموذج أفضل في الحفاظ على الاتساق البصري داخل المقطع الواحد. أما عبر المقاطع، فما زال عليك إدارة الاتساق بنفسك من خلال بنية أوامرك النصية.

يقايض الإصدار السريع جزءًا من هذا التماسك مقابل السرعة، وهو مناسب للتكرارات الأولية لكنه ليس الخيار الأمثل للمشاهد النهائية ذات الشخصيات الثابتة.

💡 فرق مهم: التماسك الزمني (داخل المقطع) قدرة في النموذج. أما الاتساق عبر المقاطع فهو انضباط في سير العمل. وهذا الجزء من مسؤوليتك أنت.

لقطة مقربة ليدين تكتبان بسرعة على لوحة مفاتيح مضاءة من الخلف في غرفة إنتاج خافتة الإضاءة

بناء نظام مراجع الشخصية

قبل أن تكتب أي أمر نصي لنموذج Veo 3.1، تحتاج إلى وثيقة مرجعية للشخصية. هذه أهم خطوة في سير العمل بأكمله. فبدونها، ستنحرف شخصيتك مهما كانت تقنيتك في كتابة الأوامر جيدة.

طريقة كتاب الشخصية

كتاب الشخصية هو كتلة نص ثابتة تنسخها وتلصقها حرفيًا في كل أمر خاص بتلك الشخصية. يحدد هذا الكتاب المراسي البصرية غير القابلة للتفاوض. تبنيه مرة واحدة ولا تغيّره أثناء المشروع.

إليك مثالًا على البنية:

السمةالقيمة المحددة
الشعرشعر أسود مستقيم، مقصوص أسفل الكتفين مباشرة، مع تموّج طبيعي خفيف عند الأطراف
العينانعينان بنيتان داكنتان بشكل لوزي، مع خط رموش علوي كثيف
البشرةبشرة ذهبية بنية دافئة، مع نمش خفيف على جسر الأنف
الوجهشكل بيضاوي، عظام وجنتين بارزة، خط فك ناعم
البنية الجسديةبنية رياضية نحيفة، بطول تقريبي 5'6"
الزي المميزسترة كارغو خضراء داكنة ضيقة بسحّاب نحاسي، تُرتدى فوق قميص داخلي أبيض بأضلع

كل تفصيل هنا محدد. ليس "شعر داكن"، بل "شعر أسود مستقيم، مقصوص أسفل الكتفين مباشرة، مع تموّج طبيعي خفيف عند الأطراف". فالتحديد هو ما يسلب النموذج حرية الانحراف عنك.

السمات الجسدية التي يجب تحديدها دائمًا

هذه هي السمات التي تنحرف عنها النماذج غالبًا. ثبّت كل واحدة منها:

  • الشعر: اللون والطول ونمط القصة والملمس وطريقة انسدالها الطبيعية
  • العينان: اللون والشكل وأي ملمح مميز (كثافة الرموش، الكحل، إلخ)
  • لون البشرة: وصف دقيق، لا مجرد "فاتحة" أو "داكنة"
  • شكل الوجه: بيضاوي أو دائري أو مربع أو على شكل قلب
  • الطول والبنية: تناسب تقريبي بالنسبة للكادر
  • الزي المميز: زي واحد ثابت للمشاهد عالية الاستمرارية
  • أي ملمح مميز: ندبة، شامة، نظارات، مجوهرات، وشم

أوراق مراجع الشخصيات منتشرة على مكتب خشبي لصانع أفلام مع توثيق مكتوب بخط اليد لسمات الشخصية

كتابة أوامر نصية تثبّت الاتساق

بعد أن أصبح كتاب الشخصية جاهزًا، تأتي الخطوة التالية وهي بناء أوامر Veo 3.1 بحيث يرسّخ وصف الشخصية التوليد في كل مرة.

تقنية عبارة الارتكاز

ابدأ دائمًا أمرك النصي بكتلة كتاب الشخصية. لا تدفنها في الوسط. فالنماذج تعطي التوكنات الأولى وزنًا أكبر، لذا فإن البدء بالوصف الجسدي يمنح سمات الشخصية أكبر تأثير على الناتج.

بنية أمر نصي تنجح:

[Character Bible Block] + [Action] + [Environment] + [Lighting and Atmosphere] + [Camera Direction]

مثال:

"امرأة بشعر أسود مستقيم مقصوص أسفل الكتفين مباشرة مع تموّج طبيعي خفيف، وعينان بنيتان داكنتان بشكل لوزي، وبشرة ذهبية بنية دافئة مع نمش خفيف على الأنف، ترتدي سترة كارغو خضراء داكنة ضيقة بسحّاب نحاسي فوق قميص داخلي أبيض بأضلع، تمشي في شارع طوكيو ممطر ليلًا، مع لافتات نيون تنعكس على برك ماء ضحلة، لقطة متوسطة، حركة كاميرا تتبع الشخصية، سينمائي."

لاحظ أن كتلة الشخصية تتقدم، ثم يأتي الفعل والبيئة بعدها. هذا الترتيب ليس اختياريًا.

الأمر النصي السلبي للاستقرار

عندما تدعم الواجهة ذلك، استخدم الأوامر النصية السلبية لمنع أكثر تنويعات الانحراف شيوعًا:

blonde hair, blue eyes, light skin, red outfit, short hair, different face

يمنع هذا النموذج من الانزلاق إلى أعلى تكويناته احتمالًا للشخصية، ويجبر التوليد على البقاء داخل الفضاء البصري الذي حددته.

💡 نصيحة: احتفظ بوثيقة "كتلة الشخصية السلبية" إلى جانب كتاب الشخصية الرئيسي. الصق الاثنين في كل توليد. أحدهما يحدد ما هي الشخصية، والآخر يحدد ما ليست عليه.

منظر عام لاستوديو إنتاج أنيق فيه ثلاث شاشات تعرض إطارات شخصية ذكاء اصطناعي متسقة عبر مشاهد مختلفة

كيفية استخدام Veo 3.1 على PicassoIA

Veo 3.1 متاح مباشرة على PicassoIA دون أي إعداد. إليك العملية الكاملة خطوة بخطوة لإنتاج فيديو بشخصيات ثابتة.

الخطوة 1: افتح النموذج

انتقل إلى صفحة نموذج Veo 3.1 على PicassoIA. سترى حقل إدخال النص لأمرك النصي. وإذا كنت تعمل على تكرارات أولية أو تختبر أفكار المشاهد، فإن Veo 3.1 Fast متاح أيضًا، ويعالج بسرعة أكبر بكثير مع تنازل بسيط في الجودة في مرحلة المسودات.

الخطوة 2: الصق كتاب الشخصية أولًا

افتح وثيقة كتاب الشخصية. انسخ كتلة الوصف الجسدي كاملة والصقها في بداية حقل الأمر تمامًا. ثم أضف تفاصيل المشهد من فعل وبيئة وعناصر سينمائية بعدها.

لا تُعِد صياغة وصف الشخصية بين المشاهد. ولا تختصره. استخدم الصياغة نفسها تمامًا التي حدّدتها في كتاب الشخصية. فحتى أي تعديل طفيف في الصياغة يُحدث اختلافًا دلاليًا كافيًا لتغيير المظهر البصري للشخصية.

الخطوة 3: هيكل أوامر المشاهد المتعددة

في مشروع متعدد المشاهد، أنشئ قائمة مرقمة من الأوامر النصية في وثيقة منفصلة قبل التوليد:

  1. المشهد 1: [Character Bible] + walking through a rainy street at night, neon reflections, medium shot
  2. المشهد 2: [Character Bible] + sitting at a café window, warm morning light, close-up shot
  3. المشهد 3: [Character Bible] + running across a rooftop at dusk, wide establishing shot

كتلة كتاب الشخصية متطابقة في الثلاثة. ما يتغير فقط هو الفعل والبيئة وتوجيه الكاميرا.

الخطوة 4: ثبّت قيمة البذرة

إذا كان Veo 3.1 يعرض معامل البذرة في الواجهة، فسجّل قيمة بذرة أفضل توليد لشخصيتك. استخدم قيمة البذرة نفسها تمامًا لكل مشهد لاحق يظهر فيه تلك الشخصية. وهذه أقوى أداة متاحة لك لتحقيق الاتساق.

💡 ملاحظة سير العمل: ولّد مرتين إلى ثلاث مرات من كل مشهد أولًا. اختر الأكثر دقة في تمثيل سمات كتاب الشخصية. ثم ثبّت قيمة البذرة تلك قبل الانتقال إلى المشهد التالي.

امرأة تبتسم أمام حاسوبها المحمول يظهر عليه منصة توليد فيديو بالذكاء الاصطناعي في نافذة مقهى مشرقة

نظرة سريعة على معاملات أوامر Veo 3.1

المعاملما يجب فعله
ترتيب الأمركتاب الشخصية أولًا، ثم الفعل، ثم البيئة
الأمر النصي السلبياذكر أي سمات لا تملكها الشخصية
البذرةاستخدم قيمة ثابتة لكل المشاهد التي تحمل الشخصية نفسها
إصدار النموذجVeo 3.1 للنهائي، وVeo 3.1 Fast للمسودات
مدة المقطعاستخدم المدة القياسية في المحاولة الأولى قبل الالتزام

نماذج أخرى تستحق التجربة للاتساق

يعد Veo 3.1 خيارًا أساسيًا قويًا، لكنه ليس الخيار الوحيد على PicassoIA لهذا السير. وبحسب نوع مشروعك، تقدم هذه النماذج نقاط قوة مكمّلة.

Kling V3 Motion Control

يتيح لك Kling V3 Motion Control نقل الحركة من فيديو مرجعي مباشرة إلى شخصيتك. وهذا مفيد بشكل خاص إذا كانت لديك بالفعل صورة شخصية ثابتة وتريد تحريكها بحركات محددة، بدلًا من الاعتماد على الوصف النصي وحده للحركة.

سير العمل: ولّد أولًا صورة شخصية ثابتة للشخصية، ثم أدخل تلك الصورة مع فيديو مرجعي للحركة إلى Kling V3 Motion Control. ستكتسب شخصيتك نمط الحركة مع احتفاظها بهويتها البصرية من صورة المرجع.

DreamActor-M2.0 لتحريك الصور الشخصية

يتخصص DreamActor-M2.0 من ByteDance في تحريك صورة شخصية واحدة. وإذا ولّدت شخصيتك أو التقطتها مرة واحدة بثبات بصري قوي، ينتج DreamActor عدة مقاطع متحركة تعتمد جميعها على الصورة المصدر نفسها. وهذه من أكثر الطرق موثوقية للاتساق عبر المقاطع، لأن المرساة البصرية هنا صورة حقيقية وليست وصفًا نصيًا.

💡 نصيحة سير العمل: ولّد صورة مرجعية لشخصيتك باستخدام نموذج تحويل النص إلى صورة، وتأكد أنها تطابق كتاب الشخصية بدقة، ثم استخدم DreamActor-M2.0 لتحريك مشاهد مختلفة. تصبح الصورة قفل الاتساق لديك.

امرأة محترفة بشعر بني محمر تحمل جهازًا لوحيًا يعرض مصغرات شخصيات في مكتب تقني حديث

Wan 2.2 Animate Replace

يتبع Wan 2.2 Animate Replace نهجًا مختلفًا، إذ يستبدل شخصية في مقطع فيديو موجود بشخصيتك المخصصة استنادًا إلى مدخل مرجعي. وهذا مثالي عندما يكون لديك مشهد يحمل الفعل الصحيح وحركة الكاميرا المناسبة، لكنك تحتاج إلى إدخال شخصيتك. يوفّر المقطع الأصلي الحركة والبيئة، بينما يوفّر وصف شخصيتك الهوية البصرية.

ويستحق التجربة أيضًا في حالات استخدام محددة:

  • Kling Avatar V2 لمقاطع الشخصيات القائمة على الأفاتار مع اتساق قوي للوجه
  • Hailuo 2.3 للمقاطع ذات الطابع السينمائي التي تحافظ على تفاصيل الشخصية في اللقطات المقربة
  • Gen-4.5 by Runway للمشاهد عالية الحركة التي يجب أن تحافظ فيها هوية الشخصية على ثباتها مع الحركة السريعة

منظر جوي من الأعلى لمساحة عمل إبداعية لصانع أفلام تضم دفاتر ولوحة مفاتيح وملاحظات شخصيات مرمّزة بالألوان

3 أخطاء تكسر الاتساق في كل مرة

حتى مع الأدوات الصحيحة، ستقوّض هذه الأخطاء الثلاثة استمرارية شخصيتك بغض النظر عن النموذج الذي تستخدمه.

الأوصاف الجسدية الغامضة

"امرأة طويلة بشعر داكن" ليست وصفًا لشخصية. إنها مجرد اقتراح. يملأ النموذج كل مساحة غير محددة بتفسيره الخاص، ويتغير هذا التفسير بين التوليدات.

الحل: تحتاج كل سمة جسدية إلى صفتين محددتين على الأقل. لون الشعر وملمسه وطوله معًا. لون العينين وشكلهما معًا. لون البشرة وأي علامة مميزة معًا.

تغيير بنية الأمر بين المشاهد

إذا ظهر كتاب الشخصية في الموضع الأول في المشهد 1 وفي الموضع الثالث في المشهد 3، فإن النموذج سيمنح الوصف أوزانًا مختلفة. ستنحرف الشخصية رغم أن النص متطابق.

الحل: ابنِ قالبًا صارمًا للأمر. يتقدم كتاب الشخصية دائمًا، ويليه الفعل ثانيًا، ثم البيئة ثالثًا. وتأتي الكاميرا والإضاءة أخيرًا. لا تحِد عن هذا الترتيب أبدًا عبر مشروعك كله.

تجاهل إعدادات البذرة

كل توليد دون بذرة ثابتة مجازفة بنتيجة مختلفة في كل مرة. فأمران بنص متطابق ينتجان شخصيتين مختلفتين الشكل لأن تهيئة الضوضاء تختلف في كل مرة.

الحل: سجّل بذرة أفضل توليد لديك. استخدم تلك البذرة لكل المشاهد اللاحقة التي تحمل الشخصية. وإذا لم يعرض النموذج إدخال البذرة، فالتقط لقطة شاشة لإعدادات التوليد للرجوع إليها.

صانعة محتوى تعمل على شاشتين، ترسم مرجعًا لشخصية على لوح رسم رقمي

سير عمل متقدم للمشاريع متعددة المشاهد

التوليد الدفعي مع تثبيت البذرة

بمجرد أن تجد بذرة تنتج شخصية تطابق كتاب الشخصية بدقة، ولّد أربع إلى ست تنويعات للمشهد باستخدام البذرة نفسها مع أوصاف فعل مختلفة قليلًا. قارنها جنبًا إلى جنب. يجب أن يظل الوجه والبنية ثابتين، بينما يتغير الفعل وحده.

إذا بدأت الشخصية بالانحراف بعد عدة تنويعات، فمن المرجح أن وصف الفعل يتعارض مع وصف الشخصية في مكان ما داخل الأمر. بسّط جزء الفعل، أو أعد ترتيب بنية الأمر لإعطاء الأولوية لكتاب الشخصية.

تحويل الصورة إلى فيديو كأقوى مرساة

لا يعتمد أكثر سير عمل موثوق للاتساق على الأوامر النصية وحدها. بل يستخدم عملية من خطوتين:

  1. ولّد صورة شخصية عالية الجودة ومتسقة باستخدام نموذج تحويل النص إلى صورة
  2. أدخل هذه الصورة إلى نموذج تحويل الصورة إلى فيديو مثل Wan 2.2 Animate Replace أو DreamActor-M2.0 أو Kling V3 Motion Control

عندما يمتلك النموذج صورة حقيقية لشخصيتك كمدخل بصري بدلًا من النص وحده، تُثبَّت ملامح الوجه ولون البشرة والشعر والنسب في تلك المرجعية. ويختفي انحراف تحويل النص إلى فيديو تقريبًا، لأن النموذج يملك شيئًا ملموسًا يطابقه.

يتطلب هذا النهج خطوات أكثر، لكنه يحقق مستوى من الاتساق البصري لا يستطيع الاعتماد على النص وحده الوصول إليه حاليًا.

💡 خط الإنتاج: استخدم Veo 3.1 للمشاهد التي تحتاج إلى بيئات ديناميكية وجودة بصرية عالية مع حركة سينمائية. واستخدم سير عمل تحويل الصورة إلى فيديو عندما تكون دقة وجه الشخصية هي الأولوية المطلقة ولا تستطيع تحمل الانحراف.

صانعة محتوى إبداعية ذات شعر مجعد تقف في مكتب منزلي دافئ، بتعبير واثق وضوء الساعة الذهبية

ابدأ ببناء فيديوهاتك الخاصة بشخصيات ثابتة

ثبات الشخصيات في فيديو الذكاء الاصطناعي مشكلة محلولة، ليس لأن النماذج تتعامل معه تلقائيًا، بل لأن هناك عملية واضحة قابلة للتكرار لتحقيقه. ابنِ كتاب شخصيتك. ثبّت بنية أوامرك. استخدم قيم البذرة. وعند الإمكان، استخدم مرساة صورية بدلًا من النص وحده.

يكافئ Veo 3.1 الأوامر النصية المنظمة أكثر من أي ارتجال إبداعي غامض. فالمبدعون الذين ينتجون أكثر النتائج اتساقًا ليسوا من يكتبون أكثر الأوامر إبداعًا. بل هم من يملكون أشد بنية أوامر انضباطًا، وأدق توثيق للشخصيات، وأنظف سير عمل بين المشاهد.

جميع النماذج المذكورة في هذا المقال متاحة على PicassoIA. يمكنك تشغيل Veo 3.1، و Kling V3 Motion Control، وDreamActor-M2.0، وWan 2.2 Animate Replace، وHailuo 2.3 دون التنقل بين المنصات، ما يجعل من السهل مقارنة النتائج وبناء سير العمل الذي يناسب نوع مشروعك تحديدًا.

ابدأ بشخصية واحدة. اكتب كتابها. ثبّت البذرة. ولّد المشهد الأول. وما تبقى يتبع من هنا.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة