Runway Gen-4.5: ما الجديد وكيفية استخدامه

Runway Gen-4.5 هو أحدث إصدار من نموذج Runway الرائد لتحويل النص إلى فيديو، ويقدّم تحسينات كبيرة في التحكم بالحركة، واتساق الإطارات عبر الزمن، والالتزام بالأوامر النصية. يستعرض هذا المقال كل ميزة جديدة، ويوضح كيفية استخدامها عمليًا، ويقارن Gen-4.5 بأقوى مولّدات الفيديو بالذكاء الاصطناعي المتاحة في 2027.

Runway Gen-4.5: ما الجديد وكيفية استخدامه
Cristian Da Conceicao
مؤسس Picasso IA

تواصل Runway تطوير بنية Gen-4 بخطوات ثابتة، والقفزة مع Gen-4.5 واضحة. إذا كنت تستخدم الإصدار السابق وتتساءل إن كانت الترقية تُحدث فرقًا فعليًا في سير عملك، فالجواب المختصر هو نعم. التغييرات ليست شكلية. فجودة الحركة، والاتساق بين الإطارات، ومدى التزام النموذج بأوامرك النصية، كلها شهدت تحسنًا حقيقيًا. يستعرض هذا المقال كل تغيير جوهري في Gen-4.5، ويوضح خطوات استخدام النموذج، ويضعه جنبًا إلى جنب مع أقوى المنافسين المتاحين حاليًا في 2027.

أيدٍ تمسك كاميرا بمستوى السينما في موقع تصوير

ما الذي تغيّر فعلًا في Gen-4.5

القفزة من Gen-4 إلى Gen-4.5 ليست مجرد تسويق. ثلاثة مجالات نالت اهتمامًا كبيرًا: دقة التحكم بالحركة، واستقرار الانتقال بين الإطارات، والالتزام بالأوامر النصية. كل واحد منها يؤثر في مدى صلاحية النموذج للعمل الإبداعي الاحترافي، سواء كنت تنتج أفلامًا قصيرة أو محتوى لوسائل التواصل الاجتماعي أو أصول فيديو تجارية.

فرشاة الحركة المتعددة

فرشاة الحركة المتعددة هي الميزة الرئيسية في هذا الإصدار. في Gen-4، كان بإمكانك اقتراح حركة عامة عبر الأوامر النصية، لكن النموذج كان يقرر بنفسه كيف تتحرك العناصر بالنسبة لبعضها. يمنحك Gen-4.5 تحكمًا دقيقًا: ترسم مناطق مباشرة على صورة الإدخال، وتُسند لكل منطقة متجهات حركة مستقلة.

هذا مهم جدًا للمشاهد التي تضم عدة أشخاص أو عناصر. شخص يمشي نحو اليسار بينما يتحرك حشد في الخلفية نحو اليمين، أو سيارة تبتعد فيما تتحرك الكاميرا في الاتجاه المعاكس. قبل هذا التحديث، كان تحقيق هذا النوع من تنسيق الحركة يتطلب دمج عدة توليدات منفصلة في مرحلة ما بعد الإنتاج. الآن يتم ذلك في توليدة واحدة.

تدعم الأداة أيضًا الحركة المتراكبة. يمكنك أن تُسند انجرافًا بطيئًا لسماء الخلفية، وحركة معتدلة لأشجار المنتصف، ومسارًا محددًا أسرع لشخص المقدمة. والنتيجة تأثير عمق بالمنظور (parallax) كان يتطلب في السابق برنامج رسوم حركية متخصصًا.

💡 نصيحة: حافظ على تمييز واضح بين متجهات الحركة في المناطق المتجاورة. تداخل اتجاهات الحركة يربك النموذج وينتج حركة ممزوجة وغير مقصودة في منطقة التداخل. وجود فجوة مكانية صغيرة بين المناطق المرسومة يمنع ذلك تمامًا.

تحسينات الاتساق الزمني

من أكثر المشكلات المزعجة في نماذج الفيديو بالذكاء الاصطناعي الأولى الوميض. كانت الوجوه تتغير بشكل خفي بين الإطارات، ويتحرك أو ينبض ملمس الملابس، وتظهر العناصر الصغيرة في الخلفية وتختفي بطرق تكسر الانغماس فورًا.

يعالج Gen-4.5 هذه المشكلة عبر انتباه زمني محسّن في بنية النموذج. عمليًا، يعني هذا:

  • يبقى ملمس الجلد والأسطح مستقرًا طوال مدة المقطع كاملة
  • لم تعد عناصر الخلفية ترتجف أو تختفي بين الإطارات
  • تتحرك الشعر والأقمشة بقصور ذاتي معقول من الناحية الفيزيائية بدلًا من القفز بين المواضع
  • يُحافظ على الإضاءة المتسقة حتى عندما تتنقل الشخصيات بين أجزاء مختلفة من الإطار
  • تُحفظ هوية الأجسام، أي أن فنجان القهوة الذي يبدأ على الطاولة يبقى فنجان قهوة بالشكل واللون نفسيهما طوال الوقت

لكل من يولّد فيديوهات الحديث أمام الكاميرا، أو محتوى على طريقة المقابلات، أو لقطات مقرّبة للمنتجات، تكفي هذه الإضافة وحدها لتبرير استخدام Gen-4.5 بدلًا من سلفه. والفرق واضح حتى من المشاهدة الأولى.

التزام أقوى بالأوامر النصية

Gen-4.5 أفضل بكثير في اتباع التعليمات النصية المحددة. كان الإصدار السابق غالبًا ما يلتزم بالمزاج العام للأمر بينما يتجاهل التفاصيل المحددة، خاصة ما يتعلق بحركة الكاميرا وسلوك العناصر الصغيرة في الإطار.

يتعامل النموذج المحدّث الآن بصورة صحيحة مع تعليمات مثل "اقتراب بطيء بالكاميرا نحو الشخص" أو "تتساقط الأوراق من أعلى اليسار بينما يبقى الشخص ثابتًا". صار التحديد في الأوامر ينتج مخرجات محددة بالمقابل، بدلًا من تقدير تقريبي. وهذا مفيد بشكل خاص للمبدعين الذين طوّروا مكتبات أوامر مفصلة ويعتمدون على تفسير ثابت للحفاظ على الأسلوب البصري عبر المشروع كله.

مخرج أفلام يراجع اللقطات على حاسوب محمول في غرفة المونتاج

Gen-4 مقابل Gen-4.5: الفروق الحقيقية

إليك مقارنة مباشرة لما تغيّر بين الإصدارين عبر الميزات الأكثر أهمية للإنتاج:

الميزةGen-4Gen-4.5
التحكم بالحركةاقتراحات نصية فقطمناطق فرشاة الحركة المتعددة
الاتساق الزمنيمتوسط، مع وميض ملحوظوميض مخفّض بشكل ملحوظ
الالتزام بالأوامريُراعى القصد العامتُتبع التعليمات المحددة
أقصى دقة1280x7681280x768
أقصى مدة10 ثوانٍ10 ثوانٍ
التحكم بالكاميراأساسي (موجّه بالنص)اتجاهية محسّنة
اتساق الشخصياتمتغير بين المقاطعأكثر ثباتًا داخل المقطع
حركة متعددة الطبقاتغير متاحةمتاحة عبر أداة الفرشاة
التسعيرقائم على النقاطقائم على النقاط (بدون تغيير)

سقف الدقة لم يتغير، وهذا جدير بالملاحظة. إذا كانت دقة 4K شرطًا صارمًا لمشروعك، فستحتاج إلى تشغيل مرحلة منفصلة لرفع الدقة بعد التوليد. وهذا قيد حقيقي مقارنة بعدد من المنافسين الذين يُخرجون الآن دقة 1080p أو أعلى أصلًا في مسار عملهم الأساسي.

كيف يعمل Gen-4.5 عمليًا

متعاونان يعملان معًا على مكتب مشترك ويراجعان اللقطات

وضع تحويل النص إلى فيديو

يأخذ مسار تحويل النص إلى فيديو في Gen-4.5 أمرًا نصيًا مكتوبًا وينتج مقطعًا يصل طوله إلى 10 ثوانٍ. النموذج مضبوط للمحتوى السينمائي، ويتعامل بإتقان خاص مع البيئات الطبيعية والمساحات المعمارية الداخلية والأشخاص. يمكن للأوامر التجريدية أو السريالية أن تنتج نتائج مثيرة، لكن الاتساق يصعب التنبؤ به والتحكم فيه عبر توليدات متعددة.

بنية الأمر الأكثر موثوقية مع Gen-4.5 تتبع هذا النمط:

[وصف الشخص] + [الفعل والحركة] + [البيئة] + [تعليمات الكاميرا] + [المزاج والإضاءة]

مثال: "امرأة ترتدي معطفًا أبيض تمشي ببطء عبر حقل قمح مشمس، والكاميرا تتتبعها من الخلف على ارتفاع منخفض، إضاءة ذهبية دافئة في الساعة الذهبية، وحركة رياح خفيفة في العشب." تمنح هذه البنية النموذج تعليمات واضحة على كل مستوى: من هو، وماذا يفعل، وأين يوجد، وكيف تتصرف الكاميرا، وما الشعور الذي يجب أن يعطيه المشهد.

تجنّب الأوصاف العاطفية الغامضة مثل "جميل" أو "درامي" كمُعدّلات منفردة. بدلًا من ذلك، صِف الظروف البصرية المحددة التي تخلق هذا الشعور. "إضاءة خلفية بعد الظهر مع توهج عدسة" أكثر فائدة من "إضاءة جميلة".

وضع تحويل الصورة إلى فيديو

هنا يتحول Gen-4.5 إلى أداة إنتاج عملية. تزوّد النموذج بصورة ثابتة وأمر حركة، فيحرّك الصورة مع الحفاظ على الأسلوب البصري والإضاءة والتكوين الأصليين للمادة.

هذا مفيد بشكل خاص عندما تملك:

  • صورًا لمنتجات تريد إحياءها بحركة خفيفة
  • أعمالًا فنية أو رسومات توضيحية تحتاج إلى تحريك
  • لقطات بورتريه تريد فيها تنفسًا طبيعيًا ورمشًا وحركة عين
  • صورًا معمارية تريد فيها حركة بيئية مثل الرياح أو الماء أو تغيّر الضوء
  • أصولًا للعلامات التجارية أو شعارات تحتاج إلى حركة مضبوطة متوافقة مع هوية العلامة

تتكامل فرشاة الحركة المتعددة مباشرة مع هذا الوضع. ترسم مناطق على الصورة المصدر، وتُسند متجهات حركة لكل منطقة، ثم تترك للنموذج حساب الفيزياء الخاصة بكيفية تفاعل هذه الحركات مع بعضها ومع هندسة المشهد.

5 نصائح لنتائج أفضل

مكتب مخرج مع ملاحظات على القصة المصورة ومواد تخطيط

للحصول على نتائج جيدة باستمرار مع Gen-4.5 يجب فهم طريقة تفسير النموذج للمدخلات. هذه الممارسات الخمس تُحدث فرقًا قابلًا للقياس في جودة المخرجات:

  1. استخدم صور المرجع متى أمكن. مخرجات تحويل الصورة إلى فيديو أكثر اتساقًا من تحويل النص إلى فيديو الخالص، لأن النموذج يملك نقطة بداية بصرية ملموسة. تُثبَّت هوية الشخص وظروف الإضاءة والتكوين من المرجع.
  2. صِف الحركة على مستوى الجملة. بدلًا من "كاميرا متحركة"، اكتب "لقطة تتبع جانبية بطيئة من اليسار إلى اليمين، والشخص يبقى في منتصف الإطار طوال الوقت". كلما كانت تعليمات الكاميرا أوضح، نُفذت بدقة أكبر.
  3. أبقِ المشاهد بسيطة من ناحية التكوين. شخص رئيسي واحد مع خلفية محددة بوضوح يتفوق على المشاهد المعقدة متعددة العناصر من حيث الاتساق والاستقرار الزمني.
  4. افصل مناطق فرشاة الحركة المتعددة بفجوات مكانية واضحة. تتسرب تعريفات الحركة بين المناطق ذات الإسنادات المتداخلة، فتنتج حركة متداخلة وغامضة لا تُرضي أيًا من التعليمات.
  5. ولّد عدة نسخ من الأمر نفسه. لدى Gen-4.5 تباين ملحوظ بين التشغيلات. توليد ثلاث إلى خمس نسخ من الأمر نفسه يمنحك مجموعة للاختيار ويرفع بشكل كبير احتمال الحصول على نتيجة قوية.

💡 نصيحة: بالنسبة لمحتوى الحديث أمام الكاميرا تحديدًا، ابدأ من صورة بورتريه عالية الدقة بدلًا من توليد شخصية من النص. تحسينات الاتساق الزمني في Gen-4.5 تحافظ على هوية الوجه بموثوقية أكبر بكثير عند العمل من مصدر فوتوغرافي حقيقي.

أين يقصّر Gen-4.5

لا يخلو أي نموذج من نقاط ضعف. هذه هي المجالات التي ما زال Gen-4.5 يعاني فيها مقارنة بما يحتاجه المبدعون المحترفون وما تقدمه النماذج المنافسة الآن:

سقف الدقة. الوصول إلى 1280x768 كحد أقصى يعني أن أي شيء مخصص للبث أو السينما أو التسليم بدقة 4K لمنصات التواصل يتطلب خطوة منفصلة لرفع الدقة. منافسون مثل LTX 2.3 Pro يُخرجون دقة 4K أصلًا، وKling v3 يتعامل مع دقة 1080p بشكل أصلي دون خطوة معالجة لاحقة.

الحد الأقصى لطول المقطع. مع 10 ثوانٍ لكل توليدة، لا يمكنك إنتاج تسلسلات ممتدة في مرور واحد. دمج عدة مقاطع معًا يخلق تحديات في الاتساق: مطابقة الإضاءة وملامح الشخص وسلوك الكاميرا عبر توليدات منفصلة عمل يستغرق وقتًا ويتطلب تصحيحًا يدويًا في كثير من الأحيان.

لا يوجد صوت أصلي. ينتج Gen-4.5 فيديو صامتًا. نماذج مثل Veo 3 وSeedance 2.0 تولّد الآن صوتًا محيطيًا متزامنًا وحوارًا وموسيقى إلى جانب الفيديو في مرور واحد. بالنسبة للمبدعين الذين يريدون مقاطع مكتملة الإنتاج دون عمل إضافي في مرحلة ما بعد الإنتاج، فهذه فجوة كبيرة.

تكلفة النقاط في سير العمل كثير التكرار. تعمل Runway بنظام النقاط، ويستهلك Gen-4.5 النقاط بمعدل يتراكم بسرعة عندما تكرر التوليدات كثيرًا لإيجاد اللقطة المناسبة. المبدعون الذين يعملون بميزانية محدودة وبحجم كبير سيشعرون بهذا القيد بحدة أكبر من أولئك الذين ينتجون أعمالًا متقنة بين الحين والآخر.

مكتب إبداعي حديث بنوافذ كبيرة وفريق أمام الشاشات

المنافسة في 2027

Gen-4.5 نموذج قوي، لكن مشهد توليد الفيديو بالذكاء الاصطناعي في 2027 شديد التنافسية. عدة بدائل تتفوق عليه في فئات محددة تهم أنواعًا مختلفة من الإنتاج.

Kling v3

Kling v3 من Kuaishou هو اليوم أحد أقدر نماذج تحويل النص إلى فيديو المتاحة. يُخرج دقة 1080p بشكل أصلي، ويتعامل مع المشاهد المعقدة متعددة الأشخاص باتساق زمني قوي، ولديه نظام تحكم مخصص بالحركة عبر Kling v3 Motion Control. لمن يعطي الأولوية لدقة الإخراج وتعقيد المشاهد، Kling v3 هو الخيار الأقوى الآن. ويظل إصدار Kling v2.6 خيارًا موثوقًا لمن يريد توازنًا بين السرعة والجودة.

Sora 2 Pro

يقدّم Sora 2 Pro من OpenAI جودة محاكاة فيزيائية لا يضاهيها Gen-4.5 في الديناميكا السائلة ومحاكاة الأقمشة والتفاعلات الجسيمية المعقدة. إذا كان محتواك يتضمن الماء أو النار أو الدخان أو حركة الأقمشة المعقدة تحت الرياح، فإن Sora 2 Pro ينتج نتائج أدق فيزيائيًا بوضوح، وتصمد عند الفحص الدقيق.

Veo 3

Veo 3 من Google هو المعيار الحالي لتوليد الفيديو المتزامن مع الصوت. ينتج صوتًا محيطيًا بيئيًا وحوارًا وموسيقى جوية إلى جانب الصور في توليدة واحدة. بالنسبة لصنّاع المحتوى للتواصل الاجتماعي والمسوّقين الذين يحتاجون إلى مقاطع جاهزة للنشر مع صوت، فإن ميزة سير العمل هذه كبيرة. وVeo 3.1 يذهب أبعد من ذلك بجودة صوت محسّنة وتصيير أسرع.

Seedance 2.0

Seedance 2.0 من ByteDance قوي بشكل خاص في التوليد السريع بجودة عالية. Seedance 2.0 Fast هو النموذج الذي تلجأ إليه عندما تحتاج إلى تكرار سريع دون التضحية بقدر كبير من الجودة البصرية. بالنسبة للوكالات والمبدعين الذين يديرون سير عمل بحجم كبير، فإن نسبة السرعة إلى الجودة يصعب تجاوزها.

مخرجة واثقة تقف في استوديو سينمائي بإضاءة احترافية

إليك كيف تقارن هذه النماذج عبر الأبعاد الأهم لقرارات الإنتاج:

النموذجأقصى دقةصوت أصليالتحكم بالحركةالأفضل لـ
Runway Gen-4.51280x768لافرشاة الحركة المتعددةاللقطات السينمائية القصيرة، والحركة الدقيقة
Kling v31080pلاتحكم متقدم بالحركةمحتوى احترافي عالي الدقة
Sora 2 Pro1080pنعمقياسيالمشاهد كثيفة الفيزياء
Veo 31080pنعمقياسيالمحتوى الاجتماعي المتزامن مع الصوت
Seedance 2.01080pنعمقياسيالتكرار السريع وبحجم كبير
LTX 2.3 Pro4Kلاقياسيمخرجات بدقة عالية جدًا

كيفية استخدام Gen 4.5 على PicassoIA

Gen 4.5 متاح مباشرة على PicassoIA، ما يعني أنه يمكنك توليد فيديو بجودة Runway دون إدارة حساب Runway منفصل أو التعامل مع نظام النقاط الخاص بهم. سير العمل واضح وسهل للمبتدئين.

لقطة مقرّبة لخط زمني لتحرير الفيديو على شاشة 4K

الخطوة 1: افتح صفحة نموذج Gen 4.5

انتقل إلى صفحة نموذج Gen 4.5 على PicassoIA. ستجد حقل إدخال الأمر النصي وخيار رفع صورة مرجعية لوضع تحويل الصورة إلى فيديو.

الخطوة 2: اختر وضع التوليد

إذا كنت تبدأ من النص فقط، فاكتب أمرك النصي مباشرة في حقل الإدخال. وإذا كانت لديك صورة مرجعية، فارفعها عبر حقل الصورة. يُفعَّل وضع تحويل الصورة إلى فيديو تلقائيًا عند اكتشاف صورة، وتصبح أداة فرشاة الحركة المتعددة متاحة في شريط الأدوات.

الخطوة 3: اكتب أمرًا نصيًا منظمًا

اتبع بنية الشخص والفعل والبيئة والكاميرا والمزاج التي وردت سابقًا. لفرشاة الحركة المتعددة: انقر أيقونة أداة الفرشاة، وارسم مناطقك على الصورة المرفوعة، وأسند اتجاهات الحركة لكل منطقة باستخدام عناصر التحكم الاتجاهية. أبقِ المناطق منفصلة مكانيًا لتجنب تسرّب الحركة.

الخطوة 4: اضبط المعاملات

  • المدة: ابدأ بمدة 5 ثوانٍ لتكرار أسرع وأرخص. انتقل إلى 10 ثوانٍ بعد أن تحصل على بنية أمر تنتج نتائج متسقة.
  • نسبة العرض إلى الارتفاع: 16:9 للمحتوى الأفقي، و9:16 للتنسيقات العمودية في وسائل التواصل الاجتماعي.
  • مقدار الحركة: الإعدادات المعتدلة تنتج أكثر النتائج استقرارًا. إعدادات الحركة العالية قد تُدخل عيوبًا زمنية حتى مع تحسينات Gen-4.5، خاصة حول الأشخاص سريعي الحركة.

الخطوة 5: ولّد وقيّم

أرسل مهمتك. يستغرق التوليد عادة من 60 إلى 120 ثانية حسب الحمل الحالي على الخوادم. قيّم المخرجات مقارنةً بموجز الحركة لديك. إذا كان الاتساق في الوجه غير دقيق، فانتقل إلى صورة مرجعية فوتوغرافية. وإذا كانت حركة الكاميرا لا تطابق قصدك، فاجعل تعليمة الكاميرا في أمرك أوضح.

الخطوة 6: كرر وحسّن

تتيح واجهة PicassoIA إعادة تشغيل الأمر نفسه مع تعديلات. استخدم ذلك لاستكشاف تنويعات الحركة، ثم ادمج أفضل لقطاتك في برنامج تحرير الفيديو. وإذا كنت بحاجة إلى رفع المخرجات إلى 4K للتسليم، فمرّرها عبر LTX 2.3 Pro أو أي نموذج آخر لرفع الدقة كخطوة أخيرة.

💡 نصيحة: إذا أردت توليدًا أسرع للتكرار بحجم كبير، فإن Gen4 Turbo متاح أيضًا على PicassoIA. يضحّي ببعض الجودة مقابل أوقات إخراج أسرع بكثير، ما يجعله عمليًا للاستكشاف الإبداعي السريع قبل الالتزام بتصيير Gen-4.5 النهائي.

دورك الآن للإبداع

امرأة تعمل في الهواء الطلق في مقهى على حاسوب محمول يعرض واجهة فيديو

يمثل Gen-4.5 أقدر إصدار من بنية Runway حتى الآن، وفرشاة الحركة المتعددة وحدها تفتح سير عمل إنتاجي لم يكن ممكنًا في الإصدارات السابقة. تحسينات الاتساق الزمني تجعله صالحًا للاستخدام الحقيقي في اللقطات المقرّبة والمحتوى المواجه للكاميرا دون التنظيف اليدوي الذي كانت تتطلبه الإصدارات السابقة.

الميزة الحقيقية للعمل على PicassoIA أنك لست مقيدًا بنموذج واحد. إذا كان مشهدك يتطلب صوتًا أصليًا، فإن Veo 3 على بعد نقرة واحدة. وإذا احتجت إلى دقة 4K أصلية، فإن LTX 2.3 Pro أو Kling v3 متاحان مباشرة. وإذا احتجت إلى حجم كبير بسرعة، فإن Seedance 2.0 Fast يؤدي المطلوب. وعندما تريد التحكم الدقيق بالحركة والجودة السينمائية التي بُني Gen-4.5 من أجلها، فهو جاهز للاستخدام دون أي إعداد إضافي.

أفضل طريقة لترى ما تستطيع هذه النماذج فعله فعلًا لمحتواك الخاص هي تشغيلها على مادتك أنت. افتح Gen 4.5 على PicassoIA، وابدأ بصورة لديك بالفعل، واكتب أمر حركة واضحًا، وانظر ما الذي سيعود. التوليدة الأولى تكون دائمًا مفاجِئة.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة