Luma Ray3: نموذج توليد الفيديو الجديد من Luma Labs

أطلقت Luma Labs للتو Ray3، أقدر نماذجها لتوليد الفيديو بالذكاء الاصطناعي حتى الآن. بفضل اتساق زمني أدق، ودعم لمقاطع أطول، والتزام أفضل بالأوامر النصية، وحركة بجودة سينمائية، يضع Ray3 شركة Luma في صدارة سباق توليد الفيديو بالذكاء الاصطناعي. يشرح هذا المقال ما الذي يميّز Ray3، وكيف يقارن بالنماذج المنافسة، وماذا يعني للمبدعين الذين يعملون اليوم بالفيديو المولَّد بالذكاء الاصطناعي.

Luma Ray3: نموذج توليد الفيديو الجديد من Luma Labs
Cristian Da Conceicao
مؤسس Picasso IA

لدى Luma Labs نمط معروف: تطلق نموذجًا، ترفع سقف الأداء، ثم تطلق نموذجًا آخر يجعل السابق يبدو كنموذج أولي. Ray3 هو هذه الخطوة التالية. يظهر في 2025 بوصفه أقدر نموذج لتحويل النص إلى فيديو أطلقته الشركة ومقرها سان فرانسيسكو، والفجوة التي يخلقها بينه وبين Ray 2 ليست تحسينًا تدريجيًا. إنها القفزة التي تجبر مختبرات أخرى على تسريع خرائط طريقها.

إذا كنت تتابع مجال فيديو الذكاء الاصطناعي، فأنت تعرف بالفعل السرعة التي تتطور بها النماذج. ما يمثّله Ray3 ليس مجرد رقم إصدار جديد. إنه إعادة تعريف لمعنى "الجودة" في الفيديو المولّد بالذكاء الاصطناعي.

لوحة مفاتيح Luma Ray3 ومحطة العمل الإبداعية

ما هو Ray3 فعليًا

سلالة Ray من Luma Labs

بدأت Luma Labs بنموذج Dream Machine، الذي أبهر منصات التواصل الاجتماعي في منتصف 2024 بحركته السلسة ومخرجاته القريبة من الواقعية. ثم كررت الشركة التطوير بسرعة، فأطلقت Ray خلفًا له، ثم Ray 2 720p بتحسينات ملموسة في الدقة والتحكم في الكاميرا.

عالجت كل جيل نقاط ضعف محددة لدى المستخدمين. عانى Dream Machine من المقاطع الطويلة ومن ثبات الشخصيات. وأصلح Ray بعضًا من ذلك. ودفع Ray 2 الأمر أبعد بإضافة التزام أفضل بالأوامر النصية وتحسين جودة الإخراج بدقة 720p. كان التطور سريعًا ومنضبطًا، وقادته بوضوح ملاحظات المبدعين من الواقع.

لا يكتفي Ray3 بمواصلة هذا المسار. بل يعيد البناء من مستوى المعمارية، إذ تشير Luma Labs إلى دورة تدريب كاملة على مجموعة بيانات فيديو أكبر بكثير وأكثر تنوعًا. والنتيجة نموذج يفهم السياق عبر الزمن بطريقة لم تستطع الإصدارات السابقة الوصول إليها.

Ray3 مقابل Ray 2: الفروق الحقيقية

أوضح تحسين يلاحظه المستخدمون هو الاتساق الزمني. في Ray 2، كانت المشاهد المعقدة التي تضم عدة أشخاص أو أجسام متحركة، خاصة في البيئات الديناميكية، تنتج أحيانًا "انحرافًا": عناصر تتغير مظهريًا ببطء في منتصف المقطع، أو حركة تناقض الفيزياء بشكل خفي. يتتبع Ray3 الأشخاص عبر الحركة باتساق محسّن بشكل ملحوظ.

الترقية الكبرى الثانية هي دقة تنفيذ الأمر النصي. درّبت Luma Labs نموذج Ray3 مع تركيز على الالتزام التركيبي، أي أنه عندما تصف مشهدًا محددًا بعلاقات مكانية واضحة، مثل "امرأة تمشي نحو اليسار بينما يمر قطار خلفها من اليمين إلى اليسار"، ينفذ Ray3 هذا الترتيب بدقة أكبر بكثير من سلفه.

ثالثًا: دعم المقاطع الأطول. كان Ray 2 يعمل بأفضل صورة في نطاق 5 إلى 8 ثوانٍ قبل أن يصبح تراجع الجودة ملحوظًا. يمدّ Ray3 هذه النافذة المريحة، فيتيح مقاطع في نطاق 10 إلى 15 ثانية دون الفوضى البصرية التي أرهقت النماذج السابقة.

فريق إبداعي يراجع محتوى فيديو مولّدًا بالذكاء الاصطناعي

ما الذي يفعله Ray3 بشكل أفضل

جودة الحركة والاتساق الزمني

هذه هي القدرة الأبرز، وتستحق التفصيل. يشير الاتساق الزمني في فيديو الذكاء الاصطناعي إلى مدى ثبات النموذج في الحفاظ على المعلومات البصرية عبر الإطارات. فكّر فيه بوصفه "ذاكرة" النموذج لشكل الشخص أو الجسم كلما تقدم المقطع.

الاتساق الزمني الضعيف يُنتج الهلوسة التي جعلت فيديو الذكاء الاصطناعي المبكر سهل التمييز: وجوه تتشوه بخفة بين اللقطات، وأيدٍ تكتسب أصابع أو تفقدها، وخلفيات ترتجف أو تتموج بطرق مستحيلة فيزيائيًا. يعالج Ray3 هذا على مستوى معمارية النموذج، بدلًا من تطبيق تنعيم لاحق على المخرجات.

النتيجة العملية فيديو يحافظ على تماسكه أثناء الحركة. شخص يمشي في ممر في Ray3 سيصل إلى نهايته بالوجه نفسه والملابس نفسها والنسب نفسها التي بدأ بها. قد يبدو هذا بسيطًا. لكن قبل Ray3 لم يكن كذلك أبدًا.

💡 نصيحة احترافية: يعمل Ray3 بشكل جيد بصفة خاصة مع المشاهد التي تضم شخصًا واحدًا بارزًا وخلفيات واضحة المعالم. كلما قدّمت معلومات تركيبية أكثر في الأمر النصي، ثبّت الحركة بصورة أفضل.

التزام بالأوامر يعمل فعلًا

ظلت هناك دائمًا فجوة في تحويل النص إلى فيديو بين ما يصفه المبدعون وما تنتجه النماذج. كانت النماذج المبكرة تتعامل مع الأوامر كاقتراحات للمزاج أكثر منها تعليمات. يضيّق Ray3 هذه الفجوة بشكل كبير.

درّبت Luma نموذج Ray3 بما تصفه بأنه "تحليل الأوامر المنظّم"، إذ يعالج الوصف المكاني والإشارات الزمنية والنبرة العاطفية كإشارات منفصلة، لا كتمثيل نصي واحد. ينتج هذا مخرجات يتطابق فيها بداية المقطع ووسطه واتجاهه مع النية المكتوبة فعلًا.

بالنسبة إلى صنّاع المحتوى السردي، لا يُعد هذا تحسينًا بسيطًا في راحة الاستخدام. إنه الفرق بين قضاء 20 دقيقة في إعادة توليد المقاطع، والحصول على نتيجة قريبة مما تريد من المحاولة الأولى أو الثانية.

مقاطع أطول وانحراف أقل

مدة 5 ثوانٍ الافتراضية في فيديو الذكاء الاصطناعي موجودة لأن معظم النماذج تحافظ على جودتها عندها. وإذا تجاوزتها، ستحصل على مخرجات تزداد عدم استقرار. يمدّ Ray3 هذه النافذة المستقرة إلى 10 إلى 15 ثانية بجودة متسقة، وهذا يفتح إمكانيات سردية لا تدعمها المقاطع القصيرة.

مقطع مدته 10 ثوانٍ بحركة كاميرا مضبوطة وشخص محدد ومسار سردي واضح هو محتوى قابل للاستخدام. يمكنه أن يقف وحده كمنشور اجتماعي، أو لحظة عرض لمنتج، أو مشهدًا ضمن تسلسل مونتاج أطول. أما مدة 5 ثوانٍ فنادرًا ما تحقق الوزن نفسه.

مخرج أفلام يدرس مخرجات فيديو سينمائية مولّدة بالذكاء الاصطناعي على شاشة كبيرة

Ray3 مقابل المنافسة

سوق فيديو الذكاء الاصطناعي في 2027 تنافسي بالفعل. ولا يعمل Ray3 في فراغ، بل يدخل إلى جانب بدائل قوية، ولكل منها نقاط قوة متميزة.

النموذجأقصى دقةمدة المقطعالصوتالالتزام بالأوامرالأفضل في
Luma Ray31080p10-15 ثانيةلاممتازالحركة السينمائية، الواقعية
Sora 21080p20 ثانيةنعمجيد جدًاالسرد الطويل
Veo 31080p8 ثوانٍنعم (أصلي)جيد جدًاالمحتوى المتزامن مع الصوت
Kling v2.61080p10 ثوانٍلاجيدتحريك الشخصيات
Seedance 2.01080p10 ثوانٍنعمجيدمحتوى وسائل التواصل الاجتماعي
Hailuo 021080p6 ثوانٍلاجيدالتكرار السريع

يتميز Ray3 في هذه المجموعة بجودة واقعية الحركة والواقعية الفوتوغرافية. إذا وضعت أمر النص نفسه جنبًا إلى جنب على هذه النماذج، فسيُنتج Ray3 عادةً النتيجة الأشبه بلقطات من كاميرا حقيقية. حبيبات الفيلم، وضبابية الحركة، وفيزياء تفاعل الأجسام: هذه مجالات استثمرت فيها Luma جهدًا تدريبيًا كبيرًا بوضوح.

المفاضلة تكمن في الصوت. على عكس Veo 3، وSora 2، وSeedance 2.0، لا يولّد Ray3 الصوت بشكل أصلي. وبالنسبة للمبدعين الذين يحتاجون صوتًا متزامنًا أو صوتًا محيطيًا مدمجًا، ستتطلب مخرجات Ray3 عملًا صوتيًا لاحقًا في مرحلة ما بعد الإنتاج.

شاشة عالية الجودة تعرض إطارًا سينمائيًا من فيديو مولّد بالذكاء الاصطناعي

من يستفيد أكثر من Ray3

صنّاع الأفلام وصنّاع المحتوى

صُمم Ray3 للأشخاص الذين يهتمون بمظهر فيديوهم. إذا كنت تنتج محتوى تكون فيه الجودة البصرية هي المقياس الأهم، حيث يجب أن يجتاز الناتج اختبار "هل يمكن أن يكون هذا لقطات حقيقية؟"، فإن Ray3 هو حاليًا الخيار الأقوى في مجال فيديو الذكاء الاصطناعي المتاح للمستخدم العادي.

ينطبق هذا على:

  • الأفلام القصيرة والمحتوى السردي: مشاهد ذات شخصيات وبيئات وحركة كاميرا محددة
  • عرض المنتجات: عروض منتجات واقعية دون تصوير فعلي
  • توليد لقطات المخزون: لقطات تكميلية عالية الجودة للمشاريع التجارية
  • محتوى الفيديو الموسيقي: مقاطع تجريدية أو سردية يكون فيها المزاج وجودة الحركة مهمين

كما يجعل التحسن في الالتزام بالأوامر Ray3 أكثر فائدة بشكل ملحوظ للعمل الإبداعي التكراري. فعندما ينفذ النموذج فعلًا ما تصفه، يمكنك توجيهه بدلًا من الاكتفاء بالتفاعل مع ما ينتجه.

وسائل التواصل الاجتماعي والفيديو القصير

نافذة 10 إلى 15 ثانية التي يشغلها Ray3 بأريحية تتطابق تقريبًا تمامًا مع الصيغ التي تنجح على منصات الفيديو القصير. فريلز Instagram، وخطاف TikTok، ومقدمة YouTube Shorts: كلها تعيش في مدة المقطع نفسها التي يعمل فيها Ray3 بأعلى جودة.

بالنسبة للمبدعين الذين يديرون حسابات اجتماعية بكميات كبيرة، فإن القدرة على توليد مقاطع واقعية ومتماسكة مدتها 10 ثوانٍ عند الطلب، دون كاميرا أو فريق إنتاج، تمثل تغييرًا تشغيليًا كبيرًا. يخفض Ray3 تكلفة محتوى الفيديو عالي الجودة إلى الوقت الذي تستغرقه كتابة أمر نصي.

شاب صانع محتوى يعمل على فيديو بالذكاء الاصطناعي من مكتبه المنزلي

كيفية استخدام Luma Ray على PicassoIA

عائلة Ray من Luma، وتضم Ray، وRay Flash 2 720p، وRay Flash 2 540p، وRay 2 540p، وRay 2 720p، متاحة كلها مباشرة على PicassoIA. إليك كيفية الحصول على أفضل النتائج:

الخطوة 1: اختر إصدار Ray

انتقل إلى قسم تحويل النص إلى فيديو، واختر نموذج Ray المناسب لاحتياجاتك. يقدم Ray 2 720p أعلى جودة بصرية للمخرجات المصقولة. وRay Flash 2 أسرع للتكرار السريع عندما تكون ما زلت تختبر الأوامر.

الخطوة 2: اكتب أمرًا نصيًا منظمًا

تستجيب نماذج Ray بأفضل صورة للأوامر التي تتضمن أربعة عناصر: وصف للشخص، وفعل أو حركة محددة، وبيئة، ومواصفات للكاميرا. على سبيل المثال:

"امرأة ترتدي سترة كتانية بنية اللون تمشي ببطء عبر شارع مرصوف بالحجارة في ليلة ممطرة، والكاميرا تتبعها من الخلف على ارتفاع الكتف، عمق ميداني ضحل، وأضواء شوارع كهرمانية دافئة تنعكس على الإسفلت المبلل."

الخطوة 3: حدّد أسلوب المقطع وإيقاعه

أضف لغة زمنية إلى أمرك لتتحكم في الإيقاع: "حركة بطيئة ومتعمدة"، "اقتراب تدريجي"، "لقطة عريضة ثابتة مع اهتزاز خفيف للكاميرا". تحلل نماذج Ray هذه التعليمات وتطبقها على الحركة المولّدة.

الخطوة 4: حسّن التكوين بالتكرار

إذا لم ينجح الناتج الأول في تحقيق الترتيب المكاني الذي تريده، فأضف وصفًا تركيبيًا أكثر وضوحًا. عبارات مثل "الشخص في وسط الإطار"، أو "خلفية غير واضحة"، أو "شخصان جنبًا إلى جنب" تساعد النموذج على فهم التخطيط.

الخطوة 5: صدّر واستخدم

عندما تحصل على المقطع الذي تريده، نزّله مباشرة وأدمجه في مونتاجك. تُخرج نماذج Ray بدقة 720p أو 1080p حسب الإصدار، وتعني جودة الحركة أن الحاجة إلى تنظيف لاحق في مرحلة ما بعد الإنتاج ستكون ضئيلة.

💡 نصيحة الأمر النصي: تجنب الأوصاف الأسلوبية الغامضة مثل "سينمائي" أو "جميل" وحدها. بدلًا من ذلك، صف ما تعنيه هذه المصطلحات في لقطتك المحددة: "ملمس حبيبات الفيلم"، "توهج عدسة أنامورفيك"، "انتشار ضوء الصباح الناعم". اللغة البصرية المحددة تنتج نتائج أفضل من التسميات الجمالية المجردة.

مساحة عمل إبداعية من الأعلى بملاحظات إنتاج الفيديو وأدواته

Ray3 في الصورة الأوسع

نماذج متقدمة تتسابق إلى الأمام

مجال فيديو الذكاء الاصطناعي في 2027 ليس بيئةً بطيئة التطور. تُطلق النماذج على دورات تمتد لشهور، ويجعل كل نموذج منها السابق يبدو قديمًا. ينضم Ray3 إلى فئة تسميها الصناعة "نماذج الفيديو المتقدمة"، وهي فئة تضم الآن Sora 2، وVeo 3، وKling v3 Omni Video إلى جانب عروض Luma.

ما يميز النماذج المتقدمة عن الأجيال السابقة ليس الدقة الخام أو السرعة. بل تقليص الفجوة بين ما يُوصف وما يُنتج. كانت أقدم نماذج فيديو الذكاء الاصطناعي تفسّر الأمر وتنتج شيئًا قريبًا من الطلب بشكل فضفاض. أما النماذج المتقدمة فتتجه نحو الامتثال الإخراجي: تصف لقطة، فتنتج تلك اللقطة.

إسهام Ray3 في هذا التطور هو تركيز قوي على فيزياء الحركة واستمرارية الأشخاص، وهما مجالان كانت فيهما الفجوة بين المقصود والفعلي الأكثر إرباكًا لسير العمل الإبداعي.

أرفف خوادم عتادية تشغّل البنية التحتية لتوليد فيديو الذكاء الاصطناعي

ماذا يعني هذا للمبدعين المستقلين

غالبًا ما يتمحور الحديث حول فيديو الذكاء الاصطناعي حول حالات الاستخدام المؤسسية: وكالات الإعلان، واستوديوهات الأفلام، وعمليات المحتوى واسعة النطاق. لكن الاضطراب الحقيقي الذي تحدثه نماذج مثل Ray3 يحدث على المستوى الفردي.

يستطيع مبدع واحد بأمر نصي مُحكم ووصول إلى منصة مثل PicassoIA أن ينتج الآن مقطع فيديو سينمائيًا بدقة 1080p ومدته 10 ثوانٍ في دقائق. لا طاقم تصوير. لا كاميرا. لا موقع. جودة المقطع ليست "جودة فيديو الذكاء الاصطناعي" بالمعنى الازدرائي الذي حمله هذا التعبير في 2023. مع Ray3، أصبح منافسًا للمحتوى المصوّر باحتراف في كثير من حالات الاستخدام.

هذا يغيّر اقتصاديات إنتاج الفيديو بالنسبة إلى:

  • اليوتيوبرز المستقلين الذين يحتاجون لقطات تكميلية وانتقالات مشاهد دون ميزانية تصوير
  • أصحاب الأعمال الصغيرة الذين يريدون عروض منتجات احترافية دون شركة إنتاج
  • الموسيقيين الذين يحتاجون مرئيات ترافق مقطوعة موسيقية
  • المعلمين وصناع الدورات التعليمية الذين يبنون محتوى فيديو توضيحيًا على نطاق واسع

لم تتراجع الحواجز أمام الفيديو الواقعي فحسب. مع Ray3، كادت تختفي.

مخرج إبداعي يراجع لوحات القصة المصورة لفيديوهات مولّدة بالذكاء الاصطناعي على مكتب في الاستوديو

ما الذي يجب متابعته لاحقًا

Ray3 هو السقف الحالي لشركة Luma، لكن Luma Labs أثبتت أنها لا تبقى عند سقف لفترة طويلة. هناك بعض المجالات التي من المرجح أن يركز عليها الإصدار القادم:

  • توليد الصوت الأصلي: الفجوة الجوهرية الوحيدة التي يعانيها Ray3 مقارنة مع Veo 3 وSora 2 هي الصوت. التزمت Luma الصمت حيال ذلك، لكن الضغط التنافسي لإضافته كبير.
  • تمديد مدة المقطع: 15 ثانية جيدة. مقاطع متماسكة مدتها 30 ثانية ستكون تحولًا جذريًا. تجعل تحسينات المعمارية في Ray3 هذا المسار قابلًا للتصديق.
  • التحكم في تحويل الصورة إلى فيديو: بينما يدعم Ray 2 بالفعل تحريك الصور، يُفترض أن يجعل الاتساق الزمني المحسّن في Ray3 المخرجات المرتكزة على صورة أكثر ثباتًا بشكل كبير.

لأي شخص يعمل في إنتاج الفيديو، سواء على المستوى المحترف أو كمبدع مستقل، يستحق تتبع وتيرة إصدارات Luma Labs الاهتمام.

ابدأ الإبداع باستخدام Ray على PicassoIA

النماذج التي تحدد الوضع الحالي لفيديو الذكاء الاصطناعي ليست فرضية. إنها متاحة الآن، وأفضل طريقة لترى ما ينتجه Ray3 وسابقاته فعلًا هي استخدامها.

يتيح لك PicassoIA الوصول المباشر إلى كامل عائلة Luma Ray، وتشمل Ray، وRay 2 720p، وRay Flash 2 540p، وRay Flash 2 720p، إلى جانب أكثر من 100 نموذج آخر لتحويل النص إلى فيديو في واجهة واحدة. يمكنك اختبار الأوامر عبر نماذج متعددة، ومقارنة المخرجات جنبًا إلى جنب، واختيار النموذج الأنسب لمشروعك.

اكتب أمرًا نصيًا يصف مشهدًا تريد رؤيته، وجرّبه على أحد نماذج Ray، وكرّر. الدورة سريعة. سقف الجودة مرتفع فعلًا. الشيء الوحيد الذي يفصلك عن مقطع فيديو واقعي بالذكاء الاصطناعي هو الوقت الذي تستغرقه لوصف اللقطة.

استوديو إبداعي مفتوح عند الغسق يعمل فيه محترفون على محتوى فيديو بالذكاء الاصطناعي

شارك هذا المقال

اختر لغتك

مقالات ذات صلة