في المرة الأولى التي تحاول فيها إنشاء فيديو بالذكاء الاصطناعي، ستحدّق على الأرجح في مربع نص فارغ وتتساءل عمّا يجب أن تكتبه بالضبط. Kling v3 Video غيّر هذا الشعور لدى كثيرين. فبينما كانت الإصدارات السابقة من النموذج تنتج نتائج تبدو غير متوقعة أو غير متسقة، قدّمت النسخة 3.0 مستوى من التماسك والتحكم في الحركة يجعل من الممكن فعلًا الحصول على فيديو مقنع من المحاولة الأولى أو الثانية، دون أي خبرة سابقة.
هذا ليس عرضًا نظريًا. إنه الإجراء العملي: ماذا تكتب، وأي إعدادات تختار، وكيف تقرأ نتائجك، وكيف تتجنب أكثر الأخطاء شيوعًا التي تُهدر الوقت والنقاط.

لماذا يبدو Kling 3.0 مختلفًا
حركة تبدو منطقية فعلًا
واجهت نماذج تحويل النص إلى فيديو السابقة صعوبة في التماسك الزمني: أشياء تتغيّر شكلها في منتصف المقطع، وأشخاص تنمو لهم أطراف إضافية، وخلفيات تومض بشكل غير متوقع. عالج Kling v3 Video هذه المشكلة بشكل مباشر. والنتيجة حركة تتبع منطقًا فيزيائيًا. الشخص الذي يمشي يبقى الشخص نفسه. الماء يتدفق في اتجاه واحد. حركات الكاميرا الأفقية لا تُدخل تشوهات مفاجئة.
بالنسبة للمبتدئين، هذا الأمر بالغ الأهمية. فعندما يتصرف النموذج بقدر أكبر من القابلية للتوقع، يمكنك أن تبدأ في بناء حدس حول ما ستنتجه أوامرك. تتوقف عن تصحيح الفيزياء وتبدأ في التفكير في الإخراج السينمائي.
موقعه ضمن عائلة Kling
توسعت عائلة نماذج Kling بشكل كبير خلال السنوات الأخيرة. لديك Kling v1.6 Standard للتكرارات السريعة منخفضة التكلفة، وKling v2.1 Master لمخرجات متوسطة المدى بدقة أعلى، وKling v2.5 Turbo Pro لعمليات التوليد السينمائية السريعة، وKling v3 Video بوصفه النموذج الرائد حاليًا. البدء بالإصدار 3 كمبتدئ منطقي: تعايَر على أفضل خط أساس متاح، ما يعني التقليل من الحيرة حول ما إذا كانت أوامرك سيئة أو أن النموذج محدود ببساطة.

قبل أن تكتب أي أمر نصي
وضعان، وطريقتا تفكير
يعمل Kling v3 Video في وضعين أساسيين على PicassoIA: Text to Video وImage to Video. فهم الوضع الذي تستخدمه قبل أن تبدأ يشكّل كل شيء في طريقة كتابة مدخلاتك.
- Text to Video: تصف مشهدًا من الصفر. ينشئ النموذج المحتوى البصري والحركة معًا. أكثر إبداعًا، لكنه أكثر تفاوتًا أيضًا.
- Image to Video: ترفع صورة ثابتة وتصف الحركة التي تريد تطبيقها عليها. تتحكم في نقطة البداية البصرية وتوجّه فقط ما يتحرك. غالبًا ما يكون أسهل للمبتدئين لأن نصف المشكلة البصرية محلول بالفعل.
إذا كانت لديك فكرة قوية دون صورة مرجعية، ابدأ بالنص. وإذا كانت لديك صورة تحبها وتريد أن تراها تنبض بالحياة، فاستخدم وضع الصورة. المساران متاحان مباشرة على صفحة نموذج Kling v3 Video على PicassoIA.
ما الذي تتحكم فيه فعلًا "المدة"؟
الإعداد الذي يسيء المبتدئون فهمه دائمًا تقريبًا هو المدة. يتيح Kling 3.0 مقاطع تتراوح بين حوالي 5 و10 ثوانٍ. يبدو هذا النطاق صغيرًا، لكنه يغيّر تمامًا ما يجب أن يحققه أمرك النصي.
يعمل المقطع الذي مدته 5 ثوانٍ بأفضل شكل مع حركة واحدة واضحة: موجة تنكسر، أو وجه يستدير، أو كاميرا تقترب ببطء. أما المقطع المدته 10 ثوانٍ فيحتاج إلى مزيد من المحتوى. إذا كان أمرك النصي يصف لحظة واحدة، فستنتج نسخة المدة 10 ثوانٍ غالبًا حشوًا: توقفات طويلة، وحركات متكررة، وانجراف خفيف دون هدف.
قاعدة عامة: اجعل مدة المقطع متناسبة مع عدد الأشياء المتميزة التي تريد أن تحدث. حركة واحدة = 5 ثوانٍ. مقطعان أو ثلاثة مقاطع متميزة = من 8 إلى 10 ثوانٍ.

كتابة أول أمر نصي لك
صيغة الأمر النصي من أربعة أجزاء
تتبع البنية الأكثر موثوقية لأمر نصي في Kling 3.0 أربعة مكونات بالترتيب:
- الشخص أو الموضوع (من أو ما الموجود في المشهد)
- الحركة (ما الذي يتحرك أو يحدث)
- البيئة (أين يدور المشهد، بما في ذلك الإضاءة ووقت اليوم)
- الكاميرا (الزاوية أو الحركة أو سلوك العدسة الذي تريده)
أمر نصي سيئ: "امرأة عند غروب الشمس"
أمر نصي يعمل: "امرأة ترتدي فستانًا أبيض تسير ببطء على شاطئ عند الساعة الذهبية، وشعرها يتطاير مع النسيم، والكاميرا تتبعها من جانبها بمستوى نظر العين"
الفرق ليس في الطول. بل في الدقة في وصف الحركة وسلوك الكاميرا. يحتاج النموذج إلى أن يعرف ما الذي يتحرك، لا ما الذي يوجد داخل الإطار فحسب.
كلمات تُفعّل الحركة
تعمل كلمات معينة في أمرك النصي كمفعّلات للحركة. إدراجها يساعد النموذج على إعطاء الأولوية للمحتوى الديناميكي بدلًا من اللقطات الثابتة.
| كلمات الحركة | كلمات الكاميرا | كلمات الأجواء |
|---|
| يمشي، يركض، ينجرف | لقطة تتبّع (tracking shot) | الساعة الذهبية |
| تتكسر الأمواج | بانوراما بطيئة (slow pan) | ضباب الصباح |
| تهبّ الريح عبر | اقتراب، ابتعاد | مطر يتساقط |
| تتراقص النار | هبوط جوي (aerial descent) | أوراق تتساقط |
| يتصاعد البخار | مدار، دوللي (orbit, dolly) | ضباب يزحف |
إن استخدام كلمة حركة واحدة على الأقل وكلمة كاميرا واحدة على الأقل في كل أمر نصي يحسّن بشكل كبير اتساق المخرجات، خاصة للمبتدئين الذين ما زالوا يعايرون حدسهم حول ما ينجح.
ما يجب تجنبه في أوامرك الأولى
ثلاثة أنماط تنتج بشكل موثوق نتائج أولى سيئة مع Kling v3 Video:
عدد كبير جدًا من الأشخاص أو الموضوعات: "امرأة وكلب وطفل يلعبون في حديقة بينما تحلّق الطيور فوق الرؤوس ونافورة تعمل في الخلفية." يوزّع النموذج ميزانية الحركة على كل هذه العناصر، ولا يُنفّذ عادةً أيًا منها بشكل جيد. اختر محورًا واحدًا.
إضاءة متناقضة: "غروب الشمس مع إضاءة استوديو" يتصارعان مع بعضهما. سيحاول النموذج مزجهما وينتج شيئًا ليس طبيعيًا ولا مقصودًا. اختر مصدر ضوء واحدًا والتزم به.
حركة غامضة: "مشهد جميل يتكشف" لا يخبر النموذج بشيء عن الحركة. كن محددًا: "صقر ينقضّ نحو سطح الماء ويرتفع في اللحظة الأخيرة."

الإعدادات التي تهم فعلًا
نسبة العرض إلى الارتفاع وما تدل عليه
يخبر اختيارك لنسبة العرض إلى الارتفاع النموذج بشيء عن النية البصرية، لا عن الأبعاد فقط.
| النسبة | الأفضل لـ |
|---|
| 16:9 | المشاهد السينمائية، والمناظر الطبيعية، واللقطات التأسيسية |
| 9:16 | المحتوى الاجتماعي، والصور الشخصية، والسرد العمودي |
| 1:1 | المحتوى المتمحور حول المنتج والتحريري |
بالنسبة لأول فيديو، تُعد 16:9 الخيار الأكثر أمانًا. تبدو معظم الحركات أفضل مع مساحة أفقية تتحرك فيها. الشخص الذي يمشي بنسبة 9:16 يقاوم الإطار؛ أما في 16:9 فهناك مساحة تتنفس فيها الحركة بشكل صحيح.
المفاضلة بين الجودة والسرعة
يقدم Kling v3 Video على PicassoIA مستويات جودة متعددة. تنتج إعدادات الجودة الأعلى حركة أنعم، وتماسكًا زمنيًا أفضل، وتفاصيل أكثر في الأسطح والملمس. لكنها تستغرق وقتًا أطول في التوليد وتكلّف نقاطًا أكثر.
في المحاولة الأولى، شغّل بالجودة القياسية. أنت تختبر بنية أمرك النصي، لا تطارد منتجًا نهائيًا. عندما ينتج أمرك الحركة والتكوين الصحيحين، رقِّ إلى الجودة العالية للنسخة النهائية.
نصيحة لسير العمل: ابدأ بسرعة، وانهِ ببطء. أنفق النقاط على التكرار الذي اقترب من الصواب، لا على النسخة التي لم تجربها بعد.
إعدادات حركة الكاميرا
يتضمن Kling v3 Video عناصر تحكم مخصصة لحركة الكاميرا، منفصلة عمّا تصفه في نص الأمر. وتشمل:
- Static: لا حركة للكاميرا. يتحرك المشهد، أما الكاميرا فلا تتحرك.
- Pan (يسارًا أو يمينًا): تدور الكاميرا أفقيًا.
- Tilt (لأعلى أو لأسفل): تدور الكاميرا عموديًا.
- Zoom In or Out: يتغير البعد البؤري دون حركة فعلية للكاميرا.
- Dolly In or Out: تتحرك الكاميرا فعليًا نحو الموضوع أو بعيدًا عنه.
- Orbit: تدور الكاميرا حول الموضوع.
بالنسبة للمبتدئين، يُعد Dolly In نقطة البداية الأكثر موثوقية. يخلق إحساسًا بالحضور والتركيز دون الحاجة إلى تتبع دقيق للموضوع. اقرنه بموضوع ثابت في المقدمة وستحصل غالبًا على نتيجة مقنعة.

كيفية استخدام Kling v3 على PicassoIA
الخطوة 1: اختر نوع المشهد أولًا
قبل فتح النموذج، قرر ما إذا كنت تصنع مشهدًا طبيعيًا أم صورة شخصية أم مشهدًا حضريًا. يشكّل هذا القرار مفردات أمرك النصي. تتحمل المشاهد الطبيعية قدرًا أكبر من التجريد. أما مشاهد الصور الشخصية والأزياء فتحتاج إلى وصف محدد لفعل بشري. وتستفيد المشاهد الحضرية من تفاصيل الطقس ووقت اليوم المدمجة في الأمر.
الخطوة 2: اكتب أمرك النصي قبل أن تفتح الأداة
اكتب أمرك النصي في تطبيق الملاحظات أو محرر النصوص أولًا. هذا يمنع قلق الحقل الفارغ الذي يؤدي إلى إدخالات غامضة. اتبع صيغة الأجزاء الأربعة: الشخص أو الموضوع، والحركة، والبيئة، والكاميرا. استهدف جملتين أو ثلاث جمل. اقرأه مرة أخرى واسأل نفسك: "ما الذي يتحرك تحديدًا في هذا المشهد؟" إذا لم تستطع الإجابة، فأضف فعلًا.
الخطوة 3: اضبط الإعدادات وولّد
انتقل إلى Kling v3 Video على PicassoIA والصق أمرك النصي المُعد. اضبط المعاملات:
- المدة: 5 ثوانٍ (المحاولة الأولى)
- نسبة العرض إلى الارتفاع: 16:9
- الجودة: قياسية
- Camera Motion: Dolly In
انقر على توليد وانتظر. قاوم الرغبة في تغيير أي شيء أثناء المعالجة. دع الأمر الحالي يكتمل قبل أن تقرر ما الذي يحتاج إلى تعديل.
الخطوة 4: راجع بمشاهدتين
عندما يصل فيديوك، شاهده مرتين قبل إصدار أي حكم. المشاهدة الأولى: هل تبدو الحركة منطقية من الناحية الفيزيائية؟ المشاهدة الثانية: هل التكوين مثير للاهتمام؟ إذا كانت الإجابة نعم على الاثنين، فلديك أساس عملي. إذا كانت الحركة خاطئة لكن التكوين متماسك، فعدّل كلمات الحركة. إذا كان التكوين غير مناسب لكن الحركة تبدو صحيحة، فعدّل وصف البيئة والكاميرا.

قراءة نتيجتك بموضوعية
كيف تبدو المحاولة الأولى الناجحة
لا يحتاج أول فيديو ناجح إلى أن يكون سينمائيًا. يحتاج إلى أن يُظهر ثلاثة أشياء:
- الشخص الرئيسي يمكن التعرف عليه طوال المقطع كله
- عنصر واحد على الأقل في المشهد يتحرك بطريقة معقولة فيزيائيًا
- حركة الكاميرا (إن وُجدت) لا تُدخل تشوهات أو عيوبًا بصرية مزعجة
إذا حققت محاولتك الأولى الشروط الثلاثة، فبنية أمرك النصي تعمل. من هنا تنتقل إلى تحسين الجوانب الجمالية، لا البنية.
متى تعيد التوليد ومتى تعدّل
أعد التوليد (الأمر النصي نفسه مع قيمة بذرة جديدة) عندما يكون منطق الحركة صحيحًا لكن التنفيذ جاء متعثرًا في هذه اللقطة تحديدًا، أو عندما تظهر عيوب بسيطة في مقطع واعد بخلاف ذلك. تمنحك إعادة التوليد تفسيرًا مختلفًا للتوجيه نفسه.
عدّل (غيّر الأمر النصي) عندما تكون الحركة خاطئة باستمرار عبر مرتين أو أكثر من إعادة التوليد، أو عندما يكون الشخص غير قابل للتمييز في كل مخرجات. تعديل الأمر النصي يعني العودة إلى صيغة الأجزاء الأربعة وإضافة التحديد.
لا تكرر أكثر من 3 مرات على الأمر النصي المعطوب نفسه. إذا لم يعمل شيء بعد ثلاث محاولات، فالمشكلة في بنية الأمر النصي، لا في قيمة البذرة العشوائية.
الخطأ الواحد الذي يُفسد معظم المحاولات الأولى
تشترك معظم أول الفيديوهات الفاشلة في السبب الجذري نفسه: يصف الأمر النصي صورة ثابتة، لا مشهدًا متحركًا. إذا كان بإمكانك تصوير ما وصفته، فليس لدى النموذج معلومات حركة يعمل بها.
اسأل نفسك: "هل يوجد فعل في أمري النصي يصف حركة فيزيائية؟" إذا لم يكن الأمر كذلك، فأضف واحدًا قبل إعادة التوليد.

5 قوالب أوامر نصية تعمل
أنتجت هذه القوالب نتائج متسقة مع Kling v3 Video. استخدمها كما هي، أو بدّل التفاصيل لتناسب رؤيتك.
المشاهد الطبيعية
"تتمايل شجرة صنوبر منفردة في رياح قوية على حافة صخرية تطل على محيط رمادي عند الغسق، والكاميرا تقترب ببطء من منتصف المسافة، والضوء الغائم منتشر وناعم، والأغصان في حركة دائمة"
"يتدفق شلال بقوة إلى بركة داكنة في غابة كثيفة عند الظهيرة، وينبعث الضباب من السطح، والكاميرا ثابتة بمستوى نظر العين، ورذاذ الماء مرئي في الهواء الأمامي"
الصور الشخصية والأزياء
"امرأة ترتدي معطفًا أحمر ضيقًا تسير نحو الكاميرا على رصيف مدينة مبلل ليلًا، بخطوة واثقة، وأضواء الشوارع بتأثير البوكيه خلفها، والكاميرا تتبعها للأمام بمستوى نظر العين، ومطر خفيف يتساقط حولها"
"رجل في الثلاثينيات من عمره يجلس على طاولة قرب نافذة مقهى، وضوء الصباح يتسلل على وجهه، وبخار يتصاعد من فنجان قهوة، ونظرته تتحول ببطء نحو النافذة، والكاميرا ثابتة مع انجراف خفيف للتركيز نحو عينيه"
البيئات الحضرية
"تقاطع مزدحم عند الشفق، والسيارات تمر بانسيابية مع خطوط ضوئية من تأثير ضبابية الحركة، والمشاة يتحركون عبر الإطار، والكاميرا في موضع ثابت بزاوية مرتفعة تنظر إلى الأسفل، والإضاءة الحضرية المحيطة تدفئ المشهد كله من الأسفل"

ما بعد أول فيديو لك
بمجرد أن تتقن الأساسيات مع Kling v3 Video، تنفتح المنصة بشكل كبير. تمنحك مجموعة تحويل النص إلى فيديو في PicassoIA حق الوصول إلى أكثر من 80 نموذجًا، لكل منها نقاط قوة مختلفة في أسلوب الحركة والدقة والتخصص في الموضوع. يتفوق بعضها في الحركة البشرية، وآخر في الديناميكيات البيئية أو فيزياء الحركة البطيئة. ومع بناء حدسك مع Kling 3.0، ستبدأ في إدراك متى يخدم نموذج آخر لقطة معينة بشكل أفضل.
يمكنك أيضًا دمج المقاطع التي أنشأها Kling مع أدوات أخرى على PicassoIA. تقوم نماذج Super Resolution برفع دقة مخرجاتك لتفاصيل أكثر وضوحًا. تقوم AI Video Enhancement بتثبيت المقاطع التي خرجت مهتزة قليلًا أو استعادتها. يضيف Lipsync كلامًا متزامنًا إلى فيديوهات الصور الشخصية للعروض التقديمية أو المحتوى الاجتماعي. تطبّق Effects طبقات أسلوبية تعمل بنظافة على اللقطات الحقيقية دون تدهور الجودة الأصلية. ينتقل سير العمل من نموذج واحد إلى خط إنتاج متكامل دون مغادرة المنصة.
الأشخاص الذين يستفيدون أكثر من توليد الفيديو بالذكاء الاصطناعي ليسوا من يكتبون أكثر الأوامر تعقيدًا في المحاولة الأولى. بل هم من يبنون حلقة ملاحظات سريعة: أمر بسيط، وتوليد سريع، ومراجعة صادقة، وتعديل مستهدف. يكافئ Kling v3 Video هذا الانضباط أكثر من أي نموذج آخر في فئته حاليًا.
أول فيديو لك على بُعد أمر نصي واحد
الحاجز أمام أول فيديو بالذكاء الاصطناعي هو أمر نصي واحد وبعض اختيارات الإعدادات. يضع PicassoIA Kling v3 Video على بُعد نقرة واحدة، دون أي إعداد مطلوب سوى تسجيل الدخول.
اختر مشهدًا يمكنك تصوره بوضوح. طبّق صيغة الأجزاء الأربعة. اضبط المدة على 5 ثوانٍ وحركة الكاميرا على Dolly In. ثم انقر على توليد.
لن يكون أول فيديو لك مثاليًا. ولا يحتاج إلى ذلك. ما سيفعله هو أن يُريك بالضبط ما يجب إصلاحه، وهكذا يبدأ كل سير عمل إبداعي جيد: بنتيجة حقيقية تستجيب لها، لا بصفحة بيضاء تخاف منها. الفيديو الثاني أفضل دائمًا. والثالث أفضل منه. ابدأ مع Kling v3 على PicassoIA وشاهد ما ينتجه أول تجربة لك.