Gemini 3.2 Pro ليس مولّدًا للفيديو. هذا الفرق مهم أكثر مما قد تخبرك به معظم الشروحات، لأن سوء فهمه يقود إلى ساعات من الإحباط ونتائج مخيبة. إنه نموذج لغوي كبير يتمتع بقدرات استدلال متعدد الوسائط، وعندما تستخدمه بالشكل الصحيح كمساعد في الكتابة، ومهندس للأوامر، ومخرج إبداعي، يصبح واحدًا من أقوى الأدوات في سير عمل إنتاج الفيديو.
يشرح هذا المقال بالتفصيل كيف يعمل هذا السير: بدءًا من جعل Gemini 3.2 Pro يكتب سيناريوهات قابلة للاستخدام، مرورًا بتحويل هذه السيناريوهات إلى أوامر مُحسّنة لنماذج الذكاء الاصطناعي المتخصصة في الفيديو، وصولًا إلى اختيار المنصات المناسبة لكل جزء من العمل.
ماذا يفعل Gemini 3.2 Pro فعلًا في مجال الفيديو
إنه نموذج لغوي أولًا
لا يولّد Gemini 3.2 Pro الفيديو بشكل أصلي. ما يجيده حقًا هو استيعاب الفيديو والتفكير فيه: بناء المشاهد، وكتابة الحوار، ووصف التكوينات البصرية، وإنتاج الأوامر المفصّلة والدقيقة تقنيًا التي تستجيب لها نماذج الذكاء الاصطناعي للفيديو بأفضل شكل.
فكّر فيه كالمخرج الإبداعي في سير عملك، لا كمشغّل الكاميرا. إنه يخطط، ويكتب، ويحسّن. أما نماذج الفيديو فهي من تنفّذ.
يحدد هذا الفرق كيفية توجيهك إلى Gemini 3.2 Pro في أعمال الفيديو. أنت لا تطلب منه صناعة فيديو، بل تطلب منه أن يفكر فيه معك.
الميزة متعددة الوسائط
ما يميّز Gemini 3.2 Pro عن النماذج اللغوية الأقدم هو قدرته متعددة الوسائط. يمكنك تزويده بصور مرجعية، أو رسومات أولية، أو لقطات شاشة لفيديوهات موجودة، وتطلب منه وصف ما يراه، ثم توليد أوامر مطابقة لأدوات الفيديو بالذكاء الاصطناعي. هذا مفيد بشكل خاص عندما تملك تصورًا بصريًا في ذهنك لكنك تجد صعوبة في وصفه بالكلمات.
على سبيل المثال، ارفع صورة فوتوغرافية بظروف إضاءة محددة واطلب: "صف هذه الصورة كما لو كنت تكتب أمرًا نصيًا لنموذج فيديو بالذكاء الاصطناعي. ضمّن اتجاه الإضاءة، وموضع الشخص، وزاوية الكاميرا، والمزاج، والحركة." غالبًا ما تكون النتيجة صالحة للاستخدام مباشرة في الخطوة التالية.
يمكنك الوصول إلى Gemini 3.1 Pro و Gemini 3 Pro مباشرة على PicassoIA، حيث يتوفر النموذجان للكتابة والتخطيط وهندسة الأوامر على المنصة نفسها التي تشغّل فيها توليد الفيديو.

قبل أن تبدأ: النموذج الذهني الصحيح
لا يوجد فيديو بنقرة واحدة هنا
يتعامل كثير من الناس مع Gemini 3.2 Pro متوقعين أن يصفوا فيديو في جملة واحدة ويحصلوا على شيء قابل للاستخدام. قد ينجح ذلك أحيانًا مع نماذج تحويل النص إلى فيديو المتخصصة. أما مع Gemini 3.2 Pro بوصفه أداتك الأساسية، فالعملية أكثر تعمدًا. والاستثمار فيها يستحق العناء. الفيديوهات الناتجة عن سير عمل يعتمد على Gemini أكثر اتساقًا، وأكثر تحديدًا بصريًا، وأسهل بكثير في التكرار والتحسين. وعندما لا تنجح النتيجة، تعرف بالضبط أي جزء من الأمر يجب تعديله.
سير العمل من خطوتين
سير العمل الكامل هو:
- الخطوة 1: استخدم Gemini 3.2 Pro لكتابة سيناريو الفيديو وتحسينه، وبناء المشاهد، والأوصاف البصرية التفصيلية.
- الخطوة 2: مرّر هذه المخرجات كأوامر إلى نموذج متخصص في الفيديو بالذكاء الاصطناعي على منصة مثل PicassoIA.
تكمن الصعوبة في التنفيذ، وتحديدًا في كيفية توجيهك إلى Gemini 3.2 Pro خلال الخطوة 1، وفي اختيارك لنموذج الفيديو المناسب في الخطوة 2.
كتابة سيناريوهات الفيديو باستخدام Gemini 3.2 Pro
أكثر استخدام فعاليةً لنموذج Gemini 3.2 Pro في سير عمل الفيديو هو كتابة السيناريو. ليس لأنه يكتب أفضل من كاتب سيناريو بشري في كل الحالات، بل لأنه يكتب أسرع، ويمكن أن تُفرض عليه قيود بنيوية دقيقة، ويستطيع في الوقت نفسه إنتاج الحوار والوصف البصري لكل مشهد.
ابدأ بموجز واضح. كلما كنت أكثر تحديدًا، كانت النتيجة أكثر فائدة:
"اكتب سيناريو فيديو مدته 30 ثانية لإعلان على وسائل التواصل الاجتماعي. المنتج آلة إسبريسو محمولة للمسافرين. النبرة دافئة وطبيعية، وليست مؤسسية. ضمّن ثلاثة مشاهد. لكل مشهد، اكتب الحوار أو التعليق الصوتي، ثم اكتب وصفًا بصريًا تفصيليًا يتضمن زاوية الكاميرا، والإضاءة، وسلوك الشخص، والمكان."
ينتج هذا الأمر مخرجات منظمة وقابلة للاستخدام خلال ثوانٍ. قارنه بطلب عام مثل "اصنع لي إعلان فيديو"، الذي ينتج دائمًا شيئًا عامًا.
تفصيل مشهد بمشهد
لأي فيديو يتجاوز 30 ثانية، اطلب من Gemini 3.2 Pro تقسيم الفيديو إلى مشاهد فردية قبل كتابة أي شيء. يمنع أسلوب المشهد بمشهد انحراف السرد ويجعل مرحلة هندسة الأوامر النهائية أنظف بكثير.
يبدو طلب تفصيل المشاهد النموذجي كالتالي:
"أريد فيديو علامة تجارية مدته 90 ثانية لعلامة ملابس مستدامة. قبل كتابة أي شيء، أعطني تفصيلًا مشهدًا بمشهد يتضمن التوقيت، والمزاج، والموقع، والصورة البصرية الأساسية لكل مشهد. سأوافق على البنية قبل أن تكتب أي شيء."
يُنتج هذا النهج على مرحلتين، البنية أولًا ثم المحتوى، نتائج أفضل باستمرار من طلب بمرحلة واحدة.
بنية الأمر التي تحقق النتائج
بعد أن توافق على السيناريو، اطلب من Gemini 3.2 Pro تحويل كل مشهد إلى أمر لتوليد الفيديو. هنا يفقد معظم الناس الجودة. هذا طلب تحويل جيد:
"حوّل المشهد 2 من السيناريو أعلاه إلى أمر مُحسّن لنموذج توليد فيديو بالذكاء الاصطناعي. ضمّن: وصف الشخص، والحركة أو الفعل، وزاوية الكاميرا وعدستها، واتجاه الإضاءة وجودتها، وتفاصيل المكان، والجو والمزاج. اجعله أقل من 100 كلمة. لا تضمّن أي تعليمات موجهة للنموذج، بل الوصف البصري فقط."
قيد الطول مهم. تعمل معظم نماذج الفيديو بالذكاء الاصطناعي بشكل أفضل مع أوامر مركزة من الأوامر الشاملة.

تحويل السيناريوهات إلى أوامر فيديو مُحسّنة
هذه هي الخطوة التي تتجاهلها معظم الشروحات، وهي أكثرها قيمة. هناك فرق كبير بين سيناريو الفيديو وأمر توليد الفيديو. يستطيع Gemini 3.2 Pro توليد كليهما، لكنه يحتاج إلى فهم الفرق بينهما.
يصف السيناريو ما يحدث، بينما يصف أمر الفيديو ما ينبغي لنموذج الذكاء الاصطناعي أن يصيّره، ويشمل ذلك تفاصيل لا تظهر أبدًا في السيناريو: عدسة الكاميرا، وعمق الميدان، ودرجة حرارة الإضاءة، وتفاصيل الملمس، وسرعة الحركة، والجو العام.
ما الذي يتغير بين السيناريو والأمر
| عنصر السيناريو | المكافئ في أمر الفيديو |
|---|
| "تدخل المرأة إلى الغرفة" | "امرأة في الثلاثينيات ترتدي فستانًا من الكتان تمشي ببطء من اليسار إلى اليمين عبر باب، عدسة 85 ملم، عمق ميدان ضحل، ضوء صباحي من اليمين" |
| "المنتج موضوع على المنضدة" | "آلة إسبريسو محمولة على منضدة رخامية متآكلة، لقطة مقربة من الأعلى، بخار يتصاعد، إضاءة خلفية دافئة، عدسة ماكرو 50 ملم" |
| "يبدو المكان دافئًا وحميميًا" | "إضاءة عملية كهرمانية دافئة، تعريض ضوئي أقل بقليل، حبيبات فيلم، فتحة عدسة 1.8، حواف ظل ناعمة" |
يحتاج تدريب Gemini 3.2 Pro على مهمة التحويل هذه إلى مثال واحد منظم جيدًا. بعد ذلك، يتعامل مع التحويل بموثوقية عبر سيناريو كامل.
حلقات تحسين الأوامر
من أكبر مزايا استخدام نموذج لغوي في هندسة الأوامر القدرة على التحسين التكراري. بعد توليد الفيديو، صف ما حصلت عليه مقابل ما أردته:
"جاء الفيديو مظلمًا جدًا، وكان الشخص قريبًا جدًا من الكاميرا. عدّل الأمر لإضافة مزيد من الإضاءة المحيطة، وسحب الكاميرا إلى الخلف لإظهار مزيد من المكان."
يتعامل Gemini 3.2 Pro مع حلقة التصحيح هذه بإتقان ويُنتج أوامر معدّلة فورًا.

Gemini 3.2 Pro مقابل النماذج اللغوية الأخرى في هذا السير
Gemini 3.2 Pro ليس الخيار الوحيد لهذا السير. لكنه، مع ذلك، من أفضل الخيارات لمهام الفيديو المحددة، بفضل قدرته الأقوى على الاستدلال متعدد الوسائط وإلمامه باللغة البصرية.
| النموذج | نقاط القوة في عمل الفيديو | نقاط الضعف |
|---|
| Gemini 3.2 Pro | إدخال متعدد الوسائط، ولغة بصرية، وأوصاف مشاهد قوية | أقل متانة في السرد الطويل |
| Gemini 3.5 Flash | السرعة، ودورات تكرار سريعة | أوصاف بصرية أقل دقة |
| GPT 5 | عمق الكتابة الإبداعية، وحوار قوي | أضعف في تفاصيل الأوامر البصرية |
| Claude Opus 4.7 | المستندات الطويلة، واتباع التعليمات بدقة | تكرار أبطأ |
| DeepSeek R1 | سلاسل الاستدلال، والمخرجات المنظمة | أقل إبداعًا في النبرة |
بالنسبة لمعظم سيناريوهات الفيديو، يقع Gemini 3.2 Pro في النقطة المثلى بين الإبداع في المخرجات وتحديد الأوامر. وإذا كانت السرعة هي الأولوية، فإن Gemini 3 Flash يتعامل مع السير نفسه بوتيرة أسرع مع عمق تفصيل أقل قليلًا.
استخدام نماذج Gemini على PicassoIA
تتيح لك PicassoIA السير كله في مكان واحد. بدلًا من التنقل بين منصات متعددة، يمكنك تشغيل Gemini 3.1 Pro لعمل السيناريو والأوامر في الجلسة نفسها التي تشغّل فيها نماذج الفيديو.
يتضمن قسم النماذج اللغوية الكبيرة على PicassoIA مجموعة Google الكاملة، من Gemini 2.5 Flash للتكرار السريع، إلى Gemini 3 Pro للمهام الإبداعية الأكثر تطلبًا.
كيفية الوصول إليه
- افتح قسم النماذج اللغوية الكبيرة على PicassoIA
- اختر Gemini 3.1 Pro أو Gemini 3 Pro من نماذج Google
- ألصق موجز الفيديو الخاص بك وشغّل سير توليد السيناريو الموضح أعلاه
- انسخ الأوامر الناتجة وانتقل مباشرة إلى قسم توليد الفيديو
- اختر نموذج الفيديو الخاص بك والصق الأوامر
المنصة نفسها، بلا تبديل للسياق. تتراكم كفاءة سير العمل هذه بسرعة في أي بيئة إنتاج.

نماذج الفيديو الأنسب لمخرجات Gemini
بعد أن يولّد Gemini 3.2 Pro أوامرك، يحدد اختيار نموذج الفيديو جودة المخرجات البصرية. تملك النماذج المختلفة نقاط قوة مختلفة، والاختيار الصحيح يعتمد على ما تنتجه.
Veo 3.1: الاقتران الطبيعي
Veo 3.1 هو نموذج Google الخاص لتحويل النص إلى فيديو، وهذا ما يجعله الأكثر توافقًا بشكل طبيعي مع مخرجات Gemini 3.2 Pro. دربت Google هذه الأنظمة على لغة بصرية متشابهة، لذلك تعمل الأوامر التي يولّدها Gemini على Veo 3.1 دون مفاجآت كثيرة.
يستحق Veo 3.1 Fast الاستخدام في مرحلة التكرار. زمن الاستجابة المنخفض يعني أنه يمكنك اختبار أمر خلال ثوانٍ وتحسينه قبل الالتزام بتصيير بجودة كاملة. ويقدّم Veo 3 صوتًا أصليًا إلى جانب الفيديو، وهذا مهم للمحتوى الاجتماعي الذي يجب أن يقف بذاته دون مونتاج صوتي لاحق.
نصيحة احترافية: عند استخدام Veo 3.1 مع أوامر يولّدها Gemini، اطلب من Gemini تضمين ملاحظات تصميم الصوت في الأمر بشكل صريح. الصوت الأصلي في Veo 3 يستجيب لهذه الإشارات.
Seedance 2.0: عندما تحتاج إلى صوت متزامن
يولّد Seedance 2.0 من ByteDance فيديو مع مزامنة صوتية مدمجة، ما يجعله قويًا للمحتوى الذي يكون فيه توقيت الصوت بأهمية الصورة. مقاطع الموسيقى، والمحتوى التجاري المرتبط بالإيقاع، وعروض المنتجات التي يقود فيها الإشارة الصوتية القطع البصري، كلها تخدمها Seedance 2.0 بشكل أفضل من النماذج التي لا تملك صوتًا أصليًا.
يسري سير أوامر Gemini نفسه تمامًا. أضف حقل وصف للصوت إلى قالب الأمر، وستحاول Seedance 2.0 مطابقته.
Kling v3 وWan 2.7 للتحكم في الحركة
يتفوق Kling v3 في الحركة السينمائية: البانوراما البطيئة، والاقتراب بعربة التصوير، وحركات الكاميرا التي تبدو مقصودة لا مولّدة بالذكاء الاصطناعي. عندما يحدد سيناريو Gemini حركة الكاميرا، يميل Kling v3 إلى تنفيذها بأعلى دقة.
يتعامل Wan 2.7 T2V مع مخرجات بدقة 1080p، ويستحق الاستخدام عندما تكون الدقة أهم من الحركة الإبداعية. اللقطات الثابتة، والمقربات للمنتجات، وعروض العمارة تبدو قوية بشكل خاص عبر Wan 2.7.
لمقاربة مختلفة للجودة السينمائية، يقدّم Ray 3.2 من Luma تصييرًا بنطاق HDR يصمد جيدًا على الشاشات الكبيرة. مخرجاته تميل إلى أن تبدو مصقولة دون الحاجة إلى معالجة لاحقة كبيرة.

3 أخطاء تُفسد النتائج
أن تكون غامضًا مع Gemini
الخطأ الأكثر شيوعًا: أن تعطي Gemini 3.2 Pro موجزًا من جملة واحدة وتتوقع أمرًا جاهزًا للإنتاج. "اصنع فيديو عن القهوة" ينتج مخرجات عامة. أما "اكتب أمر فيديو مدته 20 ثانية لإعلان في مقهى قهوة مختص، يظهر فيه باريستا في الأربعينيات من عمرها وهي تصب لاتيه على بار خشبي، إضاءة دافئة من نافذة على اليسار بعد الظهر، صب بالحركة البطيئة، عدسة 85 ملم، أصوات مقهى محيطة" فينتج شيئًا يمكنك استخدامه فعلًا.
التحديد ليس اختياريًا. كلما أعطيت سياقًا أكثر، كانت المخرجات أكثر فائدة.
تخطي خطوة تحسين الأمر
يأخذ كثير من الناس المسودة الأولى من Gemini مباشرة إلى نموذج الفيديو دون مراجعتها. المسودة الأولى نقطة بداية، لا منتج نهائي. اقرأها. اسأل: هل تصف ما تريده فعلًا؟ هل موقع الكاميرا واضح؟ هل يقوم الشخص بفعل محدد؟ هل ظروف الإضاءة دقيقة؟
أصلح الأمر قبل التوليد. توليد الفيديو يستغرق وقتًا. تكرار تحسين أمر سيئ يهدر وقتًا أكثر من تحسينه قبل أن تبدأ.
استخدام نموذج واحد لكل شيء
LTX 2 Pro ممتاز في المخرجات بدقة 4K، لكنه قد لا يكون الخيار المناسب لمقاطع التواصل الاجتماعي السريعة. Pixverse v6 يتعامل جيدًا مع الفيديو السينمائي المتزامن مع الصوت، لكنه يختلف في سلوكه عن P Video، المحسّن للتكرار السريع بتكلفة أقل.
ابنِ مكتبة قصيرة من النماذج التي تلجأ إليها في كل موقف. نموذجان أو ثلاثة موثوقة تعرفها جيدًا ستتفوق على نموذج غير مألوف في كل مرة.

أمثلة حقيقية على أوامر أنتجت نتائج
هذه أمثلة لأوامر مولّدة عبر سير عمل Gemini 3.2 Pro أنتجت مخرجات فيديو متسقة وقابلة للاستخدام.
المحتوى القصير للتواصل الاجتماعي
الموجز المقدَّم إلى Gemini:
"فيديو مدته 30 ثانية على Instagram لعلامة تجارية بسيطة للعناية بالبشرة. ثلاثة مشاهد: طقس الصباح، ونزهة في الهواء الطلق، وتهدئة المساء. الجمهور المستهدف: نساء بين 25 و40 عامًا. دافئ، هادئ، حقيقي."
مخرج Gemini للمشهد 1، محوّلًا إلى أمر فيديو:
"امرأة في أوائل الثلاثينيات تقف عند حوض حمام أبيض في ضوء الصباح، تضع مصلًا شفافًا بكلتا يديها، وتنظر إلى المرآة بتعبير هادئ. لقطة من زاوية متوسطة على مستوى المنضدة، 85 ملم f/2.0، عمق ميدان ضحل. ضوء صباحي ناعم ومنتشر من نافذة مصنفرة على اليمين. بلا مشتتات حركية، صمت محيطي. نغمات دافئة محايدة، مع ظهور ملمس البشرة."
هذا الأمر، عند تمريره إلى Veo 3.1 أنتج لقطات قابلة للاستخدام من المحاولة الأولى.
فيديوهات عروض المنتجات
تستفيد عروض المنتجات من قدرة Gemini على كتابة أوصاف بصرية دقيقة تقنيًا. الأوامر التي تتضمن ملمس السطح، واتجاه الإضاءة، وحجم الشخص أو المنتج تنتج لقطات أكثر اتساقًا من أوصاف عامة مثل "منتج على طاولة". اطلب من Gemini أن يصف المنتج أولًا كما لو كان صورة طبيعة صامتة، ثم يحوّل هذا الوصف إلى حركة.
الأفلام القصيرة السينمائية
في العمل السردي، يتألق Gemini 3.2 Pro في تطوير الأقواس العاطفية مشهدًا بمشهد. اطلب منه كتابة الدلالة البصرية الضمنية: ما الذي ينبغي للكاميرا أن تبرزه لإيصال شعور دون حوار. المخرجات غالبًا ما تتضمن تفاصيل تستجيب لها نماذج الفيديو بالذكاء الاصطناعي بشكل خاص، مثل "يدا الشخص خارج الإطار قليلًا، وتبقى الكاميرا على العينين."

بناء نظام إنتاج فيديو قابل للتكرار
قوة هذا السير لا تكمن في أي فيديو منفرد، بل في النظام الذي تبنيه حوله.
نهج القالب
أنشئ قالب أوامر في Gemini 3.2 Pro تعود إليه في كل مشروع فيديو جديد. ينبغي أن يتضمن القالب حقولك القياسية: صوت العلامة التجارية، ونوع الموضوع، والمدة، والصيغة (التواصل الاجتماعي، أو المحتوى الطويل، أو المنتج)، ونموذج المخرجات، وأي مراجع للأسلوب. ملء القالب يستغرق دقيقتين وينتج موجزًا يستطيع Gemini تحويله إلى سيناريو كامل فورًا.
الفرق التي تعمل بهذا النهج تنتج باستمرار محتوى أكثر في الأسبوع الواحد، لأن عبء اتخاذ القرار يُزال من كل دورة إنتاج على حدة.
الإنتاج الدفعي بالذكاء الاصطناعي
من الإمكانات غير المستغلة كثيرًا في سير Gemini توليد الأوامر دفعةً واحدة. أعطِ Gemini 3.2 Pro موجزًا واحدًا واطلب منه إنتاج خمس أو عشر نسخ، لكل منها زاوية كاميرا أو إعداد مشهد أو نهج نبرة مختلف. ثم شغّل كل النسخ عبر نموذج فيديو مثل Kling v2.6 أو Wan 2.6 T2V لتحديد الاتجاه البصري الأفضل قبل الاستثمار في تصيير بجودة أعلى.
هذا النهج الدفعي فعّال بشكل خاص لاختبار الإعلانات A/B، حيث تحتاج إلى خيارات بصرية متعددة من الموجز نفسه.
كيف يعمل: اطلب من Gemini عشر نسخ لموجز واحد، وولّد كل نسخة على نموذج سريع أولًا، وقيّم أيها يحقق أفضل أداء أو يبدو الأفضل بصريًا، ثم أعد تشغيل الفائزة بجودة كاملة على نموذج متميز.
ميزة السرعة هنا حقيقية. دفعة من عشر نسخ من الأوامر تستغرق من Gemini 3.2 Pro أقل من دقيقة لإنتاجها. تشغيلها عبر نموذج سريع مثل Veo 3.1 Fast أو Seedance 2.0 يمنحك عشرة خيارات بصرية للتقييم قبل الالتزام بأي شيء.

ابدأ الإنتاج على PicassoIA
كل ما يُوصف في هذا المقال متاح في مكان واحد على PicassoIA. يتولى Gemini 3.1 Pro الكتابة وهندسة الأوامر. ويتولى كتالوج توليد الفيديو، بما في ذلك Veo 3.1، وSeedance 2.0، وRay 3.2، وKling v3، وLTX 2 Pro، وPixverse v6، عملية التنفيذ، مع أكثر من 87 نموذج فيديو متاح.
يستحق هذا السير التجربة حتى بمشروع صغير واحد. اكتب موجزًا، ودع Gemini ينظّم السيناريو، وحوّله إلى أمر، ثم شغّله عبر Veo 3.1. حلقة التغذية الراجعة من دورة كاملة واحدة عبر هذا النظام ستعلّمك عن إنتاج الفيديو بالذكاء الاصطناعي أكثر من قراءة خمسة مقالات أخرى.
تتيح لك PicassoIA الوصول إلى كتالوج النماذج اللغوية الكبيرة كاملًا إلى جانب جميع نماذج الفيديو من منصة واحدة. تصفح المجموعة الكاملة على picassoia.com/en/all-models وجرّب أول فيديو يُوجَّه باستخدام Gemini اليوم.
