حين أطلقت xAI Grok Imagine Video 1.5، تحوّل الحديث في مجتمعات صنّاع المحتوى بسرعة من "ماذا يستطيع أن يفعل؟" إلى "ما الذي لا يرفض فعله؟". ارتبطت كلمة "غير خاضع للرقابة" بهذا النموذج سريعًا، ولذلك أسباب وجيهة. فهو يطبّق إشرافًا على المحتوى أخف من معظم المنافسين الرئيسيين، فيولّد مقاطع قد ترفضها أدوات مثل Veo 3 عادةً. يشرح هذا المقال ما يعنيه ذلك عمليًا، وكيف يصمد أداء النموذج تقنيًا، وكيف تصل إليه عبر PicassoIA للاستخدام الفوري.

ما هو Grok Imagine Video 1.5
مبنيّ على بنية توليد Aurora لدى xAI، يأخذ Grok Imagine Video 1.5 صورة ثابتة كإطار أول، ثم يُنشئ منها مقطع فيديو طبيعيًا متماسك الحركة. كما يقبل أوامر نصية فقط إن فضّلت تجاوز الصورة المصدر تمامًا. يصل طول الناتج إلى 15 ثانية بدقة 720p، دون علامة مائية مدمجة في الملف النهائي.
تُولَّد المقاطع بسرعة. بنية Aurora مُحسَّنة للإنتاجية، وأزمنة التوليد قصيرة بما يكفي لتجعل تكرار الأوامر النصية تجربة سلسة لا مرهقة. وعند إطلاقه، كان Grok 1.5 أسرع من Gen 4 من Runway ومن Seedance 2.5 بالدقة نفسها، مما ساهم في انتشاره السريع بين صنّاع المحتوى ذوي الإنتاج الكبير.
بنية Aurora
Aurora نموذج فيديو مملوك لشركة xAI، دُرِّب خصيصًا على طبيعية الحركة. الشعر والقماش والماء وحركة الإنسان كلها تتصرف بمعقولية فيزيائية يصعب على كثير من النماذج المنافسة بلوغها. وهذا الاتساق أهم ما يكون في المحتوى الواقعي، إذ تكسر الحركة الآلية الوهم فورًا.
يُسهم تركيز النموذج أثناء التدريب على لقطات من العالم الحقيقي بدل المصادر الاصطناعية في تفسير جودة الحركة في مشاهد مثل الشواطئ، وجلسات تصوير الأزياء والجلامور (glamour)، ولقطات الوجه المقرّبة حيث يجب أن تبقى الحركة الدقيقة مقنعة لعدة ثوانٍ.
المواصفات في لمحة
| المواصفة | القيمة |
|---|
| أقصى مدة | 15 ثانية |
| خيارات الدقة | 720p، 480p |
| نسب العرض إلى الارتفاع | 8 (16:9، 9:16، 1:1، وغيرها) |
| العلامة المائية | لا يوجد |
| الصوت | صوت محيطي متزامن |
| أنماط الإدخال | تحويل الصورة إلى فيديو، تحويل النص إلى فيديو |
سؤال "غير الخاضع للرقابة"

نادرًا ما تكون كلمة "غير خاضع للرقابة" مطلقة عند وصف نموذج ذكاء اصطناعي. عمليًا، يعني هذا مع Grok Imagine Video 1.5 أن xAI تطبّق مرشحًا أخف بكثير من المنافسين. الأوامر النصية التي تُسبب رفضًا فوريًا في Veo 3 أو Ray 3.2 أو Kling v3 Video تُولَّد هنا دون مشكلة.
أين تقع الحدود الصارمة
يحافظ Grok 1.5 على قيود صارمة. يرفض النموذج المحتوى الذي يتضمن قاصرين في سياقات جنسية للبالغين، والسيناريوهات غير الرضائية التي تُوصف بشكل صريح، وكل ما يتجاوز حدودًا غير قانونية بوضوح. لا تتغير هذه الحدود بتغيّر صياغة الأمر النصي. أما كل ما يقع خارج هذه الفئات فيندرج ضمن طيف واسع من التساهل، وهنا يتميّز هذا النموذج عن المنافسين الرئيسيين.
ما الذي يمكنك إنشاؤه فعلًا
يذكر صنّاع المحتوى الذين يستخدمون النموذج بانتظام أنهم حققوا نجاحًا ثابتًا مع:
- محتوى الجلامور (glamour) وملابس السباحة: عارضات بالبكيني والملابس الداخلية وفي جلسة تصوير لمجلة أزياء
- مشاهد رومانسية موحية: لحظات حميمية سينمائية تتوقف قبل المنطقة الصريحة
- أعمال الجسد الفنية: عُري ضمني بتأطير تركيبي راقٍ
- الرعب والجماليات المظلمة: صور مكثفة ومزعجة تتجنب المنصات الأخرى تقديمها
- مفاهيم إعلانية جريئة: حملات توقفها مرشحات سلامة العلامة التجارية قبل أن تُولَّد
جودة الحركة الواقعية هي ما يجعل هذه الفئات تعمل بمستوى احترافي. فنموذج يرتدي ملابس السباحة على شاطئ لا يبدو كعرض شرائح من صور ثابتة مُجمَّعة معًا. القماش يتحرك، والشعر يستجيب للرياح، والماء يتموج في الخلفية بمعقولية فيزيائية صُمِّم Aurora تحديدًا لتحقيقها.
كيف يقف Grok 1.5 أمام المنافسين

يعني الاختيار بين مولّدات فيديو الذكاء الاصطناعي الرائدة الموازنة بين الأداء ومرونة المحتوى وجودة الناتج معًا. إليك مقارنة مباشرة لأبرز النماذج المتاحة على PicassoIA:
💡 إذا كانت أقصى دقة ممكنة هي الأولوية، فإن LTX 2.3 Pro ينتج حتى 4K بمعدل 50 إطارًا في الثانية. وإذا كنت تحتاج إلى إزالة مرشح الأمان بالكامل، فإن P-Video يعطّل قيود المحتوى افتراضيًا ويوفر معاينات مسودة فورية.
الثمن الذي يدفعه Grok 1.5 هو الدقة (720p بدلًا من 1080p) مقابل مقاطع أطول ومرونة أفضل في المحتوى وأزمنة توليد أسرع. بالنسبة للنشر على وسائل التواصل الاجتماعي، تكفي دقة 720p بوضوح. أما للتطبيقات ذات المقاسات الكبيرة، فإن سقف الدقة اعتبار حقيقي.
كيفية استخدام Grok 1.5 على PicassoIA

يستضيف PicassoIA Grok Imagine Video 1.5 مباشرةً، لذلك لا تحتاج إلى حساب xAI أو اشتراك في Grok. يتم الوصول إليه عبر الواجهة القياسية في PicassoIA إلى جانب بقية كتالوج النماذج.
الخطوة 1: افتح صفحة النموذج
انتقل إلى صفحة Grok Imagine Video 1.5 على PicassoIA. تعرض الواجهة حقولًا للصورة المصدر، والأمر النصي، واختيار الدقة، ونسبة العرض إلى الارتفاع. اضبط الدقة على 720p للحصول على أفضل جودة للناتج قبل التوليد.
الخطوة 2: جهّز صورة مصدر قوية
تصبح صورتك المصدر الإطار الأول. وهذا هو العامل الأكبر تأثيرًا في جودة الناتج. لتوليد الصورة المصدر، يُعد Seedream 4.5 الخيار الأول. فهو ينتج نتائج واقعية للغاية في أقل من 3 ثوانٍ، ويقبل أي نوع محتوى دون قيود، مما يجعله أسرع مسار عمل: ولّد الصورة، ثم حرّكها باستخدام Grok 1.5.
بعض الأمور التي تحسّن أداء الصورة المصدر:
- صمّم التكوين للحركة: اترك مساحة في الإطار ليتحرك الشخص. فالوجه المقصوص بإحكام لا يترك للنموذج مجالًا للحركة
- طابق نسبة العرض إلى الارتفاع: إذا كنت تولّد مقطعًا عموديًا بنسبة 9:16، فابدأ بصورة مصدر عمودية حتى لا يحتاج النموذج إلى قص غير متقن
- استخدم مادة مصدر واقعية: يمدّ Aurora اللقطات الواقعية بإقناع أكبر بكثير من الفن المرسوم أو المنمّق
إذا أردت تحسين صورة مصدر قبل تحريكها، فإن PicassoIA Image Editor Pro ينتج نتائج في أقل من ثانية واحدة ويوفر توليدات غير محدودة على خطتي Elite و Infinite. يمكنك تكرار الإطار بقدر ما تحتاج دون تكلفة إضافية.
الخطوة 3: اكتب أمر الحركة النصي
في وضع تحويل الصورة إلى فيديو، يتحكم أمرك النصي في سلوك الحركة لا في مظهر الشخص. كن محددًا ومرتبًا زمنيًا في وصف الحركة:
- ضعيف: "امرأة على شاطئ"
- قوي: "تدير المرأة رأسها ببطء نحو اليسار، ويلتقط شعرها نسيم المحيط، وتتدحرج الأمواج في الخلفية، وتبقى الكاميرا ثابتة طوال الوقت"
يستجيب نموذج Aurora جيدًا للغة المرتبطة بالزمن. عبارات مثل "على مدى 8 ثوانٍ"، و"في آخر 2 ثانية"، و"تدريجيًا" تمنحك تحكمًا فعليًا في الإيقاع ضمن نافذة مدتها 15 ثانية.
الخطوة 4: حمّل وكرّر
بعد التوليد، يُنزَّل المقطع كملف MP4 دون علامة مائية. وبالنسبة لمسارات العمل التي تحتاج إلى هوية شخصية ثابتة عبر عدة مقاطع، يستخدم Grok Imagine R2V صورتك المرجعية كمرساة للهوية طوال المقطع بأكمله، لا في الإطار الافتتاحي فقط.

أفضل النماذج للمحتوى غير المقيّد بالذكاء الاصطناعي

يغطي كتالوج PicassoIA مسار إنشاء محتوى NSFW بالكامل، من توليد الصور حتى إخراج الفيديو. الترتيب الموصى به بحسب جودة الناتج والحرية الإبداعية:
-
Seedream 4.5 ⭐ — أفضل مولّد صور NSFW شامل على PicassoIA. يقبل المحتوى للبالغين، ويدعم تعديل الصور، وينتج نتائج واقعية للغاية في أقل من 3 ثوانٍ. شقيقه الأحدث Seedream 5 Lite لا يقبل أوامر NSFW، لذلك يبقى 4.5 الخيار الموصى به لأعمال المحتوى للبالغين.
-
PicassoIA Image Editor Pro — تحرير الصور من صورة إلى صورة مع توليد غير محدود في الخطتين: Elite و Infinite. توليد 1,000 صورة هنا لا يكلّفك شيئًا إضافيًا على الاشتراك، بينما يكلّف الحجم نفسه على نموذج مثل Nano Banana 2 نحو $100. يعيد النتائج في أقل من 1 ثانية. تتوفر تجربة مجانية تتيح 3 توليدات دون الحاجة إلى بطاقة ائتمان.
-
Qwen Image 2 — نموذج مفتوح المصدر لتحويل النص إلى صورة وتحريرها، بواقعية مفصّلة ودون قيود محتوى مدمجة فيه.
-
Grok Imagine Image — الشريك الصوري لنموذج Grok 1.5 Video من xAI. يحوّل أي صورة مرجعية إلى صورة بيكيني واقعية بنتائج مقنعة.
-
Recraft V4 — تحويل النص إلى صورة فقط، لكنه ينتج نتائج عالية الواقعية لأوامر المحتوى للبالغين.
-
P-Image — تحويل نص إلى صورة بمحتوى NSFW، يُولَّد في أقل من ثانية واحدة، ومفيد للنماذج الأولية السريعة ومسارات العمل ذات الحجم الكبير.
-
PicassoIA Video — توليد فيديو غير محدود من أوامر نصية بدقة تصل إلى 720p ومدة 5 ثوانٍ لكل مقطع. لا توجد حدود لكل توليد على الخطط المؤهلة.
-
P-Video — تحويل النص أو الصورة أو الصوت إلى فيديو بدقة تصل إلى 1080p. مرشح الأمان مُعطّل افتراضيًا. يوفر وضع المسودة معاينة فورية منخفضة الدقة قبل الالتزام بالتصيير الكامل.
-
Grok Imagine Video — نموذج الفيديو الأصلي من Grok. مقاطع تصل إلى 15 ثانية من النص أو الصورة أو فيديو موجود، دون علامات مائية و8 نسب عرض إلى ارتفاع.
-
LTX 2.3 Pro — الخيار الأعلى دقة بجودة تصل إلى 4K/50fps مع تحرير لإعادة التصوير والتمديد للتحكم الدقيق على مستوى الإطار.
💡 تعرّف على القائمة الكاملة للنماذج غير المقيّدة والقادرة على المحتوى NSFW عبر picassoia.com/en/all-models.
Grok 1.5 مقابل Grok Video الأصلي

الفرق بين Grok Imagine Video 1.5 وسلفه Grok Imagine Video حقيقي لكنه ليس كبيرًا. يتحسن الإصدار 1.5 في جوانب محددة هي الأهم في سيناريوهات المحتوى المعقدة.
حيث يتفوق 1.5 بوضوح
المشاهد الجماعية ومتعددة الأشخاص: يبقى الأشخاص المتعددون المتحركون في الوقت نفسه مستقرين تشريحيًا. وكثيرًا ما أنتج الإصدار الأصلي تشوّهات عندما ظهر شخصان أو أكثر معًا في الإطار.
حركة الوجه المقرّبة: تحافظ الشفاه والعيون على شكلها أثناء تغيّر التعابير ومقاطع الكلام. وتكون الانتقالات العاطفية أكثر إقناعًا عبر مدد أطول.
تماسك الخلفية: لا تنجرف خلفية مقاطع 1.5 ولا تتشوه خلال المقاطع بعد علامة 8 ثوانٍ، كما كان الإصدار الأصلي يفعل أحيانًا.
انتقالات الإضاءة: عندما ينتقل المشهد من حالة إضاءة إلى أخرى، يتعامل 1.5 مع التغيير بوميض بصري أقل بوضوح.
حيث يتساويان تقريبًا
في اللقطات البسيطة لشخص واحد بحركة قليلة، ينتج الإصداران ناتجًا متقاربًا. تحريك صورة شخصية بدوران بطيء للرأس، أو تنفس هادئ، أو ريح تمر في الشعر لا يتطلب ترقية الإصدار. يظهر التحسن عند العمل مع التعقيد: أشخاص متعددون، أو مشاهد سريعة الحركة، أو مقاطع في نطاق 12 إلى 15 ثانية.
أنماط أوامر نصية تنجح باستمرار

يعتمد الحصول على نتائج قوية من Grok Imagine Video 1.5 باستمرار على طريقة وصف الحركة. تنتج هذه البنى الأربع مخرجات موثوقة:
النمط 1: الكاميرا والشخص
"تقترب الكاميرا ببطء بينما يدير الشخص وجهه نحو الإطار، وتبقى الإضاءة الطبيعية ثابتة طوال الوقت"
النمط 2: الحركة البيئية
"يتموّج القماش في نسيم دافئ، وتتمايل أشجار النخيل في الخلفية برفق، وتتدحرج الأمواج من الجهة اليسرى للإطار"
النمط 3: التطور العاطفي
"يبدأ الشخص بتعبير محايد، ثم يتحول تدريجيًا إلى ابتسامة عريضة خلال 8 ثوانٍ، وتتجعد زوايا عينيه بحلول الإطار الأخير"
النمط 4: تسلسل الحركة
"يسير الشخص من اليسار إلى اليمين عبر الإطار، ويتحول وزنه بطبيعية مع كل خطوة، ثم يتوقف ويواجه الكاميرا في الثلاث ثوانٍ الأخيرة"
💡 التوقيت يعمل: يستجيب نموذج Aurora جيدًا للتعليمات المرتبطة بالزمن. عبارات مثل "في آخر 2 ثانية" و"بحلول المنتصف" تساعدك على التحكم في الإيقاع داخل نافذة مدتها 15 ثانية. هذا أقل شيوعًا بين مولّدات الفيديو، ويمنح مستخدمي Grok 1.5 ميزة عملية عند توجيه المخرجات.
تجنّب أنماط الأوامر النصية التي تصف مشاهد ثابتة فقط دون حركة. سيولّد النموذج شيئًا ما، لكن النتيجة تميل إلى حركة ضئيلة أو تكرار مصنوع. صِف دائمًا ما يتغير مع الزمن بدلًا من وصف ما هو موجود في لحظة واحدة.
جرّب أيضًا Grok Imagine R2V

بالنسبة لمسارات العمل التي تتطلب هوية شخصية ثابتة عبر عدة مقاطع، يستحق Grok Imagine R2V أن يُضاف إلى مسار العمل. يستخدم R2V (من المرجع إلى الفيديو) الصورة المرجعية المقدَّمة كمرساة للهوية والأسلوب طوال المقطع بأكمله، لا كإطار افتتاحي فحسب.
الفرق العملي: في وضع تحويل الصورة إلى فيديو القياسي، قد يحدث انجراف أسلوبي عبر التسلسلات الأطول. تتغير الوجوه قليلًا، وتتبدل ألوان الملابس، وتنحرف درجات البشرة. أما في وضع R2V، فتبقى هذه الخصائص مثبّتة على الصورة المرجعية. وللحفاظ على شخصية ثابتة عبر مشروع متعدد المقاطع، يكتسب هذا الفرق أهمية كبيرة.
يؤدي الجمع بين Grok Imagine Image و R2V إلى مسار عمل أصيل بالكامل ضمن منظومة xAI: ولّد صورة المصدر بنموذج الصور، ثم حرّكها مع الحفاظ على الهوية عبر R2V. وكلاهما متاح على PicassoIA دون الحاجة إلى أي وصول لحساب xAI.
ابدأ الإبداع دون قيود
يُعد Grok Imagine Video 1.5 من أكثر الأدوات فائدة عمليًا لصنّاع المحتوى الذين أعاقتهم منصات الذكاء الاصطناعي المحافظة بشدة. يبقي مسار العمل على PicassoIA الأمور بسيطة: ولّد صور المصدر باستخدام Seedream 4.5 للحصول على إطارات بداية واقعية في أقل من 3 ثوانٍ، ثم نقّحها عبر PicassoIA Image Editor Pro بتكرارات غير محدودة إن احتجت، ثم حرّكها باستخدام Grok 1.5. كل ذلك من منصة واحدة، دون تبديل الحسابات أو الأدوات.
بالنسبة لأعمال الفيديو مع إزالة مرشح الأمان بالكامل، يتناسب P-Video جيدًا مع Grok 1.5 بحسب ما إذا كنت تعطي الأولوية لمرونة المحتوى أو لأقصى دقة. وللحصول على أعلى جودة ممكنة، يُعد LTX 2.3 Pro بدقة 4K/50fps السقف المتاح حاليًا.
كل نموذج مذكور في هذا المقال متاح على picassoia.com/en/all-models. ابدأ بتجربة مجانية على PicassoIA Image Editor Pro: 3 توليدات، دون الحاجة إلى بطاقة ائتمان. شاهد ما يصبح ممكنًا حين تتوقف قيود المحتوى عن الوقوف في طريقك.