إذا كنت تعمل منذ مدة على مولّدات الصور بالذكاء الاصطناعي وتصطدم دائمًا بالجدار المعقّم نفسه، فأنت تعرف الإحباط جيدًا. Midjourney يمنعك، و DALL-E يرفض أي شيء فيه إيحاء من بعيد، وحتى الأدوات مفتوحة المصدر تضيف فلاتر أمان مع كل تحديث. لهذا السبب أصبح وضع Grok Imagine Spicy من أكثر الميزات نقاشًا في أوساط الإبداع بالذكاء الاصطناعي خلال العام الماضي. يعمل هذا الوضع مدعومًا بنموذج Aurora من xAI، ويَعِد مفتاح spicy في Grok بشيء ترفضه معظم المنصات السائدة: طبقة إذن تزيل الحواجز. لكن ما مدى فاعليته فعليًا؟ وماذا ينتج فعلًا؟ والأهم من ذلك، هل توجد طريقة أذكى لتحويل أي صورة إلى فيديو NSFW بالذكاء الاصطناعي من دون مواجهة قيود المنصات في كل خطوة؟ يجيب هذا المقال عن كل ذلك من دون حشو.

ما هو وضع Grok Imagine Spicy؟
Grok هو روبوت الدردشة الرائد لدى xAI، وتطوّره شركة الذكاء الاصطناعي التي يملكها Elon Musk كمنافس مباشر لنظام ChatGPT. على خلاف OpenAI، وضعت xAI منذ البداية Grok كبديل أقل تقييدًا، مع رغبة Grok المعلنة في تناول موضوعات تتجنّبها النماذج الأكثر حذرًا. تعمل ميزة توليد الصور، المسماة Grok Imagine، على نموذج Aurora، وهو نموذج صور مملوك لشركة xAI. في أوائل عام 2025، قدّمت xAI ما تسمّيه «وضع spicy» للمشتركين في الفئة الأعلى، وهو عمليًا يحوّل سياسة المحتوى في المنصة من التقييد إلى التساهل في توليد الصور.
الفكرة بسيطة. تمرّر معظم أنظمة الذكاء الاصطناعي الأوامر النصية عبر مصنّف محتوى قبل توليد أي شيء. يعمل هذا المصنّف كفلتر، فيرفض الأوامر التي تحتوي على كلمات أو مفاهيم معيّنة. يزيل وضع Spicy هذا الفلتر عن Aurora. عمليًا، يعني ذلك أن النموذج سينتج صورًا موحية ومرتدية ملابس جزئية ومحتوى NSFW ناعمًا، وهو ما يرفضه الوضع العادي تمامًا. بالنسبة إلى المبدعين الذين أمضوا سنوات في الالتفاف على رفض الذكاء الاصطناعي العشوائي، فالجاذبية واضحة.
نموذج Aurora الذي يقف خلف الوضع
Aurora هو نموذج توليد الصور المغلق المصدر لدى xAI، وقد دُرّب على مجموعة بيانات مملوكة، وحُسّن للواقعية الفوتوغرافية. على عكس النماذج مفتوحة المصدر مثل Flux Dev أو Stable Diffusion 3.5 Large، فإن بنية Aurora خاصة بالكامل. لم تنشر xAI أوزان النموذج ولا منهجية التدريب ولا الفروق المحددة في الضبط الدقيق بين الوضع العادي ووضع spicy. واستنادًا إلى مخرجات المستخدمين، يتفوّق النموذج بشكل خاص في الوجوه البشرية الواقعية وملمس البشرة، ما يضع جودة مخرجاته أقرب إلى مولّدات الصور المغلقة المصدر المتميزة منها إلى فئة التوليد الأقدم القائمة على SDXL.
من الجوانب الجديرة بالملاحظة في Aurora طريقة تعامله مع الإضاءة والتكوين عند تلقّي أوامر بلغة التصوير الفوتوغرافي. تميل النماذج المدرّبة على هذا النوع من البيانات إلى الاستجابة بشكل أفضل لأوصاف مثل «عدسة بورتريه 85 ملم» أو «ضوء صباحي حجمي» مقارنةً بالأوصاف الجمالية الغامضة، ويتبع Aurora هذا النمط بثبات.
ما الذي يفعله وضع Spicy فعليًا
الجواب الصريح: لا يعني وضع spicy أن Aurora سيولّد أي شيء على الإطلاق. فقد أكدت xAI أن حدودًا صارمة معيّنة تبقى قائمة بغض النظر عن إعداد الوضع. التغيير يكمن في حدّ الفلترة، لا في إزالة جميع القيود. تحجب مصنّفات المحتوى العادية على منصات مثل DALL-E الأوامر التي تتضمن كلمات مثل «ملابس داخلية» أو «بشرة عارية» أو «بيكيني» في سياقات تصويرية معيّنة. أما Aurora في وضع spicy فيعالج هذه الكلمات على أنها أوصاف تصويرية أو إبداعية مشروعة.
النتيجة العملية هي أداة تقع في مكان ما بين محاكي تصوير الجلامور (glamour) ومولّد NSFW ناعم. بالنسبة إلى المبدعين الذين يعملون في محتوى نمط الحياة للبالغين، أو الفن الشخصي بالذكاء الاصطناعي، أو عمل الشخصيات الواقعية كالصور الفوتوغرافية، فهي تفتح إمكانات إبداعية كانت تتطلب سابقًا إما تشغيل نموذج محلي أو الاشتراك في منصة متخصصة للذكاء الاصطناعي للبالغين.
💡 ملاحظة: وضع Spicy مرتبط حاليًا باشتراك X Premium Plus (بسعر $16 شهريًا في الولايات المتحدة). يمكن أن تتغيّر الوصول والأسعار والتوفر الإقليمي من xAI من دون إشعار مسبق.

Grok مقابل أبرز مولّدات الصور بالذكاء الاصطناعي
توسّع مجال صور NSFW بالذكاء الاصطناعي بشكل كبير، لكن المشهد على مستوى المنصات مجزّأ. بعض الأدوات متساهلة بشكل معلن، وبعضها يتسامح بهدوء مع المحتوى الناضج، وتحافظ معظم المنتجات السائدة على فلاتر افتراضية صارمة. معرفة موقع كل أداة فعليًا تحدّد ما إذا كان سير عملك سلسًا أم يتعطّل باستمرار.
جدار NSFW الذي يصطدم به الجميع
تعرّضت كل منصة صور رئيسية بالذكاء الاصطناعي لضغوط من متاجر التطبيقات ومعالجات المدفوعات والمعلنين للحفاظ على سياسات محتوى صارمة. ولا يتعلق الأمر عادةً باعتراض شركات الذكاء الاصطناعي على المحتوى الناضج لأسباب شخصية، بل بالبنية التحتية للأعمال. فإرشادات App Store لدى Apple، وسياسة الاستخدام المقبول لدى Stripe، وسياسات الإعلانات في Google، كلها تخلق ضغطًا خارجيًا يجبر المنصات على الإبقاء على إعدادات افتراضية مقيّدة، حتى عندما يكون النموذج الأساسي قادرًا على إنتاج أكثر من ذلك.
النتيجة نظام متدرّج الطبقات. هناك منصات مغلقة تمامًا مثل DALL-E و Imagen ترفض معظم المحتوى الموحي رفضًا قاطعًا. وهناك منصات شبه متساهلة مثل وضع spicy في Grok الذي يسمح بمحتوى NSFW ناعم ضمن حدود محددة. وهناك أخيرًا منصات مفتوحة بالكامل يستطيع فيها المبدعون تشغيل أي نموذج من دون أي قيود على الإطلاق. يقع Grok في المنتصف، ما يجعله مفيدًا فعلًا لبعض سير العمل الإبداعي، لكنه يبقى محدودًا لآخرين يحتاجون إلى تساهل أوسع أو حجم إنتاج أكبر.
كيف تتموضع المنصات
النمط واضح: نادرًا ما تجتمع الجودة الواقعية كالصور الفوتوغرافية مع التساهل في NSFW في منتج سائد ومصقول واحد. وهذه الفجوة بالذات هي ما يجعل سير العمل من الصورة إلى فيديو NSFW صعبًا إلى هذا الحد على المبدعين الفرديين الذين يعملون بموارد محدودة.

كيف تستخدم Grok Imagine خطوة بخطوة
يتطلّب استخدام Grok Imagine في وضع spicy إعدادًا محددًا لا يكون بديهيًا دائمًا للمستخدمين الجدد. تعكس الخطوات التالية حالة المنصة اعتبارًا من أبريل 2026.
الخطوة 1: احصل على الوصول
ستحتاج إلى اشتراك X Premium Plus نشط في الفئة الأعلى (بسعر $16 شهريًا في الولايات المتحدة). لا يتضمن اشتراك X Premium العادي الوصول إلى وضع spicy. بعد الاشتراك، انتقل إلى grok.com أو افتح Grok عبر تطبيق X (المعروف سابقًا باسم Twitter) على الهاتف. يتم توليد الصور مباشرةً داخل واجهة الدردشة في Grok. لا تحتاج إلى تطبيق أو أداة منفصلة.
الخطوة 2: اكتب الأمر النصي المناسب
لبنية الأمر النصي أهمية كبيرة مع Aurora، ربما أكثر مما هي مع نماذج مثل Flux 2 Pro. يستجيب Aurora بشكل أفضل للأوامر النصية بلغة التصوير الفوتوغرافي. فكّر كمصوّر يُعدّ موجزًا، لا كشخص يصف مشهدًا خياليًا.
ما الذي يعمل جيدًا:
- «جلسة تصوير جلامور احترافية لامرأة ترتدي بيكيني أسود عند حافة مسبح لا نهائي عند الغروب، عدسة بورتريه 85 ملم، Kodak Portra 400، عمق ميدان ضحل»
- «تصوير تحريري لملابس داخلية في استوديو أبيض بسيط، إضاءة جانبية درامية، كاميرا متوسطة الصيغة (medium format)، حبيبات الفيلم»
ما الذي ينتج نتائج أضعف:
- الكلمات الغامضة من دون سياق تكويني («امرأة مثيرة في ملابس داخلية»)
- قوائم صفات مفرطة الكثرة من دون بنية واضحة للمشهد
💡 نصيحة: استخدم مفردات التصوير الفوتوغرافي. كلمات مثل «عمق الميدان» و«حبيبات الفيلم» و«الإضاءة الخلفية» و«الصيغة المتوسطة» تحسّن جودة المخرجات في Aurora بثبات أكبر بكثير من أوصاف الأسلوب العامة.
الخطوة 3: فعّل وضع Spicy
داخل واجهة Grok، ابحث عن مفتاح بعنوان «Allow spicy content» أو تسمية مشابهة بحسب نسختك الإقليمية. يجب تفعيله قبل إرسال الأمر النصي. ولا يُطبَّق بأثر رجعي. وبمجرد تفعيله في جلسة، يبقى مفعّلًا حتى تعطّله أو تفتح محادثة جديدة. تحتفظ xAI بسجلات إشراف على استخدام وضع spicy، لذلك يظل النظام مراقَبًا حتى عندما يكون فلتر المحتوى مُعطّلًا.

تحويل الصور إلى فيديو بالذكاء الاصطناعي: الطلب الحقيقي
تشير عبارة البحث «Grok Imagine Spicy turn any photo into NSFW AI video» إلى سير عمل يتجاوز بكثير الفضول حول ميزة واحدة في منصة معيّنة. فهي تكشف عن خط المعالجة المحدد الذي يريده المبدعون: خذ صورة موجودة، أو صورة مولّدة بالذكاء الاصطناعي للتو، وأدخلها إلى نظام فيديو بالذكاء الاصطناعي، واحصل في المقابل على مقطع قصير وواقعي.
لماذا انطلق تحويل الصور إلى فيديو بالذكاء الاصطناعي
نما الطلب على تحويل الصور الفوتوغرافية إلى فيديو بالذكاء الاصطناعي بالتناسب المباشر مع التحسينات في جودة نماذج تحويل الصورة إلى فيديو. وعندما أثبتت أدوات مثل Wan و Kling و Runway أن صورة ثابتة واحدة يمكن تحريكها بحركة مقنعة، بدت الإمكانات الإبداعية والتجارية واضحة فورًا. وبالنسبة إلى مبدعي المحتوى للبالغين تحديدًا، فإن القدرة على أخذ صورة واحدة عالية الجودة وإنتاج مقطع فيديو قصير من دون تنظيم جلسة تصوير فيديو تعيد كتابة اقتصاديات إنتاج المحتوى بالكامل.
تقلّص الفارق في جودة توليد الفيديو بالذكاء الاصطناعي بوتيرة فاجأت معظم المراقبين. يمكن لأمر نصي مثل «تتحرك الكاميرا ببطء نحو اليسار، ويتحرك شعر الشخص برفق مع النسيم، وخلفية ضبابية ناعمة (bokeh)» الآن أن ينتج نتائج تبدو كفيديو أصلي بدقة منصات التواصل الاجتماعي المعتادة. لكن التحدي أن فلاتر المحتوى على منصات الفيديو أشدّ بكثير من تلك الموجودة في مولّدات الصور. فمحتوى الفيديو يخضع لتدقيق تنظيمي أعلى على مستوى المنصة، ما يعني أن كثيرًا من أدوات الفيديو بالذكاء الاصطناعي تطبّق إشرافًا على المحتوى أكثر صرامة من نظيراتها في الصور.
ما الذي تفعله أفضل الأدوات بشكل مختلف

تتشارك نماذج تحويل الصورة إلى فيديو التي تنتج أكثر النتائج إقناعًا خصائص محددة. فقد دُرّبت على مجموعات بيانات حركة تشمل أنواعًا متنوعة من الحركة بدلًا من أسلوب بصري ضيّق. وهي تتعامل مع ثبات الوجه عبر الإطارات، وهو أصعب تقنيًا بكثير من الحفاظ على الثبات في صورة مولّدة واحدة. والأهم أنها تسمح بتقييد التوليد بصورة مرجعية، أي أنها تأخذ صورتك المدخلة كمرساة بدلًا من العمل بالكامل انطلاقًا من أمر نصي.
بالنسبة إلى صورة الإدخال الواقعية كالصور الفوتوغرافية التي تحتاجها نماذج الفيديو، تُعدّ مولّدات مثل Flux 1.1 Pro و Grok Imagine Image نقاط بداية هي الأكثر موثوقية. فالصورة المرجعية الضبابية أو قليلة التفاصيل أو غير المتسقة أسلوبيًا تحدّ مما يمكن لأي نموذج فيديو أن ينتجه لاحقًا، مهما بلغت قدرات ذلك النموذج. والمبدأ بسيط: جودة المدخل تحدد جودة المخرج. فالاستثمار في نموذج توليد الصور المناسب من الخطوة الأولى يعود بالفائدة في كل خطوة تليها.
💡 ملاحظة: يقدّم PicassoIA أكثر من 87 نموذجًا لتحويل النص إلى فيديو إلى جانب 91 نموذجًا لتوليد الصور، وكلها متاحة من منصة واحدة. وهذا ما يجعله واحدًا من أكثر البيئات اكتمالًا المتاحة لسير عمل الإبداع من الصورة إلى الفيديو.
91 نموذجًا من دون حواجز

الإحباط الأساسي من وضع Grok Imagine Spicy بنيوي. فهو موجود داخل بيئة مغلقة مرتبطة باشتراك في منصة تواصل اجتماعي. يكفي تحديث واحد للسياسات، أو طرح قيد إقليمي واحد، أو زيادة واحدة في سعر الاشتراك، لتعريض سير عملك الإبداعي كله للخطر. بالنسبة إلى المبدعين الجادين، هذا ليس أساسًا يستحق البناء عليه.
تتبع PicassoIA نهجًا مختلفًا. فبدلًا من نموذج واحد مملوك مع مفتاح إذن، تجمع المنصة 91 نموذجًا لتحويل النص إلى صورة في واجهة متسقة، ونظام نقاط مشترك، ومن دون نقطة فشل واحدة مرتبطة بالسياسات. وإذا غيّر أحد النماذج شروط استضافته، تبقى 90 نماذج أخرى متاحة.
Grok Imagine على PicassoIA
Grok Imagine Image متاح مباشرةً على PicassoIA، ما يعني أنه يمكنك الوصول إلى النموذج القائم على Aurora من دون اشتراك X Premium. وهذا وحده فرق تكلفة مهم للمبدعين ذوي الإنتاج الكبير. فبدلًا من دفع رسوم شهرية ثابتة للوصول إلى نموذج واحد داخل منصة قد لا تستخدمها أصلًا، تدفع نقاطًا لكل صورة مقابل ما تولّده بالضبط.
لا تقف ميزة سير العمل عند التكلفة. ففي PicassoIA، توليد صورة قائمة على Aurora ثم تمريرها فورًا إلى نموذج رفع الدقة، أو أداة التعديل الموضعي، أو مسار تحويل الصورة إلى فيديو، لا يتطلب نقل ملفات بين المنصات، ولا إعادة رفع، ولا تحويل صيغ. تعمل السلسلة كلها في مكان واحد.
استخدام Grok Imagine Image على PicassoIA:
- افتح Grok Imagine Image في مجموعة PicassoIA
- اكتب أمرك النصي باستخدام أوصاف لغة التصوير الفوتوغرافي للحصول على أفضل النتائج
- اختر نسبة العرض إلى الارتفاع: 16:9 للمحتوى الأفقي الجاهز للفيديو، و 9:16 للمحتوى العمودي، و1:1 لمربع منصات التواصل
- ولّد النتيجة وقيّمها
- للحصول على مخرج فيديو: مرّر الصورة المولّدة مباشرةً إلى نموذج تحويل الصورة إلى فيديو داخل المنصة نفسها
نماذج الصور التي تستحق المعرفة
في الأعمال الواقعية كالصور الفوتوغرافية ضمن المجال القريب من NSFW، تنتج هذه النماذج باستمرار أعلى مخرجات دقة متاحة على المنصة:
- Flux 1.1 Pro Ultra: أفضل واقعية كالصور الفوتوغرافية متاحة حاليًا، ويتعامل مع إضاءة البشرة المعقدة وملمس الأقمشة بدقة استثنائية
- Flux 2 Pro: توليد أسرع مع مرونة قوية في الأوامر النصية، وموثوق لسير العمل الإبداعي ذي الحجم الكبير
- RealVisXL v3.0 Turbo: مصمم خصيصًا لتصوير البشر الواقعي، وقوي بشكل خاص في البورتريه وأعمال الجسد على مسافات قريبة ومتوسطة
- Stable Diffusion 3.5 Large: أساس قوي للضبط الدقيق باستخدام LoRA وسير العمل الدفعي المتسق في الأسلوب
- GPT Image 1.5: اتباع تعليمات متفوّق ودقة في التكوين عندما يحتوي أمرك النصي على عناصر متعددة للمشهد تحتاج إلى ترتيب مكاني دقيق

5 قواعد لنتائج أفضل في NSFW بالذكاء الاصطناعي
الحصول على مخرجات عالية الجودة باستمرار من أي مولّد صور بالذكاء الاصطناعي يتطلب أكثر من تفعيل مفتاح إذن. تنطبق هذه القواعد الخمس سواء كنت تعمل في Grok Imagine أو Flux أو أي نموذج آخر واقعي كالصور الفوتوغرافية.
-
اكتب كمصوّر يعطي موجزًا. صِف المشهد كما لو كنت تُدير جلسة تصوير. أدرج اتجاه الإضاءة، واختيار العدسة، والمسافة من الشخص، ونوع الفيلم. هذا وحده يحسّن جودة المخرجات أكثر من أي تغيير منفرد آخر.
-
صِف تشريح الجسم بدقة. النية الغامضة تنتج نتائج غامضة. إذا أردت وضعية محددة، فصِفها كما يصفها المخرج: «اليد اليسرى على الورك، والذراع اليمنى ممدودة قليلًا إلى الأمام، والوزن منقول إلى القدم الخلفية، والجذع مائل بزاوية ثلاثة أرباع نحو الكاميرا».
-
تحكّم في البيئة. كلما كان وصف الخلفية أدق، قلّ ما يملؤه النموذج بحشو عام. «شرفة على سطح مبنى، وأضواء مدينة ضبابية (bokeh)، وهواء مسائي رطب، وإشارة بار نيون مضاءة من الحافة اليمنى» ينتج نتيجة أغنى بكثير من «خارجًا في الليل».
-
اختر نسبة العرض إلى الارتفاع قبل التوليد، لا بعده. إذا كانت وجهتك النهائية منصة فيديو عمودية، فولّد بنسبة 9:16 من البداية. فقص صورة 16:9 إلى عمودية يضحّي دائمًا بالتكوين. وإذا كنت تريد مخرجًا سينمائيًا عريض الشاشة، فولّد بنسبة 16:9 من الأمر النصي الأول.
-
أصلِح الإضاءة قبل كل شيء آخر. الإضاءة هي أكبر محدد منفرد لجودة الصور الواقعية كالصور الفوتوغرافية بالذكاء الاصطناعي. أتقن وصف الإضاءة في أمرك النصي الأول قبل أن تنفق نقاطًا على تحسين التفاصيل الأخرى. فالصورة السيئة الإضاءة لشخص موصوف بدقة تبدو دائمًا أسوأ من شخص موصوف ببساطة في مشهد مضاء بإتقان.
💡 نصيحة: الخطأ الأكثر تكرارًا لدى المبتدئين هو الإفراط في وصف الشخص مع ترك البيئة عامة. فالخلفية والإضاءة تحملان وزنًا بصريًا لا يقل عن الشخص نفسه في التوليد الواقعي كالصور الفوتوغرافية.
ابدأ الإبداع بالأدوات الصحيحة

يشير النقاش كله حول Grok Imagine Spicy إلى رغبة واحدة كامنة: أداة تبتعد عن طريقك وتتيح لك الإبداع من دون احتكاك، ومن دون مفاجآت في السياسات، ومن دون جدران الاشتراكات. سواء كنت صانع محتوى فرديًا، أو منتجًا لمنصة للبالغين، أو ببساطة شخصًا يريد إنتاج صور بالذكاء الاصطناعي واقعية كالصور الفوتوغرافية عالية الجودة من دون مقاومة الفلاتر، فالجواب ليس في انتظار أن تتغير سياسة منصة واحدة لصالحك.
النماذج موجودة الآن: Grok Imagine Image و Flux 1.1 Pro Ultra و RealVisXL v3.0 Turbo متاحة كلها على منصة واحدة، من دون اشتراك شهري أو قيود جغرافية أو أوضاع إذن تُفعَّل بمفتاح. تختار النموذج، وتكتب الأمر النصي، وتولّد.
أما المبدعون الذين يريدون أخذ صورة ثابتة أبعد وتحريكها إلى فيديو بالذكاء الاصطناعي، فهذا المسار متاح هو الآخر بالفعل. ابدأ بنموذج الصور المناسب. ابنِ المشهد بالعناية التي تتطلبها المخرجات الواقعية كالصور الفوتوغرافية. ثم مرّره إلى أحد 87 نموذجًا للفيديو، ودع طبقة التحريك تفعل ما تتقنه.
صُممت PicassoIA خصيصًا لسير العمل الكامل هذا. منصة واحدة، من الأمر النصي الأول إلى الفيديو النهائي، من دون أي تحكّم بالوصول بين الخطوات.