كيفية استخدام Midjourney v8 لإنشاء الصور: أوامر نصية تعمل فعلًا
غيّر Midjourney v8 طريقة عمل توليد الصور بالذكاء الاصطناعي، مع تماسك أعلى في المشهد، وإضاءة أفضل، وتفسير أذكى للأوامر النصية. يشرح هذا المقال البنية الدقيقة للأمر النصي والإعدادات وسير العمل التي تنتج نتائج بجودة احترافية، إضافةً إلى الوجهة المناسبة عندما لا يفي v8 بالغرض.
ظهر Midjourney v8 دون ضجيج كبير، لكن أثره كان هائلًا. القفزة من v6.1 إلى v8 لم تكن تحسينًا تدريجيًا، بل كانت تغييرًا في البنية. الأوامر التي كانت تنتج صورًا باهتة ومفككة مكانيًا أصبحت تعيد صورًا تتمتع بمنطق إضاءة ودقة تكوين تتوقعهما من مصوّر فوتوغرافي محترف. لكن v8 جلب معه تحديات جديدة أيضًا: فلترة أشد للمحتوى، وسلوكيات افتراضية مختلفة، وبناء نحوي للأوامر يُربك حتى المستخدمين ذوي الخبرة. يشرح هذا المقال بالتفصيل كيفية استخدام Midjourney v8 لإنشاء الصور، من تركيب الأمر النصي إلى التحكم في المعاملات، حتى تتوقف عن التخمين وتبدأ بإنتاج نتائج تطابق رؤيتك.
ما الذي يميّز Midjourney v8
كان النموذج الرائد السابق v6.1 يقدّم بالفعل تفاصيل مبهرة. أما v8 فيبني على هذا الأساس ويعيد تشكيل طريقة معالجة النموذج للعلاقات المكانية. لم تعد الأجسام تطفو بشكل غريب فوق الخلفيات. تُلقي مصادر الضوء ظلالًا معقولة فيزيائيًا عبر الإطار كله. وتظهر تشوهات أقل بكثير في تشريح الإنسان، وتحديدًا الأيدي والأقدام والوجوه، مقارنةً بأي إصدار سابق.
ترقية التماسك
يستخدم Midjourney v8 ما يسمّيه الفريق داخليًا "ترجيح التماسك البنيوي". بعبارة بسيطة: صار النموذج يوازن المنطق التكويني عبر الصورة كلها، لا داخل مناطق معزولة فحسب. المصباح الموضوع على الجانب الأيسر من المشهد يُلقي الآن ظلالًا متسقة على كل الأجسام في الإطار، بما في ذلك عناصر الخلفية البعيدة.
هذا يهم كثيرًا في الاستخدام التجاري وتصوير المجلات ومحتوى التواصل الاجتماعي. يمكن لأمر نصي واحد جيد الصياغة أن ينتج بثقة:
مصادر ضوء متسقة تتصرف بشكل صحيح عبر كل عناصر المشهد
منظور دقيق بين الأجسام في المقدمة والخلفية
حجب طبيعي تتداخل فيه الأجسام أو تحجب بعضها بعضًا بمنطق
أشكال بشرية متناسبة تصمد عند الفحص عن قرب بدقة عالية
إعدادات الأسلوب الافتراضية الجديدة
يأتي v8 بقيم افتراضية مختلفة بشكل ملحوظ عن سابقيه. صار المعامل --stylize افتراضيًا على 100، ويميل النموذج منذ البداية نحو الجماليات السينمائية والتحريرية. وهذا يجعل النتائج الافتراضية أكثر إصرارًا على أسلوب بصري محدد مما يتوقعه كثير من المستخدمين القادمين من v5 أو v6.
💡 إذا بدت نتائج v8 فنية أكثر من اللازم لتصوير المنتجات أو أسلوب الحياة، فجرّب --stylize 50 أو --stylize 25 لتقريب النتائج أكثر من الواقعية الوثائقية.
علامة --style raw تستحق المعرفة: إذ تزيل جزءًا كبيرًا من التفسير الجمالي للنموذج، وتعيد نتائج أقرب إلى ما يصفه الأمر النصي حرفيًا. وللمراجع التقنية أو الدقة الفوتوغرافية، يكون --style raw غالبًا نقطة البداية الصحيحة.
كتابة أوامر نصية تنتج صورًا رائعة فعلًا
تسلك كتابة الأوامر النصية في v8 سلوكًا مختلفًا عن إصدارات Midjourney السابقة. يُعطي النموذج وزنًا للواصفات حسب ترتيب ظهورها، فيقدّم المعلومات الأهم تكوينيًا في المقدمة. الاستهلال الغامض ينتج صورًا غامضة، والاستهلال المحدد ينتج صورًا محددة.
تشريح الأمر النصي القوي في v8
فكّر في كل أمر نصي لنموذج Midjourney v8 على أنه يتألف من أربع طبقات متميزة. ملء كل طبقة بدقة هو الفارق بين نتيجة عامة وصورة جاهزة للنشر:
الطبقة
ما يجب تضمينه
مثال
الموضوع
من أو ما هو موجود في المشهد
"بورتريه لامرأة في الثلاثينيات (30s) من عمرها"
البيئة
أين يقع المشهد
"في مقهى باريسي مشمس"
الإضاءة
الاتجاه والجودة واللون
"ضوء خلفي دافئ بعد الظهر، ظلال ناعمة"
الأسلوب
الكاميرا أو الفيلم أو المعاملات التصويرية
"فيلم 35 ملم، Kodak Portra 400، عمق ميدان ضيق"
الأمر النصي الذي يجمع الطبقات الأربع باتساق يتفوق دائمًا على العبارات الوصفية البسيطة. قارن:
ضعيف: woman at café, photorealistic
قوي: portrait of a woman in her 30s sitting at a sunlit Parisian café, warm golden afternoon backlight from the right, soft lens flare, 35mm f/2.0, Kodak Portra 400 film grain, shallow depth of field --ar 16:9 --q 2
النسخة القوية تمنح v8 معلومات كافية لاتخاذ قرارات متماسكة على كل مستوى في التكوين: كيف تتفاعل الإضاءة مع الموضوع، وكيف يجب أن تبدو الخلفية، وأي الخصائص التصويرية تُعطى الأولوية.
الأوامر النصية السلبية في v8
يستخدم v8 المعامل --no لمنطق الاستبعاد، وهو أكثر موثوقية في هذا الإصدار من أساليب الأوامر السلبية السابقة:
للعمل الواقعي كالصور الفوتوغرافية، أدرج هذه الاستبعادات كخط أساس قياسي:
--no CGI يزيل مظهر التصيير البلاستيكي الشائع في النتائج الاصطناعية
--no cartoon يمنع الانجراف الأسلوبي نحو الجماليات المرسومة
--no text يلغي آثار النصوص المولّدة
--no neon lighting يُبقي الإضاءة طبيعية لنتائج بأسلوب التصوير الفوتوغرافي
--no blurry يحسّن الحدة العامة، خاصةً في تفاصيل الخلفية
استراتيجيات الأوامر النصية حسب الموضوع
تستفيد فئات الموضوعات المختلفة من بنى أوامر مختلفة:
البورتريهات والأشخاص: ابدأ بالعمر والتعبير والملابس قبل البيئة. العبارة "رجل يبلغ 40 عامًا ببشرة تحمل آثار الطقس، وتعبير مسترخٍ، يرتدي سترة قماشية باهتة، ويقف خارج محطة وقود ريفية عند الغسق" تتفوّق على "رجل في محطة وقود" بفارق كبير.
العمارة والتصميم الداخلي: حدّد وقت اليوم ومصادر الإضاءة الاصطناعية بوضوح. العبارة "غرفة معيشة حديثة من منتصف القرن الماضي عند السادسة مساءً، مصابيح طاولة دافئة تُشكّل بِرَكًا من الضوء الكهرماني على أرضيات خشب البلوط، وضوء أزرق رمادي غائم عبر نوافذ تمتد من الأرض إلى السقف" يمنح النموذج منطقًا تكوينيًا واضحًا.
تصوير المنتجات: صرّح بسطح الخلفية مباشرةً. العبارة "زجاجة عطر زجاجية على سطح من الرخام الأبيض، إضاءة علوية منتشرة من الأعلى، انعكاس خفيف على الرخام، نظيفة ومينيمالية، بدون إكسسوارات أو خلفيات مشتتة" تنتج نتائج متسقة بأسلوب الاستوديو.
المعاملات والإعدادات في v8
تأتي المعاملات في نهاية كل أمر نصي في Midjourney، مفصولةً بمسافات. وهي ليست زخرفية. كل معامل يمنح النموذج تعليمة محددة تتجاوز سلوكه الافتراضي.
نسبة العرض إلى الارتفاع والجودة والفوضى
ثلاثة معاملات تحدد الأساس لكل صورة تولّدها:
المعامل
الوظيفة
القيم الشائعة
--ar
يحدد نسبة العرض إلى الارتفاع للإخراج
16:9، 1:1، 9:16، 4:3
--q
يتحكم في جودة التصيير ووقت المعالجة
1 (الافتراضي)، 2 (تفاصيل أعلى)
--chaos
يتحكم في التباين بين النتائج الأربع في الشبكة
0 (متسق) إلى 100 (متباين بشدة)
للعمل التحريري والتجاري، يُعد --ar 16:9 --q 2 --chaos 10 إعدادًا موثوقًا للبداية. قيمة الفوضى الطفيفة تُبقي خيارات الشبكة الأربعة متمايزة بما يكفي لتقديم اختيارات ذات معنى، دون أن يصبح أي منها غير قابل للاستخدام.
البذور والتحكم في التنوّع
يثبّت المعامل --seed أساسًا تكوينيًا حتى تتمكن من التكرار انطلاقًا منه. عندما تجد صورة ذات تكوين وإضاءة مناسبين، انسخ قيمة البذرة الخاصة بها من واجهة Midjourney على الويب وأعد استخدامها في الأوامر اللاحقة:
A woman reading at a café window, warm morning light --ar 16:9 --q 2 --seed 4821903
تغيير وصف الموضوع مع الإبقاء على البذرة ينتج صورًا تشترك في منطق الإضاءة والترتيب المكاني نفسه. وهذا أساس سير العمل الاحترافي في v8: اعثر على أساس تكويني قوي، ثبّت البذرة، ثم نوّع التفاصيل حتى تطابق الصورة الموجز.
💡 ادمج --seed مع --chaos 0 لتحقيق أقصى قدر من إمكانية التكرار عبر سلسلة محتوى. وهذا مفيد بشكل خاص عند إنشاء مجموعة من الصور يجب أن تبدو متماسكة بصريًا.
الإضاءة والواقعية بأسلوب التصوير الفوتوغرافي
نظام الإضاءة في v8 هو أهم ترقياته. كانت إصدارات Midjourney السابقة تعامل الضوء كخاصية جمالية. أما v8 فيتعامل معه كخاصية فيزيائية تتضمن الاتجاه والتلاشي ودرجة حرارة اللون والسلوك الانعكاسي.
أوامر الإضاءة السينمائية
تنتج واصفات الإضاءة التالية نتائج عالية الجودة باستمرار في v8. كل واحد منها يمنح النموذج معلومات محددة عن كيفية تصرف الضوء فيزيائيًا في المشهد:
35mm f/2.0 يحاكي مجال الرؤية البشري الطبيعي للصور بأسلوب التوثيق
50mm f/5.6 ينتج منظورًا محايدًا بلا تشوّه، وهو خيار افتراضي موثوق للاستخدام العام
دمج مواصفات العدسات مع واصفات الإضاءة هو النقطة التي يبدأ عندها v8 في إنتاج مخرجات تضاهي فعلًا صور الأرشيف عالية الجودة.
تحسين المخرجات: التنويع والرفع والإعادة المزجية
توليد المخرج الأول هو البداية لا النهاية. أدوات ما بعد التوليد في v8 هي المكان الذي يتحقق فيه التحكم الحقيقي.
سير عمل التنويع وإعادة المزج
بعد توليد شبكة الصور الأربع الأولى، تقود ثلاث أدوات معظم سير العمل الاحترافي:
التنويع (طفيف): يولّد تغييرات بسيطة مع الإبقاء على التكوين والإضاءة متطابقين تقريبًا. استخدمه عندما تريد تعديل تفاصيل صغيرة دون فقدان أساس قوي.
التنويع (قوي): ينتج بدائل أكثر جرأة تحافظ على الموضوع الأساسي نفسه لكنها تغيّر التكوين أو الزاوية أو المزاج بشكل أكبر.
وضع إعادة المزج: يتيح لك تعديل نص الأمر بين التنويعات. فعّله بواسطة /prefer remix في Discord أو من إعدادات الواجهة على الويب.
وضع إعادة المزج هو أقوى أداة ما بعد التوليد في v8. عند تفعيله، يمكنك توليد صورة، واختيار المفضلة لديك من الشبكة، والنقر على Vary، وتعديل الأمر قبل تشغيل التنويع. وهذا يعني أنك تستطيع تغيير الإضاءة أو تبديل المواقع أو تعديل مزاج الصورة دون البدء بأمر نصي جديد من الصفر.
نظام الرفع في v8
يوفر v8 مسارين لرفع الدقة:
Upscale (Subtle): دقة 2x مع تحسين خفيف للحدّة. تغييرات ضئيلة في المحتوى. الأنسب عندما تكون الصورة الأساسية شبه نهائية.
Upscale (Creative): دقة 2x مع إضافة تفاصيل جديدة يولّدها الذكاء الاصطناعي. يملأ النموذج البنى الدقيقة: تفاصيل المسام على البشرة، ونسيج القماش على الملابس، وحبيبات الحجر على الأسطح.
الرفع (الإبداعي) قوي لكنه يستحق مراجعة دقيقة. قد يضيف تفاصيل مادية لم تكن في الأمر الأصلي. وللطباعة أو الاستخدام بالمقاسات الكبيرة، يكاد الرفع الإبداعي ينتج دائمًا نتيجة أفضل من الطفيف.
أين يصطدم v8 بقيود المحتوى
لا يمكن لأي تقييم صادق لنموذج Midjourney v8 أن يتجاوز هذا القسم. تطبّق المنصة فلاتر محتوى ترفض الأوامر النصية التي تُعدّ إشكالية محتملة، وتعد منطق الفلترة في v8 أكثر صرامة من الإصدارات السابقة.
ما الذي يتم حجبه
يحجب نظام الفلترة في v8 نطاقًا مهمًا من فئات المحتوى:
المواد الصريحة، بما في ذلك العري الضمني حتى في سياقات فنية واضحة
العنف الواقعي، بما في ذلك كثير من مشاهد الحركة التي تتضمن إصابات أو دماء
الشخصيات العامة المصوّرة في سيناريوهات محددة أو مُدينة
شعارات العلامات التجارية والعلامات المحمية بحقوق النشر التي يتعرف عليها النموذج
صور الأزياء ونمط الحياة الإيحائية التي تتجاوز حدودًا يحددها النموذج بناءً على صياغة الأمر النصي
حتى الأوامر النصية البريئة فعلًا تُعلَّم. العبارة "رياضي يسقط أثناء المنافسة" قد تُفعّل فلتر العنف. والعبارة "جلسة تصوير لمجلة أزياء بقماش شفاف" قد تُفعّل فلتر العري رغم أنها غير صريحة وفق أي معيار معقول.
ما ينجح كحل بديل
إعادة الصياغة تساعد كثيرًا في أحيان كثيرة. استبدال الواصفات الصريحة بمراجع تصويرية أو تحريرية، مثل "مصوّر لمجلة Vogue Italia، جلسة تحريرية لأزياء الهوت كوتور، تصوير أزياء فني"، يميل إلى إنتاج محتوى كان سيُحجب لو كان الأمر النصي أكثر حرفية.
لكن هناك سقف لما تستطيع إعادة الصياغة تحقيقه. إذا كان عملك الإبداعي يتضمن بانتظام محتوى يقع خارج الفئات المسموح بها في Midjourney، فإن منصة أخرى حل أكثر عملية من محاولة الالتفاف على الفلاتر التقييدية بهندسة الأوامر.
PicassoIA كبديل مرن
يشغّل PicassoIA 91 نموذجًا لتحويل النص إلى صورة، ويغطي نطاقًا إبداعيًا أوسع بكثير مما يسمح به Midjourney v8. وبالنسبة للمبدعين الذين يحتاجون نتائج دون مفاوضة مستمرة مع الفلاتر، فهو بديل جاهز للإنتاج وليس حلًا التفافيًا.
نماذج تحويل النص إلى صورة تستحق الاستخدام
تضاهي عدة نماذج على PicassoIA جودة مخرجات v8 أو تتفوق عليها في فئات محددة:
Seedream 5 Pro ينتج صورًا حادة بدقة 2K مع التزام قوي بالأمر النصي وتماسك ممتاز في الوجوه. وفي البورتريه والعمل المرتبط بأسلوب الحياة، ينافس مباشرةً جودة مخرجات Midjourney v8 مع قبوله نطاقًا أوسع من الأوامر الإبداعية.
Reve 2.1 يتميز في التحرير ضمن السياق. تولّد صورة ثم تُحسّن مناطق محددة فيها دون إعادة بناء الأمر النصي كاملًا. وبالنسبة للمبدعين الذين يعملون عبر التكرار، يكون هذا السير أسرع بوضوح.
Stable Diffusion 3 يبقى حصانًا عمليًا موثوقًا للإنتاج بالدفعات. عندما تحتاج إلى أسلوب متسق عبر عشرات الصور في جلسة واحدة، تصبح قابليته للتنبؤ ميزة مقارنةً بالنماذج الأكثر ميلًا إلى رأي محدد.
Flux Schnell LoRA هو خيار السرعة. يولّد نتائج بسرعة تكفي للتكرار عبر 10 إلى 15 تنويعة من الأوامر النصية في الوقت الذي ينهي فيه Midjourney v8 مهمة واحدة. وفي مراحل توليد الأفكار حيث يكون الحجم أهم من الصقل، فهذه هي الأداة المناسبة.
Recraft 20B يتعامل مع أي أسلوب بصري من واجهة واحدة: واقعي، متجه، بأسلوب الأيقونات، ورسم توضيحي. وبالنسبة للفرق التي تنتج أصولًا عبر فئات بصرية متعددة، يقلل ذلك الحاجة إلى التنقل بين أدوات متخصصة.
💡 لأوامر أسلوب الحياة والجلامور (glamour) أو الأزياء التي يحجبها Midjourney v8 عادةً، يتعامل Seedream 5 Pro بموثوقية مع المحتوى الإيحائي والفني وغير الصريح للبالغين. يمكنك الوصول إلى الكتالوج الكامل للنماذج عبر picassoia.com/en/all-models.
إزالة الخلفيات بنقرة واحدة
بعد أن تحصل على صورة مولّدة، تتطلب إزالة الخلفية لقوائم المنتجات أو المواد التسويقية أو التركيب عادةً تطبيقًا منفصلًا. يتعامل نموذج Remove Background في PicassoIA مع ذلك في خطوة واحدة، ويُنتج قصاصات نظيفة مع اكتشاف دقيق للحواف في الموضوعات المعقدة: الشعر والقماش والأجسام الشفافة والتفاصيل البنيوية الدقيقة.
بلا Photoshop. بلا قناع يدوي. النتيجة جاهزة للاستخدام الفوري في أي سير عمل لاحق.
رفع دقة المخرجات إلى جودة النشر
يقدّم PicassoIA عدة خيارات لرفع الدقة مصممة لحالات استخدام مختلفة:
Clarity Pro Upscaler: الأفضل للعمل الواقعي الذي تحتاج فيه إلى استعادة طبيعية للملمس وتحسين التفاصيل
P Image Upscale: معالجة سريعة، مناسبة لسير العمل عالي الحجم حيث يهم زمن الإنجاز
Real ESRGAN: قوي في استعادة التفاصيل من صور مصدر بدقة أقل دون إدخال تشوهات بصرية
سير عمل عملي لنتائج متسقة
تنتقل انضباطات الأوامر النصية التي تنجح في Midjourney v8 مباشرةً إلى PicassoIA وكل منصة أخرى لتوليد الصور بالذكاء الاصطناعي. الدقة، ومفردات الإضاءة، والتأطير القائم على العدسات ليست مهارات خاصة بمنصة بعينها. إنها معرفة بالصورة.
سير عمل ينتج نتائج موثوقة أيًا كانت الأداة التي تستخدمها:
وَلّد بأعلى جودة: الوقت الذي يستغرقه --q 2 يستحق العناء في المخرجات النهائية
نوّع أقوى نتيجة لديك بدلًا من إعادة التوليد من الصفر في كل مرة
ارفع الدقة قبل التصدير: سواء للتواصل الاجتماعي أو التحرير أو الطباعة، فالمخرجات المرفوعة الدقة تحافظ على التفاصيل بشكل أفضل عند الأحجام النهائية
تشغيل كل أمر نصي عبر المنطق البنيوي نفسه ينتج مخرجات متوسطة أفضل من معاملة كل توليد كارتجال جديد. المنصة تتغير، أما المنهج فيبقى ثابتًا.
ابدأ الإبداع على PicassoIA الآن
كل ما في هذا المقال يعمل، والطريقة الوحيدة لتطبيقه هي البدء بتوليد الصور. بنى الأوامر النصية وتركيبات المعاملات ومفردات الإضاءة الواردة أعلاه قابلة للاستخدام فورًا في Midjourney v8 وعلى PicassoIA.
إذا كانت تكلفة اشتراك Midjourney v8 أو فلترة المحتوى أو استهلاك النقاط تُبطئ إنتاجك الإبداعي، فإن PicassoIA يمنحك وصولًا فوريًا إلى 91 نموذجًا لتحويل النص إلى صورة، وإزالة الخلفيات، ورفع الدقة، وكل فئة أدوات ورد ذكرها في هذا المقال، كل ذلك من واجهة متصفح واحدة.
اختر نموذجًا. اكتب أمرًا نصيًا متعدد الطبقات باستخدام بنية الطبقات الأربع أعلاه. وَلّد، ونوّع، وارفع الدقة. الفجوة بين ما تستطيع أدوات الصور بالذكاء الاصطناعي إنتاجه اليوم وما يتطلبه العمل الإبداعي الاحترافي لم تكن أصغر من أي وقت مضى. الأدوات جاهزة. ابدأ باستخدامها.