ظهر Wan 2.6 دون ضجيج كبير، لكن جودة مخرجاته أحدثت صدىً واسعًا. إذا كنت تتابع مجال توليد الفيديو المفتوح المصدر، فأنت تعرف بالفعل أن عائلة نماذج Wan تقلّص الفجوة مع الأدوات التجارية بثبات. ويمثّل الإصدار 2.6 النقطة التي تصبح فيها هذه الفجوة صغيرة جدًا لمعظم حالات الاستخدام العملية.
يقدّم هذا المقال شرحًا لما يفعله Wan 2.6، وكيف يعمل، وكيف يقارن بالإصدارات السابقة، وكيف يمكنك استخدامه الآن عبر المتصفح دون أي تثبيت.
ما هو Wan 2.6 فعلًا
Wan 2.6 هو نموذج لتوليد الفيديو قائم على الانتشار (diffusion) طوّره فريق Wan Video التابع لشركة Alibaba. يعمل في فضاء كامن مضغوط لإنتاج تسلسلات فيديو متماسكة زمنيًا. ما يميّزه عن معظم النماذج في فئته هو الجمع بين دقة مكانية عالية، وتماسك حركي قوي، وأوزان مفتوحة.
تهم هذه النقطة الأخيرة أكثر مما يبدو. معظم نماذج الفيديو عالية الأداء هي واجهات API تجارية مغلقة. أما Wan 2.6 فهو متاح، ويمكن تشغيله في السحابة، ومدمج في منصات تتيح لك التوليد دون إدارة البنية التحتية.

ميزة المصدر المفتوح
يعني كونه مفتوح الأوزان أن النموذج يمكن نشره في أي مكان. أنت لست مرتبطًا بواجهة API محدودة بعدد الطلبات أو باشتراك قد يختفي. يستطيع مجتمع الأبحاث ضبطه بدقة، ويستطيع نظام الأدوات تغليفه، ويستطيع المنصات الإبداعية عرضه مباشرة على المستخدمين.
من الناحية العملية، هذا يعني أن Wan 2.6 متاح عبر واجهات متعددة، منها المنصات المعتمدة على المتصفح حيث تكتب أمرًا نصيًا وتحصل على فيديو خلال دقائق.
وضعان في نموذج واحد
يعمل Wan 2.6 في وضعين أساسيين يخدمان سير عمل إبداعي مختلفًا جدًا:
| الوضع | المدخل | المخرج |
|---|
| T2V (تحويل النص إلى فيديو) | أمر نصي | مقطع فيديو يُولَّد من الصفر |
| I2V (تحويل الصورة إلى فيديو) | صورة + نص اختياري | نسخة متحركة من الصورة المدخلة |
يشترك الوضعان في البنية الأساسية نفسها، لكن ضبطهما الدقيق يختلف. يفضّل وضع T2V التنوع التكويني، بينما يركّز وضع I2V على التماسك بين الإطار الأول والحركة اللاحقة.
Wan 2.6 T2V: فيديو من أمر نصي
يأخذ نموذج Wan 2.6 T2V وصفًا نصيًا ويولّد منه فيديو من العدم. لا يتطلب صورة مصدر. هذا هو الوضع الذي تستخدمه عندما تملك فكرة في ذهنك وتحتاج إلى تجسيدها.
جودة المخرجات في وضع T2V قوية بشكل ملحوظ في المشاهد المعقدة: عدة أشخاص، وتفاصيل بيئية، وحركة توحي بها زاوية الكاميرا، كلها تُصيَّر بتماسك أكبر من أجيال Wan السابقة.

كيف تعمل الكتابة للنموذج
يستجيب Wan 2.6 جيدًا للغة سينمائية ووصفية. فكّر بمنطق تعليمات مشغّل الكاميرا: ماذا يفعل الشخص، وما البيئة، وما ظرف الإضاءة، وهل توجد حركة كاميرا مقصودة.
💡 نصيحة: الأوامر التي تحدد الحركة بوضوح ("تحريك بانورامي بطيء نحو اليسار"، "تصغير تدريجي") تميل إلى إعطاء نتائج أكثر قصدية من الأوامر الغامضة. يشفّر Wan 2.6 الديناميكيات، ولا يخمّنها.
أوامر تعمل بشكل جيد:
- "امرأة تمشي على شارع مرصوف بالحجارة عند الغسق، تنعكس إضاءة المصابيح الذهبية على الرصيف المبلل، لقطة تتبّع بطيئة"
- "أمواج المحيط تتحطم على صخور بركانية داكنة، منظر جوي، ضوء غائم منتشر"
- "قطة تراقب المطر يتساقط خارج النافذة، لقطة مقرّبة، عمق ميداني ضحل، ضوء رمادي طبيعي"
أوامر تعطي نتائج ضعيفة:
- كلمات مفردة أو مفاهيم مجردة بلا أساس مادي
- تغييرات مشهد سريعة ومتعددة موصوفة في أمر واحد
- طلبات شديدة التحديد لوجه أو هوية معيّنة (Wan 2.6 ليس نموذجًا لهوية البورتريه)
الدقة وجودة المخرجات
ينتج Wan 2.6 T2V فيديو بجودة HD مع وضوح محسّن بشكل ملحوظ مقارنة بالإصدار Wan 2.5 T2V. يتعامل النموذج مع الملمس الدقيق، وحركة الأقمشة، وديناميكيات الشعر، ومحاكاة الماء بدقة أعلى من الإصدارات السابقة.
خصائص المخرجات المعتادة:
- المدة: مقاطع من 5 إلى 10 ثوانٍ حسب إعداد النشر
- تماسك الحركة: تماسك زمني قوي عبر الإطارات
- الاحتفاظ بالتفاصيل: تحسّن ملحوظ مقارنة بالإصدارين Wan 2.1 و Wan 2.2
Wan 2.6 I2V: تحريك صورة فوتوغرافية
يُعد وضع Wan 2.6 I2V المجال الذي يقضي فيه كثير من المبدعين وقتهم. تقدّم صورة ثابتة، فيحرّكها النموذج عبر التنبؤ بحركة معقولة فيزيائيًا تنبثق من المعلومات البصرية الموجودة أصلًا في الإطار.
يبدو هذا مباشرًا، لكن جودة التنفيذ تختلف كثيرًا بين النماذج. يتعامل Wan 2.6 معه بشكل أفضل من معظم نماذج فئته.

أي الصور تعمل بأفضل شكل
ليست كل الصور تتحرك بالقدر نفسه من الجودة. يعمل Wan 2.6 I2V بأفضل شكل مع:
- فصل واضح بين الشخص والخلفية: صور تحتوي على موضوع بؤري محدد أمام خلفية مقروءة
- إضاءة طبيعية: صور باتجاه ضوء وظلال واقعيين تمنح النموذج معلومات فيزيائية يعمل بها
- تعقيد معتدل: صور لشخص واحد مع خلفية متوسطة التعقيد تتفوّق على التركيبات المزدحمة
- مصدر عالي الدقة: يستفيد النموذج من مدخلات جيدة. ستتحرك صورة بدقة 1080p بشكل أكثر إقناعًا من صورة مصغّرة بدقة 480p
من الصور التي تعطي نتائج أضعف: الصور المعدّلة بكثافة بألوان اصطناعية، والصور المولّدة بالذكاء الاصطناعي ذات الفيزياء غير المتسقة، والصور التي تضم عدة أشخاص صغار على مسافات متقاربة.
💡 نصيحة: بالنسبة لتحريك صور المنتجات، تعمل الصور المضاءة من الأمام على خلفيات نظيفة بشكل ممتاز. يميل Wan 2.6 I2V إلى إنتاج تحريك دقيق وواقعي للمنتجات مع حركة بيئية طبيعية.
نسخة Flash
هناك أيضًا Wan 2.6 I2V Flash، الذي يضحّي ببعض سقف الجودة مقابل توليد أسرع بشكل ملحوظ. إذا كنت تحتاج إلى تكرار سريع لإيجاد أسلوب الحركة المناسب قبل الاستقرار على تصيير بجودة كاملة، فإن Flash هو الأداة المناسبة لتلك المرحلة من سير العمل.
فكّر في Flash كوضع المسودة لديك. أما I2V الكامل فهو وضع المخرج النهائي.

Wan 2.6 مقابل الإصدارات السابقة من Wan
تحركت عائلة Wan بسرعة. إليك موقع الإصدار 2.6 بالنسبة للإصدارات الأخرى التي قد تصادفها:
ما الذي تغيّر منذ 2.5
تتركز التحسينات من 2.5 إلى 2.6 في ثلاثة مجالات:
- التماسك المكاني: تحافظ الأجسام على حجم وتناسب ثابتين عبر الإطارات بشكل أكثر موثوقية
- طبيعية الحركة: تبدو حركة الإنسان والحيوان قابلة للتصديق فيزيائيًا بنسبة أعلى
- دقة التفاصيل: تحافظ الملامس السطحية الدقيقة، وخصلات الشعر، وثنيات الأقمشة على جودتها طوال مدة المقطع
هذه ليست فروقًا كبيرة قد تلاحظها في عرض تسويقي. إنها الفروق التي تتراكم حين تنتج 20 إلى 30 مقطعًا لكل مشروع وتحتاج إلى جودة ثابتة.

متى تستخدم النماذج الأقدم
الإصدار Wan 2.5 والإصدارات الأقدم ليست قديمة. يظل نموذج Wan 2.5 I2V Fast خيارًا ممتازًا عندما تحتاج إلى السرعة أكثر من أقصى درجات الدقة. ولا يزال Wan 2.2 T2V Fast مناسبًا لسير عمل المسودات السريعة حيث يهم زمن التوليد أكثر من دقة البكسل.
ليس الاختيار دائمًا "استخدم الأحدث". الأمر يتعلق بمطابقة النموذج للمهمة المطروحة.
كيفية استخدام Wan 2.6 على PicassoIA
يدمج PicassoIA نموذج Wan 2.6 مباشرة في المتصفح. لا حاجة إلى GPU، ولا تثبيت، ولا بيئة Python. إليك سير العمل بالتفصيل:

الخطوة 1: اختر وضعك
قرّر ما إذا كنت تعمل من أمر نصي أم من صورة. انتقل إلى أحد الخيارين:
الخطوة 2: اكتب أمرك النصي
في وضع T2V، يكون أمرك النصي كل شيء. امنح هذه الخطوة وقتك. الأمر الضعيف ينتج مقطعًا ضعيفًا مهما كان النموذج قادرًا.
بنية الأمر في T2V: الشخص + الفعل + البيئة + الإضاءة + سلوك الكاميرا
في I2V، يعمل الأمر النصي كتوجيه للحركة. أنت تخبر النموذج كيف يحرّك الصورة، لا ما تحتويه الصورة. الأوامر القصيرة التي تركّز على الحركة تعمل هنا بشكل أفضل من الأوصاف الطويلة.
الخطوة 3: اضبط المعاملات
تعرض معظم عمليات النشر بعض عناصر التحكم الرئيسية:
- المدة: عادةً من 5 إلى 10 ثوانٍ للتوليد القياسي
- نسبة العرض إلى الارتفاع: 16:9 للشاشات العريضة، و9:16 للفيديو العمودي والصيغ المخصصة للهاتف
- مقياس التوجيه (Guidance scale): القيم الأعلى تتبع الأمر النصي بصرامة أكبر، والقيم الأدنى تسمح بتنوع إبداعي أكبر
💡 نصيحة: في وضع I2V، يعطي مقياس توجيه بين 5 و7.5 عادةً أكثر الحركات طبيعية. إذا رفعته أكثر من اللازم، ستصبح الحركة متصلّبة وغير مقنعة.
الخطوة 4: وَلِّد ونزّل
أرسل طلب التوليد. يكتمل Wan 2.6 على PicassoIA عادةً خلال 2 إلى 5 دقائق حسب الحمل على الخادم. وبعد الانتهاء، نزّل ملف MP4 مباشرة دون علامات مائية ودون أي ضغط من وسائل التواصل الاجتماعي.
3 أخطاء شائعة مع Wan 2.6

أوامر نصية معقدة أكثر من اللازم
الغريزة هي كتابة كل ما تريده في أمر نصي طويل واحد. وهذا غالبًا ما يأتي بنتائج عكسية. يتعامل Wan 2.6 مع الأوامر المحددة والمركّزة بشكل أفضل من الأوصاف المتشعبة لعدة مشاهد.
الأمر الذي يطلب مشهدًا ينتقل من شاطئ عند الشروق إلى شارع مدينة ليلًا سينتج حركة غير متماسكة. النموذج يولّد مقطعًا متصلًا، وليس مونتاجًا سينمائيًا. اجعل كل توليد يتعلق بمشهد واحد متماسك وسياق بيئي واحد.
نسبة عرض إلى ارتفاع غير مناسبة للمنصة
توليد فيديو بنسبة 16:9 لمقطع Instagram Reel سيتطلب قصًّا يدمّر التكوين. فكّر في المكان الذي سينتهي إليه الفيديو قبل أن تولّده. منصات مثل TikTok وInstagram Stories وYouTube Shorts تتوقع كلها فيديو عموديًا بنسبة 9:16. أما الشاشة العريضة 16:9 فتناسب YouTube والعروض التقديمية والتضمين على الويب.
هذا سهل التصحيح مسبقًا، ومؤلم إصلاحه بعد وقوعه.
تجاهل خيار Flash
يتجه المبدعون غالبًا مباشرة إلى نموذج I2V بجودة كاملة في كل محاولة. تتراكم تكلفة التكرار بسرعة. استخدم Wan 2.6 I2V Flash لاختبار أمرك النصي وصورة المصدر أولًا. إذا بدا اتجاه الحركة والتكوين صحيحين في Flash، فشغّل بعد ذلك النسخة بجودة كاملة. هذا النهج يقلّل الوقت المهدور في التوليدات الفاشلة إلى النصف تقريبًا.
حالات استخدام حقيقية تعمل بشكل جيد

صنّاع المحتوى
يستخدم صناع الفيديو القصير Wan 2.6 لتحريك الصور الفوتوغرافية من جلسات تصويرهم، وإنشاء لقطات تكميلية (B-roll) بأجواء محيطة من أوامر نصية، وإنتاج محتوى مرئي بوتيرة كانت مستحيلة سابقًا دون فريق إنتاج. يستطيع المصوّر صاحب المحفظة القوية من الصور الثابتة أن يحوّل هذه الأصول إلى محتوى متحرك دون أي تصوير إضافي.
عروض المنتجات
تحرّك علامات التجارة الإلكترونية صور منتجاتها لإنشاء حلقات حركة دقيقة. يمكن تحريك صورة ثابتة لزجاجة عطر أو زوج من الأحذية أو منتج للعناية بالبشرة بحركة بيئية واقعية: نسمة هواء، أو دوران لطيف، أو ضوء ناعم ينزلق على السطح. يقع الناتج بين الصورة الثابتة والإعلان التجاري الكامل، وهذا بالضبط ما تحتاجه كثير من صفحات المنتجات وإعلانات التواصل الاجتماعي.
المشاريع الفنية
يستخدم الفنانون وضع I2V كامتداد تكويني لأعمالهم الثابتة. تصبح اللوحة أو الرسم الرقمي أو الصورة الفوتوغرافية إطارًا أولًا يستقرئ منه Wan 2.6 الحركة، فينتج شيئًا يقع بين الوسيط الأصلي والفيديو. النتائج غالبًا ما تكون غير متوقعة ومميزة بطرق تختلف عن أدوات التحريك المصممة لأغراض محددة.
جرّبه بنفسك
إذا كنت تنتظر نموذج فيديو بالذكاء الاصطناعي ينتج نتائج يمكنك استخدامها فعلًا في المشاريع الحقيقية، فإن Wan 2.6 يستحق وقتك الآن.
يتيح وضع T2V على Wan 2.6 T2V إنشاء مقطع من الفكرة دون الحاجة إلى أي أصل مصدر. ويأخذ وضع I2V على Wan 2.6 I2V أي صورة فوتوغرافية ويضعها في حركة. ويجعل الإصدار Flash على Wan 2.6 I2V Flash التكرار سريعًا بما يكفي كي لا تشعر بأن التجربة التزام.
وإذا أردت التقدم أبعد، يقدّم Wan 2.7 I2V أحدث جيل من جودة تحريك الصور، ويمثّل Wan 2.7 T2V أحدث مخرجات تحويل النص إلى فيديو في عائلة Wan.
كل ذلك يعمل في متصفحك على PicassoIA. اختر نموذجًا، واكتب أمرًا نصيًا، وشاهد ما يفعله Wan 2.6 فعلًا عندما تضعه قيد العمل.
