ظهر نموذجان مفتوحا المصدر للفيديو خلال أشهر قليلة من بعضهما في 2025، ولا يزال الناس يتجادلون حول أيهما يفوز. يأتي Wan 2.7 Pro من فريق Alibaba Wan، بينما HunyuanVideo 1.5 هو رد Tencent في سباق توليد الفيديو مفتوح المصدر. يعمل النموذجان محليًا، وكلاهما مجاني، وينتجان مخرجات كانت ستبدو مستحيلة قبل عامين. لكنهما ليسا النموذج نفسه، واختيار النموذج الخطأ لسير عملك يكلّفك وقتًا ومالًا.
تتجاوز هذه المقارنة الضجيج. اختبرنا النموذجين على عتاد متطابق وبأوامر نصية متطابقة، وتابعنا الأمور التي تهم فعلًا: اتساق الحركة، والالتزام بالأمر النصي، وسرعة التوليد، واستهلاك VRAM، وجودة المخرجات في الاستخدام الواقعي.

ما الذي يميّز هذين النموذجين
يبدو العرض السطحي لكلا النموذجين متطابقًا: مفتوح المصدر، وجودة عالية، ومجاني. لكن إذا تعمّقنا أكثر قليلًا، تتباين الخيارات المعمارية بشدة. Wan 2.7 Pro هو محوّل انتشاري (diffusion transformer) مُحسَّن للترابط الزمني بعيد المدى، أي أنه يحافظ على ثبات الأشخاص عبر كل إطار حتى عندما يتحركون بسرعة. أما HunyuanVideo 1.5 فيسلك مسارًا مختلفًا، إذ يُعطي الأولوية للواقعية السينمائية في الإطارات الفردية، مقابل حمل حسابي أعلى قليلًا.
نظرة سريعة على Wan 2.7 Pro
يدعم Wan 2.7 T2V توليد الفيديو من النص، ومن الصورة، ومن المرجع. يعمل المستوى Pro بدقة 1080p الأصلية، ويأتي بإصدار 14B معامل يحسّن ثبات الوجوه وثبات الخلفيات بشكل ملحوظ مقارنةً بإصدارات Wan السابقة. يتعامل النموذج بموثوقية مع أوامر حركة الكاميرا: الاقتراب بعربة التصوير (dolly-in)، والبانوراما، ولقطات الدوران حول الشخص، وهي أمور كانت الإصدارات السابقة تخفق فيها وأصبحت الآن قابلة للتكرار باستمرار.
المواصفات:
- الدقة: حتى 1080p
- المدة: من 5 إلى 10 ثوانٍ لكل مقطع
- حجم النموذج: 14B معامل (Pro) / 1.3B (lite)
- الترخيص: Apache 2.0
💡 على PicassoIA، يتوفر Wan 2.7 بثلاثة أوضاع: Wan 2.7 T2V (من النص إلى فيديو)، وWan 2.7 I2V (من الصورة إلى فيديو)، وWan 2.7 R2V (من المرجع إلى فيديو). لا حاجة إلى معالج رسومي محلي.
نظرة سريعة على HunyuanVideo 1.5
HunyuanVideo من Tencent نموذج انتشاري كامل بحجم 13B معامل، مع تركيز قوي بشكل خاص على جودة الإطارات الواقعية كالصور الفوتوغرافية. قدّم الإصدار 1.5 تحليلًا دلاليًا محسّنًا، أي أنه يتعامل مع الأوامر النصية المعقدة متعددة الجمل بدقة أكبر من الإصدار الأصلي. كما أضاف ضبطًا دقيقًا بعنوان وضع البورتريه يحافظ على استقرار الأشخاص مع تشوّه أقل بوضوح.
المواصفات:
- الدقة: حتى 720p (مُحسَّن) / 1080p (تجريبي)
- المدة: 5 ثوانٍ افتراضيًا
- حجم النموذج: 13B معامل
- الترخيص: Tencent HunyuanVideo Community License
فرق الترخيص مهم. HunyuanVideo مفتوح الأوزان من الناحية التقنية، لكن ترخيص مجتمع Tencent يتضمن قيودًا على الاستخدام التجاري تختلف عن الإذن العام الشامل بموجب Apache 2.0 الذي يمنحه Wan. إذا كنت تبني منتجًا، فإن Wan 2.7 يوفر أساسًا قانونيًا أوضح.

جودة الفيديو الخام، وجهًا لوجه
الجودة أمر ذاتي، أما عيوب الحركة فليست كذلك. أجرينا 50 أمرًا نصيًا متطابقًا على النموذجين، وقيّمناهما وفق ثلاثة أبعاد: اتساق الحركة، والالتزام بالأمر النصي، والواقعية على مستوى الإطار. انقسمت النتائج بوضوح وفق الأولويات المعمارية لكل نموذج.
اتساق الحركة
يفوز Wan 2.7 Pro في هذا الجانب. في المقاطع التي تتضمن أشخاصًا يمشون أو يستديرون أو يتفاعلون مع الأشياء، يُظهر Wan 2.7 Pro إطارات اهتزاز أقل بكثير، حيث تتشوه أطراف للحظة قصيرة أو يفقد الوجه بنيته. عند 24 إطارًا في الثانية على مدى 8 ثوانٍ، يكون الاتساق أهم من الدقة في كل إطار، لأن العين البشرية شديدة الحساسية للعيوب الزمنية حتى عندما تبدو الإطارات الفردية سليمة.
يتفوق HunyuanVideo 1.5 في المشاهد الثابتة أو بطيئة الحركة، حيث تكاد الكاميرا لا تتحرك ويبقى الأشخاص ساكنين نسبيًا. تبدو لقطات البورتريه القريبة، ولقطات الطبيعة مع نسيم خفيف، ولقطات المنتجات التي تقترب فيها الكاميرا ببطء، استثنائية. لكن لحظة إدخال حركة سريعة، يتراجع الترابط الزمني بوتيرة أسرع من Wan 2.7.

الالتزام بالأمر النصي
يتقدم HunyuanVideo 1.5 قليلًا في الالتزام بالأمر النصي، خصوصًا مع الأوامر التركيبية التي تضم أشخاصًا متعددين أو علاقات مكانية محددة. عبارة "امرأة تمشي في سوق مزدحم بينما يطارد طفل بالونًا قرب بسطة زهور" هي نوع الأوامر التي يبسّطها Wan 2.7 إلى شيء يستطيع التعامل معه، بينما يحاول HunyuanVideo 1.5 فعلًا تنفيذ العناصر الثلاثة كلها.
بالنسبة للأوامر الأبسط التي تغطي شخصًا واحدًا وفعلًا واحدًا ومحيطًا واحدًا، يؤدي النموذجان بالقدر نفسه من الجودة. لا تظهر الفجوة إلا عند الطرف الأعلى من التعقيد الدلالي.
💡 نصيحة: إذا احتوى أمرك النصي على أكثر من شخصين مختلفين أو تعليمات مكانية محددة، فإن HunyuanVideo 1.5 هو الخيار الأكثر أمانًا. أما تعليمات حركة الكاميرا، فإن Wan 2.7 Pro أكثر موثوقية.
السرعة ومتطلبات العتاد
هنا تصبح المقارنة عملية لمعظم الناس. يتطلب تشغيل هذه النماذج محليًا عتادًا قويًا، وتتناسب تكاليف التشغيل السحابي طرديًا مع زمن التوليد.

زمن التوليد حسب فئة GPU
الأرقام أدناه لمقطع مدته 5 ثوانٍ بدقة 720p:
| GPU | Wan 2.7 Pro (14B) | HunyuanVideo 1.5 (13B) |
|---|
| RTX 4090 (24GB) | ~4.5 دقيقة | ~6 دقائق |
| RTX 3090 (24GB) | ~9 دقائق | ~12 دقيقة |
| A100 (80GB) | ~2 دقيقة | ~2.5 دقيقة |
| H100 (80GB) | ~75 ثانية | ~90 ثانية |
يولّد Wan 2.7 Pro بسرعة أكبر بنحو 25 إلى 30% باستمرار عبر جميع فئات GPU. بالنسبة لمقطع مدته 10 ثوانٍ بدقة 1080p، تتسع الفجوة إلى 35% أو أكثر. وعلى دفعة من 20 مقطعًا، يُقاس هذا الفرق بالساعات لا بالدقائق.
متطلبات VRAM ومتطلبات النظام

| المتطلب | Wan 2.7 Pro (14B) | HunyuanVideo 1.5 (13B) |
|---|
| الحد الأدنى من VRAM | 16GB (مع التكميم) | 24GB |
| VRAM الموصى به | 24GB | 40GB |
| RAM | 32GB | 48GB |
| التخزين | ~28GB للنموذج | ~31GB للنموذج |
هذا فرق عملي كبير. الحد الأدنى لنموذج Wan 2.7 Pro وهو 16GB مع التكميم يعني أن مالكي RTX 3080 وRTX 4080 يستطيعون تشغيله فعلًا. أما الحد الأدنى لـ HunyuanVideo 1.5 وهو 24GB فيستبعد جزءًا كبيرًا من مالكي GPU الاستهلاكية. لكل من لا يملك 3090 أو 4090، يُعد Wan 2.7 Pro الخيار المحلي الوحيد القابل للتطبيق بين النموذجين.
لا يعمل أي من النموذجين بتكلفة معقولة على العتاد الاستهلاكي بالجودة الكاملة. لهذا السبب بالتحديد يصبح استخدام النموذجين على PicassoIA عبر التشغيل السحابي منطقيًا عمليًا لمعظم صنّاع المحتوى الذين يريدون مخرجات بدقة 1080p دون الاستثمار في GPU عالية الأداء.
جدول تفصيل الميزات
| الميزة | Wan 2.7 Pro | HunyuanVideo 1.5 |
|---|
| أقصى دقة | 1080p | 720p (1080p تجريبي) |
| أقصى مدة | 10 ثوانٍ | 5 ثوانٍ |
| من النص إلى فيديو | نعم | نعم |
| من الصورة إلى فيديو | نعم | نعم |
| من المرجع إلى فيديو | نعم | لا |
| أوامر التحكم بالكاميرا | قوية | متوسطة |
| أوامر متعددة الأشخاص | متوسطة | قوية |
| ضبط البورتريه الدقيق | لا | نعم |
| الترخيص | Apache 2.0 | مجتمعي (مقيّد) |
| الحد الأدنى من VRAM | 16GB | 24GB |
تُعد ميزة من المرجع إلى فيديو في Wan 2.7 Pro، المتاحة عبر Wan 2.7 R2V، فارقًا حقيقيًا. تزوّد النموذج بصورة مرجعية لشخص أو لشيء، فيستخدمها للحفاظ على الاتساق البصري عبر المقطع المولَّد حتى دون إطار بداية صريح. يفتح هذا الباب أمام أفلام قصيرة ومقاطع عرض لمنتجات تحافظ على الشخصيات، وهو أمر لا يستطيع HunyuanVideo 1.5 فعله في تمريرة واحدة.
كيفية استخدام Wan 2.7 على PicassoIA
يستضيف PicassoIA الأوضاع الثلاثة لنموذج Wan 2.7 كأدوات منفصلة. لا تثبيت، ولا تنزيل لأوزان النموذج، ولا إدارة لـ VRAM. سير العمل مباشر.

من النص إلى فيديو
- انتقل إلى Wan 2.7 T2V
- اكتب أمرك النصي. كن محددًا في حركة الكاميرا: "اقتراب بطيء بعربة التصوير من اليسار" يعطي نتائج أفضل من مجرد "سينمائي"
- حدد المدة (5 أو 10 ثوانٍ) والدقة
- انقر على Generate
بنية الأمر النصي التي تنجح:
- ابدأ بالشخص والفعل: "امرأة ترتدي سترة حمراء تسير في شارع من حجارة الرصف المبللة بالمطر"
- أضف اتجاه الكاميرا: "تتراجع الكاميرا ببطء لتكشف الشارع بأكمله"
- أضف الإضاءة: "ضوء بعد الظهر الغائم، ظلال ناعمة"
- أضف الجو في الأخير: "ضباب خفيف، أصوات مرور بعيدة"
من الصورة إلى فيديو
يأخذ Wan 2.7 I2V أي صورة ثابتة كإطار أول ويحرّكها إلى الأمام. هذه أسرع طريقة لإحياء صورة فوتوغرافية أو صورة ثابتة مولّدة بالذكاء الاصطناعي.
- ارفع صورتك المصدر (JPG أو PNG، ونسبة 16:9 هي الأنسب)
- اكتب أمرًا نصيًا للحركة يصف ما يجب أن يتحرك وكيف
- يستخدم النموذج صورتك كإطار أول ثابت، ويولّد الباقي
تأتي أفضل النتائج من صور تحتوي على أشخاص واضحين وخلفيات غير ملتبسة. الصور المزدحمة أو المشوشة تربك التنبؤ الزمني وتُنتج عيوبًا في المخرجات.

من المرجع إلى فيديو
يُعد Wan 2.7 R2V الوضع الأقوى لصنّاع المحتوى الذين يحتاجون إلى ثبات الشخصيات. زوّده بصورة مرجعية لوجه شخص أو لشيء ما، وسيحافظ النموذج على تلك الهوية طوال المقطع المولَّد، بغض النظر عمّا يفعله الشخص في أمر الحركة.
هكذا تولّد:
- أداءً ثابتًا لشخصيات عبر عدة مقاطع في المشروع نفسه
- مقاطع عرض لمنتجات يجب أن تبدو متطابقة في كل لقطة
- محتوى لمتحدثين باسم العلامة التجارية على نطاق واسع دون إعادة التصوير
لا يقدم أي نموذج مفتوح المصدر آخر هذه القدرة بهذه الجودة، وهذا ما يجعل R2V الحجة الأوضح لاختيار Wan 2.7 بدلًا من HunyuanVideo عندما يكون ثبات الشخصيات شرطًا.
HunyuanVideo 1.5 على PicassoIA
يشغّل HunyuanVideo على PicassoIA النموذج الكامل بحجم 13B عبر التشغيل السحابي، ما يعني أنك تحصل على مخرجات بسعة VRAM فعلية تتجاوز 24GB دون المساس بجهازك المحلي. حالة الاستخدام مختلفة فعلًا عن Wan 2.7.

يتفوق HunyuanVideo 1.5 في:
- محتوى البورتريه والجمال: يحافظ الضبط الدقيق للبورتريه على استقرار الوجوه وجاذبيتها عبر الإطارات، ما يجعله النموذج المفضّل لمقاطع الأزياء والجمال ونمط الحياة
- لقطات الطبيعة والمناظر الطبيعية (B-roll): تبدو حركات الكاميرا البطيئة فوق البيئات التفصيلية استثنائية، مع جودة ملمس أعلى على مستوى الإطار مقارنةً بنموذج Wan 2.7
- مقاطع السرد متعددة الأشخاص: عندما يتطلب أمرك النصي شخصين أو ثلاثة مختلفين في الإطار نفسه يفعلون أشياء مختلفة، يتعامل HunyuanVideo 1.5 مع التعقيد الدلالي بشكل أفضل
الثمن الذي تدفعه هو زمن التوليد. عند 720p لمقطع مدته 5 ثوانٍ، يستغرق HunyuanVideo 1.5 على PicassoIA ما يقارب 25 إلى 30% أكثر من Wan 2.7 Pro لمخرجات مكافئة. لعدد قليل من المقاطع يكون هذا الفرق ضئيلًا. أما للإنتاج بالدفعات فيتراكم بشكل كبير.
💡 متى تستخدم HunyuanVideo 1.5: لقطات البورتريه القريبة، ومحتوى الجمال، والمشاهد المعقدة متعددة الأشخاص، ولقطات الطبيعة (B-roll) حيث تكون جودة الإطار الواحد أهم من السرعة.
💡 متى تستخدم Wan 2.7 Pro: الأشخاص سريعو الحركة، وأوامر حركة الكاميرا، والمشاريع متعددة المقاطع التي تحافظ على الشخصيات عبر R2V، أو أي سير عمل تحتاج فيه إلى مقاطع مدتها 10 ثوانٍ أو دقة 1080p.
أيهما يناسب سير عملك
الإجابة الصادقة أن النموذجين يستحقان مكانهما في عدة إنتاج فيديو جادة. اختيار أحدهما وحده يعني التخلي عن قدرات حقيقية.
لصنّاع المحتوى وصانعي الأفلام
إذا كنت تصنع أفلامًا قصيرة أو محتوى لمنصات التواصل أو فيديوهات للعلامات التجارية، فالنهج العملي هو:
- استخدم Wan 2.7 T2V من أجل لقطات الحركة وحركات الكاميرا واللقطات التأسيسية حيث يكون اتساق الحركة حاسمًا
- استخدم HunyuanVideo من أجل لقطات البورتريه القريبة ولقطات الجمال والمشاهد متعددة الأشخاص حيث تكون جودة الإطار ودقة المعنى هما الأولوية
- استخدم Wan 2.7 R2V كلما احتجت إلى شخصية ثابتة عبر عدة مقاطع في المشروع نفسه
يمنحك هذا النهج المقسّم أفضل ما في المعماريتين لأنواع اللقطات المختلفة داخل المشروع نفسه. نماذج أخرى تستحق إضافتها إلى أدواتك على PicassoIA:
- Seedance 2.5: مقاطع مدتها 30 ثانية مع صوت مدمج للمحتوى السردي الأطول
- Kling v3 Video: مخرجات سينمائية مع تحكم قوي في الحركة
- Veo 3: مزامنة صوتية أصلية للمحتوى القائم على الحوار
- LTX 2 Pro: مخرجات بدقة 4K للتسليمات عالية الدقة
- Ray 3.2: مخرجات سينمائية بنطاق HDR مع علم ألوان قوي
للمطورين
إذا كنت تبني تطبيقات فوق توليد الفيديو مفتوح المصدر، فإن وضع الترخيص يسبق كل شيء آخر. يسمح ترخيص Apache 2.0 لـ Wan 2.7 Pro بالاستخدام التجاري غير المقيّد، والنماذج المشتقة، ودمج المنتج دون الحاجة إلى إذن من Alibaba. أما ترخيص مجتمع HunyuanVideo 1.5 فيتضمن استثناءات محددة تخص الاستخدام التجاري تستلزم قراءة دقيقة قبل شحن أي منتج.
من ناحية الأداء الخالص:
- يولّد Wan 2.7 Pro بسرعة أكبر ويعمل على عتاد أكثر إتاحة
- ينتج HunyuanVideo 1.5 جودة إطارات أعلى لحالات البورتريه والمشاهد المعقدة
- يقبل النموذجان صيغة الأمر النصي الأساسية نفسها، ما يجعلهما قابلين للتبادل في معظم مسارات تشغيل النموذج
بالنسبة إلى API إنتاجي أو تطبيق ويب تتحكم فيه بالعتاد، يبقى Wan 2.7 Pro الخيار الافتراضي الأفضل بفضل السرعة ووضوح الترخيص وقدرة R2V الفريدة. أما HunyuanVideo 1.5 فيعمل جيدًا كنموذج ثانوي لأنواع اللقطات المحددة التي يتفوّق فيها.

ابدأ توليد الفيديوهات الآن
لست بحاجة إلى جهاز GPU محلي، ولا حساب سحابي، ولا خلفية في نظرية الانتشار لاستخدام هذه النماذج اليوم. يشغّل PicassoIA كلًا من Wan 2.7 وHunyuanVideo عبر المتصفح دون أي إعداد. اكتب أمرًا نصيًا، واختر المدة، واحصل على مقطع خلال دقائق.
إلى جانب هذين النموذجين، يستضيف PicassoIA أكثر من 87 نموذجًا لتحويل النص إلى فيديو وتحويل الصورة إلى فيديو، من Wan 2.5 T2V للتوليد الأسرع، إلى Wan 2.6 T2V لتوازن متوسط بين الجودة والسرعة. إذا أردت مدة أطول، فإن Seedance 2.5 يتعامل مع مقاطع مدتها 30 ثانية. وإذا أردت صوتًا مدمجًا، فإن Veo 3 يفعل ذلك بشكل أصلي.
يتحرك مجال توليد الفيديو مفتوح المصدر بوتيرة تجعل النماذج التي مضى عليها ستة أشهر تبدو قديمة. يمثل Wan 2.7 Pro وHunyuanVideo 1.5 أحدث ما توصّلت إليه التقنية في توليد فيديو عالي الجودة ومجاني ومتاح. استخدمهما معًا، وتعلّم أين يتألق كل واحد منهما، وابنِ سير عمل يعاملهما كأدوات متكاملة لا كبدائل مباشرة لبعضهما.
ابدأ بأمر نصي يهمك. شاهد ما يخرج. ثم عدّل من هناك.
شاهد جميع نماذج الفيديو على PicassoIA