RunPod مقابل Vast.ai مقابل Modal: أرخص وحدات GPU لتوليد الذكاء الاصطناعي

تُسعّر RunPod وVast.ai وModal وحدات GPU بثلاث طرق مختلفة، وأرخص سعر بالساعة ليس دائمًا أرخص تكلفة للصورة. يحوّل هذا المقال الأسعار المنشورة إلى تكلفة لكل 1,000 صورة وتكلفة لكل مقطع فيديو، ثم يوضح كيف تغيّر أوقات الخمول والتخزين وساعات الإعداد الفائز.

RunPod مقابل Vast.ai مقابل Modal: أرخص وحدات GPU لتوليد الذكاء الاصطناعي
Cristian Da Conceicao
مؤسس Picasso IA

يبدو تأجير وحدة GPU لتوليد الصور والفيديو بالذكاء الاصطناعي أمرًا بسيطًا حتى تصل الفاتورة. منصة تعلن سعر 0.34 دولار في الساعة، وأخرى تحتسب الفاتورة بالثانية، وثالثة تؤجر أجهزة فائضة قد تختفي في منتصف عملية التصيير. سعر الملصق يخبرك بالكاد بشيء عن تكلفة الصورة النهائية أو مقطع فيديو مدته خمس ثوانٍ.

تضع هذه المقارنة RunPod وVast.ai وModal جنبًا إلى جنب، وتحوّل أسعارها إلى تكلفة لكل 1,000 صورة وتكلفة لكل مقطع فيديو، وتبيّن أين تحرق كل منصة المال دون أن تلفت الانتباه. كل رقم وارد أدناه محسوب من الأسعار المنشورة، مع كتابة الافتراضات بجانبه حتى تتمكن من إعادة الحساب بأرقامك أنت.

💡 الحكم السريع: Vast.ai هي الأرخص لكل ساعة GPU، وRunPod هي الأفضل توازنًا بشكل عام، وModal هي الخيار الأكثر سلاسة عندما يكون حجم طلباتك متقلبًا وأنت لا تمانع كتابة Python.

الإجابة المختصرة

يعتمد الترتيب على سؤال واحد: هل تعمل وحدة GPU بكامل طاقتها، أم تنتظر؟ الوحدة المشغولة باستمرار تفضّل الإيجارات الساعية الرخيصة. أما الوحدة التي تبقى خاملة في معظم الوقت فتفضّل الفوترة بالثانية في الخدمات بدون خادم. كل رقم في هذا المقال نابع من هذا التوتر، وهو ما يفسّر لماذا تتغيّر المنصة "الأرخص" بحسب من يطرح السؤال.

منظر من أسفل لممر طويل تصطف فيه رفوف الخوادم في مركز بيانات

السعر بالساعة في لمحة

فيما يلي الأسعار الرئيسية المعلنة لوحدات GPU التي يستخدمها الناس فعليًا لنماذج الانتشار ونماذج الفيديو. أرقام RunPod وModal مأخوذة من قوائم أسعارها العامة في أوائل أكتوبر. أما Vast.ai فهي سوق يحدد فيه كل مضيف سعره، لذلك يمثل عمود Vast.ai نطاقًا نموذجيًا وليس سعرًا ثابتًا.

GPURunPod CommunityRunPod SecureModalVast.ai (نموذجي)
RTX 4090 24GB$0.34$0.74غير متاحمن $0.25 إلى $0.80
L40S 48GB$0.79$1.09$1.95يختلف حسب المضيف
A100 80GBمن $1.19 إلى $1.39$1.59$2.50من $1.10 إلى $2.00
H100 80GBمن $1.99 إلى $2.69من $2.89 إلى $3.49$3.95حوالي من $1.50 إلى $3.00

تنخفض أسعار مثيلات Vast.ai القابلة للمقاطعة أكثر من ذلك. تعلن Vast.ai نفسها أنها أقل بنسبة 50% أو أكثر من سعر فئة «عند الطلب»، وقد أُبلغ عن عروض RTX 4090 الفورية قرب 0.15 دولار في الساعة.

💡 تعامل مع هذه الأرقام كترتيب، لا كعرض سعر. تتحرك أسعار GPU أسبوعيًا. تحقّق من لوحة التحكم المباشرة قبل أن تلتزم بميزانية.

من يفوز في كل مهمة

  • توليد الصور بالدفعات: Vast.ai أو RunPod Community. السعر بالساعة منخفض، ووحدة GPU تبقى مشغولة.
  • توليد الفيديو: RunPod H100 أو Vast.ai. المهام الطويلة تكافئ الذاكرة الكبيرة والسعر الساعي المنخفض.
  • حركة واجهات API المتقطعة: Modal أو RunPod Serverless. تدفع فقط أثناء تشغيل الطلب.
  • الإنتاج الذي يتطلب ضمانات تشغيل: RunPod Secure Cloud أو Modal. مفاجآت أقل من السوق المفتوح.
  • التجارب الأولى: Modal، لأن الرصيد الشهري المجاني يغطي آلاف الصور.

كيف تحتسب كل منصة الفاتورة

ثلاث منصات، ثلاثة نماذج ذهنية. إذا اخترت المنصة الخطأ، ستدفع ثمن ساعات تقضيها وحدة GPU الخاصة بك دون أن تفعل شيئًا.

RunPod: Pods وServerless

تبيع RunPod منتجين. Pods هي أجهزة مؤجرة تُحتسب بالثانية وفق سعر ساعي. Community Cloud هي الفئة الأرخص، بينما تعمل Secure Cloud في مراكز بيانات موثوقة مع وعود أقوى بالموثوقية. Serverless تشغّل الحاوية الخاصة بك عند الطلب، مع عمال مرنين يتقلّصون إلى الصفر.

خدمة Serverless أغلى بكثير في الساعة من البطاقة نفسها في شكل Pod. بطاقة RTX 4090 تكلّف 1.10 دولار في الساعة عبر Serverless مقابل 0.34 دولار كـ Pod من فئة Community. هذه الفجوة هي ثمن عدم إدارة أي شيء، وتمنحك قاعدة واضحة: الـ Pod يتفوّق على Serverless فقط إذا بقي مشغولًا أكثر من نحو 31% من الوقت (0.34 مقسومًا على 1.10).

Vast.ai: سوق GPU حي

لا تملك Vast.ai الأجهزة. يعرض المضيفون آلاتهم ويحددون أسعارهم، وتستأجر ما يطابق المرشحات التي تضبطها. الفوترة بالثانية دون حد أدنى، وهناك ثلاثة أنواع: عند الطلب (مضمون، دون انقطاعات)، وقابل للمقاطعة (أرخص بنسبة 50% أو أكثر، ويمكن استعادته)، ومحجوز (عقود لمدة 1 أو 3 أو 6 أشهر، بخصم يصل إلى 50%).

جهاز متعدد وحدات GPU مفتوح الإطار مركّب في مرآب منزلي

الميزة هي أقل الأسعار بين المنصات الثلاث. لكن الثمن هو التباين. يظهر مضيف في مرآب ومضيف في مركز بيانات احترافي في نتائج البحث نفسها، وتُحدَّد أسعار النطاق الترددي والتخزين لكل مضيف، لذلك اقرأ الإعلان قبل أن تستأجر. بالنسبة لدفعات الصور التي تحفظ كل نتيجة أثناء العمل، لا تكلفك المقاطعة شيئًا تقريبًا. أما في تصيير فيديو مدته عشر دقائق، فإن فقدان المثيل في الدقيقة التاسعة مؤلم.

Modal: الكود أولًا، والدفع بالثانية

لا تسلّمك Modal جهازًا. تكتب دوال Python وتحدد لها نوع GPU، وتشغّلها Modal داخل حاويات تبدأ عند الطلب. الفوترة بالثانية: تكلّف L40S مبلغ 0.000542 دولار في الثانية (1.95 دولار في الساعة)، وتكلّف H100 مبلغ 0.001097 دولار (3.95 دولار في الساعة)، وتتضمن خطة Starter رصيدًا مجانيًا قدره 30 دولارًا كل شهر.

ساعة توقيت تناظرية موضوعة بجانب بطاقة رسوميات

تعني الفوترة مع التقلّص إلى الصفر أنك لا تدفع أبدًا مقابل الخمول. لكنها تعني أيضًا أنك لن ترى الأسعار الساعية الرخيصة، لأن المعادل بالساعة في Modal هو الأعلى بين الثلاث. أنت تدفع علاوة مقابل الراحة، ولا تكون هذه العلاوة منطقية إلا إذا كانت وحدة GPU ستبقى خاملة معظم اليوم لولاها.

التكلفة الحقيقية لكل صورة

الأسعار بالساعة مجردة. ما يهم هو تكلفة صورة واحدة مكتملة.

الحسابات وراء الأرقام

مكتب عليه جدول بيانات مطبوع وآلة حاسبة وقلم أحمر

الصيغة بسيطة: تكلفة الصورة = (السعر بالساعة ÷ 3,600) × الثواني لكل صورة. الثواني هي الجزء المتغيّر. الافتراضات العملية هنا هي صورة بدقة 1024 في 1024 من FLUX Dev بـ 28 خطوة: نحو 12 ثانية على RTX 4090، و9 ثوانٍ على L40S، و4 ثوانٍ على H100، و4.5 ثانية على H100 من نوع PCIe الأبطأ. ستختلف توقيتاتك حسب التكميم والدقة وحزمة البرامج، لذلك تعامل مع الجدول أدناه كنموذج يمكنك إعادة تشغيله.

كما يفترض الحساب أن وحدة GPU محمّلة بالفعل ومشغولة. يحصل الخمول وتحميل النموذج على قسم خاص لاحقًا.

مطابقة VRAM مع نموذجك

السرعة نصف القصة فقط، لأن البطاقة التي لا تستوعب النموذج لا تستطيع تشغيله أصلًا. بشكل تقريبي، تتعامل بطاقة 24GB مثل RTX 4090 مع نماذج الصور من فئة SDXL وFLUX براحة، خاصة مع الأوزان 8-bit. وتتيح بطاقة 48GB مثل L40S إبقاء نموذج الصور وControlNet وأداة رفع الدقة محمّلة معًا دون تبديل. أما A100 أو H100 بسعة 80GB فهي ما تحتاجه نماذج الفيديو الكبيرة، لأنها تحتفظ بتسلسلات طويلة من الإطارات في الذاكرة في وقت واحد.

تؤثر الذاكرة في السعر بطريقتين. شراء VRAM أكثر مما تحتاج يحرق المال: تشغيل نموذج يحتاج 20GB على H100 يعني دفع ثمن 60GB فارغة. أما شراء أقل مما تحتاج فيحرق الوقت، لأن البرنامج ينقل الأوزان إلى ذاكرة النظام فتتباطأ كل خطوة. العادة الجيدة هي استئجار أصغر بطاقة تستوعب النموذج مع هامش بضعة غيغابايتات، وتقييم عشر صور، ثم التوسّع بعد ذلك.

💡 اختبار سريع: ولّد عشر صور على بطاقة رخيصة أولًا. إذا كان زمن الصورة الواحدة ضمن 30% مما افترضته، فسيصمد جدول التكلفة أدناه.

تكلفة 1,000 صورة

الإعدادالسعر بالساعةالثواني لكل صورةالتكلفة لكل 1,000 صورة
Vast.ai 4090، قابل للمقاطعةحوالي 0.15 دولار120.50 دولار
RunPod 4090، Community pod0.34 دولار121.13 دولار
Vast.ai 4090، عند الطلبحوالي 0.40 دولار121.33 دولار
RunPod H100 PCIe، Community pod1.99 دولار4.52.49 دولار
RunPod 4090، Serverless1.10 دولار123.67 دولار
Modal H1003.95 دولار44.39 دولار
Modal L40S1.95 دولار94.88 دولار

على وحدة GPU مشغولة طوال الوقت، تكون Vast.ai 4090 القابلة للمقاطعة أرخص بنحو 10 مرات من Modal L40S. هذا هو العنوان الرئيسي، وهو مضلّل أيضًا. نسبة الاستخدام تقلب الجدول. وحدة 4090 من نوع Community تعمل 10% فقط من اليوم تكلّف فعليًا 11.33 دولار لكل 1,000 صورة، أي أكثر من ضعف 4.88 دولار في Modal، لأنك تدفع أيضًا عن 90% الأخرى من الوقت.

الرصيد المجاني في Modal يجعل الحد الأدنى سهلًا: 30 دولارًا تشتري نحو 15 ساعة من وقت L40S، أي ما يقارب 6,000 صورة بزمن 9 ثوانٍ لكل صورة، كل شهر، دون مقابل.

التكلفة الحقيقية لكل مقطع فيديو

لماذا يغيّر الفيديو الحسابات

نماذج الفيديو أثقل. مقطع 720p مدته خمس ثوانٍ من نموذج مثل Wan 2.7 text-to-video يستغرق دقائق بدلًا من ثوانٍ، ويحتاج إلى ذاكرة VRAM أكبر، ما يدفعك من بطاقات 24GB نحو بطاقات 48GB أو 80GB. الافتراضات هنا هي 6 دقائق لكل مقطع على بطاقة من فئة 4090 أو L40S بأوزان مكمّمة، و3 دقائق على H100.

محرر فيديو يراجع مقطعًا سينمائيًا متوقفًا على شاشة كبيرة

تغيّر عمليات التصيير الطويلة المعادلة. تحميل النموذج الذي يستغرق 40 ثانية لا يهم كثيرًا عندما تستغرق المهمة 6 دقائق، لذلك لم تعد بدايات التشغيل الباردة هي العدو. بدلًا منها تصبح المقاطعات هي العدو، لأن المثيل المفقود يضيّع دقائق من العمل بدلًا من ثوانٍ. وهذا ينقل التوازن نحو Pods موثوقة وبعيدًا عن أرخص قوائم القابلة للمقاطعة.

جدول تكلفة كل مقطع

الإعدادالدقائق لكل مقطعالتكلفة لكل مقطعالتكلفة لكل 100 مقطع
RunPod 4090، Community pod60.03 دولار3.40 دولار
Vast.ai 4090، عند الطلب60.04 دولار4.00 دولار
RunPod H100 PCIe، Community pod30.10 دولار9.95 دولار
RunPod 4090، Serverless60.11 دولار11.00 دولار
Modal L40S60.20 دولار19.51 دولار
Modal H10030.20 دولار19.75 دولار

حتى أغلى صف يبلغ نحو عشرين سنتًا للمقطع. في الفيديو، القرار لا يتعلق بقروش لكل مقطع. بل يتعلق بما إذا كانت ساعات الإعداد والمتابعة والتصييرات الفاشلة تكلفك أكثر من الفرق بين الصفوف.

التكاليف الخفية التي تستنزف ميزانيتك

الخمول وبدايات التشغيل الباردة

أكثر طريقة شيوعًا لتحوّل وحدة GPU رخيصة إلى وحدة مكلفة هي نسيان إيقافها. وحدة 4090 من نوع Community تعمل طوال الشهر تكلّف نحو 248 دولارًا (0.34 دولار × 730 ساعة). أما Pod من H100 PCIe تُركت تعمل فتكلّف نحو 1,453 دولارًا. ولم تنتج أي منهما صورة واحدة بينما كنت نائمًا.

لقطة مقرّبة لمراوح تبريد الخوادم وزعانف المشتت الحراري

يواجه Serverless المشكلة المعاكسة. تحتاج الحاوية الجديدة إلى تحميل عدة غيغابايتات من الأوزان في VRAM قبل أن يعمل أول طلب. تُحمَّل نماذج الصور في ثوانٍ أو عشرات الثواني، أما نماذج الفيديو الكبيرة فتستغرق وقتًا أطول. والوقت الذي يُقضى في تحميل الأوزان داخل الدالة يُحتسب كأي وقت حوسبة آخر، لذلك أبقِ الحاويات دافئة خلال ساعات الذروة، واحتفظ بالأوزان في وحدة تخزين بدلًا من تنزيلها عند كل تشغيل.

التخزين والنقل الصادر وساعات الإعداد

💡 قاعدة عامة: ساعة من وقتك تكلّف أكثر من ساعة لأي وحدة GPU في هذه القائمة.

تتراكم أوزان النماذج بسرعة. نموذج صور واحد ونموذج فيديو واحد وحفنة من LoRA تصل بسهولة إلى 100 GB. يتراوح سعر التخزين الشبكي في RunPod بين 0.05 و0.14 دولار لكل GB شهريًا، أي أن 100 GB تكلّف من 5 إلى 14 دولارًا شهريًا، وتُحتسب سواء كان Pod يعمل أم لا. يحدد مضيفو Vast.ai أسعار التخزين والنطاق الترددي بأنفسهم، لذلك قارن بينها لكل إعلان.

ثم هناك ساعات الإعداد. تثبيت ComfyUI ومطابقة إصدارات CUDA وتصحيح الأخطاء على مضيف في السوق لديه قرص بطيء قد يستنزف فترة بعد الظهر كاملة. وبسعر 50 دولارًا في الساعة، تكلّف ساعتان من استكشاف الأخطاء وإصلاحها 100 دولار، وهو سعر الحوسبة لنحو 88,000 صورة على 4090 من نوع Community. الأسعار الساعية الرخيصة لا تستحق إلا إذا عمل الجهاز من المرة الأولى.

أي منصة تناسب أي حمل عمل

المبدعون المستقلون والهواة

بطاقة رسوميات مستلقية على طاولة عمل من خشب البلوط

إذا كنت تولّد بضع مئات من الصور في الأسبوع، فابدأ برصيد Modal المجاني واكتب سكربتًا واحدًا. وإذا كنت تفضّل سير عمل مرئيًا مثل ComfyUI، فاستأجر RunPod Community 4090 لجلسة مسائية واحدة، وأوقفها عند الانتهاء. تكافئ Vast.ai الصبر والألفة مع وحدة التحكم: رتّب حسب السعر، وراجع درجة موثوقية المضيف، واستخدم الأسعار القابلة للمقاطعة في الدفعات التي تحفظ أثناء التشغيل.

الفرق وواجهات API للإنتاج

أيدٍ بقفازات تمسك لوحة مسرّع GPU للخوادم

التطبيق الذي يخدم آلاف الطلبات بحمل غير منتظم يناسب Modal أو RunPod Serverless، حيث تدفع مقابل كل ثانية من العمل الفعلي. أما الحمل الثابت والمتوقع فيناسب Pods من RunPod Secure أو شروط Vast.ai المحجوزة، حيث يكون السعر بالساعة الأدنى لكل ساعة استخدام فعلي. وفي الفيديو على نطاق واسع، غالبًا ما تفوز H100 من حيث الإنتاجية لكل دولار، حتى عندما يبدو سعرها بالساعة مؤلمًا.

إذا كان خط إنتاجك يستدعي أيضًا نموذجًا لغويًا لكتابة الأوامر النصية، فيمكن للمنصات نفسها تشغيله، لكن نموذجًا بالحجم الكامل مثل DeepSeek R1 يحتاج إلى عقدة متعددة وحدات GPU وقد يضاعف فاتورة الأجهزة. النماذج الصغيرة تعمل على بطاقة واحدة بسعة 24GB.

متى لا يكون تأجير GPU منطقيًا

يفوز التأجير عندما تحتاج إلى شيء مخصص: تدريب LoRA خاص، أو مخطط ComfyUI غير معتاد، أو نموذج لا تستضيفه أي جهة أخرى. أما في كل ما سوى ذلك، فإن حسابات الساعة ومخاطر الخمول ووقت الإعداد غالبًا ما تجعل الخدمة المستضافة أرخص عمليًا.

ثلاثة مستقلين يقارنون أرقامًا على طاولة في شقة علوية مشرقة

تشغّل PicassoIA وحداتها الخاصة من GPU، مع توفّر 91 نموذجًا لتحويل النص إلى صورة و87 نموذجًا لتحويل النص إلى فيديو، والتوليد باستخدام نماذجها الخاصة مجاني في خطتي Infinite وWonder. لا يوجد عداد يعمل بينما تفكر في أمر نصي، ولا Pod تنساه، ولا خطأ CUDA في منتصف الليل.

كيف تستخدم Flux على PicassoIA

  1. افتح صفحة النموذج. ابدأ بـ FLUX Dev للحصول على جودة متوازنة، أو بـ FLUX Schnell عندما تريد مسودات سريعة.
  2. اكتب أمرًا نصيًا محددًا. سمِّ الشخص، واتجاه الإضاءة، والعدسة، مثلًا "85mm f/1.8، ضوء نافذة ناعم من اليسار".
  3. اختر نسبة العرض إلى الارتفاع. اختر 16:9 لرؤوس المدونات و1:1 لمنشورات التواصل الاجتماعي.
  4. اضبط الخطوات والتوجيه إن كانا معروضين. نحو 28 خطوة وقيمة توجيه قرب 3.5 نقطة بداية معقولة لـ FLUX Dev.
  5. ولّد وقارن. شغّل الأمر النصي نفسه على FLUX.2 Pro عندما تحتاج إلى مزيد من الصقل.
  6. اصقل الفائز. أرسله عبر Clarity Pro Upscaler للحصول على نسخة نظيفة عالية الدقة.
  7. حرّكه. حوّل أفضل إطار إلى مقطع قصير باستخدام Wan 2.7 image-to-video أو LTX 2 Fast.

💡 نصيحة: احتفظ بقالب أمر نصي واحد لكل صورة في السلسلة. الصياغة الثابتة للإضاءة والعدسة تمنحك مجموعة متناسقة دون أي إعداد لوحدة GPU.

جرّبه بنفسك على Picasso IA

لديك الآن الأرقام: Vast.ai لأدنى سعر بالساعة، وRunPod للتوازن، وModal للاندفاعات المدفوعة بالثانية. إذا كنت تفضّل تجاوز Pods والحاويات والفواتير، فافتح Picasso IA وشغّل دفعتك التالية هناك. ولّد بضع صور بـ FLUX Dev، وجرّب مقطعًا سينمائيًا باستخدام Seedance 2.0، وقارن النتائج بما كنت على وشك استئجار وحدة GPU لإنتاجه.

جرّب أمرًا نصيًا واحدًا على ثلاثة نماذج مختلفة، واختر الشكل الذي يعجبك، ووفّر تكلفة Pod خامل لشيء أكثر متعة. صورتك الأولى على بعد بضع نقرات.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة