بوابة API للذكاء الاصطناعي مفتوحة المصدر: أفضل الخيارات وVercel AI Gateway

قارن أفضل بوابات API للذكاء الاصطناعي مفتوحة المصدر، ومنها LiteLLM وBifrost وEnvoy وHelicone، مع Vercel AI Gateway. تعرّف على الفروق في التوجيه والبدائل الاحتياطية والميزانيات والسجلات، وعلى قيود الترخيص، وكيف تختار الإعداد المناسب لفريقك في عصر يوم واحد.

بوابة API للذكاء الاصطناعي مفتوحة المصدر: أفضل الخيارات وVercel AI Gateway
Cristian Da Conceicao
مؤسس Picasso IA

يواجه كل فريق يطلق ميزة ذكاء اصطناعي العقبة نفسها خلال أسابيع قليلة. مزوّد يفرض حدًا للمعدل عند الساعة 2 صباحًا، وآخر يغيّر اسم نموذج، والقسم المالي يسأل لماذا تضاعفت الفاتورة، وقاعدة الشيفرة لديك تحمل الآن أربع حزم SDK مختلفة. تعالج بوابة API للذكاء الاصطناعي هذه المشكلة بوقوفها بين تطبيقك وكل مزوّدي النماذج، فيصبح التوجيه وإعادة المحاولة والميزانيات والسجلات في مكان واحد بدل أن تتناثر عبر الخدمات.

تقارن هذه المقالة أفضل خيارات بوابة API للذكاء الاصطناعي مفتوحة المصدر مع Vercel AI Gateway، الخيار المستضاف الذي تلجأ إليه فرق كثيرة أولًا. سترى ما الذي يجيده كل خيار، وأين يكمن ضعفه، وكيف تختار دون إجراء اختبار مقارن يستمر شهرًا. كل ما هنا يعكس ما توثّقه الجهات المشرفة على هذه الأدوات، فتحقق من صفحات الترخيص والأسعار الحالية قبل الالتزام.

ما الذي تفعله بوابة الذكاء الاصطناعي فعلًا؟

منظر جوي لتقاطع طرق سريع تتفرّع فيه حركة السير نحو مخارج مختلفة

تخيّل البوابة تقاطع مرور لطلبات النماذج. يرسل تطبيقك طلبًا واحدًا بصيغة واحدة، وهي عادةً الشكل نفسه لواجهة OpenAI chat API. تقرر البوابة أي مزوّد وأي نموذج يجب أن يجيب، وتمرّر الاستدعاء، وتعيد استجابة موحّدة. لا تحتاج شيفرتك أن تعرف من تولّى الطلب.

لهذا سترى هذه الطبقة تُسمّى أيضًا بوابة LLM أو وكيل LLM أو واجهة API موحّدة. تختلف الأسماء والمهمة واحدة: باب واحد للدخول وعدة مزوّدين للخروج.

نقطة نهاية واحدة لمزوّدين كثيرين

من دون بوابة، يأتي كل مزوّد بحزمة SDK خاصة به، وطريقة مصادقة، ورموز أخطاء، وصيغة للبث. إضافة مزوّد ثانٍ تعني تكاملًا ثانيًا، وإضافة ثالث تعني تكاملًا ثالثًا. مع البوابة، تغيّر عنوان الأساس (base URL) واسم النموذج فقط. وتعلن معظم البوابات عن نقطة نهاية متوافقة مع OpenAI لهذا السبب: تستمر مكتبات العميل الحالية في العمل، ويمكن تغيير المزوّد خلفها يوم الثلاثاء بعد الظهر دون إعادة نشر.

المهام التي تتولاها

تتولى البوابة الجيدة ست مهام:

  • التوجيه: إرسال كل طلب إلى المزوّد أو النموذج أو المنطقة المناسبة، مع موازنة الحمل بين عدة نشرات.
  • الاحتياط (Fallbacks): التحوّل إلى بديل احتياطي عند فشل الخيار الأول أو انتهاء مهلته.
  • الميزانيات وتحديد المعدل: ضبط الإنفاق ومعدلات الطلبات لكل فريق أو مشروع أو مستخدم.
  • التخزين المؤقت: إعادة الإجابات المخزّنة للأوامر النصية المتكررة لخفض التكلفة وزمن الاستجابة.
  • المراقبة: تسجيل استهلاك التوكنات وزمن الاستجابة والتكلفة والأخطاء لكل استدعاء.
  • ضوابط الحماية: تصفية المدخلات والمخرجات الحساسة أو حجبها قبل أن تغادر شبكتك.

💡 نصيحة: لا تحتاج إلى المهام الست في اليوم الأول. يبدأ معظم الفرق بالتوجيه والاحتياط والسجلات، ثم يضيفون الميزانيات بعد أول فاتورة مفاجئة.

مفتوحة المصدر أم مستضافة؟

لقطة مقرّبة لكابلات إيثرنت متصلة بمفتاح شبكة مثبّت في رف خادم

هذا أول مفترق طرق، وهو أهم من أي جدول مقارنة للميزات.

متى تكون مفتوحة المصدر الخيار الأفضل؟

تعمل البوابات مفتوحة المصدر على بنيتك التحتية، لذا تمرّ الأوامر النصية والردود عبر أجهزة تتحكم فيها. هذا هو السبب الرئيسي الذي يدفع الفرق الخاضعة للتنظيم إلى اختيار خادم وكيل مستضاف ذاتيًا. يمكنك قراءة الشيفرة، وإصلاح خلل، وإضافة مزوّد لا يدعمه أحد بعد، وتجنّب رسم لكل طلب تفرضه البوابة نفسها. لكن المقابل عمل تشغيلي: أنت تتولى الترقيات والتوسّع وتخزين الأسرار والاستجابة لإنذار الثالثة فجرًا حين يتعطّل الوكيل.

تحتاج بيانات الاعتماد إلى عناية خاصة. تحتفظ البوابة ببيانات اعتماد كل مزوّد تستخدمه، ما يجعلها هدفًا عالي القيمة. خزّنها في مدير أسرار بدلًا من ملفات البيئة، وغيّرها وفق جدول زمني، وأعطِ كل فريق داخلي بيانات اعتماد افتراضية حتى لا تغادر بيانات المزوّدين الحقيقية البوابة أبدًا.

متى تكون الاستضافة أذكى؟

تزيل البوابة المستضافة هذا العبء كله. لا يوجد شيء تنشره، ولا قاعدة بيانات تحتاج إلى نسخ احتياطي، ولا عنقود يحتاج إلى تحديث. إذا كان فريقك مكوّنًا من ثلاثة مطوّرين يطلقون منتجًا، فإن ساعة تُقضى مع بوابة مُدارة أفضل من أسبوع يُقضى في ضبط وكيل. التكلفة هي الاعتماد على وقت تشغيل المزوّد وسياسات بياناته وتسعيره، إضافة إلى قدر أقل من المرونة في تعديل السلوك وفق احتياجاتك.

السؤالمفتوحة المصدر، مستضافة ذاتيًاخدمة مستضافة
من يشغّلها؟فريقكالمزوّد
أين تنتقل الأوامر النصية؟داخل شبكتكعبر المزوّد
وقت الإعدادساعات إلى أيامدقائق
السلوك المخصصتعديل الشيفرة أو الإضافاتالإعدادات فقط
العمل المستمرالترقيات والتوسّع والمراقبةشبه معدوم

💡 فحص الترخيص: المستودع العام لا يعني دائمًا أنه مفتوح المصدر بالكامل. تحتفظ عدة بوابات بميزات مثل تسجيل الدخول الموحّد والتحكم في الوصول حسب الدور وسجلات التدقيق ضمن ترخيص تجاري منفصل. اقرأ ملف الترخيص، لا ملف README وحده.

أفضل بوابات API للذكاء الاصطناعي مفتوحة المصدر

مطوّر يكتب في نافذة طرفية عند مكتب قائم في ضوء الصباح

هذه هي المشاريع التي تضعها معظم الفرق في قائمتها المختصرة. تتغيّر التراخيص وأعداد المزوّدين كثيرًا، لذا تعامل مع هذا القسم على أنه خريطة وليس عقدًا.

LiteLLM: أوسع دعم للمزوّدين

يُعدّ LiteLLM عادةً أول اسم يُذكر. يأتي على شكل مكتبة Python وخادم وكيل، ويتحدث صيغة OpenAI، ويدعم قائمة طويلة من المزوّدين، ما يجعله أسرع طريق إلى بوابة تعمل. النواة مرخّصة بترخيص MIT. أما تسجيل الدخول الموحّد لعدد يتجاوز عددًا صغيرًا من المستخدمين، والتحكم في الوصول حسب الدور، وسجلات التدقيق، وبعض عمليات الاستدعاء الخاصة بالإشراف، فتقع خلف ترخيص مؤسسي منفصل، لذا تحقّق من هذا الحد قبل أن تخطط للاعتماد عليها. ولأنه يعمل بلغة Python، تميل الفرق ذات حجم الطلبات المرتفع جدًا إلى قياس أدائه بعناية وتوسيعه أفقيًا.

مقارنة Portkey وBifrost

Portkey Gateway مرخّصة بترخيص MIT، وتُبقي الاحتياط وإعادة المحاولة وضوابط الحماية ضمن نواتها مفتوحة المصدر. وهي مناسبة للفرق التي تريد ضوابط للسياسات دون شراء منصة كاملة من اليوم الأول.

Bifrost مكتوبة بلغة Go، وصدرت بترخيص Apache 2.0، وتعلن عن زمن إضافي أقل من ميلي ثانية. لا تتفق الاختبارات المستقلة دائمًا مع هذا الرقم المعلن، لذا شغّل اختبار حمل خاصًا بك بأحجام أوامرك النصية قبل أن تثق بأي ادعاء عن زمن الاستجابة. تضم قائمة مزوّديها عددًا أقل من قائمة LiteLLM، وهذا مقبول إذا كانت حاجتك تقتصر على المزوّدين الكبار.

Envoy وHelicone وKong

Envoy AI Gateway مبنية على Envoy ومرخّصة بترخيص Apache 2.0. تناسب الفرق التي تشغّل Kubernetes بالفعل وتعتمد Envoy طبقةً لحركة المرور، إذ تتبع حركة النماذج عندئذ السياسات نفسها والتتبّع وعادات الإطلاق المعتمدة لكل خدمة أخرى.

صفوف من خزائن الخوادم على طول ممر نظيف في مركز بيانات بمنظور نقطة واحدة

Helicone مرخّصة بموجب Apache 2.0 ونشأت من مجال المراقبة، لذا فإن السجلات وعروض التكلفة من نقاط قوتها. أما Kong فتضيف توجيه الذكاء الاصطناعي عبر إضافات فوق بوابة API مفتوحة المصدر الخاصة بها، وهذا مريح إن كانت Kong تقف بالفعل أمام واجهات API الأخرى لديك. تحقق من إضافات الذكاء الاصطناعي المضمّنة في الإصدار المجاني قبل الاعتماد عليها.

البوابةالترخيصأفضل استخدام
LiteLLMنواة MIT، ومستوى مؤسسي مدفوعبداية سريعة، مزوّدون كثيرون
Portkey GatewayMITالضوابط وإعادة المحاولة
BifrostApache 2.0زمن إضافي منخفض، بيئة Go
Envoy AI GatewayApache 2.0منصات Kubernetes
HeliconeApache 2.0رؤية التكلفة والاستخدام
Kongنواة Apache 2.0، وبعض الإضافات المدفوعةفرق تعتمد Kong أصلًا

Vercel AI Gateway عن قرب

Vercel AI Gateway هي النظير المستضاف، والتوصيف الصادق بسيط: ليست مفتوحة المصدر. حزمة AI SDK المحيطة بها مفتوحة المصدر، لكن البوابة نفسها خدمة مُدارة. أنت تختار الراحة على حساب التحكم، وبالنسبة لكثير من الفرق يكون هذا الاختيار الصائب.

ما الذي تحصل عليه

توفر بيانات اعتماد واحدة ونقطة نهاية واحدة الوصول إلى نماذج من مزوّدين كثيرين. تعرض نقاط نهاية متوافقة مع OpenAI ومتوافقة مع Anthropic، لذلك تحتاج مكتبات العميل الحالية عادةً إلى عنوان أساس جديد فقط. وفوق ذلك تحصل على توجيه المزوّدين، وإعادة المحاولة التلقائية، واحتياط النماذج، وسجلات الإنفاق وزمن الاستجابة، وميزانيات لكل بيانات اعتماد.

أما التكلفة، فتذكر Vercel أنها تحتسب سعر القائمة الخاص بالمزوّد دون هامش على التوكنات، ويشمل ذلك حالة استخدامك بيانات اعتماد مزوّدك الخاصة (وهي ما يُسمّى غالبًا BYOK). تحصل الفرق الجديدة على رصيد شهري مجاني صغير، مُعلن بقيمة 5 دولارات وقت كتابة هذا المقال. تحقّق من صفحة التسعير الحالية، لأن قيم الأرصدة تتغيّر.

تذكر Vercel أيضًا أنه عبر حركة إنتاجها حتى أبريل 2026، وفّر الاحتياط التلقائي نحو 3.5% من الطلبات التي واجهت خطأً أو حدًّا للمعدل أو انتهاء مهلة على المسار الأول. هذا الرقم صادر عن المزوّد، لذا اعتبره مؤشرًا على مدى شيوع الاضطرابات لدى المزوّدين، لا وعدًا بما يحدث في حملك.

أين تقصّر

  • لا يمكن استضافتها ذاتيًا. تمر الأوامر النصية عبر مزوّد خارجي، وقد يستبعدها ذلك عند وجود سياسات بيانات صارمة.
  • قائمة على النقاط. تناسب النقاط المدفوعة مسبقًا الفرق الصغيرة، لكن الأقسام المالية تفضّل أحيانًا الفواتير والإنفاق الملتزم به.
  • تخصيص أقل. تضبط الإعدادات ولا تعدّل الشيفرة.
  • ارتباط خفيف بالمزوّد. بما أن واجهة API متوافقة مع OpenAI، فالانتقال غالبًا تغيير في عنوان base URL، لكن سجلاتك وميزانياتك تبقى لدى المزوّد.

التوجيه والاحتياط وإعادة المحاولة

منظر من زاوية منخفضة لبرج مراقبة الحركة الجوية عند الغروب

الاحتياط هو الميزة التي تبرر وجود البوابة وحدها. تسرد سلسلة الاحتياط النماذج بالترتيب: جرّب الخيار الأساسي، فإن أعاد خطأ 5xx أو حدًّا للمعدل 429 أو انتهت مهلته، انتقل إلى التالي. والسلسلة المعقولة تجمع بين مزوّدين مختلفين لا بين نماذج فقط، لأن انقطاع مزوّد يُسقط كل نموذج يستضيفه.

قد تبدو سلسلة عملية لميزة محادثة كما يلي:

  1. الخيار الأساسي: Claude Sonnet 5 للإجابات التي تتطلب أعلى جودة.
  2. الاحتياط الأول: GPT 5.6 Terra لدى مزوّد مختلف.
  3. الملاذ الأخير: Gemini 3.5 Flash للسرعة عندما تتعثر البدائل كلها.

منظر جوي لساحة تحويل سكك حديدية تتفرّع فيها الخطوط في اتجاهات كثيرة

كل بوابة في هذا المقال تستطيع التعبير عن سلسلة كهذه في إعداداتها. ما يختلف هو مقدار التحكم في توقيت تفعيلها: بحسب رمز الحالة، أو حد زمن الاستجابة، أو نتيجة مرشّح المحتوى، أو قاعدة مخصصة.

موازنة الحمل هي الشقيق الهادئ للاحتياط. إذا كان لديك نشرتان للنموذج نفسه، سواء في منطقتين مختلفتين أو بحسابين مختلفين، يمكن للبوابة توزيع الحركة بينهما حسب الوزن، والابتعاد عن النشرة البطيئة. وهذا يرفع أيضًا حد معدلك الفعلي، لأن لكل حساب سقفه الخاص.

إعادة المحاولة تحتاج إلى حدود

تساعد إعادة المحاولة في الأخطاء قصيرة الأجل، لكنها تحمل مخاطرة. قد يُحتسب الطلب المعاد مرتين إذا انتهى الاستدعاء الأول متأخرًا، ويمكن لعاصفة من إعادات المحاولة أن تدفع مزوّدًا متعثرًا إلى مزيد من التراجع. التزم بهذه العادات:

  • استخدم محاولتين أو ثلاث محاولات كحد أقصى، مع تأخير أسّي متزايد وتشويش عشوائي (jitter).
  • حدّد المهلات لكل نموذج. قد يفكر نموذج الاستدلال لدقيقة كاملة دون مشكلة، بينما ينبغي أن يجيب نموذج محادثة صغير خلال ثوانٍ.
  • خطّط للبث. بعد أن تصل التوكنات الأولى إلى المستخدم، لا يستطيع الاحتياط في منتصف البث أن يعيد بدء الإجابة بصمت، لذا قرّر مبكرًا كيف ستتعامل واجهتك مع ذلك.

التحكم في التكلفة والاستخدام

منظر علوي لمكتب عليه دفتر وآلة حاسبة وفنجان قهوة لتتبع التكاليف

تنمو فواتير النماذج بصمت. تحوّل البوابة الإنفاق إلى شيء تستطيع ضبطه ومراقبته.

ميزانيات لكل فريق ومشروع

أصدر بيانات اعتماد افتراضية واحدة لكل فريق أو مشروع أو عميل، وأرفق بها ميزانية شهرية وحدًّا لمعدل الطلبات. عندما تدخل برمجية نصية خارجة عن السيطرة في حلقة تكرار، تستنفد ميزانيتها الخاصة وتتوقف، بدلًا من استنزاف الحساب المشترك. ضع وسمًا على كل طلب ليجيب السجل عن سؤال "من أنفق ماذا" دون جهد في جداول البيانات. يوفر كل من LiteLLM وVercel AI Gateway الميزانيات، ومع أي أداة مستضافة ذاتيًا يجب أن تتحقق مما إذا كانت ميزة الميزانية متاحة في النسخة المجانية.

ثم استخدم البوابة لمطابقة النموذج مع المهمة:

  • أرسل التصنيف ووضع الوسوم والملخصات القصيرة إلى نموذج صغير وسريع مثل Gemini 3.5 Flash أو Qwen3.7-Plus.
  • احتفظ بالنماذج من الفئة العليا للشيفرة والاستدلال والنصوص الموجهة للعملاء، مثل Kimi K2.6 للأعمال بأسلوب الوكلاء.
  • شغّل نماذج مفتوحة الأوزان مثل Llama 4 Maverick Instruct أو Deepseek v3.1 أو GPT OSS 120B خلف نقطة النهاية نفسها مع واجهات API المدفوعة، مما يمنحك فئة منخفضة التكلفة.
  • خزّن مؤقتًا الأوامر النصية المتكررة مثل إجابات الأسئلة الشائعة، وفعّل التنبيه عند 80% من الميزانية بدل 100%.

💡 سجّل بعناية: يجعل حفظ كل أمر نصي تصحيح الأخطاء أسهل، لكنه قد يخزّن بيانات شخصية أيضًا. حدّد قواعد الاحتفاظ بالبيانات وحجبها قبل أن تفعّل التسجيل الكامل لمحتوى الطلبات.

كيف تختار في بعد ظهر يوم واحد

مهندسان يناقشان مخططًا مرسومًا بخط اليد على لوح أبيض

لا تحتاج إلى شهر من البحث. تحتاج إلى صورة واضحة لقيودك واختبار قصير واحد.

جدول قرار مبسّط

وضعكابدأ مع
فريق صغير يريد حلًا يعمل اليومVercel AI Gateway
يجب أن تبقى الأوامر النصية داخل شبكتكLiteLLM أو Portkey Gateway، مستضافتان ذاتيًا
تشغّل Kubernetes وEnvoy أصلًاEnvoy AI Gateway
زمن الاستجابة الإضافي لكل طلب هو الأهمقارن Bifrost مع LiteLLM باختبار معياري
Kong تتصدر واجهات API لديك أصلًاإضافات Kong AI
رؤية التكلفة والاستخدام تأتي أولًاHelicone

ثم نفّذ اختبارًا من خمس خطوات نفسه على أفضل خيارين لديك:

  1. وجّه تطبيقًا تجريبيًا إلى عنوان الأساس الخاص بالبوابة.
  2. أرسل ألف أمر نصي واقعي، لا أمثلة تجريبية بسيطة.
  3. ألغِ بيانات اعتماد المزوّد الأساسي وتحقّق من أن الاحتياط يعمل.
  4. تأكد من أن السجلات تُظهر التوكنات والتكلفة والأخطاء لكل طلب.
  5. قِس الزمن الإضافي مقارنةً بالاتصال بالمزوّد مباشرةً.

ثلاثة أخطاء تجنّبها

  1. الاختيار بناءً على الاختبارات المعيارية وحدها. قد تضيف بوابة ميلي ثانية واحدة في المختبر، لكنها تضيف أكثر من ذلك بعد تفعيل التسجيل والمصادقة وضوابط الحماية.
  2. تخطّي اختبار الاحتياط. افصل المزوّد الأساسي وراقب ما يحدث. السلسلة غير المختبرة مجرد تخمين.
  3. اعتبار البوابة نقطة فشل وحيدة. شغّل نسختين على الأقل خلف موازن للحمل، أو احتفظ بمسار مباشر إلى المزوّد في شيفرتك كمفتاح طوارئ.

تجاوز تفاصيل البنية التحتية وابدأ الإبداع

مصمم عند مكتب عريض يراجع صورة طبيعية على شاشة كبيرة

لا يحتاج كل مشروع إلى بوابة. إذا كان هدفك إنتاج نصوص أو صور أو فيديو بدلًا من تشغيل البنية التحتية، فإن Picasso IA يوفّر لك النماذج مباشرةً في المتصفح، دون نشر وكيل ودون الحاجة إلى تدوير بيانات اعتماد.

في جانب النصوص يمكنك تجربة Claude Sonnet 5 و GPT 5.6 Terra وGemini 3.5 Flash جنبًا إلى جنب، وهي المقارنة نفسها التي تتيح لك البوابة برمجتها. أما الصور، فشغّل أمرًا نصيًا واحدًا عبر Seedream 5 Pro وGPT Image 2 وFlux 2 Max واحتفظ بالنتيجة الأفضل لديك. وللحركة، يحوّل Seedance 2.0 النص إلى فيديو مع صوت مدمج، ويُنتج Veo 3.1 Fast مقاطع سريعة بدقة 1080p، ويستهدف Kling v3 Video اللقطات السينمائية.

اختر أمرًا نصيًا تحتاجه فعلًا، وشغّله عبر ثلاثة نماذج، وقارن النتائج. هذه العادة الواحدة تعلّمك عن جودة النماذج وتكلفتها أكثر من أي جدول اختبارات معيارية. افتح Picasso IA، واختر نموذجًا، وأنشئ أول صورة أو فيديو لك اليوم.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة