MCP لتوليد الصور من OpenAI في Cursor و Codex: الإعداد والتكاليف والحلول
أضف MCP لتوليد الصور من OpenAI إلى Cursor و Codex ودع وكيل البرمجة ينشئ بانرات رئيسية وأيقونات وتعديلات على الصور داخل مشروعك. تجد هنا إعدادات جاهزة للنسخ للمحررين، وإعدادات GPT Image 2، والتكلفة الفعلية لكل صورة، وحلولًا لانتهاء المهلة، ومسارًا عبر المتصفح يستغني عن الخادم.
أنت في منتصف صفحة هبوط داخل Cursor، ويحتاج القسم الرئيسي إلى صورة، ولا يقدّم الوكيل سوى مربع رمادي فارغ. يحلّ MCP لتوليد الصور من OpenAI في Cursor و Codex هذه المشكلة بخطوة واحدة: يستدعي الوكيل أداة صور، فيُحفظ الملف في مجلد مشروعك، ويحصل التخطيط على صورة حقيقية قبل أن تفتح أي تبويب في المتصفح.
يعرض هذا المقال الإعداد الدقيق لكلا المحررين، وأهم إعدادات النموذج، وتكلفة كل توليد، والأخطاء التي تضيّع فترة بعد الظهر كاملة. ويتضمن أيضًا مسارًا بلا خادم لمن يفضّلون النقر على الإعداد.
لماذا تضع توليد الصور داخل محررك
الروتين المعتاد بطيء. تغادر المحرر، وتفتح موقع صور، وتكتب أمرًا نصيًا من الذاكرة، وتنزّل ملفًا، وتعيد تسميته، وتسحبه إلى /public، وتصحح المسار في كودك. كل خطوة صغيرة على حدة، لكنها مجتمعة تكسر تركيزك عشرات المرات في اليوم.
تقلّص أداة الصور عبر MCP هذه الحلقة. الوكيل يعرف أصلًا موضوع الصفحة لأنه كتب الترميز للتو، لذا يستطيع كتابة الأمر النصي من السياق، وحفظ الملف، والإشارة إليه في الدور نفسه.
ما الذي يفعله الوكيل من أجلك
يكتب الأمر النصي من الكود المحيط، فتحصل صفحة الأسعار ومدونة الوصفات على صور مختلفة
يستدعي الأداة ويختار الحجم والجودة والخلفية
يحفظ الملف ويحدّث وسم <img> أو CSS
يعيد التشغيل بناءً على الملاحظات مثل "إضاءة أدفأ، وصورة أقل شبهًا بالصور النمطية"
أعطِ الوكيل وصفة للأوامر النصية
يكتب الوكلاء أوامر نصية أفضل عندما تزودهم بوصفة بدلًا من صفحة فارغة. احفظ هذه الوصفة في قواعد مشروعك، وستبقى الصور متسقة من صفحة إلى أخرى:
الموضوع والحركة: ما في الإطار وما الذي يفعله
المكان: الغرفة أو الشارع أو المنظر الطبيعي المحيط به
الإضاءة: الاتجاه والوقت من اليوم، مثل ضوء نافذة ناعم من اليسار
الكاميرا: طول العدسة والزاوية والمسافة، مثل عدسة 35 ملم عند مستوى العين
التنسيق: نسبة العرض إلى الارتفاع، وهل تحتاج الصورة إلى مساحة فارغة لعنوان رئيسي
أضف جملة أسلوب ثابتة واحدة إلى كل أمر نصي، مثل "ضوء طبيعي، حبيبات فيلم دقيقة، ملمس واقعي"، وستبدو صورة القسم الرئيسي وصور المدونة وحالات الفراغ كمجموعة واحدة. اطلب من الوكيل كتابة النص البديل في الدور نفسه، لأنه يعرف أصلًا ما تُظهره الصورة.
متى تكفي الأداة المدمجة
تقول مقالات من المجتمع عن Codex CLI إنه صدر مع توليد صور مدمج ومهارة $imagegen عندما أطلقت OpenAI النموذج gpt-image-2 في 21 أبريل 2026، وإنه يعمل بتسجيل دخولك إلى ChatGPT بدلًا من بيانات اعتماد API منفصلة. إذا كان هذا مطابقًا لتثبيتك، وكنت تحتاج إلى صورة مرة في الأسبوع، فقد لا تحتاج إلى MCP أصلًا.
يستحق خادم MCP وجوده عندما:
تريد الأداة نفسها في Cursor و Codex، بالإعدادات نفسها.
تحتاج إلى التحكم في الجودة والخلفية والحجم بدلًا من الإعدادات الافتراضية.
تريد تعديلات قائمة على الأقنعة على لقطات شاشة أو صور موجودة.
تخطط لـ تبديل المزودين لاحقًا دون تغيير سير عملك.
💡 تحقّق أولًا: شغّل codex --version واقرأ قسمي MCP والصور في وثائق Codex الحالية قبل أن تضيف أي خادم. الأداة المدمجة التي نسيتها هي أرخص خيار أمامك.
ما الذي يكشفه الخادم
معظم خوادم صور OpenAI على npm هي أغلفة بسيطة حول نقاط نهاية Images API الخاصة بالتوليد والتعديل. تكشف حزمة imagegen-mcp الشائعة عن أداتين، ويدرج ملف README الخاص بها gpt-image-1 وdall-e-2 وdall-e-3 كنماذج مدعومة. تُحفظ النتائج في ملفات مؤقتة، وتعيد الأداة مسار الملف مع بيانات base64.
أداتان، وظيفتان
الأداة
ما ترسله
الأفضل لـ
text-to-image
الأمر النصي والحجم والجودة والعدد
الصور الرئيسية، ورسومات الحالات الفارغة، والأيقونات، والعناصر النائبة
image-to-image
الصورة المصدر والأمر النصي وقناع اختياري
تصحيح منطقة واحدة من لقطة شاشة، وإعادة تصميم صورة، وإزالة عنصر
في تعديل نموذجي: أرسل صورة لمنتجك، وقنّع الخلفية، واطلب إعدادًا أهدأ. تتغير المنطقة المقنّعة بينما يبقى باقي الصورة كما هو، فيحافظ ذلك على المنتج نفسه عبر النسخ.
النموذج الحالي لصور OpenAI، بلقطة gpt-image-2-2026-04-21، مدرج للتوليد والتعديل والدفعات
يجب أن يدرجه الخادم لديك
gpt-image-1
الجيل السابق، وهو الذي يذكره README
أقدم، لذا توقّع التحديث لاحقًا
dall-e-3
نموذج أقدم
صورة واحدة لكل طلب (n=1)
dall-e-2
الأقدم بين الأربعة
احتفظ به لسير العمل القديم فقط
إذا لم يدرج الإصدار الذي تثبّته gpt-image-2 بعد، فحدّث الحزمة أو اختر خادمًا آخر يدعمه. تأخذ واجهة API نفسها gpt-image-2 كمعرّف نموذج عادي، وتسرد وثائق OpenAI نقاط النهاية v1/images/generations وv1/images/edits وv1/batch الخاصة به.
الإعداد في Cursor
يقرأ Cursor خوادم MCP من ملف mcp.json. تحتاج إلى بيانات اعتماد OpenAI، وNode.js على PATH، وحوالي دقيقتين.
اختر النطاق العام أو الخاص بالمشروع
عام:~/.cursor/mcp.json يجعل الأداة متاحة في كل المشاريع.
خاص بالمشروع:.cursor/mcp.json يبقيها داخل مستودع واحد، فيحصل زملاؤك الذين يفتحون المجلد على الأداة نفسها.
استخدم ملف المشروع عندما تنتمي أداة الصور إلى منتج واحد، واستخدم الملف العام عندما تريدها في كل مكان. في الحالتين، أبقِ السر خارج الملف ودع Cursor يقرأه من بيئتك.
صدّر OPENAI_API_KEY في ملف إعداد الصدفة لديك، ثم أعد تشغيل Cursor حتى تورث عملية المحرر المتغير. افتح إعدادات MCP، ويجب أن يظهر خادم openai-image كمتصل مع عرض أداتين. يمكن لـ Cursor أيضًا تشغيل الخادم أو إيقافه من الشريط الجانبي Customize دون حذفه.
💡 أبقِ الموافقات مفعّلة. يسأل Cursor قبل تشغيل أدوات MCP افتراضيًا. بالنسبة إلى أداة تُحتسب تكلفتها مع كل توليد، فهذا التأكيد ميزة وليس إزعاجًا. اسمح بأداة الصور في القائمة البيضاء فقط بعد أن تراقب استخدامها لمدة أسبوع.
الإعداد في Codex
يحفظ Codex إعدادات MCP في config.toml. يمكنك إضافة خادم بأمر واحد، أو تعديل الملف بنفسك.
env_vars يمرر المتغير من الصدفة لديك، فلا يُكتب أي سر في الملف. يوجد الملف في ~/.codex/config.toml، ويمكن لمشروع موثوق أن يحمل ملف .codex/config.toml الخاص به.
مهلتا الانتظار أهم مما تبدوان. ينتظر Codex افتراضيًا 10 ثوانٍ حتى يبدأ الخادم، و60 ثانية لاستدعاء الأداة. أول تشغيل للأمر npx ينزّل الحزمة، وقد يستغرق التوليد عالي الجودة وقتًا، لذا فكلتا القيمتين الافتراضيتين ضيقتان. القيم أعلاه اقتراح مني، وليست شرطًا.
يملك Codex أيضًا إعداد موافقة لكل خادم، default_tools_approval_mode، بقيم مثل prompt وapprove. ضبطه على prompt يمنحك العادة نفسها في التأكيد قبل الإنفاق التي في Cursor. راجع وثائق MCP الحالية لـ Codex للاطلاع على الخيارات الدقيقة في إصدارك.
تكلفة GPT Image 2
خادم MCP برنامج مجاني. أنت تدفع إلى OpenAI عن كل توليد. عند حجم 1024 في 1024، تضع قوائم الأسعار التابعة لجهات خارجية GPT Image 2 عند هذه الأرقام تقريبًا:
الأعمال النهائية للقسم الرئيسي، والرسومات الكثيفة بالنص
حوالي $0.211
💡 هذه الأرقام مأخوذة من قوائم أسعار الموزعين، وليست من صفحة OpenAI نفسها. تحتسب OpenAI الفاتورة بالتوكنات، لذا تغيّر الأحجام الكبيرة، والتعديلات التي تتضمن صورًا مدخلة، والأوامر النصية الطويلة الإجمالي. تحقق من صفحة أسعار OpenAI قبل أن تضع ميزانيتك.
ارسم بجودة منخفضة، وأنهِ بجودة عالية
شغّل 40 توليد مسودة بجودة منخفضة، بحوالي $0.24، لضبط التكوين والصياغة. ثم أنفق على 5 نسخ نهائية بجودة عالية، بحوالي $1.06. تصل الجلسة الكاملة إلى قرابة $1.30. أما عشر محاولات عالية الجودة دون معاينة مسبقة للحصول على صورة واحدة مناسبة فستكلّف وحدها حوالي $2.11.
ضع سقفًا للإنفاق
اضبط حدًا شهريًا للإنفاق في لوحة تحكم OpenAI.
أنشئ بيانات اعتماد مشروع منفصلة للمحرر حتى تتمكن من إلغائها وحدها.
أبقِ موافقات الأدوات مفعّلة حتى تستقر العادة.
اطلب صورة واحدة لكل استدعاء، إلا إذا كنت تقارن بين خيارات.
إصلاح الأخطاء الشائعة
تقع معظم الأعطال ضمن خمسة أنماط. راجع هذا الجدول قبل أن تغيّر أي شيء آخر.
العرض
السبب المحتمل
الحل
الخادم يبقى باللون الأحمر أو لا يتصل أبدًا
أول تنزيل للحزمة npx بطيء، أو أن npx غير موجود في PATH
شغّل الأمر في الطرفية مرة واحدة، ثم ارفع startup_timeout_sec في Codex
خطأ 401 في كل استدعاء
بيانات الاعتماد غير موجودة في بيئة المحرر
صدّر OPENAI_API_KEY، ثم أعد تشغيل المحرر بالكامل
انتهاء مهلة استدعاء الأداة عند توليد كبير
ينتظر Codex 60 ثانية افتراضيًا
ارفع tool_timeout_sec، أو خفّض الجودة إلى متوسطة
"Model not found" أو 403
حسابك أو قائمة نماذج الخادم لا تتضمن النموذج
تحقق من صلاحية الوصول للنموذج في لوحة تحكم OpenAI، وحدّث الخادم
مسار الصورة يشير إلى ملف غير موجود
كتب الخادم في مجلد مؤقت
اطلب من الوكيل نسخ الملفات إلى مجلد الأصول لديك
عندما لا يتصل الخادم أبدًا
شغّل الأمر command وargs بالضبط في الطرفية أولًا. إذا نزّل npx الحزمة هناك، فسيبدأ تشغيل المحرر التالي أسرع. على Windows، تبدأ بعض الإعدادات npx عبر الصدفة فقط، لذا جرّب cmd كأمر و["/c", "npx", "-y", "imagegen-mcp", "--models", "gpt-image-1"] كوسائط. في Codex، ارفع startup_timeout_sec قبل أن تشك في أي شيء آخر.
أين ذهبت صورتي
يكتب الخادم كل نتيجة في مجلد مؤقت، لذا قد يختفي الملف عند التنظيف التالي. أضف تعليمة دائمة إلى قواعد مشروعك: .cursor/rules في Cursor، أو AGENTS.md في Codex.
💡 قاعدة تعمل: "بعد توليد أي صورة، انسخها إلى public/images/، وأعطها اسم ملف وصفيًا، واكتب نصًا بديلًا يصف الصورة."
الصق أمرًا نصيًا طويلًا ومحددًا. يتبع النموذج التعليمات متعددة الأجزاء، ويرسم نصًا مقروءًا داخل الصورة.
اختر نسبة العرض إلى الارتفاع والجودة من الجدول أدناه.
اختر الخلفية، ثم حدد عدد الصور التي تريدها (من 1 إلى 10).
ولّد الصور، ونزّل الملف، وانقله إلى مجلد الأصول لديك.
الإعداد
الخيارات
اختره عندما
quality
منخفضة، متوسطة، عالية، تلقائي
منخفضة للمسودات، وعالية للنسخ النهائية
aspect_ratio
1:1، 3:2، 2:3، 16:9، 9:16، بالإضافة إلى أحجام ثابتة تصل إلى 3840x2160
16:9 للافتات الرئيسية
background
تلقائي، شفاف، معتم
شفاف للأيقونات والمقتطعات
output_format
png، jpeg، webp
PNG أو WebP عندما تحتاج إلى الشفافية
number_of_images
من 1 إلى 10
عدة خيارات لفكرة واحدة
input_images
صورة مرجعية واحدة أو أكثر
التعديلات وتوجيه الأسلوب
يحتوي النموذج أيضًا على حقل اختياري لبيانات اعتماد OpenAI الخاصة بك. اتركه فارغًا، فيمر الطلب عبر وسيط PicassoIA.
💡 اختصار للأوامر النصية: اطلب من نموذج لغوي مثل GPT 5.6 Sol أو Claude Sonnet 5 تحويل فكرة من سطر واحد إلى أمر نصي مفصّل، ثم الصق النتيجة في نموذج الصور.
واجهة PicassoIA API وموصل MCP
توفر PicassoIA أيضًا واجهة API للمطورين وموصلًا MCP. عنوان URL الأساسي هو https://api.picassoia.com/v1، وتستخدم الطلبات بيانات اعتماد من نوع Bearer تبدأ بالبادئة pia_sk_، وتتبع نقاط النهاية (endpoints) أسلوب Replicate: أنشئ تنبؤًا، ثم استعلم عنه بشكل دوري. يمكن الوصول عبر الواجهة إلى أربعة نماذج: PicassoIA Image، وPicassoIA Image Editor Pro، ونموذجين للفيديو.
curl -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-image/predictions \
-H "Authorization: Bearer $PICASSOIA_API_KEY" \
-H "Content-Type: application/json" \
-d '{"input": {"prompt": "wooden desk with a laptop, soft morning light", "aspect_ratio": "16:9"}}'
ثم استدعِ GET /v1/predictions/{id} حتى تُظهر status القيمة succeeded، واقرأ عناوين URL للصور من output. حدود يجب أخذها في الحسبان: 5 تنبؤات في وقت واحد لكل حساب، وأوامر نصية تصل إلى 4,000 حرف، وجسم طلب بحجم 10 MB.
نموذج GPT Image 2 ليس واحدًا من نماذج API الأربعة هذه. لذا فالتقسيم بسيط: استخدم خادم OpenAI المذكور أعلاه عندما تريد نموذج OpenAI داخل Cursor أو Codex، واستخدم PicassoIA API عندما تريد نماذج الصور الخاصة بمنصة PicassoIA من داخل الكود. تُدرج صفحة API حاليًا التنبؤات على أنها مجانية، لكن متطلبات الخطط مكتوبة بصيغة مختلفة في مواضع أخرى من الموقع، لذا تحقّق من الشروط في صفحة الأسعار قبل أن تعتمد على ذلك.
أنشئ صورك الأولى اليوم
ابدأ بخطوات صغيرة. افتح GPT Image 2 على PicassoIA، والصق الأمر النصي الذي كنت ستعطيه لوكيلك، وولّد ثلاثة خيارات بجودة منخفضة. قارنها، واختر الفائزة، وأعد توليد تلك بجودة عالية. عشر دقائق من ذلك تخبرك عن أوامرك النصية أكثر من ساعة من ضبط الإعدادات.
ثلاثة أوامر نصية تستحق التجربة أولًا:
صورة رئيسية: مشهد عريض بنسبة 16:9 يطابق مزاج منتجك، مع مساحة على اليسار لعنوان رئيسي
حالة فارغة: مشهد هادئ وبسيط بأسلوب الصور الفوتوغرافية، للشاشة التي يراها المستخدمون قبل أن يضيفوا بيانات
معاينة للتواصل الاجتماعي: صورة جريئة بنسبة 3:2 مع تعليق من كلمتين مُصيَّر داخلها
عندما تبدو الصور صحيحة، اربط الإعدادات نفسها بمحرّر Cursor أو Codex ودع الوكيل يتولى الحفظ. إذا أردت تصفح خيارات أكثر أولًا، فقائمة النماذج الكاملة موجودة في picassoia.com/en/all-models. اختر نموذجًا، وشغّل أول أمر نصي لك على Picasso IA، وشاهد ما يصل إلى مجلد مشروعك قبل وقت الغداء.