نظرة تفصيلية على سعر كل خيار في GPT Image 2 API: تكلفة الصورة الواحدة بجودة منخفضة ومتوسطة وعالية، وكيف تخفّض طلبات الدفعات الفاتورة إلى النصف، والمعاملات التي تغيّر الإجمالي، وكيف تطلب صور PNG شفافة حقيقية دون دفع تكلفة إضافية، مع ميزانيات لمشاريع حقيقية.
تكلّف صورة واحدة بحجم 1024x1024 من GPT Image 20.006$ بجودة منخفضة، و0.053$ بجودة متوسطة، و0.211$ بجودة عالية. أي فرق يبلغ 35 ضعفًا للأمر النصي نفسه، والمعامل quality وحده يحدد أي طرف من هذا النطاق ستصل إليه. وإذا أضفت حجم اللوحة وعدد الصور المرجعية التي ترسلها وما إذا كنت تستدعي نقطة نهاية الدفعات، فقد تتراوح تكلفة مهمة من 1000 صورة بين 3$ و211$.
يجمع هذا المقال كل الأرقام في مكان واحد: جدول سعر الصورة الواحدة، ومعدلات التوكنات التي يقوم عليها، والمعاملات التي تغيّر الفاتورة، والإعداد الواحد (background: "transparent") الذي يعيد صورة PNG حقيقية بقناة ألفا دون رسوم إضافية. تم التحقق من الأسعار مقابل صفحة تسعير OpenAI والحاسبات التابعة لجهات خارجية في سبتمبر وأكتوبر 2026، لذا تأكد منها قبل اعتماد أي ميزانية.
ما التكلفة الفعلية لصورة واحدة
تُحتسب فواتير نماذج الصور لدى OpenAI بالتوكن، لكن معظم الفرق تضع ميزانيتها بالصورة، لذلك تحوّل الآلات الحاسبة أحدهما إلى الآخر. يعرض الجدول أدناه سعر الإخراج القياسي (غير الدفعات) عند الأحجام الثلاثة التي تسردها API افتراضيًا.
سعر الصورة حسب الجودة
الحجم
منخفضة
متوسطة
عالية
1024x1024 (مربع)
0.006$
0.053$
0.211$
1024x1536 (عمودي)
0.005$
0.041$
0.165$
1536x1024 (أفقي)
0.005$
0.041$
0.165$
اقرأ الجدول بالنسب لا بالدولارات وحدها. الجودة المتوسطة تكلّف نحو 9 أضعاف الجودة المنخفضة. والجودة العالية تكلّف نحو 4 أضعاف المتوسطة و35 ضعفًا المنخفضة. إذا بدت المسودة جيدة بجودة منخفضة، فأنت تدفع أقل من سنت واحد عليها، وكل درجة ترتقي إليها تضاعف الفاتورة.
💡 قاعدة الميزانية: اعمل المسودات بجودة low، ووافق على التخطيط، ثم صيّر النسخة النهائية بجودة medium. واحتفظ بجودة high للنصوص الكثيفة والمخططات وأعمال الطباعة، حيث تظهر التفاصيل الإضافية بوضوح.
طلبات الدفعات تكلّف النصف
يدعم النموذج نقطة نهاية الدفعات، وتخفّض OpenAI هناك كل أنواع التوكنات بنسبة 50%. هذه معدلات التوكنات القياسية ومعدلات الدفعات لكل مليون توكن:
نوع التوكن
قياسي
دفعات
إدخال النص
5.00$
2.50$
إدخال النص المخزَّن مؤقتًا
1.25$
0.625$
إدخال الصورة
8.00$
4.00$
إدخال الصورة المخزَّن مؤقتًا
2.00$
1.00$
إخراج الصورة
30.00$
15.00$
بحجم 1024x1024، تصل تكلفة الدفعات إلى نحو 0.003$ للصورة المنخفضة الجودة، و0.027$ للصورة المتوسطة، و0.105$ للصورة عالية الجودة. الثمن الذي تدفعه هنا هو الوقت: تصل نتائج الدفعات لاحقًا بدلًا من ثوانٍ، لذلك تناسب الكتالوجات والمهام الليلية، لا مستخدمًا ينتظر بعد نقرة على زر.
الحساب الداخلي للتوكنات خلف السعر
كل رقم سعر للصورة هو ببساطة توكنات الإخراج مضروبة في 30$ لكل مليون. اقسم السعر على هذا المعدل لتحصل على عدد التوكنات الضمني: نحو 1,770 توكنًا لمربع متوسط، ونحو 7,030 لمربع عالي الجودة، ونحو 1,370 و5,500 للأفقي المتوسط والعالي. هذه الأرقام محسوبة عكسيًا من الأسعار المنشورة، وليست أرقامًا تنشرها OpenAI، لذا تعامل معها كتقديرات.
لماذا تكون الصورة الأفقية أرخص
وهنا الجزء الغريب. تحتوي لوحة 1536x1024 على 1,572,864 بكسل، أي أكثر بنسبة 50% من 1,048,576 بكسل في المربع، ومع ذلك تكلّف نحو 22% أقل بالجودة المتوسطة والعالية. لا تزداد التكلفة مع عدد البكسلات بشكل خطي. الدرس العملي: إذا سمح تخطيطك بذلك، فاختر الأفقي أو العمودي بدلًا من المربع. ستحصل على صورة أكبر بمال أقل.
ما تضيفه الصور المرجعية
تضيف التعديلات وسير العمل القائم على الصور المرجعية توكنات إدخال بسعر 8$ لكل مليون. يُظهر قياس منشور أن استدعاءً بجودة منخفضة بحجم 1024x1024 بالنص وحده يكلّف نحو 0.0063$ على 24 توكن إدخال. أما الاستدعاء نفسه مع صورتين مرجعيتين فقد كلّف نحو 0.025$ على 2,365 توكن إدخال إجمالي. أي أن الصورتين المرجعيتين ضاعفتا سعر الصورة المنخفضة أربع مرات، ولم تتغير توكنات الإخراج.
💡 نصيحة: تُرجع API كائن usage مع كل استجابة. سجّله في أول مئة استدعاء لك. إنه الطريقة الموثوقة الوحيدة لتسعير الأحجام غير القياسية، لأن OpenAI لا تنشر جدولًا لها.
المعاملات التي تغيّر فاتورتك
لقطة النموذج هي gpt-image-2-2026-04-21، وتُستخدم عبر /v1/images/generations و/v1/images/edits ونقطة نهاية الدفعات. إليك كل معامل مهم وأثره في التكلفة.
المعامل
القيم
الأثر في التكلفة
size
1024x1024، 1536x1024، 1024x1536، auto، أو مخصص
اللوحات الأكبر تُحتسب بتوكنات إخراج أكثر
quality
low، medium، high، auto
الأداة الأكبر تأثيرًا، نحو 9 أضعاف من المنخفضة إلى المتوسطة
background
transparent، opaque، auto
لا شيء، التوكنات نفسها عند الحجم والجودة نفسيهما
output_format
png، jpeg، webp
لا شيء
output_compression
من 0 إلى 100 (jpeg وwebp)
لا شيء، ملفات أصغر فقط
moderation
auto، low
لا شيء
n
عدد الصور لكل طلب
خطي، 4 صور تكلّف 4 أضعاف
partial_images
من 0 إلى 3 (البث)
غير موجود في الجداول التي وجدتها، قارن مع usage
الحجم ونسبة العرض إلى الارتفاع
إلى جانب الإعدادات الثلاثة المحددة مسبقًا، تخضع الأحجام المخصصة لقواعد صارمة من وثائق OpenAI للصور: يجب أن يكون طول كل ضلع مضاعفًا للرقم 16، ولا تتجاوز النسبة 3:1، ولا يتجاوز أي ضلع 3,840 بكسلًا، ويجب أن يقع الإجمالي بين 655,360 و8,294,400 بكسل. كل ما يتجاوز 2560x1440 يُعلَّم بأنه تجريبي. من الخيارات الشائعة 2048x2048 و2048x1152 و3840x2160.
مستويات الجودة
auto يترك للنموذج حرية الاختيار، وهذا مريح لكنه غير متوقع في الفاتورة. في الإنتاج، حدّد المستوى صراحةً. تسرد وثائق OpenAI الحالية للصور أيضًا xhigh وmax لنموذج GPT Image 2.5، ولم أجد أسعارًا منشورة للصورة الواحدة لهذين المستويين، لذلك اختبرهما بـusage قبل أن تعد أحدًا بتكلفة.
الصيغة والضغط
يبقى PNG الخيار الافتراضي والأكثر أمانًا للشفافية. كما يحمل WebP قناة ألفا وينتج ملفات أصغر. أما JPEG فتُرمَّز أسرع لكنه لا يحمل قناة ألفا. اضبط output_compression بين 0 و100 لملفات JPEG وWebP عندما تريد ملفات أخف للويب.
الإشراف وعدد الصور
يقبل moderation القيمتين auto (تصفية قياسية) أو low (أقل تقييدًا). ولا يغيّر أيٌّ منهما السعر. يولّد المعامل n عدة صور في طلب واحد ويحتسب كل واحدة منها، لذلك فإن دفعة من 10 صور تساوي عشرة أضعاف صورة واحدة. يكلّف الطلب الذي يعيد عشر مسودات متشابهة جدًا بجودة متوسطة نحو 0.53$ بالحجم المربع.
صور PNG شفافة بمعامل واحد
حتى هذا الصيف، كان القص يعني التوليد على خلفية بيضاء ثم تشغيل أداة لإزالة الخلفية بعد ذلك. في أواخر أغسطس 2026، وثّقت OpenAI الشفافية الأصلية لنموذج GPT Image 2 في دليل الاستخدام الخاص بها، كميزة في مرحلة المعاينة. يعيد طلب واحد الآن صورة PNG بقناة ألفا حقيقية.
الحقلان المطلوبان
تحتاج إلى إعدادين معًا: background="transparent" وoutput_format="png" (يعمل WebP أيضًا). يعيد طلب JPEG خطأ 400 لأن JPEG لا يستطيع تخزين الشفافية. الشفافية لا تكلّف شيئًا إضافيًا: عند الجودة والحجم نفسيهما، يستهلك transparent وopaque توكنات الصورة نفسها.
import base64
from openai import OpenAI
client = OpenAI()
result = client.images.generate(
model="gpt-image-2",
prompt="A ceramic mug, isolated object, no backdrop, no cast shadow",
size="1024x1024",
quality="medium",
background="transparent",
output_format="png",
)
with open("mug.png", "wb") as f:
f.write(base64.b64decode(result.data[0].b64_json))
print(result.usage)
يعمل المعامل نفسه في نقطة نهاية التعديل وفي أداة الصور ضمن Responses، لكن التعديلات تعيد رسم العنصر الرئيسي بدلًا من تتبع خطوطه الأصلية، لذلك ستتغير التفاصيل الدقيقة.
أين تنكسر الشفافية
تظهر ثلاث مشكلات مرارًا وتكرارًا:
الأمر النصي يغلب المعامل. إذا وصف أمرك النصي غرفة أو رفًا أو قاعدة عرض أو ظلًا ملقىً، فقد يرسمها النموذج بدلًا من ترك البكسلات فارغة. اكتب "isolated object on fully transparent alpha, no backdrop, no rectangle, no shadow."
المواد الدقيقة. ما تزال حواف الزجاج المثلج والشرائط الشفافة والشمع والألياف الشبيهة بالشعر تتفاوت من تشغيل إلى آخر، رغم أن قناة ألفا الأصلية تتعامل معها بشكل أفضل من أداة الإزالة بعد المعالجة.
فجوات المزوّدين. بعض المستضيفين والموزعين لا يمررون background. أما صفحة Cloudflare المستضافة، حين راجعتها، فقد ذكرت أن الخلفيات الشفافة غير مدعومة لهذا النموذج، وأشارت إلى GPT Image 1.5 بدلًا منه.
للحواف المطابقة للبكسل بدقة، ولِّد الصورة على خلفية سادة، ثم أنهِ العمل بأداة قص مخصصة مثل Bria Remove Background.
فحص قناة ألفا
لا تثق بملف لمجرد أن اسمه ينتهي بـ.png. قد يبدو صندوق أبيض معتم قصاصة حتى يُسقَط على شريحة داكنة. فكّ ترميز الملف واختبره:
from PIL import Image
img = Image.open("mug.png")
print(img.mode) # RGBA means an alpha channel exists
print(img.getchannel("A").getextrema()) # (0, 255) means real transparency
تعني نتيجة (255, 255) أن كل بكسل معتم بالكامل، ويجب عليك إعادة تشغيل الطلب بأمر نصي أنظف. شغّل هذا الفحص تلقائيًا قبل أي حملة كبيرة، لأن الميزة ما تزال في مرحلة المعاينة.
ميزانيات لمشاريع حقيقية
تصبح الأرقام مفيدة حين تربطها بمهمة. تستخدم هذه التقديرات أسعار الصورة القياسية أعلاه، وتتجاهل نص الأمر النصي، الذي يضيف نحو 0.50$ لكل ألف استدعاء لأمر نصي من 100 توكن.
المشروع
الإعداد
قياسي
دفعات
كتالوج منتجات، 1,000 لقطة
أفقي، متوسط
41$
نحو 20.50$
حزمة ملصقات، 500 PNG شفاف
مربع، متوسط
26.50$
نحو 13.25$
حزمة ملصقات، 500 PNG شفاف
مربع، عالٍ
105.50$
نحو 52.75$
تطبيق يُنتج 2,000 صورة يوميًا
مربع، منخفض
12$ يوميًا، نحو 360$ شهريًا
غير مناسب
تطبيق بـ2,000 صورة يوميًا
مربع، متوسط
106$ يوميًا، نحو 3,180$ شهريًا
غير مناسب
الصفان الأخيران هما التحذير. فالميزة الاستهلاكية التي تبدو رخيصة لكل صورة تتحول إلى بند شهري بأربعة أرقام حين ترتفع الجودة قليلًا.
تكلفة الصورة المحتفظ بها
نادرًا ما تنجح ورقات الملصقات ولقطات المنتجات من المحاولة الأولى. ما تدفعه فعليًا هو السعر مقسومًا على نسبة الاحتفاظ لديك. إذا رُفضت صورة واحدة من كل خمس، يرتفع المربع المتوسط من 0.053$ إلى نحو 0.066$ لكل صورة تستخدمها فعلًا. تابع نسبة الاحتفاظ لكل قالب أمر نصي، وأصلح أسوأ قالب قبل أن تمس إعداد الجودة.
حدود المعدل حسب المستوى
تهم حدود الإنتاجية بقدر أهمية السعر حين تكون المهمة كبيرة. تقيس OpenAI النموذج بالتوكنات في الدقيقة (TPM) والصور في الدقيقة (IPM):
المستوى
التوكنات في الدقيقة
الصور في الدقيقة
المستوى 1
100,000
5
المستوى 2
250,000
20
المستوى 3
800,000
50
المستوى 4
3,000,000
150
المستوى 5
8,000,000
250
على المستوى 1، يحتاج كتالوج من 1,000 صورة إلى نحو 200 دقيقة من الاستدعاءات المتواصلة. أما على المستوى 2 فتستغرق المهمة نفسها 50 دقيقة. وقد تستغرق الأوامر النصية المعقدة حتى دقيقتين لكل منها، لذا ابنِ إعادة المحاولة وطابورًا بدلًا من حلقة مشدودة.
خيارات أرخص تستحق التجربة
GPT Image 2 ليس السعر الوحيد، وهو نادرًا ما يكون الأرخص بين الخيارات التي تؤدي المهمة.
النموذج
نطاق سعر الصورة
المناسب لـ
GPT Image 2
من 0.005$ إلى 0.211$
النصوص الكثيفة، أعمال المنتجات، الشفافية
GPT Image 2.5
معدلات التوكنات نفسها لنموذج GPT Image 2
المستويات الأحدث، راجع الروابط أدناه
GPT Image 1.5
من 0.009$ إلى 0.20$
الجيل السابق، وPNG شفاف على المستضيفين الذين لا يدعمون GPT Image 2
GPT Image 1 Mini
من 0.005$ إلى 0.052$
المسودات بالجملة، أقل بنسبة 80 إلى 90% من الجودة العالية الرائدة
تسرد صفحة تسعير OpenAI GPT Image 2.5 بمعدلات التوكنات القياسية ومعدلات الدفعات نفسها لـ GPT Image 2. يتوفر GPT Image 2.5 بإصدارين على PicassoIA، هما GPT Image 2.5 Flare وGPT Image 2.5 Sunburst، لذا يمكنك مقارنتهما بـ GPT Image 2 جنبًا إلى جنب بالأمر النصي نفسه.
تشغّل PicassoIA أيضًا واجهة API خاصة بها للمطوّرين على https://api.picassoia.com/v1، مع تنبؤات على نمط Replicate (الإنشاء والاستطلاع ثم الجلب) و5 مهام متزامنة لكل حساب. ضمّت القائمة التي اطلعت عليها في 5 أكتوبر 2026 أربعة نماذج، من بينها PicassoIA Image وPicassoIA Image Editor Pro. يُستخدم GPT Image 2 نفسه من خلال تطبيق الويب. راجع شروط الخطة الحالية في صفحة الأسعار، لأن الصياغة المتعلقة بتكاليف API كانت غير متسقة عندما اطلعت عليها.
استخدام GPT Image 2 على PicassoIA
إذا أردت اختبار الأوامر النصية والإعدادات قبل أن تكتب سطرًا واحدًا من الشيفرة، فإن صفحة GPT Image 2 على PicassoIA تعرض أدوات التحكم نفسها الموجودة في API. كما تسرد إعدادات النموذج خانة اختيارية لبيانات اعتماد OpenAI. اتركها فارغة وستعمل PicassoIA كوسيط للطلب.
افتح صفحة نموذج GPT Image 2 واكتب أمرك النصي. سمِّ الشخص أو الكائن والمادة والإضاءة، وأضف "isolated object, no backdrop" للقصاصات.
اختر aspect_ratio: 1:1، 3:2، 2:3، 16:9، 9:16، أو حجمًا محددًا مثل 2048x2048 أو 3840x2160.
اضبط quality على low للمسودات، وmedium أو high للنسخ النهائية.
بدّل background إلى transparent واختر png بوصفه output_format. تضبط الصفحة افتراضيًا على WebP، وهو يحتفظ بقناة ألفا أيضًا، لكن PNG هو الخيار الأأمن لأدوات التصميم.
اضبط number_of_images بين 1 و10، ثم شغّل التوليد وحمّل الملفات.
إعدادات القصاصات النظيفة
أبقِ output_compression على قيمته الافتراضية 90 ما لم يكن حجم الملف مهمًا، واترك moderation على auto، وشغّل مسودة واحدة بجودة منخفضة قبل أن تنفق على النسخة النهائية. وإذا بدت الحواف خشنة، فارفع النتيجة إلى PicassoIA Image Editor Pro للمسة أخيرة، أو اقطع العنصر الرئيسي بأداة Bria Remove Background.
أنشئ صورك الخاصة اليوم
سعر الصورة الواحدة صغير. أما سعر الإعدادات الخاطئة حين تتكرر عشرة آلاف مرة فليس كذلك. اختر أمرًا نصيًا حقيقيًا واحدًا من مشروعك، وصيّره بجودة منخفضة ومتوسطة وعالية، ثم قارن التكلفة بما تراه فعليًا في الملف. افعل الشيء نفسه مع background="transparent" وتحقق من قناة ألفا قبل أن تثق بها.
هل أنت مستعد للتجربة؟ افتح GPT Image 2 على Picasso IA، وشغّل أول أمر نصي لك بجودة منخفضة، واحتفظ بالنتائج التي تستحق مراجعة ثانية. ثم أرسل الأمر النصي نفسه عبر نماذج 2.5 وانظر أيها يمنحك أفضل صورة مقابل كل سنت.