AI API को उसकी हेडलाइन कीमत देखकर चुनना ही बजट बिगाड़ने का सबसे आम तरीका है। प्रति टोकन कम दर का कोई मतलब नहीं, अगर आपका वर्कलोड दस गुना ज़्यादा टोकन खर्च करता है। और सस्ती प्रति-सेकंड वीडियो कीमत भी तेज़ी से बदल जाती है, जब आप 1080p, ऑडियो और कुछ रीट्राई जोड़ देते हैं। यह AI API कीमत तुलना लैंग्वेज मॉडल, इमेज जेनरेटर, वीडियो मॉडल और टेक्स्ट-टू-स्पीच की असली लिस्ट कीमतों को एक साथ रखती है, फिर उन्हें मासिक बिल में बदलती है, ताकि आप उन्हें अपने वर्कलोड से मिला सकें।
संक्षेप में: LLM कीमतें सबसे सस्ते टियर से सबसे महँगे टियर तक 100x की रेंज में फैली हैं, एक ही इमेज मॉडल अपने कम और ज़्यादा क्वालिटी सेटिंग के बीच 35x तक बदल जाता है, वीडियो $0.02 से $0.60 प्रति सेकंड तक है, और वॉइस प्रति 1,000 कैरेक्टर आधा सेंट से दस सेंट तक जाती है। नीचे दी गई दरें अक्टूबर 2026 में प्रोवाइडर के रेट कार्ड और सार्वजनिक प्राइसिंग ट्रैकर से जाँची गई थीं। हर आँकड़े को एक स्नैपशॉट मानें और बजट तय करने से पहले प्रोवाइडर के अपने पेज पर उसकी पुष्टि करें।

API बिलिंग असल में कैसे काम करती है
चार मोडैलिटी, चार अलग-अलग मीटर। इन्हें आपस में मिला देना ही वह सबसे आम वजह है जिससे "सस्ता" API महँगा पड़ जाता है।
चार यूनिट, चार झटके
- LLM प्रति मिलियन टोकन के हिसाब से बिल होते हैं। आउटपुट टोकन की कीमत इनपुट टोकन से लगभग 5 से 6 गुना ज़्यादा होती है, इसलिए लंबे जवाब बिल बढ़ाते हैं, लंबे प्रॉम्प्ट नहीं।
- इमेज प्रति तस्वीर, प्रति मेगापिक्सल या प्रति टोकन के हिसाब से बिल होती हैं। क्वालिटी और रेज़ोल्यूशन सेटिंग उसी मॉडल पर कीमत को 35x तक बढ़ा सकती हैं।
- वीडियो आउटपुट के प्रति सेकंड के हिसाब से बिल होता है। रेज़ोल्यूशन टियर और ऑडियो दर बदल देते हैं, और कुछ मॉडल प्रति टोकन बिल करते हैं, इसलिए कोई भी प्रति-सेकंड आँकड़ा सिर्फ़ एक अनुमान है।
- वॉइस प्रति 1,000 कैरेक्टर या जनरेट हुए ऑडियो के प्रति सेकंड के हिसाब से बिल होता है। यह सबसे सस्ती श्रेणी है, लेकिन मॉडल टियर फिर भी लागत को 20x तक बदल देता है।
छूट जो सचमुच मौजूद हैं
लगभग हर प्रोवाइडर में चार लीवर दिखते हैं:
- बैच प्रोसेसिंग उन कामों के लिए टोकन कीमतों को 50% घटा देती है जो इंतज़ार कर सकते हैं। Anthropic इसे साफ़ तौर पर दस्तावेज़ित करता है, और OpenAI भी वही आधी कीमत देता है।
- प्रॉम्प्ट कैशिंग दोहराए गए कॉन्टेक्स्ट का बिल सामान्य इनपुट कीमत के लगभग 10% पर करती है। Claude Opus 5.5 और Claude Sonnet 5.5 पर कैश रीड घटकर 5% हो जाता है, और Claude Fable 5.1 पर 2.5% तक।
- प्रमोशनल विंडो असली होती हैं, पर अस्थायी होती हैं। GPT 5.6 Sol कम से कम 21 नवंबर 2026 तक $4 इनपुट और $20 आउटपुट पर है, और ElevenLabs v4 पर 72% की छूट है जो 12 अक्टूबर को खत्म होती है। बजट नियमित कीमत पर बनाएँ।
- डेटा रेज़िडेंसी इसके उलट काम करती है। Claude इनफ़रेंस को US तक सीमित करने से हर टोकन श्रेणी पर 1.1x का मल्टीप्लायर जुड़ जाता है।

LLM API कीमतें एक नज़र में
लैंग्वेज मॉडल में यहाँ किसी भी श्रेणी से ज़्यादा कीमत-अंतर है, और बाज़ार का बीच का हिस्सा चुपचाप एक ही स्तर पर आ गया है।
रेट कार्ड
कीमतें USD प्रति मिलियन टोकन में हैं, स्टैंडर्ड, गैर-बैच दरों पर।
Anthropic और Google के आँकड़े उनके अपने प्राइसिंग पेज से लिए गए हैं। OpenAI के आँकड़े सार्वजनिक ट्रैकर से लिए गए हैं, क्योंकि जब मैंने जाँच की तब OpenAI का पेज पढ़ने लायक नहीं था, इसलिए पूर्वानुमान बनाने से पहले इन्हें ज़रूर जाँचें।
💡 सबसे पहले आउटपुट कीमतों की तुलना करें। तीन मिड-टियर मॉडल का इनपुट रेट एक ही $2 है, इसलिए असली अंतर आउटपुट में है: Sonnet 5 के लिए $10, Terra और Gemini 3.1 Pro के लिए $12। चैट-भारी वर्कलोड पर यह 20% का फ़र्क इनपुट रेट से ज़्यादा मायने रखता है।
एक सपोर्ट बॉट की लागत
एक छोटा सपोर्ट असिस्टेंट लीजिए जो हर महीने 10 मिलियन इनपुट टोकन भेजता है और 2 मिलियन आउटपुट टोकन पाता है।
| मॉडल | मासिक लागत |
|---|
| Claude Haiku 5.5 | $2.00 |
| GPT 5.6 Luna | $4.40 |
| Gemini 3.5 Flash | $33.00 |
| Claude Sonnet 5.5 | $40.00 |
| GPT 5.6 Terra | $44.00 |
| Gemini 3.1 Pro | $44.00 |
| GPT 5.6 Sol | $80.00 |
| Claude Opus 5.5 | $80.00 |
| Claude Fable 5.1 | $200.00 |
एक ही ट्रैफ़िक पर सबसे सस्ते और सबसे महँगे विकल्प में ठीक 100x का फ़र्क है। ज़्यादातर सपोर्ट सवालों को फ्रंटियर मॉडल की ज़रूरत नहीं होती, इसलिए रोज़मर्रा के टिकट छोटे टियर पर भेजें और सिर्फ़ कठिन टिकट ऊपर भेजें।
कैशिंग तस्वीर फिर से बदल देती है। अगर उन इनपुट टोकन के 80% दोहराए गए निर्देश हैं और वे Sonnet 5.5 की $0.10 प्रति मिलियन रीड दर पर कैश से आते हैं, तो इनपुट खर्च $20 से घटकर लगभग $4.80 रह जाता है और कुल $40 से घटकर लगभग $25 हो जाता है, कैश राइट की एक-बारगी लागत से पहले। बैच प्राइसिंग इसके ऊपर जुड़ती है, इसलिए रात भर चलने वाला काम लगभग $12 पर आ जाता है।

प्रति तस्वीर इमेज जनरेशन की लागत
इमेज API सस्ते लगते हैं, जब तक आप यह न देखें कि एक ही मॉडल के नाम के पीछे कितनी क्वालिटी सेटिंग छिपी हैं।
प्रति इमेज कीमत तालिका
| मॉडल | प्रति इमेज कीमत | नोट्स |
|---|
| GPT Image 2 | $0.006 low, $0.053 medium, $0.211 high | 1024x1024 की लिस्ट कीमतें |
| Nano Banana 2 | 1K पर $0.0336, 2K पर $0.0504, 4K पर $0.113 | Google ने 2.1 अपडेट के लिए ये दरें दी हैं |
| Seedream 5 Pro | लगभग $0.035 | ट्रैकर का अनुमान |
| FLUX.2 pro | लगभग $0.03 प्रति मेगापिक्सल | ट्रैकर का अनुमान |
| Nano Banana 2 Lite | लगभग $0.01 | ट्रैकर का अनुमान |
क्वालिटी टियर का जाल
महीने में 1,000 इमेज बनाएँ तो वही OpenAI मॉडल कम क्वालिटी पर $6, मीडियम पर $53 और हाई पर $211 लगता है। Nano Banana 2 2K पर लगभग $50 पर आता है, Seedream 5 Pro लगभग $35 पर, और Nano Banana 2 Lite लगभग $10 पर। जो सेटिंग आप डिफ़ॉल्ट पर छोड़ देते हैं, वह बिल को उस मॉडल से ज़्यादा तय करती है जो आप चुनते हैं।
रीसेलर एक और परत जोड़ते हैं। एक गेटवे ने हर टियर पर GPT Image 2 को OpenAI की दर से ठीक दोगुनी कीमत पर लिस्ट किया, जिससे आउटपुट में कोई बदलाव न होने पर भी $211 का काम $422 का बन जाता है।
💡 कम क्वालिटी पर ड्राफ़्ट, हाई पर फ़ाइनल। सबसे सस्ते टियर पर कॉन्सेप्ट बनाएँ, विजेता चुनें, फिर सिर्फ़ उन्हें पूरी क्वालिटी पर दोबारा रेंडर करें। हाई क्वालिटी पर 10% फ़ाइनलिस्ट रेट भी हर चीज़ हाई पर रेंडर करने से कहीं सस्ता पड़ता है।

प्रति सेकंड वीडियो API कीमत
वीडियो में गलत अनुमान असली पैसा खर्च करवाता है, क्योंकि हर सेकंड का बिल बनता है और हर रीट्राई पूरी कीमत दोबारा लेता है।
ऑडियो के साथ रेट कार्ड
Veo, Grok और P Video की दरें उनके निर्माताओं ने प्रकाशित की हैं। Kling और HappyHorse के आँकड़े युआन से बदले गए हैं, इसलिए मुद्रा के राउंडिंग का असर है।
100 क्लिप की लागत
मान लीजिए 720p पर 8 सेकंड की 100 क्लिप, यानी 800 सेकंड का फ़ुटेज।
- P Video: $16
- Veo 3.1 Lite: $40
- Grok Imagine Video 1.5: $64
- Veo 3.1 Fast: $80
- Kling 3.0 Turbo: $88
- HappyHorse: $100
- Veo 3.1: $320
ये कुल योग मानते हैं कि हर क्लिप काम की है। 30% कीप रेट पर 100 अच्छी क्लिप पाने के लिए लगभग 333 जनरेशन चाहिए, इसलिए Veo 3.1 Fast की लाइन $80 से बढ़कर लगभग $267 हो जाती है।
इन आँकड़ों के पीछे तीन जाल छिपे हैं। Seedance 2.0 और उसका Fast वर्ज़न प्रति टोकन बिल करते हैं, इसलिए प्रति-सेकंड कीमतें अनुमान हैं, और रीसेलर लगभग $0.09 से $0.25 तक कुछ भी कोट करते हैं। 4K पर जाने से लागत 1.5x से 3x गुना हो जाती है। और रीसेलर अक्सर आधिकारिक दरों से 2x से 3x ऊपर चार्ज करते हैं।
💡 बजट बनाने से पहले उपलब्धता जाँचें। OpenAI का Sora 2 API 24 सितंबर 2026 को बंद होने वाला था। Sora 2 अब भी मॉडल कैटलॉग में दिखता है, इसलिए उस पर पाइपलाइन बनाने से पहले जाँच लें कि वह कहाँ चलता है।

वॉइस और स्पीच की कीमत
स्पीच सबसे सस्ती मोडैलिटी है, इसलिए आम तौर पर क्वालिटी और भाषा सपोर्ट कीमत से ज़्यादा मायने रखते हैं।
प्रति 1,000 कैरेक्टर तुलना
दस मिनट की नैरेशन में लगभग 9,000 कैरेक्टर होते हैं। इसकी लागत Inworld के Max टियर पर लगभग $0.09, Gemini Flash TTS पर $0.14, ElevenLabs Flash पर $0.36, MiniMax Turbo पर $0.54, ElevenLabs v3 पर $0.72 और MiniMax HD पर $0.90 है। ऐसी सौ नैरेशन सबसे महँगे विकल्प पर कुल $90 होती हैं। ऑडियो-टोकन बिलिंग और प्रति-कैरेक्टर बिलिंग पूरी तरह एक-दूसरे में नहीं बदलतीं, इसलिए अपनी स्क्रिप्ट की लंबाई से टेस्ट करें।
ElevenLabs v4 की सूची कीमत प्रति 1,000 कैरेक्टर $0.08 है और v4 Turbo की $0.04, साथ ही 72% का लॉन्च डिस्काउंट है जो 12 अक्टूबर को खत्म होता है। Inworld के आँकड़े उसकी पिछली TTS-1 लाइन से हैं, इसलिए उन पर भरोसा करने से पहले 1.5 मॉडल जाँच लें।

छिपी लागतें जो बजट बिगाड़ती हैं
लिस्ट कीमतें न्यूनतम स्तर हैं, पूर्वानुमान नहीं।
रीट्राई, सीमाएँ और लंबे आउटपुट
- अस्वीकृत आउटपुट। अगर 20% जनरेशन फेंक दी जाती हैं, तो आपकी असरदार कीमत 25% बढ़ जाती है, क्योंकि चार नतीजों के लिए आपको पाँच रन का पैसा देना पड़ता है।
- आउटपुट की लंबाई। आउटपुट टोकन इनपुट से 5 से 6 गुना महँगे होते हैं, और रीज़निंग टोकन आउटपुट में गिने जाते हैं। कोई "थिंकिंग" मॉडल दिखने वाले जवाब के लंबा हुए बिना भी बिल बढ़ा सकता है।
- कंकरेंसी कैप। PicassoIA का API प्रति अकाउंट एक समय में 5 प्रेडिक्शन चलने देता है, और कई प्रोवाइडर खर्च टियर के हिसाब से सीमाएँ बढ़ाते हैं। कतार में इंतज़ार करने से इंजीनियरों का समय जाता है।
- रीसेलर मार्कअप। गेटवे एक बिल और एक इंटीग्रेशन के बदले आधिकारिक दरों से 2x से 3x तक चार्ज कर सकते हैं।

बचत कहाँ है
- कठिनाई के हिसाब से रूट करें। आसान अनुरोध सबसे सस्ते टियर पर भेजें और सिर्फ़ विफल होने पर ऊपर भेजें।
- जो इंतज़ार कर सकता है उसे बैच करें। टोकन पर आधी कीमत उपलब्ध सबसे बड़ी अकेली छूट है।
- स्थिर कॉन्टेक्स्ट कैश करें। सिस्टम प्रॉम्प्ट, ब्रांड स्टाइल शीट और रेफ़रेंस दस्तावेज़ इसके लिए आदर्श हैं।
- प्रयोग के दौरान रेज़ोल्यूशन घटाएँ। ड्राफ़्ट के लिए 720p वीडियो और कम क्वालिटी की इमेज काफ़ी हैं।
- आउटपुट की लंबाई सीमित करें। अधिकतम टोकन सीमा बेकाबू जनरेशन को रोकती है।
ये लीवर एक-दूसरे के असर को और बढ़ा देते हैं। जो टीम ज़्यादातर टिकट छोटे मॉडल पर भेजती है, अपने निर्देश कैश करती है और रात की रिपोर्ट बैच करती है, वह वही आउटपुट लिस्ट कीमत के एक हिस्से में पा सकती है। जबकि जो टीम हर डिफ़ॉल्ट चालू रखती है, वह हर चीज़ के लिए पूरी दर चुकाती है।

PicassoIA पर कीमतें टेस्ट करें
रेट कार्ड पढ़कर पता चलता है कि कोई मॉडल कितना खर्च करता है। उसे चलाकर पता चलता है कि आउटपुट उस खर्च के लायक है या नहीं। PicassoIA पर 120 से ज़्यादा वीडियो मॉडल, 75 लैंग्वेज मॉडल और 24 स्पीच मॉडल होस्ट हैं, साथ ही इमेज का एक विस्तृत कैटलॉग भी है, ताकि प्रोडक्शन के लिए चुनने से पहले आप टियर की तुलना साथ-साथ कर सकें।
एक ही प्रॉम्प्ट दो बार चलाएँ
- एक ही श्रेणी के दो मॉडल चुनें, जैसे Seedream 5 Pro और FLUX.2 pro।
- हर मॉडल का पेज खोलें और अपने असली वर्कलोड से एक जैसा प्रॉम्प्ट डालें।
- सेटिंग मिलाएँ: आस्पेक्ट रेशियो, रेज़ोल्यूशन और क्वालिटी।
- नतीजों की पूरे आकार पर तुलना करें, फिर नोट करें कि आप असल में किसे प्रकाशित करेंगे।
- प्रोवाइडर की प्रति-यूनिट कीमत को अपने कीप रेट से भाग दें। जो मॉडल प्रति कीपर लागत में जीतता है, वही आपका असली विकल्प है।
API से ऑटोमेट करें
PicassoIA https://api.picassoia.com/v1 पर एक डेवलपर API भी देता है, जिसे ऐसे Bearer टोकन से प्रमाणित किया जाता है जो pia_sk_ से शुरू होता है। जॉब असिंक्रोनस होते हैं: आप एक प्रेडिक्शन बनाते हैं, उसका स्टेटस पोल करते हैं और नतीजा लेते हैं।
| एंडपॉइंट | उद्देश्य |
|---|
POST /v1/models/{owner}/{name}/predictions | प्रेडिक्शन बनाएँ |
GET /v1/predictions/{id} | स्टेटस जाँचें और आउटपुट लाएँ |
POST /v1/predictions/{id}/cancel | चलता हुआ जॉब रद्द करें |
GET /v1/predictions | हाल के प्रेडिक्शन की सूची देखें |
चार मॉडल API के ज़रिए उपलब्ध हैं: PicassoIA Image, PicassoIA Image Editor Pro, PicassoIA Video और Seedance 2.5 Lite। दस्तावेज़ में अभी लिखा है कि API प्रेडिक्शन मुफ़्त हैं और कोई क्रेडिट नहीं लेते, और इसके लिए Infinite प्लान ज़रूरी है। योजना बनाने से पहले API पेज पर दोनों बातों की पुष्टि करें, क्योंकि प्लान की शर्तें बदल सकती हैं।
अपना प्राइस टेस्ट चलाएँ
सबसे अच्छा AI API वह है जो आपको ऐसे दाम पर प्रकाशित करने लायक नतीजे दे जिसे आपकी मात्रा सह सके, और यह सिर्फ़ आपके अपने प्रॉम्प्ट बता सकते हैं कि वह कौन सा है। हर श्रेणी से एक असली काम लें, उसे एक सस्ते टियर और एक प्रीमियम टियर पर चलाएँ, और प्रति कीपर लागत लिख लें। पाँच मिनट का टेस्ट रेट कार्ड पढ़ने के एक दोपहर से बेहतर है।
Picasso IA ये मॉडल एक ही जगह पर रखता है, ताकि आप हर प्रोवाइडर के लिए अलग अकाउंट खोले बिना इमेज, वीडियो, वॉइस और टेक्स्ट जनरेट कर सकें। अपने प्रोजेक्ट के किसी प्रॉम्प्ट से शुरुआत करें, फिर GPT Image 2 को PicassoIA Image के बगल में आज़माएँ और देखें कि कौन सा नतीजा आप सच में भेजेंगे। जब आप और विकल्पों की तुलना करने के लिए तैयार हों, तो सभी मॉडल पेज पर हर विकल्प ब्राउज़ करें।
