एक मिलियन टोकन GPT-6 Astra के API पर दस डॉलर इनपुट और पचास डॉलर आउटपुट में पड़ते हैं। यह पिछले फ़्लैगशिप की लिस्ट दर से दोगुना है। अगर आप सस्ते अपग्रेड की उम्मीद कर रहे थे, तो यह हेडलाइन नंबर चुभता है। पेच यह है कि GPT-6 की एक ही कीमत नहीं है। यह तीन टियर का परिवार है, और सबसे छोटे मॉडल की लागत सबसे बड़े मॉडल की लगभग एक प्रतिशत होती है।
यह आर्टिकल हर नंबर एक जगह रखता है: Astra, Sol और Luna की प्रति-टोकन दरें, वे सरचार्ज जो चुपचाप इनवॉइस फुलाते हैं, 100,000 असली रिक्वेस्ट की लागत, कौन सचमुच API कॉल कर सकता है, और कौन से फ्री विकल्प टिकते हैं। कीमतें अक्टूबर की शुरुआत के सार्वजनिक प्राइसिंग ट्रैकर से ली गई हैं, इसलिए इन्हें एक स्नैपशॉट मानें और बजट तय करने से पहले OpenAI के अपने प्राइसिंग पेज पर पुष्टि कर लें।
GPT-6 की प्रति टोकन कीमत
Astra को 3 सितंबर को सीमित प्रीव्यू के रूप में पेश किया गया और अगले दिन आम जनता के लिए खोला गया। Sol और Luna 22 सितंबर को आए। तीनों का कॉन्टेक्स्ट विंडो लगभग एक मिलियन टोकन है, जिसमें आउटपुट 128K टोकन तक जा सकता है, हालाँकि ट्रैकर सटीक आँकड़े पर सहमत नहीं हैं (1.05M बनाम 1.1M)।
Astra, फ़्लैगशिप की कीमत
Astra लंबे, एजेंटिक कामों के लिए बना है: कंप्यूटर यूज़, ब्राउज़र ऑटोमेशन, बड़े कोडिंग टास्क। उस महत्वाकांक्षा की कीमत आप चुकाते हैं।
| बिलिंग लाइन | प्रति 1M टोकन कीमत |
|---|
| इनपुट | $10.00 |
| कैश्ड इनपुट | $1.00 |
| आउटपुट | $50.00 |
| 272K टोकन से ऊपर इनपुट | $20.00 |
| 272K टोकन से ऊपर आउटपुट | $75.00 |
| बैच या Flex (इनपुट / आउटपुट) | $5.00 / $25.00 |
आउटपुट ही महँगा हिस्सा है। मॉडल जो टोकन लिखता है, उसकी कीमत उस टोकन से पाँच गुना होती है जिसे वह पढ़ता है। रीज़निंग-भारी मॉडल बहुत कुछ लिखते हैं, जिसमें वे थिंकिंग टोकन भी शामिल हैं जो आख़िरी जवाब में आपको कभी दिखते ही नहीं। एक शुरुआती थर्ड-पार्टी टेस्ट में एग्रीगेट बेंचमार्क पर Astra लगभग $167 प्रति पूरा टास्क आँका गया, जो दिखाता है कि एजेंटिक रन कितनी तेज़ी से जुड़ते हैं।

छोटे बजट के लिए Sol और Luna
पूरा परिवार एक साथ देखें।
| मॉडल | इनपुट | कैश्ड इनपुट | आउटपुट | कहाँ फ़िट होता है |
|---|
| GPT-6 Astra | $10.00 | $1.00 | $50.00 | एजेंट, कठिन कोडिंग, लंबे रिसर्च रन |
| GPT-6 Sol | $2.00 | $0.10 | $10.00 | रोज़ की कोडिंग, लेखन, सपोर्ट जवाब |
| GPT-6 Luna | $0.10 | $0.01 | $0.50 | रूटिंग, टैगिंग, बड़ी मात्रा में छोटे जवाब |
हर लाइन पर Sol की लागत Astra की एक-पाँचवीं है। Luna की लागत एक-सौवीं है। तीन कॉफ़ी कप सोचिए: पेय एक जैसा, बिल बहुत अलग।
टोकन दरें अमूर्त होती हैं, इसलिए यह मोटा अनुवाद देखें। एक टोकन लगभग अंग्रेज़ी शब्द का तीन-चौथाई होता है। Astra के आउटपुट का एक डॉलर लगभग 15,000 शब्द देता है, यानी लगभग 30 पेज की रिपोर्ट। उसी एक डॉलर में Sol पर लगभग 75,000 शब्द और Luna पर लगभग 15 लाख शब्द मिलते हैं। हर टियर पर पढ़ना लिखने से सस्ता है, इसीलिए किसी लंबे दस्तावेज़ का सारांश बनाना उसे ड्राफ़्ट करने से कहीं सस्ता पड़ता है।

पिछली पीढ़ी अपने आप सस्ती नहीं है। एक प्राइसिंग ट्रैकर के अनुसार, GPT 5.6 Sol की दर 21 नवंबर तक चलने वाली प्रमोशनल अवधि में $4 इनपुट और $20 आउटपुट है, जिससे उसी टियर नाम के तहत GPT-6 Sol सस्ती लाइन आइटम बन जाता है। GPT 5.6 Terra $2 और $12 पर सूचीबद्ध है, और GPT 5.6 Luna $0.20 और $1.20 पर, जो GPT-6 Luna की दर से दोगुना है।
💡 त्वरित पाठ: अगर आपके वर्कलोड को एजेंट या गहरी रीज़निंग की ज़रूरत नहीं है, तो Sol टियर नई डिफ़ॉल्ट है जिसकी कीमत पहले जाँचनी चाहिए। Astra अपवाद है, आधार नहीं।
तो Astra कब Sol की पाँच गुना कीमत के लायक है? जब एक असफल रन की लागत कीमत के अंतर से ज़्यादा हो: ऐसा एजेंट जो इंजीनियर का एक घंटा खपा दे, या कोई कानूनी ड्राफ़्ट जिसे वरना तीन संशोधन दौर चाहिए। ब्रेक-ईवन सीधा है। अगर एक अच्छे Astra नतीजे के बराबर पहुँचने में Sol को पाँच से ज़्यादा प्रयास लगें, तो कीमत के हिसाब से Astra जीतता है। अगर Sol दो-तीन में वहाँ पहुँच जाए, तो आप ज़्यादा भुगतान कर रहे हैं।
बिल फुलाने वाले सरचार्ज
लंबे प्रॉम्प्ट दर दोगुनी कर देते हैं
272K इनपुट टोकन पार करते ही पूरे रिक्वेस्ट की दोबारा प्राइसिंग होती है, सिर्फ़ अतिरिक्त टोकन की नहीं। इनपुट $10 से बढ़कर प्रति मिलियन $20 हो जाता है, और आउटपुट $50 से $75।
एक 300K-टोकन वाला कॉन्ट्रैक्ट बंडल सोचिए, जिसका जवाब 2K-टोकन का सारांश है:
- लंबे-कॉन्टेक्स्ट दर पर: इनपुट के लिए $6.00 और आउटपुट के लिए $0.15, यानी $6.15।
- 270K टोकन तक काटकर मानक दर पर: $2.70 और $0.10, यानी $2.80।
तीस हज़ार अतिरिक्त टोकन ने उसी रिक्वेस्ट की कीमत दोगुने से ज़्यादा कर दी।

💡 टिप: अपनी पाइपलाइन में टोकन काउंटर रखें और एक बड़ा प्रॉम्प्ट भेजने के बजाय बड़े दस्तावेज़ों को सीमा से ठीक नीचे बाँट दें।
फ़ास्ट मोड और रीजनल अपलिफ़्ट
दो और मल्टीप्लायर बारीक अक्षरों में छिपे हैं:
- फ़ास्ट मोड मानक दर से लगभग दोगुना लगता है (Astra पर $20 इनपुट, $100 आउटपुट), बदले में लगभग 2.5 गुना स्पीड के लिए। यह EU डेटा रेज़िडेंसी के साथ उपलब्ध नहीं है।
- डेटा-रेज़िडेंसी एंडपॉइंट आपके चुने टियर के ऊपर 10% जोड़ते हैं।
इन्हें जोड़ दें तो एक मासूम दिखने वाली Astra कॉल भी उसकी लिस्ट कीमत से दोगुने से ज़्यादा लग सकती है। फ़ैसला जानबूझकर करें, डिफ़ॉल्ट से नहीं।
फ़ास्ट मोड अपना प्रीमियम तब वसूलता है जब कोई इंसान जवाब का इंतज़ार कर रहा हो, जैसे इंटरैक्टिव कोडिंग असिस्टेंट या लाइव सपोर्ट चैट। रात भर चलने वाले उन कामों पर यह बेकार है जहाँ कोई घड़ी नहीं देखता। वे आधी कीमत वाली बैच क्यू में जाने चाहिए।
डॉलर में असली मासिक लागत
एक सपोर्ट टिकट, कीमत निकालकर
एक सपोर्ट बॉट लीजिए जहाँ हर टिकट में 2,000 इनपुट टोकन और 500 आउटपुट टोकन लगते हैं। Astra पर इसका मतलब है प्रॉम्प्ट के लिए $0.02 और जवाब के लिए $0.025, यानी प्रति टिकट $0.045। छोटी संख्या है, जब तक आप उसे गुणा न करें।

एक ही वर्कलोड, तीन टियर पर
यही टिकट महीने के 100,000 टिकटों पर:
| मॉडल | प्रति टिकट | 100,000 टिकट | बैच छूट के साथ |
|---|
| GPT-6 Astra | $0.045 | $4,500 | $2,250 |
| GPT-6 Sol | $0.009 | $900 | $450 |
| GPT-6 Luna | $0.00045 | $45 | $22.50 |
कैशिंग एक और लीवर जोड़ती है। अगर उन 2,000 इनपुट टोकन में से 1,500 हर बार एक ही सिस्टम प्रॉम्प्ट और उदाहरण हों, तो Astra प्रति टिकट $0.0315 पर आ जाता है, या महीने का $3,150। इससे गुणवत्ता पर असर डाले बिना $1,350 बचते हैं।
💡 मोटा नियम: Astra पर 500-टोकन का जवाब ($0.025) 2,000-टोकन के प्रॉम्प्ट ($0.02) से ज़्यादा लागत का है। आउटपुट की लंबाई इनवॉइस तय करती है।
सपोर्ट टिकट वर्कलोड का सिर्फ़ एक रूप है। यहाँ तीन और हैं, मानक दरों पर और बिना छूट के प्राइस किए गए, ताकि आप अपने प्रोजेक्ट के सबसे करीबी को ढूँढ सकें:
| वर्कलोड | प्रति रिक्वेस्ट टोकन | महीने के रिक्वेस्ट | Luna | Sol | Astra |
|---|
| सोलो डेवलपर चैट ऐप | 1,000 इन, 400 आउट | 5,000 | $1.50 | $30 | $150 |
| कंटेंट टीम के ड्राफ़्ट | 3,000 इन, 2,500 आउट | 300 | $0.47 | $9.30 | $46.50 |
| कोडिंग एजेंट रन | 200,000 इन, 30,000 आउट | 440 | $15.40 | $308 | $1,540 |
टेबल टोकन की कीमत बताती है, गुणवत्ता की नहीं। Luna एजेंट Astra एजेंट की बराबरी नहीं करेगा, इसलिए आख़िरी पंक्ति को सिफ़ारिश नहीं, बल्कि ऊपरी और निचली सीमा की तरह पढ़ें। ध्यान दें कि कोडिंग एजेंट बाकी सब पर कैसे भारी पड़ता है: सिर्फ़ 440 रन, फिर भी Astra पर $1,540। हर 200K प्रॉम्प्ट में से 150K कैश करने से यह लगभग $946 पर आ जाता है।
API कौन कॉल कर सकता है
API कहाँ से शुरू होता है
Astra API के फ़्री टियर पर उपलब्ध नहीं है। आपको कम से कम Tier 1 डेवलपर अकाउंट चाहिए, यानी बिलिंग सेट अप वाला पेड अकाउंट। लॉन्च पर OpenAI ने Astra के लिए विस्तृत रेट लिमिट या थ्रूपुट गारंटी प्रकाशित नहीं की थी, इसलिए एक्सेस मिलने के बाद अपने डैशबोर्ड में लिमिट्स पेज ज़रूर देखें।

ChatGPT प्लान अलग हैं
ChatGPT सब्सक्रिप्शन आपको API क्रेडिट नहीं देता। दोनों की बिलिंग अलग होती है, और सही चुनाव इस पर निर्भर है कि आप कैसे काम करते हैं। अगर आप ज़्यादातर चैट करते हैं, तो $20 वाला Plus प्लान आम तौर पर टोकन के हिसाब से भुगतान करने से सरल है। अगर आप प्रोडक्ट बना रहे हैं, तो आपको API चाहिए, चाहे आपके पास कोई भी प्लान हो, क्योंकि ग्राहक आपका निजी सब्सक्रिप्शन इस्तेमाल नहीं कर सकते। ऐप के अंदर Astra एक्सेस ऐसा दिखता है:
| प्लान | मासिक कीमत | Astra एक्सेस |
|---|
| Free | $0 | नहीं |
| Go | $8 | नहीं |
| Plus | $20 | हाँ |
| Pro | $100 से | हाँ, बढ़ी हुई लिमिट्स के साथ |
| Enterprise | प्रति सीट | हाँ, डिफ़ॉल्ट रूप से बंद |
यह लिखे जाने तक Luna अभी मुफ़्त ChatGPT यूज़र्स तक नहीं पहुँचा था, इसलिए ऐप के भीतर सबसे सस्ता टियर भी मुफ़्त नहीं है।
अपनी पहली API कॉल से पहले यह छोटी सूची देख लें:
- बिलिंग तरीका जोड़ें और एक छोटा प्रीपेड बैलेंस रखें।
- कोई कोड लिखने से पहले डैशबोर्ड में मासिक स्पेंड कैप सेट करें।
- प्रोजेक्ट-स्कोप्ड API क्रेडेंशियल बनाएँ और उसे एनवायरनमेंट वेरिएबल में रखें, कभी रिपॉज़िटरी में नहीं।
- डेवलपमेंट में Luna पर बनाएँ, फिर पाइपलाइन चलने के बाद मॉडल का नाम बदलें।
- हर रिक्वेस्ट के लिए इनपुट, कैश्ड और आउटपुट टोकन की गिनती लॉग करें, ताकि बिल कभी चौंकाए नहीं।
असल में काम करने वाले फ़्री विकल्प
Astra का फ़्री टियर क्यों नहीं है
Astra के लिए कोई ट्रायल आवंटन प्रकाशित नहीं हुआ है, और $50 प्रति मिलियन आउटपुट टोकन पर यह हैरानी की बात नहीं है। एक लंबा एजेंटिक रन किसी भी वास्तविक फ़्री क्रेडिट को मिनटों में खत्म कर देगा।

जहाँ फ़्री उपयोग अब भी मौजूद है
बड़े बिल के बिना विचारों को परखने के असली रास्ते अब भी हैं:
- सस्ते शुरुआती बिंदु के रूप में Luna। पाँच डॉलर का क्रेडिट लगभग 50 मिलियन इनपुट टोकन या 10 मिलियन आउटपुट टोकन देता है। यह हज़ारों छोटी बातचीत के बराबर है।
- ओपन-वेट्स मॉडल। GPT OSS 120B और GPT OSS 20B OpenAI के ओपन-वेट्स रिलीज़ हैं। अगर आपके पास हार्डवेयर है, तो उन्हें खुद चलाने में कोई प्रति-टोकन फ़ीस नहीं लगती।
- ब्राउज़र में प्रतिस्पर्धी मॉडल। खर्च करने की जगह तय करने से पहले Claude Sonnet 5, Gemini 3.5 Flash या GPT 5.4 को अपने असली प्रॉम्प्ट के साथ आज़माएँ।
एक व्यावहारिक फ़्री वर्कफ़्लो कुछ ऐसा दिखता है। ब्राउज़र में प्रॉम्प्ट तब तक प्रोटोटाइप करें जब तक जवाब अच्छे न आने लगें, फिर उसे लॉक करें, और एक सामान्य रिक्वेस्ट के टोकन गिनें। एक फ़ॉर्मूले से खुद कीमत निकालें: (इनपुट टोकन x इनपुट दर + आउटपुट टोकन x आउटपुट दर) / 1,000,000। इसे Luna, Sol और Astra के लिए चलाएँ, और किसी भी पेड कॉल से पहले आपको अपनी असली मासिक रेंज पता होगी।
PicassoIA पर GPT 5.6 Sol आज़माएँ
एक ईमानदार नोट: GPT-6 खुद अभी PicassoIA के मॉडल लिस्ट में नहीं है। सबसे नज़दीकी रिश्तेदार GPT 5.6 परिवार है: GPT 5.6 Sol, GPT 5.6 Terra और GPT 5.6 Luna। Sol बिना सेटअप के ऑनलाइन मुफ़्त आज़माया जा सकता है, जो API बजट खर्च करने से पहले एक सस्ता रिहर्सल बन जाता है।
PicassoIA पर चरण-दर-चरण
- GPT 5.6 Sol पेज खोलें।
- अपने प्रोडक्ट का कोई असली टास्क Prompt में चिपकाएँ, "hello" नहीं।
- भूमिका और लहज़ा तय करने के लिए System Prompt जोड़ें।
- none से xhigh तक Reasoning effort चुनें। none से शुरू करें और तभी बढ़ाएँ जब जवाब उथले लगें।
- Verbosity को low, medium या high पर सेट करें।
- अगर आप ऊँचा रीज़निंग लेवल चुनते हैं तो Max Completion Tokens बढ़ाएँ, वरना थिंकिंग पूरा बजट खा सकती है और जवाब खाली रह सकता है।
- अगर टास्क को उसकी ज़रूरत है, तो Image Input में स्क्रीनशॉट या डायग्राम अपलोड करें।
- चलाएँ, फिर वही प्रॉम्प्ट GPT 5.6 Luna पर दोहराएँ और गुणवत्ता और कीमत की तुलना करें।

लागत बदलने वाली सेटिंग्स
रीज़निंग मॉडल पर रीज़निंग टोकन आउटपुट टोकन की तरह बिल होते हैं, इसलिए उस पेज के डायल सीधे इनवॉइस पर असर डालते हैं:
| सेटिंग | यह क्या करती है | लागत पर असर |
|---|
| रीज़निंग एफ़र्ट: none या low | तेज़ जवाब, कम सोच-विचार | सबसे कम |
| रीज़निंग एफ़र्ट: high या xhigh | गहरे, धीमे जवाब | ज़्यादा आउटपुट टोकन |
| वर्बोसिटी: low | छोटे, सीधे जवाब | कम आउटपुट टोकन |
| Max Completion Tokens | जवाब की लंबाई पर सख़्त सीमा | हर रिक्वेस्ट के लिए अधिकतम सीमा |
बिल घटाने के तरीके

कठिनाई के हिसाब से रूट करें
आसान काम Luna को, मध्यम काम Sol को, और सिर्फ़ सबसे कठिन 5% Astra को भेजें। 80% Luna, 15% Sol और 5% Astra के काल्पनिक बँटवारे पर, 100,000-टिकट वाला वर्कलोड लगभग $396 का पड़ता है, $4,500 की जगह।
कैश और बैच
कैश्ड इनपुट Astra और Luna पर 90% सस्ता है, और Sol पर 95% सस्ता। बैच और Flex प्रोसेसिंग उन सभी कामों पर मानक दर को आधा कर देती है जो इंतज़ार कर सकते हैं।

आउटपुट सीमित करें
अधिकतम टोकन सीमा सेट करें और बुलेट्स या कॉम्पैक्ट JSON जैसे छोटे फ़ॉर्मेट माँगें। आउटपुट इनपुट से पाँच गुना कीमत का होने पर, हर छोड़ा गया वाक्य बचाया गया पैसा है।
बिल फुलाने वाली तीन गलतियाँ:
- हर टर्न पर पूरी चैट दोबारा भेजना। 10 टर्न की बातचीत, जिसमें हर टर्न 300 टोकन जोड़ता है, कुल 3,000 नहीं बल्कि 16,500 इनपुट टोकन भेजती है। पुराने टर्न का सारांश बनाएँ या साझा प्रीफ़िक्स कैश करें।
- आसान कामों पर रीज़निंग को high पर छोड़ना। थिंकिंग टोकन आउटपुट की तरह बिल होते हैं, जो रेट कार्ड की महँगी तरफ़ है।
- फ़्लैगशिप पर टेस्टिंग। Luna पर बनाएँ और डीबग करें, फिर अंतिम रन के लिए मॉडल का नाम बदलें।
💡 चेकलिस्ट: कठिनाई के हिसाब से रूट करें, दोहराया गया प्रीफ़िक्स कैश करें, जो इंतज़ार कर सके उसे बैच करें, जवाब की लंबाई सीमित करें, और कीमतें हर महीने दोबारा जाँचें, क्योंकि टियर और प्रमोशन बदलते रहते हैं।
अब आपकी बारी, बनाएँ
टेक्स्ट प्रोडक्ट बजट का सिर्फ़ आधा है। ज़्यादातर लॉन्च को तस्वीरें भी चाहिए: हीरो शॉट, थंबनेल, प्रोडक्ट मॉकअप। Picasso IA के साथ अपनी इमेज बनाकर देखें कि एक प्रॉम्प्ट कितनी दूर तक जा सकता है। Seedream 4.5 शार्प 4K डिटेल के लिए शानदार है, P-Image ड्राफ़्ट के लिए तेज़ है, और GPT Image 2 लंबे प्रॉम्प्ट को करीब से फ़ॉलो करता है।
अपने प्रोजेक्ट से एक सीन चुनें, अलग कैमरा एंगल वाले तीन प्रॉम्प्ट लिखें, और उन्हें साथ-साथ चलाएँ। पूरी कैटलॉग picassoia.com/en/all-models पर देखें और आज ही प्रयोग शुरू करें।