Claude API Pricing बनाम सब्सक्रिप्शन: प्रति टोकन लागत समझाई गई

Claude API हर इनपुट और आउटपुट टोकन पर शुल्क लेता है, जबकि Claude Pro और Max एक फ़्लैट मासिक फ़ीस लेते हैं। यह लेख Haiku, Sonnet, Opus और Fable के प्रति टोकन रेट की तुलना करता है, असली प्रति अनुरोध लागत दिखाता है, और हल्की चैट, कोडिंग एजेंट और टीमों के लिए ब्रेक-ईवन बिंदु खोजता है।

Claude API Pricing बनाम सब्सक्रिप्शन: प्रति टोकन लागत समझाई गई
Cristian Da Conceicao
Picasso IA के संस्थापक

Claude के दो प्राइस टैग हैं, और दोनों एक ही चीज़ नहीं मापते। API आपके भेजे और पाए हर टोकन पर शुल्क लेता है। Claude सब्सक्रिप्शन चैट और कोडिंग के सीमित समय के लिए एक फ़्लैट मासिक फ़ीस लेता है। गलत चुनें तो या तो ऐसे टोकन का पैसा देंगे जिन्हें आप मुश्किल से इस्तेमाल करते हैं, या डेडलाइन के बीच में उपयोग की सीमा पर अटक जाएँगे। यह लेख October 2026 तक Anthropic की प्रकाशित दरों के आधार पर दोनों पक्षों के असली आँकड़े रखता है, ताकि आप देख सकें कि प्रति-टोकन मीटर कहाँ जीतता है और फ़्लैट प्लान कहाँ आगे निकलता है।

एक डेवलपर कैफ़े की खिड़की वाली मेज़ पर लैपटॉप पर टाइप करते हुए, बगल में लैटे और नोटबुक

प्रति टोकन बिलिंग कैसे काम करती है

हर API अनुरोध मापा जाता है। आप अंदर जाने वाले टेक्स्ट, बाहर आने वाले टेक्स्ट और कुछ वैकल्पिक अतिरिक्त चीज़ों के लिए भुगतान करते हैं, जिन सबको टोकन में मापा जाता है। कीमतें प्रति दस लाख टोकन में बताई जाती हैं, जिसे MTok लिखते हैं, इसलिए $2 / MTok का मतलब है हर दस लाख टोकन के लिए $2। कोई मासिक फ़ीस नहीं, कोई सीट गिनती नहीं, और कोई सीमा नहीं: बिल ट्रैफ़िक के हिसाब से चलता है।

टोकन में क्या गिना जाता है

एक टोकन टेक्स्ट का एक टुकड़ा है, आमतौर पर एक छोटा शब्द या किसी लंबे शब्द का हिस्सा। Anthropic का अनुमानित नियम है अंग्रेज़ी में प्रति टोकन लगभग 4 कैरेक्टर या 0.75 शब्द, तो 2,500 शब्दों का लेख लगभग 3,300 टोकन होगा। कोड, गैर-अंग्रेज़ी टेक्स्ट और भारी फ़ॉर्मैटिंग में आमतौर पर ज़्यादा टोकन लगते हैं।

सादे लकड़ी के क्यूब्स को गहरे अखरोट की मेज़ पर छोटे समूहों में छाँटा जाता हुआ

पुराने और नए रेट कार्ड की तुलना करते समय एक बात मायने रखती है। Claude 4.7 और उसके बाद के मॉडल एक नया टोकनाइज़र इस्तेमाल करते हैं, जो Sonnet 4.6 और उससे पहले के मॉडलों की तुलना में वही टेक्स्ट के लिए लगभग 30% ज़्यादा टोकन बनाता है। अगर आपका प्रॉम्प्ट अब ज़्यादा टोकन में बँटता है, तो प्रति टोकन कम कीमत का मतलब हमेशा कम बिल नहीं होता।

आउटपुट महँगा क्यों है

मौजूदा लाइनअप में आउटपुट टोकन इनपुट टोकन से पाँच गुना महँगे हैं। Sonnet 5.5 प्रति दस लाख इनपुट टोकन $2 और प्रति दस लाख आउटपुट टोकन $10 लेता है। Opus 5.5 के लिए $4 और $20 है। टेक्स्ट जनरेट करना महँगा कदम है, जबकि प्रॉम्प्ट पढ़ना सस्ता है।

यही अनुपात तय करता है कि आप पैसे कैसे बचाते हैं। भेजे गए लंबे दस्तावेज़ कम लागत लगाते हैं। वापस आने वाले लंबे जवाब बहुत लागत लगाते हैं। तीन बुलेट पॉइंट माँगने वाला प्रॉम्प्ट उस प्रॉम्प्ट से सस्ता है जो 2,000 शब्दों के निबंध को न्योता देता है।

चैट हिस्ट्री बिल कैसे बढ़ाती है

API स्टेटलेस है, इसलिए हर नए टर्न में पूरी बातचीत दोबारा भेजी जाती है, और उस पूरे हिस्से का पैसा आपको इनपुट के रूप में फिर से देना पड़ता है। सोचिए एक ऐसी चैट जिसमें आप 500 टोकन लिखते हैं और मॉडल दस टर्न तक हर बार 500 टोकन में जवाब देता है। आपने सिर्फ़ 5,000 टोकन नया टेक्स्ट लिखा है, फिर भी इनपुट मीटर दस कॉल्स में मिलाकर 50,000 टोकन दिखाता है, क्योंकि टर्न 10 में टर्न 1 से 9 तक का सब कुछ फिर से भेजा जाता है।

Sonnet 5.5 पर यह बातचीत इनपुट के लिए $0.10 और 5,000 आउटपुट टोकन के लिए $0.05 लगाती है, यानी कुल $0.15। अकेले में यह छोटी रकम है। इसे रोज़ की सौ बातचीत से गुणा करें, तो हिस्ट्री इनवॉइस की सबसे बड़ी मद बन जाती है, और ठीक यहीं कैशिंग मदद करती है।

भूरे काउंटर पर ब्रास कैश रजिस्टर से लंबी कागज़ की रसीद खुलती हुई

मॉडल के अनुसार Claude API कीमतें

मौजूदा प्रति दस लाख टोकन दरें

ये Anthropic के प्राइसिंग पेज की दरें हैं, अमेरिकी डॉलर में प्रति दस लाख टोकन। आख़िरी कॉलम प्रॉम्प्ट कैश रीड की कीमत है, यानी वह टेक्स्ट दोबारा भेजने का सबसे सस्ता तरीका जो आप पहले भेज चुके हैं।

एक मेज़ का ऊपर से दृश्य, जिस पर खुला लेजर, कैलकुलेटर और कागज़ की रसीदें हैं

मॉडलइनपुटआउटपुटकैश रीड
Claude Haiku 5.5 (100K टोकन तक के प्रॉम्प्ट)$0.10$0.50$0.01
Claude Haiku 4.5$1$5$0.10
Claude Sonnet 5.5$2$10$0.10
Claude Sonnet 4.6$3$15$0.30
Claude Opus 5.5$4$20$0.20
Claude Fable 5.1$10$50$0.25

Haiku 5.5 की कीमत प्रॉम्प्ट की लंबाई से तय होती है: 100,000 टोकन से ज़्यादा के प्रॉम्प्ट पर $0.50 इनपुट और $2.50 आउटपुट लगता है।

💡 नया हमेशा महँगा नहीं होता। Opus 5.5 की $4 / $20 कीमत Opus 5 और Opus 4.8 पीढ़ी की $5 / $25 से सस्ती है, और Sonnet 5.5 की $2 / $10 कीमत Claude Sonnet 4.6 की $3 / $15 से सस्ती है। यह मान लेने से पहले कि बड़ी संख्या नए मॉडल की ही होगी, रेट कार्ड देखें।

एक अनुरोध की असली लागत

एक सामान्य अनुरोध लें: 3,000 इनपुट टोकन (एक सिस्टम प्रॉम्प्ट और चिपकाया गया दस्तावेज़) और 800 आउटपुट टोकन (एक ठोस जवाब)। यहाँ हर अनुरोध और हर हज़ार अनुरोधों की गणना है, हर पंक्ति पर एक ही टोकन गिनती का इस्तेमाल करते हुए, ताकि तुलना सरल रहे।

मॉडलप्रति अनुरोध लागतप्रति 1,000 अनुरोध लागत
Claude Haiku 5.5$0.0007$0.70
Claude Haiku 4.5$0.007$7.00
Claude Sonnet 5.5$0.014$14.00
Claude Sonnet 4.6$0.021$21.00
Claude Opus 5.5$0.028$28.00
Claude Fable 5.1$0.070$70.00

सबसे सस्ती और सबसे महँगी पंक्ति के बीच का फ़ासला 100 गुना है। मॉडल का चुनाव किसी भी प्लान के फ़ैसले से ज़्यादा बिल बदलता है। नए मॉडल एक ही टेक्स्ट को ज़्यादा टोकन में बाँटते हैं, इसलिए असली इस्तेमाल में 4.7 और उसके बाद की पंक्तियों में लगभग 30% तक जोड़ें।

कैशिंग और बैच छूट

एक महिला गोदाम के गलियारे में एक जैसे डिब्बों से भरी ट्रॉली धकेलती हुई

दो छूटें ज़्यादातर बचत का काम करती हैं, और वे एक साथ लागू हो सकती हैं:

  • प्रॉम्प्ट कैशिंग। 5 मिनट के कैश में प्रॉम्प्ट प्रीफ़िक्स लिखने की लागत बेस इनपुट कीमत का 1.25x है, और 1 घंटे के कैश की 2x। उसके बाद हर रीड की लागत 0.1x होती है। Opus 5.5 और Sonnet 5.5 पर रीड की लागत सिर्फ़ 0.05x है, और Fable 5.1 पर 0.025x। 5 मिनट का कैश एक ही रीड में अपनी लागत वसूल लेता है।
  • बैच API। एसिंक्रोनस जॉब्स पर इनपुट और आउटपुट दोनों टोकन पर 50% छूट मिलती है। Sonnet 5.5 $1 / $5 पर आ जाता है और Opus 5.5 $2 / $10 पर।

जब जवाब लंबे हों तब कैशिंग उतनी मदद नहीं करती जितनी लोग सोचते हैं, क्योंकि आउटपुट पर छूट नहीं मिलती। 50,000 इनपुट टोकन और 15,000 आउटपुट टोकन वाला एक कोडिंग सेशन Opus 5.5 पर $0.50 लगाता है। उन इनपुट टोकन में से 40,000 कैश से दें, तो यह लगभग $0.35 पर आ जाता है, यानी 30% की बचत, क्योंकि $0.30 का आउटपुट वही रहता है।

सब्सक्रिप्शन की लागत

Free, Pro और Max

सब्सक्रिप्शन मीटर की जगह एक सीमा रख देता है। आप एक तय कीमत देते हैं और Claude रोलिंग पाँच घंटे की विंडो में उपयोग सीमित करता है, जिसमें संदेशों की सटीक संख्या इस पर निर्भर करती है कि हर संदेश कितना लंबा और जटिल है।

एक यात्री मासिक ट्रांज़िट पास लिए ट्रेन स्टेशन के टर्नस्टाइल रीडर के सामने

प्लानकीमतआपको क्या मिलता है
Free$0वेब, डेस्कटॉप और मोबाइल पर चैट, वेब सर्च, फ़ाइल बनाना, कोड एक्ज़ीक्यूशन और मेमोरी के साथ
Proप्रति माह $20, या सालाना बिल पर प्रति माह $17Free से ज़्यादा उपयोग, साथ में Claude Code, Projects और अतिरिक्त मॉडल
Max 5xप्रति माह $100Pro से पाँच गुना उपयोग, ज़्यादा आउटपुट सीमा और नई सुविधाओं तक जल्दी पहुँच
Max 20xप्रति माह $200Pro से बीस गुना उपयोग

टीम और एंटरप्राइज़ सीट

एक मीटिंग टेबल के चारों ओर छपी स्प्रेडशीट देखते चार सहकर्मी

टीम की स्टैंडर्ड सीट सालाना बिलिंग पर प्रति सीट प्रति माह $20 लगती है, या मासिक बिलिंग पर $25। प्रीमियम सीट सालाना बिलिंग पर प्रति सीट प्रति माह $100 लगती है ($125 मासिक), और एक स्टैंडर्ड सीट से पाँच गुना उपयोग देती है। एंटरप्राइज़ सालाना बिलिंग पर प्रति सीट प्रति माह $20 से शुरू होता है, जिसमें उपयोग API दरों पर लगता है, और इसमें SCIM, ऑडिट लॉग, कस्टम डेटा रिटेंशन और रोल-बेस्ड एक्सेस जुड़ते हैं।

API अलग से बिल क्यों होता है

Claude सब्सक्रिप्शन में API क्रेडिट शामिल नहीं होते। Anthropic अपने प्लान से अलग API का बिल बनाता है, इसलिए $20 का Pro सब्सक्रिप्शन उस ऐप का खर्च नहीं उठाएगा जिसे आप ग्राहकों के लिए शिप करते हैं। उसके लिए API एक्सेस चाहिए, जिसकी अपनी बिलिंग होती है। व्यक्तिगत और टीम सब्सक्राइबर प्लान की सीमा खत्म होने के बाद मानक API दरों पर अतिरिक्त उपयोग क्रेडिट खरीद सकते हैं, जो व्यस्त हफ़्तों में एक सेफ़्टी वाल्व का काम करता है।

ब्रेक-ईवन कहाँ है

सबसे सरल जाँच यह है कि प्लान की कीमत को प्रति अनुरोध लागत से भाग दें। Pro के $20 और पहले वाले 3,000 इनपुट व 800 आउटपुट टोकन के अनुरोध पर, ब्रेक-ईवन कुछ ऐसा दिखता है:

एक ब्रास तराज़ू, जिसके एक पलड़े पर सिक्के हैं और दूसरे पर मुड़ा हुआ कागज़ी पास

मॉडलप्रति अनुरोध लागत$20 तक पहुँचने के अनुरोध30 दिनों में प्रति दिन
Claude Haiku 5.5$0.000728,571लगभग 952
Claude Sonnet 5.5$0.0141,429लगभग 48
Claude Opus 5.5$0.028714लगभग 24
Claude Fable 5.1$0.070286लगभग 10

यह तुलना सिर्फ़ लागत की है। प्लान में चैट इंटरफ़ेस, Projects और ऐप कनेक्शन भी शामिल होते हैं, जबकि API सिर्फ़ रॉ एक्सेस देता है और कुछ नहीं। उसे कॉल करने वाला ऐप या टूल आपको चाहिए।

हल्के चैट उपयोगकर्ता

अगर आप दिन में गिने-चुने सवाल पूछते हैं, तो प्रति टोकन भुगतान लगभग हमेशा सस्ता पड़ता है। महीने भर रोज़ तीस Sonnet 5.5 अनुरोध लगभग $12.60 बनते हैं, और Haiku 5.5 पर वही आदत कुछ पैसे लगाती है। फ़्लैट प्लान कीमत में तभी जीतता है जब आपकी मात्रा ब्रेक-ईवन से ऊपर निकल जाए, या जब आपको सबसे कम बिल से ज़्यादा इंटरफ़ेस और अतिरिक्त सुविधाएँ चाहिए हों।

भारी कोडिंग एजेंट

दोपहर की ढलती धूप में दो मॉनिटर वाली स्टैंडिंग डेस्क पर दाढ़ी वाला डेवलपर

एजेंटिक कोडिंग जवाब उलट देती है। Anthropic के अपने एक घंटे के सेशन उदाहरण के टोकन काउंट लें: 50,000 इनपुट टोकन और 15,000 आउटपुट टोकन। Opus 5.5 पर यह बिना कैशिंग के प्रति सेशन $0.50 है। एक कार्यदिवस में बीस सेशन $10 होते हैं, या 22 कार्यदिवसों में लगभग $220, जो $200 वाले Max 20x प्लान से भी ज़्यादा है।

कैशिंग अंतर को कुछ कम करती है। लगभग $0.35 प्रति सेशन पर, वही बीस सेशन रोज़ लगभग $153 प्रति माह लगते हैं। किसी भी तरह, पावर यूज़र $100 वाले Max 5x प्लान से काफ़ी ऊपर चला जाता है, और यही वह वर्कलोड है जिसके लिए फ़्लैट टियर बने थे। इसकी कमी यह है कि प्लान उपयोग की सीमाएँ फिर भी लागू होती हैं।

बजट में रखने लायक छिपी लागतें

टोकन का गणित पूरा इनवॉइस नहीं है। ये अतिरिक्त खर्च आसानी से छूट जाते हैं:

  • वेब सर्च: प्रति 1,000 सर्च $10, साथ में नतीजों से आपके प्रॉम्प्ट में जुड़ने वाले टोकन। वेब फ़ेच पर टोकन के अलावा कोई अतिरिक्त शुल्क नहीं है।
  • केवल US इनफ़रेंस: inference_geo को "us" पर सेट करने से Claude 4.6 और उसके बाद के मॉडलों पर हर टोकन श्रेणी पर 1.1x गुणक लगता है।
  • फ़ास्ट मोड: फ़ास्ट मोड में Opus 5.5 की कीमत प्रति MTok $8 इनपुट और $40 आउटपुट है, जो मानक दर से दोगुनी है।
  • Managed Agents: टोकन सामान्य दरों पर बिल होते हैं, साथ में सेशन चलने के दौरान प्रति सेशन घंटा $0.08।
  • टूल ओवरहेड: टूल वाले किसी भी अनुरोध में एक अंतर्निहित टूल प्रॉम्प्ट जुड़ता है, 5.5 पीढ़ी पर लगभग 286 टोकन, आपकी अपनी टूल परिभाषाओं से पहले।
  • टोकनाइज़र बदलाव: Claude 4.7 और उसके बाद के मॉडलों पर वही टेक्स्ट के लिए 30% तक ज़्यादा टोकन।

💡 बजट टिप: API रिस्पॉन्स में cache_read_input_tokens पर नज़र रखें। अगर बार-बार के अनुरोधों में यह लगातार शून्य रहता है, तो आपके प्रॉम्प्ट प्रीफ़िक्स में कुछ हर कॉल पर बदलता है और आप उस टेक्स्ट का पूरा दाम दे रहे हैं जिसे कैश से पढ़ा जा सकता था।

PicassoIA पर Claude Sonnet 5 इस्तेमाल करें

अगर आप API अकाउंट खोले बिना या टोकन मीटर देखे बिना Claude आज़माना चाहते हैं, तो Claude Sonnet 5 Picasso IA पर उपलब्ध है। यह पिछली Sonnet पीढ़ी है, API पर वही $2 / $10 कीमत जो Sonnet 5.5 की है, और इसके पेज पर मल्टी-स्टेप कोडिंग, टूल यूज़ और इमेज इनपुट इसकी सुविधाओं में गिनाए गए हैं।

चरण-दर-चरण सेटअप

  1. मॉडल पेज खोलें। Picasso IA पर Claude Sonnet 5 पर जाएँ।
  2. अपना प्रॉम्प्ट लिखें। Prompt फ़ील्ड ही एकमात्र ज़रूरी इनपुट है। स्टैक ट्रेस, दस्तावेज़ या सवाल चिपकाएँ।
  3. इफ़र्ट लेवल सेट करें। डिफ़ॉल्ट low है, जो सबसे तेज़ और सबसे सस्ते जवाबों के लिए थिंकिंग बंद रखता है। कठिन कोडिंग कार्य के लिए medium या high पर जाएँ, और कई फ़ाइलों को छूने वाले बग्स के लिए xhigh या max।
  4. आउटपुट सीमित करें। Max Tokens का डिफ़ॉल्ट 8,192 है। छोटे जवाब चाहिए तो इसे घटाएँ, क्योंकि Claude की किसी भी प्राइस लिस्ट में आउटपुट ही महँगा हिस्सा है।
  5. सिस्टम प्रॉम्प्ट जोड़ें। यह वैकल्पिक है। एक भूमिका या कोडिंग स्टाइल एक बार तय करें और पूरे प्रोजेक्ट में दोबारा इस्तेमाल करें।
  6. इमेज अटैच करें। यह भी वैकल्पिक है। एरर का स्क्रीनशॉट या वायरफ़्रेम स्केच संदर्भ के रूप में काम करता है।
  7. चलाएँ और सुधारें। जवाब पढ़ें, प्रॉम्प्ट को कसें, और फिर से चलाएँ।

पैरामीटर टिप्स

पैरामीटरडिफ़ॉल्टकब बदलें
Effortlowजब जवाब विवरण चूकता हो, या बग कई फ़ाइलों में फैला हो
Max Tokens8192जब आपको छोटे जवाब या लंबे कोड ब्लॉक चाहिए हों
System Promptखालीजब आपको एक तय भूमिका, टोन या कोडिंग स्टाइल चाहिए
Max Image Resolution0.5 megapixelsजब स्केल होने के बाद स्क्रीनशॉट का छोटा टेक्स्ट खो जाता है

💡 API बजट के लिए मॉडल चुनने से पहले उसी प्रॉम्प्ट को Claude Sonnet 4.6 और Claude 4.5 Haiku पर चलाएँ, ताकि गुणवत्ता का अंतर देख सकें। सबसे कठिन कोडिंग समस्याओं के लिए Claude Fable 5 आज़माएँ।

सही सेटअप चुनना

विकल्प को काम के तरीके से मिलाएँ:

  • चैट, लेखन और अपने लिए रिसर्च: Free से शुरू करें। सीमाएँ मिलने पर $20 वाले Pro पर जाएँ।
  • रोज़ के कोडिंग एजेंट: Max 5x या Max 20x, क्योंकि भारी सेशन मीटर पर फ़्लैट कीमत से ज़्यादा पड़ते हैं।
  • प्रोडक्ट या ऑटोमेशन: API, Haiku 5.5 या Sonnet 5.5 के साथ, जहाँ लेटेंसी अनुमति दे वहाँ प्रॉम्प्ट कैशिंग और बैच जॉब्स के साथ।
  • टीम: लोगों के लिए टीम सीट, और जो कुछ आप शिप करते हैं उसके लिए API।
  • दोनों: कई लोग निजी उपयोग के लिए एक प्लान रखते हैं और ऑटोमेशन के लिए API एक्सेस, क्योंकि दोनों अलग से बिल होते हैं।

सबसे सस्ता विकल्प वही है जो आपके असली काम के तरीके से मेल खाए, इसलिए प्रतिबद्ध होने से पहले एक हफ़्ता अनुरोध गिनने में लगाएँ।

Picasso IA पर आपका अगला कदम

कुछ बनाने के लिए चीज़ हो तो प्राइसिंग का गणित आसान लगता है, और Picasso IA टेक्स्ट और इमेज दोनों को आज़माने की तेज़ जगह है। प्रॉम्प्ट का ड्राफ़्ट बनाने के लिए Claude Sonnet 5 खोलें, फिर उन प्रॉम्प्ट्स को GPT Image 2, Flux 2 Pro या P-Image जैसे इमेज मॉडल से तस्वीरों में बदलें, यह आख़िरी वाला मॉडल है जिससे इस लेख की तस्वीरें बनी हैं।

कोई दृश्य चुनें, रोशनी और लेंस का वर्णन करें, और जनरेट दबाएँ। फिर एक डिटेल बदलें और दोबारा चलाएँ। प्रयोग में कुछ मिनट लगते हैं, और यह दिखाता है कि अच्छा प्रॉम्प्ट नतीजे को कितना बदल देता है। पूरा कैटलॉग picassoia.com/en/all-models पर देखें और आज ही अपनी पहली इमेज बनाएँ।

यह लेख शेयर करें

अपनी भाषा चुनें

संबंधित लेख