ElevenLabs API प्राइसिंग: लागत, फ्री टियर और रेट लिमिट का पूरा विवरण

जानें ElevenLabs API की असली लागत क्या है: हर स्पीच मॉडल की प्रति-कैरेक्टर दर, सभी छह प्लान में मासिक क्रेडिट, फ्री टियर में क्या मिलता है, प्लान के हिसाब से कंकरेंसी सीमाएँ, ट्रांसक्रिप्शन और म्यूज़िक की दरें, उदाहरण के बजट और बिल कम करने के तरीके।

ElevenLabs API प्राइसिंग: लागत, फ्री टियर और रेट लिमिट का पूरा विवरण
Cristian Da Conceicao
Picasso IA के संस्थापक

ElevenLabs की प्राइसिंग वेबसाइट खोलें तो छह प्लान, ढेर सारे क्रेडिट और प्रति हज़ार कैरेक्टर कुछ डॉलर की रकम दिखती है। अपना पहला इनवॉइस खोलें तो संख्याएँ अलग लगती हैं। इस फ़र्क़ की वजह तीन बातें हैं, जो पेज कई टैब में बिखेरकर रखता है: कोई मॉडल कैरेक्टर को क्रेडिट में कैसे बदलता है, आपका अकाउंट किस प्लान पर है, और एक ही समय पर कितनी रिक्वेस्ट चला सकते हैं। यह लेख तीनों बातें एक जगह रखता है, उदाहरणों के साथ, ताकि आप इंटीग्रेशन का कोड लिखने से पहले ही बिल का अनुमान लगा सकें।

💡 प्राइस जाँच: नीचे की हर संख्या अक्टूबर 2026 की शुरुआत में जाँची गई थी। ElevenLabs दरें बदलता है और प्रमोशन अक्सर चलाता है, इसलिए हर आँकड़े को एक स्नैपशॉट मानें और बजट तय करने से पहले अपने डैशबोर्ड में पुष्टि कर लें।

गर्म सुबह की रोशनी में लैपटॉप के पास टाइप करते डेवलपर के हाथ और एक सफ़ेद कॉफ़ी कप

API असल में क्या चार्ज करता है

क्रेडिट और डॉलर अलग हैं

ElevenLabs उपयोग को दो मुद्राओं में मापता है। सब्सक्रिप्शन प्लान आपको हर महीने क्रेडिट का एक पूल देते हैं, और हर जनरेट किया गया कैरेक्टर मॉडल के हिसाब से कुछ क्रेडिट खर्च करता है। उपयोग-आधारित API प्राइस लिस्ट इसके बजाय प्रति 1,000 कैरेक्टर डॉलर में चलती है। दोनों एक ही ऑडियो का हिसाब रखते हैं, पर इनका आपस में सीधा एक-से-एक रूपांतरण नहीं होता, इसलिए मन में किया गया त्वरित हिसाब अक्सर असली संख्या से काफ़ी दूर निकलता है।

टेक्स्ट-टू-स्पीच के लिए नियम सीधा है। Multilingual v2 जैसा मल्टीलिंगुअल मॉडल लगभग 1 क्रेडिट प्रति कैरेक्टर खर्च करता है। Flash और Turbo मॉडल प्रति कैरेक्टर 0.5 से 1 क्रेडिट खर्च करते हैं, इसीलिए चैट बॉट और फ़ोन एजेंट के लिए ये बजट विकल्प हैं।

मॉडल के हिसाब से दरें

टेक्स्ट-टू-स्पीच की उपयोग-आधारित प्राइस लिस्ट यहाँ है, प्रति 1,000 कैरेक्टर।

मॉडलप्रति 1,000 कैरेक्टर कीमतआम उपयोग
Eleven v4$0.08 (प्रमोशनल $0.022, 12 अक्टूबर 2026 तक)प्रमुख नैरेशन क्वालिटी
Eleven v4 Turbo$0.04 (प्रमोशनल $0.011)तेज़, सस्ता v4 आउटपुट
Eleven v3$0.08अभिव्यक्तिपूर्ण, भावनात्मक डिलीवरी
v3 Conversational$0.04कम लेटेंसी वाली बातचीत
Multilingual v2$0.08ऑडियोबुक और लंबी सामग्री
Flash v2.5 और Turbo v2.5$0.04रियल-टाइम एजेंट, सबसे कम लेटेंसी

v4 की छूट इस जाँच के कुछ दिन बाद खत्म हो जाती है, इसलिए बजट लिस्ट कीमत पर बनाएँ, प्रमोशनल कीमत पर नहीं।

इन पंक्तियों में से चुनना मुख्य रूप से इस पर निर्भर है कि सुनने वाला क्या नोटिस करता है। नैरेटेड वीडियो या ऑडियोबुक एक बार सुनी जाती है और भावना के आधार पर परखी जाती है, इसलिए $0.08 वाले मॉडल अपनी कीमत के लायक हैं। जो बॉट दिन में हज़ार बार "आपका ऑर्डर भेज दिया गया है" कहता है, उसे रफ़्तार पर परखा जाता है, और $0.04 वाला तेज़ मॉडल उस समृद्ध आवाज़ से बेहतर है जो कॉलर को इंतज़ार करवाए। कई टीमें दोनों चलाती हैं: जो सामग्री लोग चुनकर सुनते हैं उसके लिए प्रीमियम मॉडल, और बाकी सब स्वचालित कामों के लिए Flash मॉडल।

तीन लागत उदाहरण

स्पेस और विराम-चिह्न गिनने पर अंग्रेज़ी में औसतन लगभग 6 कैरेक्टर प्रति शब्द होते हैं, इसलिए त्वरित अनुमान के लिए शब्दों को 6 से गुणा करें।

  • ऑडियोबुक का एक अध्याय, 10,000 शब्द। लगभग 60,000 कैरेक्टर। $0.08 प्रति 1,000 पर यह $4.80 है। $0.04 वाले मॉडल पर यह $2.40 हो जाता है।
  • प्रोडक्ट वीडियो का वॉइसओवर, 500 शब्द। लगभग 3,000 कैरेक्टर, इसलिए $0.08 पर $0.24 या $0.04 पर $0.12।
  • सपोर्ट बॉट, 300 कैरेक्टर के 50,000 जवाब। यानी 1.5 करोड़ कैरेक्टर: $0.04 प्रति 1,000 पर $600, या $0.08 पर $1,200।

💡 त्वरित फ़ॉर्मूला: monthly cost = characters per month ÷ 1,000 × price per 1,000 characters। इसे दो बार चलाएँ, एक बार अपनी सबसे कम अनुमानित मात्रा के लिए और एक बार सबसे ज़्यादा के लिए।

अखरोट की लकड़ी की मेज़ पर कैलकुलेटर, हाथ से लिखे आँकड़ों वाली नोटबुक और रसीदों का ऊपर से दृश्य

प्लान, क्रेडिट और मासिक लागत

भुगतान का दूसरा तरीका सब्सक्रिप्शन है। हर प्लान क्रेडिट का एक तय मासिक पूल बेचता है, साथ में कॉमर्शियल लाइसेंस, टीम सीट और ज़्यादा कंकरेंसी जैसी सुविधाएँ।

छह प्लान की तुलना

प्लानमासिक कीमतमासिक क्रेडिटसबसे उपयुक्त
Free$010,000टेस्टिंग और प्रोटोटाइप
Starter$630,000अकेले क्रिएटर, पहले महीने पर छूट
Creator$22121,000नियमित कंटेंट प्रोडक्शन, पहले महीने पर छूट
Pro$99600,000छोटे प्रोडक्ट और स्टूडियो
Scale$2991.8 मिलियनबढ़ते ऐप, तीन सीट
Business$9906 मिलियनबड़ी मात्रा, दस सीट

सालाना बिलिंग में दो महीने मुफ़्त मिलते हैं: आप दस महीने का भुगतान करते हैं और बारह महीने इस्तेमाल करते हैं। बिना इस्तेमाल हुए क्रेडिट अधिकतम दो महीने तक आगे बढ़ते हैं, और उनकी सीमा आपके मासिक आवंटन का तीन गुना होती है, बशर्ते सब्सक्रिप्शन सक्रिय रहे।

प्लान के हिसाब से प्रति क्रेडिट लागत

कीमत को क्रेडिट से भाग दें तो प्लान एक जैसे नहीं लगते।

प्लानप्रभावी कीमत प्रति 1,000 क्रेडिट
Starter$0.20
Creator$0.18
Pro$0.165
Scale$0.166
Business$0.165

दो बातें साफ़ दिखती हैं। Starter से Pro तक प्रति क्रेडिट लागत लगभग 17 प्रतिशत गिरती है, फिर सपाट हो जाती है। Pro के आगे आप सस्ते ऑडियो के लिए नहीं, कंकरेंसी, सीट और सपोर्ट के लिए भुगतान कर रहे होते हैं।

दूसरी बात ज़्यादा मायने रखती है। 1 क्रेडिट प्रति कैरेक्टर पर ये आँकड़े पहली तालिका की उपयोग-आधारित दरों से ऊपर रहते हैं। दोनों प्राइस लिस्ट अलग तरीके से बिल होती हैं, इसलिए कोई एक चुनने से पहले अपनी अनुमानित मात्रा को दोनों पर जाँच लें, और अपने डैशबोर्ड में देखें कि आपका अकाउंट कौन-सा बिलिंग मोड इस्तेमाल करता है।

तीन नमूना मासिक बजट

यहाँ देखें कि तीन वास्तविक प्रोजेक्ट दोनों तरह से हिसाब लगाने पर कहाँ पहुँचते हैं। उपयोग-आधारित कॉलम पहली तालिका की सूची-दरों का इस्तेमाल करता है।

प्रोजेक्टप्रति माह कैरेक्टरउपयोग-आधारित लागतउपयुक्त प्लान
सोलो YouTuber, 1,200 शब्दों के 8 वीडियो57,600$0.08 पर $4.61Creator, 121,000 क्रेडिट के लिए $22
कोर्स प्रकाशक, 1,500 शब्दों के 40 पाठ360,000$0.08 पर $28.80Pro, 600,000 क्रेडिट के लिए $99
वॉइस बॉट, 250 कैरेक्टर के 500,000 जवाब12.5 करोड़$0.04 पर $5,000कस्टम कॉन्ट्रैक्ट, क्योंकि Business की सीमा 6 मिलियन क्रेडिट है

आपके अकाउंट पर उपयोग-आधारित दरें खरीदी जा सकती हैं या नहीं, यह आपके बिलिंग सेटअप पर निर्भर है, इसलिए इस तालिका को कोट नहीं, तुलना मानें। पैटर्न फिर भी वही रहता है: छोटे और मध्यम प्रोजेक्ट किसी प्लान में आराम से फ़िट हो जाते हैं, जबकि हाई-वॉल्यूम बॉट एक सेल्स बातचीत है, चेकआउट पेज का मामला नहीं।

एक चमकदार स्टार्टअप ऑफ़िस में एक साझा मेज़ के चारों ओर बैठकर काम करते चार डेवलपर्स का हाई-एंगल व्यू

फ्री टियर व्यवहार में

10,000 क्रेडिट में क्या आता है

फ्री प्लान $0 में हर महीने 10,000 क्रेडिट देता है। 1 क्रेडिट प्रति कैरेक्टर खर्च करने वाले मॉडल पर यह 10,000 कैरेक्टर है: लगभग 1,700 शब्द, या सामान्य पढ़ने की गति से लगभग 11 मिनट का तैयार भाषण। आधा क्रेडिट प्रति कैरेक्टर वाले Flash मॉडल पर वही पूल लगभग 20 मिनट तक खिंच जाता है।

इतना तीन कामों के लिए काफ़ी है:

  • किसी प्रोजेक्ट के लिए आवाज़ चुनना
  • यह जाँचना कि आपका इंटीग्रेशन टेक्स्ट भेजता है और ऑडियो सही तरीके से वापस पाता है
  • क्लाइंट या टीम के साथी को दिखाने के लिए प्रोटोटाइप बनाना

किन सीमाओं की उम्मीद रखें

  • कोई कॉमर्शियल लाइसेंस नहीं। जो ऑडियो आप प्रकाशित या बेचते हैं, उसके लिए पेड प्लान चाहिए।
  • सबसे कम कंकरेंसी। मल्टीलिंगुअल मॉडल पर दो एक साथ रिक्वेस्ट, और Flash व Turbo पर चार।
  • बैच जॉब के लिए जगह नहीं। 60,000 कैरेक्टर वाला 10,000 शब्दों का एक अध्याय छह महीने के फ्री क्रेडिट खा जाएगा।

इन तीनों में से कोई भी बात आपके अपग्रेड का संकेत है। जिस पल आपको ऑडियो कमर्शियली प्रकाशित करना हो, दो से ज़्यादा जॉब एक साथ चलाने हों, या हर महीने लगभग 10,000 कैरेक्टर से ज़्यादा बनाने हों, फ्री प्लान प्लान नहीं रहता, ट्रायल बन जाता है। $6 वाला Starter सबसे छोटा अगला कदम है, और यह मासिक क्रेडिट तीन गुना कर देता है और कॉमर्शियल लाइसेंस भी जोड़ता है।

💡 टिप: फ्री क्रेडिट दो-तीन वाक्यों की टेस्ट स्क्रिप्ट पर खर्च करें, पूरे अध्यायों पर कभी नहीं। पहले आवाज़, रफ़्तार और स्थिरता तय करें, फिर पूरा टेक्स्ट एक बार चलाएँ।

स्टूडियो में ध्वनि-पैनल के बीच माइक्रोफ़ोन में बोलते पॉडकास्टर का नीचे से दृश्य

रेट लिमिट और कंकरेंसी

इस API की सीमाएँ ज़्यादातर कंकरेंसी से जुड़ी हैं: एक ही समय पर कितनी रिक्वेस्ट चल रही हैं, न कि आप प्रति मिनट कितनी भेजते हैं। एक तेज़ मॉडल जो एक सेकंड में खत्म हो जाए, एक स्लॉट से कई रिक्वेस्ट सँभाल लेता है। धीमी, लंबी जनरेशन पूरे रन के दौरान अपना स्लॉट रोके रखती है।

प्लान के हिसाब से सीमाएँ

प्लानMultilingual v2 और v3Flash और Turbo
Free24
Starter36
Creator510
Pro1020
Scale1530
Business1530

लिखे जाने के समय ये प्रकाशित सीमाएँ हैं। एंटरप्राइज़ अकाउंट को बढ़ी हुई सीमाएँ मिलती हैं, और नए मॉडल की अपनी अलग सीमाएँ हो सकती हैं, इसलिए डैशबोर्ड ज़रूर देखें।

सीमा पार करने पर API या तो रिक्वेस्ट को कतार में डालता है, जिससे थोड़ी देरी होती है, या HTTP 429 एरर लौटाता है। दोनों के लिए तैयारी रखें:

  1. एक्सपोनेंशियल बैकऑफ़ के साथ दोबारा कोशिश करें।
  2. रैंडम जिटर जोड़ें, ताकि रीट्राई एक साथ लहर बनकर न आएँ।
  3. सेमाफ़ोर से अपनी तरफ़ से चल रही कॉल सीमित करें, जो आपके प्लान की सीमा से थोड़ी नीचे हो।

Python में एक न्यूनतम रीट्राई रैपर कुछ ऐसा दिखता है:

import random
import time

def with_backoff(call, retries=5, base=0.5):
    for attempt in range(retries):
        try:
            return call()
        except RateLimitError:
            time.sleep(base * 2 ** attempt + random.random() * 0.25)
    raise RuntimeError("still rate limited after retries")

RateLimitError की जगह वह एक्सेप्शन रखें जो आपका HTTP क्लाइंट 429 पर फेंकता है। इंतज़ार आधे सेकंड से बढ़कर आठ सेकंड तक जाता है, और रैंडम हिस्सा समानांतर वर्कर्स को एक साथ रीट्राई करने से रोकता है।

काले सर्वर रैक की कतारों वाले डेटा सेंटर के गलियारे का चौड़ा दृश्य

अपनी कंकरेंसी का आकलन

यह अनुमान इस्तेमाल करें:

concurrent requests ≈ requests per second × seconds per generation

एक ऐप जो प्रति सेकंड 8 रिक्वेस्ट के शिखर पर पहुँचता है और हर जनरेशन में 1.5 सेकंड लेता है, उसे लगभग 12 एक साथ चलने वाले स्लॉट चाहिए। Flash मॉडल पर यह Pro में फ़िट हो जाता है, जो 20 देता है।

वॉइस एजेंट अलग है, क्योंकि हर लाइव कॉल एक ही समय पर बोलने की माँग कर सकती है। शिखर पर 25 एक साथ कॉल करने वालों के लिए आपको 25 स्लॉट चाहिए, और Flash मॉडल पर सिर्फ़ Scale या Business (30) वह गुंजाइश देता है। प्लान छूटी हुई कॉल की तुलना में सस्ते हैं, इसलिए औसत घंटे के बजाय अपने सबसे व्यस्त घंटे के लिए आकार तय करें।

चमकदार ऑफ़िस में हेडसेट लगाए और कॉल लेते ग्राहक सहायता एजेंटों की कतार

ट्रांसक्रिप्शन और म्यूज़िक की दरें

आवाज़ बिल का सिर्फ़ एक हिस्सा है। अगर आपका प्रोडक्ट ऑडियो को टेक्स्ट में बदलता है या साउंडट्रैक बनाता है, तो वे मीटर भी चलते हैं।

Scribe स्पीच टू टेक्स्ट

ट्रांसक्रिप्शन का बिल प्रति कैरेक्टर नहीं, प्रति घंटा ऑडियो के हिसाब से होता है:

  • Scribe v2: फ़ाइलों के लिए $0.22 प्रति घंटा
  • Scribe v2 Realtime: $0.39 प्रति घंटा, लगभग 150 ms लेटेंसी के साथ
  • वोकैबुलरी हिंट: $0.05 प्रति घंटा अतिरिक्त
  • ट्रांसक्रिप्ट एडिटिंग: $0.07 प्रति घंटा अतिरिक्त

रिकॉर्ड किए गए 100 घंटे के इंटरव्यू का बैकलॉग लगभग $22 पड़ता है। रियल टाइम में ट्रांसक्रिप्ट किया गया दो घंटे का लाइव इवेंट लगभग $0.78 का है। इन दरों पर ट्रांसक्रिप्शन ज़्यादातर ऑडियो प्रोडक्ट में सबसे सस्ती लाइन आइटम है, इसलिए यह शायद ही प्लान तय करता है। अगर सटीकता पर दूसरी राय चाहिए, तो वही फ़ाइल GPT-4o Transcribe या Gemini 3 Pro पर चलाएँ और ट्रांसक्रिप्ट की तुलना करें।

कैफ़े की मेज़ पर लैपटॉप पर हेडफ़ोन लगाकर सुनती और नोट टाइप करती युवा महिला

म्यूज़िक और वॉइस टूल

म्यूज़िक जनरेशन का बिल आउटपुट के प्रति मिनट $0.15 है। तीन-तीन मिनट के तीस ट्रैक 90 मिनट होते हैं, यानी $13.50। Voice Isolator और Voice Changer, हर एक $0.12 प्रति मिनट चलते हैं।

प्रति-मिनट बिलिंग म्यूज़िक का अनुमान आसान बनाती है, और ज़रूरत से ज़्यादा खर्च भी आसान बनाती है, क्योंकि प्रॉम्प्ट का हर रीट्राई फिर से बिल होता है। छोटा ब्रीफ़ लिखें, एक छोटा सैंपल बनाएँ, और उसके बाद ही पूरी लंबाई माँगें। कोड में जोड़ने से पहले आप PicassoIA पर ElevenLabs Music को आज़मा सकते हैं।

मंद रोशनी वाले कंट्रोल रूम में एनालॉग मिक्सिंग कंसोल के फ़ेडर पर टिके हाथ

बिल कम करने के तरीके

ज़्यादातर बचत कम कैरेक्टर भेजने और सही काम के लिए सस्ते मॉडल चुनने से आती है।

  • काम के हिसाब से मॉडल चुनें। बॉट और अलर्ट के लिए Flash इस्तेमाल करें, और प्रीमियम मॉडल उस नैरेशन के लिए बचाएँ जहाँ भावना मायने रखती है। बॉट ट्रैफ़िक पर दर आधी करना अक्सर सबसे बड़ी अकेली बचत होती है।
  • हर दोहराए गए वाक्यांश को कैश करें। अभिवादन, मेनू प्रॉम्प्ट और एरर संदेश कभी नहीं बदलते। टेक्स्ट, आवाज़ और सेटिंग्स को एक साथ हैश करें, ऑडियो फ़ाइल स्टोर करें और उसे स्टोरेज से परोसें। अगर आपके 40 प्रतिशत जवाब दोहराए जाते हैं, तो उनमें से 40 प्रतिशत का भुगतान बंद हो जाता है।
  • साफ़ टेक्स्ट भेजें। रिक्वेस्ट से पहले HTML, मार्कअप, फ़ुटनोट और दोहराया गया खाली स्थान हटाएँ। हर कैरेक्टर बिल होता है।
  • लंबी स्क्रिप्ट को संदर्भ के साथ हिस्सों में बाँटें। पैराग्राफ़ ब्रेक पर बाँटें और आसपास के वाक्य संदर्भ के रूप में भेजें, ताकि लहजा एक जैसा रहे और एक लाइन के संपादन के लिए पूरी स्क्रिप्ट दोबारा न बनानी पड़े।
  • बैच से पहले पूर्वावलोकन करें। एक पैराग्राफ चलाएँ, सुनें, फिर बाकी चलाएँ।
  • अपने कोड में सीमा तय करें। रोज़ के कैरेक्टर गिनें, बजट के 80 प्रतिशत पर अलर्ट दें और 100 पर रोक दें।
  • रीट्राई पर नज़र रखें। वह रीट्राई लूप जो सफल हो चुकी रिक्वेस्ट को दोबारा भेजता है, आपसे दोगुना बिल करवाता है। हर जॉब को एक ID दें, ताकि डुप्लिकेट पकड़े जा सकें।
  • टेस्ट में API का मॉक बनाएँ। जो टेस्ट सूट हर कमिट पर असली एंडपॉइंट बुलाता है, वह चुपचाप क्रेडिट जलाता है। एक सैंपल रिस्पॉन्स रिकॉर्ड करें और उसे कंटीन्यूअस इंटीग्रेशन में दोबारा चलाएँ।
  • डेवलपमेंट को प्रोडक्शन से अलग रखें। स्टेजिंग एनवायरनमेंट, डेमो और प्रयोग उसी पूल से क्रेडिट लेते हैं जिससे आपका लाइव प्रोडक्ट। उन्हें छोटा कोटा दें, या अलग अकाउंट, ताकि टेस्ट स्क्रिप्ट का कोई लूप महीने का पूरा कोटा न खा जाए।
  • हर महीने सबसे बड़ी स्क्रिप्ट्स का ऑडिट करें। पिछले महीने की जनरेशन को कैरेक्टर गिनती के हिसाब से छाँटें। कुछ लंबी जॉब अक्सर ज़्यादातर बिल बनाती हैं, और वही कैश करने या छोटा करने लायक होती हैं।

डुअल-मॉनिटर डेस्क पर हेडफ़ोन लगाए वीडियो एडिटर, सुनहरी शाम की रोशनी में

आवाज़ें पहले PicassoIA पर परखें

किसी पेड API को प्रोडक्शन में जोड़ने से पहले उन जगहों पर आवाज़ें परखें जहाँ गलत चुनाव की कीमत कुछ नहीं होती। PicassoIA अपने टेक्स्ट-टू-स्पीच कलेक्शन में कई ElevenLabs मॉडल होस्ट करता है, साथ में दूसरी लैब के मॉडल भी, ताकि आप डिलीवरी की तुलना साथ-साथ कर सकें। यह वीडियो को दूसरी भाषाओं में अनुवाद करने के लिए ElevenLabs Dubbing भी देता है।

तुलना के लायक मॉडल

कामपहले आज़माएँइनसे तुलना करें
अभिव्यक्तिपूर्ण नैरेशनEleven v3MiniMax Speech 2.8 HD, Gemini 3.1 Flash TTS
लंबी बहुभाषी स्क्रिप्टMultilingual v2Qwen3 TTS
कम लेटेंसी वाले एजेंटFlash v2.5Inworld Realtime TTS 1.5 Max
म्यूज़िकElevenLabs MusicMiniMax Music 2.6, Lyria 3 Pro, Stable Audio 2.5
ट्रांसक्रिप्शनGPT-4o TranscribeGPT-4o Mini Transcribe, Gemini 3 Pro

V3 के साथ चरण-दर-चरण

  1. टेक्स्ट-टू-स्पीच कलेक्शन में Eleven v3 पेज खोलें।
  2. अपनी स्क्रिप्ट के दो-तीन वाक्य Prompt फ़ील्ड में चिपकाएँ।
  3. एक आवाज़ चुनें। 26 आवाज़ों में से चुनें, और डिफ़ॉल्ट Rachel है।
  4. language code सेट करें, जैसे en, es या fr।
  5. पहली रन के लिए स्टेबिलिटी 0.5 और similarity boost 0.75 पर छोड़ दें।
  6. चलाएँ, सुनें, एक बार में एक सेटिंग बदलें, फिर ऑडियो डाउनलोड करें।

बदलने लायक सेटिंग्स

सेटिंगरेंजडिफ़ॉल्टटिप
स्पीड0.25 से 41प्राकृतिक नैरेशन के लिए 0.9 और 1.15 के बीच रखें
स्टाइल0 से 10कहानी सुनाने के लिए 0.2 से 0.4 आज़माएँ। ऊँची वैल्यू नाटकीय लगती है
स्टेबिलिटी0 से 10.5लंबी ऑडियोबुक के लिए बढ़ाएँ, विविध डिलीवरी के लिए घटाएँ
Similarity boost0 से 10.75चुनी गई आवाज़ से ज़्यादा सटीक मेल के लिए बढ़ाएँ
पिछला और अगला टेक्स्टटेक्स्टखालीहिस्सों के बीच इंटोनेशन चिकना करने के लिए आसपास के वाक्य चिपकाएँ

💡 टिप: हर रन में एक सेटिंग बदलें और नोट रखें। दस छोटे टेस्ट क्लिप आपको एक लंबी जनरेशन से ज़्यादा लागत और क्वालिटी के बारे में सिखाते हैं।

Picasso IA पर आज़माएँ

आपके अगले वॉइसओवर, साउंडट्रैक या ट्रांसक्रिप्ट को पहले दिन बजट की स्प्रेडशीट नहीं चाहिए। Picasso IA पर टेक्स्ट-टू-स्पीच कलेक्शन खोलें, V3 में एक छोटी स्क्रिप्ट चिपकाएँ, और कुछ ही सेकंड में नतीजा सुनें। फिर वही स्क्रिप्ट दो और आवाज़ों से चलाएँ और वह रखें जो आपके श्रोताओं पर सबसे ठीक बैठे।

पॉडकास्ट, कोर्स या प्रोडक्ट डेमो बना रहे हैं? प्लेटफ़ॉर्म के फ़ोटोरियलिस्टिक इमेज मॉडल उन थंबनेल, बैनर और सीन आर्ट को बना सकते हैं जो आपके ऑडियो के साथ जाते हैं। प्रॉम्प्ट लिखें, मॉडल चुनें और देखें क्या निकलता है। हर वॉइस, म्यूज़िक, ट्रांसक्रिप्शन और इमेज मॉडल picassoia.com/en/all-models पर ब्राउज़ करें, और आज ही अपने प्रोजेक्ट्स के साथ प्रयोग शुरू करें।

यह लेख शेयर करें

अपनी भाषा चुनें

संबंधित लेख