fal.ai प्राइसिंग: API लागत, फ़्री क्रेडिट और MCP

fal.ai आउटपुट के हिसाब से बिलिंग करता है: हर इमेज के सेंट, हर GPU घंटे के डॉलर और वीडियो के प्रति सेकंड तक $0.40, और यह सब प्रीपेड क्रेडिट से चुकाया जाता है। यह आर्टिकल मौजूदा रेट बताता है, क्रेडिट की एक्सपायरी और 2-रिक्वेस्ट कंकरेंसी लिमिट समझाता है, दिखाता है कि MCP सर्वर पर कितना खर्च आता है, और गणित की तुलना एक फ़्लैट प्लान से करता है।

fal.ai प्राइसिंग: API लागत, फ़्री क्रेडिट और MCP
Cristian Da Conceicao
Picasso IA के संस्थापक

ज़्यादातर प्राइसिंग पेज बताते हैं कि एक रन की लागत कितनी है। आपका बजट तय करने वाले सवाल उसके बाद आते हैं: एक महीने में कितने रन समाते हैं, उन फ़्री क्रेडिट का क्या होता है जिन्हें आपने छुआ तक नहीं, और क्या MCP सर्वर मॉडल के ऊपर कोई अलग फ़ीस जोड़ता है। यह आर्टिकल सितंबर 23 से 8 अक्टूबर 2026 के बीच जाँचे गए fal.ai के प्रकाशित प्राइसिंग विवरण एक जगह रखता है और हिसाब लगाता है, ताकि आप एक पैसा खर्च करने से पहले किसी असली प्रोजेक्ट की कीमत तय कर सकें।

छोटा सार: fal प्रीपेड है और आउटपुट के हिसाब से बिलिंग करता है। इमेज $0.003 प्रति मेगापिक्सल से लेकर $0.15 प्रति इमेज तक हैं, वीडियो कुछ सेंट से लेकर $0.40 प्रति सेकंड तक हैं, GPU घंटे के हिसाब से किराए पर मिलते हैं, और MCP सर्वर खुद मुफ़्त है। आप केवल उन रनों का भुगतान करते हैं जो वह ट्रिगर करता है, और वे डायरेक्ट API कॉल के समान रेट पर लगते हैं।

💡 कीमतें बदलती हैं। यहाँ हर आँकड़े को एक स्नैपशॉट मानें। किसी मॉडल के पेज पर, या MCP सर्वर के अंदर get_pricing टूल पर लाइव नंबर दिखता है, इसलिए बजट तय करने से पहले वहाँ देख लें।

fal.ai आपसे बिलिंग कैसे करता है

प्रीपेड क्रेडिट, आउटपुट के हिसाब से बिलिंग

fal एक प्रीपेड क्रेडिट मॉडल पर चलता है। इसकी शर्तें कहती हैं कि आप क्रेडिट पहले से खरीदते हैं, और हर रन, चाहे वेब इंटरफ़ेस से हो या API कॉल से, उसकी लागत आपके बैलेंस से काटता है। आपसे किस इकाई के हिसाब से शुल्क लिया जाता है, यह इस पर निर्भर है कि मॉडल क्या बनाता है:

आउटपुटबिलिंग यूनिटप्राइसिंग पेज का उदाहरण
इमेजप्रति इमेज या प्रति मेगापिक्सल$0.0398 प्रति इमेज (Nano Banana)
वीडियोप्रति सेकंड, या प्रति वीडियो$0.14 प्रति सेकंड (Kling Video v3)
भाषा और अन्य मॉडलप्रति रिक्वेस्ट या प्रति कंप्यूट सेकंडमॉडल के हिसाब से बदलता है
रॉ कंप्यूटप्रति GPU घंटाH100 के लिए $2.49 से $4.50

कंक्रीट की दीवार पर एनालॉग बिजली मीटर, fal.ai की पे-पर-यूज़ बिलिंग का चित्र

इसे सब्सक्रिप्शन नहीं, बिजली के मीटर की तरह समझें। कुछ चलता नहीं, तो कुछ चार्ज नहीं होता। fal का अपना कहना है कि आप केवल वही कंप्यूटिंग पावर चुकाते हैं जो आप इस्तेमाल करते हैं, और डॉक्स जोड़ते हैं कि आप सफल आउटपुट के लिए भुगतान करते हैं, कतार में इंतज़ार के समय के लिए कभी नहीं।

कंकरेंसी और विफल रन

दो नियम असल लागत को हेडलाइन रेट से ज़्यादा तय करते हैं।

  • कंकरेंसी 2 से शुरू होती है। नए अकाउंट में एक साथ 2 रिक्वेस्ट चल सकती हैं। जैसे-जैसे आप क्रेडिट खरीदते हैं, यह लिमिट अपने-आप बढ़ती है, 40 तक। इससे ज़्यादा के लिए सेल्स टीम से बात करनी पड़ती है।
  • एरर ज़्यादातर मुफ़्त हैं। सर्वर एरर (HTTP 500 और उससे ऊपर) कभी चार्ज नहीं होते। क्लाइंट एरर (HTTP 422) चार्ज हो सकता है अगर समस्या पकड़े जाने से पहले GPU काम शुरू कर चुका था। Model APIs पर कोल्ड स्टार्ट का समय बिल नहीं होता, इसलिए आप केवल इनफ़रेंस के समय का भुगतान करते हैं।

दो चेकआउट लेन वाला सुपरमार्केट जिसमें सिर्फ़ एक खुली है, 2 रिक्वेस्ट कंकरेंसी लिमिट का चित्र

एक और नियम प्रोडक्शन में परेशानी खड़ी करता है। जब आपका बैलेंस अकाउंट की लॉक थ्रेशोल्ड से नीचे गिरता है, तो अकाउंट लॉक हो जाता है और क्रेडिट जोड़ने तक API रिक्वेस्ट अस्वीकार की जाती हैं। अगर आपका ऐप ग्राहकों को सेवा देता है, तो उस लाइन से काफ़ी ऊपर टॉप-अप रिमाइंडर सेट करें।

प्रति रन इमेज की कीमतें

सस्ते मॉडल, प्रति मेगापिक्सल प्राइस

बजट इमेज मॉडल रिज़ॉल्यूशन के हिसाब से बिल करते हैं। 1024 x 1024 की इमेज लगभग 1.05 मेगापिक्सल (MP) की होती है, और 1920 x 1080 का फ़्रेम लगभग 2.07 MP का।

मॉडलप्राइस1 MP इमेज की लागत
FLUX.1 schnell$0.003 प्रति MPलगभग $0.003
Z Image Turbo$0.005 प्रति MPलगभग $0.005
FLUX.2 dev$0.012 प्रति MPलगभग $0.012
FLUX.2 proपहले MP के लिए $0.03$0.03 या उससे ज़्यादा

पहली दो पंक्तियाँ fal के प्राइसिंग पेज से हैं। आख़िरी दो 23 सितंबर 2026 की एक प्राइस तुलना से हैं। $0.003 प्रति MP पर, 1,000 स्क्वेयर इमेज की लागत लगभग $3 है।

प्रीमियम मॉडल, प्रति इमेज प्राइस

हाई-एंड मॉडल मेगापिक्सल का हिसाब छोड़ देते हैं और प्रति इमेज एक फ़्लैट रकम लेते हैं। कुछ इसके ऊपर एक क्वालिटी टियर भी जोड़ते हैं।

मॉडलप्रति इमेज प्राइस
Nano Banana$0.0398
Nano Banana Pro$0.15
GPT Image 2$0.006 low, $0.053 medium, $0.211 high
Seedream 5 Lite$0.035
Seedream 5 Pro$0.0675
Qwen Image 31K पर $0.04

प्रिंट किए गए फ़्रेम की कॉन्टैक्ट शीट पकड़े फ़ोटोग्राफ़र, प्रति इमेज इमेज जनरेशन लागत का चित्र

महीने में 1,000 इमेज बनाएँ तो फ़र्क नाटकीय है:

  • FLUX.1 schnell: लगभग $3
  • Nano Banana: $39.80
  • Nano Banana Pro: $150
  • GPT Image 2 हाई क्वालिटी पर: $211

💡 GPT Image 2 अकेले अपनी लो सेटिंग से हाई सेटिंग तक लगभग 35 गुना का फ़र्क दिखाता है। टियर हर काम के हिसाब से चुनें: ड्राफ़्ट लो पर, फ़ाइनल हाई पर।

प्रति सेकंड वीडियो की कीमतें

प्रति सेकंड रेट की तुलना

वीडियो में बिल तेज़ी से बढ़ते हैं, क्योंकि आप हर कोशिश के हर सेकंड का भुगतान करते हैं, उनका भी जिन्हें आप फेंक देते हैं। ये 23 सितंबर की तुलना के 720p रेट हैं, जनरेटेड ऑडियो के साथ और उसके बिना:

मॉडलप्रति सेकंड, बिना ऑडियोप्रति सेकंड, ऑडियो के साथ
Veo 3.1 Lite$0.03$0.05
Veo 3.1 Fast$0.10$0.15
Veo 3.1$0.20$0.40
Kling v3 Standard$0.084$0.126
Kling v3 Pro$0.112$0.168
Wan 3$0.10सूचीबद्ध नहीं
Grok Imagine Video 1.5$0.14सूचीबद्ध नहीं
Seedance 2.0 Fastलगभग $0.24सूचीबद्ध नहीं
Seedance 2.0लगभग $0.30सूचीबद्ध नहीं

fal के अपने प्राइसिंग पेज पर Kling Video v3 के लिए $0.14 प्रति सेकंड और Kling v2.5 के लिए $0.07 दिया है, जो ऊपर के Standard और Pro टियर की उसी रेंज में आता है। Seedance 2.0 टोकन के हिसाब से बिल होता है ($0.014 प्रति 1,000 टोकन), इसलिए इसके लिए हर प्रति-सेकंड आँकड़ा एक अनुमान है जो रिज़ॉल्यूशन और अवधि के साथ बदलता है।

पॉज़ की हुई पहाड़ी फ़्रेम और स्टॉपवॉच वाली वीडियो एडिटर की मेज़, प्रति सेकंड वीडियो लागत का चित्र

💡 ऑडियो मुफ़्त नहीं है। यह Veo 3.1 का रेट $0.20 से दोगुना करके $0.40 प्रति सेकंड कर देता है, और Veo 3.1 Lite को दो-तिहाई बढ़ा देता है। अगर साउंडट्रैक कहीं और से आता है, तो साइलेंट रेंडर करें।

तीन मासिक बजट

असली कामों के लिए ऊपर के रेट का मतलब यह है:

  1. Kling v3 पर 5 सेकंड की 100 क्लिप। $0.14 प्रति सेकंड पर हर क्लिप $0.70 की है, इसलिए महीने का खर्च $70 है।
  2. ऑडियो के साथ 8 सेकंड की एक क्लिप। Veo 3.1 पर यह 8 x $0.40 = $3.20 है। Veo 3.1 Lite पर यह 8 x $0.05 = $0.40 है, यानी आठ गुना सस्ता।
  3. Veo 3.1 Fast पर ऑडियो के साथ 5 सेकंड की 1,000 क्लिप। हर क्लिप $0.75 की है, इसलिए महीने का खर्च $750 है।

रीट्राई एक छिपा हुआ गुणक हैं। अगर हर तीन में से एक क्लिप बेकार निकलती है, तो हर रखने लायक क्लिप की असली लागत टेबल में दिखाए गए से 50% ज़्यादा होगी।

GPU प्रति घंटा रेट

जब कोई होस्टेड मॉडल फ़िट नहीं बैठता, तो fal GPU घंटे के हिसाब से किराए पर देता है। प्राइसिंग पेज हर कार्ड के लिए एक रेंज दिखाता है:

GPUमेमोरीप्रति घंटा रेट
RTX PRO 600096 GB$1.99 से $4.00
H10080 GB$2.49 से $4.50
H200141 GB$2.99 से $6.00
B200192 GB$5.49 से $7.99
GB200192 GB$5.89 से $9.99
B300288 GB$5.99 से $12.99

सर्वर रैक की कतारों वाला शांत डेटा सेंटर गलियारा, GPU प्रति घंटा रेट का चित्र

एक H100 पर 8 घंटे के काम की लागत $19.92 से $36 के बीच है। वही कार्ड 730 घंटे के महीने में लगातार चालू रखें, तो बिल निचले सिरे पर $1,817.70 और ऊँचे सिरे पर $3,285 है।

इसकी तुलना प्रति-रन प्राइसिंग से करें। अकेले कीमत के हिसाब से, $2.49 प्रति घंटा वाला हमेशा-चालू H100, $0.003 प्रति इमेज वाले FLUX.1 schnell की तुलना में $2.49 प्रति घंटा वाला हमेशा-चालू H100 तभी सस्ता पड़ने लगता है जब आप लगभग महीने में 6,00,000 एक-मेगापिक्सल इमेज पार कर लें। उससे नीचे, प्रति-रन बिलिंग जीतती है, और उसमें किसी को खाली मशीन पर नज़र रखने की ज़रूरत नहीं होती।

फ़्री क्रेडिट और एक्सपायरी

नए अकाउंट को क्या मिलता है

fal नए अकाउंट को टेस्टिंग के लिए स्टार्टर क्रेडिट देता है, लेकिन प्राइसिंग पेज और डॉक्यूमेंटेशन कोई रकम प्रकाशित नहीं करते। थर्ड-पार्टी पेज इसे भुगतान विधि जोड़ने से पहले सीमित संख्या की जनरेशन बताते हैं, और यह आँकड़ा प्रमोशन के साथ बदलता है। मान कर चलें कि ऑफ़र छोटा होगा।

ऊपर के रेट पर एक डॉलर कितनी दूर जाता है, यह देखें:

  • FLUX.1 schnell पर लगभग 333 एक-मेगापिक्सल इमेज
  • Nano Banana पर लगभग 25 इमेज
  • Veo 3.1 Lite पर ऑडियो के साथ 5 सेकंड की 4 क्लिप
  • Kling v3 पर 5 सेकंड की लगभग 1.4 क्लिप

कैफ़े काउंटर पर एक सादा प्रीपेड कार्ड सरकाता हाथ, fal.ai फ़्री क्रेडिट का चित्र

💡 ट्रायल क्रेडिट उस मॉडल पर खर्च करें जिसे आप असल में शिप करेंगे, सबसे सस्ते पर नहीं। बजट मॉडल पर किया टेस्ट आपको प्रीमियम मॉडल की लागत के बारे में कुछ नहीं बताता।

क्रेडिट कब एक्सपायर होते हैं

एक्सपायरी के नियम क्रेडिट के प्रकार के हिसाब से अलग हैं, और दोनों आधिकारिक पेज प्रमोशनल क्रेडिट पर एक-दूसरे से सहमत नहीं हैं।

क्रेडिट का प्रकारएक्सपायरीरिफ़ंडेबल
खरीदे गएखरीद से 365 दिननहीं, शर्तों के अनुसार
फ़्री या प्रमोशनलशर्तों के अनुसार 90 दिन, FAQ के अनुसार 1 सप्ताह से 1 वर्षलागू नहीं

घड़ी के आकार वाला घंटा ग्लास और गोल घेरे वाले दिनों का कैलेंडर, fal.ai क्रेडिट एक्सपायरी का चित्र

FAQ कहता है कि फ़्री क्रेडिट और कूपन की एक्सपायरी अलग-अलग ग्रांट पर निर्भर करती है। शर्तें कहती हैं कि प्रमोशनल क्रेडिट 90 दिन में एक्सपायर होते हैं। अपने ग्रांट की तारीख बिलिंग डैशबोर्ड में पढ़ें, और एक साल में खर्च न हो सकने वाला बड़ा बैलेंस न खरीदें, क्योंकि खरीदे गए क्रेडिट केवल खपत के लिए हैं और रिफ़ंड नहीं होते।

fal MCP सर्वर पर कितना खर्च आता है

इसे जोड़ना

कुछ नहीं। fal साफ़ कहता है: MCP सर्वर मुफ़्त है, और आप केवल उन मॉडल रनों का भुगतान करते हैं जिन्हें आप ट्रिगर करते हैं, मानक fal प्राइसिंग पर। डायरेक्ट API कॉल पर लागू होने वाली कंकरेंसी लिमिट ही यहाँ भी लागू होती हैं, और सर्वर स्टेटलेस है, यानी रिक्वेस्ट के बीच कुछ स्टोर नहीं करता।

इसमें जुड़ने के दो दस्तावेज़ीकृत रास्ते हैं। एंडपॉइंट https://mcp.fal.ai/mcp Authorization हेडर में बेयरर टोकन लेता है। एंडपॉइंट https://mcp.fal.ai/mcp-relay ब्राउज़र साइन-इन इस्तेमाल करता है, इसलिए कोई टोकन नहीं चाहिए। एक सामान्य क्लाइंट कॉन्फ़िग कुछ ऐसा दिखता है:

{
  "mcpServers": {
    "fal-ai": {
      "url": "https://mcp.fal.ai/mcp",
      "headers": { "Authorization": "Bearer YOUR_FAL_TOKEN" }
    }
  }
}

यह Claude Code, Claude Desktop, Cursor, Windsurf, ChatGPT और Codex CLI के साथ काम करता है। इसके पीछे का असिस्टेंट Claude Sonnet 5 या Gemini 3.5 Flash जैसा मॉडल हो सकता है। जिस मॉडल से आप चैट करते हैं, उसकी लागत उन fal रनों से अलग से लगती है जिन्हें वह ट्रिगर करता है।

धूप वाले कैफ़े में टाइप करती महिला, बगल में असिस्टेंट फ़ोटो थंबनेल का जवाब देता हुआ, fal.ai MCP उपयोग का चित्र

खर्च सीमित करने वाले टूल

सर्वर लगभग नौ टूल उपलब्ध कराता है। खर्च नियंत्रित करने के लिए उनमें से चार मायने रखते हैं:

टूलआपके बजट के लिए क्या करता है
get_pricingजनरेट करने से पहले मॉडल की कीमत दिखाता है
recommend_modelआपके बताए काम के लिए एक मॉडल सुझाता है
run_modelमॉडल चलाता है और नतीजे के लिए 45 सेकंड तक इंतज़ार करता है
submit_job और check_jobलंबे काम कतार में डालते हैं और बिना रुके उनकी स्थिति जाँचते हैं

एक एजेंट एक वाक्य से एक दर्जन रन चेन कर सकता है, और हर एक का बिल बनता है। दो आदतें इसे सुरक्षित रखती हैं। असिस्टेंट से कहें कि पहले get_pricing कॉल करे और किसी भी ऐसे रन से पहले पूछे जो आपकी बताई सीमा से ऊपर हो। और प्रीपेड बैलेंस सीमित रखें, क्योंकि प्रीपेड अकाउंट खर्च की एक सख़्त सीमा है: जब पैसा खत्म होता है, तो अकाउंट लॉक हो जाता है।

एक फ़्लैट-रेट विकल्प

प्रति-रन बिलिंग हल्के उपयोग को इनाम देती है और प्रयोग को सज़ा। इसका उल्टा मॉडल वह प्लान है जो कुछ मॉडल पर उदार या असीमित जनरेशन देता है, और Picasso IA इसी तरह से काम करता है। इसका प्राइसिंग पेज अपने सभी पेड प्लान में PicassoIA Image के लिए असीमित जनरेशन दिखाता है, Elite और Infinite प्लान पर असीमित PicassoIA Video, और इन्हीं दो प्लान पर Seedance 2.5 Lite का प्रमोशनल असीमित उपयोग।

खिड़की की रोशनी में प्रिंट की हुई फ़ोटो पकड़े डिज़ाइनर, बिना मीटर वाली इमेज जनरेशन का चित्र

मॉडल और सीमाएँ

PicassoIA के पास एक डेवलपर API भी है और Claude तथा ChatGPT के लिए एक MCP कनेक्टर भी। चार मॉडल दोनों पर उपलब्ध हैं:

मॉडलकाम
PicassoIA Imageटेक्स्ट से इमेज
PicassoIA Image Editor Pro1 से 4 इमेज संपादित या मिलाएँ
PicassoIA Videoटेक्स्ट या इमेज से वीडियो
Seedance 2.5 Liteऑडियो के साथ टेक्स्ट या इमेज से वीडियो

एक अकाउंट में एक साथ 5 प्रेडिक्शन कतार में या चलते हुए हो सकते हैं, जो उसके API टोकन और MCP कनेक्शन में साझा होते हैं। रिक्वेस्ट बॉडी 10 MB और प्रॉम्प्ट 4,000 कैरेक्टर तक सीमित हैं। API रेफ़रेंस कहता है कि API प्रेडिक्शन अभी मुफ़्त हैं और इनमें कोई क्रेडिट नहीं लगता, लेकिन यह भी कहता है कि प्रेडिक्शन बनाने के लिए Infinite प्लान चाहिए, जबकि प्राइसिंग पेज Elite पर भी API Access और MCP Connections दिखाता है। इस पर कुछ बनाने से पहले प्लान टेबल जाँच लें।

API को कॉल करना

प्रवाह है बनाएँ, पोल करें, लाएँ। टोकन को अपनी pia_sk_ वैल्यू से बदलें:

curl -s -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-image/predictions \
  -H "Authorization: Bearer $PICASSOIA_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"input": {"prompt": "a lighthouse at sunset, oil painting", "aspect_ratio": "16:9"}}'

रिस्पॉन्स एक id लौटाता है जो api_ से शुरू होता है, status का starting, और सुझाए गए इंतज़ार के साथ एक eta। फिर GET /v1/predictions/{id} को तब तक पोल करें जब तक स्टेटस succeeded, failed या canceled न दिखाए। सफल होने पर, output में इमेज URL होते हैं। वैकल्पिक इनपुट में num_outputs (1 या 2), output_format (webp, jpg या png) और दोहराए जा सकने वाले नतीजों के लिए seed शामिल हैं।

मीटर के बिना आज़माएँ

तुलना करने का सबसे तेज़ तरीका है एक ही प्रॉम्प्ट दो बार चलाना। वह प्रॉम्प्ट लें जिसे आप किसी मीटर वाले API पर भेजने वाले थे, उसे PicassoIA Image में चिपकाएँ, और देखें कि नतीजा प्रति-इमेज बिल से बचने लायक अच्छा है या नहीं। फिर जीतने वाली इमेज को सुधार के लिए PicassoIA Image Editor Pro से गुज़ारें, और अगर आपको आवाज़ के साथ गति चाहिए तो उसे Seedance 2.5 Lite से एनिमेट करें।

Picasso IA खोलें, कोई मॉडल चुनें, और आज ही अपनी इमेज बनाएँ। अगर आपके प्रोजेक्ट को बाद में API या MCP कनेक्शन चाहिए, तो वही मॉडल उसके पीछे तैयार मिलेंगे।

यह लेख शेयर करें

अपनी भाषा चुनें

संबंधित लेख