fal.ai आउटपुट के हिसाब से बिलिंग करता है: हर इमेज के सेंट, हर GPU घंटे के डॉलर और वीडियो के प्रति सेकंड तक $0.40, और यह सब प्रीपेड क्रेडिट से चुकाया जाता है। यह आर्टिकल मौजूदा रेट बताता है, क्रेडिट की एक्सपायरी और 2-रिक्वेस्ट कंकरेंसी लिमिट समझाता है, दिखाता है कि MCP सर्वर पर कितना खर्च आता है, और गणित की तुलना एक फ़्लैट प्लान से करता है।
ज़्यादातर प्राइसिंग पेज बताते हैं कि एक रन की लागत कितनी है। आपका बजट तय करने वाले सवाल उसके बाद आते हैं: एक महीने में कितने रन समाते हैं, उन फ़्री क्रेडिट का क्या होता है जिन्हें आपने छुआ तक नहीं, और क्या MCP सर्वर मॉडल के ऊपर कोई अलग फ़ीस जोड़ता है। यह आर्टिकल सितंबर 23 से 8 अक्टूबर 2026 के बीच जाँचे गए fal.ai के प्रकाशित प्राइसिंग विवरण एक जगह रखता है और हिसाब लगाता है, ताकि आप एक पैसा खर्च करने से पहले किसी असली प्रोजेक्ट की कीमत तय कर सकें।
छोटा सार: fal प्रीपेड है और आउटपुट के हिसाब से बिलिंग करता है। इमेज $0.003 प्रति मेगापिक्सल से लेकर $0.15 प्रति इमेज तक हैं, वीडियो कुछ सेंट से लेकर $0.40 प्रति सेकंड तक हैं, GPU घंटे के हिसाब से किराए पर मिलते हैं, और MCP सर्वर खुद मुफ़्त है। आप केवल उन रनों का भुगतान करते हैं जो वह ट्रिगर करता है, और वे डायरेक्ट API कॉल के समान रेट पर लगते हैं।
💡 कीमतें बदलती हैं। यहाँ हर आँकड़े को एक स्नैपशॉट मानें। किसी मॉडल के पेज पर, या MCP सर्वर के अंदर get_pricing टूल पर लाइव नंबर दिखता है, इसलिए बजट तय करने से पहले वहाँ देख लें।
fal.ai आपसे बिलिंग कैसे करता है
प्रीपेड क्रेडिट, आउटपुट के हिसाब से बिलिंग
fal एक प्रीपेड क्रेडिट मॉडल पर चलता है। इसकी शर्तें कहती हैं कि आप क्रेडिट पहले से खरीदते हैं, और हर रन, चाहे वेब इंटरफ़ेस से हो या API कॉल से, उसकी लागत आपके बैलेंस से काटता है। आपसे किस इकाई के हिसाब से शुल्क लिया जाता है, यह इस पर निर्भर है कि मॉडल क्या बनाता है:
आउटपुट
बिलिंग यूनिट
प्राइसिंग पेज का उदाहरण
इमेज
प्रति इमेज या प्रति मेगापिक्सल
$0.0398 प्रति इमेज (Nano Banana)
वीडियो
प्रति सेकंड, या प्रति वीडियो
$0.14 प्रति सेकंड (Kling Video v3)
भाषा और अन्य मॉडल
प्रति रिक्वेस्ट या प्रति कंप्यूट सेकंड
मॉडल के हिसाब से बदलता है
रॉ कंप्यूट
प्रति GPU घंटा
H100 के लिए $2.49 से $4.50
इसे सब्सक्रिप्शन नहीं, बिजली के मीटर की तरह समझें। कुछ चलता नहीं, तो कुछ चार्ज नहीं होता। fal का अपना कहना है कि आप केवल वही कंप्यूटिंग पावर चुकाते हैं जो आप इस्तेमाल करते हैं, और डॉक्स जोड़ते हैं कि आप सफल आउटपुट के लिए भुगतान करते हैं, कतार में इंतज़ार के समय के लिए कभी नहीं।
कंकरेंसी और विफल रन
दो नियम असल लागत को हेडलाइन रेट से ज़्यादा तय करते हैं।
कंकरेंसी 2 से शुरू होती है। नए अकाउंट में एक साथ 2 रिक्वेस्ट चल सकती हैं। जैसे-जैसे आप क्रेडिट खरीदते हैं, यह लिमिट अपने-आप बढ़ती है, 40 तक। इससे ज़्यादा के लिए सेल्स टीम से बात करनी पड़ती है।
एरर ज़्यादातर मुफ़्त हैं। सर्वर एरर (HTTP 500 और उससे ऊपर) कभी चार्ज नहीं होते। क्लाइंट एरर (HTTP 422) चार्ज हो सकता है अगर समस्या पकड़े जाने से पहले GPU काम शुरू कर चुका था। Model APIs पर कोल्ड स्टार्ट का समय बिल नहीं होता, इसलिए आप केवल इनफ़रेंस के समय का भुगतान करते हैं।
एक और नियम प्रोडक्शन में परेशानी खड़ी करता है। जब आपका बैलेंस अकाउंट की लॉक थ्रेशोल्ड से नीचे गिरता है, तो अकाउंट लॉक हो जाता है और क्रेडिट जोड़ने तक API रिक्वेस्ट अस्वीकार की जाती हैं। अगर आपका ऐप ग्राहकों को सेवा देता है, तो उस लाइन से काफ़ी ऊपर टॉप-अप रिमाइंडर सेट करें।
प्रति रन इमेज की कीमतें
सस्ते मॉडल, प्रति मेगापिक्सल प्राइस
बजट इमेज मॉडल रिज़ॉल्यूशन के हिसाब से बिल करते हैं। 1024 x 1024 की इमेज लगभग 1.05 मेगापिक्सल (MP) की होती है, और 1920 x 1080 का फ़्रेम लगभग 2.07 MP का।
पहली दो पंक्तियाँ fal के प्राइसिंग पेज से हैं। आख़िरी दो 23 सितंबर 2026 की एक प्राइस तुलना से हैं। $0.003 प्रति MP पर, 1,000 स्क्वेयर इमेज की लागत लगभग $3 है।
प्रीमियम मॉडल, प्रति इमेज प्राइस
हाई-एंड मॉडल मेगापिक्सल का हिसाब छोड़ देते हैं और प्रति इमेज एक फ़्लैट रकम लेते हैं। कुछ इसके ऊपर एक क्वालिटी टियर भी जोड़ते हैं।
💡 GPT Image 2 अकेले अपनी लो सेटिंग से हाई सेटिंग तक लगभग 35 गुना का फ़र्क दिखाता है। टियर हर काम के हिसाब से चुनें: ड्राफ़्ट लो पर, फ़ाइनल हाई पर।
प्रति सेकंड वीडियो की कीमतें
प्रति सेकंड रेट की तुलना
वीडियो में बिल तेज़ी से बढ़ते हैं, क्योंकि आप हर कोशिश के हर सेकंड का भुगतान करते हैं, उनका भी जिन्हें आप फेंक देते हैं। ये 23 सितंबर की तुलना के 720p रेट हैं, जनरेटेड ऑडियो के साथ और उसके बिना:
fal के अपने प्राइसिंग पेज पर Kling Video v3 के लिए $0.14 प्रति सेकंड और Kling v2.5 के लिए $0.07 दिया है, जो ऊपर के Standard और Pro टियर की उसी रेंज में आता है। Seedance 2.0 टोकन के हिसाब से बिल होता है ($0.014 प्रति 1,000 टोकन), इसलिए इसके लिए हर प्रति-सेकंड आँकड़ा एक अनुमान है जो रिज़ॉल्यूशन और अवधि के साथ बदलता है।
💡 ऑडियो मुफ़्त नहीं है। यह Veo 3.1 का रेट $0.20 से दोगुना करके $0.40 प्रति सेकंड कर देता है, और Veo 3.1 Lite को दो-तिहाई बढ़ा देता है। अगर साउंडट्रैक कहीं और से आता है, तो साइलेंट रेंडर करें।
तीन मासिक बजट
असली कामों के लिए ऊपर के रेट का मतलब यह है:
Kling v3 पर 5 सेकंड की 100 क्लिप। $0.14 प्रति सेकंड पर हर क्लिप $0.70 की है, इसलिए महीने का खर्च $70 है।
ऑडियो के साथ 8 सेकंड की एक क्लिप।Veo 3.1 पर यह 8 x $0.40 = $3.20 है। Veo 3.1 Lite पर यह 8 x $0.05 = $0.40 है, यानी आठ गुना सस्ता।
Veo 3.1 Fast पर ऑडियो के साथ 5 सेकंड की 1,000 क्लिप। हर क्लिप $0.75 की है, इसलिए महीने का खर्च $750 है।
रीट्राई एक छिपा हुआ गुणक हैं। अगर हर तीन में से एक क्लिप बेकार निकलती है, तो हर रखने लायक क्लिप की असली लागत टेबल में दिखाए गए से 50% ज़्यादा होगी।
GPU प्रति घंटा रेट
जब कोई होस्टेड मॉडल फ़िट नहीं बैठता, तो fal GPU घंटे के हिसाब से किराए पर देता है। प्राइसिंग पेज हर कार्ड के लिए एक रेंज दिखाता है:
GPU
मेमोरी
प्रति घंटा रेट
RTX PRO 6000
96 GB
$1.99 से $4.00
H100
80 GB
$2.49 से $4.50
H200
141 GB
$2.99 से $6.00
B200
192 GB
$5.49 से $7.99
GB200
192 GB
$5.89 से $9.99
B300
288 GB
$5.99 से $12.99
एक H100 पर 8 घंटे के काम की लागत $19.92 से $36 के बीच है। वही कार्ड 730 घंटे के महीने में लगातार चालू रखें, तो बिल निचले सिरे पर $1,817.70 और ऊँचे सिरे पर $3,285 है।
इसकी तुलना प्रति-रन प्राइसिंग से करें। अकेले कीमत के हिसाब से, $2.49 प्रति घंटा वाला हमेशा-चालू H100, $0.003 प्रति इमेज वाले FLUX.1 schnell की तुलना में $2.49 प्रति घंटा वाला हमेशा-चालू H100 तभी सस्ता पड़ने लगता है जब आप लगभग महीने में 6,00,000 एक-मेगापिक्सल इमेज पार कर लें। उससे नीचे, प्रति-रन बिलिंग जीतती है, और उसमें किसी को खाली मशीन पर नज़र रखने की ज़रूरत नहीं होती।
फ़्री क्रेडिट और एक्सपायरी
नए अकाउंट को क्या मिलता है
fal नए अकाउंट को टेस्टिंग के लिए स्टार्टर क्रेडिट देता है, लेकिन प्राइसिंग पेज और डॉक्यूमेंटेशन कोई रकम प्रकाशित नहीं करते। थर्ड-पार्टी पेज इसे भुगतान विधि जोड़ने से पहले सीमित संख्या की जनरेशन बताते हैं, और यह आँकड़ा प्रमोशन के साथ बदलता है। मान कर चलें कि ऑफ़र छोटा होगा।
ऊपर के रेट पर एक डॉलर कितनी दूर जाता है, यह देखें:
💡 ट्रायल क्रेडिट उस मॉडल पर खर्च करें जिसे आप असल में शिप करेंगे, सबसे सस्ते पर नहीं। बजट मॉडल पर किया टेस्ट आपको प्रीमियम मॉडल की लागत के बारे में कुछ नहीं बताता।
क्रेडिट कब एक्सपायर होते हैं
एक्सपायरी के नियम क्रेडिट के प्रकार के हिसाब से अलग हैं, और दोनों आधिकारिक पेज प्रमोशनल क्रेडिट पर एक-दूसरे से सहमत नहीं हैं।
क्रेडिट का प्रकार
एक्सपायरी
रिफ़ंडेबल
खरीदे गए
खरीद से 365 दिन
नहीं, शर्तों के अनुसार
फ़्री या प्रमोशनल
शर्तों के अनुसार 90 दिन, FAQ के अनुसार 1 सप्ताह से 1 वर्ष
लागू नहीं
FAQ कहता है कि फ़्री क्रेडिट और कूपन की एक्सपायरी अलग-अलग ग्रांट पर निर्भर करती है। शर्तें कहती हैं कि प्रमोशनल क्रेडिट 90 दिन में एक्सपायर होते हैं। अपने ग्रांट की तारीख बिलिंग डैशबोर्ड में पढ़ें, और एक साल में खर्च न हो सकने वाला बड़ा बैलेंस न खरीदें, क्योंकि खरीदे गए क्रेडिट केवल खपत के लिए हैं और रिफ़ंड नहीं होते।
fal MCP सर्वर पर कितना खर्च आता है
इसे जोड़ना
कुछ नहीं। fal साफ़ कहता है: MCP सर्वर मुफ़्त है, और आप केवल उन मॉडल रनों का भुगतान करते हैं जिन्हें आप ट्रिगर करते हैं, मानक fal प्राइसिंग पर। डायरेक्ट API कॉल पर लागू होने वाली कंकरेंसी लिमिट ही यहाँ भी लागू होती हैं, और सर्वर स्टेटलेस है, यानी रिक्वेस्ट के बीच कुछ स्टोर नहीं करता।
इसमें जुड़ने के दो दस्तावेज़ीकृत रास्ते हैं। एंडपॉइंट https://mcp.fal.ai/mcpAuthorization हेडर में बेयरर टोकन लेता है। एंडपॉइंट https://mcp.fal.ai/mcp-relay ब्राउज़र साइन-इन इस्तेमाल करता है, इसलिए कोई टोकन नहीं चाहिए। एक सामान्य क्लाइंट कॉन्फ़िग कुछ ऐसा दिखता है:
यह Claude Code, Claude Desktop, Cursor, Windsurf, ChatGPT और Codex CLI के साथ काम करता है। इसके पीछे का असिस्टेंट Claude Sonnet 5 या Gemini 3.5 Flash जैसा मॉडल हो सकता है। जिस मॉडल से आप चैट करते हैं, उसकी लागत उन fal रनों से अलग से लगती है जिन्हें वह ट्रिगर करता है।
खर्च सीमित करने वाले टूल
सर्वर लगभग नौ टूल उपलब्ध कराता है। खर्च नियंत्रित करने के लिए उनमें से चार मायने रखते हैं:
टूल
आपके बजट के लिए क्या करता है
get_pricing
जनरेट करने से पहले मॉडल की कीमत दिखाता है
recommend_model
आपके बताए काम के लिए एक मॉडल सुझाता है
run_model
मॉडल चलाता है और नतीजे के लिए 45 सेकंड तक इंतज़ार करता है
submit_job और check_job
लंबे काम कतार में डालते हैं और बिना रुके उनकी स्थिति जाँचते हैं
एक एजेंट एक वाक्य से एक दर्जन रन चेन कर सकता है, और हर एक का बिल बनता है। दो आदतें इसे सुरक्षित रखती हैं। असिस्टेंट से कहें कि पहले get_pricing कॉल करे और किसी भी ऐसे रन से पहले पूछे जो आपकी बताई सीमा से ऊपर हो। और प्रीपेड बैलेंस सीमित रखें, क्योंकि प्रीपेड अकाउंट खर्च की एक सख़्त सीमा है: जब पैसा खत्म होता है, तो अकाउंट लॉक हो जाता है।
एक फ़्लैट-रेट विकल्प
प्रति-रन बिलिंग हल्के उपयोग को इनाम देती है और प्रयोग को सज़ा। इसका उल्टा मॉडल वह प्लान है जो कुछ मॉडल पर उदार या असीमित जनरेशन देता है, और Picasso IA इसी तरह से काम करता है। इसका प्राइसिंग पेज अपने सभी पेड प्लान में PicassoIA Image के लिए असीमित जनरेशन दिखाता है, Elite और Infinite प्लान पर असीमित PicassoIA Video, और इन्हीं दो प्लान पर Seedance 2.5 Lite का प्रमोशनल असीमित उपयोग।
मॉडल और सीमाएँ
PicassoIA के पास एक डेवलपर API भी है और Claude तथा ChatGPT के लिए एक MCP कनेक्टर भी। चार मॉडल दोनों पर उपलब्ध हैं:
एक अकाउंट में एक साथ 5 प्रेडिक्शन कतार में या चलते हुए हो सकते हैं, जो उसके API टोकन और MCP कनेक्शन में साझा होते हैं। रिक्वेस्ट बॉडी 10 MB और प्रॉम्प्ट 4,000 कैरेक्टर तक सीमित हैं। API रेफ़रेंस कहता है कि API प्रेडिक्शन अभी मुफ़्त हैं और इनमें कोई क्रेडिट नहीं लगता, लेकिन यह भी कहता है कि प्रेडिक्शन बनाने के लिए Infinite प्लान चाहिए, जबकि प्राइसिंग पेज Elite पर भी API Access और MCP Connections दिखाता है। इस पर कुछ बनाने से पहले प्लान टेबल जाँच लें।
API को कॉल करना
प्रवाह है बनाएँ, पोल करें, लाएँ। टोकन को अपनी pia_sk_ वैल्यू से बदलें:
curl -s -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-image/predictions \
-H "Authorization: Bearer $PICASSOIA_TOKEN" \
-H "Content-Type: application/json" \
-d '{"input": {"prompt": "a lighthouse at sunset, oil painting", "aspect_ratio": "16:9"}}'
रिस्पॉन्स एक id लौटाता है जो api_ से शुरू होता है, status का starting, और सुझाए गए इंतज़ार के साथ एक eta। फिर GET /v1/predictions/{id} को तब तक पोल करें जब तक स्टेटस succeeded, failed या canceled न दिखाए। सफल होने पर, output में इमेज URL होते हैं। वैकल्पिक इनपुट में num_outputs (1 या 2), output_format (webp, jpg या png) और दोहराए जा सकने वाले नतीजों के लिए seed शामिल हैं।
मीटर के बिना आज़माएँ
तुलना करने का सबसे तेज़ तरीका है एक ही प्रॉम्प्ट दो बार चलाना। वह प्रॉम्प्ट लें जिसे आप किसी मीटर वाले API पर भेजने वाले थे, उसे PicassoIA Image में चिपकाएँ, और देखें कि नतीजा प्रति-इमेज बिल से बचने लायक अच्छा है या नहीं। फिर जीतने वाली इमेज को सुधार के लिए PicassoIA Image Editor Pro से गुज़ारें, और अगर आपको आवाज़ के साथ गति चाहिए तो उसे Seedance 2.5 Lite से एनिमेट करें।
Picasso IA खोलें, कोई मॉडल चुनें, और आज ही अपनी इमेज बनाएँ। अगर आपके प्रोजेक्ट को बाद में API या MCP कनेक्शन चाहिए, तो वही मॉडल उसके पीछे तैयार मिलेंगे।