Suno v6 विवाद: उपयोगकर्ता क्या नापसंद करते हैं और इसे कैसे ठीक करें
Suno v6 ने कई सब्सक्राइबर्स को धुँधली मिक्स, दबे हुए वोकल्स और पुराने मॉडल्स पर वापस जाने का कोई रास्ता न होने की स्थिति में छोड़ दिया। यह लेख बताता है कि क्या बदला, उपयोगकर्ता सबसे ज़्यादा क्या नापसंद करते हैं, और वे प्रॉम्प्ट, ऑडियो और टूल्स के बदलाव जो साफ़ और निखरे हुए गाने वापस ला सकते हैं।
एक म्यूज़िक जनरेटर के लिए पैसे दें, अपना पूरा वर्कफ़्लो उसी के इर्द-गिर्द बनाएँ, और फिर एक नया वर्ज़न आए जो ऐसा लगे जैसे किसी ने आपके स्पीकर्स पर ऊनी कंबल डाल दिया हो। Suno v6 विवाद का यही संक्षिप्त सार है, और यह तेज़ी से फैला। लॉन्च के कुछ ही समय बाद सब्सक्राइबर्स सब्सक्रिप्शन रद्द करने वाले थ्रेड्स पोस्ट करने लगे, आउटपुट को दबा हुआ, सामान्य और बेजान बताने लगे, और पूछने लगे कि वे उस मॉडल पर वापस क्यों नहीं जा सकते जिस पर उन्हें भरोसा था।
अगर आप AI से गाने बनाते हैं, तो इस प्रतिक्रिया को गौर से देखना ज़रूरी है। शिकायतें साफ़ हैं, कारण आंशिक रूप से तकनीकी हैं, और नुकसान का एक अच्छा हिस्सा बेहतर प्रॉम्प्ट, एक छोटी ऑडियो क्लीनअप चेन, या अपने टूलबॉक्स में दूसरा जनरेटर रखकर कम किया जा सकता है। यह लेख बताता है कि क्या बदला, लोग असल में क्या नापसंद करते हैं, और आज काम करने वाले व्यावहारिक फ़िक्स, साथ ही एक विकल्प का चरण-दर-चरण ट्यूटोरियल भी, जिसे आप अभी खोल सकते हैं।
v6 में वास्तव में क्या बदला
लाइसेंस्ड डेटा में बदलाव
Suno ने v6 को सितंबर की शुरुआत में म्यूज़िक मॉडल्स के नए सूट के रूप में पेश किया, जिसे प्रमुख लेबल दुनिया के साथ मिलकर बनाया गया था, और इसमें Warner Music Group, BMG और Believe के साथ लाइसेंसिंग डील्स शामिल हैं। कंपनी ने इस रिलीज़ को तेज़, ज़्यादा एक्सप्रेसिव और उच्च गुणवत्ता वाला बताया, जिसकी संगीत की भाषा पर बेहतर पकड़ है। एक और मुख्य बात ट्रेनिंग डेटा की है: v6 लाइसेंस्ड कैटलॉग पर निर्भर है, और Suno का कहना है कि इसे शुरुआत से ट्रेन किया गया है और इसमें Universal या Sony का डेटा इस्तेमाल नहीं हुआ है।
ट्रेनिंग डेटा आवाज़ को आकार देता है। जो मॉडल रिकॉर्डिंग के एक अलग समूह का अध्ययन करता है, वह अलग आदतें सीख सकता है: वोकल और वाद्ययंत्रों के बीच अलग संतुलन, ऊँची फ़्रीक्वेंसी पर अलग टोन, और कोरस कैसा लगना चाहिए इसकी अलग समझ। कंपनी के बाहर का कोई भी व्यक्ति नहीं बता सकता कि कौन-सा चुनाव कौन-सी खामी लाया, इसलिए किसी एक कारण वाली थ्योरी को अनुमान ही मानें। फिर भी श्रोता जो सुन रहे हैं, वह इतना एक-सा है कि उसका विस्तार से वर्णन किया जा सकता है।
पुराने मॉडल वापस क्यों नहीं आ सकते
जो बात निराशा को गुस्से में बदल देती है, वह सीधी है: रिपोर्ट्स के अनुसार v6 आने पर पुराने मॉडल हटा दिए गए। जिन लोगों ने अपनी आदतें पिछली आवाज़ के हिसाब से ढाली थीं, वे उसे मेनू से चुनकर काम नहीं चला सकते थे। गुणवत्ता में गिरावट परेशान करती है। पर गुणवत्ता में गिरावट के साथ वापसी का कोई रास्ता न होना टूटे वादे जैसा लगता है।
💡 टिप: जब भी कोई प्लेटफ़ॉर्म रातों-रात किसी मॉडल को बदल सकता है, तो जो ट्रैक्स आपको पसंद हों उन्हें बनते ही डाउनलोड कर लें। तैयार WAV फ़ाइलें और एक्सपोर्ट किए गए स्टेम्स किसी भी अपडेट से ज़्यादा टिकते हैं।
विषय
Suno ने क्या कहा
उपयोगकर्ताओं ने क्या रिपोर्ट किया
गुणवत्ता
तेज़, ज़्यादा एक्सप्रेसिव, उच्च गुणवत्ता
दबा हुआ, फीका, भारी कम्प्रेस्ड
ट्रेनिंग डेटा
लाइसेंस्ड कैटलॉग, शुरुआत से ट्रेन
सामान्य, एक-जैसे परिणाम
पुराने मॉडल
v6 सूट द्वारा बदले गए
वापस जाने का विकल्प नहीं
उपयोगकर्ता सबसे ज़्यादा क्या नापसंद करते हैं
Reddit थ्रेड्स और समाचार रिपोर्ट्स में वही शिकायतें बार-बार आती हैं। वे चार समूहों में बँटती हैं, और हर एक आगे इस लेख में एक अलग फ़िक्स की ओर इशारा करती है।
दबा हुआ मिक्स और गायब हाई फ़्रीक्वेंसी
जो वाक्यांश सबसे ज़्यादा चिपका, वह है "स्पीकर्स पर कंबल।" उपयोगकर्ता ऊपरी फ़्रीक्वेंसी के फीके होने, ऐसे वोकल्स जो खोखले या पानी के अंदर जैसे लगते हैं, वाद्ययंत्रों का एक-दूसरे में घुल जाना बजाय साफ़ लेन में बैठने के, और भारी कम्प्रेशन की सामान्य अनुभूति का वर्णन करते हैं। अगर आप सिंबल्स में चमक, वोकल पर साँस की आवाज़ या एकॉस्टिक गिटार के आसपास की हवा नहीं सुन पाते, तो यही वह शिकायत है जिसके साथ आप जी रहे हैं।
दबे हुए वोकल्स
दूसरी सबसे आम बात यह है कि वोकल्स मिक्स में बहुत पीछे बैठते हैं। बोल सही होने पर भी गायक ऐसा लगता है मानो वह बगल के कमरे से गा रहा हो। कुछ श्रोता यह भी बताते हैं कि पिछले वर्ज़न की तुलना में वोकल की पर्सनैलिटी बदल जाती है, इसलिए जो वॉइस स्टाइल उन्हें पसंद थी, वह अब उसी तरह वापस नहीं आती।
सामान्य, एक-जैसे परिणाम
कई उपयोगकर्ता कहते हैं कि v6 के आउटपुट एक प्रॉम्प्ट से दूसरे तक ज़्यादा सपाट और एक-जैसे होते हैं। मेलोडी और हार्मनी के विकल्प समरूप लगते हैं, और एक ही प्रॉम्प्ट को दोबारा जनरेट करने पर पहले जितनी विविधता नहीं मिलती। जो व्यक्ति जनरेटर को आइडिया मशीन की तरह इस्तेमाल करता है, उसके लिए कम विविधता का मतलब है कम सुखद संयोग।
वे प्रॉम्प्ट जो ब्रीफ़ से चूक जाते हैं
टेम्पो, जेनर, इंस्ट्रुमेंटेशन और अरेंजमेंट के अनुरोध कुछ लोगों के लिए कम भरोसेमंद ढंग से पूरे होते हैं। दूसरों की रिपोर्ट है कि लंबे ट्रैक्स में बाद में गुणवत्ता गिरती है और दोहराव आने लगता है। प्रयोगात्मक v6-wild विकल्प का ज़िक्र लंबे टुकड़ों में आर्टिफ़ैक्ट्स और दोहराव के लिए होता है, हालाँकि कुछ लोग इसे जानबूझकर किए गए प्रयोगों के लिए उपयोगी पाते हैं।
समुदाय की प्रतिक्रिया
रद्दीकरण और गुस्से भरे थ्रेड्स
Reddit पर r/SunoAI समुदाय शिकायतें ज़ाहिर करने की जगह बन गया। "Bye bye Suno, I'm cancelling my subscription" शीर्षक वाले थ्रेड पर सैकड़ों कमेंट आए, एक और ने v6 को "कचरा और मज़ाक" कहा, और कुछ पोस्ट्स ने इसे "Suno की मौत" घोषित किया। एक पुराने सब्सक्राइबर ने कहा कि पिछले वर्ज़न असली रिकॉर्डिंग से लगभग अलग न पहचाना जा सकने वाला संगीत बनाते थे, जबकि v6 ने "दबा हुआ, सामान्य, बेजान कचरा" दिया।
सब एक राय नहीं हैं। कुछ उपयोगकर्ता बताते हैं कि छोटा v6-mini विकल्प रीमिक्स और परफ़ॉर्मेंस-आधारित प्रॉम्प्ट्स के लिए आश्चर्यजनक रूप से अच्छे नतीजे देता है, और यह नीचे दिए फ़िक्स के लिए एक उपयोगी संकेत है।
कॉपीराइट का बादल
लाइसेंसिंग का प्रयास कॉपीराइट विवाद को शांत करने के लिए था। इसने उसे खत्म नहीं किया। Universal Music Group और Sony Music Entertainment, जो पहले से Suno के साथ विवाद में हैं, तर्क देते हैं कि 60,202 साउंड रिकॉर्डिंग्स बिना अनुमति इस्तेमाल हुईं, और v6 ने नॉलेज डिस्टिलेशन के ज़रिए पिछले मॉडलों से जानकारी ली हो सकती है, जहाँ एक नया मॉडल पुराने मॉडल के आउटपुट से व्यवहार सीखता है। Suno का जवाब सीधा है: v6 को शुरुआत से ट्रेन किया गया है और इसमें Universal या Sony का डेटा इस्तेमाल नहीं हुआ है।
यह बहस अदालतें सुलझाएँगी, कोई ब्लॉग पोस्ट नहीं। क्रिएटर्स के लिए व्यावहारिक सबक छोटा है और ज़्यादा काम का: किसी प्लेटफ़ॉर्म के पीछे का मॉडल और उसके नीचे की कानूनी ज़मीन बदल सकती है, जबकि आपके प्रोजेक्ट अभी भी खुले हों।
Suno के अनुसार क्या आने वाला है
Suno ने उन फ़ीचर्स की सूची भी घोषित की है जो अभी आने बाकी हैं: गानों के सेक्शन की नेचुरल लैंग्वेज में एडिटिंग, पूरे ट्रैक को दोबारा जनरेट किए बिना एक बोल की लाइन बदलना, कई स्रोतों से बने मैशअप, सैंपल आइसोलेशन और सैंपल बिल्डिंग वर्कफ़्लो, और Believe व TuneCore की साझेदारी से मुआवज़े के साथ ऑप्ट-इन आर्टिस्ट प्रोडक्ट्स। इनमें से ज़्यादातर बिना पुष्टि की लॉन्च तारीख़ों के आते हैं।
अगर ये जैसा बताया गया है वैसे आते हैं, तो सेक्शन एडिटिंग "एक खराब टेक सब कुछ बिगाड़ देता है" वाली समस्या को कम कर सकती है। फिर भी इनमें से कोई भी मॉडल की मूल आवाज़ नहीं बदलता, इसलिए जो वादा किया गया है उसके बजाय आज जो मौजूद है उसी के हिसाब से योजना बनाएँ।
रद्द करें या इंतज़ार करें?
इसका कोई एक सही जवाब नहीं है, क्योंकि सही कदम इस बात पर निर्भर है कि आप टूल का उपयोग कैसे करते हैं। यह त्वरित तालिका आम स्थितियाँ सूचीबद्ध करती है। यह एक व्यावहारिक चेकलिस्ट है, कानूनी या वित्तीय सलाह नहीं।
आपकी स्थिति
समझदारी भरा कदम
शौकिया जिसे पिछली आवाज़ पसंद थी
प्लान रोकें, अपने सबसे अच्छे ट्रैक्स डाउनलोड करें, और दूसरे जनरेटर को आज़माएँ
व्यावसायिक रूप से म्यूज़िक रिलीज़ कर रहे हैं
हर एक्सपोर्ट रखें, प्लेटफ़ॉर्म की मौजूदा शर्तें पढ़ें, और बैकअप टूल तैयार रखें
छोटे मॉडल पर रीमिक्स से संतुष्ट
बने रहें, क्योंकि आपका वर्कफ़्लो शायद पहले से v6 के अनुकूल है
अधूरे गानों के साथ बीच प्रोजेक्ट में
गाने के बीच में टूल बदलने के बजाय अभी पूरा करें और एक्सपोर्ट करें
प्रॉम्प्ट से इसे कैसे ठीक करें
⚠️ ईमानदार नोट: इनमें से कोई भी टिप Suno की आधिकारिक आवश्यकता नहीं है, और इनमें से कोई भी पुराने मॉडल को वापस नहीं लाती। ये समुदाय द्वारा परखे गए विचार हैं जो v6 के आउटपुट को बेहतर बनाते हैं, परफ़ेक्ट नहीं।
प्रोड्यूसर की तरह लिखें
सबसे ज़्यादा दोहराया जाने वाला तरीका है कि व्यापक जेनर टैग्स पर निर्भर रहना बंद करें और इसके बजाय प्रोडक्शन का वर्णन करें: वोकल कहाँ बैठता है, मिक्स कितना साफ़ होना चाहिए, कौन-से वाद्ययंत्र बजते हैं, और परफ़ॉर्मेंस कैसा महसूस होता है।
कमज़ोर प्रॉम्प्ट
मज़बूत प्रॉम्प्ट
इंडी पॉप, महिला वोकल
इंडी पॉप, 110 BPM, लीड वोकल आगे और ड्राई, चमकदार एकूस्टिक गिटार, क्रिस्प हाई-हैट्स, खुला टॉप एंड, हल्का कम्प्रेशन
उदास पियानो बैलेड
अंतरंग पियानो बैलेड, क्लोज़-माइक्ड फ़ेल्ट पियानो, नरम पुरुष वोकल बीच में और आगे, प्राकृतिक रूम रीवर्ब, चौड़ी डायनेमिक्स
रॉक गाना
गैराज रॉक, 140 BPM, खुरदुरे ओवरड्राइव्ड गिटार, तीखी स्नेयर क्रैक, गिटार के नीचे सुनाई देता बास, कच्चा लाइव एहसास
ज़्यादा टेक जनरेट करें
चूँकि विविधता कम लगती है, इसलिए हर प्रॉम्प्ट को बैच जॉब की तरह लें। चार से छह टेक चलाएँ, एक समय में एक तत्व बदलें (टेम्पो, वोकल का वर्णन, मुख्य वाद्ययंत्र), और जो काम किया उसका सरल लॉग रखें। सबसे अच्छा टेक दोनों स्पीकर और हेडफ़ोन पर सुनकर चुनें, क्योंकि दबा हुआ मिक्स अक्सर एक पर छिप जाता है और दूसरे पर दिखता है।
गाने छोटे सेक्शनों में बनाएँ
अगर लंबे ट्रैक्स में देर से गुणवत्ता गिरती है, तो एक लंबा टेक माँगना बंद करें। एक वर्स और कोरस जनरेट करें, फिर ब्रिज और आउट्रो, और सबसे अच्छे हिस्से एडिटर में जोड़ें। छोटे जनरेशन v6-mini विकल्प को भी उचित मौका देते हैं, खासकर रीमिक्स के लिए।
बाद में ऑडियो ठीक करें
दबा हुआ ट्रैक खोया हुआ ट्रैक नहीं है। एक छोटी क्लीनअप चेन ज़्यादातर काम कर देती है, और वही चेन किसी भी जनरेटर के संगीत में मदद करती है।
किसी स्लाइडर को छूने से पहले पाँच मिनट का लिसनिंग टेस्ट करें। सबसे तेज़ कोरस को लूप करें, फिर एक कमर्शियल रेफ़रेंस ट्रैक के साथ बराबर वॉल्यूम पर बारी-बारी से सुनें। एक संकरे EQ बूस्ट को धीरे-धीरे 200 Hz से 12 kHz तक घुमाएँ और नोट करें कि ट्रैक कहाँ सबसे खराब लगता है। इससे पता चलता है कि असली समस्या कीचड़, कर्कशता है या ऊपरी फ़्रीक्वेंसी की कमी, ताकि आप अंदाज़े के बजाय एक चीज़ ठीक करें।
समस्या
कदम
शुरुआती बिंदु
फीका ऊपरी हिस्सा
हल्का हाई शेल्फ़
8 kHz से ऊपर +2 से +4 dB, छोटे कदमों में
कीचड़ जैसे लो मिड्स
संकरा कट
200 से 400 Hz के आसपास 2 से 3 dB
दबा हुआ वोकल
वोकल अलग करें, उठाएँ
वोकल स्टेम पर +1.5 से 3 dB
बूस्ट के बाद कर्कश हाई
डी-एसर या डायनामिक EQ
5 से 8 kHz को केवल तब दबाएँ जब वह उछले
सपाट, दबा हुआ एहसास
अतिरिक्त लिमिटिंग से बचें
ट्रांज़िएंट शेपर जोड़ें, और कम्प्रेशन नहीं
साफ़ करें और कीचड़ हटाएँ
पहले कट, फिर बूस्ट। 200 से 400 Hz का थोड़ा-सा जमाव हटाने से पूरा मिक्स कम दबा हुआ लगता है, इसलिए बाद में आपको कम हाई शेल्फ़ चाहिए। शेल्फ़ छोटे कदमों में जोड़ें और उसी लाउडनेस के कमर्शियल ट्रैक से तुलना करें। दो मिनट बाद आपके कान भटकने लगते हैं, इसलिए रेफ़रेंस अक्सर बदलें।
वोकल्स को आगे लाएँ
अगर आपके एडिटर में सेपरेशन टूल है, तो वोकल को वाद्ययंत्रों से अलग करें। वोकल को कुछ डेसीबल उठाएँ, फिर ऊपरी हार्मोनिक्स के लिए थोड़ी पैरेलल सैचुरेशन जोड़ें। थोड़ा-सा प्लेट रिवर्ब आवाज़ को ऊपर से जोड़ी हुई लगने से बचाता है। आक्रामक लिमिटिंग के बजाय हल्का अंतिम लाउडनेस पास करके समाप्त करें, क्योंकि भारी कम्प्रेशन ठीक वही है जिसकी श्रोता पहले से शिकायत करते हैं।
💡 टिप: जनरेटर से उपलब्ध सबसे उच्च गुणवत्ता में एक्सपोर्ट करें। दबे हुए ट्रैक को ठीक करना लॉसलेस ऑडियो पर भारी कम्प्रेस्ड फ़ाइल की तुलना में कहीं आसान है।
अभी आज़माने लायक विकल्प
कोई एक जनरेटर हर जेनर में नहीं जीतता, इसलिए दूसरा अपने पास रखें। PicassoIA कई म्यूज़िक मॉडल सूचीबद्ध करता है, और आप उन्हें मिनटों में एक ही प्रॉम्प्ट पर परख सकते हैं। हर एक में वही प्रॉम्प्ट चलाएँ और फ़ैसला अपने कानों पर छोड़ें।
Music 2.6 टेक्स्ट विवरण को वोकल्स और इंस्ट्रुमेंटेशन वाले पूरे गाने में बदलता है, और यह आपके बोल में संरचना टैग्स का पालन करता है। विचार से डाउनलोड करने योग्य फ़ाइल तक का सबसे तेज़ रास्ता यहाँ है।
मॉडल पेज खोलें। PicassoIA पर Music 2.6 पर जाएँ और नई जनरेशन शुरू करें।
प्रोड्यूसर स्टाइल वाला प्रॉम्प्ट लिखें। शैली, मूड और परिदृश्य को 2,000 अक्षरों तक लिखें। "प्रोड्यूसर की तरह लिखें" वाला फ़ॉर्मेट अपनाएँ: टेम्पो, वोकल की जगह, वाद्ययंत्र, और मिक्स का एहसास।
वोकल या इंस्ट्रुमेंटल चुनें। बिना गाने वाले ट्रैक के लिए Is Instrumental चालू करें। इस मोड में प्रॉम्प्ट ज़रूरी है और बोल की आवश्यकता नहीं है।
संरचना टैग्स के साथ बोल जोड़ें। 1 से 3,500 अक्षरों के बोल पेस्ट करें और [Intro], [Verse], [Pre Chorus], [Chorus], [Bridge] और [Outro] जैसे टैग्स से सेक्शन चिह्नित करें। अभी बोल नहीं हैं? फ़ील्ड खाली छोड़ें और Lyrics Optimizer चालू करें, ताकि मॉडल आपके प्रॉम्प्ट से बोल लिख दे।
ऑडियो गुणवत्ता सेट करें। डिफ़ॉल्ट 44.1 kHz और 256 kbps हैं। अगर आप ऊपर वाली क्लीनअप चेन चलाने की योजना बना रहे हैं तो WAV चुनें, या जल्दी साझा करने के लिए MP3।
जनरेट करें, सुनें, समायोजित करें। परिणाम को स्पीकर और हेडफ़ोन पर चलाएँ, एक विवरण बदलें, और फिर से चलाएँ।
जब आपको साफ़ और संपादन योग्य परिणाम चाहिए, तो ये सेटिंग्स सबसे ज़्यादा मायने रखती हैं:
सेटिंग
सुझाया गया मान
क्यों
ऑडियो फ़ॉर्मेट
एडिटिंग के लिए WAV, शेयर करने के लिए MP3
लॉसलेस ऑडियो आपके EQ को ज़्यादा गुंजाइश देता है
सैंपल रेट
44100 Hz
डिफ़ॉल्ट और संगीत का मानक
बिटरेट
256000
सबसे ऊँचा विकल्प, कम्प्रेस्ड फ़ॉर्मेट के लिए सबसे अच्छा
Lyrics Optimizer
जब बोल का फ़ील्ड खाली हो तब चालू
आपके प्रॉम्प्ट से मेल खाते बोल लिखता है
Is Instrumental
बैकग्राउंड ट्रैक्स के लिए चालू
वोकल पूरी तरह हटाता है, इसलिए केवल प्रॉम्प्ट चाहिए
एक शुरुआती प्रॉम्प्ट जिसे आप पेस्ट कर सकते हैं:
Warm indie pop, 110 BPM, lead female vocal upfront and intimate, bright acoustic guitar, crisp hi-hats, open top end, light compression, summer evening mood
💡 टिप: जब आपको टाइम कोडेड नियंत्रण चाहिए तो Lyria 3 Pro इस्तेमाल करें। "[0:00 - 0:15] soft intro, [0:15 - 0:45] verse with warm piano" जैसा प्रॉम्प्ट आपको हर पल को टाइमलाइन पर रखने देता है।
Picasso IA पर अपने ट्रैक्स बनाएँ
Suno v6 विवाद ने समुदाय को एक स्थायी सबक सिखाया: किसी एक टूल को अपनी आवाज़ का मालिक कभी न बनने दें। अपने प्रॉम्प्ट रखें, अपना एक्सपोर्ट किया हुआ ऑडियो रखें, और दूसरा जनरेटर पहुँच में रखें, ताकि कोई अचानक अपडेट संकट के बजाय छोटा-सा चक्कर बन जाए।
Picasso IA वह दूसरा टूल एक क्लिक की दूरी पर रखता है। Music 2.6 या Lyria 3 Pro खोलें, इस लेख का प्रोड्यूसर स्टाइल प्रॉम्प्ट पेस्ट करें, और परिणाम की तुलना अपने ताज़ा v6 ट्रैक से करें। फिर रिलीज़ पूरा करें: Seedream 4.5 से एल्बम आर्टवर्क और Seedance 2.0 से एक छोटा वीडियो क्लिप बनाएँ, ताकि आपके गाने की आवाज़ के साथ उसका चेहरा भी हो।
आज एक प्रॉम्प्ट आज़माएँ। अगर यह उससे ज़्यादा साफ़ सुनाई दे जिससे आप अब तक जूझ रहे थे, तो आपको अपना नया डिफ़ॉल्ट मिल गया है।