अंग्रेज़ी से अनुवादित

AI संगीत निर्माण मशीन लर्निंग मॉडल का उपयोग करके संगीत रचना या उत्पादन करता है, जिसमें पाठ विवरण से स्वरों सहित पूर्ण गीत शामिल हैं, यह एक ऐसा क्षेत्र है जिसने 2023 से व्यावसायिक विकास और कॉपीराइट संघर्ष में तेजी देखी।

AI संगीत निर्माण उन प्रणालियों को संदर्भित करता है जो मशीन लर्निंग का उपयोग करके संगीत रचना, व्यवस्था या उत्पादन करती हैं, जिसमें छोटे वाद्य लूप उत्पन्न करने वाले उपकरणों से लेकर उन प्रणालियों तक शामिल हैं जो शैली, मनोदशा और गीतों का वर्णन करने वाले टेक्स्ट प्रॉम्प्ट से गायन सहित एक पूरा गाना तैयार कर सकती हैं।

इतिहास

एल्गोरिदमिक रचना दशकों से डीप लर्निंग से पहले की है, लेकिन संगीत निर्माण के लिए तंत्रिका दृष्टिकोण ने Google के WaveNet-व्युत्पन्न ऑडियो कार्य और OpenAI के MuseNet और Jukebox जैसे मॉडलों के साथ गति प्राप्त की, जो 2019 और 2020 में जारी किए गए थे, जो विभिन्न कलाकारों और शैलियों की शैली में कच्चा ऑडियो उत्पन्न कर सकते थे, हालांकि आउटपुट गुणवत्ता और लंबे टुकड़ों पर सुसंगतता सीमित रही। यह क्षेत्र 2023 और 2024 में सुनो और Udio के उद्भव के साथ मुख्यधारा के उपयोग की ओर निर्णायक रूप से स्थानांतरित हो गया, जिसने उपयोगकर्ताओं को एक छोटे टेक्स्ट विवरण से एक मिनट से भी कम समय में गीत और गायन सहित पूरे गाने उत्पन्न करने की अनुमति दी, जिससे परिष्कार और शैली बहुमुखी प्रतिभा का स्तर प्राप्त हुआ जिसने आकस्मिक श्रोताओं के लिए आउटपुट को मानव-निर्मित संगीत से अलग करना मुश्किल बना दिया।

तकनीकी दृष्टिकोण

आधुनिक टेक्स्ट-से-संगीत प्रणालियाँ आमतौर पर एक ऑटोरेग्रेसिव मॉडल घटक को जोड़ती हैं जो संरचना और गीतों की योजना बनाता है, एक डिफ्यूजन मॉडल या ऑटोरेग्रेसिव ऑडियो जनरेटर के साथ जो वास्तविक तरंग या एक मध्यवर्ती स्पेक्ट्रोग्राम प्रतिनिधित्व प्रस्तुत करता है, जो टेक्स्ट-से-स्पीच और टेक्स्ट-से-वीडियो में उपयोग की जाने वाली तकनीकों की भावना के समान है। कुछ प्रणालियाँ सीधे अंत-से-अंत तक ऑडियो उत्पन्न करती हैं, जबकि अन्य रचना, व्यवस्था और स्वर संश्लेषण को चरणों में अलग करती हैं। वॉयस क्लोनिंग के समान, संदर्भ आवाज या शैली पर पीढ़ी को सशर्त बनाने की क्षमता ने किसी विशिष्ट वास्तविक कलाकार की गायन आवाज की नकल करने वाले गाने उत्पन्न करने की संभावना बढ़ा दी।

कॉपीराइट और उद्योग प्रतिक्रिया

संगीत निर्माण विशेष रूप से विवादास्पद रहा है क्योंकि इन मॉडलों के लिए प्रशिक्षण डेटा में अक्सर लाइसेंस के बिना कॉपीराइट वाणिज्यिक रिकॉर्डिंग शामिल होती है। 2024 में, Universal Music Group, Sony Music और Warner Music सहित प्रमुख रिकॉर्ड लेबलों ने Suno और Udio के खिलाफ बड़े पैमाने पर कॉपीराइट उल्लंघन का आरोप लगाते हुए मुकदमे दायर किए, जो जनरेटिव एआई कंपनियों का सामना करने वाले एआई कॉपीराइट मुकदमों की व्यापक लहर का हिस्सा था। YouTube और Spotify सहित कुछ प्लेटफार्मों ने एआई-जनित ट्रैक के लिए प्रकटीकरण आवश्यकताओं और हटाने के तंत्र पेश या चर्चा की, और क्या एआई-सहायता प्राप्त या एआई-जनित गाने कॉपीराइट सुरक्षा, स्ट्रीमिंग रॉयल्टी या चार्ट पात्रता के लिए योग्य हैं, ये प्रश्न 2020 के दशक के मध्य तक अधिकांश क्षेत्राधिकारों में अनसुलझे रहे।

स्वागत

संगीतकारों और निर्माताओं में विभाजन रहा है: कुछ ने विचारों को डेमो करने, बैकिंग ट्रैक बनाने या रचनात्मक अवरोधों को दूर करने के लिए जनरेटिव टूल को अपनाया, जबकि अन्य ने तकनीक को सत्र संगीतकारों, संगीतकारों और स्वतंत्र कलाकारों की आजीविका के लिए सीधा खतरा माना, जो टेक्स्ट-से-इमेज निर्माण में श्रम विस्थापन के बारे में उठाई गई चिंताओं को प्रतिध्वनित करता है। स्ट्रीमिंग प्लेटफार्मों ने भी रॉयल्टी फार्मिंग के लिए बड़े पैमाने पर अपलोड किए गए एआई-जनित ट्रैक में वृद्धि की सूचना दी, जो एआई स्लॉप के तहत वर्णित सामग्री बाढ़ के बारे में व्यापक चिंताओं में योगदान देता है। 2020 के दशक के मध्य तक, एआई-जनित संगीत एक नवीनता से प्रमुख प्लेटफार्मों पर नए अपलोड के मापने योग्य हिस्से में स्थानांतरित हो गया था, भले ही इसकी कानूनी स्थिति विवादित बनी रही।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:generative-ai·audio-ai·industry
इस पृष्ठ को अंतिम बार संपादित किया गया 2 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास