Getty v. Stability (2023) एक कॉपीराइट उल्लंघन मुकदमा है जो Getty Images द्वारा Stability AI के खिलाफ दायर किया गया है, जो Stable Diffusion छवि-निर्माण मॉडल का डेवलपर है। यह मामला, जनवरी 2023 में डेलावेयर के लिए संयुक्त राज्य जिला न्यायालय में शुरू किया गया था, आरोप लगाता है कि Stability AI ने अपने Generative AI मॉडल को प्रशिक्षित करने के लिए Getty के डेटाबेस से लाखों छवियों को बिना अनुमति के कॉपी और प्रोसेस किया। मुकदमा वैधानिक हर्जाना, निषेधाज्ञा राहत, और उल्लंघनकारी प्रशिक्षण डेटा के विनाश की मांग करता है।
विवाद Deep learning प्रणालियों के प्रशिक्षण में वेब-स्क्रैप की गई छवियों के उपयोग पर केंद्रित है। Getty Images, एक प्रमुख स्टॉक फोटो एजेंसी, दावा करती है कि Stability AI के कार्य उसके कॉपीराइट और उसके योगदानकर्ताओं के कॉपीराइट का उल्लंघन करते हैं। Stability AI ने तर्क दिया है कि सार्वजनिक रूप से उपलब्ध छवियों का उसका उपयोग उचित उपयोग के अंतर्गत आता है, एक बचाव जो Artificial intelligence क्षेत्र में कई समान मामलों में केंद्रीय रहा है।
मामले की पृष्ठभूमि
2022 में, Stability AI ने Stable Diffusion जारी किया, एक ओपन-सोर्स Neural network मॉडल जो टेक्स्ट प्रॉम्प्ट से विस्तृत छवियां उत्पन्न करने में सक्षम है। मॉडल को LAION-5B नामक डेटासेट पर प्रशिक्षित किया गया था, जिसमें इंटरनेट से स्क्रैप किए गए अरबों छवि-पाठ जोड़े शामिल थे। Getty Images, जो लाखों तस्वीरों का लाइसेंस देती है, ने आरोप लगाया कि उसकी स्वामित्व वाली छवियों का एक महत्वपूर्ण हिस्सा बिना अनुमति के इस डेटासेट में शामिल किया गया था।
Getty Images ने 13 जनवरी, 2023 को डेलावेयर के लिए अमेरिकी जिला न्यायालय में अपनी शिकायत दर्ज की। मुकदमा Stability AI, साथ ही इसके सीईओ, Emad Mostaque, और कंपनी की अमेरिकी सहायक कंपनी, Stability AI Ltd को नामित करता है। शिकायत प्रत्यक्ष, योगदानकारी, और विकृत कॉपीराइट उल्लंघन, साथ ही कॉपीराइट प्रबंधन जानकारी को हटाने या बदलने के लिए डिजिटल मिलेनियम कॉपीराइट अधिनियम (DMCA) के उल्लंघन का दावा करती है।
कानूनी दावे और तर्क
Getty Images का प्राथमिक दावा है कि Stability AI ने प्रशिक्षण प्रक्रिया के दौरान लाखों कॉपीराइट छवियों को पुनरुत्पादित और संग्रहीत किया। कंपनी का तर्क है कि यह पुनरुत्पादन परिवर्तनकारी नहीं है और Stability AI के उपयोग की व्यावसायिक प्रकृति उचित उपयोग के खिलाफ है। Getty यह भी दावा करती है कि Stable Diffusion ऐसी छवियां उत्पन्न कर सकता है जो मूल तस्वीरों से काफी मिलती-जुलती हैं, जिसमें वॉटरमार्क और अन्य पहचान चिह्न शामिल हैं, जो उचित उपयोग बचाव को और कमजोर करता है।
Stability AI ने यह कहते हुए जवाब दिया है कि सार्वजनिक रूप से उपलब्ध छवियों पर प्रशिक्षण एक कानूनी उचित उपयोग है, जैसे एक मानव कलाकार मौजूदा कार्यों से सीखता है। कंपनी ने यह भी तर्क दिया है कि Stable Diffusion द्वारा उत्पन्न छवियां नई, परिवर्तनकारी कृतियां हैं जो किसी विशिष्ट कॉपीराइट का उल्लंघन नहीं करती हैं। Stability AI ने मामले को खारिज करने की मांग की है, लेकिन अदालत ने दावों को आगे बढ़ने की अनुमति दी है, यह संकेत देते हुए कि कानूनी प्रश्न महत्वपूर्ण हैं।
संबंधित मुकदमे और उद्योग प्रभाव
Getty v. Stability मामला Generative AI कंपनियों के खिलाफ मुकदमेबाजी की एक व्यापक लहर का हिस्सा है। जनवरी 2023 में, तीन कलाकारों - Sarah Andersen, Kelly McKernan, और Karla Ortiz - ने Stability AI, Midjourney, और DeviantArt के खिलाफ एक वर्ग-कार्रवाई मुकदमा दायर किया, जिसमें समान कॉपीराइट उल्लंघन का आरोप लगाया गया। वह मामला, Andersen v. Stability AI, बाद में आंशिक रूप से खारिज कर दिया गया था लेकिन कुछ दावों पर आगे बढ़ने की अनुमति दी गई थी। अन्य मुकदमे लेखकों द्वारा OpenAI और Anthropic के खिलाफ Large language model के प्रशिक्षण में कॉपीराइट पाठ के उपयोग पर दायर किए गए हैं।
इन मामलों के Artificial intelligence उद्योग के लिए महत्वपूर्ण निहितार्थ हैं। यदि अदालतें AI कंपनियों के खिलाफ फैसला सुनाती हैं, तो उन्हें प्रशिक्षण डेटा का लाइसेंस लेने की आवश्यकता हो सकती है, जो लागत बढ़ा सकता है और भविष्य के मॉडलों के विकास को बदल सकता है। इसके विपरीत, उचित उपयोग के पक्ष में एक फैसला सार्वजनिक रूप से उपलब्ध डेटा पर प्रशिक्षण की वैधता को मजबूत कर सकता है, आगे नवाचार को प्रोत्साहित कर सकता है।
प्रशिक्षण डेटा की भूमिका
विवाद का मूल इस बात में निहित है कि Machine learning मॉडल कैसे प्रशिक्षित किए जाते हैं। Stable Diffusion एक प्रकार का Generative AI मॉडल है जो U-Net आर्किटेक्चर और प्रसार नामक एक प्रक्रिया का उपयोग करके छवियां उत्पन्न करता है। प्रशिक्षण प्रक्रिया में मॉडल को लाखों छवियों और उनके संबंधित पाठ विवरणों को खिलाना शामिल है, जिससे यह दृश्य विशेषताओं और भाषा के बीच सांख्यिकीय संबंधों को सीख सके।
Getty Images का तर्क है कि इस प्रक्रिया में उसके कॉपीराइट कार्यों का अनधिकृत पुनरुत्पादन शामिल है। कंपनी ने बताया है कि Stable Diffusion कभी-कभी अपने डेटाबेस से छवियों की लगभग सटीक प्रतियां पुन: उत्पन्न कर सकता है, जिसमें Getty Images वॉटरमार्क भी शामिल है। Getty का दावा है कि यह प्रदर्शित करता है कि मॉडल ने कॉपीराइट सामग्री को याद कर लिया है और उसे आउटपुट कर सकता है, जो उचित उपयोग नहीं है।
प्रक्रियात्मक इतिहास और वर्तमान स्थिति
Getty द्वारा शिकायत दर्ज करने के बाद, Stability AI ने मामले को खारिज करने के लिए आगे बढ़ते हुए तर्क दिया कि दावे अनुमानित थे और कंपनी ने सीधे किसी कॉपीराइट का उल्लंघन नहीं किया था। 2023 के अंत में एक फैसले में, अदालत ने खारिज करने के प्रस्ताव को अस्वीकार कर दिया, जिससे मामले को खोज चरण में आगे बढ़ने की अनुमति मिली। अदालत ने पाया कि Getty ने प्रशंसनीय रूप से आरोप लगाया था कि Stability AI ने उसकी छवियों को कॉपी किया था और उचित उपयोग बचाव इस स्तर पर दावों को खारिज करने के लिए पर्याप्त नहीं था।
शुरुआती 2025 तक, मामला अभी भी खोज चरण में है। दोनों पक्ष व्यापक दस्तावेज़ उत्पादन और बयानों में लगे हुए हैं। एक परीक्षण तिथि अभी तक निर्धारित नहीं की गई है। इस मामले का परिणाम एक मिसाल स्थापित कर सकता है कि कॉपीराइट कानून Artificial intelligence प्रशिक्षण पर कैसे लागू होता है, जो न केवल Stability AI बल्कि OpenAI, Anthropic, और Google DeepMind जैसी अन्य कंपनियों को भी प्रभावित करेगा।
व्यापक संदर्भ: AI और कॉपीराइट कानून
Getty v. Stability मामला कई उच्च-प्रोफ़ाइल विवादों में से एक है जिसने AI और कॉपीराइट के बारे में कानूनी और नियामक चर्चाओं को प्रेरित किया है। संयुक्त राज्य अमेरिका में, कॉपीराइट कार्यालय ने मार्गदर्शन जारी किया है जिसमें कहा गया है कि पूरी तरह से AI द्वारा उत्पन्न कार्य कॉपीराइट सुरक्षा के पात्र नहीं हैं, लेकिन क्या कॉपीराइट कार्यों पर प्रशिक्षण उल्लंघन है, यह सवाल अनसुलझा है। यूरोपीय संघ में, AI अधिनियम में प्रशिक्षण डेटा के बारे में पारदर्शिता की आवश्यकता वाले प्रावधान शामिल हैं, लेकिन यह स्पष्ट रूप से कॉपीराइट को संबोधित नहीं करता है।
कुछ विशेषज्ञों का तर्क है कि वर्तमान कॉपीराइट कानून AI प्रशिक्षण की जटिलताओं को संभालने के लिए अपर्याप्त है। वे सुझाव देते हैं कि कॉपीराइट धारकों और AI डेवलपर्स के हितों को संतुलित करने के लिए नए कानून की आवश्यकता हो सकती है। अन्य लोग मानते हैं कि उचित उपयोग पर्याप्त है और अदालतें अंततः सार्वजनिक रूप से उपलब्ध डेटा पर प्रशिक्षण की वैधता को बरकरार रखेंगी।
संभावित परिणाम और निहितार्थ
यदि Getty Images की जीत होती है, तो Stability AI को पर्याप्त हर्जाना देने और अपने प्रशिक्षण डेटासेट को हटाने या नष्ट करने का आदेश दिया जा सकता है। इसका ओपन-सोर्स AI मॉडल के विकास पर ठंडा प्रभाव पड़ सकता है, क्योंकि अन्य डेवलपर्स बिना लाइसेंस के वेब-स्क्रैप किए गए डेटा पर प्रशिक्षण लेने से हिचकिचा सकते हैं। यह लाइसेंस प्राप्त प्रशिक्षण डेटा के लिए एक बाजार भी बना सकता है, जहां Getty Images जैसी कंपनियां AI प्रशिक्षण उद्देश्यों के लिए अपने अभिलेखागार तक पहुंच बेचती हैं।
यदि Stability AI जीतता है, तो यह धारणा को मजबूत करेगा कि सार्वजनिक रूप से उपलब्ध डेटा पर प्रशिक्षण एक उचित उपयोग है, जो AI विकास को तेज कर सकता है। हालांकि, यह अधिक आक्रामक स्क्रैपिंग प्रथाओं को भी जन्म दे सकता है, संभावित रूप से फोटोग्राफरों और अन्य सामग्री निर्माताओं को नुकसान पहुंचा सकता है जो लाइसेंसिंग शुल्क पर निर्भर हैं।
यह मामला Artificial intelligence समुदाय, कानूनी विद्वानों और सामग्री निर्माताओं द्वारा बारीकी से देखा जा रहा है। इसका समाधान संभवतः प्रभावित करेगा कि AI कंपनियां डेटा संग्रह कैसे करती हैं और क्या वे कॉपीराइट धारकों से लाइसेंस मांगती हैं। अभी तक, मामला लंबित है, और कोई अंतिम निर्णय जारी नहीं किया गया है।