AI कॉपीराइट मुकदमे उस लिटिगेशन की लहर को संदर्भित करते हैं, जो 2022 में शुरू हुई और 2020 के दशक के मध्य तक जारी रही, जिसे लेखकों, कलाकारों, समाचार प्रकाशकों, संगीत लेबलों और अन्य अधिकार धारकों ने AI कंपनियों के खिलाफ जनरेटिव मॉडल को प्रशिक्षित करने के लिए कॉपीराइट सामग्री के उपयोग और उन मॉडलों द्वारा उत्पादित आउटपुट पर लाया। ये मामले सामूहिक रूप से परीक्षण करते हैं कि क्या बिना लाइसेंस के कॉपीराइट किए गए कार्यों पर प्रशिक्षण अमेरिकी कॉपीराइट कानून के तहत उचित उपयोग के रूप में योग्य है, और क्या AI-जनित आउटपुट जो संरक्षित कार्यों से मिलते-जुलते हैं, उल्लंघन का गठन करते हैं।
प्रमुख मामले
दृश्य कलाकारों ने स्टेबिलिटी AI, मिडजर्नी और DeviantArt के खिलाफ स्टेबल डिफ्यूजन और समान प्रणालियों के लिए उपयोग किए गए प्रशिक्षण डेटा पर कुछ शुरुआती मुकदमे दायर किए। Getty Images ने अलग से यूके और अमेरिका दोनों में स्टेबिलिटी AI पर मुकदमा किया, जिसमें लाखों कॉपीराइट छवियों के उपयोग का आरोप लगाया, और आउटपुट की ओर इशारा किया जो Getty के वॉटरमार्क के विकृत संस्करण को पुन: प्रस्तुत करते दिखे, जो प्रत्यक्ष प्रतिलिपि के साक्ष्य के रूप में था। न्यूयॉर्क टाइम्स ने दिसंबर 2023 में OpenAI और माइक्रोसॉफ्ट पर मुकदमा किया, जिसमें आरोप लगाया कि ChatGPT और Bing की AI सुविधाओं को टाइम्स के लेखों पर प्रशिक्षित किया गया था और वे लगभग शब्द-दर-शब्द पुन: उत्पन्न कर सकते थे, और उसकी सामग्री पर प्रशिक्षित मॉडलों के विनाश के साथ-साथ हर्जाने की मांग की। लेखकों के समूहों, जिनमें प्रमुख उपन्यासकार शामिल थे, ने पायरेटेड पुस्तक डेटासेट के उपयोग पर OpenAI, मेटा और अन्य डेवलपर्स के खिलाफ क्लास-एक्शन मुकदमे दायर किए। रिकॉर्डिंग इंडस्ट्री एसोसिएशन ऑफ अमेरिका ने, प्रमुख रिकॉर्ड लेबलों की ओर से, 2024 में कॉपीराइट रिकॉर्डिंग पर प्रशिक्षण के लिए AI संगीत जनरेटर सुनो और उसके प्रतिद्वंद्वी Udio पर मुकदमा किया।
निर्णय और समझौते
परिणाम मिश्रित थे और धीरे-धीरे विकसित हुए, बजाय एक ही निर्णय में अंतर्निहित प्रश्न को हल करने के। कुछ शुरुआती मामलों को प्रक्रियात्मक आधार पर संकुचित या खारिज कर दिया गया, जबकि अन्य खोज के चरण में आगे बढ़े और ऐसे निर्णय उत्पन्न किए जो अदालत और विशिष्ट तथ्यों के अनुसार भिन्न थे, कुछ न्यायाधीशों ने प्रशिक्षण के पहलुओं को दूसरों की तुलना में उचित उपयोग होने की अधिक संभावना पाया, विशेष रूप से जहां आउटपुट संरक्षित अभिव्यक्ति को बारीकी से पुन: उत्पन्न नहीं करते थे। पूर्ण परीक्षण परिणामों की प्रतीक्षा करने के बजाय, कई AI कंपनियों ने प्रकाशकों और सामग्री मालिकों के साथ लाइसेंसिंग सौदों को एक समानांतर रणनीति के रूप में आगे बढ़ाया, जिसमें OpenAI और प्रमुख समाचार और मीडिया संगठनों के बीच समझौते शामिल थे, जिससे समय के साथ सक्रिय लिटिगेशन में शेष पक्षों की संख्या कम हो गई।
महत्व
ये मुकदमे AI और कॉपीराइट नीति में व्यापक बहसों के केंद्र में हैं, जो प्रशिक्षण-डेटा की उत्पत्ति, कॉमन क्रॉल जैसे बड़े पैमाने के वेब अभिलेखागार के उपयोग, और AI डेवलपर्स और रचनात्मक और पत्रकारिता उद्योगों के बीच आर्थिक संबंधों से जुड़े चिंताओं के साथ प्रतिच्छेद करते हैं, जिनका काम प्रीट्रेनिंग डेटासेट को ईंधन देता है। इन मामलों ने यह भी आकार दिया कि AI प्रयोगशालाएं आगे चलकर डेटा लाइसेंसिंग और प्रकटीकरण के बारे में कैसे दृष्टिकोण रखती हैं, और EU AI अधिनियम और अन्य उभरते AI शासन ढांचों से संबंधित नीति चर्चाओं में अक्सर उद्धृत किया गया, जिनमें से कई ने प्रशिक्षण डेटा स्रोतों के आसपास विशिष्ट पारदर्शिता आवश्यकताओं को जोड़ा।