Authors Guild v. OpenAI एक कॉपीराइट उल्लंघन मुकदमा है जो 2023 में संयुक्त राज्य अमेरिका के दक्षिणी जिले के लिए जिला न्यायालय में दायर किया गया था। वादी, Authors Guild द्वारा प्रतिनिधित्व किए गए लेखकों का एक समूह, आरोप लगाते हैं कि OpenAI ने उनकी कॉपीराइट पुस्तकों का उपयोग बिना अनुमति के अपने बड़े भाषा मॉडल, जिसमें GPT-3 और GPT-4 शामिल हैं, को प्रशिक्षित करने के लिए किया। यह मामला जनरेटिव AI कंपनियों की प्रथाओं के लिए कई हाई-प्रोफाइल कानूनी चुनौतियों में से एक है, जो मशीन लर्निंग पर उचित उपयोग सिद्धांत के आवेदन के बारे में प्रश्न उठाता है।
यह मुकदमा 19 सितंबर, 2023 को Authors Guild और सत्रह व्यक्तिगत लेखकों, जिनमें डेविड बाल्डैकी, जॉन ग्रिशम, और जॉर्ज आर.आर. मार्टिन शामिल हैं, द्वारा शुरू किया गया था। वादी दावा करते हैं कि OpenAI की प्रशिक्षण प्रक्रिया में उनके कार्यों को डेटासेट में कॉपी करना शामिल था, जिनका उपयोग मॉडलों को प्रशिक्षित करने के लिए किया गया, जो प्रत्यक्ष और विकृत कॉपीराइट उल्लंघन का गठन करता है। वे यह भी आरोप लगाते हैं कि OpenAI ने इन अनधिकृत प्रतियों से लाभ कमाया, जिससे 1976 के कॉपीराइट अधिनियम के तहत उनके विशेष अधिकारों का उल्लंघन हुआ।
प्रारंभिक शिकायत और कानूनी तर्क
मूल शिकायत में वैधानिक क्षति और निषेधाज्ञा राहत की मांग की गई, यह तर्क देते हुए कि OpenAI का कॉपीराइट ग्रंथों का उपयोग परिवर्तनकारी नहीं था क्योंकि मॉडल कार्यों की अभिव्यंजक सामग्री को पुन: प्रस्तुत करते हैं और उससे मूल्य प्राप्त करते हैं। वादी ने इस बात पर जोर दिया कि OpenAI के मॉडल ऐसे पाठ उत्पन्न कर सकते हैं जो मूल पुस्तकों की शैली और सामग्री को बारीकी से दर्शाते हैं, जिससे लेखकों के कार्यों के बाजार को कमजोर किया जाता है।
OpenAI ने 2024 की शुरुआत में खारिज करने का प्रस्ताव दायर करके जवाब दिया, यह दावा करते हुए कि प्रशिक्षण में कॉपीराइट सामग्री का उपयोग उचित उपयोग सिद्धांत के तहत संरक्षित है। कंपनी ने तर्क दिया कि प्रशिक्षण प्रक्रिया परिवर्तनकारी है, क्योंकि यह नए, गैर-अभिव्यंजक आउटपुट बनाती है, और मॉडल मूल पुस्तकों के विकल्प के रूप में काम नहीं करते हैं। OpenAI ने यह भी कहा कि वादी अभिवेदन मानकों के अनुसार उल्लंघन के विशिष्ट उदाहरणों का आरोप लगाने में विफल रहे।
संशोधित शिकायत और नए आरोप
18 मार्च, 2024 को, वादी ने एक संशोधित शिकायत दायर की, जिसमें अधिक लेखकों को जोड़ा गया और उनके दावों को परिष्कृत किया गया। संशोधित शिकायत में मॉडलों द्वारा वादी की पुस्तकों के अंशों को बारीकी से व्याख्या या पुन: प्रस्तुत करने वाले पाठ उत्पन्न करने के विशिष्ट उदाहरण शामिल थे, जिन्हें वादी ने प्रत्यक्ष उल्लंघन का प्रदर्शन करने के रूप में तर्क दिया। संशोधित शिकायत में अन्यायपूर्ण संवर्धन और अनुचित प्रतिस्पर्धा के दावे भी पेश किए गए, हालांकि बाद के दाखिलों में इन्हें हटा दिया गया।
संशोधित शिकायत में अतिरिक्त प्रतिवादियों का नाम लिया गया, जिसमें Microsoft शामिल था, जिसने OpenAI में भारी निवेश किया था और Microsoft Azure के माध्यम से क्लाउड बुनियादी ढांचा प्रदान किया था। वादी ने आरोप लगाया कि Microsoft मॉडलों के प्रशिक्षण और तैनाती से लाभ कमाने के कारण उल्लंघन के लिए संयुक्त रूप से उत्तरदायी था। Microsoft ने अपना खारिज करने का प्रस्ताव दायर किया, यह तर्क देते हुए कि उसका प्रशिक्षण प्रक्रिया में कोई सीधा संबंध नहीं था।
खारिज करने के प्रस्तावों पर निर्णय
9 जुलाई, 2024 को, न्यायाधीश सिडनी एच. स्टीन ने खारिज करने के प्रस्तावों पर एक निर्णय जारी किया। अदालत ने वादी के कई दावों को खारिज कर दिया, जिनमें विकृत उल्लंघन और अन्यायपूर्ण संवर्धन के दावे शामिल थे, लेकिन मुख्य प्रत्यक्ष उल्लंघन के दावों को आगे बढ़ने की अनुमति दी। अदालत ने पाया कि वादी ने पर्याप्त रूप से आरोप लगाया कि OpenAI ने उनके कार्यों की प्रतिलिपि बनाई, और उचित उपयोग बचाव को खारिज करने के प्रस्ताव के बजाय सारांश निर्णय चरण में बेहतर ढंग से संबोधित किया जाना चाहिए।
निर्णय ने वैधानिक क्षति के मुद्दे को भी संबोधित किया, यह ध्यान देते हुए कि वादी उन कार्यों के लिए उन्हें मांग सकते हैं जो अमेरिकी कॉपीराइट कार्यालय के साथ पंजीकृत हैं। अदालत ने Microsoft के खिलाफ दावों को खारिज कर दिया, यह पाते हुए कि वादी ने पर्याप्त रूप से आरोप नहीं लगाया कि Microsoft के पास उल्लंघनकारी गतिविधि की निगरानी करने का अधिकार और क्षमता थी, जो विकृत दायित्व के लिए एक आवश्यकता है।
उचित उपयोग और परिवर्तनकारी उपयोग बहस
मामले में केंद्रीय कानूनी प्रश्न यह है कि क्या कॉपीराइट ग्रंथों पर Large language model प्रशिक्षण उचित उपयोग का गठन करता है। उचित उपयोग सिद्धांत, कॉपीराइट अधिनियम की धारा 107 में संहिताबद्ध, चार कारकों पर विचार करता है: उपयोग का उद्देश्य और चरित्र, कॉपीराइट कार्य की प्रकृति, उपयोग किए गए हिस्से की मात्रा और महत्वपूर्णता, और कार्य के संभावित बाजार पर प्रभाव।
OpenAI तर्क देता है कि उपयोग परिवर्तनकारी है क्योंकि मॉडल मूल कार्यों को पुन: प्रस्तुत नहीं करते हैं बल्कि उनसे सांख्यिकीय पैटर्न सीखते हैं। कंपनी इस तथ्य की ओर इशारा करती है कि मॉडल नए पाठ उत्पन्न करने के लिए डिज़ाइन किए गए हैं, न कि मौजूदा कार्यों के भंडार के रूप में काम करने के लिए। वादी इसका प्रतिवाद करते हैं कि प्रतिलिपि परिवर्तनकारी नहीं है क्योंकि मॉडल मूल कार्यों की शैली और सामग्री की नकल करने के लिए प्रशिक्षित हैं, और OpenAI के संचालन की व्यावसायिक प्रकृति उचित उपयोग के खिलाफ है।
खोज और साक्ष्य
जुलाई 2024 के निर्णय के बाद, मामला खोज चरण में प्रवेश कर गया। वादी ने OpenAI के प्रशिक्षण डेटा और कॉपीराइट सामग्री के उपयोग के संबंध में आंतरिक संचार तक पहुंच की मांग की। OpenAI ने इनमें से कुछ अनुरोधों का विरोध किया है, व्यापार रहस्य संरक्षण और विशाल मात्रा में डेटा उत्पादन के बोझ का हवाला देते हुए।
अक्टूबर 2024 में, अदालत ने OpenAI को अपने प्रशिक्षण डेटासेट में उपयोग की गई पुस्तकों की एक सूची उत्पादन करने का आदेश दिया, लेकिन कंपनी को कुछ मालिकाना जानकारी को संपादित करने की अनुमति दी। वादी ने OpenAI के प्रमुख अधिकारियों, जिसमें CEO सैम ऑल्टमैन शामिल हैं, से पूछताछ करने की भी मांग की है, हालांकि अदालत ने अभी तक उन अनुरोधों पर निर्णय नहीं दिया है।
संबंधित मामले और उद्योग प्रभाव
Authors Guild मामला AI कंपनियों के खिलाफ मुकदमेबाजी की एक व्यापक लहर का हिस्सा है। अन्य लेखकों द्वारा समान मुकदमे दायर किए गए हैं, जिसमें सारा सिल्वरमैन के नेतृत्व में एक क्लास एक्शन और द न्यूयॉर्क टाइम्स जैसे समाचार संगठन शामिल हैं। इन मामलों को Artificial intelligence उद्योग द्वारा बारीकी से देखा जा रहा है, क्योंकि परिणाम AI मॉडलों के प्रशिक्षण और तैनाती के तरीके के लिए मिसाल स्थापित कर सकते हैं।
मामले ने नीति निर्माताओं का भी ध्यान आकर्षित किया है। 2024 में, अमेरिकी कॉपीराइट कार्यालय ने AI और कॉपीराइट पर एक रिपोर्ट जारी की, जिसमें कांग्रेस से प्रशिक्षण डेटा के लिए उचित उपयोग के दायरे को स्पष्ट करने की सिफारिश की गई। रिपोर्ट में कहा गया कि वर्तमान कानून अस्पष्ट है और रचनाकारों और AI डेवलपर्स दोनों के लिए निश्चितता प्रदान करने के लिए विधायी कार्रवाई की आवश्यकता हो सकती है।
वर्तमान स्थिति और अगले कदम
2024 के अंत तक, मामला खोज चरण में है, दोनों पक्ष संभावित सारांश निर्णय प्रस्तावों के लिए तैयारी कर रहे हैं। अदालत ने खोज की प्रगति और किसी भी शेष प्रस्ताव पर चर्चा करने के लिए जनवरी 2025 के लिए एक स्थिति सम्मेलन निर्धारित किया है। एक परीक्षण तिथि निर्धारित नहीं की गई है, लेकिन कानूनी विशेषज्ञों को उम्मीद है कि मामला सारांश निर्णय या समझौते के माध्यम से हल हो जाएगा, पूर्ण परीक्षण की जटिलता और लागत को देखते हुए।
Authors Guild v. OpenAI का परिणाम Generative AI उद्योग के लिए महत्वपूर्ण प्रभाव डाल सकता है। यदि अदालत पाती है कि कॉपीराइट कार्यों पर प्रशिक्षण उचित उपयोग नहीं है, तो AI कंपनियों को प्रशिक्षण डेटा के लिए लाइसेंस प्राप्त करने की आवश्यकता हो सकती है, जिससे लागत बढ़ सकती है और नवाचार धीमा हो सकता है। इसके विपरीत, OpenAI के पक्ष में एक निर्णय AI विकास में बड़े पैमाने पर वेब स्क्रैपिंग के निरंतर उपयोग के लिए एक कानूनी आधार प्रदान कर सकता है।
व्यापक संदर्भ और विद्वान टिप्पणी
कानूनी विद्वानों ने मामले पर अलग-अलग दृष्टिकोण पेश किए हैं। कुछ तर्क देते हैं कि उचित उपयोग सिद्धांत को नई तकनीकों को समायोजित करने के लिए लचीले ढंग से व्याख्या की जानी चाहिए, कॉपीराइट कानून के इतिहास का हवाला देते हुए जो फोटोकॉपियर और VCR जैसे नवाचारों के अनुकूल हुआ है। अन्य का तर्क है कि AI प्रशिक्षण में प्रतिलिपि का पैमाना अभूतपूर्व है और लेखकों को आर्थिक नुकसान वास्तविक है, विशेष रूप से उन लोगों के लिए जिनके कार्यों का उपयोग प्रतिस्पर्धी सामग्री उत्पन्न करने वाले मॉडलों को प्रशिक्षित करने के लिए किया जाता है।
मामले ने AI के युग में रचनात्मकता और लेखकत्व की प्रकृति के बारे में बहस भी छेड़ दी है। कुछ टिप्पणीकारों ने सुझाव दिया है कि मुकदमा एक व्यापक चिंता को दर्शाता है जो मानव लेखकों की भूमिका के बारे में है जब मशीनें ऐसा पाठ उत्पन्न कर सकती हैं जो मानव लेखन से अप्रभेद्य है। अन्य ने बताया है कि वादी AI के खिलाफ नहीं हैं, बल्कि उनके कार्यों के बिना मुआवजे के उपयोग के खिलाफ हैं।
संभावित परिणाम और मिसालें
यदि मामला गुण-दोष पर निर्णय के लिए आगे बढ़ता है, तो अदालत को AI प्रशिक्षण के विशिष्ट तथ्यों पर चार-कारक उचित उपयोग परीक्षण लागू करना होगा। अदालत विचार कर सकती है कि क्या मॉडलों के आउटपुट पर्याप्त रूप से परिवर्तनकारी हैं, क्या उपयोग किए गए कार्य मुख्य रूप से तथ्यात्मक या रचनात्मक हैं, और क्या प्रशिक्षण प्रक्रिया आवश्यकता से अधिक प्रतिलिपि बनाती है। बाजार हानि कारक केंद्रीय होने की संभावना है, क्योंकि वादी तर्क देंगे कि मॉडल उनकी पुस्तकों की मांग को कम करते हैं, जबकि OpenAI का तर्क होगा कि मॉडल मूल कार्यों के साथ प्रतिस्पर्धा नहीं करते हैं।
वादी के पक्ष में एक निर्णय AI कंपनियों के लिए प्रशिक्षण डेटा के लिए लाइसेंस प्राप्त करने की आवश्यकता पैदा कर सकता है, संभावित रूप से कॉपीराइट कार्यों के लिए एक नया बाजार बना सकता है। OpenAI के पक्ष में एक निर्णय इस विचार को मजबूत कर सकता है कि AI प्रशिक्षण उचित उपयोग है, लेकिन यह रचनाकारों की चिंताओं को संबोधित करने के लिए विधायी कार्रवाई को भी प्रेरित कर सकता है। किसी भी तरह, मामले की अपील होने की संभावना है, और अंतिम समाधान अंततः सुप्रीम कोर्ट से आ सकता है।
निष्कर्ष
Authors Guild v. OpenAI एक ऐतिहासिक मामला है जो AI और कॉपीराइट के लिए कानूनी परिदृश्य को आकार देगा। संशोधित शिकायतों और निर्णयों ने दावों के दायरे को स्पष्ट किया है, लेकिन उचित उपयोग का मूल प्रश्न अनसुलझा है। जैसे-जैसे मामला आगे बढ़ता है, यह कानूनी, प्रौद्योगिकी और रचनात्मक समुदायों से ध्यान आकर्षित करता रहेगा, और इसका परिणाम Machine learning के विकास और बौद्धिक संपदा के संरक्षण के लिए स्थायी प्रभाव डालेगा।