लेखकों का OpenAI के विरुद्ध सामूहिक मुकदमा

अंग्रेज़ी से अनुवादित

OpenAI के विरुद्ध लेखकों द्वारा दायर एक सामूहिक मुकदमा, जिसमें बड़े भाषा मॉडलों के प्रशिक्षण में कॉपीराइट उल्लंघन का आरोप लगाया गया है, तथा कॉपीराइट कृतियों के अनधिकृत उपयोग के लिए क्षतिपूर्ति और निषेधात्मक राहत की मांग की गई है।

OpenAI के विरुद्ध लेखकों का सामूहिक मुकदमा एक समेकित कानूनी कार्यवाही है जिसमें लेखकों के एक समूह ने आरोप लगाया कि OpenAI, जो GPT-3 और GPT-4 जैसे बड़े भाषा मॉडलों का डेवलपर है, ने उनकी पुस्तकों और अन्य लिखित कृतियों का उपयोग अपनी कृत्रिम बुद्धिमत्ता प्रणालियों को प्रशिक्षित करने के लिए बिना अनुमति के करके उनके कॉपीराइट का उल्लंघन किया। यह मामला, जो संयुक्त राज्य अमेरिका के दक्षिणी न्यूयॉर्क जिले के संघीय न्यायालय में दायर किया गया था, कॉपीराइट किए गए पाठ पर जनरेटिव एआई को प्रशिक्षित करने की वैधता के बारे में व्यापक बहसों का केंद्र बिंदु बन गया। वादीगण ने वैधानिक हर्जाना, लाभ का समर्पण, और आगे के अनधिकृत उपयोग के विरुद्ध निषेधाज्ञा की मांग की, जबकि OpenAI ने तर्क दिया कि उसकी प्रशिक्षण प्रथाएँ उचित उपयोग सिद्धांत के अंतर्गत आती हैं।

यह मुकदमा एआई कंपनियों के विरुद्ध समान मुकदमों की लहर के बीच उभरा, जो रचनात्मक उद्योगों और Generative AI के तेजी से व्यावसायीकरण के बीच बढ़ते तनाव को दर्शाता है। लेखकों के दावे इस आधार पर केंद्रित थे कि OpenAI के Large language model, जो Transformer (architecture) आर्किटेक्चर पर निर्मित हैं और विशाल इंटरनेट कोरपोरा पर प्रशिक्षित हैं, अनिवार्य रूप से संरक्षित अभिव्यक्ति को पुनरुत्पादित और व्युत्पन्न करते हैं। खोज इंजन या छवि थंबनेल से जुड़े पहले के मामलों के विपरीत, इस मुकदमे ने प्रशिक्षण की मूलभूत प्रक्रिया को ही लक्षित किया, जिससे यह नए प्रश्न उठे कि क्या मशीन लर्निंग के लिए कॉपीराइट सामग्री का अंतर्ग्रहण उल्लंघन है।

पृष्ठभूमि और दायर करना

प्रारंभिक शिकायत 8 सितंबर, 2023 को सारा सिल्वरमैन, रिचर्ड काद्रे, और क्रिस्टोफर गोल्डन सहित लेखकों द्वारा दायर की गई थी, जिन्होंने आरोप लगाया कि OpenAI के प्रशिक्षण डेटा में उनकी पुस्तकें बिना प्राधिकरण के शामिल थीं। वादीगण ने दावा किया कि OpenAI के OpenAI मॉडल उनकी कृतियों के सारांश, व्याख्याएँ, और यहाँ तक कि शब्दशः अंश भी उत्पन्न कर सकते हैं, जो दर्शाता है कि प्रशिक्षण प्रक्रिया ने अभिव्यंजक तत्वों की नकल और भंडारण किया था। इस मामले को बाद में माइकल चैबन, ता-नेहिसी कोट्स, और हास्य कलाकार सारा सिल्वरमैन द्वारा लाए गए अन्य लेखक मुकदमों के साथ समेकित किया गया, जिसे "In re OpenAI ChatGPT Litigation" शीर्षक के अंतर्गत रखा गया।

लेखकों का प्रतिनिधित्व कानूनी फर्म सुस्मान गॉडफ्रे द्वारा किया गया, जिसने पहले उच्च-प्रोफ़ाइल बौद्धिक संपदा विवादों में मुकदमेबाजी की थी। शिकायत में विस्तार से बताया गया कि कैसे OpenAI ने प्रशिक्षण डेटासेट तैयार करने के लिए इंटरनेट के बड़े हिस्से, जिसमें पुस्तक भंडार और चोरी किए गए पाठ संग्रह शामिल थे, को स्क्रैप किया। इसमें आंतरिक OpenAI दस्तावेज़ और सार्वजनिक बयानों का हवाला दिया गया जो सुझाव देते थे कि कंपनी ने लाइसेंस के बिना कॉपीराइट सामग्री का उपयोग करने के कानूनी जोखिमों को पहचाना था। वादीगण ने तर्क दिया कि OpenAI के कार्य परिवर्तनकारी नहीं थे, बल्कि मौजूदा कृतियों का व्यावसायिक शोषण थे, क्योंकि मॉडल बाजार में मूल पुस्तकों के साथ प्रतिस्पर्धा करते थे।

कानूनी दावे और तर्क

मुख्य कानूनी दावा अमेरिकी कॉपीराइट अधिनियम, विशेष रूप से 17 U.S.C. § 501 के तहत प्रत्यक्ष कॉपीराइट उल्लंघन था। वादीगण ने आरोप लगाया कि OpenAI ने पुनरुत्पादन, व्युत्पन्न कृतियाँ तैयार करने, और प्रतियों के वितरण के उनके विशेष अधिकारों का उल्लंघन किया। उन्होंने सहायक उल्लंघन और अन्यायपूर्ण संवर्धन के दावे भी उठाए, यह तर्क देते हुए कि OpenAI ने उनके रचनात्मक श्रम के अनधिकृत उपयोग से लाभ कमाया। शिकायत में प्रति कृति $150,000 तक के वैधानिक हर्जाने की मांग की गई, जो कथित रूप से उल्लंघित कृतियों की संख्या को देखते हुए अरबों डॉलर तक हो सकता था।

OpenAI की बचाव मुख्य रूप से उचित उपयोग अपवाद पर आधारित थी, जो 17 U.S.C. § 107 में संहिताबद्ध है। कंपनी ने तर्क दिया कि मॉडल को प्रशिक्षित करना एक परिवर्तनकारी उपयोग है क्योंकि मॉडल मूल पाठ को पुनरुत्पादित नहीं करता, बल्कि सांख्यिकीय पैटर्न और भाषाई संरचनाएँ सीखता है। OpenAI ने कहा कि प्रशिक्षण का उद्देश्य एक सामान्य-उद्देश्यीय उपकरण बनाना है, न कि लेखकों की कृतियों को प्रतिस्थापित करना, और मॉडलों का आउटपुट शायद ही कभी स्रोत सामग्री से मिलता जुलता है। कंपनी ने यह भी नोट किया कि उसने शब्दशः कॉपीराइट पाठ की पीढ़ी को रोकने के लिए फ़िल्टर लागू किए थे, हालाँकि वादीगण ने इन उपायों की प्रभावशीलता पर विवाद किया।

एक प्रमुख कानूनी प्रश्न यह था कि क्या प्रशिक्षण के दौरान कॉपीराइट कृतियों की मध्यवर्ती नकल उल्लंघन है। वादीगण ने Authors Guild v. Google के ऐतिहासिक मामले से सादृश्य बनाया, जहाँ न्यायालय ने माना कि खोज अनुक्रमण के लिए Google द्वारा पुस्तकों का डिजिटलीकरण उचित उपयोग था। हालाँकि, लेखकों ने तर्क दिया कि Google का उपयोग पाठ को खोजने योग्य बनाने तक सीमित था, जबकि OpenAI का उपयोग एक प्रतिस्पर्धी उत्पाद के निर्माण में शामिल था जो मूल लेखकों की शैली में नया पाठ उत्पन्न कर सकता था। "खोज" और "पीढ़ी" के बीच का अंतर विवाद का केंद्रीय बिंदु बन गया।

खोज और तकनीकी साक्ष्य

खोज चरण के दौरान, वादीगण ने OpenAI के प्रशिक्षण डेटा और मॉडल वेट तक पहुँच की मांग की, यह तर्क देते हुए कि यह साक्ष्य यह साबित करने के लिए आवश्यक था कि कॉपीराइट कृतियाँ वास्तव में नकल की गई थीं। OpenAI ने व्यापार रहस्य संरक्षण और ऐसे डेटा का उत्पादन करने के लिए आवश्यक विशाल कम्प्यूटेशनल संसाधनों का हवाला देते हुए विरोध किया। हालाँकि, न्यायालय ने सीमित खोज का आदेश दिया, जिससे वादीगण को मेटाडेटा और लॉग का निरीक्षण करने की अनुमति मिली जो दिखाते थे कि प्रशिक्षण कोरपस में कौन से स्रोत शामिल थे। इससे यह खुलासा हुआ कि OpenAI ने Books3 जैसे डेटासेट का उपयोग किया था, जो छाया पुस्तकालय Bibliotik से चोरी की गई पुस्तकों का संग्रह है, जिसमें हजारों कॉपीराइट शीर्षक शामिल थे।

तकनीकी साक्ष्य Neural network की आर्किटेक्चर और Deep learning की प्रकृति पर केंद्रित था। वादीगण के विशेषज्ञों ने गवाही दी कि बड़े भाषा मॉडल, जिनमें Transformer (architecture) आर्किटेक्चर पर आधारित शामिल हैं, प्रशिक्षण उदाहरणों के संपीड़ित प्रतिनिधित्व संग्रहीत करते हैं। उन्होंने तर्क दिया कि ये प्रतिनिधित्व मॉडल को ऐसा पाठ पुनरुत्पादित करने की अनुमति देते हैं जो केवल सांख्यिकीय संयोग नहीं है, बल्कि मूल से सीधा व्युत्पन्न है। OpenAI के विशेषज्ञों ने जवाब दिया कि मॉडल स्टोकेस्टिक हैं और किसी विशिष्ट पाठ से कोई समानता मॉडल की सामान्यीकरण करने की क्षमता का परिणाम है, न कि याद रखने की। "स्मरण" बनाम "सामान्यीकरण" पर बहस मामले में एक आवर्ती विषय बन गई।

न्यायिक निर्णय और प्रस्ताव

फरवरी 2024 में, न्यायाधीश अरासेली मार्टिनेज़-ओल्गुइन ने OpenAI के मामले को खारिज करने के प्रस्ताव को अस्वीकार कर दिया, जिससे कॉपीराइट दावों को आगे बढ़ने की अनुमति मिली। न्यायाधीश ने फैसला सुनाया कि वादीगण ने प्रशंसनीय रूप से आरोप लगाया था कि OpenAI की प्रशिक्षण प्रक्रिया में संरक्षित अभिव्यक्ति की नकल शामिल थी, और उचित उपयोग बचाव को याचिका चरण में हल नहीं किया जा सकता था। यह निर्णय महत्वपूर्ण था क्योंकि इसने OpenAI के तर्क को खारिज कर दिया कि मामला सीमा अवधि द्वारा वर्जित था या वादीगण के पास स्थिति का अभाव था। फैसले ने यह भी नोट किया कि वादीगण ने प्रशिक्षण डेटा और मॉडल के आउटपुट के बीच संबंध को पर्याप्त रूप से स्थापित किया था, भले ही आउटपुट शब्दशः प्रतियाँ न हों।

मई 2024 में एक बाद के फैसले ने मामले के दायरे को संकुचित कर दिया, वादीगण के कुछ दावों को खारिज कर दिया, जिनमें राज्य कानून और अन्यायपूर्ण संवर्धन से संबंधित शामिल थे, लेकिन मुख्य कॉपीराइट दावों को बरकरार रखा। न्यायालय ने OpenAI के मध्यस्थता के लिए बाध्य करने के प्रस्ताव को भी अस्वीकार कर दिया, यह पाते हुए कि वादीगण ने किसी मध्यस्थता खंड से सहमति नहीं दी थी। इन फैसलों ने संभावित मुकदमे के लिए मंच तैयार किया, हालाँकि दोनों पक्षों ने समझौते की इच्छा व्यक्त की। मामला उसी न्यायाधीश को सौंपा गया था जो अन्य एआई कॉपीराइट मामलों की देखरेख कर रहे थे, जिनमें Anthropic और Google DeepMind के विरुद्ध शामिल थे, जो सुझाव देता था कि न्यायालय सामान्य कानूनी मुद्दों को समन्वित तरीके से संबोधित कर सकता है।

उद्योग और नीति निहितार्थ

इस मुकदमे के Artificial intelligence उद्योग के लिए दूरगामी निहितार्थ थे। इसने Anthropic और Google DeepMind सहित अन्य एआई कंपनियों को अपनी प्रशिक्षण प्रथाओं की समीक्षा करने और प्रकाशकों और लेखकों के साथ लाइसेंसिंग समझौतों पर बातचीत करने के लिए प्रेरित किया। 2023 के अंत में, OpenAI ने प्रशिक्षण के लिए समाचार सामग्री को लाइसेंस देने के लिए Axel Springer और Associated Press सहित कई मीडिया कंपनियों के साथ साझेदारी की घोषणा की। हालाँकि, ये सौदे प्रशिक्षण में उपयोग की जाने वाली पुस्तकों और लेखों के केवल एक छोटे हिस्से को कवर करते थे, जिससे कई लेखक असंतुष्ट रह गए।

इस मामले ने विधायी प्रयासों को भी प्रभावित किया। अमेरिकी कांग्रेस में, विधायकों ने AI Foundation Model Transparency Act जैसे विधेयक पेश किए, जो कंपनियों को अपने प्रशिक्षण डेटा स्रोतों का खुलासा करने की आवश्यकता होगी। यूरोपीय संघ का AI Act, जिसे 2024 में अंतिम रूप दिया गया, में सामान्य-उद्देश्यीय एआई मॉडल के डेवलपर्स को अपने प्रशिक्षण डेटा का दस्तावेजीकरण करने और कॉपीराइट कानून का पालन करने की आवश्यकता वाले प्रावधान शामिल थे। लेखकों का सामूहिक मुकदमा एक परीक्षण मामले के रूप में कार्य करता था कि क्या मौजूदा कॉपीराइट कानून एआई प्रशिक्षण को प्रभावी ढंग से विनियमित कर सकता है, या क्या नए कानून की आवश्यकता थी।

रचनात्मक समुदाय से प्रतिक्रियाएँ

इस मुकदमे ने लेखकों और अन्य रचनाकारों को एकजुट किया, जो इसे अपनी आजीविका की रक्षा के रूप में देखते थे। Authors Guild जैसे संगठनों ने वादीगण का समर्थन करते हुए amicus ब्रीफ दायर किए, यह तर्क देते हुए कि एआई मॉडल मानव लेखन के मूल्य को कम करने और रचनात्मक कार्य के लिए आर्थिक प्रोत्साहन को कमजोर करने की धमकी देते हैं। हालाँकि, कुछ लेखकों ने प्रेरणा और सहयोग के उपकरण के रूप में एआई के लिए समर्थन व्यक्त किया, और कुछ ने अपनी कृतियों को एआई कंपनियों को लाइसेंस भी दिया। यह विभाजन रचनात्मक क्षेत्रों में स्वचालन की भूमिका के बारे में व्यापक सामाजिक बहसों को दर्शाता था।

इस मुकदमे में शामिल होने वाले प्रमुख लेखकों में जोनाथन फ्रांज़ेन, जोडी पिकोल्ट, और जॉर्ज आर.आर. मार्टिन शामिल थे, हालाँकि कुछ ने बाद में वापस ले लिया या आरक्षण व्यक्त किया। यह मामला शिक्षाविदों का ध्यान भी आकर्षित करता था, जिन्होंने बहस की कि क्या कॉपीराइट पाठ पर प्रशिक्षण मानव सीखने के अनुरूप है। Melanie Mitchell और Brendan Lake जैसे विद्वानों ने तर्क दिया कि मशीनें मानव अर्थ में "पढ़ती" नहीं हैं, लेकिन कानूनी प्रणाली को यह तय करना था कि क्या डेटा की यांत्रिक नकल और परिवर्तन की प्रक्रिया उल्लंघन है।

समझौता और परिणाम

2025 तक, मामला अनसुलझा रहा, दोनों पक्ष समझौता वार्ता में लगे हुए थे। रिपोर्टों ने संकेत दिया कि OpenAI ने लेखकों के एक समूह को लाइसेंसिंग शुल्क देने की पेशकश की थी, लेकिन वादीगण ने उच्च राशि और चल रही रॉयल्टी की मांग की। न्यायालय ने 2025 के अंत के लिए एक स्थिति सम्मेलन निर्धारित किया था, और पर्यवेक्षकों ने अनुमान लगाया कि मुकदमेबाजी की उच्च लागत और प्रतिकूल फैसले की संभावना को देखते हुए समझौता होने की संभावना थी। एक समझौता एआई कंपनियों द्वारा रचनाकारों को मुआवजा देने के तरीके के लिए एक मिसाल स्थापित करेगा, हालाँकि यह अन्य प्रतिवादियों को बाध्य नहीं करेगा।

इस मामले ने संबंधित मुकदमेबाजी को भी जन्म दिया। 2024 में, गैर-काल्पनिक लेखकों के एक समूह ने OpenAI के विरुद्ध एक अलग सामूहिक मुकदमा दायर किया, यह आरोप लगाते हुए कि कंपनी ने उनकी कृतियों का उपयोग बिना अनुमति के किया था। न्यूयॉर्क टाइम्स ने OpenAI और Microsoft के विरुद्ध अपना मुकदमा दायर किया, जो उसी न्यायालय में लंबित था। ये मामले, लेखकों के सामूहिक मुकदमे के साथ, एक जटिल कानूनी परिदृश्य बनाते थे जो एआई विकास के भविष्य को आकार देगा। लेखकों के मामले का परिणाम न केवल अमेरिका बल्कि दुनिया भर के उन क्षेत्राधिकारों को प्रभावित करने की व्यापक रूप से उम्मीद की गई थी जो समान प्रश्नों से जूझ रहे थे।

व्यापक संदर्भ और भविष्य का दृष्टिकोण

OpenAI के विरुद्ध लेखकों का सामूहिक मुकदमा एआई कंपनियों को उनके प्रशिक्षण डेटा के लिए जवाबदेह ठहराने के लिए एक बड़े आंदोलन का हिस्सा था। इसने तकनीकी नवाचार और बौद्धिक संपदा अधिकारों के बीच तनाव को उजागर किया, और इसने इस तथ्य के साथ एक सार्वजनिक सामना करने के लिए मजबूर किया कि एआई प्रणालियाँ अनगिनत लेखकों, कलाकारों, और पत्रकारों के अवैतनिक श्रम पर निर्मित हैं। इस मामले ने एआई विकास में पारदर्शिता की आवश्यकता को भी रेखांकित किया, क्योंकि वादीगण के खोज अनुरोधों ने प्रशिक्षण डेटा संग्रह की अपारदर्शी प्रकृति को उजागर किया।

आगे देखते हुए, इस मामले में स्थापित कानूनी सिद्धांतों के स्थायी प्रभाव हो सकते हैं। यदि न्यायालय ने फैसला सुनाया कि अनुमति के बिना कॉपीराइट कृतियों पर प्रशिक्षण उल्लंघन है, तो एआई कंपनियों को अपनी डेटा अधिग्रहण रणनीतियों को बदलने की आवश्यकता होगी, संभवतः सार्वजनिक डोमेन कृतियों या लाइसेंस प्राप्त सामग्री पर निर्भर रहना होगा। यदि न्यायालय ने उचित उपयोग के पक्ष में फैसला सुनाया, तो यह एआई डेवलपर्स को मौजूदा पाठ का उपयोग करने की व्यापक छूट देगा, लेकिन यह अनिवार्य लाइसेंसिंग योजना बनाने के लिए विधायी कार्रवाई को भी प्रेरित कर सकता है। किसी भी तरह, यह मामला Machine learning के इतिहास और Generative AI के व्यावसायीकरण में एक निर्णायक क्षण का प्रतिनिधित्व करता था।

लेखकों का सामूहिक मुकदमा लेखकत्व की प्रकृति के बारे में भी प्रश्न उठाता था। जैसे-जैसे एआई मॉडल मानव लेखन के बराबर पाठ उत्पन्न करने में सक्षम होते जाते हैं, मूल निर्माण और व्युत्पन्न कार्य के बीच की रेखा धुंधली होती जाती है। इस मामले ने न्यायालयों को यह विचार करने के लिए मजबूर किया कि क्या एक मशीन जिसने लाखों पुस्तकें "पढ़ी" हैं, मौलिक रूप से एक मानव लेखक से अलग है जो उन्हीं पुस्तकों से प्रभावित हुआ है। जबकि कानूनी प्रणाली ने अभी तक एक निश्चित उत्तर प्रदान नहीं किया था, इस मामले ने सुनिश्चित किया कि यह प्रश्न आने वाले वर्षों में बहस का विषय रहेगा।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·artificial-intelligence·class-action·openai
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास