लेखकों की क्लास कार्रवाई ओपनएआई के विरुद्ध

अंग्रेज़ी से अनुवादित

संयुक्त राज्य अमेरिका में कथा लेखकों द्वारा प्रशिक्षण डेटा के उपयोग को लेकर OpenAI के खिलाफ दायर कॉपीराइट मुकद्दमों का समेकन, जिसमें बड़े भाषा मॉडलों में कार्यों के अनधिकृत पुनरुत्पादन का आरोप लगाया गया है। मामलों को 2024 में न्यूयॉर्क के दक्षिणी जिले में समेकित किया गया था, जिसमें उचित उपयोग (fair use) और कुछ दावों को खारिज करने पर प्रमुख निर्णय शामिल हैं।

लेखकों द्वारा OpenAI के विरुद्ध दायर किए गए वर्ग-क्रिया मुकदमे (Authors Class Actions Against OpenAI) संयुक्त राज्य अमेरिका के संघीय न्यायालयों में कथा लेखकों द्वारा OpenAI के विरुद्ध दायर किए गए समेकित मुकदमों का एक समूह है, जो ChatGPT जैसे उत्पादों के अंतर्निहित बड़े भाषा मॉडल का विकासकर्ता है। वादी आरोप लगाते हैं कि OpenAI ने अपने मॉडलों को प्रशिक्षित करने के लिए बिना अनुमति के उनकी कॉपीराइट पुस्तकों की प्रतिलिपि बनाई, जो प्रत्यक्ष और अप्रत्यक्ष कॉपीराइट उल्लंघन का गठन करती है, और कंपनी ने उस अनधिकृत उपयोग से लाभ कमाया। यह मुकदमा, जो न्यूयॉर्क के दक्षिणी जिले के अमेरिकी जिला न्यायालय में समेकित किया गया है, जनरेटिव AI प्रणालियों के प्रशिक्षण पर कॉपीराइट कानून कैसे लागू होता है, इसका एक केंद्रीय परीक्षण मामला बन गया है।

ये मामले 2022 के अंत में ChatGPT के व्यावसायिक रिलीज़ और OpenAI के मॉडल परिवार के बाद के विस्तार के मद्देनज़र सामने आए। लेखकों ने तर्क दिया कि उनके कार्यों को प्रशिक्षण के लिए उपयोग किए जाने वाले विशाल पाठ संग्रहों में बिना लाइसेंस या मुआवजे के शामिल किया गया था, और मॉडल उनकी पुस्तकों के अंशों को पुन: प्रस्तुत या बारीकी से अनुकरण कर सकते थे। OpenAI ने जवाब दिया कि उसका कॉपीराइट सामग्री का उपयोग उचित उपयोग सिद्धांत के अंतर्गत आता है, मशीन लर्निंग की परिवर्तनकारी प्रकृति और मॉडलों द्वारा सीखे गए गैर-अभिव्यंजक सांख्यिकीय पैटर्न का हवाला देते हुए।

प्रक्रियात्मक इतिहास और समेकन

पहला प्रमुख लेखक मुकदमा जून 2023 में हास्य कलाकार और लेखिका सारा सिल्वरमैन, लेखक रिचर्ड कैड्रे और क्रिस्टोफर गोल्डन द्वारा कैलिफोर्निया के उत्तरी जिले में दायर किया गया था। उस मामले, सिल्वरमैन बनाम OpenAI, ने आरोप लगाया कि OpenAI के प्रशिक्षण डेटा में पायरेटेड पुस्तक भंडार शामिल थे। जुलाई 2023 में, लेखक पॉल ट्रेमब्ले और मोना अवाद द्वारा न्यूयॉर्क के दक्षिणी जिले में एक अलग वर्ग-क्रिया मुकदमा दायर किया गया, जिसका प्रतिनिधित्व उसी कानूनी फर्म ने किया, OpenAI और उसके साझेदार माइक्रोसॉफ्ट के विरुद्ध।

सितंबर 2023 में, न्यायिक पैनल ऑन मल्टीडिस्ट्रिक्ट लिटिगेशन ने कई अतिव्यापी लेखक मुकदमों को एक एकल कार्यवाही, इन री OpenAI ChatGPT लिटिगेशन, में समेकित किया, जिसे न्यूयॉर्क के दक्षिणी जिले में न्यायाधीश जेड एस. राकॉफ को सौंपा गया। समेकित कार्रवाई में जॉर्ज आर.आर. मार्टिन, जॉन ग्रिशम, जोडी पिकोल्ट और अन्य लेखकों के दावे शामिल थे, जो बाद में शामिल हुए, हालांकि कुछ लेखकों ने अलग मुकदमे दायर किए जो बाद में मुख्य मामले में विलय कर दिए गए। 2024 की शुरुआत तक, प्रमुख वादियों ने एक समेकित संशोधित शिकायत दायर की, जिसमें अन्यायपूर्ण संवर्धन और लापरवाही के दावे जोड़े गए, और OpenAI और उसके सीईओ सैम ऑल्टमैन को प्रतिवादी के रूप में नामित किया गया।

मुख्य कानूनी दावे

वादियों का प्राथमिक दावा 17 यू.एस.सी. § 501 के तहत प्रत्यक्ष कॉपीराइट उल्लंघन है, यह तर्क देते हुए कि OpenAI ने प्रशिक्षण के दौरान और मॉडल आउटपुट में उनके कार्यों को पुन: प्रस्तुत और वितरित किया। उन्होंने विकृत और योगदानकारी उल्लंघन का भी आरोप लगाया, यह दावा करते हुए कि OpenAI के पास उल्लंघनकारी गतिविधि को नियंत्रित करने का अधिकार और क्षमता थी और उसने इससे लाभ कमाया। शिकायत में विशिष्ट उदाहरणों का हवाला दिया गया जहां ChatGPT ने कथित तौर पर कॉपीराइट पुस्तकों से लगभग शब्दशः अंश उत्पन्न किए, जो वादियों ने तर्क दिया कि यह प्रदर्शित करता है कि मॉडलों ने अभिव्यंजक सामग्री को संग्रहीत और पुनर्प्राप्त किया।

एक दूसरा प्रमुख दावा डिजिटल मिलेनियम कॉपीराइट अधिनियम (DMCA) के उल्लंघन में, प्रशिक्षण डेटा से कॉपीराइट प्रबंधन जानकारी (CMI), जैसे लेखक के नाम और शीर्षक, को हटाने से संबंधित था। वादियों ने तर्क दिया कि CMI को हटाने से उल्लंघन की सुविधा मिली और लेखकों की अपने अधिकारों को लागू करने की क्षमता में बाधा उत्पन्न हुई। OpenAI ने इस दावे को खारिज करने के लिए प्रस्ताव दिया, यह तर्क देते हुए कि DMCA प्रावधान के लिए उल्लंघन को प्रेरित करने के इरादे की आवश्यकता थी, जिसे वादियों ने प्रशंसनीय रूप से आरोपित नहीं किया था।

प्रमुख निर्णय

फरवरी 2024 में, न्यायाधीश राकॉफ ने DMCA दावे को खारिज कर दिया, यह पाते हुए कि वादियों ने पर्याप्त रूप से यह आरोपित नहीं किया कि OpenAI ने उल्लंघन को छिपाने के लिए जानबूझकर CMI हटाया। उन्होंने मुख्य कॉपीराइट दावों को आगे बढ़ने की अनुमति दी, OpenAI के तर्क को खारिज करते हुए कि दावे राज्य कानून द्वारा पूर्व-अधिकृत थे और वादियों के पास स्थिति का अभाव था क्योंकि उन्होंने हर कार्य पंजीकृत नहीं किया था।

नवंबर 2024 में, न्यायाधीश राकॉफ ने उचित उपयोग पर एक महत्वपूर्ण निर्णय जारी किया। उन्होंने प्रत्यक्ष उल्लंघन दावों को खारिज करने के OpenAI के प्रस्ताव को अस्वीकार कर दिया, यह मानते हुए कि उचित उपयोग बचाव को याचिका चरण में हल नहीं किया जा सकता है। अदालत ने जोर दिया कि क्या उपयोग परिवर्तनकारी था, और क्या मॉडल मूल कार्यों के साथ प्रतिस्पर्धा करते थे, ये तथ्य के प्रश्न थे जिनके लिए खोज की आवश्यकता थी। निर्णय ने यह भी नोट किया कि OpenAI के अपने दस्तावेज़, जिनमें उच्च-गुणवत्ता वाले पाठ डेटा की कमी के बारे में आंतरिक संचार शामिल हैं, उपयोग के उद्देश्य और चरित्र पर प्रभाव डाल सकते हैं।

हालांकि, उसी महीने एक अलग निर्णय में, न्यायाधीश राकॉफ ने अन्यायपूर्ण संवर्धन और लापरवाही के दावों को खारिज कर दिया, यह पाते हुए कि वे कॉपीराइट दावों के नकल थे और आर्थिक हानि नियम द्वारा वर्जित थे। उन्होंने कुछ आरोपों को भी हटा दिया जो नुकसान के सट्टा सिद्धांतों पर निर्भर थे, जैसे कि दावा कि मॉडलों के आउटपुट पुस्तक बिक्री को कम कर देंगे।

उचित उपयोग तर्क

OpenAI का उचित उपयोग बचाव चार वैधानिक कारकों पर निर्भर करता है: उपयोग का उद्देश्य और चरित्र, कॉपीराइट कार्य की प्रकृति, उपयोग की गई मात्रा और पर्याप्तता, और संभावित बाजार पर प्रभाव। कंपनी ने तर्क दिया कि तंत्रिका नेटवर्क का प्रशिक्षण एक गैर-अभिव्यंजक उपयोग है, क्योंकि मॉडल विशिष्ट अभिव्यक्तियों को पुन: प्रस्तुत करने के बजाय सांख्यिकीय पैटर्न सीखता है। उसने सुप्रीम कोर्ट के गूगल बनाम ओरेकल (2021) के निर्णय का हवाला दिया, जिसने माना कि परिवर्तनकारी उद्देश्य के लिए कोड की प्रतिलिपि उचित उपयोग थी, और दूसरे सर्किट के ऑथर्स गिल्ड बनाम गूगल (2015) के फैसले का, जिसने पाया कि खोज के लिए गूगल की पुस्तक स्कैनिंग उचित उपयोग थी।

वादियों ने प्रतिवाद किया कि OpenAI का उपयोग व्यावसायिक था और मॉडल मूल कार्यों के साथ प्रतिस्पर्धा करने वाला पाठ उत्पन्न कर सकते थे, लाइसेंस प्राप्त पुनरुत्पादन के बाजार को नुकसान पहुंचाते हुए। उन्होंने यह भी तर्क दिया कि प्रतिलिपि का पैमाना - लाखों पुस्तकों से अरबों शब्द - गूगल बुक्स मामले में सीमित स्निपेट्स के अनुरूप नहीं था। अदालत का नवंबर 2024 का निर्णय इन मुद्दों को परीक्षण के लिए छोड़ दिया, यह नोट करते हुए कि वास्तविक आउटपुट और आर्थिक प्रभाव का आकलन करने के लिए खोज की आवश्यकता होगी।

संबंधित मुकदमे और संदर्भ

लेखकों के मामले AI कंपनियों के विरुद्ध कॉपीराइट मुकदमों की एक व्यापक लहर का हिस्सा हैं। 2023 में, दृश्य कलाकारों ने स्टेबिलिटी AI, मिडजर्नी और डेविएंटआर्ट के विरुद्ध वर्ग-क्रिया मुकदमे दायर किए, और 2024 में, संगीत प्रकाशकों ने गीत पुनरुत्पादन पर एंथ्रोपिक पर मुकदमा किया। एंथ्रोपिक मामला, कॉनकॉर्ड म्यूजिक ग्रुप बनाम एंथ्रोपिक, में प्रशिक्षण डेटा और आउटपुट पुनरुत्पादन के बारे में समान दावे शामिल थे। लेखकों के मामले दिसंबर 2023 में दायर OpenAI और माइक्रोसॉफ्ट के विरुद्ध न्यूयॉर्क टाइम्स मुकदमे के साथ भी प्रतिच्छेद करते हैं, जिसने आरोप लगाया कि मॉडलों ने समाचार लेखों को शब्दशः पुन: प्रस्तुत किया।

लेखकों के मुकदमे में, अदालत ने न्यूयॉर्क टाइम्स मामले के साथ खोज का समन्वय किया है, जिससे साझा दस्तावेज़ उत्पादन और विशेषज्ञ गवाही की अनुमति मिलती है। इस समन्वय ने मुकदमे की गति को धीमा कर दिया है, अदालत ने 2025 के अंत या 2026 की शुरुआत के लिए परीक्षण तिथि निर्धारित की है। 2025 की शुरुआत तक, पक्ष तथ्य खोज में लगे हुए थे, जिसमें OpenAI के अधिकारियों और तकनीकी कर्मचारियों के बयान और प्रशिक्षण डेटा मेटाडेटा का आदान-प्रदान शामिल था।

AI विकास के लिए निहितार्थ

लेखकों के वर्ग-क्रिया मुकदमों का परिणाम कृत्रिम बुद्धिमत्ता उद्योग को महत्वपूर्ण रूप से प्रभावित कर सकता है। एक निर्णय कि बिना लाइसेंस के कॉपीराइट कार्यों पर प्रशिक्षण उचित उपयोग नहीं है, AI डेवलपर्स को प्रकाशकों और लेखकों के साथ लाइसेंस पर बातचीत करने के लिए मजबूर करेगा, संभावित रूप से लागत बढ़ाएगा और प्रशिक्षण डेटा की विविधता को सीमित करेगा। इसके विपरीत, OpenAI के पक्ष में एक निर्णय वर्तमान प्रशिक्षण प्रथाओं की वैधता की पुष्टि करेगा, हालांकि यह आउटपुट पुनरुत्पादन के बारे में प्रश्नों को हल नहीं कर सकता है।

इस मामले ने विधायी ध्यान भी आकर्षित किया है। 2024 में, कई अमेरिकी सीनेटरों ने प्रशिक्षण डेटा के लिए पारदर्शिता आवश्यकताओं और कॉपीराइट कार्यों के लिए एक वैधानिक लाइसेंसिंग योजना का प्रस्ताव करने वाले विधेयक पेश किए। लेखकों के मुकदमे को इन बहसों में स्पष्ट नियमों की आवश्यकता के प्रमाण के रूप में उद्धृत किया गया है। अंतरराष्ट्रीय स्तर पर, 2024 में अपनाया गया यूरोपीय संघ का AI अधिनियम, प्रशिक्षण डेटा सारांशों के प्रकटीकरण की आवश्यकता वाले प्रावधान शामिल करता है, हालांकि यह सीधे कॉपीराइट दायित्व को संबोधित नहीं करता है।

वर्तमान स्थिति और संभावनाएं

2025 की शुरुआत तक, समेकित कार्रवाई खोज चरण में है। अदालत ने वर्ग प्रमाणन प्रस्तावों को अस्वीकार कर दिया है, लेकिन वादियों ने संकेत दिया है कि वे तथ्य खोज के बाद फिर से प्रमाणन मांगेंगे। न्यायाधीश राकॉफ ने 2025 के मध्य के लिए एक पूर्व-परीक्षण सम्मेलन निर्धारित किया है, जिसमें 2026 में संभावित परीक्षण होगा। यह मामला कानूनी विद्वानों और उद्योग पर्यवेक्षकों द्वारा व्यापक रूप से देखा जा रहा है, क्योंकि यह पूर्व-निर्धारित कर सकता है कि अमेरिकी अदालतें बड़े पैमाने पर मशीन लर्निंग पर उचित उपयोग कैसे लागू करती हैं।

OpenAI को अन्य न्यायक्षेत्रों में भी समानांतर मुकदमों का सामना करना पड़ा है, जिसमें कनाडा में एक वर्ग-क्रिया मुकदमा और अमेरिकी कॉपीराइट कार्यालय के समक्ष एक शिकायत शामिल है। कंपनी ने कुछ प्रकाशकों, जैसे एक्सेल स्प्रिंगर और एसोसिएटेड प्रेस, के साथ लाइसेंसिंग समझौते करना शुरू कर दिया है, लेकिन व्यक्तिगत कथा लेखकों के साथ समझौते नहीं किए हैं। लेखकों के वर्ग-क्रिया मुकदमे OpenAI की प्रशिक्षण प्रथाओं के लिए सबसे व्यापक चुनौती बने हुए हैं, और उनका समाधान संभवतः जनरेटिव AI और कॉपीराइट कानून के भविष्य को आकार देगा।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·openai·class-action·generative-ai
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास