NYT बनाम OpenAI उचित उपयोग बचाव

अंग्रेज़ी से अनुवादित

द न्यूयॉर्क टाइम्स ने दिसंबर 2023 में OpenAI और Microsoft के खिलाफ मुकदमा दायर किया, जिसमें बड़े भाषा मॉडलों के प्रशिक्षण में कॉपीराइट उल्लंघन का आरोप लगाया गया। OpenAI का उचित उपयोग बचाव परिवर्तनकारी उपयोग का तर्क देता है, जबकि टाइम्स अपने लेखों के अनधिकृत पुनरुत्पादन का दावा करता है।

द न्यूयॉर्क टाइम्स कंपनी ने दिसंबर 2023 में OpenAI और Microsoft के खिलाफ मुकदमा दायर किया, जिसमें आरोप लगाया गया कि इन कंपनियों ने बिना अनुमति या मुआवजे के अपने बड़े भाषा मॉडल को प्रशिक्षित करने के लिए लाखों कॉपीराइट समाचार लेखों का उपयोग किया। यह मामला, जिसे औपचारिक रूप से द न्यूयॉर्क टाइम्स कंपनी बनाम माइक्रोसॉफ्ट कॉर्पोरेशन और OpenAI, इंक. कहा जाता है, इस बात पर केंद्रित है कि क्या जनरेटिव आर्टिफिशियल इंटेलिजेंस प्रणालियों के प्रशिक्षण में कॉपीराइट पाठ का उपयोग संयुक्त राज्य कॉपीराइट कानून के तहत उचित उपयोग है। परिणाम इस बात के लिए एक मिसाल कायम कर सकता है कि आर्टिफिशियल इंटेलिजेंस कंपनियां अपने प्रशिक्षण डेटासेट में कॉपीराइट सामग्री को कैसे संभालती हैं।

टाइम्स का दावा है कि OpenAI का ChatGPT और Microsoft का Azure-संचालित Copilot उत्पाद अपने लेखों के महत्वपूर्ण हिस्सों को शब्दशः या निकट पैराफ्रेज़ में पुन: प्रस्तुत करते हैं, अक्सर उचित श्रेय के बिना। शिकायत में कई उदाहरणों का हवाला दिया गया है जहां मॉडलों ने टाइम्स की रिपोर्टिंग से लगभग समान अंश आउटपुट किए, जिसमें पेवॉल वाली सामग्री भी शामिल है। OpenAI ने उचित उपयोग बचाव का दावा करते हुए जवाब दिया है, यह तर्क देते हुए कि सार्वजनिक रूप से उपलब्ध पाठ पर प्रशिक्षण परिवर्तनकारी है और मूल कार्यों का विकल्प नहीं है। Microsoft, OpenAI के प्राथमिक निवेशक और वितरक के रूप में, भी प्रतिवादी के रूप में नामित है।

मुकदमे की पृष्ठभूमि

यह मुकदमा 27 दिसंबर, 2023 को संयुक्त राज्य जिला न्यायालय, दक्षिणी जिला न्यूयॉर्क में दायर किया गया था। टाइम्स वैधानिक क्षति और निषेधाज्ञा राहत चाहता है, जिसमें उसकी सामग्री को शामिल करने वाले सभी मॉडल वेट और प्रशिक्षण डेटासेट का विनाश शामिल है। यह फाइलिंग टाइम्स और OpenAI के बीच लाइसेंसिंग समझौते पर महीनों की विफल बातचीत के बाद हुई। टाइम्स ने कथित तौर पर 100 मिलियन से अधिक लेखों के अपने संग्रह के उपयोग के लिए मुआवजा मांगा था, लेकिन पक्ष शर्तों पर सहमत नहीं हो सके।

यह मामला AI कंपनियों से जुड़े कई हाई-प्रोफाइल कॉपीराइट विवादों में से एक है। जुलाई 2023 में, सारा सिल्वरमैन और क्रिस्टोफर गोल्डन सहित लेखकों ने समान दावों के लिए OpenAI और Meta पर मुकदमा किया। टाइम्स का मुकदमा उल्लेखनीय है क्योंकि इसमें एक प्रमुख समाचार संगठन शामिल है जिसके पास पर्याप्त कानूनी संसाधन और अपनी सामग्री की सुरक्षा में स्पष्ट व्यावसायिक हित है। परिणाम प्रभावित कर सकता है कि समाचार प्रकाशक और अन्य सामग्री निर्माता AI डेवलपर्स के साथ कैसे बातचीत करते हैं।

OpenAI का उचित उपयोग तर्क

OpenAI का बचाव उचित उपयोग के सिद्धांत पर टिका है, जो अमेरिकी कॉपीराइट अधिनियम की धारा 107 में संहिताबद्ध है। कंपनी का तर्क है कि कॉपीराइट पाठ पर एक मॉडल को प्रशिक्षित करना एक परिवर्तनकारी उपयोग है - यह मूल अभिव्यक्ति को पुन: प्रस्तुत करने के बजाय एक नया कार्य (अनुक्रम में अगले टोकन की भविष्यवाणी) बनाता है। OpenAI का दावा है कि प्रशिक्षण प्रक्रिया स्रोत पाठ की प्रतियां संग्रहीत नहीं करती है, बल्कि शब्दों के बीच सांख्यिकीय पैटर्न और संबंध सीखती है। कंपनी अपने मॉडल की विषयों की एक विस्तृत श्रृंखला पर मूल पाठ उत्पन्न करने की क्षमता को इस बात के प्रमाण के रूप में इंगित करती है कि यह केवल अपने प्रशिक्षण डेटा को उगलता नहीं है।

OpenAI अपनी तकनीक के सार्वजनिक लाभ पर भी जोर देता है। कंपनी का तर्क है कि बड़े भाषा मॉडल अनुसंधान, शिक्षा और रचनात्मक अभिव्यक्ति को सक्षम करते हैं, और सार्वजनिक रूप से उपलब्ध पाठ पर प्रशिक्षण को प्रतिबंधित करना नवाचार को दबा देगा। OpenAI ने नोट किया है कि यह उन वेबसाइट मालिकों के लिए एक ऑप्ट-आउट तंत्र प्रदान करता है जो अपनी सामग्री को प्रशिक्षण में उपयोग नहीं करना चाहते हैं, हालांकि टाइम्स ने मुकदमा दायर करने से पहले इस तंत्र का उपयोग नहीं किया। कंपनी आगे तर्क देती है कि टाइम्स के लेख तथ्यात्मक समाचार रिपोर्ट हैं, जिन्हें रचनात्मक कार्यों की तुलना में कमजोर कॉपीराइट सुरक्षा मिलती है, और मॉडल केवल अंतर्निहित तथ्यों और विचारों का उपयोग करते हैं, मूल अभिव्यक्ति का नहीं।

टाइम्स के कॉपीराइट दावे

टाइम्स इसका जवाब देता है कि उचित उपयोग लागू नहीं होता क्योंकि OpenAI का उपयोग व्यावसायिक है और सीधे अखबार के अपने उत्पादों के साथ प्रतिस्पर्धा करता है। शिकायत में आरोप लगाया गया है कि ChatGPT और Copilot टाइम्स के लेखों के सारांश उत्पन्न कर सकते हैं जो मूल को पढ़ने के विकल्प के लिए पर्याप्त विस्तृत हैं, जिससे टाइम्स वेबसाइट से ट्रैफ़िक और विज्ञापन राजस्व हट जाता है। अखबार यह भी दावा करता है कि मॉडल कुछ मामलों में अपने लेखों को शब्दशः पुन: प्रस्तुत करते हैं, जो किसी भी परिवर्तनकारी उपयोग से परे है।

टाइम्स अपनी सामग्री की "मोज़ेक" प्रकृति की ओर इशारा करता है - व्यक्तिगत लेख एक बड़े संपादकीय उत्पाद का हिस्सा हैं जिसमें संदर्भ, विश्लेषण और खोजी रिपोर्टिंग शामिल है। अखबार का तर्क है कि इस सामग्री के कुछ हिस्सों को भी पुन: प्रस्तुत करना इसके मूल्य को कमजोर करता है। शिकायत यह भी नोट करती है कि OpenAI ने अन्य प्रकाशकों, जिनमें Axel Springer और Associated Press शामिल हैं, से सामग्री लाइसेंस की है, जो बताता है कि कंपनी कॉपीराइट सामग्री का उपयोग करते समय अनुमति की आवश्यकता को पहचानती है। टाइम्स का तर्क है कि लाइसेंस देने से उसके इनकार को उचित उपयोग के दावे के माध्यम से दरकिनार नहीं किया जाना चाहिए।

कानूनी मिसालें और व्याख्याएं

इस मामले में उचित उपयोग विश्लेषण संभवतः कई प्रमुख मिसालों पर आधारित होगा। Authors Guild बनाम Google (2015) में, दूसरे सर्किट ने माना कि Google द्वारा अपने खोज सूचकांक के लिए लाखों पुस्तकों का डिजिटलीकरण परिवर्तनकारी उचित उपयोग था क्योंकि यह पुस्तकों को पूर्ण रूप से पुन: प्रस्तुत किए बिना स्निपेट और खोज कार्यक्षमता प्रदान करता था। OpenAI संभवतः इस मामले का हवाला देगा कि इसका उपयोग समान रूप से परिवर्तनकारी है। हालांकि, टाइम्स Google Books को अलग कर सकता है यह नोट करके कि यह पुस्तकों के साथ प्रतिस्पर्धा नहीं करता था, जबकि ChatGPT समाचार लेखों के साथ प्रतिस्पर्धा करने वाली सामग्री उत्पन्न कर सकता है।

एक अन्य प्रासंगिक मिसाल 2023 का मामला Thomson Reuters बनाम Ross Intelligence है, जहां एक अदालत ने पाया कि AI कानूनी अनुसंधान उपकरण को प्रशिक्षित करने के लिए Reuters के कानूनी हेडनोट्स का उपयोग उचित उपयोग नहीं था। वह निर्णय, हालांकि दूसरे सर्किट में बाध्यकारी नहीं है, बताता है कि अदालतें AI प्रशिक्षण की अधिक कठोरता से जांच कर सकती हैं जब आउटपुट मूल कार्य के साथ प्रतिस्पर्धा करता है। टाइम्स संभवतः तर्क देगा कि इसका मामला Ross Intelligence के करीब है, Google Books के नहीं, क्योंकि ChatGPT को समाचार सामग्री के साथ सवालों के जवाब देने के लिए डिज़ाइन किया गया है, जो सीधे टाइम्स के मुख्य व्यवसाय के साथ प्रतिस्पर्धा करता है।

प्रशिक्षण डेटा के तकनीकी पहलू

यह मामला इस बारे में तकनीकी प्रश्न भी उठाता है कि मशीन लर्निंग मॉडल जानकारी कैसे संग्रहीत और पुनर्प्राप्त करते हैं। OpenAI के मॉडल ट्रांसफॉर्मर वास्तुकला पर आधारित हैं, जो पाठ को संसाधित करने के लिए मल्टी-हेड अटेंशन तंत्र का उपयोग करता है। प्रशिक्षण के दौरान, मॉडल पाठ के एक विशाल कोष पर भविष्यवाणी त्रुटि को कम करने के लिए अरबों मापदंडों को समायोजित करता है। OpenAI ने अपने प्रशिक्षण डेटासेट की पूरी सामग्री का खुलासा नहीं किया है, लेकिन टाइम्स की शिकायत में आरोप लगाया गया है कि विशिष्ट अंशों को पुन: प्रस्तुत करने की मॉडलों की क्षमता के आधार पर उसके लेख प्रशिक्षण डेटा में दिखाई देते हैं।

OpenAI का तर्क है कि मॉडल में पारंपरिक अर्थों में पाठ की प्रतियां नहीं होती हैं - मापदंड सांख्यिकीय संबंधों को एन्कोड करते हैं, सटीक स्ट्रिंग्स को नहीं। हालांकि, शोधकर्ताओं ने प्रदर्शित किया है कि बड़े भाषा मॉडल अपने प्रशिक्षण डेटा से लंबे अंशों को याद कर सकते हैं और पुन: प्रस्तुत कर सकते हैं, खासकर जब वे अंश कई बार दिखाई देते हैं या विशिष्ट होते हैं। टाइम्स ने ChatGPT के अपने लेखों से लगभग शब्दशः उद्धरण आउटपुट करने के उदाहरण प्रदान किए हैं, जो बताता है कि स्मरण होता है। अदालत को यह निर्धारित करने की आवश्यकता हो सकती है कि क्या यह स्मरण कॉपीराइट कानून के तहत पुनरुत्पादन का गठन करता है।

उद्योग प्रतिक्रियाएं और निहितार्थ

मुकदमे ने प्रौद्योगिकी और प्रकाशन उद्योगों से प्रतिक्रियाएं आकर्षित की हैं। कुछ प्रकाशकों, जिनमें News Corp और Gannett शामिल हैं, ने टाइम्स की स्थिति के लिए समर्थन व्यक्त किया है, जबकि अन्य ने AI कंपनियों के साथ लाइसेंसिंग समझौते किए हैं। OpenAI ने कई प्रकाशकों के साथ समझौते किए हैं, जिनमें Politico की मूल कंपनी Axel Springer और Financial Times शामिल हैं, ताकि उनकी सामग्री को प्रशिक्षण और प्रदर्शन में उपयोग किया जा सके। ये समझौते बताते हैं कि कुछ प्रकाशक मुकदमा करने के बजाय AI कंपनियों के साथ साझेदारी में मूल्य देखते हैं।

AI शोधकर्ताओं ने चिंता व्यक्त की है कि प्रतिकूल फैसला क्षेत्र में प्रगति में बाधा डाल सकता है। कई लोग तर्क देते हैं कि सक्षम मॉडल बनाने के लिए बड़े, विविध डेटासेट पर प्रशिक्षण आवश्यक है, और प्रत्येक कॉपीराइट कार्य के लिए व्यक्तिगत लाइसेंस की आवश्यकता अव्यावहारिक होगी। कुछ ने वैकल्पिक ढांचे का प्रस्ताव किया है, जैसे अनिवार्य लाइसेंसिंग प्रणाली या पाठ डेटा के लिए सामूहिक अधिकार संगठन। यह मामला अंतरराष्ट्रीय AI विकास को भी प्रभावित कर सकता है, क्योंकि अन्य देश देखते हैं कि अमेरिकी अदालतें कॉपीराइट सुरक्षा को तकनीकी नवाचार के साथ कैसे संतुलित करती हैं।

संभावित परिणाम और समयरेखा

शुरुआती 2025 तक, मामला खोज चरण में है, दोनों पक्ष प्रशिक्षण डेटा और मॉडल आउटपुट के बारे में सबूतों का आदान-प्रदान कर रहे हैं। एक परीक्षण तिथि निर्धारित नहीं की गई है, और कानूनी विशेषज्ञों को उम्मीद है कि मामले को हल करने में कई साल लगेंगे, संभवतः सुप्रीम कोर्ट तक पहुंच सकता है। अदालत परीक्षण से पहले उचित उपयोग प्रश्न पर सारांश निर्णय जारी कर सकती है, जो मुद्दों को संकीर्ण कर सकता है या मामले को पूरी तरह से हल कर सकता है।

कई परिणाम संभव हैं। अदालत यह निर्धारित कर सकती है कि OpenAI का उपयोग उचित उपयोग है, जिससे कंपनी को बिना अनुमति के कॉपीराइट पाठ पर प्रशिक्षण जारी रखने की अनुमति मिलती है। वैकल्पिक रूप से, अदालत पा सकती है कि उपयोग उचित नहीं है, संभावित रूप से OpenAI को क्षति का भुगतान करने और टाइम्स से सामग्री लाइसेंस करने की आवश्यकता होती है। एक मध्य मार्ग में एक निर्णय शामिल हो सकता है कि कुछ उपयोग उचित हैं जबकि अन्य नहीं हैं, पुनरुत्पादन की डिग्री और व्यावसायिक प्रभाव पर निर्भर करता है। मामला अदालत के बाहर भी सुलझाया जा सकता है, जैसा कि कई हाई-प्रोफाइल कॉपीराइट विवादों में होता है, OpenAI टाइम्स को लाइसेंसिंग शुल्क का भुगतान करता है और अपनी सामग्री को पुन: प्रस्तुत करने पर कुछ प्रतिबंधों से सहमत होता है।

निर्णय के AI उद्योग के लिए दूरगामी परिणाम होने की संभावना है। OpenAI के खिलाफ एक फैसला अन्य कंपनियों, जिनमें Anthropic और Google DeepMind शामिल हैं, को अपनी प्रशिक्षण प्रथाओं को बदलने के लिए मजबूर कर सकता है। यह ओपन-सोर्स मॉडल के विकास को भी प्रभावित कर सकता है, जो सार्वजनिक रूप से उपलब्ध पाठ पर निर्भर करते हैं। इसके विपरीत, OpenAI के पक्ष में एक फैसला AI कंपनियों को बिना अनुमति के कॉपीराइट सामग्री का उपयोग जारी रखने के लिए प्रोत्साहित कर सकता है, संभावित रूप से सामग्री निर्माताओं से अधिक मुकदमेबाजी की ओर ले जाता है। यह मामला इस बात का एक मौलिक परीक्षण है कि कॉपीराइट कानून नई तकनीकों के लिए कैसे अनुकूलित होता है, और इसका परिणाम आने वाले वर्षों के लिए AI डेवलपर्स और सामग्री उत्पादकों के बीच संबंधों को आकार देगा।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·artificial-intelligence·litigation·fair-use
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास