अंग्रेज़ी से अनुवादित

NYT बनाम OpenAI मुकदमा एक कॉपीराइट उल्लंघन मामला है, जिसे द न्यूयॉर्क टाइम्स ने दिसंबर 2023 में OpenAI और Microsoft के खिलाफ दायर किया था, जिसमें बड़े भाषा मॉडलों को प्रशिक्षित करने के लिए अपने लेखों के अनधिकृत उपयोग का आरोप लगाया गया है। यह मामला [[fair-use|उचित उपयोग]] और जनरेटिव AI के बारे में प्रमुख कानूनी प्रश्न उठाता है।

The New York Times Company ने 27 दिसंबर, 2023 को न्यूयॉर्क के दक्षिणी जिले के लिए संयुक्त राज्य अमेरिका के जिला न्यायालय में OpenAI और Microsoft के खिलाफ एक मुकदमा दायर किया। शिकायत में आरोप लगाया गया है कि प्रतिवादियों ने अपने बड़े भाषा मॉडल को प्रशिक्षित करने के लिए बिना अनुमति के लाखों कॉपीराइट समाचार लेखों का उपयोग किया और परिणामी प्रणालियाँ अखबार की अपनी सामग्री के साथ प्रतिस्पर्धा करती हैं। यह मामला जनरेटिव एआई और कॉपीराइट कानून के प्रतिच्छेदन पर सबसे अधिक देखी जाने वाली कानूनी लड़ाइयों में से एक है, जिसका पूरे कृत्रिम बुद्धिमत्ता उद्योग पर प्रभाव पड़ता है।

मुकदमा प्रत्यक्ष और विकृत कॉपीराइट उल्लंघन के दावों के साथ-साथ डिजिटल मिलेनियम कॉपीराइट अधिनियम के उल्लंघन पर केंद्रित है। टाइम्स वैधानिक क्षति, निषेधाज्ञा राहत, और किसी भी मॉडल और प्रशिक्षण डेटासेट के विनाश की मांग करता है जिसमें उसके कार्य शामिल हैं। OpenAI और Microsoft ने खारिज करने के प्रस्तावों के साथ जवाब दिया है, यह तर्क देते हुए कि लेखों का उनका उपयोग अमेरिकी कॉपीराइट कानून के तहत उचित उपयोग है, एक बचाव जो 2025 की शुरुआत तक अदालत में पूरी तरह से हल नहीं हुआ है।

पृष्ठभूमि और पक्षकार

The New York Times, जिसकी स्थापना 1851 में हुई, संयुक्त राज्य अमेरिका के सबसे बड़े और सबसे प्रभावशाली समाचार पत्रों में से एक है, जिसका डिजिटल सदस्यता आधार 2023 तक 10 मिलियन से अधिक है। इसका व्यवसाय मॉडल काफी हद तक विशेष रिपोर्टिंग और पेवॉल सामग्री पर निर्भर करता है। OpenAI, जिसकी स्थापना 2015 में हुई, एक अग्रणी एआई अनुसंधान संगठन है जिसने GPT श्रृंखला के मॉडल विकसित किए, जिसमें GPT-3 और GPT-4 शामिल हैं, जो ChatGPT जैसे उत्पादों को शक्ति प्रदान करते हैं। Microsoft, OpenAI में एक प्रमुख निवेशक है जिसकी रिपोर्टेड $13 बिलियन की प्रतिबद्धता है, Azure के माध्यम से क्लाउड बुनियादी ढांचा प्रदान करता है और OpenAI के मॉडल को अपने Bing खोज इंजन और Office उत्पादकता सुइट में एकीकृत करता है।

शिकायत में 100 से अधिक विशिष्ट उदाहरणों की पहचान की गई है जहां ChatGPT और Bing Chat ने कथित तौर पर टाइम्स के लेखों को लगभग शब्दशः पुन: प्रस्तुत किया, अक्सर पेवॉल के पीछे, बिना श्रेय या लाइसेंस के। टाइम्स का तर्क है कि यह अपनी पत्रकारिता का मुद्रीकरण करने की क्षमता को कमजोर करता है, क्योंकि उपयोगकर्ता सदस्यता लिए बिना एआई प्रणालियों से समान जानकारी प्राप्त कर सकते हैं।

कानूनी दावे और आरोप

प्राथमिक दावा कॉपीराइट उल्लंघन है, यह कहते हुए कि प्रतिवादियों ने अपने मॉडल के प्रशिक्षण के दौरान टाइम्स के लेखों की नकल, पुनरुत्पादन और वितरण किया। शिकायत में विस्तार से बताया गया है कि प्रशिक्षण प्रक्रिया में इंटरनेट से स्क्रैप किए गए विशाल पाठ कोरपोरा को शामिल करना शामिल है, जिसमें लाखों टाइम्स लेख शामिल थे। टाइम्स आगे आरोप लगाता है कि मॉडल अपने लेखों के समान आउटपुट उत्पन्न कर सकते हैं, कभी-कभी सटीक वाक्य या पैराग्राफ सहित।

मुकदमा विकृत उल्लंघन का भी आरोप लगाता है, यह दावा करते हुए कि OpenAI और Microsoft ने अपने उपयोगकर्ताओं के उल्लंघनकारी कृत्यों से सीधे लाभ उठाया, जिन्होंने कॉपीराइट सामग्री को पुन: प्रस्तुत करने के लिए मॉडल को प्रेरित किया। इसके अतिरिक्त, टाइम्स डिजिटल मिलेनियम कॉपीराइट अधिनियम के तहत एक दावा करता है, यह तर्क देते हुए कि प्रतिवादियों ने प्रशिक्षण प्रक्रिया के दौरान कॉपीराइट प्रबंधन जानकारी, जैसे बायलाइन और कॉपीराइट नोटिस, को हटा दिया या बदल दिया।

बचाव तर्क

OpenAI और Microsoft ने फरवरी 2024 में खारिज करने का एक प्रस्ताव दायर किया, यह तर्क देते हुए कि मुकदमा सट्टा दावों पर आधारित है और कॉपीराइट कार्यों का प्रशिक्षण के लिए उपयोग एक परिवर्तनकारी उचित उपयोग है। वे कहते हैं कि मॉडल मूल लेखों के लिए बाजार को प्रतिस्थापित नहीं करते हैं बल्कि सूचना संश्लेषण के लिए एक नए उपकरण के रूप में कार्य करते हैं। प्रतिवादी इस तथ्य की ओर भी इशारा करते हैं कि टाइम्स के लेख ऑनलाइन सार्वजनिक रूप से सुलभ थे, और प्रशिक्षण प्रक्रिया में प्रत्यक्ष नकल के बजाय सांख्यिकीय पैटर्न शामिल हैं।

अपनी फाइलिंग में, OpenAI ने श्रेय प्रदान करने और प्रकाशकों को प्रशिक्षण से बाहर निकलने की अनुमति देने के अपने प्रयासों पर जोर दिया है, हालांकि टाइम्स का तर्क है कि ये उपाय अपर्याप्त हैं और उल्लंघन होने के बाद ही आए। प्रतिवादियों ने यह भी नोट किया है कि टाइम्स स्वयं विभिन्न उद्देश्यों के लिए एआई उपकरणों का उपयोग करता है, जो प्रौद्योगिकी की एक निश्चित डिग्री की स्वीकृति का सुझाव देता है।

उद्योग संदर्भ और संबंधित मामले

मुकदमा एआई कंपनियों से जुड़े कॉपीराइट विवादों की एक व्यापक लहर का हिस्सा है। 2023 में, सारा सिल्वरमैन और जॉर्ज आर.आर. मार्टिन सहित लेखकों ने OpenAI और अन्य कंपनियों के खिलाफ क्लास-एक्शन मुकदमे दायर किए, जबकि दृश्य कलाकारों ने Stability AI और Midjourney पर मुकदमा किया। Getty Images ने यूके और अमेरिका में Stability AI के खिलाफ एक अलग मुकदमा दायर किया। इन मामलों में सामान्य प्रश्न हैं कि क्या कॉपीराइट डेटा पर प्रशिक्षण उचित उपयोग है, और क्या एआई-जनित आउटपुट मौजूदा कार्यों का उल्लंघन कर सकते हैं।

NYT मामले का परिणाम इस बात के लिए मिसाल स्थापित कर सकता है कि अदालतें मशीन लर्निंग के संदर्भ में उचित उपयोग की व्याख्या कैसे करती हैं। कानूनी विद्वानों ने नोट किया है कि Authors Guild v. Google जैसे मामलों में स्थापित परिवर्तनकारी उपयोग सिद्धांत, बचाव के लिए केंद्रीय हो सकता है। हालांकि, OpenAI के उत्पादों की व्यावसायिक प्रकृति और टाइम्स को संभावित बाजार क्षति इस मामले को पहले के उदाहरणों से अलग करती है।

प्रशिक्षण डेटा के तकनीकी पहलू

बड़े भाषा मॉडल के प्रशिक्षण में पुस्तकों, वेबसाइटों और समाचार लेखों सहित विविध स्रोतों से अरबों शब्दों को खिलाना शामिल है। OpenAI का GPT-3, जो 2020 में जारी किया गया था, Common Crawl नामक डेटासेट पर प्रशिक्षित किया गया था, जिसमें पेटाबाइट्स वेब पेज शामिल हैं। टाइम्स का आरोप है कि इसके लेख इस और बाद के डेटासेट में बिना प्राधिकरण के शामिल थे। तकनीकी प्रक्रिया में ट्रांसफॉर्मर और मल्टी-हेड अटेंशन जैसी तकनीकों का उपयोग करके पाठ को संख्यात्मक प्रतिनिधित्व में परिवर्तित करना शामिल है, जो मॉडल को पैटर्न सीखने और सुसंगत प्रतिक्रियाएं उत्पन्न करने की अनुमति देता है।

OpenAI ने स्वीकार किया है कि इसका प्रशिक्षण डेटा सार्वजनिक रूप से उपलब्ध वेब सामग्री शामिल है, लेकिन इसने अपने डेटासेट की पूरी संरचना का खुलासा नहीं किया है। कंपनी ने कॉपीराइट पाठ को शब्दशः पुन: प्रस्तुत करने की संभावना को कम करने के लिए फिल्टर लागू किए हैं, लेकिन टाइम्स की शिकायत ऐसे उदाहरण प्रदान करती है जहां ये फिल्टर विफल रहे। इस मामले ने अधिक पारदर्शी डेटा सोर्सिंग की आवश्यकता और एआई कंपनियों और सामग्री निर्माताओं के बीच लाइसेंसिंग समझौतों की संभावना के बारे में चर्चा को बढ़ावा दिया है।

प्रक्रियात्मक इतिहास और स्थिति

प्रारंभिक फाइलिंग के बाद, अदालत ने मामले को OpenAI के खिलाफ अन्य संबंधित कॉपीराइट मुकदमों के साथ पूर्व-परीक्षण उद्देश्यों के लिए समेकित किया, हालांकि टाइम्स का मामला अलग बना हुआ है। मार्च 2024 में, न्यायाधीश ने प्रतिवादियों के खारिज करने के प्रस्ताव को आंशिक रूप से अस्वीकार कर दिया, मुख्य कॉपीराइट दावों को आगे बढ़ने की अनुमति दी जबकि कुछ माध्यमिक दावों को खारिज कर दिया। 2025 की शुरुआत तक, पक्ष डिस्कवरी में लगे हुए हैं, टाइम्स OpenAI के प्रशिक्षण डेटा और आंतरिक संचार तक पहुंच की मांग कर रहा है।

एक महत्वपूर्ण विकास नवंबर 2024 में हुआ जब OpenAI ने टाइम्स के खिलाफ एक प्रति-दावा दायर किया, यह आरोप लगाते हुए कि अखबार ने कॉपीराइट सामग्री को पुन: प्रस्तुत करने के लिए ChatGPT को हेरफेर करने के लिए एक ठेकेदार को काम पर रखा था, जो प्लेटफॉर्म की सेवा शर्तों का उल्लंघन करता है। टाइम्स ने इन आरोपों से इनकार किया है, उन्हें केंद्रीय मुद्दों से ध्यान भटकाने वाला बताया है। मामला 2025 के अंत में परीक्षण के लिए निर्धारित है, हालांकि दोनों पक्षों के लिए उच्च दांव को देखते हुए समझौता संभव बना हुआ है।

पत्रकारिता और एआई के लिए निहितार्थ

मुकदमे का समाचार उद्योग के लिए महत्वपूर्ण निहितार्थ है, जो डिजिटल अर्थव्यवस्था के अनुकूल होने के लिए संघर्ष कर रहा है। कई प्रकाशकों ने एआई कंपनियों के साथ लाइसेंसिंग समझौते किए हैं, जैसे कि OpenAI और Axel Springer, Associated Press, और News Corp के बीच सौदे। हालांकि, टाइम्स ने मुकदमेबाजी को चुना है, यह तर्क देते हुए कि लाइसेंसिंग अकेले अनधिकृत उपयोग के मौलिक नुकसान को संबोधित नहीं करता है। यह मामला यह निर्धारित कर सकता है कि क्या एआई कंपनियों को अपने उत्पादों को रेखांकित करने वाले डेटा के लिए भुगतान करना होगा, संभावित रूप से पत्रकारिता और एआई विकास दोनों की अर्थव्यवस्था को फिर से आकार देना।

एआई उद्योग के लिए, एक प्रतिकूल फैसला कंपनियों को अपनी प्रशिक्षण प्रथाओं को ओवरहाल करने के लिए मजबूर कर सकता है, संभावित रूप से डेटासेट के पैमाने को सीमित कर सकता है और लागत बढ़ा सकता है। इसके विपरीत, OpenAI के पक्ष में एक फैसला व्यापक उचित उपयोग सुरक्षा स्थापित कर सकता है, आगे नवाचार को प्रोत्साहित कर सकता है लेकिन सामग्री निर्माताओं के बीच चिंताएं बढ़ा सकता है। यह मामला MIT CSAIL और स्टैनफोर्ड एआई लैब जैसे संस्थानों के शोधकर्ताओं द्वारा बारीकी से देखा जा रहा है, जो एआई के कानूनी और नैतिक आयामों का अध्ययन करते हैं।

जनता और विद्वानों की प्रतिक्रियाएं

मुकदमे पर जनमत विभाजित है। पत्रकार और मीडिया अधिवक्ता आम तौर पर टाइम्स का समर्थन करते हैं, इसे बौद्धिक संपदा और गुणवत्ता पत्रकारिता की स्थिरता की रक्षा के रूप में देखते हैं। तकनीकी उत्साही और कुछ एआई शोधकर्ता तर्क देते हैं कि प्रतिबंधात्मक कॉपीराइट फैसले प्रगति में बाधा डाल सकते हैं, नए ज्ञान बनाने के लिए मौजूदा कार्यों का उपयोग करने के लंबे इतिहास की ओर इशारा करते हैं। कानूनी विशेषज्ञों ने नोट किया है कि मामला अंततः सुप्रीम कोर्ट तक पहुंच सकता है, शामिल प्रश्नों की नवीनता और महत्व को देखते हुए।

विद्वानों ने एआई के संदर्भ में उचित उपयोग की अवधारणा पर भी बहस की है, कुछ नए ढांचे का प्रस्ताव करते हुए जो नवाचार और निर्माता अधिकारों को संतुलित करते हैं। इस मामले ने शैक्षणिक सम्मेलनों और पेपरों को बढ़ावा दिया है, जिसमें तंत्रिका नेटवर्क प्रशिक्षण डेटा को कैसे याद करते हैं और पुनरुत्पादन किन परिस्थितियों में होता है, इसका विश्लेषण शामिल है। यह शोध न्यायिक निर्णयों और भविष्य के कानून को सूचित कर सकता है।

संभावित परिणाम और भविष्य की दिशाएं

कई संभावित परिणाम संभव हैं। अदालत यह फैसला कर सकती है कि कॉपीराइट कार्यों पर प्रशिक्षण उचित उपयोग है, जो संभवतः अधिक लाइसेंसिंग वार्ता की ओर ले जाएगा लेकिन अनिवार्य भुगतान नहीं। वैकल्पिक रूप से, अदालत उल्लंघन पा सकती है, OpenAI को क्षति का भुगतान करने और संभवतः अपने मॉडल को नष्ट करने की आवश्यकता होगी, जो अभूतपूर्व और विघटनकारी होगा। एक मध्य मार्ग में एक फैसला शामिल हो सकता है जो प्रशिक्षण की अनुमति देता है लेकिन शब्दशः पुनरुत्पादन के खिलाफ मजबूत सुरक्षा की आवश्यकता होती है, या एक लाइसेंसिंग व्यवस्था को अनिवार्य करता है।

अदालत कक्ष से परे, इस मामले ने विधायी प्रस्तावों को बढ़ावा दिया है, जैसे कि AI Foundation Model Transparency Act, जो कंपनियों को प्रशिक्षण डेटा स्रोतों का खुलासा करने की आवश्यकता होगी। यूरोपीय संघ का AI Act, जो 2024 में पारित हुआ, प्रशिक्षण डेटा के लिए कॉपीराइट अनुपालन पर प्रावधान शामिल करता है। ये नियामक प्रयास एक ढांचा प्रदान कर सकते हैं जो मामले-दर-मामले मुकदमेबाजी की आवश्यकता को कम करता है। NYT v. OpenAI मुकदमा इस प्रकार एक ऐतिहासिक मामले के रूप में खड़ा है जो प्रभावित करेगा कि समाज आने वाले वर्षों के लिए एआई के लाभों को निर्माताओं के अधिकारों के साथ कैसे संतुलित करता है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-infringement·generative-ai·legal-case·journalism
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास