अंग्रेज़ी से अनुवादित

न्यूयॉर्क टाइम्स ने दिसंबर 2023 में OpenAI और Microsoft के खिलाफ कॉपीराइट उल्लंघन का मुकदमा दायर किया, जिसमें आरोप लगाया गया कि बड़े भाषा मॉडलों को प्रशिक्षित करने के लिए उसके लेखों का अनधिकृत उपयोग किया गया। यह मामला जनरेटिव एआई की नींव के लिए एक ऐतिहासिक कानूनी चुनौती है।

The New York Times Company v. Microsoft Corporation and OpenAI, Inc. एक ऐतिहासिक कॉपीराइट उल्लंघन मुकदमा है, जो 27 दिसंबर 2023 को संयुक्त राज्य अमेरिका के दक्षिणी जिला न्यायालय (न्यूयॉर्क) में दायर किया गया था। इस मुकदमे में आरोप लगाया गया है कि OpenAI और उसके प्रमुख निवेशक Microsoft ने The New York Times के लाखों कॉपीराइट समाचार लेखों का उपयोग अपने बड़े भाषा मॉडल को प्रशिक्षित करने के लिए बिना अनुमति या मुआवजे के किया, जिससे कॉपीराइट कानून का उल्लंघन हुआ और अखबार के व्यवसाय मॉडल को खतरा पैदा हुआ। इस मामले को व्यापक रूप से इस बात का निर्णायक परीक्षण माना जा रहा है कि बौद्धिक संपदा कानून Generative AI प्रणालियों और उनके अंतर्निहित प्रशिक्षण डेटा पर कैसे लागू होता है।

यह मुकदमा प्रतिवादियों को उस चीज़ के लिए उत्तरदायी ठहराने की मांग करता है जिसे टाइम्स "The Times के अद्वितीय मूल्यवान कार्यों की अवैध नकल और उपयोग" कहता है। यह प्रति उल्लंघित कार्य $150,000 तक की वैधानिक क्षतिपूर्ति, टाइम्स सामग्री के आगे उपयोग पर रोक, और उस सामग्री को शामिल करने वाले किसी भी डेटासेट या मॉडल के विनाश की मांग करता है। समकालीन रिपोर्टों के अनुसार, यह दायर करना अखबार और OpenAI के बीच महीनों की बातचीत के लाइसेंसिंग समझौते पर विफल होने के बाद हुआ।

पृष्ठभूमि और संदर्भ

यह विवाद Artificial intelligence प्रणालियों के तीव्र विकास से उत्पन्न हुआ है, विशेष रूप से Transformer (architecture) वास्तुकला पर आधारित Deep learning मॉडलों से। OpenAI, जिसकी स्थापना 2015 में एक गैर-लाभकारी अनुसंधान प्रयोगशाला के रूप में हुई थी और बाद में लाभ-उन्मुख शाखा के साथ पुनर्गठित किया गया, ने 2020 में GPT-3 और नवंबर 2022 में ChatGPT जारी किया। ये प्रणालियाँ इंटरनेट से स्क्रैप किए गए विशाल पाठ संग्रहों पर प्रशिक्षित हैं, जिनमें समाचार लेख, पुस्तकें और अन्य कॉपीराइट सामग्री शामिल हैं।

The New York Times, जिसकी स्थापना 1851 में हुई थी, ने लंबे समय से एक पेवॉल और डिजिटल सदस्यता व्यवसाय बनाए रखा है, और 2023 के अंत तक 10 मिलियन से अधिक सदस्यों की रिपोर्ट की। अखबार ने तर्क दिया कि उसकी पत्रकारिता एक मूल्यवान, स्वामित्व वाली संपत्ति है, और AI कंपनियों को इसे स्वतंत्र रूप से उपयोग करने की अनुमति देना उत्पादन लागत की वसूली की उसकी क्षमता को कमजोर करता है। टाइम्स ने यह भी नोट किया कि AI चैटबॉट लेखों के कुछ हिस्सों को "याद" कर सकते हैं और पुन: उत्पन्न कर सकते हैं, जो संभावित रूप से अखबार के अपने वितरण चैनलों के साथ सीधे प्रतिस्पर्धा कर सकते हैं।

कानूनी दावे और तर्क

शिकायत में कई कारणों का उल्लेख किया गया है, जिनमें प्रत्यक्ष कॉपीराइट उल्लंघन, योगदानकारी उल्लंघन और विकृत उल्लंघन शामिल हैं। टाइम्स ने दर्जनों उदाहरण प्रदान किए जहां ChatGPT और अन्य OpenAI उत्पादों ने कथित तौर पर उसके लेखों के लगभग शब्द-दर-शब्द अंशों को पुन: उत्पन्न किया, जिसमें टैक्सी मेडलियन ऋण पर 2019 की जांच और COVID-19 महामारी पर 2020 का एक लेख शामिल है। अखबार ने तर्क दिया कि ऐसे आउटपुट प्रदर्शित करते हैं कि मॉडल उसकी सामग्री पर प्रशिक्षित थे और पुनरुत्पादन परिवर्तनकारी नहीं है।

OpenAI और Microsoft ने अदालती दलीलों में जवाब दिया कि कॉपीराइट सामग्री का उनका उपयोग "उचित उपयोग" सिद्धांत के अंतर्गत आता है, जो आलोचना, टिप्पणी, समाचार रिपोर्टिंग, शिक्षण या अनुसंधान जैसे उद्देश्यों के लिए सीमित उपयोग की अनुमति देता है। उन्होंने तर्क दिया कि बड़े डेटासेट पर प्रशिक्षण एक परिवर्तनकारी प्रक्रिया है जो मूल कार्यों को प्रतिस्थापित नहीं करती बल्कि नए, गैर-अभिव्यंजक सांख्यिकीय प्रतिनिधित्व बनाती है। Microsoft, जिसने 2023 की शुरुआत तक OpenAI में $13 बिलियन से अधिक का निवेश किया था, ने फरवरी 2024 में खारिज करने का प्रस्ताव दायर किया, यह दावा करते हुए कि टाइम्स ने विशिष्ट नुकसान नहीं दिखाया था।

टाइम्स ने जवाब दिया कि उचित उपयोग एक संकीर्ण अपवाद है और OpenAI के संचालन का वाणिज्यिक पैमाना, AI-जनित सारांशों द्वारा उत्पन्न प्रत्यक्ष प्रतिस्पर्धा के साथ, उचित उपयोग के निष्कर्ष के खिलाफ है। कानूनी विद्वानों ने नोट किया कि यह मामला इस बात के लिए मिसाल स्थापित कर सकता है कि अदालतें AI प्रशिक्षण के "उद्देश्य और चरित्र" की व्याख्या कैसे करती हैं, एक प्रश्न जो अमेरिकी न्यायशास्त्र में अनसुलझा बना हुआ है।

प्रमुख घटनाएँ और समयरेखा

  • 27 दिसंबर 2023: टाइम्स ने न्यूयॉर्क के दक्षिणी जिले में अपनी शिकायत दायर की, जिसमें OpenAI और Microsoft दोनों को प्रतिवादी बनाया गया।
  • जनवरी 2024: OpenAI ने सार्वजनिक रूप से कहा कि वह मुकदमे से "आश्चर्यचकित और निराश" है, यह नोट करते हुए कि वह टाइम्स के साथ उत्पादक चर्चा में था। कंपनी ने उन वेबसाइट मालिकों के लिए एक ऑप्ट-आउट तंत्र भी पेश करना शुरू किया जो नहीं चाहते थे कि उनकी सामग्री भविष्य के प्रशिक्षण में उपयोग हो।
  • फरवरी 2024: Microsoft ने खारिज करने का प्रस्ताव दायर किया, यह तर्क देते हुए कि टाइम्स के दावे अनुमानित थे और कंपनी का मॉडलों के प्रशिक्षण में कोई सीधा योगदान नहीं था।
  • अप्रैल 2024: अदालत ने Microsoft के खारिज करने के प्रस्ताव को आंशिक रूप से अस्वीकार कर दिया, जिससे मामला कई दावों पर आगे बढ़ सका। मामले से जुड़े न्यायाधीश सिडनी एच. स्टीन ने दोनों पक्षों को खोज प्रक्रिया में शामिल होने का आदेश दिया।
  • जून 2024: OpenAI ने अपना स्वयं का सारांश निर्णय प्रस्ताव दायर किया, यह दावा करते हुए कि टाइम्स यह साबित नहीं कर सकता कि विशिष्ट लेखों को इस तरह से पुन: उत्पन्न किया गया जिससे बाजार को नुकसान हुआ। टाइम्स ने आंतरिक OpenAI संचार का हवाला देते हुए विरोध किया, जिसमें सामग्री को लाइसेंस देने की आवश्यकता स्वीकार की गई थी।
  • अक्टूबर 2024: अदालत ने खोज विवादों पर प्रारंभिक सुनवाई की, विशेष रूप से OpenAI के प्रशिक्षण डेटासेट तक पहुंच के संबंध में। टाइम्स ने विस्तृत रिकॉर्ड मांगे कि प्रशिक्षण में कौन से लेख शामिल थे, जबकि OpenAI ने तर्क दिया कि ऐसी जानकारी एक व्यापार रहस्य है।
  • 2025 की शुरुआत तक: मामला खोज चरण में बना रहा, कोई परीक्षण तिथि निर्धारित नहीं हुई। दोनों पक्ष प्रस्ताव और विशेषज्ञ रिपोर्ट दायर करते रहे।

व्यापक निहितार्थ

यह मुकदमा AI कंपनियों के खिलाफ कानूनी कार्रवाइयों की लहर का हिस्सा है। 2023 में, सारा सिल्वरमैन और जॉर्ज आर.आर. मार्टिन जैसे लेखकों ने समान दावों के लिए OpenAI और Meta के खिलाफ वर्ग-कार्रवाई मुकदमे दायर किए। Getty Images ने प्रशिक्षण डेटा में अपनी तस्वीरों का उपयोग करने के लिए यूके और अमेरिका में Stability AI पर मुकदमा किया। टाइम्स मामला उल्लेखनीय है क्योंकि इसमें एक प्रमुख समाचार संगठन शामिल है जिसके पास पर्याप्त कानूनी संसाधन और परिणाम में स्पष्ट वित्तीय हिस्सेदारी है।

परिणाम Machine learning विकास के अर्थशास्त्र को प्रभावित कर सकता है। यदि टाइम्स जीतता है, तो AI कंपनियों को प्रकाशकों से सामग्री लाइसेंस करने की आवश्यकता हो सकती है, एक लागत जो उद्योग को नया आकार दे सकती है। इसके विपरीत, OpenAI के पक्ष में निर्णय सार्वजनिक रूप से उपलब्ध पाठ पर प्रशिक्षण की प्रथा को वैध बना सकता है, संभावित रूप से OpenAI और Anthropic और Google DeepMind जैसे प्रतिस्पर्धियों के विकास को तेज कर सकता है।

समाचार संगठनों ने अलग-अलग प्रतिक्रियाएं दी हैं। कुछ, जैसे एसोसिएटेड प्रेस और एक्सल स्प्रिंगर, ने OpenAI के साथ लाइसेंसिंग समझौते पर हस्ताक्षर किए हैं। अन्य, जिनमें टाइम्स भी शामिल है, ने मुकदमेबाजी को चुना है। इस मामले ने नए कानून की आवश्यकता के बारे में चर्चा भी शुरू की है, कुछ विधायकों ने AI प्रशिक्षण के लिए "सूचना और ऑप्ट-आउट" व्यवस्था का प्रस्ताव किया है।

तकनीकी और नैतिक आयाम

यह मामला इस बारे में प्रश्न उठाता है कि तंत्रिका नेटवर्क जानकारी कैसे संग्रहीत और पुनर्प्राप्त करते हैं। शोधकर्ताओं ने दिखाया है कि बड़े भाषा मॉडल लंबे पाठ मार्गों को याद कर सकते हैं, खासकर जब वे मार्ग प्रशिक्षण डेटा में कई बार दिखाई देते हैं। टाइम्स ने तर्क दिया कि उसके लेख, जो व्यापक रूप से सिंडिकेटेड और उद्धृत हैं, OpenAI के डेटासेट में अधिक प्रतिनिधित्व होने की संभावना है, जिससे शब्द-दर-शब्द पुनरुत्पादन का जोखिम बढ़ जाता है।

नैतिक बहसें इस बात पर केंद्रित हैं कि क्या AI कंपनियों का सामग्री निर्माताओं को मुआवजा देने का नैतिक दायित्व है। उचित उपयोग के समर्थक तर्क देते हैं कि प्रशिक्षण एक मानव के लेखों को पढ़ने और सीखने के अनुरूप है, जबकि आलोचकों का कहना है कि AI प्रशिक्षण का पैमाना और वाणिज्यिक प्रकृति मौलिक रूप से अलग है। इस मामले ने AI प्रशिक्षण में पारदर्शिता की कमी को भी उजागर किया है, क्योंकि अधिकांश कंपनियां अपने पूर्ण डेटा स्रोतों को सार्वजनिक रूप से प्रकट नहीं करती हैं।

प्रतिक्रियाएँ और टिप्पणी

कानूनी विशेषज्ञों ने भिन्न भविष्यवाणियां की हैं। कुछ, जैसे स्टैनफोर्ड लॉ प्रोफेसर मार्क लेमली, ने तर्क दिया है कि AI प्रशिक्षण को उचित उपयोग माने जाने की संभावना है, गूगल बुक्स मामले जैसे पूर्व निर्णयों का हवाला देते हुए। अन्य, जिनमें कॉपीराइट विद्वान पामेला सैमुएलसन शामिल हैं, ने नोट किया है कि टाइम्स का प्रत्यक्ष प्रतिस्पर्धा का सबूत तराजू को झुका सकता है। MIT कंप्यूटर साइंस और आर्टिफिशियल इंटेलिजेंस लेबोरेटरी और स्टैनफोर्ड AI लैब दोनों ने इस मामले पर संगोष्ठियों की मेजबानी की है, जो इसके शैक्षणिक महत्व को दर्शाता है।

OpenAI के CEO सैम ऑल्टमैन ने सार्वजनिक रूप से कहा है कि कंपनी सामग्री के लिए भुगतान करने को तैयार है, लेकिन उनका मानना है कि वर्तमान कानूनी ढांचा अस्पष्ट है। मार्च 2024 के एक साक्षात्कार में, उन्होंने कहा, "हम प्रकाशकों के साथ अच्छे साझेदार बनना चाहते हैं। सवाल यह है कि उचित मूल्य क्या है।" टाइम्स, अपनी ओर से, बनाए रखा है कि उसका प्राथमिक लक्ष्य अपनी पत्रकारिता की रक्षा करना और उद्योग के लिए एक मिसाल स्थापित करना है।

वर्तमान स्थिति और भविष्य का दृष्टिकोण

2024 के अंत तक, मामला हल नहीं हुआ था। दोनों पक्षों ने व्यापक प्रस्ताव अभ्यास में संलग्न किया है, और अदालत ने अभी तक मूल उचित उपयोग प्रश्न पर निर्णय नहीं दिया है। कुछ पर्यवेक्षकों को उम्मीद है कि मामला सुप्रीम कोर्ट तक पहुंचेगा, इसके राष्ट्रीय महत्व को देखते हुए। इस बीच, OpenAI ने न्यूज कॉर्प और फाइनेंशियल टाइम्स सहित अन्य प्रकाशकों के साथ सामग्री समझौते जारी रखे हैं, यह सुझाव देते हुए कि उद्योग मुकदमे के परिणाम की परवाह किए बिना लाइसेंसिंग मॉडल की ओर बढ़ रहा है।

टाइम्स ने समानांतर कार्रवाई भी की है, जिसमें डेटा संरक्षण मुद्दों के बारे में यूके के सूचना आयुक्त कार्यालय में एक शिकायत शामिल है। कंपनी ने कहा है कि वह अपनी स्वयं की AI क्षमताओं में निवेश जारी रखेगी, जिसमें डेटा एनालिटिक्स के लिए Google Cloud के साथ साझेदारी शामिल है, लेकिन मुकदमेबाजी के लिए प्रतिबद्ध है।

निष्कर्ष

The New York Times बनाम OpenAI मामला मीडिया और कृत्रिम बुद्धिमत्ता के बीच संबंधों में एक महत्वपूर्ण मोड़ का प्रतिनिधित्व करता है। इसका समाधान न केवल शामिल पक्षों को बल्कि Artificial intelligence विकास, सामग्री लाइसेंसिंग और कॉपीराइट कानून के व्यापक पारिस्थितिकी तंत्र को भी प्रभावित करेगा। जैसे-जैसे तकनीक विकसित होती है, इस मामले में स्थापित कानूनी सिद्धांत भविष्य के विवादों के लिए एक आधार के रूप में काम कर सकते हैं, जिससे यह दशक के सबसे बारीकी से देखे जाने वाले मुकदमों में से एक बन जाता है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·artificial-intelligence·legal-dispute·news-media
इस पृष्ठ को अंतिम बार संपादित किया गया 13 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास