न्यूयॉर्क टाइम्स कंपनी बनाम माइक्रोसॉफ्ट कॉर्पोरेशन

अंग्रेज़ी से अनुवादित

न्यूयॉर्क टाइम्स कंपनी बनाम माइक्रोसॉफ्ट कॉर्पोरेशन एक कॉपीराइट उल्लंघन मुकदमा है, जो दिसंबर 2023 में दायर किया गया था, जिसमें आरोप लगाया गया है कि OpenAI और माइक्रोसॉफ्ट ने बिना अनुमति के NYT लेखों का उपयोग ChatGPT और अन्य AI मॉडलों को प्रशिक्षित करने के लिए किया, और हर्जाने तथा उल्लंघनकारी सामग्री को हटाने की मांग की गई है।

न्यूयॉर्क टाइम्स कंपनी बनाम माइक्रोसॉफ्ट कॉर्पोरेशन एक ऐतिहासिक कॉपीराइट उल्लंघन मुकदमा है, जो 27 दिसंबर 2023 को संयुक्त राज्य अमेरिका के दक्षिणी न्यूयॉर्क जिले के संघीय न्यायालय में दायर किया गया था। वादी, द न्यूयॉर्क टाइम्स कंपनी, आरोप लगाती है कि ओपनएआई और माइक्रोसॉफ्ट ने, अपने बड़े भाषा मॉडल जैसे कि ChatGPT और उन्हें समर्थन देने वाले Azure-आधारित बुनियादी ढांचे के विकास और तैनाती के माध्यम से, अपने कृत्रिम बुद्धिमत्ता प्रणालियों को प्रशिक्षित करने के लिए लाखों कॉपीराइट समाचार लेखों का अनधिकृत पुनरुत्पादन और उपयोग किया। यह मुकदमा वैधानिक क्षतिपूर्ति, निषेधाज्ञा राहत, और उल्लंघनकारी मॉडल वजन और प्रशिक्षण डेटासेट के विनाश की मांग करता है, जो इसे जनरेटिव एआई के वाणिज्यिक अनुप्रयोग के लिए सबसे महत्वपूर्ण कानूनी चुनौतियों में से एक बनाता है।

यह मामला कॉपीराइट कानून और मशीन लर्निंग के प्रतिच्छेदन पर केंद्रित है, विशेष रूप से इंटरनेट से स्क्रैप किए गए पाठ के विशाल संग्रह पर बड़े भाषा मॉडल को प्रशिक्षित करने की प्रथा पर। टाइम्स का तर्क है कि ओपनएआई और माइक्रोसॉफ्ट ने ChatGPT के अंतर्निहित तंत्रिका नेटवर्क बनाने के लिए उसके लेखों को पूर्ण रूप से कॉपी किया, और यह कि मॉडल कॉपीराइट सामग्री को पुन: उत्पन्न या बारीकी से व्याख्या कर सकते हैं, जिससे अखबार के अपने डिजिटल उत्पादों के साथ प्रतिस्पर्धा होती है। माइक्रोसॉफ्ट को ओपनएआई में अपने अरबों डॉलर के निवेश और Bing Chat और Microsoft 365 Copilot जैसे उत्पादों में ओपनएआई मॉडल के एकीकरण के कारण प्रतिवादी के रूप में नामित किया गया है। यह मुकदमा इस बात का अग्रदूत बन गया है कि अदालतें उभरते जनरेटिव एआई क्षेत्र में मौजूदा कॉपीराइट सिद्धांतों को कैसे लागू करेंगी।

पृष्ठभूमि और पक्षकार

द न्यूयॉर्क टाइम्स कंपनी, जिसकी स्थापना 1851 में हुई थी, संयुक्त राज्य अमेरिका में सबसे प्रमुख समाचार संगठनों में से एक है, जिसका 2023 तक डिजिटल सदस्यता आधार 10 मिलियन से अधिक है। इसका व्यवसाय मॉडल कॉपीराइट द्वारा संरक्षित विशेष रिपोर्टिंग और विश्लेषण पर बहुत अधिक निर्भर करता है। ओपनएआई, जिसकी स्थापना 2015 में एक गैर-लाभकारी संस्था के रूप में हुई और 2019 में एक सीमित-लाभ इकाई के रूप में पुनर्गठित हुई, उन्नत कृत्रिम बुद्धिमत्ता प्रणालियों का विकास करती है, जिसमें GPT श्रृंखला के बड़े भाषा मॉडल शामिल हैं। माइक्रोसॉफ्ट, एक वैश्विक प्रौद्योगिकी निगम, ने 2019 से ओपनएआई में 13 अरब डॉलर से अधिक का निवेश किया है, अपने Azure प्लेटफॉर्म के माध्यम से क्लाउड कंप्यूटिंग संसाधन प्रदान किए हैं, और ओपनएआई के मॉडल को अपने उत्पादों में शामिल किया है।

यह मुकदमा माइक्रोसॉफ्ट को ओपनएआई के साथ उसके गहरे वित्तीय और तकनीकी उलझाव के कारण सह-प्रतिवादी के रूप में नामित करता है। माइक्रोसॉफ्ट का Azure क्लाउड ओपनएआई के प्रशिक्षण और अनुमान कार्यभार की मेजबानी करता है, और कंपनी के पास कुछ ओपनएआई प्रौद्योगिकियों का व्यावसायीकरण करने के विशेष अधिकार हैं। टाइम्स का आरोप है कि माइक्रोसॉफ्ट केवल एक निष्क्रिय निवेशक नहीं है, बल्कि उल्लंघनकारी प्रणालियों के विकास और वितरण में एक सक्रिय भागीदार है।

कॉपीराइट उल्लंघन के आरोप

शिकायत में विशिष्ट उदाहरणों का विवरण दिया गया है जहां ChatGPT और माइक्रोसॉफ्ट के Bing Chat ने कथित तौर पर टाइम्स के लेखों को शब्दशः या केवल मामूली बदलावों के साथ पुन: उत्पन्न किया। उदाहरण के लिए, मुकदमा कैलिफोर्निया में 2018 के कैंप फायर के बारे में एक प्रश्न का हवाला देता है, जहां ChatGPT ने कथित तौर पर टाइम्स के एक लेख से एक लगभग शब्दशः अंश लौटाया, जिसमें शीर्षक और प्रमुख पैराग्राफ शामिल थे। टाइम्स का तर्क है कि ऐसे आउटपुट प्रदर्शित करते हैं कि मॉडल को उसकी कॉपीराइट सामग्री पर प्रशिक्षित किया गया था और वे इसे मांग पर उत्पन्न कर सकते हैं, जो प्रत्यक्ष और सहायक उल्लंघन का गठन करता है।

टाइम्स यह भी दावा करता है कि ओपनएआई और माइक्रोसॉफ्ट ने प्रशिक्षण डेटा से कॉपीराइट प्रबंधन जानकारी, जैसे कि बायलाइन और प्रकाशन तिथियां, को हटा दिया या अस्पष्ट कर दिया, जो डिजिटल मिलेनियम कॉपीराइट अधिनियम का उल्लंघन है। मुकदमे में कहा गया है कि प्रतिवादियों ने टाइम्स से लाइसेंस या अनुमति नहीं मांगी, इसके बावजूद कि उनके पास ऐसा करने के संसाधन थे, और यह कि लेखों का उनका उपयोग परिवर्तनकारी नहीं है, बल्कि मूल कार्य का विकल्प है।

कानूनी तर्क और बचाव

ओपनएआई और माइक्रोसॉफ्ट ने 2025 की शुरुआत तक शिकायत के लिए औपचारिक उत्तर दर्ज नहीं किया है, लेकिन उनके सार्वजनिक बयान और संबंधित मामलों में कानूनी दाखिले संभावित बचाव का सुझाव देते हैं। इनमें उचित उपयोग सिद्धांत शामिल है, जो आलोचना, टिप्पणी, समाचार रिपोर्टिंग, शिक्षण, या अनुसंधान जैसे उद्देश्यों के लिए अनुमति के बिना कॉपीराइट सामग्री के सीमित उपयोग की अनुमति देता है। प्रतिवादी तर्क दे सकते हैं कि कॉपीराइट पाठ पर प्रशिक्षण एक परिवर्तनकारी उपयोग है, क्योंकि मॉडल लेखों को पूर्ण रूप से पुन: उत्पन्न नहीं करते हैं, बल्कि सांख्यिकीय पैटर्न और भाषाई संरचनाओं को सीखते हैं।

एक और संभावित बचाव यह है कि मॉडल विशिष्ट लेखों को उगलने के लिए डिज़ाइन नहीं किए गए हैं, और कोई भी समानता भाषा की प्रकृति और कुछ वाक्यांशों की व्यापकता के कारण है। ओपनएआई ने कहा है कि यह उन वेबसाइटों के लिए "ऑप्ट-आउट" तंत्र का उपयोग करता है जो अपनी सामग्री को प्रशिक्षण के लिए उपयोग नहीं करना चाहते हैं, हालांकि टाइम्स का तर्क है कि यह कॉपीराइट धारकों पर अनुचित बोझ डालता है। यह मामला यह सवाल भी उठा सकता है कि क्या बड़े भाषा मॉडल का आउटपुट एक व्युत्पन्न कार्य का गठन करता है, एक अवधारणा जिसे अदालतों ने एआई के संदर्भ में अभी तक पूरी तरह से खोजा नहीं है।

प्रक्रियात्मक इतिहास और संबंधित मामले

यह मुकदमा दक्षिणी न्यूयॉर्क जिले के न्यायाधीश सिडनी एच. स्टीन को सौंपा गया था। 2024 की शुरुआत में, अदालत ने पूर्व-परीक्षण उद्देश्यों के लिए संबंधित मामलों को समेकित करने के लिए एक संयुक्त प्रस्ताव को मंजूरी दी, हालांकि टाइम्स का मामला अलग बना हुआ है। कई अन्य कॉपीराइट धारकों ने ओपनएआई और माइक्रोसॉफ्ट के खिलाफ समान मुकदमे दायर किए हैं, जिनमें सारा सिल्वरमैन और जॉर्ज आर.आर. मार्टिन जैसे लेखक, और स्टेबिलिटी एआई और मिडजर्नी के खिलाफ दृश्य कलाकार शामिल हैं। टाइम्स का मामला अपने पैमाने और वादी की एक प्रमुख मीडिया संगठन के रूप में स्थिति के लिए उल्लेखनीय है।

फरवरी 2024 में, अदालत ने खोज के लिए एक समय सारिणी निर्धारित करते हुए एक शेड्यूलिंग आदेश जारी किया, जिसमें परीक्षण की तारीख अनंतिम रूप से 2025 के अंत के लिए निर्धारित की गई थी। पक्षों ने व्यापक गति अभ्यास में संलग्न किया है, जिसमें खारिज करने के प्रस्ताव और सारांश निर्णय के प्रस्ताव शामिल हैं, हालांकि 2025 की शुरुआत तक कोई निर्णायक आदेश जारी नहीं किया गया है। इस मामले ने विभिन्न संगठनों, जिनमें ऑथर्स गिल्ड और इलेक्ट्रॉनिक फ्रंटियर फाउंडेशन शामिल हैं, से एमिकस ब्रीफ आकर्षित किए हैं, जो इसके व्यापक निहितार्थों को दर्शाता है।

एआई उद्योग के लिए निहितार्थ

इस मामले के परिणाम का बड़े भाषा मॉडल के विकास और कृत्रिम बुद्धिमत्ता के व्यापक क्षेत्र पर गहरा प्रभाव हो सकता है। यदि अदालत टाइम्स के पक्ष में फैसला करती है, तो यह ओपनएआई और माइक्रोसॉफ्ट को पर्याप्त क्षतिपूर्ति का भुगतान करने और अपनी प्रशिक्षण प्रथाओं को बदलने के लिए मजबूर कर सकता है, संभावित रूप से लाइसेंस प्राप्त डेटासेट के उपयोग या अधिक मजबूत सामग्री फ़िल्टरिंग के कार्यान्वयन की आवश्यकता हो सकती है। यह एआई विकास की लागत बढ़ा सकता है और छोटी कंपनियों और अनुसंधान संस्थानों के लिए प्रवेश में बाधाएं पैदा कर सकता है।

इसके विपरीत, प्रतिवादियों के पक्ष में एक फैसला सार्वजनिक रूप से उपलब्ध पाठ पर प्रशिक्षण की वैधता की पुष्टि करेगा, जो जनरेटिव एआई में निरंतर नवाचार के लिए हरी झंडी प्रदान करेगा। यह मामला अन्य प्रौद्योगिकी कंपनियों द्वारा बारीकी से देखा जा रहा है, जिनमें एंथ्रोपिक, गूगल-डीपमाइंड, और मेटा-एआई शामिल हैं, जो समान कानूनी चुनौतियों का सामना कर रहे हैं। यह एआई विनियमन के बारे में चल रही नीतिगत बहसों के साथ भी प्रतिच्छेद करता है, क्योंकि संयुक्त राज्य अमेरिका और यूरोप में सरकारें मशीन लर्निंग में कॉपीराइट सामग्री के उपयोग को नियंत्रित करने वाले नए कानूनों पर विचार कर रही हैं।

तकनीकी संदर्भ: एलएलएम कैसे प्रशिक्षित होते हैं

कानूनी मुद्दों को समझने के लिए, बड़े भाषा मॉडल को प्रशिक्षित करने की तकनीकी प्रक्रिया पर विचार करना सहायक है। ये मॉडल, 2017 में पेश किए गए ट्रांसफॉर्मर वास्तुकला पर आधारित हैं, पुस्तकों, वेबसाइटों और अन्य स्रोतों से अरबों शब्दों वाले विशाल डेटासेट पर प्रशिक्षित होते हैं। प्रशिक्षण के दौरान, मॉडल अपने आंतरिक मापदंडों - इसके तंत्रिका-नेटवर्क कनेक्शन के वजन - को एक अनुक्रम में अगले शब्द की भविष्यवाणी करने के लिए समायोजित करता है, एक प्रक्रिया जिसे स्व-पर्यवेक्षित शिक्षण के रूप में जाना जाता है। इसके लिए मॉडल को पाठ में सांख्यिकीय नियमितताओं को एन्कोड करने की आवश्यकता होती है, जिसमें तथ्य, शैलियां, और कभी-कभी शब्दशः वाक्यांश शामिल होते हैं।

ओपनएआई के GPT-3 और GPT-4 के लिए प्रशिक्षण डेटा में कॉमन क्रॉल, एक सार्वजनिक वेब संग्रह, का एक बड़ा हिस्सा, साथ ही विकिपीडिया और पुस्तकों जैसे क्यूरेटेड डेटासेट शामिल थे। टाइम्स का आरोप है कि उसके लेख बिना अनुमति के इन डेटासेट में शामिल किए गए थे। मॉडल की विशिष्ट अंशों को पुन: उत्पन्न करने की क्षमता एक ज्ञात घटना है, जिसे अक्सर "स्मरण" कहा जाता है, जो तब होता है जब कुछ अनुक्रम प्रशिक्षण डेटा में बार-बार दिखाई देते हैं। शोधकर्ताओं ने दिखाया है कि बड़े भाषा मॉडल कॉपीराइट कार्यों से लंबे अंशों को उगल सकते हैं, जो उल्लंघन के बारे में चिंताएं बढ़ाता है।

व्यापक कानूनी परिदृश्य और उचित उपयोग

उचित उपयोग सिद्धांत, जो यू.एस. कॉपीराइट अधिनियम की धारा 107 में संहिताबद्ध है, चार कारकों पर विचार करता है: उपयोग का उद्देश्य और चरित्र, कॉपीराइट कार्य की प्रकृति, उपयोग किए गए हिस्से की मात्रा और पर्याप्तता, और संभावित बाजार पर प्रभाव। अदालतों ने खोज इंजन और वीडियो रिकॉर्डिंग जैसी प्रौद्योगिकियों पर उचित उपयोग लागू किया है, लेकिन एआई प्रशिक्षण के लिए आवेदन नया है। 2023 के मामले ऑथर्स गिल्ड बनाम गूगल में, दूसरे सर्किट ने माना कि खोज के लिए पुस्तकों का गूगल का डिजिटलीकरण उचित उपयोग था, लेकिन उस मामले में गैर-अभिव्यंजक उपयोग शामिल था, जबकि एआई मॉडल अभिव्यंजक सामग्री उत्पन्न कर सकते हैं।

टाइम्स का तर्क है कि उपयोग परिवर्तनकारी नहीं है क्योंकि मॉडल मूल लेखों के साथ प्रतिस्पर्धा करने वाले पाठ उत्पन्न करने के लिए डिज़ाइन किए गए हैं, संभावित रूप से टाइम्स वेबसाइट पर ट्रैफ़िक और सदस्यता राजस्व को कम करते हैं। प्रतिवादी यह प्रतिवाद कर सकते हैं कि मॉडल लेखों को प्रतिस्थापित नहीं करते हैं, बल्कि जानकारी तक पहुंचने का एक नया तरीका प्रदान करते हैं, जैसे खोज इंजन। इन कारकों का अदालत का विश्लेषण अन्य एआई कंपनियों और सामग्री निर्माताओं से जुड़े भविष्य के मामलों के लिए एक मिसाल स्थापित करेगा।

वर्तमान स्थिति और दृष्टिकोण

2025 की शुरुआत तक, यह मामला खोज चरण में है, दोनों पक्ष साक्ष्य और विशेषज्ञ रिपोर्टों का आदान-प्रदान कर रहे हैं। अदालत ने अभी तक मूल कानूनी प्रश्नों पर फैसला नहीं किया है, और 2025 के अंत तक परीक्षण की उम्मीद नहीं है। पक्षों ने समझौता वार्ता में संलग्न किया है, लेकिन कोई समझौता नहीं हुआ है। यह मामला कई हाई-प्रोफाइल मुकदमों में से एक है जो एआई के लिए कानूनी वातावरण को आकार देगा, संगीत लेबल और छवि जनरेटर से जुड़े मामलों के साथ।

परिणाम इस बात पर निर्भर करेगा कि अदालत तथ्यों की व्याख्या कैसे करती है और तेजी से विकसित हो रही तकनीक पर मौजूदा कानून कैसे लागू करती है। कानूनी विद्वान संभावित परिणाम पर विभाजित हैं, कुछ उचित उपयोग का फैसला करने की भविष्यवाणी करते हैं और अन्य टाइम्स के पक्ष में फैसले की उम्मीद करते हैं। इसके राष्ट्रीय महत्व के कारण, यह मामला अंततः दूसरे सर्किट और संभवतः सुप्रीम कोर्ट में अपील किया जा सकता है। परिणाम के बावजूद, इसने पहले ही कई एआई कंपनियों को सामग्री प्रदाताओं से लाइसेंस लेने के लिए प्रेरित किया है, और जनरेटिव एआई द्वारा उत्पन्न अद्वितीय चुनौतियों को संबोधित करने के लिए नए कानून की आवश्यकता के बारे में चर्चाओं को तेज कर दिया है।

पत्रकारिता और मीडिया पर प्रभाव

मुकदमे ने मीडिया उद्योग और एआई डेवलपर्स के बीच व्यापक तनाव को भी उजागर किया है। समाचार संगठन अपनी रिपोर्टिंग की सुरक्षा के लिए कॉपीराइट पर भरोसा करते हैं, लेकिन एआई सिस्टम समाचार को एकत्र और सारांशित कर सकते हैं जो उनके व्यवसाय मॉडल को कमजोर कर सकते हैं। टाइम्स अपने स्वयं के एआई उपकरणों की खोज में सक्रिय रहा है, लेकिन यह जोर देता है कि उसकी सामग्री के किसी भी उपयोग की भरपाई की जानी चाहिए। एसोसिएटेड प्रेस और एक्सल स्प्रिंगर सहित अन्य प्रकाशकों ने ओपनएआई के साथ लाइसेंसिंग समझौतों पर हस्ताक्षर किए हैं, जबकि टाइम्स ने मुकदमेबाजी को चुना है।

यदि टाइम्स जीत जाता है, तो यह अन्य प्रकाशकों से समान मुकदमों की लहर पैदा कर सकता है, संभावित रूप से एआई कंपनियों को सामूहिक लाइसेंसिंग व्यवस्था पर बातचीत करने के लिए मजबूर कर सकता है। यह मीडिया संगठनों के लिए एक नया राजस्व स्रोत बना सकता है, लेकिन एआई नवाचार की गति को भी धीमा कर सकता है। इसके विपरीत, टाइम्स के लिए एक हार एआई कंपनियों को बिना अनुमति के सामग्री स्क्रैप करना जारी रखने के लिए प्रोत्साहित कर सकती है, संभावित रूप से पत्रकारिता की वित्तीय व्यवहार्यता को नुकसान पहुंचा सकती है। इस प्रकार यह मामला प्रौद्योगिकी और प्रेस के बीच संबंधों में एक महत्वपूर्ण मोड़ का प्रतिनिधित्व करता है।

निष्कर्ष

न्यूयॉर्क टाइम्स कंपनी बनाम माइक्रोसॉफ्ट कॉर्पोरेशन एक निर्णायक कानूनी लड़ाई है जो कृत्रिम बुद्धिमत्ता के युग में कॉपीराइट की सीमाओं को परिभाषित करने में मदद करेगी। इसका समाधान एआई डेवलपर्स, सामग्री निर्माताओं और जनता के लिए दूरगामी परिणाम होंगे, जो प्रभावित करेगा कि जानकारी कैसे उत्पादित, एक्सेस और मुद्रीकृत की जाती है। जैसे-जैसे मामला आगे बढ़ता है, इसे कानूनी विशेषज्ञों, प्रौद्योगिकीविदों और मीडिया अधिकारियों द्वारा समान रूप से बारीकी से देखा जाएगा, जो मशीन बुद्धि के नवीनतम रूपों पर सदियों पुराने कॉपीराइट सिद्धांतों के अनुप्रयोग के लिए एक परीक्षण मामले के रूप में कार्य करेगा।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·artificial-intelligence·lawsuits·large-language-models
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास