न्यूयॉर्क टाइम्स बनाम OpenAI

अंग्रेज़ी से अनुवादित

न्यूयॉर्क टाइम्स बनाम ओपनएआई एक कॉपीराइट उल्लंघन मुकदमा है, जो अखबार द्वारा ओपनएआई और माइक्रोसॉफ्ट के खिलाफ एआई चैटबॉट्स को प्रशिक्षित करने के लिए अपने लेखों के अनधिकृत उपयोग पर दायर किया गया है, जिसमें बड़े पैमाने पर नकल और आर्थिक नुकसान का आरोप लगाया गया है।

न्यूयॉर्क टाइम्स बनाम OpenAI एक कॉपीराइट उल्लंघन मुकदमा है, जिसे द न्यूयॉर्क टाइम्स कंपनी ने दिसंबर 2023 में OpenAI और माइक्रोसॉफ्ट के खिलाफ दायर किया था। यह मामला लाखों कॉपीराइट समाचार लेखों के कथित अनधिकृत उपयोग पर केंद्रित है, जिनका उपयोग ChatGPT और अन्य उत्पादों को संचालित करने वाले बड़े भाषा मॉडलों को प्रशिक्षित करने के लिए किया गया था। अखबार अरबों डॉलर का हर्जाना मांगता है और उन AI मॉडलों और डेटासेटों के विनाश की मांग करता है जिनमें उसकी सामग्री शामिल है या उससे प्राप्त हुई है। 2025 तक, यह मुकदमा न्यूयॉर्क के दक्षिणी जिले के लिए संयुक्त राज्य जिला न्यायालय में जारी है, जिसमें सुनवाई की तारीख 2025 के अंत या 2026 की शुरुआत में निर्धारित है।

पृष्ठभूमि: जनरेटिव AI और कॉपीराइट

Generative AI पर आधारित बड़े भाषा मॉडलों के उदय ने कॉपीराइट कानून में एक नई सीमा बनाई। ये प्रणालियाँ, जो ट्रांसफॉर्मर आर्किटेक्चर पर निर्मित हैं, इंटरनेट से स्क्रैप किए गए पाठ के विशाल संग्रह को ग्रहण करती हैं, जिसमें समाचार लेख, पुस्तकें और वेबसाइटें शामिल हैं। OpenAI का ChatGPT, जो पहली बार नवंबर 2022 में जारी किया गया था, ने मानव-समान प्रतिक्रियाएँ उत्पन्न करने की क्षमता प्रदर्शित की, जो अक्सर कॉपीराइट पाठ को पुन: प्रस्तुत या बारीकी से अनुवादित करती थीं। इस व्यवहार ने कानूनी प्रश्न उठाए कि क्या कॉपीराइट सामग्री पर AI को प्रशिक्षित करना उचित उपयोग या कार्रवाई योग्य उल्लंघन है। लेखकों और अधिकार धारकों की ओर से कई मुकदमे दायर किए गए, लेकिन टाइम्स का मामला अपने पैमाने और प्रमुख प्रौद्योगिकी निगमों की भागीदारी के कारण सबसे प्रमुख बन गया।

पक्षकार और कानूनी दावे

वादी, द न्यूयॉर्क टाइम्स कंपनी, एक प्रमुख अमेरिकी समाचार पत्र है जिसका कॉपीराइट प्रवर्तन का एक मजबूत इतिहास है। प्रतिवादियों में OpenAI और उसका वाणिज्यिक साझेदार माइक्रोसॉफ्ट शामिल हैं, जिसने OpenAI के उत्पादों के लिए क्लाउड बुनियादी ढाँचा और विशेष क्लाउड होस्टिंग प्रदान की। माइक्रोसॉफ्ट के GitHub Copilot का भी नाम लिया गया है, हालाँकि प्राथमिक ध्यान ChatGPT और अंतर्निहित मॉडलों पर बना हुआ है।

27 दिसंबर, 2023 को न्यूयॉर्क के दक्षिणी जिले में दायर अपनी शिकायत में, टाइम्स ने कई दावे किए: प्रत्यक्ष कॉपीराइट उल्लंघन, योगदानकारी उल्लंघन, प्रतिनिधिक उल्लंघन, और लैनहम अधिनियम के तहत अनुचित प्रतिस्पर्धा। टाइम्स ने आरोप लगाया कि OpenAI और माइक्रोसॉफ्ट ने बिना अनुमति के उसके लाखों लेखों की प्रतिलिपि बनाई, उन्हें मॉडलों को प्रशिक्षित करने के लिए उपयोग किया, और मॉडलों को ऐसे आउटपुट उत्पन्न करने में सक्षम बनाया जो मूल पाठ को "याद" करते हैं, "दोहराते हैं" या अनुवादित करते हैं, अक्सर विशेषता हटाकर। शिकायत में दर्जनों उदाहरण शामिल थे जहाँ ChatGPT ने टाइम्स के लेखों के लगभग शब्द-दर-शब्द अंश उत्पन्न किए, कभी-कभी पूरे पैराग्राफ भी।

अखबार ने प्रत्येक उल्लंघित कार्य के लिए $150,000 तक की वैधानिक क्षति की मांग की, जो विचाराधीन लेखों की संख्या को देखते हुए अरबों तक हो सकती है। इसने अपने कॉपीराइट सामग्री को शामिल करने वाले सभी प्रशिक्षण डेटा और मॉडलों के विलोपन या विनाश के साथ-साथ भविष्य के उपयोग को रोकने वाले निषेधाज्ञा की भी मांग की।

OpenAI और माइक्रोसॉफ्ट की प्रतिक्रिया

OpenAI और माइक्रोसॉफ्ट ने फरवरी 2024 में खारिज करने के प्रस्ताव दायर किए, यह तर्क देते हुए कि प्रशिक्षण के लिए कॉपीराइट सामग्री का उपयोग अमेरिकी कॉपीराइट कानून के तहत उचित उपयोग है। उन्होंने तर्क दिया कि मॉडल सामग्री को सांख्यिकीय संबंधों की नई, गैर-अभिव्यंजक संरचनाओं में बदल देते हैं, और विचाराधीन आउटपुट या तो कानूनी सारांश थे या उपयोगकर्ता संकेतों का परिणाम थे जिन्होंने पुनरुत्पादन को प्रेरित किया। उन्होंने यह भी तर्क दिया कि टाइम्स के "स्मरण" के दावे अतिरंजित थे और कंपनी ने वास्तविक नुकसान साबित नहीं किया था।

अपने कानूनी ब्रीफ में, प्रतिवादियों ने नोट किया कि टाइम्स को विशेष रूप से AI के कारण पाठक संख्या में गिरावट नहीं हुई थी, और अखबार ने स्वयं AI-जनित सामग्री का उपयोग करने का प्रयोग किया था। उन्होंने वेब स्क्रैपिंग के उद्योग अभ्यास को प्रथागत बताया। खारिज करने के प्रस्ताव आंशिक रूप से सफल रहे: सितंबर 2024 में, न्यायाधीश सिडनी एच. स्टीन ने प्रतिनिधिक उल्लंघन से संबंधित दावों को खारिज कर दिया, लेकिन प्रत्यक्ष उल्लंघन और योगदानकारी दावों को आगे बढ़ने की अनुमति दी। झूठे समर्थन के लिए लैनहम अधिनियम का दावा भी खारिज कर दिया गया, अदालत ने सुझाव दिया कि टाइम्स इसे फिर से दायर करे।

प्रमुख कानूनी मुद्दे और मिसालें

यह मामला कई अनसुलझे सिद्धांतों को छूता है। केंद्रीय प्रश्न यह है कि क्या कॉपीराइट कार्यों पर प्रशिक्षण उचित उपयोग के चार-कारक परीक्षण के तहत परिवर्तनकारी है, जो उपयोग के उद्देश्य, कार्य की प्रकृति, उपयोग की मात्रा और बाजार पर प्रभाव की जाँच करता है। अदालतों ने ऐतिहासिक रूप से माना है कि कुछ प्रकार के डिजिटल पुनरुत्पादन, जैसे Google की पुस्तक स्कैनिंग परियोजना, उचित उपयोग के रूप में योग्य हैं। हालाँकि, टाइम्स का तर्क है कि जनरेटिव AI अलग है क्योंकि इसके आउटपुट सीधे मूल लेखों के साथ प्रतिस्पर्धा कर सकते हैं, संभावित रूप से सदस्यता राजस्व और लाइसेंसिंग अवसरों को कम कर सकते हैं।

एक और मुद्दा "स्मरण" घटना है। शोध से पता चला है कि बड़े भाषा मॉडल संकेत देने पर प्रशिक्षण डेटा को फिर से बना सकते हैं, विशेष रूप से अस्पष्ट या दोहराए गए पाठ के लिए। टाइम्स ने ऐसे उदाहरण दर्ज किए जहाँ ChatGPT ने उसके लेखों को लगभग शब्द-दर-शब्द पुन: प्रस्तुत किया, यह सुझाव देते हुए कि मॉडल ने सामग्री को पूरी तरह से परिवर्तित नहीं किया था। OpenAI ने बनाए रखा कि ऐसे आउटपुट दुर्लभ हैं और उन्होंने लंबे पुनरुत्पादन को रोकने के लिए तकनीकी उपाय लागू किए हैं।

AI उद्योग पर व्यापक प्रभाव

इस मुकदमे का व्यापक AI पारिस्थितिकी तंत्र पर महत्वपूर्ण प्रभाव है। कई कंपनियाँ, जिनमें Anthropic, Google DeepMind, और Apple शामिल हैं, ने समान मुकदमों का सामना किया है या कर रही हैं या प्रकाशकों के साथ लाइसेंसिंग समझौते किए हैं। परिणाम एक मिसाल स्थापित कर सकता है कि क्या AI कंपनियों को प्रशिक्षण डेटा के लिए अनुमति लेनी होगी और भुगतान करना होगा या वे वेब को स्वतंत्र रूप से स्क्रैप करना जारी रख सकती हैं।

मुकदमेबाजी के जवाब में, कई मीडिया संगठनों ने OpenAI और अन्य कंपनियों के साथ समझौते किए हैं। उदाहरण के लिए, एसोसिएटेड प्रेस, एक्सल स्प्रिंगर और न्यूज़ कॉर्प ने कथित तौर पर लाइसेंसिंग समझौते किए हैं, जबकि नेशनल पब्लिक रेडियो और शिकागो ट्रिब्यून जैसे अन्य ने विकल्पों की खोज की है। यह मामला सामग्री लाइसेंसिंग की ओर रुझान को तेज कर सकता है, क्योंकि AI फर्में कानूनी जोखिम को कम करना चाहती हैं। इसके विपरीत, टाइम्स के पक्ष में एक फैसला प्रशिक्षण डेटासेटों के संकलन के तरीके में मौलिक बदलाव ला सकता है, संभावित रूप से स्टार्टअप और छोटे खिलाड़ियों के लिए लागत बढ़ा सकता है।

कानूनी कार्यवाही और समयरेखा

यह मामला पूर्व-परीक्षण चरणों से आगे बढ़ा है। 2024 में, पक्षकारों ने व्यापक खोज में संलग्न हुए, अदालत ने OpenAI को प्रशिक्षण डेटा लॉग और आंतरिक संचार उत्पन्न करने का आदेश दिया। टाइम्स ने रिकॉर्ड भी प्राप्त किए जो दिखाते हैं कि OpenAI के कर्मचारियों को बिना अनुमति के कॉपीराइट सामग्री का उपयोग करने के बारे में चिंताएँ थीं। नवंबर 2024 में, अदालत ने माइक्रोसॉफ्ट के Copilot से संबंधित अतिरिक्त दावों को शामिल करने के टाइम्स के प्रस्ताव को अस्वीकार कर दिया, लेकिन शिकायत में संशोधन की अनुमति दी।

एक उल्लेखनीय विकास फरवरी 2025 में हुआ जब न्यायाधीश स्टीन ने 15 दिसंबर, 2025 के लिए परीक्षण निर्धारित करने वाले एक कार्यक्रम आदेश को मंजूरी दी। उन्होंने दूसरे सर्किट में एक संबंधित मामले के लंबित रहने तक परीक्षण में देरी करने के OpenAI के अनुरोध को भी अस्वीकार कर दिया, जिसमें एक अलग लेखक मुकदमा शामिल है। परीक्षण कई हफ्तों तक चलने की उम्मीद है और इसमें संभवतः AI प्रौद्योगिकी और अर्थशास्त्र पर विशेषज्ञ गवाही शामिल होगी।

आर्थिक और रणनीतिक विचार

टाइम्स के लिए, यह मुकदमा केवल क्षति के बारे में नहीं है। यह उसकी पत्रकारिता की रक्षा और AI द्वारा उपयोग की जाने वाली समाचार सामग्री के लिए लाइसेंसिंग बाजार स्थापित करने का एक प्रयास है। अखबार ने तर्क दिया है कि AI चैटबॉट पारंपरिक खोज और प्रत्यक्ष समाचार उपभोग को बदल सकते हैं, जिससे उसका सदस्यता मॉडल कमजोर हो सकता है। यह अपने ब्रांड को भी महत्व देता है और उम्मीद करता है कि जब उसकी रिपोर्टिंग का उपयोग किया जाए तो विशेषता दी जाए।

OpenAI, इस बीच, प्रमुख कानूनी फर्मों और बाहरी विशेषज्ञों को नियुक्त करते हुए कानूनी बचाव में भारी निवेश किया है। कंपनी ने कॉपीराइट और उचित उपयोग पर पेपर प्रकाशित करते हुए सार्वजनिक आउटरीच में भी संलग्न हुई है। माइक्रोसॉफ्ट, एक प्रमुख शेयरधारक और बुनियादी ढाँचा प्रदाता के रूप में, अपनी कानूनी टीम रखता है लेकिन बड़े पैमाने पर OpenAI की रणनीति के लिए विरोध किया है। वित्तीय दांव ऊँचे हैं: यदि टाइम्स जीतता है, तो यह अरबों में वैधानिक क्षति का दावा कर सकता है, और प्रतिवादियों के खिलाफ एक फैसला अन्य प्रकाशकों से अनुवर्ती मुकदमों की लहर को ट्रिगर कर सकता है।

उद्योग प्रतिक्रियाएँ और संवैधानिक संदर्भ

प्रतिक्रियाएँ विभाजित हैं। कई विद्वान और AI शोधकर्ता तर्क देते हैं कि कॉपीराइट पाठ पर प्रशिक्षण क्षेत्र को आगे बढ़ाने के लिए आवश्यक है और अत्यधिक प्रतिबंधात्मक फैसले नवाचार में बाधा डालेंगे। अन्य, जिनमें पत्रकार और लेखक शामिल हैं, टाइम्स का समर्थन करते हैं, इस मामले को रचनात्मक आजीविका की रक्षा के लिए आवश्यक मानते हैं। अमेरिकी कॉपीराइट कार्यालय ने जटिलता को स्वीकार करते हुए दिशानिर्देश जारी किए हैं, लेकिन AI प्रशिक्षण पर निर्णायक फैसले देने से परहेज किया है।

यह मामला पहले संशोधन विचारों को भी छूता है, क्योंकि AI-जनित सामग्री जानकारी प्रदान करने के लिए समाचारों को ग्रहण करने पर निर्भर करती है। सुप्रीम कोर्ट ने अभी तक इन मुद्दों को संबोधित नहीं किया है, जिससे जिला अदालतें अज्ञात क्षेत्र में नेविगेट कर रही हैं। कुछ ने इंटरनेट युग के ऐतिहासिक मामलों, जैसे सोनी बनाम यूनिवर्सल और ऑथर्स गिल्ड बनाम गूगल, के साथ समानताएँ खींची हैं, जिन्होंने तकनीकी प्रगति और कॉपीराइट सुरक्षा को संतुलित किया।

दांव पर क्या है

यदि अदालत फैसला करती है कि टाइम्स के लेखों का उपयोग उचित उपयोग नहीं है, तो यह कुछ OpenAI मॉडलों के विनाश का आदेश दे सकती है या लाइसेंसिंग योजना की आवश्यकता हो सकती है। ऐसा परिणाम AI कंपनियों को सार्वजनिक डोमेन या स्पष्ट रूप से लाइसेंस प्राप्त डेटा पर निर्भर रहने के लिए मजबूर कर सकता है, विकास को धीमा कर सकता है लेकिन संभावित रूप से सामग्री निर्माताओं के लिए एक नया व्यवसाय बना सकता है। इसके विपरीत, एक उचित उपयोग फैसला कई AI प्रयोगशालाओं के वर्तमान प्रथाओं को मान्य करेगा, हालाँकि यह स्वैच्छिक समझौतों को बाहर नहीं कर सकता है।

2025 के अंत तक, परीक्षण अभी शुरू नहीं हुआ है, और दोनों पक्षों ने समझौते के लिए खुलेपन का संकेत दिया है। OpenAI ने अन्य प्रकाशकों से सामग्री का लाइसेंस लिया है, जो बातचीत करने की इच्छा का सुझाव देता है। हालाँकि, टाइम्स ने मुकदमेबाजी के लिए अपनी प्रतिबद्धता व्यक्त की है, यह तर्क देते हुए कि अकेले लाइसेंसिंग AI द्वारा उत्पन्न "अस्तित्वगत खतरे" को हल नहीं करेगा। यह मामला कानून और प्रौद्योगिकी के प्रतिच्छेदन में सबसे अधिक देखे जाने वाले मामलों में से एक बना हुआ है, जिसका पत्रकारिता और डिजिटल अर्थव्यवस्था के भविष्य पर प्रभाव है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·legal-dispute·generative-ai·news-publishing
इस पृष्ठ को अंतिम बार संपादित किया गया 14 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास