अंग्रेज़ी से अनुवादित

NYT बनाम OpenAI (2023) एक कॉपीराइट उल्लंघन मुकदमा है, जिसे द न्यूयॉर्क टाइम्स ने दिसंबर 2023 में OpenAI और Microsoft के खिलाफ दायर किया था, जिसमें AI मॉडलों को प्रशिक्षित करने के लिए लाखों लेखों के अनधिकृत उपयोग का आरोप लगाया गया है। यह मामला हर्जाने और प्रशिक्षण डेटा के विनाश की मांग करता है, जो जनरेटिव AI में उचित उपयोग के बारे में महत्वपूर्ण प्रश्न उठाता है।

NYT बनाम OpenAI (2023) एक ऐतिहासिक कॉपीराइट उल्लंघन मुकदमा है, जिसे द न्यूयॉर्क टाइम्स कंपनी ने OpenAI और उसके प्रमुख निवेशक Microsoft के खिलाफ 27 दिसंबर 2023 को अमेरिकी जिला न्यायालय, दक्षिणी जिला न्यूयॉर्क में दायर किया था। शिकायत में आरोप लगाया गया है कि OpenAI और Microsoft ने अपने बड़े भाषा मॉडल, जिनमें GPT-4 और ChatGPT शामिल हैं, को प्रशिक्षित करने के लिए बिना अनुमति के लाखों कॉपीराइट समाचार लेखों का उपयोग किया, और ये मॉडल अब टाइम्स की सामग्री को ऐसे तरीकों से पुन: प्रस्तुत और "याद" करते हैं जो सीधे अखबार के अपने उत्पादों के साथ प्रतिस्पर्धा करते हैं। यह मुकदमा प्रति उल्लंघित कार्य $150,000 तक की वैधानिक क्षतिपूर्ति, टाइम्स सामग्री के आगे उपयोग पर रोक, और ऐसी सामग्री वाले सभी प्रशिक्षण डेटासेट के विनाश की मांग करता है।

इस मामले को व्यापक रूप से जनरेटिव एआई उद्योग और सामग्री निर्माताओं के बीच बड़े संघर्ष के लिए एक संकेतक के रूप में देखा जाता है, क्योंकि यह परीक्षण करता है कि क्या "उचित उपयोग" सिद्धांत मॉडल प्रशिक्षण के लिए कॉपीराइट पाठ की बड़े पैमाने पर स्क्रैपिंग तक विस्तारित होता है। परिणाम एआई विकास की अर्थव्यवस्था को नया आकार दे सकता है, कंपनियों को लाइसेंसिंग समझौतों पर बातचीत करने या प्रशिक्षण पाइपलाइनों को फिर से डिजाइन करने के लिए मजबूर कर सकता है। 2025 की शुरुआत तक, यह मामला मुकदमे से पहले की कार्यवाही में बना हुआ है, दोनों पक्षों ने खारिज करने के प्रस्ताव और प्रति-दावे दायर किए हैं।

पृष्ठभूमि: जनरेटिव एआई और डेटा स्क्रैपिंग का उदय

यह मुकदमा गहन शिक्षण में तेजी से प्रगति और ट्रांसफॉर्मर-आधारित मॉडलों के वाणिज्यिक तैनाती की पृष्ठभूमि में उभरा। 2015 में स्थापित OpenAI ने 2020 में GPT-3 और नवंबर 2022 में ChatGPT जारी किया, जो जल्दी ही इतिहास में सबसे तेजी से बढ़ने वाले उपभोक्ता अनुप्रयोगों में से एक बन गया। ये मॉडल सार्वजनिक इंटरनेट से स्क्रैप किए गए विशाल पाठ संग्रह पर प्रशिक्षित होते हैं, जिनमें समाचार लेख, किताबें और शैक्षणिक पेपर शामिल हैं। टाइम्स का आरोप है कि इसकी सामग्री, जो काफी हद तक पेवॉल के पीछे है, बिना प्राधिकरण के इन डेटासेट में दिखाई दी, अक्सर ऐसी मात्रा में कि यह प्रशिक्षण सामग्री का एक महत्वपूर्ण हिस्सा बन गई।

Microsoft, जिसने OpenAI में $13 बिलियन से अधिक का निवेश किया और अपने मॉडलों को Bing Chat और Office 365 जैसे उत्पादों में एकीकृत किया, को कथित रूप से उल्लंघन करने वाली प्रणालियों को तैनात करने और उनसे लाभ कमाने में भूमिका के लिए सह-प्रतिवादी के रूप में नामित किया गया है। शिकायत में विशिष्ट उदाहरणों का हवाला दिया गया है जहां ChatGPT ने टाइम्स के लेखों से लगभग शब्द-दर-शब्द अंश उत्पन्न किए, जिनमें टैक्सी उद्योग पर 2019 की जांच और बंधक ब्याज दरों पर 2020 का लेख शामिल है, यह दर्शाता है कि मॉडल मांग पर कॉपीराइट पाठ को पुन: उत्पन्न कर सकते हैं।

कानूनी दावे और मांगें

टाइम्स कई कारणों का दावा करता है, जिनमें प्रत्यक्ष कॉपीराइट उल्लंघन, योगदानकारी उल्लंघन, और प्रतिनिधिक उल्लंघन शामिल हैं। यह तर्क देता है कि OpenAI और Microsoft ने प्रशिक्षण और अनुमान के दौरान इसके कार्यों की नकल की, संग्रहीत किया और वितरित किया, और मॉडलों के आउटपुट अनधिकृत व्युत्पन्न कार्यों का गठन करते हैं। शिकायत इस बात पर जोर देती है कि प्रतिवादियों ने "अपना व्यवसाय दूसरों के काम की पीठ पर बनाया" और टाइम्स ने पत्रकारिता पर अरबों डॉलर खर्च किए जिसे एआई कंपनियों ने मुफ्त में हड़प लिया।

मौद्रिक क्षतिपूर्ति के अलावा, टाइम्स एक स्थायी निषेधाज्ञा का अनुरोध करता है जो OpenAI और Microsoft को अपने प्रशिक्षण डेटासेट से टाइम्स सामग्री की सभी प्रतियां हटाने और भविष्य में उपयोग को रोकने की आवश्यकता होगी। यह मांग अपने पैमाने में अभूतपूर्व है, क्योंकि यह प्रभावी रूप से कंपनियों को अपने मॉडलों को शुरू से फिर से प्रशिक्षित करने के लिए मजबूर करेगी, एक प्रक्रिया जिसमें सैकड़ों मिलियन डॉलर खर्च होंगे और संभावित रूप से मॉडल की गुणवत्ता को कम करेगी। टाइम्स प्रतिवादियों को अपने प्रशिक्षण डेटा स्रोतों का खुलासा करने और भविष्य के उल्लंघन को रोकने के लिए तकनीकी उपायों को लागू करने का आदेश देने का भी अनुरोध करता है।

OpenAI की बचाव: उचित उपयोग और सार्वजनिक हित

OpenAI ने फरवरी 2024 में अपनी प्रतिक्रिया दायर की, यह तर्क देते हुए कि कॉपीराइट सामग्री का इसका उपयोग उचित उपयोग अपवाद के अंतर्गत आता है, जो आलोचना, टिप्पणी, समाचार रिपोर्टिंग, शिक्षण और अनुसंधान जैसे उद्देश्यों के लिए सीमित पुनरुत्पादन की अनुमति देता है। कंपनी का दावा है कि एआई मॉडल को प्रशिक्षित करना एक परिवर्तनकारी उपयोग है जो मूल कार्यों का विकल्प नहीं है, और मॉडल विशिष्ट ग्रंथों को याद करने के बजाय पैटर्न और तथ्य सीखते हैं। OpenAI अपने "ऑप्ट-आउट" तंत्र की ओर भी इशारा करता है, जो वेबसाइट मालिकों को अपने वेब क्रॉलर को ब्लॉक करने की अनुमति देता है, और अन्य प्रकाशकों, जैसे एसोसिएटेड प्रेस और एक्सेल स्प्रिंगर के साथ चल रही साझेदारी को बौद्धिक संपदा का सम्मान करने के अच्छे इरादों के प्रमाण के रूप में इंगित करता है।

Microsoft ने इन तर्कों को दोहराया, इस बात पर जोर देते हुए कि मॉडल नई सामग्री उत्पन्न करने के उपकरण हैं, न कि मौजूदा लेखों को पुन: उत्पन्न करने के लिए। प्रतिवादी यह भी नोट करते हैं कि टाइम्स ने स्वयं विभिन्न उद्देश्यों के लिए एआई उपकरणों का उपयोग किया और अखबार की शिकायत प्रतिस्पर्धा को दबाने का एक प्रयास है। कानूनी विद्वान इन बचावों की ताकत पर विभाजित हैं, कुछ तर्क देते हैं कि नकल का पैमाना और उपयोग की वाणिज्यिक प्रकृति उचित उपयोग के खिलाफ है, जबकि अन्य मशीन लर्निंग की परिवर्तनकारी प्रकृति को एक मजबूत औचित्य के रूप में इंगित करते हैं।

उद्योग प्रतिक्रियाएं और समानांतर मुकदमे

टाइम्स मुकदमा एआई कंपनियों के खिलाफ मुकदमों की लहर का हिस्सा है। 2023 में, सारा सिल्वरमैन, क्रिस्टोफर गोल्डन और रिचर्ड काद्रे सहित लेखकों ने OpenAI और Meta के खिलाफ क्लास-एक्शन मुकदमे दायर किए, जबकि हास्य कलाकार सारा सिल्वरमैन का मामला बाद में दूसरों के साथ समेकित किया गया। Getty Images ने छवि जनरेटर को प्रशिक्षित करने में अपनी तस्वीरों के उपयोग के लिए यू.के. और अमेरिका में Stability AI के खिलाफ मुकदमा दायर किया। 2024 में, Authors Guild ने OpenAI के खिलाफ क्लास-एक्शन दायर किया, और शिकागो ट्रिब्यून और न्यूयॉर्क डेली न्यूज सहित कई समाचार पत्र OpenAI और Microsoft के खिलाफ एक अलग मुकदमे में शामिल हुए।

इन मामलों ने उद्योग से कई प्रतिक्रियाएं उत्पन्न की हैं। कुछ कंपनियां, जैसे Anthropic और Google DeepMind, ने प्रकाशकों से सामग्री लाइसेंस करना शुरू कर दिया है, जबकि अन्य ने संगीत स्ट्रीमिंग के लिए उपयोग किए जाने वाले समान वैधानिक लाइसेंसिंग योजना के लिए तर्क दिया है। अमेरिकी कॉपीराइट कार्यालय ने 2023 में एआई और कॉपीराइट पर एक सार्वजनिक जांच शुरू की, और यूरोपीय संघ ने 2024 में एआई अधिनियम पारित किया, जिसमें प्रशिक्षण डेटा के लिए पारदर्शिता आवश्यकताएं शामिल हैं। टाइम्स मामले का परिणाम एक मिसाल स्थापित कर सकता है जो इन सभी प्रयासों को प्रभावित करेगा।

प्रमुख कानूनी प्रश्न और मिसालें

केंद्रीय कानूनी प्रश्न यह है कि क्या कॉपीराइट पाठ पर एआई मॉडल को प्रशिक्षित करना उचित उपयोग का गठन करता है। अदालतों ने ऐतिहासिक रूप से चार-कारक परीक्षण लागू किया है: उपयोग का उद्देश्य और चरित्र, कॉपीराइट कार्य की प्रकृति, उपयोग किए गए हिस्से की मात्रा और महत्वपूर्णता, और संभावित बाजार पर प्रभाव। 2015 के मामले Authors Guild v. Google में, दूसरे सर्किट ने पाया कि खोज के लिए Google का पुस्तकों का डिजिटलीकरण उचित उपयोग था, लेकिन उस मामले में सीमित स्निपेट और गैर-वाणिज्यिक उद्देश्य शामिल थे। टाइम्स का तर्क है कि इसके लेख अत्यधिक रचनात्मक और अभिव्यंजक हैं, प्रतिवादियों ने पूरे कार्यों की नकल की, और ChatGPT की सारांश और अंश उत्पन्न करने की क्षमता सीधे टाइम्स के लाइसेंसिंग राजस्व और सदस्यता व्यवसाय को नुकसान पहुंचाती है।

एक और प्रमुख मुद्दा "याद रखने" की समस्या है। OpenAI ने स्वीकार किया है कि बड़े भाषा मॉडल कभी-कभी प्रशिक्षण डेटा को शब्द-दर-शब्द पुन: उत्पन्न कर सकते हैं, खासकर जब कुछ तरीकों से संकेत दिया जाता है। टाइम्स की शिकायत में ऐसे आउटपुट के उदाहरण शामिल हैं, जिन्हें कंपनी परिवर्तनकारी नहीं बल्कि थोक नकल का एक रूप मानती है। प्रतिवादी इसका प्रतिवाद करते हैं कि ये उदाहरण दुर्लभ हैं और मॉडल सामान्यीकरण के लिए डिज़ाइन किए गए हैं, याद रखने के लिए नहीं। विशेषज्ञ गवाहों से मॉडल प्रशिक्षण के तकनीकी विवरण और पुनरुत्पादन की संभावना पर दोनों पक्षों से गवाही देने की उम्मीद है।

प्रक्रियात्मक इतिहास और वर्तमान स्थिति

शिकायत दायर होने के बाद, अदालत ने मामला न्यायाधीश सिडनी एच. स्टीन को सौंपा। 2024 की शुरुआत में, OpenAI और Microsoft ने खारिज करने के प्रस्ताव दायर किए, यह तर्क देते हुए कि टाइम्स ने प्रत्यक्ष उल्लंघन का पर्याप्त रूप से आरोप नहीं लगाया क्योंकि उसने विशिष्ट उल्लंघनकारी आउटपुट की पहचान नहीं की। टाइम्स ने मार्च 2024 में अपनी शिकायत में संशोधन किया, और अधिक उदाहरण जोड़े और अपने दावों को स्पष्ट किया। जुलाई 2024 में, न्यायाधीश स्टीन ने खारिज करने के प्रस्तावों को अस्वीकार कर दिया, जिससे मामला खोज चरण में आगे बढ़ सका। यह फैसला टाइम्स के लिए एक महत्वपूर्ण जीत के रूप में देखा गया, क्योंकि इसने प्रतिवादियों के तर्क को खारिज कर दिया कि मामला बहुत अटकलबाजी पर आधारित था।

खोज चरण विवादास्पद होने की उम्मीद है, टाइम्स OpenAI के प्रशिक्षण डेटा और डेटा सोर्सिंग के बारे में आंतरिक संचार तक पहुंच चाहता है। OpenAI ने कुछ अनुरोधों का विरोध किया है, व्यापार रहस्यों और विशाल डेटासेट उत्पन्न करने के बोझ का हवाला देते हुए। अदालत ने पार्टियों को संभावित समझौते पर चर्चा करने का भी आदेश दिया है, लेकिन 2025 की शुरुआत तक कोई समझौता नहीं हुआ है। मुकदमे की तारीख निर्धारित नहीं की गई है, लेकिन कानूनी पर्यवेक्षकों का अनुमान है कि यह 2025 के अंत या 2026 में शुरू हो सकता है।

एआई विकास के लिए व्यापक निहितार्थ

इस मामले के दोनों पक्षों से परे निहितार्थ हैं। यदि टाइम्स जीतता है, तो एआई कंपनियों को सभी कॉपीराइट प्रशिक्षण डेटा के लिए लाइसेंस प्राप्त करने की आवश्यकता हो सकती है, जिससे लागत बढ़ सकती है और नवाचार धीमा हो सकता है। कुछ स्टार्टअप केवल सार्वजनिक डोमेन या सिंथेटिक डेटा का उपयोग करने के लिए स्थानांतरित हो सकते हैं, जबकि बड़ी फर्में स्वामित्व डेटासेट या प्रकाशकों के साथ साझेदारी में निवेश कर सकती हैं। यह मामला ओपन-सोर्स मॉडल के विकास को भी प्रभावित कर सकता है, जो भारी मात्रा में स्क्रैप किए गए डेटा पर निर्भर करते हैं और लाइसेंसिंग आवश्यकताओं का पालन करने के लिए संसाधन नहीं हो सकते हैं।

इसके विपरीत, यदि OpenAI प्रबल होता है, तो यह बिना अनुमति के कॉपीराइट सामग्री पर प्रशिक्षण की प्रथा को वैध बना सकता है, संभावित रूप से अधिक आक्रामक स्क्रैपिंग और रचनाकारों के लिए कम मुआवजे की ओर ले जा सकता है। यह परिणाम एआई-जनित सामग्री की ओर रुझान को तेज कर सकता है, पारंपरिक मीडिया कंपनियों पर और दबाव डाल सकता है। इसलिए यह मामला प्रौद्योगिकीविदों, वकीलों और पत्रकारों द्वारा समान रूप से बारीकी से देखा जाता है, क्योंकि यह मशीन लर्निंग के युग में बौद्धिक संपदा की सीमाओं को परिभाषित करने में मदद करेगा।

निष्कर्ष

NYT बनाम OpenAI (2023) जनरेटिव एआई युग के लिए एक निर्णायक कानूनी लड़ाई है। यह लेखकत्व, स्वामित्व और मानव रचनात्मकता के मूल्य के बारे में मौलिक प्रश्न उठाता है, ऐसी दुनिया में जहां मशीनें बड़े पैमाने पर पाठ उत्पन्न कर सकती हैं। मामले का समाधान, चाहे न्यायिक फैसले या समझौते के माध्यम से, दशकों के लिए एआई अनुसंधान, मीडिया अर्थशास्त्र और कॉपीराइट कानून के भविष्य को आकार देने की संभावना है। जैसे-जैसे मुकदमेबाजी सामने आती है, यह एक अनुस्मारक के रूप में कार्य करता है कि तंत्रिका नेटवर्क और मशीन लर्निंग की तीव्र प्रगति केवल एक तकनीकी कहानी नहीं है, बल्कि एक गहरी मानवीय कहानी है कि तकनीकी प्रगति से किसे लाभ होता है और किसे लागत वहन करनी पड़ती है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:copyright-law·artificial-intelligence·litigation·media-industry
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास