अमेरिकी कॉपीराइट कार्यालय (USCO), जो लाइब्रेरी ऑफ कांग्रेस की एक इकाई है, ने Artificial intelligence प्रणालियों के प्रशिक्षण में कॉपीराइट कृतियों के उपयोग की जांच की है। इसके निष्कर्ष, जो 2024 से शुरू होकर रिपोर्टों की एक श्रृंखला में जारी किए गए, इस बात को संबोधित करते हैं कि क्या और कैसे मौजूदा कॉपीराइट कानून Machine learning मॉडलों द्वारा संरक्षित सामग्री के अंतर्ग्रहण पर लागू होता है, जिसमें Large language model और अन्य Generative AI उपकरण शामिल हैं। कार्यालय का विश्लेषण एआई और बौद्धिक संपदा पर विधायी और न्यायिक चर्चाओं के लिए एक संदर्भ बिंदु बन गया है।
इस क्षेत्र में कॉपीराइट कार्यालय की भूमिका अमेरिकी कॉपीराइट कानून को प्रशासित करने और कांग्रेस को सलाह देने के इसके व्यापक जनादेश से उत्पन्न होती है। विधायी शाखा के हिस्से के रूप में, यह कॉपीराइट लागू नहीं करता बल्कि नीति सिफारिशें प्रदान करता है और दावों का पंजीकरण करता है। एआई प्रशिक्षण डेटा पर इसकी रिपोर्टों ने सार्वजनिक टिप्पणियों, विशेषज्ञ गवाही और अंतरराष्ट्रीय तुलनाओं पर आधारित होकर कानूनी परिदृश्य को स्पष्ट करने का लक्ष्य रखा है, बिना नई विधान निर्धारित किए जब तक कि कांग्रेस इसका अनुरोध न करे।
पृष्ठभूमि: कॉपीराइट और एआई प्रशिक्षण
एक एआई मॉडल को प्रशिक्षित करने में आमतौर पर पाठ, छवियों या अन्य कृतियों के बड़े डेटासेट को Neural network या Transformer (architecture) आर्किटेक्चर में फीड करना शामिल होता है। यह प्रक्रिया, जिसे मशीन लर्निंग के रूप में जाना जाता है, मॉडल को पैटर्न पहचानने और नए आउटपुट उत्पन्न करने की अनुमति देती है। डेटासेट में अक्सर कॉपीराइट पुस्तकें, लेख, तस्वीरें और कलाकृतियाँ शामिल होती हैं, जो सवाल उठाती हैं कि क्या ऐसा उपयोग उल्लंघन का गठन करता है या उचित उपयोग जैसे अपवादों के अंतर्गत आता है।
USCO के शामिल होने से पहले, अदालतों ने OpenAI और Anthropic जैसी कंपनियों से जुड़े मामलों में इन मुद्दों को संबोधित करना शुरू कर दिया था, लेकिन कोई समान मानक उभर कर सामने नहीं आया था। कॉपीराइट कार्यालय की रिपोर्टों का उद्देश्य कानूनी सिद्धांतों और व्यावहारिक निहितार्थों का एक व्यापक अवलोकन प्रदान करना है, जो नीति निर्माताओं और हितधारकों दोनों का मार्गदर्शन करने में मदद करे।
2023 की जांच की सूचना
अगस्त 2023 में, कॉपीराइट कार्यालय ने फेडरल रजिस्टर में एक जांच की सूचना जारी की, जिसमें कॉपीराइट और एआई पर सार्वजनिक टिप्पणियाँ मांगी गईं, विशेष रूप से प्रशिक्षण डेटा पर ध्यान केंद्रित किया गया। जांच में एआई प्रशिक्षण की प्रकृति, कॉपीराइट कृतियों के उपयोग की सीमा, और दायित्व के पक्ष और विपक्ष में कानूनी तर्कों के बारे में पूछा गया। व्यक्तियों, कंपनियों, शैक्षणिक संस्थानों और वकालत समूहों से 10,000 से अधिक टिप्पणियाँ प्रस्तुत की गईं, जो इस मुद्दे के उच्च दांव को दर्शाती हैं।
कार्यालय ने रचनाकारों, प्रौद्योगिकी फर्मों और कानूनी विशेषज्ञों सहित हितधारकों के साथ श्रवण सत्र भी आयोजित किए। इन सत्रों ने भिन्न दृष्टिकोणों को उजागर किया: कुछ ने तर्क दिया कि अनुमति के बिना कॉपीराइट कृतियों पर प्रशिक्षण एक परिवर्तनकारी उचित उपयोग है, जबकि अन्य ने कहा कि इसके लिए लाइसेंसिंग या मुआवजे की आवश्यकता है। टिप्पणियों और सत्रों ने बाद की रिपोर्ट को सूचित किया।
2024 की रिपोर्ट: कॉपीराइट और कृत्रिम बुद्धिमत्ता
मार्च 2024 में, कॉपीराइट कार्यालय ने अपनी रिपोर्ट का पहला भाग जारी किया, जिसका शीर्षक "कॉपीराइट और कृत्रिम बुद्धिमत्ता" था, जो डिजिटल प्रतिकृतियों और प्रशिक्षण में कॉपीराइट कृतियों के उपयोग पर केंद्रित था। रिपोर्ट ने निष्कर्ष निकाला कि मौजूदा कॉपीराइट कानून, विशेष रूप से उचित उपयोग सिद्धांत, एआई प्रशिक्षण पर लागू हो सकता है, लेकिन इसने एक सामान्य छूट या नए अनिवार्य लाइसेंस का समर्थन करने से इनकार कर दिया। इसके बजाय, इसने मामले-दर-मामले विश्लेषण पर जोर दिया, जिसमें उपयोग के उद्देश्य, कॉपीराइट कृति की प्रकृति, उपयोग की मात्रा और बाजार पर प्रभाव जैसे कारकों पर विचार किया गया।
रिपोर्ट ने नोट किया कि Deep learning प्रक्रिया में अक्सर पूरी कृतियों को प्रशिक्षण डेटासेट में कॉपी करना शामिल होता है, जो उचित उपयोग के खिलाफ जा सकता है, लेकिन इसने यह भी स्वीकार किया कि एआई आउटपुट की परिवर्तनकारी प्रकृति एक बचाव का समर्थन कर सकती है। कार्यालय ने सिफारिश की कि कांग्रेस विकास की निगरानी करे और यदि आवश्यक हो तो लक्षित विधान पर विचार करे, लेकिन इसने विशिष्ट वैधानिक परिवर्तनों का प्रस्ताव करने से परहेज किया।
प्रशिक्षण डेटा पर मुख्य निष्कर्ष
प्रशिक्षण डेटा पर रिपोर्ट के मुख्य निष्कर्षों में शामिल हैं:
- अंतर्ग्रहण पुनरुत्पादन के रूप में: एक एआई मॉडल को प्रशिक्षित करने में आमतौर पर कृतियों की प्रतियां बनाना शामिल होता है, जो कॉपीराइट कानून के तहत पुनरुत्पादन अधिकार को प्रभावित करता है।
- उचित उपयोग स्वचालित नहीं है: कार्यालय ने इस तर्क को खारिज कर दिया कि एआई प्रशिक्षण स्वाभाविक रूप से उचित उपयोग है, इस बात पर जोर देते हुए कि प्रत्येक मामले का मूल्यांकन उसके तथ्यों पर किया जाना चाहिए।
- बाजार प्रभाव: रिपोर्ट ने विचार किया कि क्या एआई प्रशिक्षण मूल कृतियों के बाजार को नुकसान पहुंचाता है या लाभ पहुंचाता है, यह देखते हुए कि यह कारक अक्सर विवादित होता है।
- पारदर्शिता और उत्पत्ति: कार्यालय ने प्रशिक्षण डेटा स्रोतों के स्वैच्छिक प्रकटीकरण को प्रोत्साहित किया, लेकिन व्यावहारिक चुनौतियों का हवाला देते हुए ऐसे प्रकटीकरण को अनिवार्य नहीं किया।
इन निष्कर्षों को चल रहे मुकदमेबाजी में उद्धृत किया गया है, जैसे कि लेखकों द्वारा एआई कंपनियों के खिलाफ दायर मुकदमे, और एआई नीति पर कांग्रेस की सुनवाई में।
2025 का अद्यतन और चल रहा कार्य
2025 की शुरुआत में, कॉपीराइट कार्यालय ने डिजिटल प्रतिकृतियों और राज्य प्रचार अधिकारों के साथ इसके अंतर्संबंध को संबोधित करते हुए एक अनुवर्ती रिपोर्ट जारी की। इसने एआई के अन्य पहलुओं की जांच करने की योजना भी घोषित की, जिसमें एआई-जनित आउटपुट की कॉपीराइट योग्यता शामिल है। कार्यालय का कार्य नेतृत्व विवाद से जटिल हो गया है: मई 2025 में, राष्ट्रपति डोनाल्ड ट्रम्प ने रजिस्ट्रार शिरा पर्लमटर को बर्खास्त करने का दावा किया, लेकिन यह पद कांग्रेस का एक कर्मचारी है, और पर्लमटर के अधिकार को अदालत में बरकरार रखा गया है। इस अनिश्चितता ने कार्यालय की एआई पहलों की निरंतरता के बारे में सवाल उठाए हैं।
विवाद के बावजूद, कार्यालय ने मार्गदर्शन प्रकाशित करना और अंतरराष्ट्रीय चर्चाओं में भाग लेना जारी रखा है, जैसे कि विश्व बौद्धिक संपदा संगठन में। इसकी रिपोर्टें यह समझने के लिए एक प्रमुख संसाधन बनी हुई हैं कि अमेरिकी कॉपीराइट कानून एआई प्रशिक्षण पर कैसे लागू होता है।
उद्योग और नीति के लिए निहितार्थ
USCO के निष्कर्षों के एआई डेवलपर्स, सामग्री निर्माताओं और नीति निर्माताओं के लिए महत्वपूर्ण निहितार्थ हैं। OpenAI, Anthropic और Google DeepMind जैसी कंपनियों के लिए, रिपोर्टें स्पष्ट करती हैं कि वे उचित उपयोग संरक्षण नहीं मान सकते, जिससे लाइसेंसिंग समझौतों या प्रशिक्षण प्रथाओं में बदलाव की आवश्यकता बढ़ सकती है। रचनाकारों के लिए, रिपोर्टें पुष्टि करती हैं कि उनकी कृतियाँ संरक्षित हैं, लेकिन वे अपारदर्शी प्रशिक्षण प्रक्रियाओं के खिलाफ अधिकारों को लागू करने की कठिनाई को भी उजागर करती हैं।
विधायी रूप से, रिपोर्टों ने प्रस्तावित विधेयकों को सूचित किया है, जैसे कि जनरेटिव एआई कॉपीराइट प्रकटीकरण अधिनियम, जो एआई कंपनियों को अपने प्रशिक्षण डेटा का प्रकटीकरण करने की आवश्यकता होगी। कॉपीराइट कार्यालय ने इस विशिष्ट विधेयक का समर्थन नहीं किया है, लेकिन इसने पारदर्शिता के विचार को नीति लक्ष्य के रूप में समर्थन दिया है।
आलोचनाएँ और बहसें
कॉपीराइट कार्यालय के दृष्टिकोण को दोनों पक्षों से आलोचना का सामना करना पड़ा है। कुछ प्रौद्योगिकी अधिवक्ता तर्क देते हैं कि रिपोर्टें बहुत सतर्क हैं और नवाचार को दबा सकती हैं, जबकि कुछ रचनाकार समूहों का मानना है कि वे अधिकारों की रक्षा में पर्याप्त नहीं जाती हैं। कानूनी विद्वानों ने भी कार्यालय की उचित उपयोग की व्याख्या पर बहस की है, कुछ का तर्क है कि मामले-दर-मामले दृष्टिकोण एआई प्रशिक्षण के पैमाने के लिए अव्यावहारिक है।
विवाद का एक और बिंदु कॉपीराइट कार्यालय की भूमिका है। लाइब्रेरी ऑफ कांग्रेस के हिस्से के रूप में, यह विधायी शाखा के भीतर काम करता है, लेकिन इसकी सलाहकार भूमिका अदालतों पर बाध्यकारी नहीं है। रिपोर्टें प्रभावशाली हैं, लेकिन उनके पास कानून का बल नहीं है, और अदालतें अलग-अलग निष्कर्षों पर पहुंच सकती हैं।
भविष्य की दिशाएँ
आगे देखते हुए, कॉपीराइट कार्यालय से एआई पर अपना काम जारी रखने की उम्मीद है, जिसमें कॉपीराइट योग्यता और संभावित विधायी सिफारिशों पर अतिरिक्त रिपोर्टें शामिल हैं। नेतृत्व विवाद का परिणाम कार्यालय की प्राथमिकताओं को प्रभावित कर सकता है, लेकिन कांग्रेस को सलाह देने का इसका जनादेश अपरिवर्तित है। जैसे-जैसे एआई प्रौद्योगिकी विकसित होती है, कार्यालय संभवतः सिंथेटिक डेटा के उपयोग और रचनात्मक उद्योगों पर एआई के प्रभाव जैसी नई चुनौतियों का समाधान करने के लिए अपने निष्कर्षों पर पुनर्विचार करेगा।
अभी के लिए, प्रशिक्षण डेटा पर USCO की रिपोर्टें कॉपीराइट और कृत्रिम बुद्धिमत्ता के जटिल अंतर्संबंध को नेविगेट करने के लिए एक आधारभूत ढांचा प्रदान करती हैं। वे एक संतुलित दृष्टिकोण की आवश्यकता को रेखांकित करती हैं जो नवाचार और रचनाकारों के अधिकारों दोनों का सम्मान करता है, एक लक्ष्य जिसके लिए सभी हितधारकों के बीच निरंतर संवाद की आवश्यकता होगी।