यूके एआई सुरक्षा अनुसंधान

अंग्रेज़ी से अनुवादित

यूके एआई सुरक्षा अनुसंधान उन्नत कृत्रिम बुद्धिमत्ता से उत्पन्न जोखिमों का अध्ययन और शमन करने के लिए यूके सरकारी निकायों, शैक्षणिक संस्थानों और निजी प्रयोगशालाओं के समन्वित प्रयासों को संदर्भित करता है, जिसमें 2023 में एआई सुरक्षा संस्थान की स्थापना भी शामिल है।

यूके एआई सुरक्षा अनुसंधान में यूनाइटेड किंगडम में सरकारी एजेंसियों, विश्वविद्यालयों और निजी प्रयोगशालाओं की समन्वित गतिविधियाँ शामिल हैं, जो उन्नत कृत्रिम बुद्धिमत्ता प्रणालियों द्वारा उत्पन्न जोखिमों को समझने और कम करने के लिए समर्पित हैं। इस क्षेत्र ने 2023 में महत्वपूर्ण सार्वजनिक प्रमुखता प्राप्त की, जब यूके सरकार ने ब्लेचले पार्क में पहला वैश्विक एआई सुरक्षा शिखर सम्मेलन आयोजित किया और बाद में एक समर्पित राज्य-समर्थित अनुसंधान निकाय के रूप में एआई सुरक्षा संस्थान (AISI) की स्थापना की। यूके का दृष्टिकोण अंतर्राष्ट्रीय सहयोग, तकनीकी मूल्यांकन और सीमांत मॉडलों के लिए सुरक्षा मानकों के विकास पर जोर देता रहा है, जिसमें बड़े भाषा मॉडल आर्किटेक्चर और ट्रांसफॉर्मर प्रौद्योगिकी पर निर्मित मॉडल शामिल हैं।

इस क्षेत्र में अनुसंधान कई विषयों में फैला हुआ है, जिसमें मशीन लर्निंग मजबूती, व्याख्यात्मकता, संरेखण और जनरेटिव एआई के सामाजिक प्रभाव शामिल हैं। ऑक्सफोर्ड विश्वविद्यालय और कैम्ब्रिज विश्वविद्यालय जैसे यूके-आधारित संस्थानों ने मौलिक कार्यों में योगदान दिया है, जबकि गूगल डीपमाइंड (मुख्यालय लंदन में) और एंथ्रोपिक (जिसने 2023 में यूके कार्यालय खोला) जैसी निजी क्षेत्र की संस्थाओं ने सुरक्षा मूल्यांकन पर सरकारी निकायों के साथ साझेदारी की है। यह क्षेत्र तकनीकी कंप्यूटर विज्ञान और सार्वजनिक नीति के प्रतिच्छेदन पर संचालित होता है, जिसमें भविष्य की प्रणालियों से विनाशकारी परिणामों को रोकने पर ध्यान केंद्रित किया गया है।

सरकारी नेतृत्व वाली पहल

यूके सरकार का एआई सुरक्षा अनुसंधान के लिए प्राथमिक माध्यम एआई सुरक्षा संस्थान है, जिसे नवंबर 2023 में £100 मिलियन के प्रारंभिक बजट के साथ शुरू किया गया था। संस्थान के अधिदेश में सीमांत मॉडलों का पूर्व-परिनियोजन परीक्षण, मूल्यांकन बेंचमार्क विकसित करना और प्रणालीगत जोखिमों पर शोध प्रकाशित करना शामिल है। अप्रैल 2024 में, संस्थान ने अपनी पहली प्रमुख रिपोर्ट, "एआई सुरक्षा संस्थान मूल्यांकन दृष्टिकोण" जारी की, जिसमें साइबर-आक्रमण, जैविक दुरुपयोग और स्वायत्त प्रतिकृति जैसे क्षेत्रों में क्षमताओं का आकलन करने की पद्धतियों की रूपरेखा दी गई। संस्थान ने ओपनएआई, एंथ्रोपिक और गूगल डीपमाइंड के साथ औपचारिक साझेदारी भी स्थापित की है, जिससे शोधकर्ताओं को परीक्षण के लिए पूर्व-रिलीज़ मॉडलों तक पहुंच मिलती है।

एक दूसरी प्रमुख पहल फ्रंटियर एआई टास्कफोर्स है, जिसे 2023 में विज्ञान, नवाचार और प्रौद्योगिकी विभाग के तहत बनाया गया था। टेक उद्यमी इयान होगार्थ के नेतृत्व वाली इस टास्कफोर्स को 2024 की शुरुआत में एआई सुरक्षा संस्थान में शामिल कर लिया गया। यूके ने मई 2024 में दक्षिण कोरिया के साथ एआई सियोल शिखर सम्मेलन की सह-मेजबानी भी की, जहां भाग लेने वाले देशों ने सीमांत मॉडलों के लिए सुरक्षा ढांचे प्रकाशित करने पर सहमति व्यक्त की।

शैक्षणिक और अनुसंधान योगदान

यूके के विश्वविद्यालयों ने एआई सुरक्षा अनुसंधान में केंद्रीय भूमिका निभाई है। ऑक्सफोर्ड विश्वविद्यालय का फ्यूचर ऑफ ह्यूमैनिटी इंस्टीट्यूट, जिसकी स्थापना दार्शनिक निक बोस्ट्रोम ने 2005 में की थी, ने एआई से अस्तित्वगत जोखिम पर प्रभावशाली कार्य किया, जिसमें 2014 की पुस्तक "सुपरइंटेलिजेंस" शामिल है। कैम्ब्रिज विश्वविद्यालय में अस्तित्वगत जोखिम अध्ययन केंद्र ने भी इसी तरह दीर्घकालिक जोखिमों पर ध्यान केंद्रित किया है। 2023 में, यूके रिसर्च एंड इनोवेशन (UKRI) ने यूके रिसर्च एंड इनोवेशन एआई सुरक्षा हब स्थापित करने के लिए £31 मिलियन आवंटित किए, जो 12 विश्वविद्यालयों में अंतःविषय परियोजनाओं को वित्तपोषित करता है।

यूके प्रयोगशालाओं के तकनीकी अनुसंधान ने मुख्य सुरक्षा विधियों में योगदान दिया है। गूगल डीपमाइंड के शोधकर्ताओं ने आरएलएआईएफ (एआई फीडबैक से सुदृढीकरण सीखना) तकनीक विकसित की, जो मानव लेबल के बजाय एआई-जनित आलोचनाओं का उपयोग करके संरेखण में सुधार करती है। एलन ट्यूरिंग इंस्टीट्यूट (मुख्यालय लंदन में) जैसे संस्थानों में मॉडल प्रूनिंग और व्याख्यात्मकता पर काम ने तंत्रिका नेटवर्क मॉडलों में आंतरिक प्रतिनिधित्व की पहचान और नियंत्रण के तरीकों का पता लगाया है।

निजी क्षेत्र की भागीदारी

कई प्रमुख एआई कंपनियों ने यूके-आधारित सुरक्षा अनुसंधान संचालन स्थापित किए हैं। गूगल डीपमाइंड, जिसकी स्थापना 2010 में लंदन में हुई थी, अपना मुख्यालय वहीं बनाए हुए है और उसने सुरक्षा विषयों पर व्यापक रूप से प्रकाशित किया है, जिसमें 2016 का पेपर "कंक्रीट प्रॉब्लम्स इन एआई सेफ्टी" शामिल है। एंथ्रोपिक ने 2023 में लंदन कार्यालय खोला और रेड-टीमिंग अभ्यासों पर एआई सुरक्षा संस्थान के साथ सहयोग किया है। ओपनएआई ने 2023 में लंदन में उपस्थिति स्थापित की, और अपनी संरेखण टीम के लिए पूर्व डीपमाइंड शोधकर्ताओं को नियुक्त किया।

यूके ने एआई बुनियादी ढांचे में भी निवेश आकर्षित किया है जो सुरक्षा अनुसंधान का समर्थन करता है। एआरएम होल्डिंग्स, जिसका मुख्यालय कैम्ब्रिज में है, एआई प्रशिक्षण प्रणालियों में उपयोग होने वाले चिप्स का उत्पादन करती है, जबकि ब्रिस्टल-आधारित अर्धचालक कंपनी ग्राफकोर ने मशीन-लर्निंग कार्यभार के लिए डिज़ाइन किया गया इंटेलिजेंस प्रोसेसिंग यूनिट (IPU) विकसित किया। ये हार्डवेयर विकास सुरक्षा-महत्वपूर्ण मॉडलों के अधिक कुशल प्रशिक्षण और मूल्यांकन को सक्षम बनाते हैं।

अंतर्राष्ट्रीय सहयोग और मानक

यूके ने खुद को एआई सुरक्षा अनुसंधान के लिए वैश्विक समन्वयक के रूप में स्थापित किया है। नवंबर 2023 शिखर सम्मेलन में 28 देशों द्वारा हस्ताक्षरित ब्लेचले घोषणा ने हस्ताक्षरकर्ताओं को सुरक्षित एआई विकास के लिए साझा सिद्धांतों के लिए प्रतिबद्ध किया। यूके के एआई सुरक्षा संस्थान ने यूएस एआई सुरक्षा संस्थान (2024 में स्थापित) और जापानी एआई सुरक्षा संस्थान (2024 में स्थापित) के साथ द्विपक्षीय शोध साझेदारी स्थापित की है। फरवरी 2025 में, यूके और यूएस ने मॉडल मूल्यांकन पर एक संयुक्त शोध कार्यक्रम की घोषणा की, जो मल्टी-हेड अटेंशन व्याख्यात्मकता और प्रतिकूल मजबूती पर केंद्रित है।

यूके अंतर्राष्ट्रीय एआई सुरक्षा रिपोर्ट में भी भाग लेता है, जो ट्यूरिंग पुरस्कार विजेता योशुआ बेंगियो के नेतृत्व में एक सहयोगात्मक प्रयास है जो वैश्विक शोध निष्कर्षों को संश्लेषित करता है। जनवरी 2025 में प्रकाशित पहला संस्करण, 30 देशों के 96 विशेषज्ञों के योगदान के साथ आया, जिसमें यूके के शोधकर्ताओं ने हानि फलन और मूल्यांकन मेट्रिक्स पर अध्यायों का योगदान दिया।

चुनौतियाँ और भविष्य की दिशाएँ

प्रगति के बावजूद, यूके एआई सुरक्षा अनुसंधान को कई चुनौतियों का सामना करना पड़ता है। गहन शिक्षण उन्नति की तीव्र गति का अर्थ है कि मूल्यांकन विधियाँ अक्सर मॉडल क्षमताओं से पीछे रह जाती हैं। शोधकर्ताओं ने हालिया बड़े भाषा मॉडल रिलीज़ में देखे गए खरबों मापदंडों वाली प्रणालियों के लिए सुरक्षा परीक्षणों को बढ़ाने में कठिनाइयों पर ध्यान दिया है। यह क्षेत्र "संरेखण समस्या" से भी जूझता है - यह सुनिश्चित करना कि एआई प्रणालियाँ मानवीय मूल्यों के अनुसार कार्य करें - जो सामान्य-उद्देश्य एजेंटों के लिए अनसुलझा बना हुआ है।

भविष्य की दिशाओं में व्याख्यात्मकता अनुसंधान के लिए बढ़ी हुई फंडिंग शामिल है, जिसमें एआई सुरक्षा संस्थान ने मार्च 2025 में लेयर नॉर्मलाइज़ेशन गतिशीलता और यांत्रिक व्याख्यात्मकता पर परियोजनाओं के लिए £10 मिलियन अनुदान कार्यक्रम की घोषणा की। यूके सरकार ने एक नया एआई सुरक्षा अधिनियम भी प्रस्तावित किया है, जो मध्य-2025 तक संसदीय समीक्षा के अधीन है, जो यूके में तैनात सभी सीमांत मॉडलों के लिए सुरक्षा परीक्षण को अनिवार्य करेगा। इन प्रयासों का परिणाम संभवतः राष्ट्रीय नीति और जिम्मेदार एआई विकास के लिए वैश्विक मानदंडों दोनों को आकार देगा।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:ai-safety·uk-government·machine-learning·public-policy
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास