सुसंगत एक्सट्रापोलेटेड वोलिशन (सीईवी) एआई संरेखण के क्षेत्र में एक सैद्धांतिक ढांचा है जो उस दृष्टिकोण का वर्णन करता है जिसके द्वारा एक कृत्रिम अतिबुद्धिमत्ता (एएसआई) इस परोपकारी धारणा पर कार्य करेगी कि मनुष्य क्या चाह सकते हैं यदि वे अधिक जानकार, अधिक तर्कसंगत, सोचने के लिए अधिक समय वाले, और एक समाज के रूप में एक साथ परिपक्व हुए होते, मानवता की वर्तमान व्यक्तिगत या सामूहिक प्राथमिकताओं के विपरीत। इसे 2004 में एलिज़र युडकोवस्की द्वारा मैत्रीपूर्ण एआई पर अपने काम के भाग के रूप में प्रस्तावित किया गया था।
यह अवधारणा उन्नत एआई प्रणालियों के लिए लक्ष्य निर्धारित करने की चुनौती को संबोधित करती है जो मानव बुद्धि से आगे निकल सकती हैं। नियमों या मूल्यों का एक निश्चित समूह कूटबद्ध करने के बजाय, सीईवी सुझाव देता है कि एक एएसआई को मानवता की वोलिशन को एक्सट्रापोलेट करके अपने उद्देश्य प्राप्त करने चाहिए, जिसका लक्ष्य यह प्रतिबिंबित करना है कि लोग आदर्श ज्ञानमीमांसीय और नैतिक परिस्थितियों में क्या चाह सकते हैं।
अवधारणा
सीईवी प्रस्ताव करता है कि एक उन्नत एआई प्रणाली को मानवता की वोलिशन को एक्सट्रापोलेट करके अपने लक्ष्य प्राप्त करने चाहिए। इसका मतलब है मानव प्राथमिकताओं को एकत्र करना और उन्हें एक ऐसी प्रक्रिया में प्रक्षेपित करना जो दर्शाती है कि लोग आदर्श ज्ञानमीमांसीय और नैतिक परिस्थितियों में क्या चाह सकते हैं। इसका उद्देश्य यह सुनिश्चित करना है कि एआई प्रणालियाँ मानवता के वास्तविक हितों का अतिक्रमण न करें; न तो क्षणिक या खराब सूचित प्राथमिकताओं का पालन करें, और न ही उन मुद्दों पर निर्णय लें जिन पर मानवता की इच्छा अभी तक अप्रत्याशित है।
काव्यात्मक शब्दों में, हमारी सुसंगत एक्सट्रापोलेटेड वोलिशन हमारी इच्छा है यदि हम अधिक जानते, तेज़ सोचते, अधिक वे लोग होते जो हम चाहते थे कि हम होते, एक साथ और दूर तक बड़े हुए होते; जहाँ एक्सट्रापोलेशन अभिसरण करता है बजाय विचलन के, जहाँ हमारी इच्छाएँ सुसंगत होती हैं बजाय हस्तक्षेप के; एक्सट्रापोलेटेड जैसा हम चाहते हैं कि वह एक्सट्रापोलेटेड हो, व्याख्या की गई जैसा हम चाहते हैं कि वह व्याख्या की गई हो।
यह ढांचा मानवीय और आत्म-सुधारात्मक होने के लिए डिज़ाइन किया गया है, जो मानव मूल्यों के स्रोत को पकड़ने पर ध्यान केंद्रित करता है बजाय उन्हें सूचीबद्ध करने की कोशिश करने के। यह नियमों की एक स्पष्ट, निश्चित सूची बिछाने की कठिनाई से बचता है। यह नैतिक विकास को समाहित करता है, वर्तमान त्रुटिपूर्ण नैतिक विश्वासों को बंद होने से रोकता है। यह उस प्रभाव को सीमित करता है जो प्रोग्रामरों का एक छोटा समूह एएसआई के मूल्यांकन पर डाल सकता है, जिससे पहले एएसआई बनाने के प्रोत्साहन भी कम होते हैं। और यह मानवता को उसकी नियति का प्रभारी रखता है।
बहस
युडकोवस्की और निक बोस्ट्रोम ध्यान देते हैं कि सीईवी में कई दिलचस्प गुण हैं, लेकिन इसे महत्वपूर्ण सैद्धांतिक और व्यावहारिक चुनौतियों का भी सामना करना पड़ता है। बोस्ट्रोम नोट करते हैं कि सीईवी में "कई मुक्त पैरामीटर हैं जिन्हें विभिन्न तरीकों से निर्दिष्ट किया जा सकता है, जिससे प्रस्ताव के विभिन्न संस्करण प्राप्त होते हैं।" ऐसा एक पैरामीटर एक्सट्रापोलेशन आधार है (जिसकी एक्सट्रापोलेटेड वोलिशन को ध्यान में रखा जाता है)। उदाहरण के लिए, क्या इसमें गंभीर मनोभ्रंश वाले लोग, वनस्पति अवस्था में मरीज़, भ्रूण, या भ्रूण शामिल होने चाहिए। वह यह भी नोट करते हैं कि यदि सीईवी का एक्सट्रापोलेशन आधार केवल मनुष्यों को शामिल करता है, तो एक जोखिम है कि परिणाम अन्य जानवरों और डिजिटल दिमागों के प्रति उदार नहीं होगा। एक संभावित समाधान सीईवी के एक्सट्रापोलेशन आधार का विस्तार करने के लिए एक तंत्र शामिल करना होगा।
ये बहसें एआई संरेखण और एआई सुरक्षा पर व्यापक प्रवचन का हिस्सा हैं, जो यह जांचती हैं कि कैसे सुनिश्चित किया जाए कि उन्नत एआई प्रणालियाँ मानव मूल्यों और हितों के अनुसार कार्य करें।
विविधताएँ और विकल्प
सीईवी का एक प्रस्तावित सैद्धांतिक विकल्प एक कृत्रिम अतिबुद्धिमत्ता की बेहतर संज्ञानात्मक क्षमताओं पर भरोसा करना है ताकि वह पता लगा सके कि नैतिक रूप से क्या सही है, और उसे उसी के अनुसार कार्य करने देना है। दोनों तकनीकों को संयोजित करना भी संभव है, उदाहरण के लिए एएसआई सीईवी का पालन करता है सिवाय जब यह नैतिक रूप से अनुचित हो।
एक अन्य समीक्षा में, एक दार्शनिक विश्लेषण सीईवी को स्वायत्त प्रणालियों में सामाजिक विश्वास के लेंस के माध्यम से खोजता है। एंथनी गिडेंस की "सक्रिय विश्वास" की अवधारणा पर आधारित, लेखक सीईवी के "सुसंगत, एक्सट्रापोलेटेड और क्लस्टर्ड वोलिशन" (सीईसीवी) में विकास का प्रस्ताव करता है। यह सूत्रीकरण विविध सांस्कृतिक समूहों की नैतिक प्राथमिकताओं को बेहतर ढंग से प्रतिबिंबित करने का लक्ष्य रखता है, इस प्रकार एआई प्रणालियों को डिज़ाइन करने के लिए एक अधिक व्यावहारिक नैतिक ढांचा प्रदान करता है जो सार्वजनिक विश्वास अर्जित करते हैं और सामाजिक विविधता को समायोजित करते हैं।
अन्य एआई अवधारणाओं से संबंध
सीईवी कृत्रिम बुद्धिमत्ता अनुसंधान के व्यापक क्षेत्र के भीतर स्थित है, विशेष रूप से उन चर्चाओं में जो मानवता के लिए लाभकारी प्रणालियों को डिज़ाइन करने के तरीके के बारे में हैं। यह उन दृष्टिकोणों के विपरीत है जो स्पष्ट नियम-आधारित प्रणालियों या मानव प्रतिक्रिया से सीखने पर निर्भर करते हैं, जैसे आरएलएचएफ (मानव प्रतिक्रिया से सुदृढीकरण सीखना), जो आधुनिक बड़े भाषा मॉडल में उपयोग किया जाता है। जबकि आरएलएचएफ का लक्ष्य पुनरावृत्त प्रतिक्रिया के माध्यम से मॉडल को वर्तमान मानव प्राथमिकताओं के साथ संरेखित करना है, सीईवी उन प्राथमिकताओं का एक अधिक महत्वाकांक्षी एक्सट्रापोलेशन प्रस्ताव करता है।
यह ढांचा एआई प्रणालियों में तर्कसंगतता और निर्णय लेने के बारे में प्रश्नों से भी संबंधित है। यह मानता है कि प्राथमिकताओं का एक सुसंगत समूह है जिस पर मनुष्य आदर्श परिस्थितियों में अभिसरण करेंगे, जो एक विवादास्पद दार्शनिक धारणा है।
यह भी देखें
- एआई संरेखण
- एआई सुरक्षा
- कृत्रिम बुद्धिमत्ता
- तर्कसंगतता