अंग्रेज़ी से अनुवादित

पॉल क्रिस्टियानो एक अमेरिकी एआई सुरक्षा शोधकर्ता हैं, जिन्होंने उस तकनीक को सह-विकसित किया जो बाद में मानव प्रतिक्रिया से सुदृढीकरण सीखने ([[reinforcement-learning-from-human-feedback|मानव प्रतिक्रिया से सुदृढीकरण सीखना]]) के रूप में जानी गई, और बाद में उन्होंने [[alignment-research-center|संरेखण अनुसंधान केंद्र]] की स्थापना की।

पॉल क्रिस्टियानो एक अमेरिकी शोधकर्ता हैं जो AI संरेखण के क्षेत्र में जाने जाते हैं, जिन्होंने उस तकनीक को सह-विकसित किया जो RLHF बन गई, और उन्होंने एलाइनमेंट रिसर्च सेंटर की स्थापना की, जो एक गैर-लाभकारी संरेखण अनुसंधान संगठन है।

प्रारंभिक करियर और RLHF

क्रिस्टियानो ने अपने शुरुआती वर्षों में OpenAI में एक शोधकर्ता के रूप में काम किया, जहाँ 2017 में वे "Deep Reinforcement Learning from Human Preferences" नामक पेपर के सह-लेखक थे, जिसने मॉडल आउटपुट के बीच मानव तुलनाओं से एक रिवॉर्ड मॉडल को प्रशिक्षित करने और फिर उस रिवॉर्ड मॉडल के विरुद्ध एक नीति को अनुकूलित करने की मूल विधि पेश की। यह दृष्टिकोण, जिसे बाद में बड़े पैमाने पर विस्तारित किया गया और भाषा मॉडल पर RLHF के रूप में लागू किया गया, चैट-उन्मुख मॉडलों को मानव इरादे के साथ संरेखित करने की प्रमुख तकनीक बन गई, जो सबसे स्पष्ट रूप से ChatGPT और इसके निर्देश-पालन पूर्ववर्ती InstructGPT के प्रशिक्षण के पीछे देखी गई।

एलाइनमेंट रिसर्च सेंटर

2021 में, क्रिस्टियानो ने OpenAI छोड़ दिया और एलाइनमेंट रिसर्च सेंटर (ARC) की स्थापना की, जो AI संरेखण में सैद्धांतिक कार्य पर केंद्रित एक गैर-लाभकारी संगठन है, जिसमें मॉडलों से "अव्यक्त ज्ञान प्राप्त करने" और यह मूल्यांकन करने के तरीकों पर शोध शामिल है कि क्या किसी मॉडल में ऐसी क्षमताएँ या इरादे हैं जो उसके आउटपुट से प्रकट नहीं होते। ARC फ्रंटियर मॉडलों के सबसे प्रारंभिक औपचारिक पूर्व-तैनाती क्षमता मूल्यांकनों के निर्माण और संचालन के लिए भी जाना जाने लगा, जिसमें खतरनाक-क्षमता परीक्षण शामिल है, जो GPT-4 सहित रिलीज़ से पहले OpenAI और Anthropic जैसी प्रयोगशालाओं के समन्वय में किया गया।

अमेरिकी AI सुरक्षा संस्थान

2024 में, क्रिस्टियानो को अमेरिकी AI सुरक्षा संस्थान में सुरक्षा-केंद्रित मूल्यांकन कार्य का नेतृत्व करने के लिए नियुक्त किया गया, जो राष्ट्रीय मानक और प्रौद्योगिकी संस्थान के भीतर स्थित है, एक ऐसी भूमिका जिसने तकनीकी संरेखण कार्य से निकटता से जुड़े एक शोधकर्ता को एक सरकारी निकाय के अंदर रखा, जो अंतर्राष्ट्रीय AI सुरक्षा शिखर सम्मेलन प्रक्रिया से पहले फ्रंटियर मॉडलों का मूल्यांकन करने के लिए जिम्मेदार है, जो नवंबर 2023 में ब्लेचली पार्क में शुरू हुई थी। इस नियुक्ति को AI सुरक्षा समुदाय के विभिन्न हिस्सों से स्वतंत्रता और सरकार की मूल्यांकन क्षमता के सवालों पर समर्थन और आलोचना दोनों मिली।

प्रभाव

क्रिस्टियानो को AI सुरक्षा क्षेत्र के भीतर व्यापक रूप से उन शोधकर्ताओं में से एक माना जाता है जो दीर्घकालिक AI जोखिम के बारे में अमूर्त चिंताओं को ठोस, अनुभवजन्य रूप से परीक्षण योग्य शोध कार्यक्रमों में अनुवाद करने के लिए सबसे अधिक जिम्मेदार हैं, जो निक बोस्ट्रॉम जैसे लोगों से जुड़े अधिक दार्शनिक कार्य और 2022 के बाद जारी लगभग हर प्रमुख चैट-उन्मुख मॉडल में उपयोग की जाने वाली व्यावहारिक प्रशिक्षण तकनीकों के बीच सेतु का काम करते हैं।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:ai-safety·alignment·industry
इस पृष्ठ को अंतिम बार संपादित किया गया 2 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास