ट्यूरिंग परीक्षण एक मानदंड है जो यह आकलन करता है कि क्या कोई मशीन मानव से अप्रभेद्य संवादात्मक व्यवहार प्रदर्शित कर सकती है। गणितज्ञ एलन ट्यूरिंग द्वारा 1950 के एक शोधपत्र "कंप्यूटिंग मशीनरी एंड इंटेलिजेंस" में प्रस्तावित, यह प्रश्न "क्या मशीनें सोच सकती हैं?" को एक अनुभवजन्य "अनुकरण खेल" के रूप में पुनः परिभाषित करता है: एक मानव न्यायाधीश दो छिपे प्रतिभागियों - एक मानव और एक मशीन - के साथ पाठ-आधारित बातचीत करता है, और यह निर्धारित करना होता है कि कौन सा कौन है। यदि न्यायाधीश मशीन को मानव से विश्वसनीय रूप से अलग नहीं कर पाता, तो मशीन को परीक्षण पास करने वाला माना जाता है।
ट्यूरिंग ने इस परीक्षण को मशीन चेतना या विचार के दार्शनिक रूप से जटिल प्रश्न के व्यावहारिक विकल्प के रूप में अभिप्रेत किया, आध्यात्मिक बहस को दरकिनार कर एक अवलोकनीय व्यवहारिक मानक पर ध्यान केंद्रित किया। यह परीक्षण कृत्रिम बुद्धिमत्ता क्षेत्र की स्थापना से छह वर्ष पूर्व का है; "कृत्रिम बुद्धिमत्ता" शब्द स्वयं 1956 के डार्टमाउथ कार्यशाला में गढ़ा गया था, जिसे जॉन मैकार्थी और मार्विन मिंस्की सहित अन्य लोगों ने आयोजित किया था, जो ट्यूरिंग के ढांचे से प्रभावित थे।
उत्पत्ति और प्रारूप
ट्यूरिंग के मूल प्रारूप में तीन प्रतिभागी शामिल थे: एक मानव पूछताछकर्ता, एक मानव उत्तरदाता, और एक मशीन, जो केवल टाइप किए गए पाठ के माध्यम से संवाद करते थे ताकि आवाज या रूप के संकेत हट जाएं। तब से विकसित विविधताओं में "मानक" दो-प्रतिभागी संस्करण शामिल है, जहां न्यायाधीश केवल एक इकाई से बातचीत करता है और अनुमान लगाता है कि क्या वह मानव है, साथ ही औपचारिक प्रतियोगिताएं जैसे लोएब्नर पुरस्कार, जो 1990 से 2019 तक वार्षिक रूप से चलाया गया और उन चैटबॉट्स को पुरस्कार देता था जिन्हें सबसे विश्वसनीय रूप से मानवीय माना जाता था, हालांकि किसी ने भी बिना प्रतिबंध के पूर्ण उत्तीर्णता हासिल नहीं की।
प्रारंभिक प्रयास और आलोचना
एलिजा जैसे कार्यक्रम, जिसे जोसेफ वाइज़ेनबाम ने 1966 में एक रोजेरियन मनोचिकित्सक का अनुकरण करने के लिए बनाया, कुछ उपयोगकर्ताओं को यह विश्वास दिलाने में सफल रहे कि वे एक व्यक्ति से बात कर रहे हैं, बावजूद इसके कि यह समझ के बजाय सरल पैटर्न-मिलान का उपयोग करता था। वाइज़ेनबाम बाद में मशीन बुद्धिमत्ता को बढ़ा-चढ़ाकर पेश करने के प्रमुख आलोचक बन गए, और लोगों की प्रवृत्ति जो केवल संवादात्मक रूप की नकल करने वाली प्रणालियों को समझ का श्रेय देती है, अब अक्सर "एलिजा प्रभाव" कहलाती है।
आलोचकों ने लंबे समय से तर्क दिया है कि यह परीक्षण बुद्धिमत्ता के बजाय धोखे को मापता है। दार्शनिक जॉन सियरल का 1980 का "चीनी कक्ष" विचार प्रयोग यह दावा करता है कि एक प्रणाली बिना किसी वास्तविक समझ के प्रतीकों को विश्वसनीय रूप से हेरफेर कर सकती है, जो परीक्षण की विचार के मार्कर के रूप में वैधता को चुनौती देता है। अन्य लोग ध्यान देते हैं कि परीक्षण मानव-केंद्रित है, सटीक या सक्षम व्यवहार के बजाय मानवीय विचित्रताओं और त्रुटियों को पुरस्कृत करता है, और एक संकीर्ण रूप से प्रशिक्षित चैटबॉट सामान्य तर्क के बजाय संवादात्मक चालों के माध्यम से पास कर सकता है।
आधुनिक प्रासंगिकता
नवंबर 2022 में चैटजीपीटी के लॉन्च के बाद से बड़े भाषा मॉडल प्रणालियों के उदय ने परीक्षण की प्रासंगिकता पर बहस को पुनर्जीवित किया है। 2023 के बाद से कई अनौपचारिक और शैक्षणिक अध्ययनों ने बताया है कि आधुनिक संवादात्मक मॉडल छोटे आदान-प्रदान में मानव न्यायाधीशों को मानव सहयोगियों के बराबर या उससे अधिक दर पर धोखा दे सकते हैं, हालांकि पद्धति और निश्चित "उत्तीर्ण" के दावे विवादित बने हुए हैं। कई शोधकर्ता अब ट्यूरिंग परीक्षण को मशीन बुद्धिमत्ता या सामान्य कृत्रिम बुद्धिमत्ता के सार्थक माप के बजाय एक दिलचस्प ऐतिहासिक बेंचमार्क मानते हैं, यह देखते हुए कि धाराप्रवाह संवाद अब उस व्यापक तर्क, योजना और आधारभूत समझ को निहित नहीं करता जो क्षेत्र अब सामान्य बुद्धिमत्ता से जोड़ता है। प्राकृतिक भाषा प्रसंस्करण और तर्क में अधिक लक्षित बेंचमार्क, जिनमें एआरसी-एजीआई जैसे परीक्षण शामिल हैं, ने इसे अनुसंधान उपकरण के रूप में काफी हद तक प्रतिस्थापित कर दिया है, भले ही ट्यूरिंग परीक्षण लोकप्रिय संस्कृति में "क्या मशीन मानवीय लगती है" के संक्षिप्त रूप के रूप में बना हुआ है।