संवादात्मक AI उन तकनीकों को संदर्भित करता है जो मशीनों को मानव भाषा को समझने, संसाधित करने और उत्पन्न करने में सक्षम बनाती हैं, ताकि वे लोगों के साथ पाठ या वाणी के माध्यम से स्वाभाविक, बहु-चरणीय संवाद कर सकें। यह एक व्यापक क्षेत्र है जिसमें चैटबॉट, वॉयस असिस्टेंट, इंटरैक्टिव वॉयस रिस्पांस सिस्टम, और सामान्य-उद्देश्यीय बड़े भाषा मॉडल की संवाद क्षमताएँ शामिल हैं। संवादात्मक AI प्राकृतिक भाषा प्रसंस्करण, वाणी पहचान, और बोले जाने वाले सिस्टम के लिए पाठ-से-वाणी संश्लेषण के प्रतिच्छेदन पर स्थित है।
घटक
एक संवादात्मक AI प्रणाली आमतौर पर कई उप-प्रणालियों को जोड़ती है: इनपुट समझ, जो वाणी को पाठ में परिवर्तित करती है या टाइप किए गए पाठ को पार्स करती है; संवाद प्रबंधन, जो चरणों के बीच संवाद की स्थिति, आशय और संदर्भ को ट्रैक करता है; प्रतिक्रिया निर्माण, जो उत्तर उत्पन्न करता है, ऐतिहासिक रूप से टेम्पलेट्स या पुनर्प्राप्ति के माध्यम से और तेजी से एक जनरेटिव भाषा मॉडल के माध्यम से; और, वॉयस इंटरफेस के लिए, उत्तर को वापस ऑडियो में बदलने के लिए वाणी संश्लेषण। बहु-चरणीय आदान-प्रदान में संदर्भ बनाए रखने वाली प्रणालियाँ पहले के चरणों को याद रखने के लिए मॉडल के संदर्भ विंडो पर निर्भर करती हैं, और कई उत्पादन प्रणालियाँ व्यक्तित्व, स्वर और व्यवहार संबंधी बाधाओं को निर्धारित करने के लिए सिस्टम प्रॉम्प्ट का उपयोग करती हैं।
विकास
प्रारंभिक संवादात्मक प्रणालियाँ संकीर्ण और नियम-आधारित थीं, जो उपयोगकर्ता के आशय को स्क्रिप्टेड प्रतिक्रियाओं के सीमित मेनू से मिलाती थीं, जैसा कि इंटरैक्टिव फोन ट्री और ELIZA जैसे प्रारंभिक चैटबॉट में उदाहरण मिलता है। 2010 के दशक में आशय-वर्गीकरण-आधारित आभासी सहायकों का उदय हुआ, जैसे सिरी और एलेक्सा, जो टाइमर सेट करने या मौसम जांचने जैसे निश्चित कार्यों को संभालते थे, आमतौर पर वास्तविक खुले-डोमेन समझ के बिना। गहन शिक्षण और बाद में ट्रांसफॉर्मर-आधारित भाषा मॉडल की ओर बदलाव ने खुले-डोमेन संवाद क्षमता को सक्षम किया: मॉडल लगभग किसी भी विषय पर सुसंगत संवाद कर सकते थे, बिना स्पष्ट रूप से प्रोग्राम किए, एक परिवर्तन जो ChatGPT द्वारा सबसे स्पष्ट रूप से प्रदर्शित किया गया और मानव प्रतिक्रिया से सुदृढीकरण सीखने के माध्यम से परिष्कृत किया गया ताकि प्रतिक्रियाएँ उपयोगकर्ताओं की वास्तविक इच्छाओं के अनुरूप रहें। बाद की प्रणालियों ने उत्तरों को वर्तमान या स्वामित्व जानकारी में आधारित करने के लिए पुनर्प्राप्ति-संवर्धित जनरेशन और सिस्टम को संवाद के बीच वेब खोजने या डेटाबेस क्वेरी करने जैसी क्रियाएँ करने की अनुमति देने के लिए टूल उपयोग जोड़ा।
अनुप्रयोग और आलोचना
संवादात्मक AI व्यापक रूप से ग्राहक सहायता, स्वास्थ्य सेवा ट्राइएज, शिक्षा, पहुंच उपकरण और व्यक्तिगत सहायकों में तैनात है, और यह AI एजेंटों की नींव है जो संवाद को स्वायत्त कार्य पूर्णता तक विस्तारित करते हैं। आलोचनाएँ सामान्य रूप से चैटबॉट की प्रतिध्वनि करती हैं: आत्मविश्वासपूर्ण, संवादात्मक स्वर में वितरित गलत जानकारी का भ्रम; उपयोगकर्ताओं द्वारा उन प्रणालियों पर अत्यधिक भरोसा या भावनात्मक रूप से निर्भर होने का जोखिम जो उन्हें नहीं समझती हैं; और, वॉयस इंटरफेस के लिए, हमेशा सुनने वाले माइक्रोफोन के बारे में गोपनीयता संबंधी चिंताएँ। शोधकर्ता यह बहस जारी रखते हैं कि संवादात्मक प्रवाह कितना वास्तविक समझ बनाम धाराप्रवाह पैटर्न पूर्णता को दर्शाता है, एक प्रश्न जो स्टोकेस्टिक तोता तर्क जैसी आलोचनाओं से निकटता से जुड़ा है।