एंकर स्पष्टीकरण व्याख्यात्मक मशीन लर्निंग में एक तकनीक है जो किसी भी ब्लैक-बॉक्स मॉडल द्वारा किए गए व्यक्तिगत भविष्यवाणियों के लिए उच्च-परिशुद्धता, स्थानीय स्पष्टीकरण उत्पन्न करती है। वैश्विक स्पष्टीकरणों के विपरीत जो पूरे मॉडल का वर्णन करते हैं, एंकर एक एकल उदाहरण पर ध्यान केंद्रित करते हैं, एक सरल यदि-तो नियम उत्पन्न करते हैं - जैसे "यदि आयु > 30 और आय > $50,000, तो भविष्यवाणी स्वीकृत है" - जो उस उदाहरण के आसपास उच्च संभावना के साथ धारण करने के लिए डिज़ाइन किया गया है। यह विधि मार्को टुलियो रिबेरो, समीर सिंह, और कार्लोस गेस्ट्रिन द्वारा 2018 में पेश की गई थी, जो स्थानीय व्याख्यात्मक मॉडल-अज्ञेय स्पष्टीकरण (LIME) पर उनके पहले के काम पर आधारित है। एंकर विशेष रूप से उनकी परिशुद्धता और मानव समझ में आसानी के लिए मूल्यवान हैं, जिससे वे वित्त और स्वास्थ्य सेवा जैसे उच्च-दांव वाले क्षेत्रों में Machine learning प्रणालियों के ऑडिट और डिबगिंग के लिए एक व्यावहारिक उपकरण बन जाते हैं।
एंकर के पीछे मुख्य विचार एक नियम प्रदान करना है जो भविष्यवाणी को "एंकर" करता है: यदि नियम की शर्तें पूरी होती हैं, तो भविष्यवाणी समान रहने की उम्मीद है, चाहे अन्य विशेषताओं में परिवर्तन हों। यह LIME के विपरीत है, जो एक स्थानीय रैखिक मॉडल फिट करता है और अस्थिर हो सकता है। एंकर एक सुदृढीकरण सीखने-आधारित खोज का उपयोग करते हैं जो कवरेज को अधिकतम करने वाले नियम खोजने के लिए होता है (पड़ोस में उदाहरणों का अनुपात जहां नियम लागू होता है) जबकि उपयोगकर्ता-निर्दिष्ट परिशुद्धता सीमा, आमतौर पर 0.95 या उच्चतर, बनाए रखता है। परिणाम एक पारदर्शी, मानव-पठनीय नियम है जो सांख्यिकीय सीमाओं के अधीन, स्थानीय निष्ठा की गारंटी प्रदान करता है।
औपचारिक परिभाषा और परिशुद्धता
औपचारिक रूप से, एक एंकर एक नियम A है जिसमें फीचर-मान विधेय का संयोजन होता है (जैसे, "फीचर1 = मान1 और फीचर2 > मान2")। किसी दिए गए उदाहरण x और ब्लैक-बॉक्स मॉडल f के लिए, एंकर A को f(x) की व्याख्या करने के लिए कहा जाता है यदि नियम x पर लागू होता है और A की परिशुद्धता कम से कम एक सीमा τ है। परिशुद्धता को संभावना के रूप में परिभाषित किया गया है कि f(x') = f(x) सभी उदाहरणों x' के लिए जो A को संतुष्ट करते हैं, जहां संभावना एक विक्षोभ वितरण पर ली जाती है जो स्थानीय पड़ोस का अनुमान लगाती है। व्यवहार में, यह संभावना नमूने के माध्यम से अनुमानित की जाती है, और एल्गोरिदम उम्मीदवार नियमों का कुशलतापूर्वक पता लगाने के लिए एक बहु-भुजा बैंडिट दृष्टिकोण का उपयोग करता है।
कवरेज एक और प्रमुख मीट्रिक है, जिसे पड़ोस में एक यादृच्छिक रूप से विक्षुब्ध उदाहरण के A को संतुष्ट करने की संभावना के रूप में परिभाषित किया गया है। लक्ष्य उच्च परिशुद्धता (विश्वसनीयता सुनिश्चित करने) और जितना संभव हो उतना उच्च कवरेज (यह सुनिश्चित करने कि नियम अत्यधिक संकीर्ण नहीं है) के साथ एक नियम खोजना है। एल्गोरिदम इन दो उद्देश्यों को संतुलित करता है, अक्सर अन्य स्थानीय व्याख्याकर्ताओं की तुलना में अधिक संक्षिप्त नियम उत्पन्न करता है।
एल्गोरिदम और कार्यान्वयन
रिबेरो और सहयोगियों ने सुदृढीकरण सीखने के ढांचे का उपयोग करके एंकर लागू किए, जहां राज्य विधेय का वर्तमान सेट है, और क्रियाएं नियम को परिष्कृत करने के लिए नए विधेय जोड़ती हैं। इनाम परिशुद्धता और कवरेज का संयोजन है, जिसमें अत्यधिक जटिल नियमों के लिए दंड होता है। खोज एक नीति द्वारा निर्देशित होती है जो सीखती है कि कौन से विधेय उच्च-परिशुद्धता नियम उत्पन्न करने की संभावना रखते हैं, अन्वेषण के लिए अपर बाउंड (UCB) एल्गोरिदम के एक प्रकार का उपयोग करते हुए। यह विधि उच्च-आयामी डेटा के लिए भी कम्प्यूटेशनल रूप से कुशल बनाती है, हालांकि यह LIME जैसे सरल तरीकों की तुलना में धीमी हो सकती है।
ओपन-सोर्स कार्यान्वयन, anchor पायथन पैकेज में उपलब्ध है, तालिका और पाठ दोनों डेटा का समर्थन करता है। पाठ के लिए, एंकर शब्द उपस्थिति या अनुपस्थिति के आधार पर नियम उत्पन्न कर सकते हैं, जैसे "यदि समीक्षा में 'अच्छा नहीं' शामिल है, तो भावना नकारात्मक है।" पैकेज scikit-learn मॉडल के साथ एकीकृत होता है और श्रेणीबद्ध और निरंतर सुविधाओं को संभाल सकता है, निरंतर सुविधाओं को नियम निर्माण के दौरान अंतराल में विभाजित किया जाता है।
LIME और SHAP के साथ तुलना
एंकर LIME की सीमाओं के जवाब में विकसित किए गए थे, जो एक स्थानीय रैखिक मॉडल फिट करता है और विक्षोभ कर्नेल की पसंद के प्रति संवेदनशील हो सकता है। LIME के स्पष्टीकरण अक्सर अस्थिर होते हैं, जिसका अर्थ है कि इनपुट में छोटे परिवर्तन से स्पष्टीकरण में काफी भिन्नता हो सकती है। एंकर एक नियम प्रदान करके इसे संबोधित करते हैं जो स्पष्ट रूप से परिभाषित पड़ोस के भीतर मजबूत होने के लिए डिज़ाइन किया गया है। हालांकि, एंकर गैर-रेखीय स्थानीय व्यवहार को पकड़ने में LIME की तुलना में कम लचीले होते हैं, क्योंकि वे केवल बाइनरी नियम प्रदान करते हैं न कि भारित फीचर महत्व।
SHAP (SHapley Additive exPlanations) की तुलना में, जो फीचर योगदान का एक गेम-सैद्धांतिक आरोपण प्रदान करता है, एंकर एक अलग व्यापार-बंद प्रदान करते हैं। SHAP मान योगात्मक होते हैं और भविष्यवाणी में जोड़े जा सकते हैं, लेकिन वे एक सीधा निर्णय नियम प्रदान नहीं करते हैं। एंकर उन अंत-उपयोगकर्ताओं के लिए अधिक कार्रवाई योग्य होते हैं जिन्हें यह जानने की आवश्यकता होती है कि "यह भविष्यवाणी किन शर्तों के तहत मान्य है?" लेकिन उनमें SHAP की वैश्विक स्थिरता का अभाव होता है। व्यवहार में, चिकित्सक अक्सर पूरी तस्वीर प्राप्त करने के लिए वैश्विक तरीकों के साथ एंकर का उपयोग करते हैं।
उच्च-दांव क्षेत्रों में अनुप्रयोग
एंकर विभिन्न क्षेत्रों में लागू किए गए हैं जहां मॉडल पारदर्शिता महत्वपूर्ण है। वित्त में, वे क्रेडिट स्कोरिंग निर्णयों को समझाने में मदद करते हैं, जिससे ऋण अधिकारियों को यह समझने की अनुमति मिलती है कि आवेदन क्यों अस्वीकार किया गया था और इसे ग्राहकों को संप्रेषित कर सकते हैं। स्वास्थ्य सेवा में, एंकर स्पष्ट कर सकते हैं कि मॉडल पुनः प्रवेश के उच्च जोखिम की भविष्यवाणी क्यों करता है, निर्णय लेने में चिकित्सकों की सहायता करता है। उदाहरण के लिए, एक नियम कह सकता है "यदि रोगी को मधुमेह है और आयु > 65, तो अनुमानित जोखिम उच्च है।" ऐसे नियम कच्चे फीचर भार की तुलना में डोमेन ज्ञान के खिलाफ सत्यापित करना आसान होते हैं।
विधि का उपयोग प्राकृतिक भाषा प्रसंस्करण में भावना वर्गीकरणकर्ताओं और स्पैम डिटेक्टरों को समझाने के लिए भी किया गया है। उदाहरण के लिए, एक स्पैम ईमेल के लिए एक एंकर हो सकता है "यदि ईमेल में 'मुफ्त' और 'यहां क्लिक करें' शामिल है, तो यह स्पैम है।" यह डेवलपर्स को स्पष्ट सहसंबंधों की पहचान करने और मॉडल मजबूती में सुधार करने में मदद करता है।
सीमाएं और आलोचनाएं
इसकी ताकत के बावजूद, एंकर की कई सीमाएं हैं। परिशुद्धता की गारंटी सांख्यिकीय है और विक्षोभ वितरण पर निर्भर करती है, जो वास्तविक दुनिया के डेटा बदलाव को पूरी तरह से प्रतिबिंबित नहीं कर सकती है। यदि पड़ोस बहुत संकीर्ण रूप से परिभाषित किया गया है, तो नियम सामान्यीकरण नहीं कर सकता है; यदि बहुत व्यापक है, तो परिशुद्धता गिर सकती है। खोज एल्गोरिदम अत्यधिक जटिल नियम भी उत्पन्न कर सकता है, हालांकि इनाम फ़ंक्शन इसे दंडित करता है। इसके अतिरिक्त, एंकर कई परस्पर क्रिया करने वाली सुविधाओं के साथ उच्च-आयामी स्थानों में भविष्यवाणियों को समझाने के लिए उपयुक्त नहीं हैं, क्योंकि नियम स्थान तेजी से बढ़ता है।
आलोचकों ने नोट किया है कि एंकर, अन्य स्थानीय तरीकों की तरह, विरोधी विक्षोभों द्वारा धोखा दिया जा सकता है। एक हमलावर ऐसे इनपुट तैयार कर सकता है जो नियम को संतुष्ट करते हैं लेकिन नमूने वाले पड़ोस के बाहर अलग-अलग भविष्यवाणियों की ओर ले जाते हैं। इसने अधिक मजबूत स्पष्टीकरण विधियों में अनुसंधान को प्रेरित किया है, लेकिन एंकर तुलना के लिए एक आधार रेखा बने हुए हैं।
विस्तार और विविधताएं
एंकर को बेहतर बनाने के लिए कई विस्तार प्रस्तावित किए गए हैं। एक संस्करण, जिसे "कवरेज अनुकूलन के साथ एंकर" कहा जाता है, परिशुद्धता बनाए रखते हुए कवरेज को अधिकतम करने पर केंद्रित है, एक लालची खोज का उपयोग करते हुए। एक और विस्तार एंकर को बहु-वर्ग वर्गीकरण के लिए अनुकूलित करता है, प्रत्येक वर्ग के लिए नियम उत्पन्न करता है। प्रतितथ्यात्मक स्पष्टीकरणों के लिए एंकर का उपयोग करने पर भी काम है, जहां नियम को संशोधित किया जाता है ताकि यह दिखाया जा सके कि भविष्यवाणी को क्या बदल देगा। ये विकास एंकर को व्याख्यात्मक एआई के तेजी से विकसित हो रहे क्षेत्र में प्रासंगिक बनाए रखते हैं।
आधुनिक Large language model के संदर्भ में, एंकर को Transformer (architecture)-आधारित मॉडलों से भविष्यवाणियों को समझाने के लिए अनुकूलित किया गया है, हालांकि उच्च-आयामी एम्बेडिंग स्थान चुनौतियां पेश करते हैं। शोधकर्ताओं ने अधिक मानव-अनुकूल स्पष्टीकरण प्रदान करने के लिए ध्यान-आधारित तरीकों के साथ एंकर को जोड़ा है, लेकिन यह अनुसंधान का एक सक्रिय क्षेत्र बना हुआ है।
अन्य व्याख्यात्मकता विधियों से संबंध
एंकर स्थानीय, मॉडल-अज्ञेय स्पष्टीकरण विधियों के व्यापक परिवार से संबंधित हैं, जिसमें LIME, SHAP, और प्रतितथ्यात्मक स्पष्टीकरण भी शामिल हैं। वे वैश्विक तरीकों जैसे फीचर महत्व या आंशिक निर्भरता भूखंडों से अलग हैं। व्याख्यात्मकता के वर्गीकरण में, एंकर को "नियम-आधारित" स्पष्टीकरण माना जाता है, जो निर्णय पेड़ों के समान है लेकिन स्थानीय रूप से उत्पन्न होता है। यह उन्हें गैर-विशेषज्ञ उपयोगकर्ताओं के लिए विशेष रूप से उपयोगी बनाता है जो यदि-तो तर्क को समझ सकते हैं।
एंकर के विकास ने क्षेत्र में बाद के काम को प्रभावित किया है, जिसमें स्पष्टीकरणों के लिए अधिक कठोर मूल्यांकन मेट्रिक्स का निर्माण शामिल है। MIT CSAIL और Stanford AI Lab जैसे संस्थानों के शोधकर्ताओं ने नई विधियों के लिए एक बेंचमार्क के रूप में एंकर का हवाला दिया है। यह विधि व्याख्यात्मक मशीन लर्निंग पर पाठ्यक्रमों में भी सिखाई जाती है, LIME और SHAP के साथ।
व्यावहारिक उपयोग और उपकरण
एंकर का उपयोग करने के लिए, एक चिकित्सक आमतौर पर एक प्रशिक्षित मॉडल और एक डेटासेट लोड करता है, फिर रुचि के उदाहरण के साथ एंकर व्याख्याकर्ता को कॉल करता है। एल्गोरिदम को परिशुद्धता सीमा और अनुमान के लिए नमूनों की संख्या निर्दिष्ट करने की आवश्यकता होती है। आउटपुट संबंधित परिशुद्धता और कवरेज अनुमानों के साथ एक नियम है। anchor पैकेज एक पठनीय प्रारूप में नियमों को प्रदर्शित करने के लिए विज़ुअलाइज़ेशन उपकरण भी प्रदान करता है। यह पायथन 3 के साथ संगत है और पिप के माध्यम से स्थापित किया जा सकता है।
उत्पादन वातावरण में, एंकर को निगरानी पाइपलाइनों में एकीकृत किया जा सकता है ताकि यह संकेत दिया जा सके कि मॉडल का व्यवहार कब बदलता है। उदाहरण के लिए, यदि किसी नियम की परिशुद्धता समय के साथ घटती है, तो यह डेटा बहाव का संकेत दे सकता है। यह एमएलओपीएस और मॉडल शासन पर बढ़ते जोर के साथ संरेखित है।
भविष्य की दिशाएं
व्याख्यात्मक एआई का क्षेत्र विकसित हो रहा है, और एंकर को अधिक परिष्कृत तरीकों से बदलने की संभावना है जो स्थानीय और वैश्विक दृष्टिकोणों को जोड़ते हैं। हालांकि, उच्च-परिशुद्धता नियमों का मूल सिद्धांत मूल्यवान बना हुआ है। जैसे-जैसे Generative AI मॉडल अधिक प्रचलित होते जाते हैं, असंरचित डेटा को संभालने में सक्षम स्पष्टीकरण विधियों की आवश्यकता होती है, और एंकर को Neural network से एम्बेडिंग के साथ काम करने के लिए बढ़ाया जा सकता है। शोधकर्ता यह भी खोज रहे हैं कि एंकर को वितरणात्मक बदलाव के प्रति अधिक मजबूत कैसे बनाया जाए, जो वास्तविक दुनिया की तैनाती के लिए एक महत्वपूर्ण चुनौती है।
संक्षेप में, एंकर व्यक्तिगत भविष्यवाणियों को समझाने का एक व्यावहारिक, मानव-समझने योग्य तरीका प्रदान करते हैं, सरल रैखिक अनुमानों और जटिल वैश्विक मॉडलों के बीच एक स्थान भरते हैं। परिशुद्धता पर उनका जोर उन्हें महत्वपूर्ण अनुप्रयोगों के लिए एक भरोसेमंद विकल्प बनाता है, और उनके एल्गोरिदमिक नवाचारों ने व्याख्यात्मकता उपकरणों की एक पीढ़ी को प्रेरित किया है।