पैरामीट्रिक मॉडल सांख्यिकीय और मशीन लर्निंग मॉडल का एक वर्ग है, जिसमें मापदंडों की एक निश्चित, सीमित संख्या होती है। इसका अर्थ है कि मॉडल की जटिलता प्रशिक्षण से पहले निर्धारित होती है और प्रशिक्षण डेटा की मात्रा के बावजूद नहीं बदलती है। मापदंडों को डेटा से सीखा जाता है, और प्रशिक्षण पूरा होने के बाद, मॉडल मूल डेटासेट को बनाए रखे बिना भविष्यवाणियां कर सकता है। यह गैर-पैरामीट्रिक मॉडल के विपरीत है, जिनमें मापदंडों की संख्या प्रशिक्षण डेटा के आकार के साथ बढ़ सकती है।
यह अवधारणा Machine learning में मौलिक है, जहां पैरामीट्रिक और गैर-पैरामीट्रिक दृष्टिकोणों के बीच चयन मॉडल की लचीलापन, कम्प्यूटेशनल आवश्यकताओं और सामान्यीकरण को प्रभावित करता है। पैरामीट्रिक मॉडल एक विशिष्ट कार्यात्मक रूप मानते हैं, जैसे रैखिक संबंध, जो उन्हें प्रशिक्षित करने और व्याख्या करने में सरल बनाता है, लेकिन जटिल पैटर्न के लिए संभावित रूप से कम लचीला होता है।
ऐतिहासिक पृष्ठभूमि
पैरामीट्रिक और गैर-पैरामीट्रिक विधियों के बीच अंतर की जड़ें शास्त्रीय सांख्यिकी में हैं। Alan Perlis जैसे सांख्यिकीविदों (हालांकि कंप्यूटर विज्ञान के लिए अधिक जाने जाते हैं) और अन्य के शुरुआती कार्यों ने मॉडल-आधारित अनुमान की नींव रखी। 1960 और 1970 के दशक में, कम्प्यूटेशनल सांख्यिकी के उदय ने रैखिक प्रतिगमन और लॉजिस्टिक प्रतिगमन जैसे पैरामीट्रिक मॉडल को लोकप्रिय बनाया। 1980 के दशक तक "पैरामीट्रिक" शब्द पाठ्यपुस्तकों में मानक बन गया, और Christopher Bishop के पैटर्न पहचान पर बाद के कार्य ने मशीन लर्निंग में इसके उपयोग को मजबूत किया।
प्रकार और उदाहरण
सामान्य पैरामीट्रिक मॉडल में रैखिक प्रतिगमन, लॉजिस्टिक प्रतिगमन और रैखिक विभेदक विश्लेषण शामिल हैं। Deep learning में, कई आर्किटेक्चर पैरामीट्रिक हैं, जैसे तंत्रिका नेटवर्क जिनमें भार और पूर्वाग्रहों की एक निश्चित संख्या होती है। उदाहरण के लिए, एक Transformer (architecture) मॉडल में उसकी आर्किटेक्चर (जैसे, परत आकार, ध्यान हेड) के आधार पर पूर्व निर्धारित संख्या में पैरामीटर होते हैं। OpenAI और Anthropic जैसे बड़े भाषा मॉडल पैरामीट्रिक हैं, जिनमें डिज़ाइन समय पर अरबों पैरामीटर निर्धारित होते हैं।
गैर-पैरामीट्रिक मॉडल, जैसे कि के-निकटतम पड़ोसी और निर्णय वृक्ष, में निश्चित पैरामीटर संख्या नहीं होती है; वे प्रशिक्षण डेटा संग्रहीत करते हैं या जटिलता में बढ़ते हैं। हालांकि, कुछ मॉडल रेखा को धुंधला करते हैं, जैसे गाऊसी प्रक्रियाएं, जो गैर-पैरामीट्रिक हैं लेकिन पैरामीट्रिक रूप से अनुमानित की जा सकती हैं।
लाभ और हानियाँ
पैरामीट्रिक मॉडल कई लाभ प्रदान करते हैं: वे कम्प्यूटेशनल रूप से कुशल हैं, कम मेमोरी की आवश्यकता होती है, और व्याख्या करना आसान होता है। वे तब अच्छी तरह से सामान्यीकरण करते हैं जब माना गया कार्यात्मक रूप वास्तविक डेटा वितरण से मेल खाता है। हालांकि, यदि रूप बहुत सरल है तो वे अंडरफिट हो सकते हैं, और वे मापदंडों को बढ़ाए बिना जटिल पैटर्न को कैप्चर नहीं कर सकते हैं, जो डेटा सीमित होने पर ओवरफिटिंग का कारण बन सकता है।
व्यवहार में, पैरामीट्रिक मॉडल अक्सर छोटे डेटासेट या जब व्याख्यात्मकता महत्वपूर्ण होती है, जैसे चिकित्सा या वित्तीय अनुप्रयोगों में, पसंद किए जाते हैं। उदाहरण के लिए, Intuitive Surgical जोखिम मूल्यांकन के लिए पैरामीट्रिक मॉडल का उपयोग कर सकता है, जबकि Waymo धारणा के लिए अधिक लचीले गैर-पैरामीट्रिक दृष्टिकोण का उपयोग कर सकता है।
आधुनिक AI में भूमिका
आधुनिक Artificial intelligence में, Deep learning की सफलता के कारण पैरामीट्रिक मॉडल प्रमुख हैं। निश्चित पैरामीटर संख्या AWS Trainium या Cerebras जैसे विशेष हार्डवेयर पर कुशल प्रशिक्षण की अनुमति देती है। Google DeepMind और Amazon Web Services जैसी कंपनियां बड़े पैमाने पर पैरामीट्रिक मॉडल तैनात करती हैं। मॉडल आकार और प्रदर्शन के बीच व्यापार-बंद एक प्रमुख शोध क्षेत्र है, जिसमें सटीकता खोए बिना मॉडल को संपीड़ित करने के प्रयास शामिल हैं।
हालांकि, निश्चित पैरामीटर संख्या एक सीमा हो सकती है जब डेटा प्रचुर मात्रा में हो और पैटर्न जटिल हों। इसने अनुकूली मॉडल में शोध को जन्म दिया है, लेकिन पैरामीट्रिक मॉडल अधिकांश अनुप्रयोगों के लिए मानक बने हुए हैं।