अंग्रेज़ी से अनुवादित

बिल्लियाँ बनाम कुत्ते (Cats vs. Dogs) कैगल प्रतियोगिता का एक डेटासेट है, जिसमें 25,000 लेबल किए गए बिल्ली और कुत्ते की छवियाँ शामिल हैं, जो छवि वर्गीकरण और गहन शिक्षण शिक्षा के लिए एक मानक बेंचमार्क के रूप में व्यापक रूप से उपयोग किया जाता है।

Cats vs. Dogs एक प्रसिद्ध डेटासेट है जिसे 2013 में एक Kaggle प्रतियोगिता के लिए पेश किया गया था। इसमें 25,000 रंगीन छवियाँ शामिल हैं, जो 12,500 बिल्लियों की तस्वीरों और 12,500 कुत्तों की तस्वीरों के बीच समान रूप से विभाजित हैं। छवियाँ विभिन्न इंटरनेट फोटो संग्रहों से ली गई थीं और विभिन्न रिज़ॉल्यूशन और पहलू अनुपातों में प्रदान की गई थीं। प्राथमिक कार्य द्विआधारी छवि वर्गीकरण है: एक छवि दिए जाने पर, यह निर्धारित करना कि इसमें बिल्ली है या कुत्ता।

यह डेटासेट जल्दी ही Machine learning समुदाय में एक मानक बेंचमार्क बन गया, विशेष रूप से Deep learning और Neural network आर्किटेक्चर पर पाठ्यक्रमों और ट्यूटोरियल के लिए। इसका मध्यम आकार और सरल द्विआधारी लेबलिंग इसे डेटा प्रीप्रोसेसिंग, Data Augmentation, ट्रांसफर लर्निंग और मॉडल मूल्यांकन जैसी मौलिक अवधारणाओं को प्रदर्शित करने के लिए आदर्श बनाती है। यह अक्सर उन अभ्यासकर्ताओं द्वारा उपयोग किए जाने वाले पहले वास्तविक-विश्व डेटासेट में से एक है जो कन्वोल्यूशनल न्यूरल नेटवर्क (CNN) बनाना सीख रहे हैं।

प्रतियोगिता और इतिहास

Cats vs. Dogs प्रतियोगिता 2013 में Kaggle पर आयोजित की गई थी, जिसका उद्देश्य प्रतिभागियों को ऐसे एल्गोरिदम विकसित करने के लिए प्रोत्साहित करना था जो स्वचालित रूप से छवियों को वर्गीकृत कर सकें। प्रतियोगिता ने सैकड़ों टीमों को आकर्षित किया और छवि पहचान कार्यों के लिए डीप लर्निंग के उपयोग को लोकप्रिय बनाने में मदद की। उस समय, कई विजेता समाधानों ने हस्तनिर्मित सुविधाओं और पारंपरिक क्लासिफायर का उपयोग किया, लेकिन डेटासेट ने कन्वोल्यूशनल न्यूरल नेटवर्क के लिए एक प्रारंभिक परीक्षण मैदान के रूप में भी काम किया, जो जल्द ही इस क्षेत्र पर हावी हो जाएंगे।

प्रतियोगिता समाप्त होने के बाद, डेटासेट Kaggle पर सार्वजनिक रूप से उपलब्ध रहा, और इसे अनगिनत शोध पत्रों, विश्वविद्यालय पाठ्यक्रमों और ऑनलाइन ट्यूटोरियल में डाउनलोड और उपयोग किया गया है। इसकी दीर्घायु आंशिक रूप से इसकी सरलता और TensorFlow और PyTorch जैसी सामान्य लाइब्रेरीज़ का उपयोग करके इसे लोड और प्रोसेस करने में आसानी के कारण है।

डेटासेट की विशेषताएँ

Cats vs. Dogs डेटासेट में प्रत्येक छवि एक JPEG फ़ाइल है जिसका फ़ाइल नाम लेबल को दर्शाता है, जैसे "cat.0.jpg" या "dog.0.jpg"। छवियाँ आकार में भिन्न होती हैं, जिनमें प्रत्येक तरफ कुछ सौ से लेकर एक हज़ार से अधिक पिक्सेल तक के विशिष्ट आयाम होते हैं। यह परिवर्तनशीलता न्यूरल नेटवर्क में इनपुट से पहले रीसाइज़िंग और सामान्यीकरण जैसे प्रीप्रोसेसिंग चरणों की आवश्यकता होती है।

डेटासेट संतुलित है, जिसमें प्रति वर्ग ठीक 12,500 छवियाँ हैं, जो मूल्यांकन मेट्रिक्स को सरल बनाता है। हालाँकि, यह चुनौतियों से रहित नहीं है: कुछ छवियों में कई जानवर, अवरोध, या असामान्य मुद्राएँ होती हैं, जो क्लासिफायर को भ्रमित कर सकती हैं। इसके अतिरिक्त, छवियाँ पूरी तरह से क्यूरेटेड नहीं हैं, इसलिए कभी-कभी गलत लेबल वाले उदाहरण होते हैं, हालाँकि ये दुर्लभ हैं।

डीप लर्निंग शिक्षा में उपयोग

Cats vs. Dogs अक्सर परिचयात्मक डीप लर्निंग पाठ्यक्रमों में एक शैक्षणिक उपकरण के रूप में उपयोग किया जाता है। यह एक एकल GPU पर उचित समय में प्रशिक्षित करने के लिए पर्याप्त छोटा है, फिर भी Batch Normalization, Dropout, और Learning Rate Scheduling जैसी तकनीकों के लाभों को प्रदर्शित करने के लिए पर्याप्त बड़ा है। कई ट्यूटोरियल इसका उपयोग शुरू से एक सरल CNN के निर्माण को चित्रित करने के लिए करते हैं, साथ ही Residual Network (ResNet) आर्किटेक्चर जैसे पूर्व-प्रशिक्षित मॉडल के साथ ट्रांसफर लर्निंग के उपयोग को भी।

डेटासेट Data Augmentation में अभ्यास के लिए भी उपयुक्त है, जहाँ रोटेशन, फ़्लिपिंग और ज़ूमिंग जैसे परिवर्तन प्रशिक्षण सेट के प्रभावी आकार को बढ़ाने और सामान्यीकरण में सुधार करने के लिए लागू किए जाते हैं। क्योंकि छवियाँ वास्तविक-विश्व तस्वीरें हैं, वे सिंथेटिक डेटासेट की तुलना में अधिक यथार्थवादी चुनौती प्रदान करती हैं, जिससे छात्रों को मजबूत प्रीप्रोसेसिंग और मॉडल ट्यूनिंग के महत्व को समझने में मदद मिलती है।

प्रभाव और विरासत

शिक्षा से परे, Cats vs. Dogs का उपयोग शोध में नए एल्गोरिदम को बेंचमार्क करने और विभिन्न परिस्थितियों में क्लासिफायर के व्यवहार का अध्ययन करने के लिए किया गया है। इसने व्युत्पन्न डेटासेट को भी प्रेरित किया है, जैसे कि अतिरिक्त वर्गों या अधिक चुनौतीपूर्ण विविधताओं वाले संस्करण। डेटासेट की लोकप्रियता ने Artificial intelligence में प्रगति के लिए एक मानक परीक्षण मैदान के रूप में छवि वर्गीकरण का उपयोग करने की व्यापक प्रवृत्ति में योगदान दिया।

जबकि ImageNet जैसे बड़े और अधिक जटिल डेटासेट अब अत्याधुनिक शोध के लिए आदर्श बन गए हैं, Cats vs. Dogs त्वरित प्रयोगों और कंप्यूटर विज़न की मूल बातें सिखाने के लिए एक मूल्यवान संसाधन बना हुआ है। इसकी पहुँच और स्पष्ट लेबलिंग यह सुनिश्चित करती है कि यह आने वाले वर्षों में मशीन लर्निंग समुदाय में एक प्रमुख तत्व बना रहेगा।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:dataset·image-classification·deep-learning·kaggle
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास