अंग्रेज़ी से अनुवादित

गौंटलेट लूप एक एजेंटिक प्रॉम्प्टिंग पैटर्न है जिसमें बिल्डर और आलोचक एजेंट एक स्पष्ट गुणवत्ता मानदंड के विरुद्ध अंधी तुलना के साथ पुनरावृत्ति करते हैं, जब तक कि आउटपुट एक संदर्भ को नहीं हरा देता।

गौंटलेट लूप एक एजेंटिक प्रॉम्प्टिंग पैटर्न है जिसमें एक एआई एजेंट सिस्टम एक स्पष्ट गुणवत्ता मानक के विरुद्ध किसी कार्य पर पुनरावृत्ति करता है, अलग-अलग बिल्डर और आलोचक भूमिकाओं और अंधी तुलनाओं का उपयोग करते हुए, जब तक कि आउटपुट एक ठोस संदर्भ को न हरा दे। इस तकनीक को 2026 में डेवलपर मैट शूमर द्वारा लोकप्रिय बनाया गया, जिन्होंने इसका नाम गढ़ा और इसका उपयोग "क्लॉड ऑफ ड्यूटी" बनाने के लिए किया, जो एक ब्राउज़र गेम है जिसे एजेंटिक कोडिंग हार्नेस के अंदर एजेंटों द्वारा शुरू से अंत तक तैयार किया गया था।

यह कैसे काम करता है

एक गौंटलेट लूप दो इनपुट से शुरू होता है: एक महत्वाकांक्षी लक्ष्य और एक ठोस उदाहरण कि "शानदार" कैसा दिखता है (संदर्भ)। एक प्रमुख एजेंट तब:

  1. मानक निर्धारित करता है। संदर्भ को प्रेरणा के रूप में नहीं, बल्कि हराने के लिए मानक माना जाता है।
  2. आर्टिफैक्ट को विघटित करता है सबसे छोटे भागों में जिन्हें स्वतंत्र रूप से सुधारा और आंका जा सके।
  3. बिल्डरों को नियुक्त करता है। प्रत्येक महत्वपूर्ण भाग एक बिल्डर एजेंट के पास जाता है जो इसे तैयार या संशोधित करता है।
  4. अंधा निर्णय करता है। ताज़ा संदर्भ वाला एक अलग आलोचक एजेंट वर्तमान आउटपुट की तुलना संदर्भ से एक अंधे ए/बी परीक्षण के रूप में करता है, बिना यह जाने कि कौन सा कौन सा है।
  5. सबसे बड़ा अंतर ढूंढता है। यदि आउटपुट हार जाता है, तो आलोचक सबसे बड़ा सार्थक अंतर बताता है, जो अगला निर्माण लक्ष्य बन जाता है।
  6. लूप करता है जब तक आउटपुट तुलना नहीं जीत लेता या कोई रोक शर्त पूरी नहीं हो जाती।

बिल्डरों और आलोचकों के बीच अलगाव मायने रखता है: एक ताज़ा-संदर्भ न्यायाधीश अपने स्वयं के काम का मूल्यांकन करने वाले मॉडल के स्व-मूल्यांकन पूर्वाग्रह से बचता है, और अंधा ए/बी ढांचा सामान्य प्रशंसा के बजाय ठोस तुलनाओं को मजबूर करता है।

आवश्यकताएँ और उपयोग

गौंटलेट लूप क्लॉड कोड या कोडेक्स जैसे एजेंटिक हार्नेस के अंदर चलते हैं, जहाँ एजेंट फ़ाइलें खोल सकते हैं, कोड चला सकते हैं, परिणाम प्रस्तुत कर सकते हैं, स्क्रीनशॉट निरीक्षण कर सकते हैं और उप-एजेंट उत्पन्न कर सकते हैं। यह पैटर्न किसी भी आर्टिफैक्ट पर लागू होता है जिसे निरीक्षण और सुधारा जा सकता है: कोड, वेबसाइट, उत्पाद डिज़ाइन, विपणन संपत्ति, लेखन और अनुसंधान। यह एजेंटिक स्व-सुधार तकनीकों के व्यापक परिवार से संबंधित है, जिसमें मल्टी-एजेंट सिस्टम में आलोचक-सत्यापनकर्ता पाइपलाइन और न्यायाधीश पैनल शामिल हैं।

यह भी देखें

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:Prompting techniques·Agentic AI
इस पृष्ठ को अंतिम बार संपादित किया गया 13 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास