अंग्रेज़ी से अनुवादित

मेटा के ओपन-वेट लार्ज लैंग्वेज मॉडल्स का परिवार, पहली बार फरवरी 2023 में जारी किया गया, जिसका प्रारंभिक ऑनलाइन लीक [[open-source]] लार्ज लैंग्वेज मॉडल पारिस्थितिकी तंत्र को उत्प्रेरित करने में सहायक रहा।

Llama (Large Language Model Meta AI) बड़े भाषा मॉडलों का एक परिवार है, जिसे Meta AI द्वारा विकसित किया गया है और पहली बार 24 फरवरी 2023 को जारी किया गया था। इसे बंद वाणिज्यिक मॉडलों के लिए एक शोध-उन्मुख विकल्प के रूप में स्थापित किया गया था, जिसे प्रकाशित वज़न के साथ एक लाइसेंस के तहत उपलब्ध कराया गया था जो शोध और, बाद के संस्करणों में, अधिकांश वाणिज्यिक उपयोग की अनुमति देता है।

प्रारंभिक रिलीज़ और लीक

पहले Llama मॉडल, जिनमें 7 बिलियन से 65 बिलियन पैरामीटर थे, शुरू में केवल स्वीकृत शोधकर्ताओं को आवेदन के तहत जारी किए गए थे। कुछ ही दिनों में, मॉडल वज़न फ़ाइल-शेयरिंग साइट 4chan पर लीक हो गए और इंटरनेट पर तेज़ी से फैल गए, एक घटना जिसे व्यापक रूप से बड़ी प्रयोगशालाओं के बाहर सक्षम भाषा मॉडल चलाने और फ़ाइन-ट्यूनिंग के साथ जमीनी स्तर के प्रयोग की लहर शुरू करने का श्रेय दिया जाता है। लीक, Quantization जैसी तकनीकों के साथ मिलकर, जिसने उपभोक्ता हार्डवेयर पर बड़े मॉडल चलाना संभव बना दिया, ने समुदाय-आधारित परियोजनाओं और Llama वज़न पर निर्मित फ़ाइन-ट्यून व्युत्पन्नों की भारी वृद्धि को सक्षम किया, जो हगिंग फेस जैसे प्लेटफार्मों पर बड़े पैमाने पर होस्ट किए गए।

बाद के रिलीज़

मेटा ने जुलाई 2023 में Llama 2 जारी किया, जो माइक्रोसॉफ्ट के साथ साझेदारी में एक अधिक अनुमेय लाइसेंस के तहत था जो स्पष्ट रूप से अधिकांश संगठनों के लिए वाणिज्यिक उपयोग की अनुमति देता था, और अप्रैल 2024 में Llama 3, जिसने बेंचमार्क प्रदर्शन में काफी सुधार किया और बाद में बड़े और मल्टीमॉडल वेरिएंट के साथ विस्तारित किया गया, जिसमें छवि इनपुट स्वीकार करने वाले संस्करण शामिल थे। 2025 में जारी Llama 4 ने मिश्रण-ऑफ-एक्सपर्ट्स वास्तुकला और मूल मल्टीमॉडलिटी को अपनाया। सभी संस्करणों में, उस समय मेटा के मुख्य AI वैज्ञानिक Yann LeCun, मॉडल वज़न को खुले तौर पर जारी करने के रणनीतिक मूल्य के एक प्रमुख सार्वजनिक समर्थक थे, उन्होंने तर्क दिया कि यह सुरक्षा अनुसंधान को गति देता है, AI क्षमता के खतरनाक एकाग्रता को रोकता है, और मेटा के प्रौद्योगिकी स्टैक के आसपास डेवलपर पारिस्थितिकी तंत्र बनाता है।

लाइसेंसिंग और ओपन-वेट्स बहस

Llama की लाइसेंस शर्तें संस्करणों में विकसित हुईं और इस बात पर चल रही बहस का विषय थीं कि क्या मॉडल पारंपरिक सॉफ्टवेयर अर्थ में वास्तव में "ओपन सोर्स" के रूप में योग्य थे, क्योंकि लाइसेंस में उपयोग प्रतिबंध (जैसे बहुत बड़ी कंपनियों के लिए सीमाएं) शामिल थे जो मानक ओपन-सोर्स लाइसेंस में मौजूद नहीं हैं। इस तनाव ने Llama को ओपन-वेट्स मॉडल और AI के लिए खुलेपन का क्या मतलब होना चाहिए, के बारे में व्यापक उद्योग चर्चा के केंद्र में रखा, साथ ही Mistral AI, DeepSeek, और अलीबाबा के Qwen से अन्य खुले रिलीज़ के साथ।

पारिस्थितिकी तंत्र और प्रभाव

Llama की उपलब्धता ने व्यापक ओपन-मॉडल पारिस्थितिकी तंत्र को काफी हद तक आकार दिया: यह LoRA और अन्य कुशल फ़ाइन-ट्यूनिंग विधियों के लिए एक सामान्य आधार बन गया, मॉडल व्यवहार पर अकादमिक शोध में एक मानक आधार रेखा, और कई डाउनस्ट्रीम वाणिज्यिक और खुले उत्पादों की नींव। Mark Zuckerberg ने सार्वजनिक रूप से मेटा की ओपन-वेट्स रणनीति को OpenAI और अन्य फ्रंटियर प्रयोगशालाओं के बंद दृष्टिकोणों से अलग एक दीर्घकालिक दांव के रूप में तैयार किया, यह तर्क देते हुए कि सक्षम मॉडलों तक व्यापक पहुंच मेटा के व्यावसायिक हितों और व्यापक AI पारिस्थितिकी तंत्र दोनों की सेवा करती है, हालांकि इस रणनीति ने कुछ AI सुरक्षा शोधकर्ताओं से आलोचना आकर्षित की, जो वज़न के स्वतंत्र रूप से वितरित होने के बाद दुरुपयोग को नियंत्रित करने की कठिनाई के बारे में चिंतित थे। 2025 में, मेटा ने अपने AI अनुसंधान प्रयासों के कुछ हिस्सों को एक नई "सुपरइंटेलिजेंस" प्रयोगशाला के तहत पुनर्गठित किया, जिसमें Alexandr Wang सहित बाहरी प्रतिभा की भर्ती की गई, रिपोर्टों के बीच मूल खुले Llama रिलीज़ की तुलना में तेजी से आक्रामक, कम खुले तौर पर प्रकाशित शोध रुख अपनाया गया।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:large-language-models·open-weights·meta-models
इस पृष्ठ को अंतिम बार संपादित किया गया 2 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास