अंग्रेज़ी से अनुवादित

Guillaume Lample एक फ्रांसीसी कंप्यूटर वैज्ञानिक और Meta AI में शोध वैज्ञानिक हैं, जो LLaMA बड़े भाषा मॉडल श्रृंखला के सह-लेखक होने और तंत्रिका मशीन अनुवाद तथा भाषा मॉडलिंग में योगदान के लिए जाने जाते हैं।

गुइल्यूम लैम्पल एक फ्रांसीसी कंप्यूटर वैज्ञानिक और मेटा एआई (पूर्व में फेसबुक एआई रिसर्च) में शोध वैज्ञानिक हैं। वे तंत्रिका नेटवर्क आर्किटेक्चर में अपने योगदान के लिए सबसे अधिक जाने जाते हैं, विशेष रूप से प्राकृतिक भाषा प्रसंस्करण के लिए, और एलएलएएमए श्रृंखला के बड़े भाषा मॉडल के सह-लेखक के रूप में। उनका काम मशीन लर्निंग, डीप लर्निंग, और ट्रांसफॉर्मर-आधारित मॉडल तक फैला हुआ है।

लैम्पल ने 2016 में कार्नेगी मेलन विश्वविद्यालय से कंप्यूटर विज्ञान में पीएचडी पूरी की, जहाँ उन्होंने एलेक्सी एफ्रोस और रुसलान सलाखुतदीनोव के मार्गदर्शन में काम किया। उनका डॉक्टरेट शोध अनसुपरवाइज्ड लर्निंग और जनरेटिव मॉडल पर केंद्रित था, जिसमें पिक्सेल-स्तरीय डोमेन अनुकूलन और छवि निर्माण पर काम शामिल था। स्नातक होने के बाद, वे 2016 में फेसबुक एआई रिसर्च (अब मेटा एआई) में एक शोध वैज्ञानिक के रूप में शामिल हुए।

तंत्रिका मशीन अनुवाद

फेसबुक एआई रिसर्च में लैम्पल का प्रारंभिक कार्य तंत्रिका मशीन अनुवाद पर केंद्रित था। 2017 में, उन्होंने "अनसुपरवाइज्ड मशीन ट्रांसलेशन यूज़िंग मोनोलिंगुअल कॉर्पोरा ओनली" नामक पेपर का सह-लेखन किया, जिसे इंटरनेशनल कॉन्फ्रेंस ऑन लर्निंग रिप्रेजेंटेशन (आईसीएलआर) में प्रस्तुत किया गया। पेपर ने प्रदर्शित किया कि एक अनुवाद प्रणाली को समानांतर कॉर्पोरा के बिना, केवल प्रत्येक भाषा में मोनोलिंगुअल टेक्स्ट का उपयोग करके प्रशिक्षित किया जा सकता है। दृष्टिकोण ने साझा अव्यक्त स्थानों और डीनॉइज़िंग ऑटोएनकोडर का लाभ उठाया, जिससे अंग्रेजी-फ्रेंच और अंग्रेजी-जर्मन बेंचमार्क पर प्रतिस्पर्धी परिणाम प्राप्त हुए। इस कार्य के बाद 2018 में "फ्रेज़-बेस्ड एंड न्यूरल अनसुपरवाइज्ड मशीन ट्रांसलेशन" आया, जिसने फ्रेज़-आधारित सांख्यिकीय तरीकों को तंत्रिका घटकों के साथ जोड़ा।

क्रॉस-भाषाई भाषा मॉडलिंग

2019 में, लैम्पल और सहयोगियों ने क्रॉस-भाषाई भाषा मॉडल (एक्सएलएम) पेश किया, जिसे "क्रॉस-लिंगुअल लैंग्वेज मॉडल प्रीट्रेनिंग" पेपर में वर्णित किया गया। मॉडल ने कई भाषाओं में एक साझा शब्दावली और मास्क्ड भाषा मॉडलिंग उद्देश्यों का उपयोग किया, जिससे नामित इकाई पहचान और टेक्स्ट वर्गीकरण जैसे कार्यों के लिए शून्य-शॉट स्थानांतरण सक्षम हुआ। एक्सएलएम ने उस समय एक्सएनएलआई बेंचमार्क पर सर्वोत्तम परिणाम प्राप्त किए, जो पिछले बहुभाषी मॉडल से बेहतर प्रदर्शन कर रहा था। दृष्टिकोण ने बाद के बहुभाषी मॉडल जैसे एक्सएलएम-आर और एमबीईआरटी को प्रभावित किया।

एलएलएएमए और बड़े भाषा मॉडल

लैम्पल मेटा एआई में एलएलएएमए परिवार के मॉडल के मुख्य योगदानकर्ता थे। पहला एलएलएएमए मॉडल, फरवरी 2023 में जारी किया गया, चार आकारों में आया: 7बी, 13बी, 33बी, और 65बी पैरामीटर। तकनीकी रिपोर्ट, "एलएलएएमए: ओपन एंड एफिशिएंट फाउंडेशन लैंग्वेज मॉडल" में विस्तार से बताया गया कि मॉडल को सार्वजनिक रूप से उपलब्ध डेटासेट पर कुल 1.4 ट्रिलियन टोकन के साथ कैसे प्रशिक्षित किया गया। लैम्पल की भूमिका में मॉडल आर्किटेक्चर और प्रशिक्षण स्थिरता पर काम शामिल था। जुलाई 2023 में जारी एलएलएएमए-2, 70बी पैरामीटर तक विस्तारित हुआ और एक वाणिज्यिक लाइसेंस पेश किया। अप्रैल 2024 में जारी एलएलएएमए-3 में 8बी और 70बी वेरिएंट शामिल थे, जिसके बाद जुलाई 2024 में 405बी मॉडल आया। ये मॉडल ओपन-सोर्स एआई समुदाय में व्यापक रूप से अपनाए गए हैं और कई फाइन-ट्यून्ड व्युत्पन्न मॉडल के आधार के रूप में कार्य करते हैं।

अन्य शोध योगदान

अनुवाद और भाषा मॉडल के अलावा, लैम्पल ने कोड निर्माण और प्रोग्राम संश्लेषण पर काम किया है। 2021 में, उन्होंने (सैल्सफोर्स रिसर्च के सहयोगियों के साथ) "कोडटी5" का सह-लेखन किया, जो कोड समझ और निर्माण के लिए एक एकीकृत प्री-ट्रेंड एनकोडर-डिकोडर मॉडल है। उन्होंने फ्यू-शॉट लर्निंग और प्रॉम्प्ट इंजीनियरिंग पर शोध में भी योगदान दिया, जिसमें 2022 का पेपर "लैंग्वेज मॉडल्स आर फ्यू-शॉट लर्नर्स" शामिल है (हालांकि यह विशेष पेपर आमतौर पर ओपनएआई के जीपीटी-3 से जुड़ा है)। मेटा एआई में, वे मल्टीमॉडल लर्निंग और मानव प्रतिक्रिया से सुदृढ़ीकरण सीखने की खोज करने वाली परियोजनाओं में शामिल रहे हैं।

प्रभाव और मान्यता

गूगल स्कॉलर के अनुसार, लैम्पल के काम को 2024 तक 30,000 से अधिक बार उद्धृत किया गया है। अनसुपरवाइज्ड मशीन ट्रांसलेशन और क्रॉस-लिंगुअल प्रीट्रेनिंग पर उनके पेपर इस क्षेत्र में सबसे अधिक उद्धृत किए गए लोगों में से हैं। उन्होंने न्यूरिप्स और एसीएल सहित प्रमुख सम्मेलनों के लिए क्षेत्र अध्यक्ष के रूप में कार्य किया है। 2023 में, उन्हें फ्रांसीसी प्रौद्योगिकी पत्रिका एल'यूसीन नोवेल द्वारा "40 अंडर 40" में से एक नामित किया गया था। वे पेरिस में मेटा एआई में काम करना जारी रखते हैं, जहाँ वे बड़े पैमाने पर जनरेटिव मॉडल पर केंद्रित एक टीम का नेतृत्व करते हैं।

चयनित प्रकाशन

  • "अनसुपरवाइज्ड मशीन ट्रांसलेशन यूज़िंग मोनोलिंगुअल कॉर्पोरा ओनली" (आईसीएलआर 2017)
  • "फ्रेज़-बेस्ड एंड न्यूरल अनसुपरवाइज्ड मशीन ट्रांसलेशन" (ईएमएनएलपी 2018)
  • "क्रॉस-लिंगुअल लैंग्वेज मॉडल प्रीट्रेनिंग" (न्यूरिप्स 2019)
  • "एलएलएएमए: ओपन एंड एफिशिएंट फाउंडेशन लैंग्वेज मॉडल" (2023)
  • "एलएलएएमए-2: ओपन फाउंडेशन एंड फाइन-ट्यून्ड चैट मॉडल" (2023)
  • "द लामा 3 हर्ड ऑफ मॉडल्स" (2024)

उनके शोध को यूरोपीय अनुसंधान परिषद और फ्रांसीसी राष्ट्रीय अनुसंधान एजेंसी से अनुदान द्वारा समर्थित किया गया है, हालांकि विशिष्ट अनुदान संख्या सार्वजनिक रूप से सूचीबद्ध नहीं हैं। 2024 तक, लैम्पल एक सक्रिय शोधकर्ता बने हुए हैं, हाल के काम में बड़े भाषा मॉडल की दक्षता और सुरक्षा में सुधार पर ध्यान केंद्रित किया गया है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:computer-science·machine-learning·natural-language-processing·meta-ai
इस पृष्ठ को अंतिम बार संपादित किया गया 5 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास