एलन इंस्टीट्यूट फॉर आर्टिफिशियल इंटेलिजेंस, जिसे आमतौर पर AI2 के नाम से जाना जाता है, सिएटल, वाशिंगटन में स्थित एक गैर-लाभकारी कृत्रिम-बुद्धिमत्ता अनुसंधान संस्थान है। इसकी स्थापना 2014 में माइक्रोसॉफ्ट के सह-संस्थापक पॉल एलन ने की थी, जिन्होंने पहले एलन इंस्टीट्यूट फॉर ब्रेन साइंस को वित्त पोषित किया था और एआई अनुसंधान में समान परोपकारी महत्वाकांक्षा लागू करने की मांग की थी। ओरेन एट्ज़ियोनी ने इसकी स्थापना से 2022 तक संस्थान के पहले मुख्य कार्यकारी के रूप में कार्य किया।
इतिहास
AI2 ने शुरू से ही खुद को सिलिकॉन वैली में उभरती वाणिज्यिक एआई प्रयोगशालाओं के लिए एक शोध-प्रथम प्रतिसंतुलन के रूप में स्थापित किया। शुरुआती परियोजनाओं में सिमेंटिक स्कॉलर शामिल था, जो एक मुफ्त शैक्षणिक खोज इंजन है जो वैज्ञानिक साहित्य पर मशीन-लर्निंग और प्राकृतिक-भाषा-प्रसंस्करण लागू करता है, और एलनएनएलपी, एनएलपी अनुसंधान के लिए PyTorch पर निर्मित एक ओपन-सोर्स लाइब्रेरी। संस्थान ने कंप्यूटर-विज़न समूह PRIOR को भी इनक्यूबेट किया और आंतरिक शोध समूहों से निकली स्पिनआउट कंपनियों का समर्थन किया। 2018 में पॉल एलन की मृत्यु ने संस्थान को समाप्त नहीं किया; यह उनकी संपत्ति के बंदोबस्ती और अली फरहादी सहित बाद के नेतृत्व के तहत जारी रहा।
OLMo और खुला शोध
व्यापक बड़े-भाषा-मॉडल परिदृश्य में AI2 का सबसे दृश्यमान योगदान OLMo (ओपन लैंग्वेज मॉडल) के साथ आया, जिसे 2024 से जारी किया गया। OpenAI, Anthropic, और Google DeepMind जैसी प्रयोगशालाओं के अधिकांश सीमांत-मॉडल के विपरीत, OLMo को अपने पूर्ण प्रशिक्षण डेटा (डोलमा कॉर्पस), प्रशिक्षण और मूल्यांकन कोड, और मध्यवर्ती चेकपॉइंट्स के साथ जारी किया गया था, न कि केवल अंतिम वेट्स के साथ। इसने इसे कुछ वास्तविक खुले-वेट्स मॉडलों में से एक बना दिया, जहां शोधकर्ता केवल तैयार उत्पाद के बजाय पूरी प्रशिक्षण प्रक्रिया का अध्ययन कर सकते थे, एक अंतर जिसे AI2 ने प्रतिलिपि प्रस्तुत करने योग्य विज्ञान और उभरती क्षमताओं और प्रशिक्षण-डेटा प्रभावों का अध्ययन करने के लिए महत्वपूर्ण बताया। बाद के OLMo रिलीज़ ने पूरी तरह से खुली रिलीज़ दर्शन को बनाए रखते हुए बेंचमार्क प्रदर्शन में सुधार किया, और AI2 ने डेटा क्यूरेशन, फाइन-ट्यूनिंग और इंस्ट्रक्शन ट्यूनिंग पर सहयोगी शोध प्रकाशित किया।
स्वागत और प्रभाव
AI2 का पूरी तरह से खुला दृष्टिकोण शोधकर्ताओं और नीति निर्माताओं द्वारा एआई-शासन और वाणिज्यिक प्रयोगशालाओं द्वारा उपयोग किए जाने वाले प्रशिक्षण डेटा की पारदर्शिता पर बहस में एक संदर्भ बिंदु के रूप में उद्धृत किया गया है, जिनमें से कई को अज्ञात प्रशिक्षण कॉर्पोरा पर कॉपीराइट-मुकदमों का सामना करना पड़ता है। क्योंकि OLMo मॉडल आम तौर पर कई बेंचमार्क पर शीर्ष मालिकाना और यहां तक कि शीर्ष खुले-वेट्स मॉडल जैसे Llama या Qwen से पीछे रहते हैं, AI2 के योगदान को अक्सर अत्याधुनिक क्षमता के लिए प्रतिस्पर्धात्मक दावे के रूप में कम और व्यापक शोध समुदाय के लिए एक बुनियादी ढांचे और पारदर्शिता परियोजना के रूप में अधिक तैयार किया जाता है। संस्थान लाभ-आधारित एआई प्रयोगशालाओं के साथ एक गैर-लाभकारी के रूप में काम करना जारी रखता है, खुले उपकरण, डेटासेट और मॉडल को वित्त पोषित करता है जिन पर डाउनस्ट्रीम शोधकर्ता और छोटी कंपनियां लाइसेंसिंग प्रतिबंधों के बिना निर्माण कर सकती हैं।