एमिली एम. बेंडर वाशिंगटन विश्वविद्यालय में भाषाविज्ञान की प्रोफेसर हैं और बड़े भाषा मॉडलों के बारे में अतिशयोक्तिपूर्ण दावों की एक प्रमुख शैक्षणिक आलोचक हैं।
बेंडर की शैक्षणिक पृष्ठभूमि कम्प्यूटेशनल भाषाविज्ञान में है, और उनका शोध लंबे समय से भाषाई रूप और अर्थ के बीच के संबंध पर, तथा धाराप्रवाह भाषा उत्पादन को वास्तविक समझ के प्रमाण के रूप में मानने के जोखिमों पर केंद्रित रहा है। अलेक्जेंडर कोलर के साथ 2020 के एक पेपर, "क्लाइम्बिंग टुवर्ड्स एनएलयू: ऑन मीनिंग, फॉर्म, एंड अंडरस्टैंडिंग इन द एज ऑफ डेटा" में, बेंडर ने "ऑक्टोपस परीक्षण" प्रस्तुत किया, एक विचार प्रयोग जिसमें एक अति-बुद्धिमान ऑक्टोपस, जिसने केवल दो लोगों को केबल द्वारा संवाद करते हुए देखा है, बिना उस भौतिक दुनिया तक किसी पहुँच के जिसका वे वर्णन करते हैं, सांख्यिकीय रूप से प्रशंसनीय प्रतिक्रियाएँ उत्पन्न करना सीखता है, बिना कभी यह समझे कि शब्द किस चीज़ का उल्लेख करते हैं। बेंडर ने इस उपमा का उपयोग यह तर्क देने के लिए किया कि विशुद्ध रूप से पाठ के सांख्यिकीय पैटर्न पर प्रशिक्षित प्रणालियाँ, चाहे वे कितनी भी बड़ी हों, यह नहीं माना जा सकता कि उन्होंने अर्थ या समझ उसी तरह प्राप्त की है जिस तरह एक मानव वक्ता करता है।
स्टोकेस्टिक तोते
2021 में, बेंडर ने टिमनिट गेब्रू, एंजेलिना मैकमिलन-मेजर और मार्गरेट मिशेल के साथ "ऑन द डेंजर्स ऑफ स्टोकेस्टिक पैरट्स: कैन लैंग्वेज मॉडल्स बी टू बिग?" सह-लेखन किया। यह पेपर, जो गेब्रू और मिशेल के गूगल में रहते हुए लिखा गया था, ने तर्क दिया कि बड़े भाषा मॉडलों को बड़े पैमाने पर बढ़ाने से पर्यावरणीय लागतें आती हैं, वेब-स्क्रैप किए गए प्रशिक्षण डेटा में मौजूद सामाजिक पूर्वाग्रहों को एनकोड और प्रवर्धित करने का जोखिम होता है, ऐसा पाठ उत्पन्न होता है जिसका तथ्यात्मक सटीकता के लिए ऑडिट करना कठिन होता है, और उपयोगकर्ताओं तथा यहाँ तक कि शोधकर्ताओं को धाराप्रवाह आउटपुट को समझ समझने की भूल करने के लिए प्रोत्साहित करता है - यह एक आलोचना है जिसने इस क्षेत्र को व्यापक रूप से प्रयुक्त शब्द स्टोकेस्टिक तोता दिया। पेपर का प्रकाशन, और गूगल की उस पर आपत्तियाँ, गेब्रू के कंपनी से हाई-प्रोफाइल प्रस्थान में योगदान दीं।
सार्वजनिक टिप्पणी
बेंडर भाषा को मानवीय रूप देने के खिलाफ सबसे दृश्यमान शैक्षणिक आवाज़ों में से एक बनी हुई हैं, चैटबॉट का वर्णन करते समय और यह वर्णन करते समय कि एलएलएम क्या करते हैं, अधिक सटीक, गैर-मानसिक शब्दावली पर जोर देती हैं, उदाहरण के लिए मॉडलों को शाब्दिक अर्थ में समझने, जानने या मतिभ्रम करने के रूप में वर्णित करने पर आपत्ति जताती हैं, भले ही वह मतिभ्रम जैसे शब्दों को क्षेत्र के भीतर स्थापित आशुलिपि के रूप में स्वीकार करती हों। वह समाजशास्त्री एलेक्स हाना के साथ पॉडकास्ट "मिस्ट्री एआई हाइप थिएटर 3000" की सह-मेज़बान हैं, जिसमें दोनों एआई क्षमताओं के बारे में मीडिया कवरेज और उद्योग के दावों की आलोचनात्मक जाँच करते हैं।
प्रभाव
बेंडर का भाषाविज्ञान-आधारित संदेहवाद कृत्रिम सामान्य बुद्धिमत्ता समयरेखाओं और बड़े मॉडलों में आकस्मिक समझ के दावों पर बहस में एक मानक संदर्भ बिंदु बन गया है, जिसे अक्सर गैरी मार्कस जैसे शोधकर्ताओं की आलोचनाओं के साथ, प्रमुख एआई प्रयोगशालाओं के अधिक आशावादी आख्यानों के प्रतिसंतुलन के रूप में उद्धृत किया जाता है।