GPT-4 एक बड़े पैमाने पर मल्टीमॉडल बड़ा भाषा मॉडल है जिसे OpenAI द्वारा विकसित किया गया और 14 मार्च, 2023 को GPT-3 के उत्तराधिकारी के रूप में जारी किया गया, और यह ChatGPT के उन्नत संस्करण को शक्ति देने वाला अंतर्निहित मॉडल है। अपने पूर्ववर्तियों के विपरीत, GPT-4 पाठ और छवि दोनों इनपुट स्वीकार करता है, हालांकि इसका आउटपुट अपने मूल रिलीज़ में केवल पाठ-आधारित रहा, और OpenAI ने पेशेवर और शैक्षणिक बेंचमार्क की एक विस्तृत श्रृंखला में काफी बेहतर प्रदर्शन की सूचना दी, जिसमें एक अनुकरणीय बार परीक्षा उत्तीर्ण करना शामिल है, जिसमें OpenAI ने मानव परीक्षार्थियों की तुलना में अनुकूल तुलना की।
गोपनीयता और तकनीकी प्रकटीकरण
GPT-4 की रिलीज़ ने OpenAI की प्रकाशन प्रथाओं में एक उल्लेखनीय बदलाव को चिह्नित किया। पहले के GPT पेपरों के विपरीत, जिन्होंने वास्तुकला और प्रशिक्षण डेटा का विवरण दिया, OpenAI की GPT-4 तकनीकी रिपोर्ट ने मॉडल आकार, वास्तुकला विवरण, प्रशिक्षण कंप्यूट या डेटासेट संरचना के बारे में कोई जानकारी प्रकट नहीं की, प्रतिस्पर्धा और सुरक्षा संबंधी विचारों का हवाला देते हुए। खुलेपन के प्रति OpenAI के पहले के मानदंड से यह विचलन अनुसंधान समुदाय के कुछ हिस्सों से आलोचना का विषय बना, जिन्होंने तर्क दिया कि इसने वैज्ञानिक प्रतिलिपि प्रस्तुत करने की क्षमता को कमजोर कर दिया जो इस क्षेत्र की विशेषता थी, और यह सीमा-रेखा मॉडल के डेवलपर्स के बीच पारदर्शिता पर व्यापक बहस में अक्सर उद्धृत उदाहरण बन गया।
AGI की चिंगारी
रिलीज़ के तुरंत बाद, माइक्रोसॉफ्ट के शोधकर्ताओं के एक समूह ने "स्पार्क्स ऑफ आर्टिफिशियल जनरल इंटेलिजेंस" प्रकाशित किया, जो कोडिंग, गणित, चिकित्सा, कानून और अन्य डोमेन में GPT-4 की क्षमताओं की जांच करने वाला एक पेपर है, जिसमें तर्क दिया गया कि मॉडल ने प्रारंभिक, सामान्य-उद्देश्यीय समस्या-समाधान क्षमताओं का प्रदर्शन किया जो संकीर्ण पैटर्न मिलान से परे थीं, और इसे कृत्रिम सामान्य बुद्धिमत्ता के संबंध में उचित रूप से चर्चा की जा सकती है। यह पेपर सार्वजनिक और अनुसंधान प्रवचन को स्थानांतरित करने में प्रभावशाली था, हालांकि इसने कठोर बेंचमार्किंग के बजाय वास्तविक, गैर-व्यवस्थित मूल्यांकन पर भरोसा करने के लिए पद्धतिगत आलोचना भी आकर्षित की।
प्रशिक्षण और सुरक्षा
GPT-4 को बड़े पैमाने पर प्रीट्रेनिंग का उपयोग करके प्रशिक्षित किया गया था, इसके बाद इसके आउटपुट को मानव प्राथमिकताओं के साथ संरेखित करने के लिए RLHF का उपयोग किया गया, साथ ही रिलीज़ से पहले बाहरी शोधकर्ताओं के साथ व्यापक रेड-टीमिंग की गई, जो उद्योग भर में रेड-टीमिंग और गार्डरेल कार्य से जुड़ी प्रथाओं का एक अनुप्रयोग है। OpenAI ने बाद में GPT-4 Turbo और अन्य पुनरावृत्त अद्यतन जारी किए जिन्होंने संदर्भ लंबाई का विस्तार किया और लागत कम की, और GPT-4 को भुगतान किए गए ChatGPT स्तरों के पीछे डिफ़ॉल्ट मॉडल के रूप में पेश किया, जिससे निरंतर सदस्यता राजस्व वृद्धि में योगदान मिला।
प्रभाव
GPT-4 की रिलीज़ ने AI उद्योग में प्रतिस्पर्धात्मक दबाव तेज कर दिया, जिससे Google DeepMind, Anthropic और अन्य प्रयोगशालाओं से त्वरित रिलीज़ को बढ़ावा मिला, और इसे अक्सर उस बिंदु के रूप में उद्धृत किया जाता है जिस पर सीमा-रेखा भाषा मॉडल विकास शैक्षणिक-निकट अनुसंधान संस्कृति से बड़े पैमाने पर, पूंजी-गहन वाणिज्यिक प्रतिस्पर्धा की ओर निर्णायक रूप से स्थानांतरित हुआ, एक अवधि जिसे कभी-कभी व्यापक एआई-उछाल के हिस्से के रूप में संदर्भित किया जाता है। OpenAI ने बाद में 2024 में OpenAI o1 को GPT-4-श्रेणी के आधार मॉडलों के शीर्ष पर निर्मित एक विशिष्ट तर्क-केंद्रित उत्तराधिकारी रेखा के रूप में जारी किया।