GPT-4 एक बड़ा भाषा मॉडल है जिसे OpenAI द्वारा विकसित किया गया है, जो 14 मार्च, 2023 को अपनी GPT फाउंडेशन मॉडल श्रृंखला की चौथी पीढ़ी के रूप में जारी किया गया था। इसने GPT-3.5 का स्थान लिया और इसके बाद GPT-5 आया। अपने पूर्ववर्तियों के विपरीत, GPT-4 एक मल्टीमॉडल मॉडल है, जो पाठ और छवि दोनों इनपुट को संसाधित करने में सक्षम है। OpenAI ने मॉडल आकार, वास्तुकला, या प्रशिक्षण हार्डवेयर जैसे तकनीकी विवरणों का खुलासा नहीं किया, प्रतिस्पर्धी और सुरक्षा चिंताओं का हवाला देते हुए। GPT-4 शुरू में ChatGPT Plus ग्राहकों के लिए उपलब्ध था और बाद में OpenAI API के माध्यम से, 32,000 टोकन तक के संदर्भ का समर्थन करने वाले संस्करण के साथ। मई 2024 में, OpenAI ने GPT-4o पेश किया, जो वास्तविक समय ऑडियो और विज़न क्षमताओं वाला एक उत्तराधिकारी है, जो मुफ्त-स्तरीय उपयोगकर्ताओं के लिए भी उपलब्ध था।
पृष्ठभूमि
OpenAI ने 2018 में पहला GPT मॉडल पेश किया, जो ट्रांसफॉर्मर आर्किटेक्चर पर आधारित था और पुस्तकों के एक बड़े कोष पर प्रशिक्षित था। अगले वर्ष, GPT-2 ने पैमाने पर सुसंगत पाठ उत्पन्न करने की क्षमता प्रदर्शित की। 2020 में, GPT-3 को GPT-2 के मापदंडों से 100 गुना से अधिक के साथ जारी किया गया था, और आगे के शोधन ने GPT-3.5 को जन्म दिया, जिसने ChatGPT चैटबॉट को शक्ति प्रदान की। GPT-4 ने इस वंशावली पर निर्माण किया, जिसमें मल्टीमॉडल इनपुट और अधिक उन्नत प्रशिक्षण तकनीकों को शामिल किया गया।
क्षमताएँ
GPT-4 के डिफ़ॉल्ट संस्करण में 8K संदर्भ विंडो थी, जबकि एक विशेष API संस्करण 32K टोकन तक का समर्थन करता था। एक मल्टीमॉडल मॉडल के रूप में, यह छवियों को इनपुट के रूप में स्वीकार कर सकता था, जिससे उपयोगकर्ता फ़ोटो अपलोड कर सकते थे और दृश्य सामग्री के आधार पर सुझाव या उत्तर प्राप्त कर सकते थे। GPT-4 को बाहरी इंटरफेस के साथ बातचीत करने के लिए भी प्रेरित किया जा सकता था, जैसे कि वेब खोज करने के लिए <search></search> टैग के भीतर एक क्वेरी संलग्न करना, परिणामों को मॉडल के प्रॉम्प्ट में डालकर प्रतिक्रिया बनाना। इसने मॉडल को API का उपयोग करने, छवियां उत्पन्न करने और वेबपेजों का सारांश बनाने की अनुमति दी।
2023 में Nature में एक लेख ने बताया कि प्रोग्रामरों ने कोडिंग कार्यों के लिए GPT-4 को उपयोगी पाया, जैसे त्रुटियों की पहचान करना और अनुकूलन सुझाना, इसकी त्रुटि की प्रवृत्ति के बावजूद। लेख में उद्धृत एक बायोफिजिसिस्ट ने नोट किया कि MATLAB से Python में एक प्रोग्राम पोर्ट करने में दिनों के बजाय "लगभग एक घंटा" लगा। 89 सुरक्षा परिदृश्यों के एक परीक्षण में, GPT-4 ने SQL इंजेक्शन हमलों के लिए कमजोर कोड 5% समय उत्पन्न किया, जबकि 2021 से GitHub Copilot के लिए 40% की तुलना में।
नवंबर 2023 में, OpenAI ने GPT-4 Turbo और GPT-4 Turbo with Vision की घोषणा की, जिसमें 128K संदर्भ विंडो और काफी कम मूल्य निर्धारण था।
मानकीकृत परीक्षणों पर योग्यता
अध्ययनों ने मानकीकृत परीक्षणों के माध्यम से चैटबॉट चलाने की विश्वसनीयता पर सवाल उठाए हैं। टोरेंस टेस्ट ऑफ क्रिएटिव थिंकिंग में, GPT-4 ने मौलिकता और प्रवाह के लिए शीर्ष 1% में स्कोर किया, लचीलेपन के स्कोर 93वें से 99वें प्रतिशत तक थे।
चिकित्सा अनुप्रयोग
Microsoft के शोधकर्ताओं ने चिकित्सा समस्याओं पर GPT-4 का परीक्षण किया और पाया कि, विशेष प्रॉम्प्ट तैयार करने के बिना, यह USMLE पर पासिंग स्कोर से 20 अंकों से अधिक हो गया, जो GPT-3.5 जैसे पहले के सामान्य-उद्देश्य वाले मॉडल और चिकित्सा ज्ञान पर विशेष रूप से ठीक-ट्यून किए गए मॉडल, जैसे Med-PaLM, से बेहतर प्रदर्शन करता है। हालांकि, रिपोर्ट ने चिकित्सा अनुप्रयोगों के लिए बड़े भाषा मॉडल का उपयोग करने में "महत्वपूर्ण जोखिम" की चेतावनी दी, जिसमें गलत सिफारिशें और भ्रमित तथ्यात्मक त्रुटियां शामिल हैं। अप्रैल 2023 में, Microsoft और Epic Systems ने रोगी प्रश्नों का उत्तर देने और चिकित्सा रिकॉर्ड का विश्लेषण करने के लिए स्वास्थ्य सेवा प्रदाताओं को GPT-4-संचालित सिस्टम प्रदान करने की योजना की घोषणा की।
GPT-4o
13 मई, 2024 को, OpenAI ने GPT-4o ("o" "ओमनी" के लिए) पेश किया, जो GPT-4 का उत्तराधिकारी है जो वास्तविक समय में पाठ, ऑडियो और छवि मोडलिटी में आउटपुट संसाधित और उत्पन्न करता है। GPT-4o ने मानव संवाद के तुलनीय तेज़ प्रतिक्रिया समय, गैर-अंग्रेजी भाषाओं पर बेहतर प्रदर्शन, और बेहतर विज़न और ऑडियो समझ का प्रदर्शन किया। GPT-4 के विपरीत, यह मुफ्त-स्तरीय उपयोगकर्ताओं के लिए उपलब्ध था।
सीमाएँ
अपने पूर्ववर्तियों की तरह, GPT-4 भ्रमित करने के लिए जाना जाता है, ऐसे आउटपुट उत्पन्न करता है जिसमें इसके प्रशिक्षण डेटा में नहीं होने वाली जानकारी शामिल हो सकती है या उपयोगकर्ता के प्रॉम्प्ट का खंडन कर सकती है। इसमें निर्णय लेने में पारदर्शिता का भी अभाव है; जब इसके तर्क को समझाने के लिए कहा जाता है, तो GPT-4 पोस्ट-हॉक स्पष्टीकरण प्रदान करता है जो वास्तविक प्रक्रिया को प्रतिबिंबित नहीं कर सकता है, और कई मामलों में, ये स्पष्टीकरण पिछले बयानों का सीधे खंडन करते हैं।
2023 में, शोधकर्ताओं ने GPT-4 का परीक्षण ConceptARC बेंचमार्क के खिलाफ किया, जो अमूर्त तर्क को मापने के लिए डिज़ाइन किया गया है, और पाया कि यह सभी श्रेणियों में 33% से नीचे स्कोर करता है, जबकि विशेष मॉडल ने अधिकांश पर 60% स्कोर किया, और मनुष्यों ने कम से कम 91% स्कोर किया। सैम बोमन, अनुसंधान में शामिल नहीं, ने सुझाव दिया कि परिणाम अमूर्त तर्क की कमी का संकेत नहीं दे सकते क्योंकि परीक्षण दृश्य है, जबकि GPT-4 एक भाषा मॉडल है।
पूर्वाग्रह
GPT-4 को दो चरणों में प्रशिक्षित किया गया था। पहले, इसे अगले टोकन की भविष्यवाणी करने के लिए बड़े इंटरनेट पाठ डेटासेट पर प्रशिक्षित किया गया था। दूसरे, मानव प्रतिक्रिया का उपयोग मानव प्रतिक्रिया से सुदृढीकरण सीखने के माध्यम से सिस्टम को ठीक करने के लिए किया गया था, मॉडल को उन प्रॉम्प्ट को अस्वीकार करने के लिए प्रशिक्षित किया गया था जो OpenAI की हानिकारक व्यवहार की परिभाषा का उल्लंघन करते हैं, जैसे अवैध गतिविधियां, आत्म-नुकसान, या ग्राफिक सामग्री। Microsoft शोधकर्ताओं ने सुझाव दिया कि GPT-4 संज्ञानात्मक पूर्वाग्रह जैसे पुष्टिकरण पूर्वाग्रह, एंकरिंग, और आधार-दर उपेक्षा प्रदर्शित कर सकता है।
प्रशिक्षण
OpenAI ने GPT-4 के प्रशिक्षण के तकनीकी विवरण जारी नहीं किए। तकनीकी रिपोर्ट ने मॉडल आकार, वास्तुकला, या उपयोग किए गए हार्डवेयर को निर्दिष्ट करने से परहेज किया। इसने एक बड़े डेटासेट पर पर्यवेक्षित सीखने के संयोजन का वर्णन किया, जिसके बाद मानव और एआई प्रतिक्रिया के साथ सुदृढीकरण सीखने का वर्णन किया, लेकिन डेटासेट निर्माण, कंप्यूटिंग शक्ति, या हाइपरपैरामीटर जैसे सीखने की दर, युग गणना, या ऑप्टिमाइज़र पर विवरण प्रदान नहीं किया। रिपोर्ट ने इस निर्णय के कारणों के रूप में "प्रतिस्पर्धी परिदृश्य और बड़े पैमाने पर मॉडल के सुरक्षा निहितार्थ" का हवाला दिया। सैम ऑल्टमैन ने कहा कि GPT-4 को प्रशिक्षित करने की लागत $100 मिलियन से अधिक थी, जैसा कि Semafor द्वारा रिपोर्ट किया गया था।
स्वागत और प्रभाव
GPT-4 की रिलीज़ ने एआई समुदाय और उससे परे महत्वपूर्ण ध्यान आकर्षित किया। इसकी मल्टीमॉडल क्षमताओं और बेंचमार्क पर बेहतर प्रदर्शन, जिसमें मानकीकृत परीक्षण और चिकित्सा परीक्षाएं शामिल हैं, पर व्यापक रूप से चर्चा की गई। हालांकि, भ्रम, पूर्वाग्रह, और पारदर्शिता की कमी के बारे में चिंताएं बनी रहीं। फरवरी 2023 में आधिकारिक रिलीज़ से पहले बिंग चैट में एक प्रारंभिक संस्करण का एकीकरण भी जांच के दायरे में आया। GPT-4 2025 में ChatGPT से हटाए जाने के बाद भी OpenAI API में उपलब्ध रहा, और इसका उत्तराधिकारी GPT-4o मॉडल की क्षमताओं को विकसित करता रहा।