GPT-5 एक बहुविध (multimodal) बड़ा भाषा मॉडल है जिसे OpenAI द्वारा विकसित किया गया है और यह इसकी जनरेटिव प्री-ट्रेंड ट्रांसफॉर्मर (GPT) फाउंडेशन मॉडल की श्रृंखला में पाँचवाँ मॉडल है। इस श्रृंखला में GPT-4 से पहले आने वाला यह मॉडल 7 अगस्त, 2025 को लॉन्च किया गया था। यह चैटबॉट उत्पादों ChatGPT और Microsoft Copilot के उपयोगकर्ताओं के साथ-साथ OpenAI API के माध्यम से डेवलपर्स के लिए सार्वजनिक रूप से सुलभ है। यह लॉन्च जनरेटिव एआई के विकास में एक महत्वपूर्ण कदम था, जिसमें वास्तविक समय की बहुविध समझ और एजेंटिक क्षमताओं पर ध्यान केंद्रित किया गया था।
उसी वर्ष, Google DeepMind ने Astra लॉन्च किया, जिसे Gemini Live के रूप में भी जाना जाता है, जो एक वास्तविक समय का बहुविध एआई सहायक है जो उपभोक्ता और उद्यम बाजारों में GPT-5 के साथ सीधे प्रतिस्पर्धा करता है। Astra का लॉन्च, जो 2025 में हुआ, ने दृश्य और श्रवण इनपुट के साथ सहज बातचीत पर जोर दिया, जिससे यह OpenAI की पेशकश का एक प्रमुख प्रतिद्वंद्वी बन गया। यह लेख मुख्य रूप से GPT-5 पर केंद्रित है, जिसमें व्यापक परिदृश्य के संदर्भ में Astra का उल्लेख किया गया है।
पृष्ठभूमि
14 अप्रैल, 2023 को, OpenAI के मुख्य कार्यकारी अधिकारी सैम ऑल्टमैन ने मैसाचुसेट्स इंस्टीट्यूट ऑफ टेक्नोलॉजी में एक कार्यक्रम में बात की और कहा कि कंपनी उस समय GPT-5 को प्रशिक्षित नहीं कर रही थी। उन्होंने कहा कि OpenAI "GPT-4 विकास को प्राथमिकता दे रहा है" और "हम GPT-5 जारी नहीं कर रहे हैं और कुछ समय के लिए नहीं करेंगे"। 18 जुलाई को, OpenAI ने संयुक्त राज्य अमेरिका में "GPT-5" ट्रेडमार्क के लिए आवेदन किया। 13 नवंबर को, ऑल्टमैन ने फाइनेंशियल टाइम्स को पुष्टि की कि कंपनी GPT-5 विकसित करने के लिए काम कर रही है।
द इंफॉर्मेशन के अनुसार, "[2024 की दूसरी छमाही के अधिकांश समय के लिए, OpenAI एक मॉडल विकसित कर रहा था जिसे आंतरिक रूप से ओरियन के रूप में जाना जाता था और GPT-5 बनने का इरादा था", "[लेकिन] ओरियन का प्रयास एक बेहतर मॉडल बनाने में विफल रहा, और कंपनी ने इसके बजाय इसे फरवरी [2025] में GPT-4.5 के रूप में जारी किया।" जुलाई 2025 के अंत तक, OpenAI के अगस्त की शुरुआत में GPT-5 जारी करने की योजना बनाने की व्यापक उम्मीद थी। 30 जुलाई को, द वर्ज ने बताया कि "Microsoft GPT-5 के लिए तैयारी कर रहा है" क्योंकि "Microsoft की एआई योजनाओं से परिचित सूत्रों" ने एक संपादक को बताया कि कंपनी अपने Copilot चैटबॉट के लिए एक नए मोड का परीक्षण कर रही थी जो एक ऐसा मॉडल पेश करेगा जो "कार्य के आधार पर गहराई से या जल्दी से सोचता है"। 5 अगस्त को, GPT-5 की रिलीज़ से पहले, OpenAI ने GPT-OSS जारी किया, जो दो ओपन-वेट मॉडल का एक सेट है जिसमें तर्क क्षमताएं हैं। GPT-5 को फिर 7 अगस्त को एक लाइवस्ट्रीम कार्यक्रम के दौरान अनावरण किया गया।
क्षमताएं
अपनी रिलीज़ के समय, GPT-5 के पास गणित, प्रोग्रामिंग, वित्त और बहुविध समझ का परीक्षण करने वाले बेंचमार्क पर अत्याधुनिक प्रदर्शन था। OpenAI के अनुसार, इसके पूर्ववर्ती मॉडलों की तुलना में सुधारों में तेज़ प्रतिक्रिया समय, बेहतर कोडिंग और लेखन कौशल, स्वास्थ्य प्रश्नों के अधिक सटीक उत्तर और भ्रम के निम्न स्तर शामिल हैं। इसके अलावा, पिछले मॉडलों की तुलना में, GPT-5 का लक्ष्य संभावित रूप से हानिकारक प्रश्नों को सीधे अस्वीकार करने के बजाय सुरक्षित, उच्च-स्तरीय प्रतिक्रियाएं देना है, एक दृष्टिकोण जिसे OpenAI "सुरक्षित पूर्णताएं" कहता है, जिसका उद्देश्य "GPT-5 को अधिक असुरक्षित प्रश्नों को अस्वीकार करने में सक्षम बनाना है, जबकि हानिरहित जानकारी चाहने वाले उपयोगकर्ताओं को कम अस्वीकृतियां देना है।" इसके अतिरिक्त, GPT-5 को अपने पूर्ववर्ती मॉडलों की तुलना में अधिक आलोचनात्मक, "कम प्रशंसात्मक रूप से सहमत" उत्तर देने के लिए प्रशिक्षित किया गया था।
GPT-5 के लॉन्च से कुछ दिन पहले, मॉडल के दो शुरुआती परीक्षकों ने कहा कि वे कोड करने और गणितीय और वैज्ञानिक समस्याओं को हल करने की इसकी क्षमता से "प्रभावित" थे। उन्होंने सुझाव दिया कि मॉडल GPT-4 से महत्वपूर्ण सुधार दिखाता है, लेकिन GPT-3 से GPT-4 तक की तुलना में उतना बड़ा लाभ नहीं। GPT-5 की रिलीज़ से एक दिन पहले, एक प्रेस ब्रीफिंग के दौरान, OpenAI के मुख्य कार्यकारी अधिकारी सैम ऑल्टमैन ने GPT-5 को "AGI के मार्ग में एक महत्वपूर्ण कदम" कहा, जो कृत्रिम सामान्य बुद्धि का जिक्र करते हुए, बुद्धि का काल्पनिक स्तर है जिसे OpenAI किसी भी आर्थिक रूप से मूल्यवान कार्य को करने की क्षमता के रूप में परिभाषित करता है जो एक मानव कर सकता है। ऑल्टमैन के अनुसार, GPT-5 अपने पूर्ववर्तियों की तुलना में "काफी बेहतर" है, जो कार्यों की एक विस्तृत श्रृंखला में "पीएचडी-स्तर" की क्षमताएं प्रदान करता है।
GPT-5 उपयोग की सटीक ऊर्जा खपत का खुलासा OpenAI द्वारा नहीं किया गया है। रोड आइलैंड विश्वविद्यालय के शोधकर्ताओं ने अनुमान लगाया कि एक मध्यम-लंबाई की प्रतिक्रिया 18 वाट-घंटे से थोड़ा अधिक खपत करती है, जो 18 मिनट के लिए एक गरमागरम बल्ब का उपयोग करने के बराबर है।
वास्तुकला
GPT-5 एक प्रणाली है जिसमें एक तेज़, उच्च-थ्रूपुट मॉडल, एक गहरा तर्क मॉडल, और एक वास्तविक समय राउटर शामिल है जो बातचीत के प्रकार, जटिलता, उपकरण आवश्यकताओं और स्पष्ट उपयोगकर्ता इरादे के आधार पर निर्णय लेता है कि किस मॉडल का उपयोग करना है। ऑल्टमैन ने पहले मैन्युअल मॉडल चयनकर्ता की अत्यधिक जटिल होने के लिए आलोचना की थी, जो एकीकरण की आवश्यकता का सुझाव देता है। GPT-5 में एजेंटिक कार्यक्षमता भी शामिल है जिसके माध्यम से यह अपना खुद का डेस्कटॉप स्थापित कर सकता है और अपने कार्य से संबंधित स्रोतों की खोज के लिए अपने ब्राउज़र का उपयोग स्वायत्त रूप से कर सकता है। GPT-5 सिस्टम कार्ड दो तेज़, उच्च-थ्रूपुट मॉडल - gpt-5-main और gpt-5-main-mini - और दो सोच मॉडल - gpt-5-thinking और gpt-5-thinking-mini - को परिभाषित करता है। OpenAI API में, डेवलपर्स सोच मॉडल, इसके मिनी संस्करण, और gpt-5-thinking-nano, सोच मॉडल का एक और भी छोटा और तेज़ नैनो संस्करण, तक पहुंच सकते हैं। API के माध्यम से सुलभ GPT-5 का संस्करण समायोज्य तर्क प्रयास (निम्न, मध्यम, उच्च, या न्यूनतम) और वाचालता (निम्न, मध्यम, या उच्च) रखता है। इसके अतिरिक्त, ChatGPT gpt-5-thinking तक पहुंच प्रदान करता है जिसमें समानांतर परीक्षण-समय कंप्यूट का उपयोग करने वाली सेटिंग होती है, जिसे gpt-5-thinking-pro कहा जाता है।
सुरक्षा और सीमाएं
न्यूरलट्रस्ट, एक सुरक्षा अनुसंधान कंपनी, ने दावा किया कि उसने मॉडल का परीक्षण करने के पहले दिन के भीतर GPT-5 से समझौता करने में सफलता पाई। इसकी रिपोर्ट के अनुसार, इसने GPT-5 को विस्फोटक उपकरणों के निर्माण के लिए विस्तृत निर्देश उत्पन्न करने में सक्षम बनाया। SPLX, एक अन्य कंपनी, ने समान परीक्षण किए और GPT-5 की सुरक्षा के बारे में समान निष्कर्ष पर पहुंची। उनके आकलन बताते हैं कि GPT-5 में महत्वपूर्ण सुरक्षा अंतराल हैं, जो संभावित रूप से इसे कॉर्पोरेट वातावरण में उपयोग के लिए असुरक्षित बनाते हैं।
इन चिंताओं के बावजूद, OpenAI ने अपने सुरक्षा उपायों पर जोर दिया है, जिसमें "सुरक्षित पूर्णताएं" दृष्टिकोण और मानव प्रतिक्रिया से सुदृढीकरण सीखना जैसी संरेखण तकनीकें शामिल हैं। हालांकि, बाहरी शोधकर्ताओं द्वारा उजागर की गई सुरक्षा कमजोरियां उन्नत एआई प्रणालियों के लिए मजबूत सुरक्षा सुनिश्चित करने में चल रही चुनौतियों का संकेत देती हैं।
प्रशिक्षण
AIMultiple के अनुसार, GPT-5 स्वाभाविक रूप से बहुविध है, जिसका अर्थ है कि इसे एक साथ कई मोडैलिटी (जैसे पाठ और चित्र) पर शुरू से प्रशिक्षित किया गया था, बिना पहले से प्रशिक्षित भाषा या दृष्टि मॉडल पर निर्भर हुए। इसकी प्रशिक्षण प्रक्रिया में तीन चरण शामिल थे: अनुपयोगी पूर्व-प्रशिक्षण, पर्यवेक्षित फाइन-ट्यूनिंग, और मानव प्रतिक्रिया से सुदृढीकरण सीखना। पूर्व-प्रशिक्षण में पुस्तकों, लेखों, वेब पेजों, शैक्षणिक पत्रों और लाइसेंस प्राप्त स्रोतों का एक बड़े पैमाने पर बहुभाषी डेटासेट उपयोग किया गया। GPT-5 की दृश्य और पाठ क्षमताओं को GPT-4 के विपरीत, प्रशिक्षण के दौरान एक साथ विकसित होने के रूप में वर्णित किया गया था।
प्रशिक्षण प्रक्रिया ने ट्रांसफॉर्मर आर्किटेक्चर और बड़े भाषा मॉडल तकनीकों में प्रगति का लाभ उठाया, जिसमें मल्टी-हेड अटेंशन और स्थितीय एन्कोडिंग शामिल हैं। डेटा संवर्धन और मॉडल प्रूनिंग का उपयोग भी मॉडल की दक्षता और प्रदर्शन में योगदान दिया।
उपयोग और एकीकरण
GPT-5 का उपयोग ChatGPT में किया जाता है। हालांकि GPT-5 सभी ChatGPT उपयोगकर्ताओं के लिए मुफ्त है, प्लस उपयोगकर्ताओं को उच्च उपयोग सीमाएं मिलती हैं जबकि प्रो उपयोगकर्ताओं को GPT-5 तक असीमित पहुंच के साथ-साथ GPT-5 Pro तक सीमित पहुंच मिलती है। निचले-स्तरीय उपयोगकर्ताओं के लिए प्रति घंटे प्रतिक्रियाओं पर मानक सीमाएं अभी भी लागू होती हैं। इसके अतिरिक्त, GPT-5 की शुरुआत के साथ, ChatGPT का "एडवांस्ड वॉयस मोड" को "ChatGPT वॉयस" द्वारा बदल दिया गया, जो अधिक प्राकृतिक-ध्वनि वाली बातचीत को सक्षम करने वाला माना जाता है। OpenAI ने कहा कि "स्टैंडर्ड वॉयस मोड 9 सितंबर, 2025 को सेवानिवृत्त हो जाता है, जो सभी उपयोगकर्ताओं को ChatGPT वॉयस पर एकीकृत करता है"। 24 नवंबर, 2025 को, ChatGPT में शॉपिंग अनुसंधान की सुविधा जोड़ी गई, जिसे gpt-5-thinking-mini पर पोस्ट-प्रशिक्षित एक मिनी मॉडल होने का दावा किया गया।
GPT-5 Microsoft Copilot में भी उपलब्ध है, और Microsoft ने कहा कि वह GPT-5 को अपने उत्पादों की एक विस्तृत श्रृंखला में शामिल करेगा। 9to5Mac के अनुसार, Apple Inc. अपने iOS 26, iPadOS 26, और macOS Tahoe ऑपरेटिंग सिस्टम में Apple Intelligence सुविधा में मॉडल को एकीकृत करने की योजना बना रहा है। यह OpenAI API के माध्यम से भी सुलभ है, जिससे डेवलपर्स मॉडल के शीर्ष पर एप्लिकेशन बना सकते हैं।
तुलना में, Google का Astra (Gemini Live) Google के पारिस्थितिकी तंत्र, जिसमें Android और Google Assistant शामिल हैं, में एकीकृत है, और समान वास्तविक समय बहुविध क्षमताएं प्रदान करता है। OpenAI और Google DeepMind के बीच प्रतिस्पर्धा ने क्षेत्र में नवाचार को तेज किया है, दोनों कंपनियां एआई सहायकों की सीमाओं को आगे बढ़ा रही हैं।
प्रभाव और स्वागत
GPT-5 के लॉन्च का एआई उद्योग पर महत्वपूर्ण प्रभाव पड़ा है। बेंचमार्क पर इसका अत्याधुनिक प्रदर्शन कृत्रिम बुद्धिमत्ता प्रणालियों के लिए नए मानक स्थापित कर चुका है। कई डोमेन में जटिल कार्यों को संभालने की मॉडल की क्षमता की शुरुआती परीक्षकों द्वारा प्रशंसा की गई है, हालांकि कुछ ने नोट किया कि GPT-4 पर सुधार GPT-3 से GPT-4 तक की छलांग जितना नाटकीय नहीं है।
आलोचकों ने GPT-5 की सुरक्षा और सुरक्षा के बारे में चिंताएं उठाई हैं, विशेष रूप से न्यूरलट्रस्ट और SPLX द्वारा रिपोर्ट की गई कमजोरियों के आलोक में। ये मुद्दे एआई सुरक्षा और संरेखण में निरंतर अनुसंधान की आवश्यकता को उजागर करते हैं, एक क्षेत्र जिसमें जोशुआ टेनेनबाम और मेलानी मिशेल जैसे विशेषज्ञ शामिल हैं।
इन चुनौतियों के बावजूद, GPT-5 से शिक्षा, स्वास्थ्य सेवा और सॉफ्टवेयर विकास सहित विभिन्न क्षेत्रों में एआई के व्यापक रूप से अपनाए जाने की उम्मीद है। Microsoft Copilot और Apple Intelligence जैसे उत्पादों में इसका एकीकरण बताता है कि यह उपभोक्ताओं और उद्यमों दोनों के लिए एक सर्वव्यापी उपकरण बन जाएगा।
निष्कर्ष
GPT-5 जनरेटिव एआई और बड़े भाषा मॉडल के विकास में एक प्रमुख मील का पत्थर का प्रतिनिधित्व करता है। 7 अगस्त, 2025 को Google के Astra के साथ इसका लॉन्च वास्तविक समय के बहुविध एआई सहायकों के एक नए युग को चिह्नित करता है। जबकि सुरक्षा और ऊर्जा खपत के मामले में चुनौतियां बनी हुई हैं, GPT-5 की क्षमताएं क्षेत्र में हो रही तेजी से प्रगति को प्रदर्शित करती हैं। जैसे-जैसे एआई विकसित होता रहता है, GPT-5 जैसे मॉडल प्रौद्योगिकी और समाज के भविष्य को आकार देने में केंद्रीय भूमिका निभाएंगे।