अंग्रेज़ी से अनुवादित

GPT-5.6 ओपनएआई द्वारा विकसित एक बड़ा भाषा मॉडल है, जिसे 2025 में GPT-5 के उत्तराधिकारी के रूप में जारी किया गया था, जिसमें बेहतर तर्क, मल्टीमॉडल क्षमताओं और दक्षता में सुधार पर ध्यान केंद्रित किया गया है।

GPT-5.6 एक बड़ा भाषा मॉडल है जिसे OpenAI द्वारा विकसित किया गया है, और इसे 15 सितंबर, 2025 को जारी किया गया। यह GPT-5 का उत्तराधिकारी है और कंपनी की जनरेटिव AI श्रृंखला में एक महत्वपूर्ण प्रगति का प्रतिनिधित्व करता है, जिसमें बेहतर तर्क, बहु-मोडल समझ और कम्प्यूटेशनल दक्षता पर जोर दिया गया है। यह मॉडल OpenAI के API और उपभोक्ता उत्पादों, जिसमें ChatGPT शामिल है, के अपडेट के साथ पेश किया गया था।

GPT-5.6 ट्रांसफॉर्मर आर्किटेक्चर पर आधारित है जो पिछले GPT मॉडलों की नींव है, और इसमें प्रशिक्षण पद्धति और मॉडल डिज़ाइन में सुधार शामिल किए गए हैं। यह कई कॉन्फ़िगरेशन में उपलब्ध है, जिसमें प्रमुख संस्करण में कथित तौर पर 2.1 ट्रिलियन पैरामीटर हैं, हालांकि OpenAI ने आधिकारिक रूप से इस आंकड़े की पुष्टि नहीं की है। यह मॉडल टेक्स्ट, छवि और ऑडियो इनपुट का समर्थन करता है, और टेक्स्ट, कोड और संरचित डेटा आउटपुट उत्पन्न कर सकता है।

आर्किटेक्चर और प्रशिक्षण

GPT-5.6 गहन शिक्षण ढांचे का उपयोग करता है जो ट्रांसफॉर्मर आर्किटेक्चर पर आधारित है, जिसमें मल्टी-हेड अटेंशन तंत्र और जहां लागू हो एनकोडर-डिकोडर संरचनाएं शामिल हैं। मॉडल को सार्वजनिक रूप से उपलब्ध टेक्स्ट, कोड और मल्टीमीडिया सामग्री से युक्त विविध डेटासेट पर प्रशिक्षित किया गया था, जिसमें रिपोर्ट किया गया प्रशिक्षण कम्प्यूट 1.8e26 FLOPs था। OpenAI ने मॉडल को मानवीय प्राथमिकताओं के साथ संरेखित करने के लिए पर्यवेक्षित शिक्षण और AI फीडबैक से सुदृढीकरण शिक्षण का संयोजन उपयोग किया।

प्रशिक्षण प्रक्रिया में अनुकूलन को स्थिर करने के लिए ग्रेडिएंट क्लिपिंग, लेयर नॉर्मलाइज़ेशन और बैच नॉर्मलाइज़ेशन तकनीकें शामिल थीं। मॉडल गहरी परतों के प्रशिक्षण को सुविधाजनक बनाने के लिए अवशिष्ट नेटवर्क का लाभ उठाता है, और नियमितीकरण के लिए ड्रॉपआउट का उपयोग करता है। पैरामीटर अपडेट के लिए एडम ऑप्टिमाइज़र के वेरिएंट का उपयोग किया गया, जिसमें लर्निंग रेट शेड्यूल शामिल था जिसमें वार्म-अप और कोसाइन क्षय चरण शामिल थे।

क्षमताएं और प्रदर्शन

GPT-5.6 अपने पूर्ववर्ती की तुलना में तर्क बेंचमार्क पर बेहतर प्रदर्शन दर्शाता है। MMLU (मैसिव मल्टीटास्क लैंग्वेज अंडरस्टैंडिंग) बेंचमार्क पर, इसने 91.2% का स्कोर हासिल किया, जो GPT-5 के 88.7% से अधिक है। मॉडल ने गणितीय तर्क कार्यों में भी सुधार दिखाया, GSM8K डेटासेट पर 94.5% और MATH बेंचमार्क पर 82.3% स्कोर किया। कोडिंग मूल्यांकन में, GPT-5.6 ने HumanEval पर 78.9% पास दर और SWE-bench पर 71.4% हासिल किया, जो बेहतर कोड जनरेशन और डिबगिंग क्षमताओं को दर्शाता है।

मॉडल की बहु-मोडल क्षमताएं इसे छवियों और ऑडियो को संसाधित और उत्पन्न करने की अनुमति देती हैं। MMMU (मैसिव मल्टी-डिसिप्लिन मल्टीमोडल अंडरस्टैंडिंग) बेंचमार्क पर, इसने 68.7% स्कोर किया, और ऑडियो-आधारित कार्यों पर, LibriSpeech परीक्षण सेट पर 85.2% सटीकता हासिल की। GPT-5.6 तथ्यात्मक सटीकता में भी सुधार दिखाता है, जिसमें GPT-5 की तुलना में भ्रम दरों में 12% की कमी आई है, जैसा कि आंतरिक OpenAI मूल्यांकनों द्वारा मापा गया है।

तैनाती और उपलब्धता

GPT-5.6 को इसकी रिलीज़ तिथि पर OpenAI के API के माध्यम से उपलब्ध कराया गया था, जिसमें मानक संस्करण के लिए मूल्य निर्धारण $15 प्रति मिलियन इनपुट टोकन और $60 प्रति मिलियन आउटपुट टोकन था। एक छोटा, अधिक कुशल वेरिएंट, GPT-5.6-mini भी जारी किया गया था, जो कम-विलंबता अनुप्रयोगों को लक्षित करता है। यह मॉडल ChatGPT में एकीकृत है, जो मुफ्त और भुगतान किए गए स्तरों के लिए डिफ़ॉल्ट मॉडल के रूप में GPT-5 की जगह लेता है। OpenAI ने क्लाउड होस्टिंग के लिए Microsoft Azure के साथ साझेदारी की, जिससे Amazon Web Services और Google Cloud में भी वैश्विक उपलब्धता सुनिश्चित हुई।

प्रारंभिक पहुंच OpenAI के साझेदारी कार्यक्रम के माध्यम से चुनिंदा उद्यम ग्राहकों को दी गई थी, जिसमें स्वास्थ्य सेवा, वित्त और शिक्षा के संगठन शामिल थे। मॉडल डोमेन-विशिष्ट कार्यों के लिए फाइन-ट्यूनिंग का समर्थन करता है, जिसमें OpenAI कस्टम अनुकूलन के लिए उपकरण प्रदान करता है। 2025 के अंत तक, GPT-5.6 95 देशों में उपलब्ध है, जिसमें अतिरिक्त क्षेत्रों में विस्तार की योजना है।

स्वागत और प्रभाव

GPT-5.6 को शोधकर्ताओं और उद्योग चिकित्सकों से आम तौर पर सकारात्मक समीक्षाएं मिलीं। स्टैनफोर्ड AI लैब और बर्कले AI रिसर्च द्वारा स्वतंत्र मूल्यांकनों ने पहले के मॉडलों की तुलना में बेहतर तर्क और कम पूर्वाग्रह की पुष्टि की। हालांकि, कुछ आलोचकों ने नोट किया कि मॉडल अभी भी जटिल बहु-चरणीय तर्क के साथ संघर्ष करता है और विशिष्ट क्षेत्रों में प्रशंसनीय लेकिन गलत आउटपुट उत्पन्न कर सकता है।

GPT-5.6 की रिलीज़ ने जनरेटिव AI बाजार में प्रतिस्पर्धा को तेज कर दिया, जिससे Anthropic ने Claude 4 और Google DeepMind ने Gemini 2.5 के साथ प्रतिक्रिया दी। विश्लेषकों ने देखा कि GPT-5.6 की दक्षता लाभ, जो मॉडल प्रूनिंग और ज्ञान आसवन तकनीकों के माध्यम से प्राप्त हुए, ने बड़े मॉडल तैनाती के लिए एक नया मानक स्थापित किया। मॉडल का खुला API और मजबूत दस्तावेज़ीकरण ने स्टार्टअप्स और अनुसंधान संस्थानों में इसके व्यापक अपनाने में योगदान दिया।

सुरक्षा और नैतिक विचार

OpenAI ने GPT-5.6 में कई सुरक्षा उपाय लागू किए, जिनमें बेहतर संरेखण तकनीकें और एक नया व्याख्यात्मकता उपकरण शामिल है जो उपयोगकर्ताओं को विशिष्ट प्रशिक्षण डेटा के लिए मॉडल निर्णयों को ट्रेस करने की अनुमति देता है। कंपनी ने बाहरी शोधकर्ताओं के साथ व्यापक रेड-टीमिंग अभ्यास किए, जिसके परिणामस्वरूप GPT-5 की तुलना में हानिकारक आउटपुट में 25% की कमी आई। हालांकि, संभावित दुरुपयोग के बारे में चिंताएं बनी हुई हैं, विशेष रूप से दुष्प्रचार और डीपफेक उत्पन्न करने में।

इन चिंताओं के जवाब में, OpenAI ने उपयोग नीतियां पेश कीं जो कुछ उच्च-जोखिम वाले अनुप्रयोगों को प्रतिबंधित करती हैं, जैसे कि मानवीय निगरानी के बिना स्वास्थ्य सेवा और वित्त में स्वचालित निर्णय लेना। कंपनी ने GPT-5.6 की क्षमताओं, सीमाओं और प्रशिक्षण डेटा स्रोतों का विवरण देने वाला एक मॉडल कार्ड प्रकाशित करके पारदर्शिता के लिए भी प्रतिबद्ध किया। दिसंबर 2025 तक, कोई बड़ी सुरक्षा घटना रिपोर्ट नहीं की गई है, हालांकि निरंतर निगरानी जारी है।

भविष्य के विकास

OpenAI ने 2026 की शुरुआत में GPT-5.7 जारी करने की योजना की घोषणा की है, जिसमें लंबे संदर्भ समझ और वास्तविक समय बातचीत में अपेक्षित सुधार होंगे। कंपनी मॉडल के पर्यावरणीय प्रभाव को कम करने के तरीकों की भी खोज कर रही है, जिसका लक्ष्य 2027 तक अनुमान ऊर्जा खपत में 30% की कमी है। OpenAI के शोधकर्ता स्केलेबिलिटी और दक्षता को और बढ़ाने के लिए मिश्रण-ऑफ-एक्सपर्ट्स परतों जैसी नवीन आर्किटेक्चर की जांच कर रहे हैं।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:large-language-models·openai·generative-ai·artificial-intelligence
इस पृष्ठ को अंतिम बार संपादित किया गया 14 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास