अंग्रेज़ी से अनुवादित

OpenAI ने 31 जनवरी 2025 को o3-mini जारी किया, जो डेवलपर्स के लिए एक छोटा, लागत-प्रभावी तर्क मॉडल है, जो समायोज्य तर्क प्रयास स्तरों के साथ तकनीकी क्षेत्रों में बेहतर प्रदर्शन प्रदान करता है।

OpenAI o3-mini OpenAI द्वारा विकसित एक बड़ा भाषा मॉडल है, जिसे 31 जनवरी 2025 को जारी किया गया था। यह OpenAI o3 मॉडल का एक छोटा संस्करण है, जिसे डेवलपर्स और उपयोगकर्ताओं के लिए एक लागत-प्रभावी विकल्प के रूप में डिज़ाइन किया गया है, जिन्हें कम कंप्यूट संसाधनों के साथ बड़े मॉडल की तर्क क्षमताओं की आवश्यकता होती है। o3-mini एक जनरेटिव एआई ट्रांसफॉर्मर वास्तुकला पर आधारित है, जो चरण-दर-चरण तार्किक तर्क के लिए गहन शिक्षण तकनीकों का लाभ उठाता है।

यह मॉडल o3 श्रृंखला का हिस्सा है, जो OpenAI o1 मॉडल के बाद आई थी। o3-mini को प्रदर्शन और लागत के बीच संतुलन प्रदान करने के लिए पेश किया गया था, जो कोडिंग, गणित और विज्ञान जैसे तकनीकी क्षेत्रों को लक्षित करता है, जहाँ सटीकता और गति आवश्यक हैं। यह तीन तर्क प्रयास स्तर प्रदान करता है - निम्न, मध्यम और उच्च - जिससे उपयोगकर्ता अपनी आवश्यकताओं के आधार पर प्रतिक्रिया विलंबता और गुणवत्ता के बीच व्यापार-बंद कर सकते हैं।

इतिहास और रिलीज़

OpenAI o3 मॉडल की पहली घोषणा 20 दिसंबर 2024 को की गई थी। "o3" नाम "o2" के बजाय चुना गया था ताकि मोबाइल कैरियर ब्रांड O2 के साथ ट्रेडमार्क विवाद से बचा जा सके। OpenAI ने सुरक्षा और अनुसंधान शोधकर्ताओं को 10 जनवरी 2025 तक मॉडल तक प्रारंभिक पहुँच के लिए आवेदन करने के लिए आमंत्रित किया। घोषणा के बाद, दो संस्करणों की योजना बनाई गई: o3 और o3-mini।

31 जनवरी 2025 को, OpenAI ने o3-mini को सभी ChatGPT उपयोगकर्ताओं के लिए जारी किया, जिसमें मुफ्त-स्तरीय उपयोगकर्ता और कुछ API उपयोगकर्ता शामिल हैं। OpenAI ने o3-mini को सटीकता और गति की आवश्यकता वाले तकनीकी क्षेत्रों के लिए o1 के "विशेष विकल्प" के रूप में वर्णित किया। ChatGPT का मुफ्त संस्करण मध्यम तर्क प्रयास स्तर का उपयोग करता है, जबकि भुगतान करने वाले ग्राहक o3-mini-high तक पहुँच सकते हैं, जो अधिक कंप्यूट का उपयोग करने वाला एक संस्करण है। ChatGPT Pro स्तर के ग्राहकों को o3-mini और o3-mini-high दोनों तक असीमित पहुँच मिली।

इसके तुरंत बाद, 2 फरवरी को, OpenAI ने OpenAI Deep Research लॉन्च किया, जो एक सेवा है जो वेब खोजों के आधार पर 5 से 30 मिनट के भीतर व्यापक रिपोर्ट तैयार करने के लिए o3 के एक संस्करण का उपयोग करती है। 6 फरवरी को, DeepSeek R1 जैसे प्रतिद्वंद्वियों के दबाव के जवाब में, OpenAI ने o3-mini की विचार प्रक्रिया की पारदर्शिता बढ़ाने के लिए अपडेट की घोषणा की। 12 फरवरी को, OpenAI ने ChatGPT Plus ग्राहकों के लिए o3-mini-high की दर सीमा बढ़ाई, उन्हें प्रति सप्ताह 50 अनुरोधों से बढ़ाकर प्रति दिन 50 अनुरोध कर दिया, और फ़ाइल और छवि अपलोड समर्थन जोड़ा।

16 अप्रैल 2025 को, OpenAI ने o3 और o4-mini जारी किए, जो o3-mini के उत्तराधिकारी हैं। इसके बाद, 10 जून को, OpenAI ने o3-pro जारी किया, जिसे कंपनी ने अपना सबसे सक्षम मॉडल होने का दावा किया। एक बयान में, OpenAI ने चुनौतीपूर्ण प्रश्नों के लिए o3-pro का उपयोग करने की सिफारिश की जहाँ विश्वसनीयता गति से अधिक महत्वपूर्ण है, यह देखते हुए कि कुछ मिनट इंतजार करना व्यापार-बंद के लायक है। 28 मई 2026 को, OpenAI ने घोषणा की कि o3 को 26 अगस्त 2026 को ChatGPT से सेवानिवृत्त कर दिया जाएगा, 90-दिन की सूर्यास्त अवधि के बाद, लेकिन यह परिवर्तन API को प्रभावित नहीं करता था।

क्षमताएँ और प्रदर्शन

OpenAI ने o3-mini को उत्तर उत्पन्न करने से पहले "सोचने" के लिए सुदृढीकरण शिक्षण का उपयोग करके प्रशिक्षित किया, जिसे "निजी विचार श्रृंखला" कहा जाता है। यह दृष्टिकोण मॉडल को पहले से योजना बनाने और कार्यों के माध्यम से तर्क करने की अनुमति देता है, समस्याओं को हल करने के लिए मध्यवर्ती तर्क चरणों का प्रदर्शन करता है, हालाँकि अतिरिक्त कंप्यूटिंग शक्ति और बढ़ी हुई प्रतिक्रिया विलंबता की कीमत पर।

o3-mini जटिल कार्यों पर o1 की तुलना में काफी बेहतर प्रदर्शन प्रदर्शित करता है, जिसमें कोडिंग, गणित और विज्ञान शामिल हैं। OpenAI के अनुसार, पूर्ण o3 मॉडल ने GPQA Diamond बेंचमार्क पर 87.7% का स्कोर हासिल किया, जिसमें विशेषज्ञ-स्तर के विज्ञान प्रश्न शामिल हैं जो ऑनलाइन सार्वजनिक रूप से उपलब्ध नहीं हैं। SWE-bench Verified पर, एक सॉफ्टवेयर इंजीनियरिंग बेंचमार्क, o3 ने o1 के 48.9% की तुलना में 71.7% स्कोर किया। Codeforces पर, o3 ने 2727 का Elo स्कोर हासिल किया, जबकि o1 ने 1891 स्कोर किया। कृत्रिम सामान्य बुद्धिमत्ता के लिए अमूर्त और तर्क कोष (ARC-AGI) बेंचमार्क पर, o3 ने o1 की तुलना में तीन गुना सटीकता हासिल की।

ये बेंचमार्क मॉडल की उन्नत तर्क क्षमताओं को उजागर करते हैं, जिससे यह उन कार्यों के लिए उपयुक्त हो जाता है जिनमें तार्किक निगमन और बहु-चरणीय समस्या-समाधान की आवश्यकता होती है। o3-mini की शुरुआत परिचालन लागत को कम करके इन क्षमताओं को व्यापक दर्शकों तक विस्तारित करती है।

तकनीकी डिज़ाइन और वास्तुकला

अपने पूर्ववर्ती की तरह, o3-mini एक तंत्रिका नेटवर्क आधारित मॉडल है जो ट्रांसफॉर्मर वास्तुकला का उपयोग करता है। यह इनपुट अनुक्रमों को प्रभावी ढंग से संसाधित करने के लिए बहु-शीर्ष ध्यान तंत्र और स्थितीय एन्कोडिंग को शामिल करता है। मॉडल को पाठ्यक्रम शिक्षण और RLHF (मानव प्रतिक्रिया से सुदृढीकरण शिक्षण) का उपयोग करके प्रशिक्षित किया जाता है, जो इसके आउटपुट को मानवीय अपेक्षाओं के साथ संरेखित करने में मदद करता है।

o3-mini की प्रमुख विशेषताओं में से एक इसका समायोज्य तर्क प्रयास स्तर है, जो विचार श्रृंखला प्रक्रिया की गहराई को नियंत्रित करता है। यह सुविधा डेवलपर्स को एप्लिकेशन के आधार पर गति या सटीकता के लिए अनुकूलित करने की अनुमति देती है। मॉडल पुनरावृत्त परिशोधन का भी समर्थन करता है, जिससे उपयोगकर्ता इसे अधिक सटीक उत्तरों की ओर मार्गदर्शन कर सकते हैं।

मूल्य निर्धारण और उपलब्धता

OpenAI ने o3-mini को डेवलपर्स के लिए एक लागत-प्रभावी समाधान के रूप में स्थापित किया। कंपनी ने नोट किया कि यह पूर्ण o3 मॉडल की तुलना में काफी सस्ता है, कुछ कॉन्फ़िगरेशन में कीमत 80% कम है। यह मूल्य निर्धारण रणनीति उन्नत तर्क क्षमताओं को अमेज़न वेब सेवाओं और एज़्योर क्लाउड तैनाती से लेकर मोबाइल ऐप्स तक अनुप्रयोगों की एक विस्तृत श्रृंखला के लिए सुलभ बनाने का लक्ष्य रखती है।

o3-mini OpenAI API और ChatGPT इंटरफ़ेस के माध्यम से उपलब्ध है। अपनी प्रारंभिक रिलीज़ के अनुसार, यह सीमित उपयोग के साथ मुफ्त-स्तरीय उपयोगकर्ताओं के लिए सुलभ था, जबकि भुगतान करने वाले ग्राहकों के पास नीचे उल्लिखित उच्च दर सीमाएँ थीं।

तुलना और प्रभाव

कृत्रिम बुद्धिमत्ता के प्रतिस्पर्धी परिदृश्य में, o3-mini को एंथ्रोपिक के Claude और गूगल डीपमाइंड के मॉडल जैसे प्रतिद्वंद्वियों का सामना करना पड़ता है। o3-mini की रिलीज़ OpenAI की लागत-प्रतिस्पर्धी मॉडल जैसे DeepSeek R1 के उद्भव की प्रतिक्रिया का हिस्सा थी, जिसने कंपनी को अधिक किफायती तर्क विकल्प पेश करने के लिए दबाव डाला। ARC-AGI और Codeforces जैसे बेंचमार्क पर मॉडल का प्रदर्शन जटिल तर्क कार्यों को संभालने की इसकी क्षमता प्रदर्शित करता है, जिससे यह मशीन शिक्षण शोधकर्ताओं और डेवलपर्स के लिए एक मूल्यवान उपकरण बन जाता है।

o3-mini की शुरुआत ने व्यापक AI पारिस्थितिकी तंत्र को प्रभावित किया है, अन्य कंपनियों को दक्षता और सामर्थ्य पर ध्यान केंद्रित करने के लिए प्रोत्साहित किया है। इसने तर्क प्रक्रियाओं की पारदर्शिता के बारे में चर्चाओं को भी जन्म दिया है, जिससे OpenAI मॉडल के विचार पैटर्न को संप्रेषित करने के तरीके में अपडेट हुए हैं।

यह भी देखें

  • OpenAI o1 (पूर्ववर्ती के रूप में, हालाँकि स्लग सूची में नहीं, हम OpenAI जैसा संबंधित लिंक उपयोग करते हैं)
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:openai·large-language-model·artificial-intelligence·reasoning-model
इस पृष्ठ को अंतिम बार संपादित किया गया 12 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास