Google Gemini 3 बहुविध (multimodal) बड़े भाषा मॉडलों का एक परिवार है, जिसे Google DeepMind द्वारा विकसित किया गया और नवंबर 2025 में जारी किया गया। Gemini 3 न्यूज़ लॉन्च इस रिलीज़ की सार्वजनिक घोषणा को संदर्भित करता है, जिसे कृत्रिम बुद्धिमत्ता उद्योग में एक बड़े कदम के रूप में और दिसंबर 2023 में पेश की गई Gemini मॉडल श्रृंखला की अगली पीढ़ी के रूप में प्रस्तुत किया गया था।
Gemini, Google के पहले के LaMDA और PaLM 2 मॉडलों का उत्तराधिकारी है और Gemini चैटबॉट को शक्ति प्रदान करता है। यह नाम Gemini राशि से आया है। मूल Gemini परिवार में Gemini Pro, Gemini Deep Think, Gemini Flash और Gemini Flash Lite शामिल थे, और बाद के संस्करणों में Gemini 1.5 और Gemini 2.0 का विस्तार हुआ। Gemini 3 को अब तक का सबसे सक्षम संस्करण बताया गया, जो बहुविध दृष्टिकोण पर आधारित है जो मॉडल को पाठ, चित्र, ऑडियो, वीडियो और कंप्यूटर कोड को संसाधित करने की अनुमति देता है।
पृष्ठभूमि
Google ने सबसे पहले Gemini की घोषणा की, जो उसकी सहायक कंपनी Google DeepMind द्वारा विकसित एक बड़ा भाषा मॉडल है, 10 मई, 2023 को Google I/O मुख्य भाषण के दौरान। इसे PaLM 2 के अधिक शक्तिशाली उत्तराधिकारी के रूप में वर्णित किया गया था, जिसे भी इसी कार्यक्रम में अनावरण किया गया था। Google के सीईओ सुंदर पिचाई ने उस समय कहा था कि Gemini अभी भी अपने प्रारंभिक विकास के चरणों में है। कई अन्य भाषा मॉडलों के विपरीत, Gemini को शुरू से ही बहुविध बनाने के लिए डिज़ाइन किया गया था, जिसका अर्थ है कि यह एक साथ कई प्रकार के डेटा को संसाधित कर सकता है, जिसमें पाठ, चित्र, ऑडियो, वीडियो और कंप्यूटर कोड शामिल हैं। यह परियोजना DeepMind और Google Brain के बीच एक सहयोग था, जो Google की दो शाखाएँ थीं जिन्हें Google DeepMind में विलय कर दिया गया था।
Wired के साथ एक साक्षात्कार में, DeepMind के सीईओ डेमिस हसाबिस ने कहा कि Gemini की उन्नत क्षमताएँ इसे OpenAI के ChatGPT से आगे निकलने की अनुमति देंगी, जो GPT-4 पर चलता है। हसाबिस ने DeepMind के AlphaGo प्रोग्राम की ताकतों पर प्रकाश डाला, जिसने 2016 में गो चैंपियन ली सेडोल को हराकर दुनिया भर में ध्यान आकर्षित किया था, और कहा कि Gemini AlphaGo की शक्ति को अन्य Google DeepMind भाषा मॉडलों के साथ जोड़ देगा। अगस्त 2023 में, द इंफॉर्मेशन ने बताया कि Google 2023 के अंत में लॉन्च की तारीख को लक्षित कर रहा था और संवादात्मक पाठ क्षमताओं को AI-संचालित छवि निर्माण के साथ जोड़कर OpenAI और अन्य प्रतिस्पर्धियों से आगे निकलने की उम्मीद कर रहा था। Google के सह-संस्थापक सर्गेई ब्रिन को कथित तौर पर सेवानिवृत्ति से बाहर बुलाया गया था ताकि वे Gemini के विकास में सहायता कर सकें, साथ ही Google Brain और DeepMind के सैकड़ों इंजीनियरों को भी शामिल किया गया। चूंकि Gemini को YouTube वीडियो के ट्रांसक्रिप्ट पर प्रशिक्षित किया गया था, इसलिए संभावित कॉपीराइट सामग्री को फ़िल्टर करने के लिए वकीलों को लाया गया था।
लॉन्च से पहले का विकास
6 दिसंबर, 2023 को, पिचाई और हसाबिस ने एक आभासी प्रेस कॉन्फ्रेंस में Gemini 1.0 की घोषणा की। प्रारंभिक रिलीज़ में तीन मॉडल शामिल थे: अत्यधिक जटिल कार्यों के लिए Gemini Ultra, कार्यों की एक विस्तृत श्रृंखला के लिए Gemini Pro, और डिवाइस पर कार्यों के लिए Gemini Nano। लॉन्च के समय, Gemini Pro और Nano को क्रमशः Bard और Pixel 8 Pro स्मार्टफोन में एकीकृत किया गया था। Gemini Ultra को बाद में एक "Bard Advanced" स्तर को शक्ति देने और 2024 की शुरुआत में सॉफ्टवेयर डेवलपर्स के लिए उपलब्ध होने के लिए निर्धारित किया गया था। Google ने कहा कि व्यापक सुरक्षा परीक्षण की आवश्यकता के कारण Gemini को अगले वर्ष तक व्यापक रूप से उपलब्ध नहीं कराया जाएगा। Gemini को Google के टेंसर प्रोसेसिंग यूनिट्स पर प्रशिक्षित किया गया था, और यह नाम NASA के प्रोजेक्ट Gemini के साथ-साथ DeepMind-Google Brain विलय को भी संदर्भित करता है।
Gemini Ultra को विभिन्न उद्योग बेंचमार्क पर GPT-4, एंथ्रोपिक के Claude 2, Inflection AI के Inflection-2, मेटा के LLaMA 2 और xAI के Grok 1 से बेहतर प्रदर्शन करने की सूचना दी गई थी। यह 57-विषय वाले मैसिव मल्टीटास्क लैंग्वेज अंडरस्टैंडिंग परीक्षण में मानव विशेषज्ञों से बेहतर प्रदर्शन करने वाला पहला भाषा मॉडल भी था, जिसमें 90 प्रतिशत का स्कोर था। Gemini Pro को 13 दिसंबर, 2023 को AI Studio और Vertex AI पर Google Cloud ग्राहकों के लिए उपलब्ध कराया गया था। अक्टूबर 2023 में अमेरिकी राष्ट्रपति जो बाइडेन द्वारा हस्ताक्षरित एक कार्यकारी आदेश के अनुसार, Google ने कहा कि वह Gemini Ultra के परीक्षण परिणाम संघीय सरकार के साथ साझा करेगा। कंपनी ने ब्लेचली पार्क में AI सुरक्षा शिखर सम्मेलन के सिद्धांतों का पालन करने के लिए यूनाइटेड किंगडम की सरकार के साथ भी चर्चा की।
जनवरी 2024 में, Google ने Gemini Nano और Gemini Pro को Galaxy S24 स्मार्टफोन लाइनअप में एकीकृत करने के लिए सैमसंग के साथ साझेदारी की। अगले महीने, Bard और Duet AI को Gemini ब्रांड के तहत एकीकृत किया गया, और Gemini Advanced with Ultra 1.0 को Google One के नए AI Premium स्तर के माध्यम से जारी किया गया। फरवरी 2024 में, Google ने Gemini 1.5 लॉन्च किया, इसे 1.0 Ultra से अधिक शक्तिशाली बताते हुए, एक नई वास्तुकला, विशेषज्ञों का मिश्रण दृष्टिकोण और एक बड़ा एक-मिलियन-टोकन संदर्भ विंडो के साथ। उसी महीने, Google ने Gemma की शुरुआत की, जो Gemini मॉडलों की एक छोटी, मुफ्त और ओपन-सोर्स श्रृंखला है। 14 मई, 2024 को Google I/O मुख्य भाषण में, Google ने Gemini 1.5 Flash की घोषणा की और अपने बिल्ट-इन AI आर्किटेक्चर के माध्यम से Chrome ब्राउज़र में डेस्कटॉप-अनुकूलित Gemini Nano बिल्ड को एकीकृत करने की योजना बनाई। दो अद्यतन मॉडल, Gemini-1.5-Pro-002 और Gemini-1.5-Flash-002, 24 सितंबर, 2024 को जारी किए गए।
11 दिसंबर, 2024 को, Google ने Gemini 2.0 Flash Experimental की घोषणा की। इस संस्करण ने वास्तविक समय ऑडियो और वीडियो इंटरैक्शन के लिए एक मल्टीमॉडल लाइव API, वॉटरमार्किंग के साथ मूल छवि और नियंत्रणीय टेक्स्ट-टू-स्पीच पीढ़ी, और एकीकृत Google खोज पेश की। जून 2025 में, Google ने Gemini CLI पेश किया, एक ओपन-सोर्स AI एजेंट जो Gemini क्षमताओं को टर्मिनल पर लाया, जो कोडिंग, स्वचालन और समस्या-समाधान सुविधाएँ प्रदान करता है, जिसमें व्यक्तिगत डेवलपर्स के लिए उदार मुफ्त उपयोग सीमाएँ हैं। इन रिलीज़ों ने उस वर्ष बाद में Gemini 3 लॉन्च के लिए मंच तैयार किया।
नवंबर 2025 लॉन्च कार्यक्रम
Gemini 3 न्यूज़ लॉन्च नवंबर 2025 में एक आभासी प्रेस कार्यक्रम के रूप में हुआ। Google DeepMind ने Gemini 3 को Gemini 2.0 के उत्तराधिकारी और Gemini परिवार में नवीनतम प्रमुख रिलीज़ के रूप में प्रस्तुत किया। इस कार्यक्रम ने जनरेटिव AI उद्योग में ध्यान आकर्षित किया, दिसंबर 2023 में मूल Gemini 1.0 घोषणा के साथ तुलना की गई। Google के अनुसार, Gemini 3 ने तर्क, लंबे-संदर्भ समझ और बहुविध आउटपुट में सुधार शामिल किए, जो Gemini 2.0 में पेश की गई सुविधाओं जैसे मूल छवि निर्माण और नियंत्रणीय टेक्स्ट-टू-स्पीच पर आधारित थे।
पिछले Gemini लॉन्च की तरह, कंपनी ने सुरक्षा परीक्षण और जिम्मेदार तैनाती पर जोर दिया। Google ने कहा कि वह Gemini Ultra के साथ स्थापित मिसाल के बाद सरकारी एजेंसियों के साथ मूल्यांकन परिणाम साझा करना जारी रखेगा। कंपनी ने Google सेवाओं, जिसमें खोज, Chrome और Google Cloud शामिल हैं, के साथ Gemini 3 के एकीकरण पर भी प्रकाश डाला। कार्यक्रम में, Google ने घोषणा की कि Gemini 3 डेवलपर्स के लिए Vertex AI और AI Studio के माध्यम से उपलब्ध होगा, जो दिसंबर 2023 में Gemini Pro के लिए उपयोग किए गए वितरण मॉडल का विस्तार करेगा।
मॉडल परिवार और तकनीकी वास्तुकला
Gemini 3 ने बहुविध डिज़ाइन को जारी रखा जो Gemini परिवार को पाठ-केवल बड़े भाषा मॉडलों से अलग करता है। अंतर्निहित वास्तुकला ट्रांसफॉर्मर मॉडल पर आधारित है, एक गहन शिक्षण दृष्टिकोण जो 2017 में पेश किया गया था और आधुनिक भाषा मॉडलों में मानक बन गया है। Gemini 1.5 की तरह, Gemini 3 से विशेषज्ञों के मिश्रण डिज़ाइन का उपयोग करने की उम्मीद थी, जिसमें तंत्रिका नेटवर्क के विभिन्न हिस्से विभिन्न प्रकार के इनपुट के लिए सक्रिय होते हैं। यह दृष्टिकोण मॉडल को बड़ी मात्रा में डेटा संभालने में मदद करता है जबकि कम्प्यूटेशनल लागत प्रबंधनीय रहती है।
Gemini परिवार में ऐतिहासिक रूप से विभिन्न उपयोग मामलों की सेवा के लिए कई स्तर शामिल हैं। मूल लाइनअप में Gemini Ultra, Pro और Nano शामिल थे, और बाद के संस्करणों ने Flash और Flash Lite जोड़े। Gemini 3 के लिए, Google ने तुरंत मॉडल वेरिएंट का पूरा सेट खुलासा नहीं किया, लेकिन लॉन्च में Pro, Flash और Deep Think स्तर शामिल होने की उम्मीद थी। लॉन्च के अनुसार, पैरामीटर गणना और प्रशिक्षण डेटा आकार जैसे विस्तृत तकनीकी विनिर्देश पूरी तरह से जारी नहीं किए गए थे। Google ने कहा कि Gemini 3 को उसके टेंसर प्रोसेसिंग यूनिट्स पर प्रशिक्षित किया गया था, जो पहले के Gemini मॉडलों के लिए उपयोग की जाने वाली हार्डवेयर रणनीति को जारी रखता है।
मॉडल की बहुविध क्षमताएँ इसे पाठ, चित्र, ऑडियो और वीडियो को संसाधित और उत्पन्न करने की अनुमति देती हैं। यह मशीन लर्निंग क्षेत्र में एक प्रमुख अंतर है, जहाँ कई मॉडल एकल विधा तक सीमित हैं। Gemini 3 की इन विधाओं को एक ही प्रणाली में संयोजित करने की क्षमता को अधिक सामान्य कृत्रिम बुद्धिमत्ता प्रणालियों की ओर एक कदम के रूप में प्रस्तुत किया गया था जो दुनिया के साथ समृद्ध तरीकों से बातचीत कर सकते हैं।
उद्योग और प्रतिस्पर्धी संदर्भ
Gemini 3 लॉन्च बड़े भाषा मॉडल बाजार में तीव्र प्रतिस्पर्धा के समय आया। OpenAI ने GPT-4 जारी किया था और अपनी ChatGPT सेवा को अद्यतन करना जारी रखा था, जबकि एंथ्रोपिक ने Claude श्रृंखला के मॉडल विकसित किए थे। Google ने Gemini 3 को इन प्रणालियों के प्रत्यक्ष प्रतिस्पर्धी के रूप में स्थान दिया, पहले के Gemini संस्करणों के बेंचमार्क प्रदर्शन पर निर्माण करते हुए। Gemini Ultra ने पहले ही कई उद्योग बेंचमार्क पर GPT-4 और Claude 2 से बेहतर प्रदर्शन किया था, और Google ने दावा किया कि Gemini 3 ने उस बढ़त को बढ़ाया, हालांकि लॉन्च के अनुसार स्वतंत्र सत्यापन अभी उपलब्ध नहीं था।
यह कार्यक्रम AI बुनियादी ढांचे में बढ़ते निवेश की पृष्ठभूमि के खिलाफ भी हुआ। प्रमुख क्लाउड प्रदाता, जिनमें Google Cloud, अमेज़न वेब सर्विसेज और माइक्रोसॉफ्ट Azure शामिल हैं, प्रमुख मॉडलों तक पहुँच प्रदान करने के लिए प्रतिस्पर्धा कर रहे थे। Vertex AI और AI Studio के माध्यम से Gemini 3 को उपलब्ध कराने का Google का निर्णय डेवलपर्स और उद्यम ग्राहकों को आकर्षित करने की एक व्यापक रणनीति का हिस्सा था। कंपनी को ओपन-सोर्स मॉडल रिलीज़ से भी दबाव का सामना करना पड़ा, जिसके कारण फरवरी 2024 में Gemma की शुरुआत हुई। Gemini 3 के लॉन्च को AI उद्योग में Google की अग्रणी स्थिति बनाए रखने के प्रयास के रूप में देखा गया, साथ ही सुरक्षा, कॉपीराइट और बड़े पैमाने पर मॉडल प्रशिक्षण के पर्यावरणीय प्रभाव के बारे में चिंताओं को संबोधित करते हुए।
उपलब्धता और पारिस्थितिकी तंत्र
Gemini 3 लॉन्च के समय कई चैनलों के माध्यम से उपलब्ध था। डेवलपर्स Google Cloud के Vertex AI और AI Studio के माध्यम से मॉडल तक पहुँच सकते थे, उसी मार्ग का अनुसरण करते हुए जो दिसंबर 2023 में Gemini Pro के लिए उपयोग किया गया था। Google ने यह भी कहा कि Gemini 3 को Gemini चैटबॉट और अन्य Google उत्पादों, जिसमें खोज, Chrome और Workspace शामिल हैं, में एकीकृत किया जाएगा। यह Gemini 1.0 के लिए घोषित एकीकरण योजनाओं को दर्शाता है, जिसमें खोज, विज्ञापन, Chrome, Duet AI और AlphaCode 2 शामिल थे।
उपभोक्ता पक्ष पर, Google ने पहले Gemini Nano और Pro को Galaxy S24 में लाने के लिए सैमसंग के साथ साझेदारी की थी, और Gemini 3 के भविष्य के Android उपकरणों में दिखाई देने की उम्मीद थी। जून 2025 में पेश किया गया ओपन-सोर्स Gemini CLI, भी Gemini 3 का समर्थन करने के लिए अद्यतन किया गया था, जो डेवलपर्स को कोडिंग और स्वचालन कार्यों के लिए एक टर्मिनल-आधारित इंटरफ़ेस देता है। Google की व्यापक पारिस्थितिकी तंत्र रणनीति में Gemini को मालिकाना सेवाओं और खुले उपकरणों दोनों के माध्यम से उपलब्ध कराना शामिल था, एक संतुलन जिसे कंपनी Gemma की रिलीज़ के बाद से परिष्कृत कर रही थी।
स्वागत और महत्व
Gemini 3 न्यूज़ लॉन्च को AI उद्योग में एक प्रमुख घटना के रूप में व्यापक रूप से रिपोर्ट किया गया। विश्लेषकों ने नोट किया कि यह रिलीज़ मूल Gemini 1.0 घोषणा के दो साल से भी कम समय बाद आई, जो क्षेत्र में विकास की तीव्र गति को दर्शाती है। इस कार्यक्रम ने Google DeepMind के बहुविध AI में निरंतर निवेश और OpenAI और एंथ्रोपिक के साथ प्रतिस्पर्धा करने के उसके प्रयासों पर प्रकाश डाला। लॉन्च के अनुसार, Gemini 3 के लिए स्वतंत्र बेंचमार्क परिणाम अभी प्रकाशित नहीं हुए थे, और मॉडल का दीर्घकालिक प्रभाव देखा जाना बाकी था। फिर भी, रिलीज़ ने कृत्रिम बुद्धिमत्ता अनुसंधान में अग्रणी शोध संगठनों में से एक के रूप में Google DeepMind की स्थिति को मजबूत किया, एक मॉडल परिवार के साथ जो प्रारंभिक LaMDA और PaLM 2 प्रणालियों से विकसित होकर जनरेटिव AI के लिए एक व्यापक मंच बन गया था।