अंग्रेज़ी से अनुवादित

Google Gemini, जिसे पहले Bard के नाम से जाना जाता था, Google द्वारा निर्मित एक जनरेटिव AI चैटबॉट और वर्चुअल असिस्टेंट है, जो बड़े भाषा मॉडल (large language models) द्वारा संचालित है। यह Google सेवाओं में एकीकृत है और OpenAI के GPT मॉडलों के साथ प्रतिस्पर्धा करता है।

Google Gemini, जिसे पहले Bard के नाम से जाना जाता था, Google द्वारा विकसित एक जनरेटिव आर्टिफिशियल इंटेलिजेंस चैटबॉट और वर्चुअल असिस्टेंट है। यह उसी नाम के बड़े भाषा मॉडल (LLM) के परिवार द्वारा संचालित है, जो पहले LaMDA और PaLM 2 पर आधारित था। Gemini आर्किटेक्चर को कई डेटा प्रकारों पर मूल रूप से प्रशिक्षित किया जाता है, जिससे मॉडल एक साथ टेक्स्ट, कंप्यूटर कोड, चित्र, ऑडियो और वीडियो को संसाधित और उत्पन्न कर सकते हैं। Google इस तकनीक को अलग-अलग क्षमताओं में वितरित करता है, जिसमें कुशल ऑन-डिवाइस संस्करण ("Nano") और लागत प्रभावी, उच्च-थ्रूपुट वेरिएंट ("Flash") से लेकर जटिल तर्क के लिए डिज़ाइन किए गए उच्च-कंप्यूट मॉडल ("Pro" और "Ultra") शामिल हैं। 1.5 और 3 मॉडल पीढ़ियों ने विस्तारित संदर्भ विंडो पेश कीं, जिससे एक ही प्रॉम्प्ट में संपूर्ण कोडबेस, लंबे-फॉर्म वीडियो, या व्यापक दस्तावेज़ अभिलेखागार जैसे बड़े डेटासेट का विश्लेषण संभव हो गया।

Gemini की घोषणा पहली बार 6 दिसंबर, 2023 को की गई थी, और इसने एआई सेवाओं के लिए मौजूदा Google ब्रांडिंग को बदल दिया। फरवरी 2024 में, Bard चैटबॉट का नाम बदलकर Gemini कर दिया गया, और Google Cloud और Workspace के लिए "Duet AI" ब्रांडिंग को Gemini पहचानकर्ता के पक्ष में हटा दिया गया। मॉडल Gemini मोबाइल ऐप के माध्यम से Google पारिस्थितिकी तंत्र में एकीकृत होते हैं, जो Android उपकरणों पर एक ओवरले असिस्टेंट के रूप में कार्य करता है, और तीसरे पक्ष के डेवलपर्स के लिए Vertex AI प्लेटफ़ॉर्म के माध्यम से भी।

इतिहास

पृष्ठभूमि

नवंबर 2022 में, OpenAI ने ChatGPT लॉन्च किया, जो GPT-3 परिवार के बड़े भाषा मॉडल पर आधारित एक चैटबॉट है। ChatGPT ने दुनिया भर में ध्यान आकर्षित किया, एक वायरल इंटरनेट सनसनी बन गया। Google Search के लिए ChatGPT के संभावित खतरे से चिंतित होकर, Google के अधिकारियों ने "कोड रेड" अलर्ट जारी किया, कंपनी के आर्टिफिशियल इंटेलिजेंस प्रयासों में सहायता के लिए कई टीमों को फिर से नियुक्त किया। Google और मूल कंपनी Alphabet के CEO सुंदर पिचाई द्वारा यह अलर्ट जारी करने की व्यापक रूप से सूचना दी गई थी, लेकिन पिचाई ने बाद में द न्यूयॉर्क टाइम्स को इससे इनकार कर दिया। एक दुर्लभ कदम में, Google के सह-संस्थापक लैरी पेज और सर्गेई ब्रिन, जिन्होंने 2019 में Alphabet के सह-CEO के रूप में अपनी भूमिकाओं से इस्तीफा दे दिया था, ने ChatGPT के प्रति Google की प्रतिक्रिया पर चर्चा करने के लिए कंपनी के अधिकारियों के साथ आपातकालीन बैठकों में भाग लिया। ब्रिन ने वर्षों में पहली बार फरवरी 2023 में Google के कोड तक पहुंच का अनुरोध किया।

Google ने 2021 में पहले LaMDA, एक प्रोटोटाइप LLM का अनावरण किया था, लेकिन इसे जनता के लिए जारी नहीं किया गया था। एक ऑल-हैंड्स मीटिंग में कर्मचारियों द्वारा पूछे गए सवाल पर कि क्या LaMDA ChatGPT के साथ प्रतिस्पर्धा करने का एक चूक गया अवसर था, पिचाई और Google AI प्रमुख जेफ डीन ने कहा कि हालांकि कंपनी के चैटबॉट में ChatGPT के समान क्षमताएं थीं, लेकिन एक LLM पेश करने के जोखिम थे जो गलत जानकारी फैला सकते हैं, इसलिए उन्होंने प्रतीक्षा करने का फैसला किया। जनवरी 2023 में, Google Brain की सहयोगी कंपनी DeepMind के CEO डेमिस हसाबिस ने ChatGPT प्रतिद्वंद्वी की योजनाओं का संकेत दिया, और Google कर्मचारियों को ChatGPT प्रतियोगी पर प्रगति में तेजी लाने का निर्देश दिया गया, "Apprentice Bard" और अन्य चैटबॉट का गहन परीक्षण किया। पिचाई ने फरवरी में Google की तिमाही आय निवेशक कॉल के दौरान निवेशकों को आश्वासन दिया कि कंपनी के पास LaMDA की उपलब्धता और अनुप्रयोगों का विस्तार करने की योजना है।

बार्ड

#### घोषणा

6 फरवरी, 2023 को, Google ने Bard की घोषणा की, जो LaMDA द्वारा संचालित एक जनरेटिव आर्टिफिशियल इंटेलिजेंस चैटबॉट है। Bard को पहले 10,000 "विश्वसनीय परीक्षकों" के एक चुनिंदा समूह के लिए जारी किया गया था, जिसके बाद महीने के अंत में व्यापक रिलीज़ निर्धारित की गई थी। परियोजना की देखरेख उत्पाद प्रमुख जैक क्रावज़िक ने की थी, जिन्होंने उत्पाद को खोज इंजन के बजाय एक "सहयोगी एआई सेवा" के रूप में वर्णित किया, जबकि पिचाई ने विस्तार से बताया कि Bard को Google Search में कैसे एकीकृत किया जाएगा। रॉयटर्स ने गणना की कि Google Search में ChatGPT जैसी सुविधाओं को जोड़ने से कंपनी को 2024 तक $6 बिलियन का अतिरिक्त खर्च हो सकता है, जबकि अनुसंधान और परामर्श फर्म SemiAnalysis ने गणना की कि इससे Google को $3 बिलियन का खर्च आएगा। तकनीक को कोडनेम "Atlas" के तहत विकसित किया गया था, जिसमें "Bard" नाम एक कहानीकार के लिए सेल्टिक शब्द के संदर्भ में है और "नीचे एल्गोरिथ्म की रचनात्मक प्रकृति को प्रतिबिंबित करने" के लिए चुना गया था।

कई मीडिया आउटलेट्स और वित्तीय विश्लेषकों ने Google को बिंग एआई (बाद में माइक्रोसॉफ्ट कोपायलट के रूप में पुनः ब्रांडेड) के रूप में अपने बिंग सर्च इंजन में ChatGPT को एकीकृत करने के लिए OpenAI के साथ अपनी साझेदारी का अनावरण करने वाले प्रतिद्वंद्वी माइक्रोसॉफ्ट के नियोजित 7 फरवरी के कार्यक्रम से पहले बार्ड की घोषणा में "जल्दबाजी" करने और "पकड़ने" से बचने के रूप में वर्णित किया। माइक्रोसॉफ्ट के CEO सत्य नडेला ने द वर्ज को बताया: "मैं चाहता हूं कि लोग जानें कि हमने उन्हें नचाया है।" द वर्ज के टॉम वॉरेन और ब्लूमबर्ग न्यूज के डेवी अल्बा ने कहा कि यह 2021 में समाप्त होने वाले छह साल के "संघर्ष विराम" के बाद "खोज के भविष्य" पर दो बिग टेक कंपनियों के बीच एक और टकराव की शुरुआत है; द गार्डियन के क्रिस स्टोकेल-वॉकर, रिकोड की सारा मॉरिसन, और निवेश फर्म वेडबश सिक्योरिटीज के विश्लेषक डैन आइव्स ने इसे दोनों के बीच एक एआई हथियारों की दौड़ करार दिया।

पेरिस में बार्ड को प्रदर्शित करने वाले एक "निराशाजनक" 8 फरवरी के लाइवस्ट्रीम के बाद, Google के शेयरों में आठ प्रतिशत की गिरावट आई, जो बाजार मूल्य में $100 बिलियन के नुकसान के बराबर है, और लाइवस्ट्रीम का यूट्यूब वीडियो निजी कर दिया गया था। कई दर्शकों ने डेमो के दौरान एक त्रुटि की ओर भी इशारा किया जिसमें बार्ड एक प्रश्न के उत्तर में जेम्स वेब स्पेस टेलीस्कोप के बारे में गलत जानकारी देता है। Google कर्मचारियों ने कंपनी के आंतरिक मंच मेमेजेन पर बार्ड की पिचाई की "जल्दबाजी" और "विफल" घोषणा की आलोचना की, जबकि फ्यूचरिज्म की मैगी हैरिसन ने रोलआउट को "अराजकता" कहा। पिचाई ने यह कहते हुए अपने कार्यों का बचाव किया कि Google "लंबे समय से एआई पर गहराई से काम कर रहा है", इस धारणा को खारिज कर दिया कि बार्ड का लॉन्च एक घुटने का झटका था।

पेरिस लाइवस्ट्रीम के एक सप्ताह बाद, पिचाई ने 80,000 कर्मचारियों को आंतरिक रूप से बार्ड के परीक्षण में दो से चार घंटे बिताने के लिए कहा, जबकि Google कार्यकारी प्रभाकर राघवन ने उन्हें बार्ड द्वारा की गई किसी भी त्रुटि को ठीक करने के लिए कहा। अगले हफ्तों में, Google कर्मचारियों ने आंतरिक संदेशों में बार्ड की आलोचना की, सुरक्षा और नैतिक चिंताओं का हवाला देते हुए और कंपनी के नेताओं से सेवा शुरू न करने का आग्रह किया। Google के अधिकारियों ने अपनी एआई नैतिकता टीम द्वारा किए गए नकारात्मक जोखिम मूल्यांकन रिपोर्ट को खारिज करते हुए उत्पाद लॉन्च किया। उस महीने के अंत में राजस्व वृद्धि धीमी होने के कारण पिचाई द्वारा अचानक 12,000 कर्मचारियों की छंटनी करने के बाद, शेष श्रमिकों ने छंटनी पर अपनी "राय" मांगने वाले बार्ड के साथ अपने विनोदी आदान-प्रदान के मीम्स और स्निपेट साझा किए।

तकनीकी वास्तुकला

Gemini मॉडल ट्रांसफार्मर आर्किटेक्चर पर बनाए गए हैं, जो अन्य बड़े भाषा मॉडल के समान है, लेकिन एक महत्वपूर्ण अंतर के साथ: वे कई डेटा प्रकारों पर मूल रूप से प्रशिक्षित होते हैं। यह मल्टीमॉडल प्रशिक्षण मॉडल को एक साथ टेक्स्ट, कोड, चित्र, ऑडियो और वीडियो को संसाधित और उत्पन्न करने की अनुमति देता है, उन पुराने मॉडलों के विपरीत जो प्रत्येक मोडैलिटी को अलग से संभालते थे। आर्किटेक्चर में लंबे अनुक्रमों को संभालने के लिए मल्टी-हेड अटेंशन और पोजिशनल एन्कोडिंग जैसी तकनीकें शामिल हैं। 1.5 और 3 पीढ़ियों ने संदर्भ विंडो का विस्तार किया, जिससे एक ही प्रॉम्प्ट में संपूर्ण कोडबेस, लंबे-फॉर्म वीडियो, या व्यापक दस्तावेज़ अभिलेखागार जैसे बड़े डेटासेट का विश्लेषण संभव हो गया। यह कुशल ध्यान तंत्र के माध्यम से प्राप्त किया जाता है जो कम्प्यूटेशनल ओवरहेड को कम करता है।

Google प्रदर्शन और दक्षता को संतुलित करने के लिए Gemini को कई रूपों में वितरित करता है। "Nano" संस्करण ऑन-डिवाइस उपयोग के लिए डिज़ाइन किया गया है, जो मोबाइल हार्डवेयर पर कुशलता से चलता है। "Flash" संस्करण उच्च-थ्रूपुट, लागत प्रभावी कार्यों के लिए अनुकूलित है। "Pro" संस्करण जटिल तर्क को संभालता है, जबकि "Ultra" संस्करण सबसे अधिक मांग वाले अनुप्रयोगों के लिए उच्चतम-कंप्यूट मॉडल है। ये विविधताएं Vertex AI के माध्यम से Google के गूगल क्लाउड प्लेटफ़ॉर्म में एकीकृत हैं, जिससे तीसरे पक्ष के डेवलपर्स एपीआई के माध्यम से मॉडल तक पहुंच सकते हैं।

एकीकरण और उपलब्धता

Gemini मोबाइल ऐप एंड्रॉइड उपकरणों पर एक ओवरले असिस्टेंट के रूप में कार्य करता है, कुछ क्षमताओं में पिछले Google Assistant की जगह लेता है। यह Gemini ब्रांडिंग के तहत Gmail, Docs और Sheets सहित Google Workspace में एकीकृत है। मॉडल गूगल क्लाउड के Vertex AI प्लेटफ़ॉर्म के माध्यम से भी उपलब्ध हैं, जो डेवलपर्स को एआई एप्लिकेशन बनाने और तैनात करने के लिए उपकरण प्रदान करता है। फरवरी 2024 में, बार्ड चैटबॉट का नाम बदलकर Gemini कर दिया गया, और Google Cloud और Workspace के लिए "Duet AI" ब्रांडिंग को Gemini पहचानकर्ता के पक्ष में हटा दिया गया। इस रीब्रांडिंग ने Google की एआई पेशकशों को एक ही नाम के तहत एकीकृत कर दिया।

स्वागत और विवाद

Gemini की रिलीज़ ने तकनीकी प्रशंसा और सार्वजनिक विवाद दोनों उत्पन्न किए हैं। टिप्पणीकारों ने कोडिंग और पुनर्प्राप्ति कार्यों में मॉडल के बेंचमार्क को OpenAI के GPT-4 और GPT-5 के साथ प्रतिस्पर्धी बताया है। हालांकि, उत्पाद लॉन्च को इसके आउटपुट की विश्वसनीयता के बारे में आलोचना का सामना करना पड़ा। 2024 की शुरुआत में, Google ने लोगों की छवियों को उत्पन्न करने की मॉडल की क्षमता को निलंबित कर दिया, जब उपयोगकर्ताओं ने मानव विषयों के चित्रण में ऐतिहासिक अशुद्धियों और पूर्वाग्रह की सूचना दी। बाद के अपडेट, जिसमें 2025 के दौरान जारी Gemini 1.5 और 3 श्रृंखला शामिल हैं, ने मतिभ्रम को कम करने, विलंबता में सुधार करने और स्वायत्त अनुसंधान और सॉफ्टवेयर विकास के लिए एजेंटिक क्षमताओं को बढ़ाने पर ध्यान केंद्रित किया। विवाद जनरेटिव एआई में पूर्वाग्रह और तथ्यात्मक सटीकता के बारे में चल रही चुनौतियों को उजागर करते हैं।

यह भी देखें

बाहरी लिंक

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:generative-ai·large-language-model·google·chatbot
इस पृष्ठ को अंतिम बार संपादित किया गया 14 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास