अंग्रेज़ी से अनुवादित

जेमिनी 1.5 001 गूगल डीपमाइंड के जेमिनी 1.5 परिवार के मल्टीमॉडल बड़े भाषा मॉडलों का प्रारंभिक स्थिर संस्करण है, जिसे 2024 में जारी किया गया था। इसमें प्रो, फ्लैश और फ्लैश-लाइट वेरिएंट शामिल हैं और यह दस लाख टोकन का संदर्भ विंडो समर्थन करता है।

जेमिनी 1.5 001, गूगल डीपमाइंड द्वारा विकसित बड़े भाषा मॉडल के जेमिनी 1.5 परिवार का पहला स्थिर रिलीज़ है। इस परिवार की घोषणा 15 फरवरी, 2024 को की गई थी, और 001 पदनाम इसके घटक मॉडलों के प्रारंभिक एपीआई संस्करणों को संदर्भित करता है। ये मॉडल जनरेटिव एआई के उदाहरण हैं, जो कृत्रिम बुद्धिमत्ता का एक उप-क्षेत्र है, जो पाठ, छवि, ऑडियो और वीडियो इनपुट स्वीकार करते हैं, और एक ट्रांसफॉर्मर आर्किटेक्चर पर मिश्रण-विशेषज्ञ डिज़ाइन के साथ निर्मित होते हैं।

जेमिनी 1.5 परिवार सार्वजनिक एलएलएम लीडरबोर्ड पर दिखाई दिया, जिसमें चैटबॉट एरिना और आर्टिफिशियल एनालिसिस शामिल हैं, जहां इसके वेरिएंट को अन्य मॉडलों के मुकाबले बेंचमार्क किया गया था। 001 संस्करण पहले थे जो डेवलपर्स को Google AI Studio और गूगल क्लाउड के Vertex AI प्लेटफ़ॉर्म के माध्यम से उपलब्ध कराए गए थे।

पृष्ठभूमि और रिलीज़

गूगल डीपमाइंड ने 15 फरवरी, 2024 को जेमिनी 1.5 की घोषणा की, जो पहले के जेमिनी 1.0 मॉडलों के उन्नयन के रूप में थी। प्रारंभिक रिलीज़ में जेमिनी 1.5 प्रो, एक प्रमुख मॉडल शामिल था, और बाद में जेमिनी 1.5 फ्लैश तक विस्तारित हुआ, जो उच्च-मात्रा वाले कार्यों के लिए अनुकूलित एक हल्का और तेज़ वेरिएंट है। मॉडल नामों में "001" प्रत्यय, जैसे कि gemini-1.5-pro-001 और gemini-1.5-flash-001, परिवार में प्रत्येक मॉडल के पहले स्थिर संस्करण की पहचान करता है। ये संस्करण डेवलपर्स और उद्यम ग्राहकों को Google AI Studio और Vertex AI के माध्यम से उपलब्ध कराए गए थे, जिनकी कीमत टोकन उपयोग पर आधारित थी।

आर्किटेक्चर

जेमिनी 1.5 मॉडल एक ट्रांसफॉर्मर-आधारित आर्किटेक्चर का उपयोग करते हैं, जिसमें मिश्रण-विशेषज्ञ तंत्रिका नेटवर्क डिज़ाइन होता है, जो प्रत्येक टोकन के लिए केवल मापदंडों का एक उपसमुच्चय सक्रिय करता है, जिससे दक्षता में सुधार होता है। वे एक मिलियन टोकन तक के संदर्भ विंडो का समर्थन करते हैं, जिससे लंबे दस्तावेज़ों, कोडबेस और वीडियो को संसाधित करना संभव होता है। मॉडलों को विभिन्न प्रकार के डेटा पर गहन शिक्षण तकनीकों का उपयोग करके प्रशिक्षित किया जाता है और वे पाठ, छवियों, ऑडियो और वीडियो में कार्य कर सकते हैं। आर्किटेक्चर में मल्टी-हेड अटेंशन और पोज़िशनल एन्कोडिंग शामिल है, जो आधुनिक बड़े भाषा मॉडलों में सामान्य घटक हैं।

वेरिएंट

001 रिलीज़ में सार्वजनिक बेंचमार्क स्नैपशॉट में तीन मुख्य वेरिएंट शामिल हैं:

  • जेमिनी 1.5 प्रो: प्रमुख मॉडल, जटिल तर्क और मल्टीमॉडल कार्यों के लिए डिज़ाइन किया गया।
  • जेमिनी 1.5 फ्लैश: बड़े पैमाने पर अनुप्रयोगों के लिए एक तेज़, अधिक लागत-कुशल मॉडल।
  • जेमिनी 1.5 फ्लैश-लाइट: बाद में पेश किया गया एक हल्का वेरिएंट, जो और भी कम विलंबता और लागत के लिए अनुकूलित है।

ये वेरिएंट समान अंतर्निहित आर्किटेक्चर साझा करते हैं लेकिन पैरामीटर गणना और अनुमान गति में भिन्न होते हैं। फ्लैश और फ्लैश-लाइट मॉडल उन उपयोग मामलों के लिए हैं जहां प्रतिक्रिया समय और लागत महत्वपूर्ण हैं।

अनुमान और तैनाती

डेवलपर्स Google AI Studio और Vertex AI के माध्यम से जेमिनी 1.5 001 मॉडल तक पहुंच सकते हैं। अनुमान के दौरान, वे आउटपुट यादृच्छिकता को नियंत्रित करने के लिए टॉप-के सैंपलिंग, टॉप-पी सैंपलिंग, और तापमान जैसे जनरेशन पैरामीटर समायोजित कर सकते हैं। मॉडल बीम खोज के माध्यम से निर्धारक डिकोडिंग का भी समर्थन करते हैं। एपीआई एंडपॉइंट Google क्लाउड इंफ्रास्ट्रक्चर पर होस्ट किए जाते हैं, और मॉडल कम-विलंबता अनुप्रयोगों के लिए स्ट्रीमिंग प्रतिक्रियाओं का समर्थन करते हैं।

प्रदर्शन और स्वागत

जेमिनी 1.5 001 मॉडल का मूल्यांकन चैटबॉट एरिना और आर्टिफिशियल एनालिसिस जैसे सार्वजनिक लीडरबोर्ड पर किया गया, जहां उन्होंने ओपनएआई, एंथ्रोपिक और अन्य संगठनों के मॉडलों के साथ प्रतिस्पर्धा की। मॉडलों ने तर्क, कोडिंग और मल्टीमॉडल बेंचमार्क में मजबूत प्रदर्शन दिखाया, जो मशीन लर्निंग में प्रगति को दर्शाता है। एक मिलियन-टोकन संदर्भ विंडो एक उल्लेखनीय विशेषता थी जिसने परिवार को कई समकालीनों से अलग किया।

विरासत

001 संस्करणों को बाद में अद्यतन संस्करणों द्वारा प्रतिस्थापित किया गया, जिसमें 002 श्रृंखला शामिल है, जिसने प्रदर्शन में सुधार किया और विलंबता कम की। जेमिनी 1.5 परिवार के बाद 2024 के अंत में जेमिनी 2.0 परिवार आया। अद्यतनों के बावजूद, 001 संस्करण उन डेवलपर्स के लिए उपलब्ध हैं जिन्हें स्थिर, दीर्घकालिक एपीआई एंडपॉइंट की आवश्यकता होती है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:large-language-model·google-deepmind·generative-ai·multimodal
इस पृष्ठ को अंतिम बार संपादित किया गया 13 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास