नैनो बनाना एक अनौपचारिक, समुदाय-निर्धारित नाम है जो Google के जेमिनी परिवार के भीतर विकसित एक छवि निर्माण और संपादन मॉडल के लिए है, जो Google द्वारा सार्वजनिक रूप से अपनी पहचान की पुष्टि करने से पहले इस उपनाम से व्यापक रूप से जाना जाने लगा। मॉडल को बाद में औपचारिक रूप से जारी किया गया और Gemini 2.5 Flash Image के रूप में विपणन किया गया।
नाम की उत्पत्ति
मॉडल पहली बार LMArena पर एक रहस्यमय प्रविष्टि के रूप में गुमनाम रूप से दिखाई दिया, जो समुदाय-आधारित मॉडल तुलना मंच है, जहां नई प्रणालियों का परीक्षण कभी-कभी आधिकारिक घोषणा से पहले कोडनेम के तहत किया जाता है। मंच और सोशल मीडिया पर उपयोगकर्ताओं ने इसके सूचीबद्ध कोडनेम के आधार पर अज्ञात मॉडल को "नैनो-बनाना" के रूप में संदर्भित करना शुरू कर दिया, और यह उपनाम उन अटकलों के हफ्तों के दौरान बना रहा कि इसके पीछे कौन सी प्रयोगशाला और कौन सा मॉडल संस्करण था। जब Google डीपमाइंड ने 2025 में मॉडल की पहचान की पुष्टि की, तो उसने अपने कुछ विपणन और डेवलपर संचारों में उपनाम को हटाने के बजाय अपनाया, जो एक प्रमुख प्रयोगशाला द्वारा गंभीर उत्पाद रिलीज़ के लिए समुदाय-निर्मित ब्रांडिंग को अपनाने का एक असामान्य उदाहरण है।
क्षमताएँ
नैनो बनाना ने पहले के टेक्स्ट-टू-इमेज और छवि-संपादन उपकरणों से खुद को अलग किया, मौजूदा तस्वीरों पर संपादन के लिए मजबूत निर्देश-पालन के माध्यम से, जिसमें कई संपादित आउटपुट में लोगों और वस्तुओं की सुसंगत पहचान संरक्षण शामिल था, एक क्षमता जिसे कई पिछले डिफ्यूजन-आधारित संपादकों ने खराब तरीके से संभाला था। यह प्राकृतिक भाषा में वर्णित लक्षित संपादन कर सकता था, जैसे किसी वस्तु की सामग्री बदलना, प्रकाश बदलना, या तत्वों को जोड़ना, जबकि बाकी छवि को दृश्य रूप से सुसंगत रखना, और यह बहु-छवि इनपुट का समर्थन करता था, जिससे कई स्रोत तस्वीरों को एक ही उत्पन्न परिणाम में मिश्रित किया जा सकता था।
मूर्ति प्रवृत्ति
मॉडल 2025 में एक विशिष्ट उपयोग-मामले के माध्यम से मुख्यधारा की वायरल घटना बन गया: किसी व्यक्ति की तस्वीर को एक संग्रहणीय एक्शन-फिगर या खिलौना मूर्ति जैसी छवि में बदलना, जिसमें ब्लिस्टर पैकेजिंग, सहायक उपकरण और एक प्रदर्शन बॉक्स शामिल हो, जो फोटोरियलिस्टिक सामग्री और प्रकाश के साथ प्रस्तुत किया गया हो। यह प्रवृत्ति सोशल प्लेटफार्मों पर तेजी से फैल गई, लाखों उपयोगकर्ताओं ने मूर्ति-शैली के सेल्फ-पोर्ट्रेट उत्पन्न और साझा किए, जिसकी तुलना पहले की वायरल एआई छवि प्रवृत्तियों जैसे OpenAI के छवि उपकरणों के साथ उत्पन्न स्टूडियो घिबली-शैली के चित्रों से की गई। प्रवृत्ति के पैमाने ने समकालीन छवि निर्माण मॉडल की बेहतर फोटोरियलिज्म और पहचान-स्थिरता दोनों को चित्रित किया, साथ ही सुलभ, साझा करने योग्य एआई-जनित सामग्री के लिए निरंतर भूख को भी, एक गतिशीलता जिसे प्लेटफ़ॉर्म वायरलिटी और सोशल फीड्स में बाढ़ लाने वाली एआई-जनित सामग्री के बारे में व्यापक चिंताओं के संदर्भ में भी चर्चा की गई।
स्वागत और महत्व
नैनो बनाना को एआई छवि संपादन में स्थिरता और नियंत्रणीयता के लिए एक मील का पत्थर के रूप में व्यापक रूप से कवर किया गया, एक ऐसा क्षेत्र जहां पहले के मॉडल, जिनमें मिडजर्नी और फ्लक्स के संस्करण शामिल हैं, शुद्ध टेक्स्ट-टू-इमेज निर्माण में अपनी ताकत के सापेक्ष तुलनात्मक रूप से कमजोर थे। Google के व्यापक Gemini ऐप और API में इसका एकीकरण उच्च-निष्ठा, सुसंगत छवि संपादन को विशेषज्ञ उपकरण बने रहने के बजाय व्यापक उपभोक्ता दर्शकों के लिए सुलभ बनाता है, और इसकी रिलीज़ ने अन्य छवि-निर्माण प्रयोगशालाओं पर इसकी संपादन सटीकता से मेल खाने के लिए प्रतिस्पर्धी दबाव बढ़ा दिया। इस प्रकरण ने इस अवधि के दौरान एआई रिलीज़ में एक आवर्ती पैटर्न को भी उजागर किया, जिसमें बिना ब्रांड वाले या गुमनाम रूप से परीक्षण किए गए मॉडल अपने डेवलपर की आधिकारिक पुष्टि से पहले मूल्यांकन प्लेटफार्मों पर महत्वपूर्ण सार्वजनिक रुचि और अटकलें उत्पन्न करते हैं।