अंग्रेज़ी से अनुवादित

Luma AI, जिसे पहले Luma Labs के नाम से जाना जाता था, एक सैन फ्रांसिस्को स्थित जनरेटिव AI कंपनी है, जो अपने टेक्स्ट-टू-वीडियो मॉडल Dream Machine और 3D जनरेटर Genie के लिए जानी जाती है, और स्मार्टफोन ऐप्स प्रदान करती है जो मीडिया बनाने और संपादित करने के लिए हैं।

Luma AI, जिसे पहले Luma Labs के नाम से जाना जाता था, सैन फ्रांसिस्को, कैलिफोर्निया में स्थित एक जनरेटिव आर्टिफिशियल इंटेलिजेंस कंपनी है। यह कंपनी वीडियो और 3D सामग्री उत्पन्न करने और संपादित करने के लिए मॉडल और एप्लिकेशन विकसित करती है, मुख्य रूप से उपभोक्ता-उन्मुख स्मार्टफोन ऐप और वेब प्लेटफॉर्म के माध्यम से। Luma AI अपने टेक्स्ट-टू-वीडियो मॉडल Dream Machine के लिए सबसे अधिक जाना जाता है, जिसे जून 2024 में जारी किया गया था, और इसके पहले के 3D जनरेशन टूल Genie के लिए भी। कंपनी Generative AI के व्यापक क्षेत्र में काम करती है, और OpenAI के Sora और Google DeepMind के Veo जैसे अन्य टेक्स्ट-टू-वीडियो सिस्टम के साथ प्रतिस्पर्धा करती है।

Luma AI के उत्पाद Deep learning और Neural network आर्किटेक्चर में प्रगति पर आधारित हैं, जिसमें यथार्थवादी गति संश्लेषण और प्रॉम्प्ट-आधारित रचनात्मकता पर ध्यान केंद्रित किया गया है। कंपनी के उपकरण उपयोगकर्ताओं को टेक्स्ट विवरण या स्थिर छवियों से छोटे वीडियो क्लिप उत्पन्न करने के साथ-साथ तस्वीरों से 3D मॉडल बनाने की अनुमति देते हैं। अपने शुरुआती रिलीज़ के बाद से, Luma AI ने अपनी गति कैप्चर की गुणवत्ता और अपने प्रशिक्षण डेटा की पारदर्शिता से संबंधित कानूनी और नैतिक प्रश्नों के लिए ध्यान आकर्षित किया है।

इतिहास

Luma AI की स्थापना 2021 में Alex Yu और Amit Jain द्वारा की गई थी। Yu, जिन्होंने पहले न्यूरल रेंडरिंग अनुसंधान पर काम किया था, और Jain, जो एक पूर्व Apple इंजीनियर हैं, ने फोटोरियलिस्टिक 3D पुनर्निर्माण पर ध्यान केंद्रित करते हुए कंपनी की शुरुआत की। 2022 में, Luma AI ने Luma नामक एक स्मार्टफोन ऐप पेश किया, जो Machine learning का उपयोग करके फोन के कैमरे से वास्तविक दुनिया की वस्तुओं और स्थानों को स्कैन करता था, जिससे उच्च-गुणवत्ता वाले 3D मॉडल तैयार होते थे। कंपनी ने बाद में Genie के साथ जनरेटिव 3D निर्माण की ओर रुख किया, जो टेक्स्ट प्रॉम्प्ट या छवियों से 3D एसेट उत्पन्न कर सकता था।

जून 2024 में, Luma AI ने 12 जून को Dream Machine, एक टेक्स्ट-टू-वीडियो मॉडल, जनता के लिए जारी किया। यह रिलीज़ कंपनी के X अकाउंट पर उदाहरण वीडियो के साथ घोषित की गई थी। कुछ ही दिनों में, सोशल मीडिया पर उपयोगकर्ताओं ने Dream Machine वीडियो साझा किए जो Midjourney की छवियों को फिर से बनाते थे, Girl with a Pearl Earring जैसी प्रसिद्ध कलाकृतियों को एनिमेट करते थे, और Doge और distracted boyfriend जैसे इंटरनेट मीम्स के गति संस्करण तैयार करते थे। एक उपयोगकर्ता द्वारा बनाया गया काल्पनिक एनिमेटेड फिल्म Monster Camp का ट्रेलर, Luma AI द्वारा X पर दोबारा पोस्ट किया गया, जिससे उपयोगकर्ताओं की आलोचना हुई जिन्होंने कहा कि यह Monsters, Inc. फ्रैंचाइज़ की दृश्य शैली की नकल करता है और इसमें Mike Wazowski जैसा दिखने वाला एक चरित्र शामिल है। Ellenor Argyropoulos द्वारा निर्देशित एक और वीडियो, जिसमें प्राचीन मिस्र में सेट एक Pixar-शैली की एनीमेशन दिखाई गई थी, वायरल हो गई।

2024 के अंत और 2025 की शुरुआत तक, Luma AI ने अपनी उत्पाद लाइन का विस्तार किया, Dream Machine के अद्यतन संस्करण जारी किए और जनवरी 2025 में Ray2 वीडियो जनरेशन मॉडल जोड़ा। कंपनी ने अन्य AI फर्मों के साथ भी साझेदारी की और महत्वपूर्ण धन प्राप्त किया, जिससे इसका मूल्यांकन सैकड़ों मिलियन डॉलर तक पहुंच गया, हालांकि विशिष्ट आंकड़ों की सार्वजनिक रूप से पुष्टि नहीं की गई है।

Dream Machine

Dream Machine Luma AI द्वारा विकसित एक टेक्स्ट-टू-वीडियो मॉडल है। यह उपयोगकर्ता द्वारा प्रदान किए गए प्रॉम्प्ट या स्थिर छवियों के आधार पर छोटे वीडियो क्लिप उत्पन्न करता है। मॉडल को ट्रांसफॉर्मर-आधारित आर्किटेक्चर का उपयोग करके बनाया गया था, जो Large language model सिस्टम में उपयोग किए जाने वाले समान है, लेकिन दृश्य अस्थायी जनरेशन के लिए अनुकूलित किया गया है। जून 2024 तक, Dream Machine द्वारा उत्पन्न वीडियो पांच सेकंड लंबे थे और उनका रिज़ॉल्यूशन 1360 गुणा 752 पिक्सल था। उपयोगकर्ता Google खाते से साइन अप कर सकते थे और जनरेशन शुरू करने के लिए एक प्रॉम्प्ट टाइप कर सकते थे या एक स्थिर छवि अपलोड कर सकते थे।

सिस्टम वीडियो उत्पन्न करने से पहले अपने स्वयं के बड़े भाषा मॉडल के आधार पर उपयोगकर्ता के प्रॉम्प्ट को आंतरिक रूप से संशोधित करता है। उपयोगकर्ता मुफ्त में सीमित संख्या में वीडियो बना सकते थे - प्रति दिन दस वीडियो, कुल तीस मुफ्त वीडियो - और उनके पास सशुल्क सदस्यता योजनाओं का विकल्प था। Standard, Pro, और Premier योजनाएं क्रमशः 120, 400, और 2,000 वीडियो की अनुमति देती थीं, जैसा कि कंपनी की वेबसाइट पर वर्णित है। Luma AI ने रिलीज़ के तुरंत बाद वीडियो एक्सटेंशन, एक डिस्कवरी पेज, और इन-वीडियो संपादन जैसी सुविधाएं जोड़ने की योजना बताई। वेबसाइट ने सीमाओं को भी स्वीकार किया, यह देखते हुए कि Dream Machine को टेक्स्ट और कुछ प्रकार की गति को चित्रित करने में कठिनाई हो सकती है।

क्षमताएं और प्रौद्योगिकी

Dream Machine सुसंगत गति अनुक्रम उत्पन्न करने के लिए वीडियो डेटा पर प्रशिक्षित एक बड़े पैमाने के ट्रांसफॉर्मर मॉडल का लाभ उठाता है। पहले के डिफ्यूजन-आधारित वीडियो मॉडल के विपरीत, Dream Machine एक बहु-चरणीय पाइपलाइन का उपयोग करता है जो पहले अव्यक्त फ्रेम की भविष्यवाणी करता है और फिर उन्हें अंतिम रिज़ॉल्यूशन तक बढ़ाता है। मॉडल प्राकृतिक भाषा प्रॉम्प्ट और संदर्भ छवियों दोनों को स्वीकार कर सकता है, जिससे शैली स्थानांतरण और वस्तु हेरफेर की अनुमति मिलती है। उदाहरण के लिए, उपयोगकर्ता किसी व्यक्ति की स्थिर छवि अपलोड कर सकते थे और मॉडल से उन्हें चलने के लिए कह सकते थे, या एक चित्रित दृश्य प्रदान कर सकते थे और कैमरा गति का अनुरोध कर सकते थे।

Luma AI ने Dream Machine के लिए एक डेवलपर-अनुकूल एप्लिकेशन प्रोग्रामिंग इंटरफेस (API) भी जारी किया है, जिसमें लॉन्च के तुरंत बाद वीडियो एक्सटेंशन, एक डिस्कवरी सुविधा, और इन-वीडियो संपादन उपकरण जोड़ने की योजना घोषित की गई थी। ये अद्यतन आकस्मिक उपयोग से परे पेशेवर और उद्यम अनुप्रयोगों में जाने के इरादे का सुझाव देते हैं, जिसमें विज्ञापन, फिल्म प्री-विज़ुअलाइज़ेशन, और कॉन्सेप्ट आर्ट शामिल हैं। अंतर्निहित तकनीक Transformer (architecture) आर्किटेक्चर और संभवतः डिफ्यूजन-आधारित विधियों में प्रगति पर निर्भर करती है, हालांकि विशिष्ट आर्किटेक्चरल विवरण पूरी तरह से प्रकट नहीं किए गए हैं।

क्षमताएं और विशेषताएं

Dream Machine टेक्स्ट प्रॉम्प्ट या स्थिर छवियों को इनपुट के रूप में स्वीकार करता है, उन्हें यथार्थवादी गति के साथ छोटे वीडियो क्लिप में परिवर्तित करता है। मॉडल की ताकत सुसंगत गति को पकड़ने की क्षमता में निहित है, जिसमें चरित्र इशारे, कैमरा पैनिंग, और वस्तु इंटरैक्शन शामिल हैं। Luma AI ने Genie, एक 3D जनरेशन मॉडल भी विकसित किया है, जो गेम विकास और आभासी वातावरण की ओर उन्मुख टेक्स्ट या छवि प्रॉम्प्ट से 3D एसेट बनाता है।

कंपनी के स्मार्टफोन ऐप में 3D कैप्चर के लिए मूल Luma स्कैनिंग ऐप और बाद में वीडियो जनरेशन और संपादन के लिए ऐप शामिल हैं। उपयोगकर्ता एक वेब इंटरफेस के माध्यम से Dream Machine तक पहुंच सकते हैं, जिसमें एक डेवलपर API पेश करने की योजना है। Luma AI ने वीडियो एक्सटेंशन सुविधाओं और एक डिस्कवरी प्लेटफॉर्म के साथ भी प्रयोग किया है, जिससे उपयोगकर्ता समुदाय-जनित सामग्री ब्राउज़ और रीमिक्स कर सकते हैं।

अंतर्निहित तकनीक Transformer (architecture) मॉडल और डिफ्यूजन-आधारित वीडियो जनरेशन के संयोजन का उपयोग करती है, जो आधुनिक Generative AI सिस्टम के बीच एक सामान्य शैली है। Luma AI अपने प्रशिक्षण डेटा के पूर्ण विवरण का खुलासा नहीं करता है, और कंपनी के दस्तावेज़ीकरण में कहा गया है कि मॉडल को टेक्स्ट रेंडरिंग और जटिल गति अनुक्रमों में कठिनाई होती है।

स्वागत

Dream Machine को जून 2024 में रिलीज़ होने पर महत्वपूर्ण मीडिया ध्यान मिला। पत्रकारों और उपयोगकर्ताओं ने इसकी तुलना OpenAI के Sora से की, जो एक टेक्स्ट-टू-वीडियो मॉडल था जिसे पहले घोषित किया गया था लेकिन व्यापक रूप से जारी नहीं किया गया था, और Kling से, जो एक और प्रतिस्पर्धी वीडियो जनरेशन मॉडल है। The Verge और TechRadar के आलोचकों ने गति की यथार्थवादिता और उपयोग में आसानी की प्रशंसा की, लेकिन प्रशिक्षण डेटा की अपारदर्शिता के बारे में चिंता व्यक्त की। TechRadar के Mark Wilson ने कहा कि प्रशिक्षण डेटा के बारे में पारदर्शिता की कमी ने व्यक्तिगत रचनात्मक परियोजनाओं से परे मॉडल की उपयोगिता में विश्वास को सीमित कर दिया। Tom's Guide के Ryan Morrison ने Dream Machine को "सबसे अच्छे प्रॉम्प्ट-फॉलोइंग और गति समझ वाले AI वीडियो जनरेटरों में से एक" कहा, फिर भी इसे पेशेवर-ग्रेड आउटपुट से कम पाया। Mashable के लिए लिखते हुए, Chase DiBennedetto ने Dream Machine के साथ बनाए गए सोशल-मीडिया वीडियो को "भयानक रूप से" यथार्थवादी और अतियथार्थवादी या काल्पनिक सेटिंग्स की याद दिलाने वाला बताया।

कुछ सुरक्षा शोधकर्ताओं ने बताया कि Dream Machine का उपयोग यथार्थवादी डीपफेक बनाने के लिए किया जा सकता है, और कंपनी को कॉपीराइट और सामग्री उत्पत्ति के बारे में निरंतर जांच का सामना करना पड़ता है। इन चिंताओं के बावजूद, उपकरण को इसकी पहुंच और इसके मुफ्त स्तर की गुणवत्ता के लिए व्यापक रूप से सराहा गया।

तुलना और संदर्भ

Luma AI एक प्रतिस्पर्धी परिदृश्य में काम करता है जिसमें OpenAI का Sora, Google DeepMind का Veo, और अन्य Artificial intelligence वीडियो मॉडल शामिल हैं। कुछ प्रतिस्पर्धियों के विपरीत जिन्होंने पहुंच प्रतिबंधित की है, Luma AI ने Dream Machine को जनता के लिए जल्दी जारी किया, जिससे व्यापक प्रयोग की अनुमति मिली। उपभोक्ता-उन्मुख उपकरणों पर कंपनी का ध्यान इसे उद्यम-उन्मुख वीडियो जनरेशन प्लेटफॉर्म से अलग करता है। Luma AI क्लाउड प्रदाताओं के साथ भी सहयोग करता है और AWS Trainium या समान बुनियादी ढांचे का उपयोग करता है, हालांकि विशिष्ट हार्डवेयर साझेदारी सार्वजनिक रूप से विस्तृत नहीं की गई है।

3D स्थान में, Luma AI का Genie OpenAI और Nvidia जैसी कंपनियों के उपकरणों के साथ प्रतिस्पर्धा करता है, जो उन रचनाकारों को लक्षित करता है जिन्हें 3D एसेट के तेजी से प्रोटोटाइपिंग की आवश्यकता होती है। कंपनी खुद को Neural network रेंडरिंग में उन्नत अनुसंधान और व्यावहारिक रचनात्मक उपकरणों के बीच एक पुल के रूप में स्थापित करती है।

यह भी देखें

संदर्भ

जानकारी जून 2024 और जनवरी 2025 की सार्वजनिक रिपोर्टिंग और कंपनी घोषणाओं पर आधारित है। स्रोतों में The Verge, TechRadar, Tom's Guide, और Mashable से प्रेस कवरेज शामिल है।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:generative-ai·text-to-video·artificial-intelligence-companies·3d-modeling
इस पृष्ठ को अंतिम बार संपादित किया गया 8 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास