अंग्रेज़ी से अनुवादित

OpenAI Sora ओपनएआई द्वारा बनाया गया एक टेक्स्ट-टू-वीडियो मॉडल और सोशल मीडिया ऐप था, जिसे फरवरी 2024 में पूर्वावलोकन किया गया और दिसंबर 2024 में सार्वजनिक रूप से जारी किया गया। इसने प्रॉम्प्ट से छोटे वीडियो उत्पन्न किए, 2025 में दूसरी पीढ़ी के साथ, और 2026 में इसे बंद कर दिया गया।

OpenAI Sora एक टेक्स्ट-टू-वीडियो मॉडल और सोशल मीडिया ऐप था, जिसे OpenAI द्वारा विकसित किया गया था। कृत्रिम बुद्धिमत्ता का उपयोग करते हुए, यह मॉडल प्रॉम्प्ट के आधार पर छोटे वीडियो क्लिप उत्पन्न करता था, और मौजूदा छोटे वीडियो को भी विस्तारित कर सकता था। फरवरी 2024 में, OpenAI ने अपने आउटपुट के उदाहरण जनता के सामने प्रस्तुत किए, और Sora की पहली पीढ़ी दिसंबर 2024 में संयुक्त राज्य अमेरिका और कनाडा में ChatGPT Plus और ChatGPT Pro उपयोगकर्ताओं के लिए सार्वजनिक रूप से जारी की गई।

Sora की दूसरी पीढ़ी सितंबर 2025 के अंत में अमेरिका और कनाडा के चुनिंदा उपयोगकर्ताओं के लिए जारी की गई थी। Sora 2 ने ऐप में सोशल मीडिया सुविधाओं को एकीकृत किया। यह ऐप 26 अप्रैल 2026 को बंद कर दिया गया, और एप्लिकेशन प्रोग्रामिंग इंटरफेस (API) को 24 सितंबर 2026 को बंद करने की योजना है, जो समग्र रूप से Sora AI ब्रांड के अंत को चिह्नित करता है।

पृष्ठभूमि

Sora से पहले कई अन्य मॉडल टेक्स्ट से वीडियो उत्पन्न करने में सक्षम थे, जिनमें Meta का Make-A-Video, Runway का Gen-2, और Google Veo शामिल हैं। OpenAI, जो Sora के पीछे की कंपनी है, ने सितंबर 2023 में DALL-E 3 जारी किया था, जो इसके DALL-E टेक्स्ट-टू-इमेज मॉडलों में तीसरा था। Sora के विकास ने Generative AI और Deep learning में प्रगति पर आधारित था, विशेष रूप से Diffusion model तकनीकें जो छवि निर्माण में उपयोग होती हैं।

इतिहास

प्रारंभिक रिलीज़

Sora को विकसित करने वाली टीम ने इसका नाम जापानी शब्द 'आकाश' के नाम पर रखा, जो इसकी "असीम रचनात्मक क्षमता" को दर्शाता है। 15 फरवरी 2024 को, OpenAI ने पहली बार Sora का पूर्वावलोकन किया, जिसमें इसके द्वारा बनाए गए हाई-डेफिनिशन वीडियो के कई क्लिप जारी किए, जिनमें एक पहाड़ी सड़क पर चलती SUV, एक मोमबत्ती के पास "छोटा रोएँदार राक्षस" का एनीमेशन, बर्फ में टोक्यो से गुजरते दो लोग, और कैलिफोर्निया गोल्ड रश का नकली ऐतिहासिक फुटेज शामिल थे। OpenAI ने कहा कि यह एक मिनट तक लंबे वीडियो उत्पन्न करने में सक्षम था। कंपनी ने फिर एक तकनीकी रिपोर्ट साझा की जिसमें मॉडल को प्रशिक्षित करने के लिए उपयोग की जाने वाली विधियों पर प्रकाश डाला गया। OpenAI के CEO सैम ऑल्टमैन ने भी ट्विटर उपयोगकर्ताओं के प्रॉम्प्ट के जवाब में Sora-जनित वीडियो के साथ ट्वीट्स की एक श्रृंखला पोस्ट की।

9 दिसंबर 2024 तक, OpenAI ने धीरे-धीरे Sora को अमेरिका और कनाडा में ChatGPT Pro और ChatGPT Plus उपयोगकर्ताओं के लिए सार्वजनिक रूप से उपलब्ध कराया था। इससे पहले, कंपनी ने मॉडल पर प्रतिकूल परीक्षण करने के लिए गलत सूचना और पूर्वाग्रह के विशेषज्ञों सहित एक छोटे "रेड टीम" को सीमित पहुँच प्रदान की थी। कंपनी ने Sora को रचनात्मक क्षेत्रों में इसकी उपयोगिता पर प्रतिक्रिया प्राप्त करने के लिए वीडियो निर्माताओं और कलाकारों सहित रचनात्मक पेशेवरों के एक छोटे समूह के साथ भी साझा किया। फरवरी 2025 में, OpenAI ने उपयोगकर्ताओं को चैटबॉट से Sora वीडियो उत्पन्न करने की अनुमति देकर Sora को ChatGPT में एकीकृत करने की योजना की घोषणा की।

Sora 2

Sora 2 का अनावरण 30 सितंबर 2025 को किया गया, साथ ही एक iOS ऐप भी जारी किया गया, और दो महीने बाद एक Android ऐप भी। मॉडल द्वारा उत्पन्न सभी वीडियो में उपकरण के दुरुपयोग को रोकने के लिए एक दृश्यमान, गतिशील वॉटरमार्क होता है। Sora के पिछले संस्करण ने भी दर्शकों को वास्तविक और काल्पनिक सामग्री के बीच अंतर करने की अनुमति देने के लिए एक सुरक्षा वॉटरमार्क जोड़ा था। 7 अक्टूबर को, 404 Media ने रिपोर्ट किया कि Sora 2 वीडियो से वॉटरमार्क हटाने में सक्षम तृतीय-पक्ष प्रोग्राम प्रचलित हो गए थे। कई आउटलेट्स, जैसे Wired पत्रिका, ने नोट किया है कि Sora 2 ऐप शैली और सुविधाओं में TikTok के समान है।

बंद करना

24 मार्च 2026 को, OpenAI ने X पर घोषणा की कि वह मोबाइल ऐप और API दोनों में Sora को बंद कर रहा है। Sora ऐप 26 अप्रैल 2026 को बंद कर दिया गया, जबकि API को 24 सितंबर 2026 को बंद करने की योजना है। Disney के साथ OpenAI की साझेदारी, जिसमें एक लाइसेंसिंग समझौता शामिल था जो Sora के भीतर Disney पात्रों के उपयोग की अनुमति देता था, भी समाप्त हो रही थी। इस निर्णय ने ब्रिटिश प्रौद्योगिकी समाचार वेबसाइट The Register को OpenAI को "प्रोडक्ट-किलर" का लेबल देने के लिए प्रेरित किया, जो Google, Amazon Web Services, Broadcom, Cloud Software Group, और Netscape जैसी अन्य प्रौद्योगिकी कंपनियों के नक्शेकदम पर चल रहा था।

OpenAI ने अपनी बंद करने की सूचना में Sora को बंद करने का कोई विशिष्ट कारण नहीं बताया। इस विच्छेदन के संबंध में सामने आई रिपोर्टों ने इस निर्णय को कंप्यूटेशन की कमी, लागत दबाव, और मुख्य उद्यम उत्पादों की ओर व्यापक बदलाव से जोड़ा। अपने सार्वजनिक लॉन्च के बाद, Sora के दुनिया भर के उपयोगकर्ता लगभग दस लाख तक पहुँच गए, इससे पहले कि वे 500,000 से कम हो गए, जबकि वीडियो निर्माण की कम्प्यूटेशनल माँगों के कारण सेवा को संचालित करने के लिए प्रतिदिन लगभग $1 मिलियन की लागत आती थी।

कानूनी विनियमन

नवंबर 2024 में, Sora पहुँच के लिए एक API कुंजी परीक्षकों के एक समूह द्वारा Hugging Face पर लीक कर दी गई थी, जिन्होंने एक घोषणापत्र पोस्ट किया था जिसमें कहा गया था कि वे विरोध कर रहे हैं कि Sora का उपयोग "कला धोने" के लिए किया गया था। लीक सार्वजनिक होने के तीन घंटे बाद OpenAI ने सभी पहुँच रद्द कर दी और कहा कि "सैकड़ों कलाकारों" ने विकास को आकार दिया है और "भागीदारी स्वैच्छिक है"।

अपने लॉन्च के समय, Sora 2 ने डिफ़ॉल्ट रूप से कॉपीराइट सामग्री की अनुमति दी, जब तक कि कॉपीराइट धारकों ने प्लेटफ़ॉर्म पर अपनी सामग्री के निर्माण को प्रतिबंधित करने के लिए OpenAI से संपर्क नहीं किया। 3 अक्टूबर 2025 को, OpenAI ने कहा कि Sora 2 के भविष्य के अपडेट से कॉपीराइट धारकों को कॉपीराइट सामग्री के निर्माण पर "अधिक सूक्ष्म नियंत्रण" मिलेगा, लेकिन कंपनी ने यह नहीं बताया कि मौजूदा सामग्री हटाई जाएगी या नहीं। 6 अक्टूबर को, MPA के अध्यक्ष ने Sora 2 के साथ कॉपीराइट के प्रति OpenAI के दृष्टिकोण की आलोचना की।

11 दिसंबर 2025 को, वॉल्ट डिज़नी कंपनी ने घोषणा की कि वह तीन साल के लाइसेंसिंग समझौते में OpenAI में $1 बिलियन का निवेश करेगी, ताकि Disney+ पर उपयोगकर्ता Sora 2 पर इसके 200 से अधिक कॉपीराइट पात्रों को उत्पन्न कर सकें। इन पात्रों में Disney Animation, Pixar, Marvel Studios, और Star Wars के पात्र शामिल हैं।

क्षमताएँ और सीमाएँ

Sora के पीछे की तकनीक DALL-E 3 के पीछे की तकनीक का एक अनुकूलन है। OpenAI के अनुसार, Sora एक डिफ्यूज़न ट्रांसफॉर्मर है, जो एक डीनॉइज़िंग लेटेंट डिफ्यूज़न मॉडल है जिसमें एक ट्रांसफॉर्मर इसके डीनॉइज़र के रूप में कार्य करता है। एक वीडियो लेटेंट स्पेस में 3D "पैच" को डीनॉइज़ करके उत्पन्न किया जाता है, फिर एक वीडियो डीकंप्रेसर द्वारा मानक स्पेस में परिवर्तित किया जाता है। वीडियो के लिए विस्तृत कैप्शन बनाने के लिए एक वीडियो-टू-टेक्स्ट मॉडल का उपयोग करके प्रशिक्षण डेटा को बढ़ाने के लिए रीकैप्शनिंग को नियोजित किया जाता है।

OpenAI ने मॉडल को सार्वजनिक रूप से उपलब्ध वीडियो के साथ-साथ इस उद्देश्य के लिए लाइसेंस प्राप्त कॉपीराइट वीडियो का उपयोग करके प्रशिक्षित किया, लेकिन वीडियो की संख्या या सटीक स्रोत का खुलासा नहीं किया। अपनी रिलीज़ पर, OpenAI ने Sora की कुछ कमियों को स्वीकार किया, जिसमें जटिल भौतिकी का अनुकरण करने, कार्य-कारण को समझने, और बाएँ और दाएँ के बीच अंतर करने की सीमित क्षमता शामिल है। OpenAI ने यह भी कहा कि कंपनी की मौजूदा सुरक्षा प्रथाओं का पालन करते हुए, Sora यौन, हिंसक, घृणास्पद, या सेलिब्रिटी कल्पना के साथ-साथ मौजूदा बौद्धिक संपदा वाली सामग्री के लिए टेक्स्ट प्रॉम्प्ट को प्रतिबंधित करेगा।

Sora शोधकर्ता टिम ब्रूक्स ने कहा कि मॉडल ने अपने डेटासेट से अकेले 3D ग्राफिक्स बनाना सीखा, जबकि साथी Sora शोधकर्ता बिल पीबल्स ने कहा कि मॉडल की क्षमताएँ प्रशिक्षण डेटा और कंप्यूट को बढ़ाने से उभरीं, जो Machine learning और Neural network अनुसंधान में व्यापक रुझानों के अनुरूप हैं।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:text-to-video·openai·generative-ai·discontinued-software
इस पृष्ठ को अंतिम बार संपादित किया गया 9 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास