## डीपसीक-आर1 रिलीज़ और बाज़ार में हलचल (जनवरी 2025)

अंग्रेज़ी से अनुवादित

DeepSeek, एक चीनी AI कंपनी, ने जनवरी 2025 में अपना ओपन-वेट R1 मॉडल जारी किया, जिससे प्रौद्योगिकी क्षेत्र में शेयर बाजार की बड़ी गिरावट आई और उद्योग में AI लागत और दक्षता का पुनर्मूल्यांकन हुआ।

DeepSeek, हांग्जो स्थित एक चीनी कृत्रिम बुद्धिमत्ता कंपनी, ने जनवरी 2025 में अपना ओपन-वेट लार्ज लैंग्वेज मॉडल DeepSeek-R1 जारी किया। इस रिलीज़ ने वैश्विक प्रौद्योगिकी शेयरों में महत्वपूर्ण गिरावट को ट्रिगर किया, क्योंकि निवेशकों ने एआई विकास के प्रतिस्पर्धी परिदृश्य और विशाल पूंजीगत व्यय की आवश्यकता का पुनर्मूल्यांकन किया। इस घटना ने एआई प्रशिक्षण की दक्षता और ओपन-सोर्स मॉडल की व्यवहार्यता के बारे में व्यापक उद्योग चर्चा को प्रेरित किया।

DeepSeek, High-Flyer की एक सहायक कंपनी है, जो लियांग वेनफेंग द्वारा सह-स्थापित एक चीनी हेज फंड है। कंपनी ओपन-वेट मॉडल विकसित करने पर केंद्रित है, जिसका अर्थ है कि मॉडल पैरामीटर सार्वजनिक रूप से साझा किए जाते हैं, हालांकि प्रशिक्षण डेटा खुले तौर पर लाइसेंस प्राप्त नहीं है। जनवरी 2025 से, DeepSeek ने अपने मॉडल मुफ्त और ओपन-सोर्स सॉफ्टवेयर लाइसेंस के तहत जारी किए हैं। कंपनी का दृष्टिकोण तत्काल व्यावसायीकरण पर शोध पर जोर देता है, जिससे यह कुछ नियामक प्रावधानों को नेविगेट कर सके।

पृष्ठभूमि

DeepSeek की स्थापना जुलाई 2023 में हुई थी, जो अप्रैल 2023 में High-Flyer द्वारा एक कृत्रिम सामान्य बुद्धिमत्ता (AGI) अनुसंधान प्रयोगशाला की स्थापना के बाद हुई। प्रयोगशाला को दो महीने बाद एक स्वतंत्र कंपनी में बदल दिया गया, जिसमें High-Flyer इसका प्रमुख निवेशक था। लियांग वेनफेंग, जो 2008 के वित्तीय संकट के बाद से व्यापार कर रहे थे, ने जून 2015 में High-Flyer की सह-स्थापना की। हेज फंड ने अक्टूबर 2016 में स्टॉक ट्रेडिंग के लिए GPU-निर्भर डीप लर्निंग मॉडल का उपयोग शुरू किया, जो CPU-आधारित रैखिक मॉडल से संक्रमण था।

DeepSeek की उत्पत्ति High-Flyer के कंप्यूटिंग बुनियादी ढांचे में निहित है। 2019 में, कंपनी ने अपना पहला कंप्यूटिंग क्लस्टर, Fire-Flyer, 200 मिलियन युआन की लागत से बनाया। क्लस्टर में 1,100 GPU शामिल थे जो 200 Gbit/s पर जुड़े थे और 1.5 वर्षों के बाद सेवानिवृत्त कर दिए गए। 2021 तक, लियांग ने Nvidia GPU की बड़ी मात्रा हासिल करना शुरू कर दिया था, कथित तौर पर अमेरिकी चिप बिक्री प्रतिबंधों के प्रभावी होने से पहले 10,000 Nvidia A100 GPU प्राप्त किए।

Fire-Flyer 2

Fire-Flyer 2 का निर्माण 2021 में 1 बिलियन युआन के बजट के साथ शुरू हुआ। 2022 तक, इसकी क्षमता 96% से अधिक उपयोग की गई, जो कुल 56.74 मिलियन GPU घंटे थी। क्लस्टर में 625 नोड्स में 5,000 PCIe A100 GPU थे, प्रत्येक में 8 GPU थे। शुरुआत में, इसने DGX संस्करण के बजाय PCIe A100 का उपयोग किया क्योंकि प्रशिक्षित मॉडल एकल 40 GB GPU VRAM के भीतर फिट हो सकते थे, जिसके लिए केवल डेटा समानांतरता की आवश्यकता थी। बाद में, इसने बड़े मॉडलों को प्रशिक्षित करने के लिए NVLink और Nvidia Collective Communications Library (NCCL) को शामिल किया, जिसके लिए मॉडल समानांतरता की आवश्यकता थी।

Fire-Flyer 2 2025 तक संचालन में बना हुआ है। इसमें सह-डिज़ाइन किया गया सॉफ्टवेयर और हार्डवेयर आर्किटेक्चर है। हार्डवेयर 200 Gbps इंटरकनेक्ट के साथ Nvidia GPU का उपयोग करता है, जो उच्च बाइसेक्शन बैंडविड्थ के लिए दो फैट ट्री के साथ दो ज़ोन में विभाजित है। सॉफ्टवेयर में 3FS (Fire-Flyer File System) शामिल है, जो अतुल्यकालिक यादृच्छिक रीड के लिए डिज़ाइन की गई एक वितरित समानांतर फ़ाइल प्रणाली है, जो Direct I/O और RDMA Read का उपयोग करती है। इसमें hfreduce भी शामिल है, जो अतुल्यकालिक संचार के लिए एक लाइब्रेरी है।

DeepSeek-R1 रिलीज़

DeepSeek-R1 जनवरी 2025 में एक समान नाम के चैटबॉट के साथ लॉन्च किया गया था। मॉडल ने तर्क कार्यों में प्रतिस्पर्धी प्रदर्शन प्रदर्शित किया, कथित तौर पर OpenAI और अन्य पश्चिमी एआई कंपनियों के प्रमुख मॉडलों को टक्कर दी। इसकी ओपन-वेट प्रकृति ने डेवलपर्स और शोधकर्ताओं को मॉडल का निरीक्षण और संशोधन करने की अनुमति दी, जिससे तेजी से अपनाने और प्रयोग को बढ़ावा मिला।

रिलीज़ के तत्काल वित्तीय प्रभाव थे। घोषणा के दिन, प्रमुख प्रौद्योगिकी शेयरों में तेज गिरावट देखी गई। Nvidia, एक प्रमुख GPU निर्माता, ने अपने बाजार मूल्य में महत्वपूर्ण गिरावट देखी, क्योंकि निवेशकों ने सवाल उठाया कि क्या एआई चिप्स की उच्च मांग बनी रहेगी यदि मॉडल अधिक कुशलता से प्रशिक्षित किए जा सकते हैं। एआई आपूर्ति श्रृंखला की अन्य कंपनियों, जिनमें AMD, TSMC, और Broadcom शामिल हैं, को भी गिरावट का सामना करना पड़ा। बाजार का झटका DeepSeek की अपेक्षाकृत कम कम्प्यूटेशनल लागत के साथ उच्च प्रदर्शन प्राप्त करने की क्षमता के कारण था, जो इस धारणा को चुनौती देता था कि अत्याधुनिक एआई के लिए विशाल कंप्यूट निवेश आवश्यक थे।

बाजार प्रभाव और उद्योग पुनर्मूल्यांकन

DeepSeek-R1 रिलीज़ ने उद्योग भर में एआई रणनीतियों के व्यापक पुनर्मूल्यांकन को प्रेरित किया। विश्लेषकों और अधिकारियों ने OpenAI, Anthropic, और Google DeepMind जैसी कंपनियों द्वारा विशाल पूंजीगत व्यय की स्थिरता पर सवाल उठाना शुरू कर दिया। इस घटना ने मालिकाना पेशकशों को बाधित करने के लिए ओपन-सोर्स मॉडल की क्षमता को उजागर किया, क्योंकि DeepSeek का मॉडल स्वतंत्र रूप से उपलब्ध था, जिससे छोटे खिलाड़ियों के लिए प्रवेश की बाधाएं कम हो गईं।

प्रतिक्रिया में, कुछ कंपनियों ने अपने स्वयं के दक्षता प्रयासों को तेज किया, एल्गोरिदमिक सुधारों और हार्डवेयर अनुकूलन पर ध्यान केंद्रित किया। इस घटना ने उन्नत चिप्स पर अमेरिकी निर्यात नियंत्रणों के बारे में चर्चाओं को भी तेज कर दिया, क्योंकि DeepSeek की सफलता ने प्रदर्शित किया कि चीनी कंपनियां प्रतिबंधों के बावजूद प्रतिस्पर्धी परिणाम प्राप्त कर सकती हैं। बाजार का झटका निवेशकों के लिए एक जागृति कॉल के रूप में देखा गया, जिन्होंने पहले मान लिया था कि एआई नेतृत्व सबसे उन्नत हार्डवेयर तक पहुंच से जुड़ा था।

कंपनी संचालन और रणनीति

DeepSeek का मुख्यालय हांग्जो, झेजियांग में है, और यह High-Flyer के स्वामित्व और वित्त पोषण में है। लियांग वेनफेंग सीईओ के रूप में कार्य करते हैं, मई 2024 तक दो शेल निगमों के माध्यम से 84% हिस्सेदारी रखते हैं। कंपनी शोध पर केंद्रित है और कहा है कि इसकी व्यावसायीकरण की कोई तत्काल योजना नहीं है। यह रुख इसे उपभोक्ता-सामना करने वाली प्रौद्योगिकियों के उद्देश्य से चीन के एआई नियमों के कुछ प्रावधानों से बचने की अनुमति देता है।

DeepSeek का भर्ती दृष्टिकोण लंबे कार्य अनुभव पर कौशल पर जोर देता है, जिसके परिणामस्वरूप कई भर्तियां विश्वविद्यालय से ताजा होती हैं। कंपनी मॉडलों में शामिल विशेषज्ञता की सीमा का विस्तार करने के लिए कंप्यूटर विज्ञान पृष्ठभूमि के बिना व्यक्तियों को भी भर्ती करती है, जैसे कविता या उन्नत गणित। द न्यूयॉर्क टाइम्स के अनुसार, दर्जनों DeepSeek शोधकर्ताओं के पास पीपुल्स लिबरेशन आर्मी प्रयोगशालाओं और सेवन सन्स ऑफ नेशनल डिफेंस के साथ संबद्धताएं हैं या पहले थीं। 2025 से, इसका चैटबॉट पीपुल्स लिबरेशन आर्मी द्वारा गैर-लड़ाकू भूमिकाओं में अपनाया गया है, जिसमें अस्पताल, पीपुल्स आर्म्ड पुलिस और राष्ट्रीय लामबंदी संगठन शामिल हैं।

अमेरिकी चिप प्रतिबंधों के कारण, DeepSeek ने कम्प्यूटेशनल दक्षता को अधिकतम करने के लिए अपने एल्गोरिदम को परिष्कृत किया है, पुराने हार्डवेयर का लाभ उठाया और ऊर्जा खपत को कम किया। कंपनी ने अफ्रीका में भी विस्तार किया है, अधिक किफायती और कम बिजली-भूखे एआई समाधान पेश किए हैं। DeepSeek ने अफ्रीकी भाषा मॉडल को मजबूत किया है और स्टार्टअप उत्पन्न किए हैं, उदाहरण के लिए नैरोबी में। हुआवेई की भंडारण और क्लाउड कंप्यूटिंग सेवाओं के साथ, उप-सहारा अफ्रीका में तकनीकी परिदृश्य पर प्रभाव काफी है, जो पश्चिमी एआई प्लेटफार्मों की तुलना में स्थानीय डेटा संप्रभुता और लचीलापन प्रदान करता है।

क्लाउड होस्टिंग और अपनाना

अपने ओपन-वेट ढांचे के कारण, DeepSeek मॉडल क्लाउड प्रदाताओं द्वारा मूल रूप से होस्ट किए गए हैं, जिनमें Microsoft Azure और Perplexity AI शामिल हैं। इसने मॉडलों तक व्यापक पहुंच की सुविधा प्रदान की है, जिससे डेवलपर्स को उन्हें विभिन्न अनुप्रयोगों में एकीकृत करने की अनुमति मिली है। ओपन-वेट दृष्टिकोण ने तीसरे पक्ष के फाइन-ट्यूनिंग और अनुकूलन को भी सक्षम किया है, जो मॉडल के तेजी से अपनाने में योगदान देता है।

DeepSeek-R1 की रिलीज़ की तुलना प्रौद्योगिकी के ऐतिहासिक क्षणों से की गई है जहां विघटनकारी नवाचारों ने बाजारों को नया आकार दिया। इसने गैर-अमेरिकी कंपनियों के लिए एआई विकास में नेतृत्व करने की क्षमता को रेखांकित किया, अमेरिकी तकनीकी दिग्गजों के प्रभुत्व को चुनौती दी। इस घटना ने बंद-स्रोत एआई मॉडल की दीर्घकालिक व्यवहार्यता के बारे में भी सवाल उठाए, क्योंकि ओपन-सोर्स विकल्पों में सुधार जारी है।

भविष्य का दृष्टिकोण

बाजार के झटके के बाद, DeepSeek ने नए मॉडल विकसित और जारी करना जारी रखा। फरवरी 2026 में, Anthropic ने DeepSeek पर अपने स्वयं के LLM को प्रशिक्षित करने के लिए हजारों धोखाधड़ी खातों का उपयोग करके Claude के साथ लाखों बातचीत उत्पन्न करने का आरोप लगाया। अप्रैल 2026 में, निवेशकों ने DeepSeek के साथ $300 मिलियन के फंडिंग राउंड के लिए चर्चा शुरू की, जो कंपनी को कुल $10 बिलियन के मूल्यांकन पर लाएगा। DeepSeek ने मई 2026 की सीरीज A राउंड पूरा किया जिसमें US$7 बिलियन प्राप्त हुए, जो US$52 बिलियन के पोस्ट-मनी मूल्यांकन तक पहुंच गया। जुलाई 2026 में, ब्लूमबर्ग और फाइनेंशियल टाइम्स ने बताया कि कंपनी ने IPO की तैयारी शुरू कर दी थी, संभावित रूप से 2027 की शुरुआत में सूचीबद्ध हो सकती है। उसी महीने, इसने US$70 बिलियन के प्री-मनी मूल्यांकन को लक्षित करते हुए चर्चा शुरू की।

जनवरी 2025 में DeepSeek-R1 की रिलीज़ कृत्रिम बुद्धिमत्ता के इतिहास में एक ऐतिहासिक घटना बनी हुई है, जो नवाचार की तेज गति और प्रौद्योगिकी और वित्तीय बाजारों की परस्पर संबद्धता को दर्शाती है। इस घटना ने एआई दक्षता, ओपन-सोर्स विकास और एआई उन्नति के भू-राजनीतिक आयामों के बारे में वैश्विक बातचीत को प्रेरित किया।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:artificial-intelligence·financial-market-impact·open-source-ai·technology-event
इस पृष्ठ को अंतिम बार संपादित किया गया 13 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास