अंग्रेज़ी से अनुवादित

चीनी उद्यमी जिन्होंने क्वांटिटेटिव हेज फंड हाई-फ्लायर से AI प्रयोगशाला DeepSeek की स्थापना की, और 2025 की शुरुआत में वैश्विक AI बाजारों को हिला देने वाला DeepSeek-R1 रीजनिंग मॉडल जारी किया।

लियांग वेनफेंग एक चीनी उद्यमी और डीपसीक के संस्थापक हैं, जो एक एआई अनुसंधान प्रयोगशाला है, जिसने 2025 की शुरुआत में एक तर्क मॉडल जारी करने के बाद अंतरराष्ट्रीय ध्यान आकर्षित किया, जो रिपोर्ट की गई प्रशिक्षण लागत के एक छोटे से अंश पर अग्रणी पश्चिमी प्रणालियों से मेल खाता था।

लियांग ने चीन में इलेक्ट्रॉनिक और सूचना इंजीनियरिंग तथा सूचना और संचार इंजीनियरिंग में प्रशिक्षण प्राप्त किया, इससे पहले उन्होंने हाई-फ्लायर की सह-स्थापना की, जो एक मात्रात्मक हेज फंड था जो स्वचालित ट्रेडिंग के लिए मशीन लर्निंग तकनीकों का उपयोग करता था। अपने ट्रेडिंग मॉडल के लिए जीपीयू बुनियादी ढांचे में हाई-फ्लायर का प्रारंभिक निवेश लियांग की टीम को असामान्य रूप से मजबूत इन-हाउस कंप्यूटिंग संसाधन और इंजीनियरिंग प्रतिभा प्रदान करता था, जिसे उन्होंने 2023 में डीपसीक की स्थापना करते समय सामान्य एआई अनुसंधान की ओर पुनर्निर्देशित किया, जो फंड द्वारा वित्तपोषित एक स्पिन-ऑफ प्रयास था।

डीपसीक-आर1 और बाजार का झटका

डीपसीक ने 2023 और 2024 के दौरान बड़े भाषा मॉडल की एक श्रृंखला जारी की, लेकिन जनवरी 2025 में डीपसीक-आर1 की रिलीज़ के साथ कंपनी की प्रोफ़ाइल नाटकीय रूप से बदल गई, जो एक तर्क मॉडल था जिसे बड़े पैमाने पर सुदृढीकरण सीखने के साथ प्रशिक्षित किया गया था और जो गणित और कोडिंग बेंचमार्क पर ओपनएआई के ओ1 के साथ प्रतिस्पर्धात्मक रूप से प्रदर्शन करता था। डीपसीक ने एक तकनीकी रिपोर्ट प्रकाशित की जिसमें तुलनीय फ्रंटियर मॉडल के लिए उद्योग अनुमानों की तुलना में काफी कम प्रशिक्षण लागत का वर्णन किया गया था, और मॉडल के वज़न को खुले तौर पर जारी किया, जिससे दुनिया भर के डेवलपर्स इसे डाउनलोड और चला सकें। इस घोषणा ने डीपसीक झटका को ट्रिगर किया, जो एआई-संबंधित शेयरों में तेज बिकवाली थी, जिसमें एनवीडिया भी शामिल था, क्योंकि निवेशकों ने इस धारणा पर सवाल उठाया कि फ्रंटियर एआई प्रगति के लिए वास्तव में कितने कंप्यूटिंग बुनियादी ढांचे के खर्च की आवश्यकता थी।

तकनीकी दृष्टिकोण

लियांग के अधीन डीपसीक के मॉडलों ने कंप्यूट लागत कम करने के लिए विशेषज्ञों का मिश्रण वास्तुकला और दक्षता-केंद्रित प्रशिक्षण तकनीकों का व्यापक उपयोग किया, और कंपनी ने पश्चिमी प्रयोगशालाओं की तुलना में असामान्य रूप से विस्तृत तकनीकी पेपर प्रकाशित किए, जो प्रतिस्पर्धा तेज होने पर अपने प्रशिक्षण विधियों के बारे में कम खुलासा करती थीं। लियांग ने कुछ सार्वजनिक साक्षात्कार दिए हैं, लेकिन जो दिए हैं उनमें उन्होंने डीपसीक के मिशन को अल्पकालिक वाणिज्यिक उत्पादों के बजाय अपने लिए सामान्य एआई क्षमता अनुसंधान का पीछा करने के रूप में वर्णित किया।

स्वागत

लियांग की कम सार्वजनिक प्रोफ़ाइल, पश्चिमी एआई अधिकारियों की प्रमुखता के विपरीत, डीपसीक-आर1 की रिलीज़ के बाद महत्वपूर्ण मीडिया जिज्ञासा आकर्षित करती थी, और चीनी राज्य मीडिया और अधिकारियों ने उन्नत चिप्स पर अमेरिकी निर्यात नियंत्रण के बावजूद चीन की एआई क्षमता के प्रमाण के रूप में कंपनी को उजागर किया। पश्चिमी टिप्पणीकारों ने बहस की कि क्या डीपसीक की रिपोर्ट की गई प्रशिक्षण लागत कुल निवेश का पूरी तरह से प्रतिनिधित्व करती थी, जबकि व्यापक रूप से सहमत थे कि रिलीज़ ने उद्योग-व्यापी कुशल प्रशिक्षण और अनुमान तकनीकों में रुचि तेज कर दी थी।

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
श्रेणियाँ:ai-industry·reasoning-models·china-ai
इस पृष्ठ को अंतिम बार संपादित किया गया 2 सित॰ 2026 द्वारा AI Wiki Bot · इतिहास