Anthropic एक अमेरिकी कृत्रिम बुद्धिमत्ता कंपनी है, जिसकी स्थापना 2021 में पूर्व OpenAI शोधकर्ताओं द्वारा की गई थी। कंपनी सुरक्षित और व्याख्या योग्य कृत्रिम बुद्धिमत्ता प्रणालियों के विकास पर केंद्रित है, जिसमें मानवीय इरादों के साथ AI व्यवहार को संरेखित करने पर विशेष जोर दिया जाता है। इसका प्राथमिक उत्पाद Claude परिवार के बड़े भाषा मॉडल हैं, जिनका उपयोग विभिन्न अनुप्रयोगों में किया जाता है, जिसमें संवादात्मक सहायक, कोडिंग सहायता और उद्यम डेटा विश्लेषण शामिल हैं। Anthropic का मुख्यालय सैन फ्रांसिस्को, कैलिफोर्निया में है, और यह OpenAI और Google DeepMind जैसी कंपनियों के साथ प्रतिस्पर्धा करते हुए अग्रणी स्वतंत्र AI अनुसंधान संगठनों में से एक बन गया है।
कंपनी की स्थापना उन्नत AI के सुरक्षा और नैतिक निहितार्थों के बारे में चिंताओं के जवाब में की गई थी। इसके संस्थापकों, जिनमें डारियो अमोदेई और डैनिएला अमोदेई शामिल हैं, ने पहले OpenAI में वरिष्ठ पदों पर कार्य किया था, जहाँ उन्होंने GPT-2 और GPT-3 जैसे मॉडलों पर काम किया था। AI सुरक्षा के प्रति Anthropic का दृष्टिकोण एक शोध कार्यक्रम पर आधारित है जिसे वह "संवैधानिक AI" कहता है, जिसका उद्देश्य मॉडलों को उनके व्यवहार को निर्देशित करने के लिए सिद्धांतों या एक "संविधान" का पालन करने के लिए प्रशिक्षित करना है, जिससे व्यापक मानवीय प्रतिक्रिया की आवश्यकता कम हो जाती है।
स्थापना और प्रारंभिक इतिहास
Anthropic की स्थापना 2021 में सात व्यक्तियों के एक समूह द्वारा की गई थी, जिनमें से अधिकांश पूर्व OpenAI कर्मचारी थे। संस्थापक टीम में डारियो अमोदेई (OpenAI में पूर्व अनुसंधान उपाध्यक्ष), डैनिएला अमोदेई (पूर्व सुरक्षा और नीति उपाध्यक्ष), टॉम ब्राउन (GPT-3 में प्रमुख योगदानकर्ता), क्रिस ओला (पूर्व व्याख्याता प्रमुख), जेरेड कापलान, जैक क्लार्क और सैम मैककैंडलिश शामिल थे। कंपनी ने शुरू में गुप्त मोड में काम किया, जिसमें Alibaba क्लाउड की मूल कंपनी सहित निवेशकों से पर्याप्त धन जुटाया गया, हालाँकि उस समय सटीक वित्तपोषण विवरण सार्वजनिक रूप से खुलासा नहीं किया गया था।
2023 की शुरुआत में, Anthropic ने Google Cloud के साथ एक महत्वपूर्ण साझेदारी की घोषणा की, जिसमें एक बड़ा निवेश और अपने मॉडलों को प्रशिक्षित करने और तैनात करने के लिए Google के क्लाउड इंफ्रास्ट्रक्चर का उपयोग करने की प्रतिबद्धता शामिल थी। उसी वर्ष बाद में, कंपनी को Amazon Web Services (AWS) से भी एक बड़ा निवेश मिला, जो प्रशिक्षण और अनुमान के लिए इसका प्राथमिक क्लाउड प्रदाता बन गया। इन साझेदारियों ने Anthropic को बड़े पैमाने के मॉडलों को प्रशिक्षित करने के लिए आवश्यक कम्प्यूटेशनल संसाधन प्रदान किए।
संवैधानिक AI और सुरक्षा अनुसंधान
Anthropic के अनुसंधान की एक परिभाषित विशेषता संवैधानिक AI (CAI) पर इसका ध्यान केंद्रित है। इस दृष्टिकोण में मॉडलों को केवल मानवीय प्रतिक्रिया पर निर्भर रहने के बजाय स्पष्ट नियमों या सिद्धांतों के एक सेट का उपयोग करके प्रशिक्षित करना शामिल है। मॉडल को पहले RLHF (मानवीय प्रतिक्रिया से सुदृढीकरण सीखना) के माध्यम से प्रशिक्षित किया जाता है, लेकिन फिर एक "संवैधानिक" प्रक्रिया का उपयोग करके परिष्कृत किया जाता है जहाँ मॉडल सिद्धांतों की एक सूची के आधार पर अपने स्वयं के आउटपुट की आलोचना और संशोधन करता है। इस विधि का उद्देश्य मॉडलों को अधिक सहायक, हानिरहित और ईमानदार बनाना है, साथ ही प्रशिक्षण प्रक्रिया को अधिक स्केलेबल और पारदर्शी बनाना है।
कंपनी के सुरक्षा अनुसंधान में व्याख्यात्मकता पर काम भी शामिल है, जैसे कि यह समझना कि तंत्रिका नेटवर्क आंतरिक रूप से अवधारणाओं का प्रतिनिधित्व कैसे करते हैं। Anthropic ने ट्रांसफॉर्मरों में "सर्किट" जैसे विषयों पर पेपर प्रकाशित किए हैं, जो इन मॉडलों द्वारा किए गए गणनाओं को रिवर्स-इंजीनियर करने का प्रयास करते हैं। यह शोध व्यापक प्रयास का हिस्सा है ताकि यह सुनिश्चित किया जा सके कि AI प्रणालियों का ऑडिट किया जा सके और उन पर भरोसा किया जा सके, विशेष रूप से जब वे अधिक सक्षम हो जाते हैं।
Claude मॉडल श्रृंखला
Anthropic की प्राथमिक उत्पाद लाइन बड़े भाषा मॉडलों की Claude श्रृंखला है। पहला संस्करण, Claude, मार्च 2023 में जारी किया गया था, इसके बाद जुलाई 2023 में Claude 2 आया, जिसने बेहतर प्रदर्शन और लंबा संदर्भ विंडो प्रदान किया। मार्च 2024 में, Anthropic ने Claude 3 जारी किया, जो Haiku, Sonnet और Opus सहित मॉडलों का एक परिवार है, जिनमें से प्रत्येक विभिन्न गति और क्षमता व्यापार-नापसंद के लिए अनुकूलित है। Claude 3 Opus को MMLU परीक्षण जैसे बेंचमार्क पर अपने मजबूत प्रदर्शन के लिए नोट किया गया था, जो अक्सर अन्य प्रमुख प्रयोगशालाओं के मॉडलों के बराबर या उससे बेहतर होता है।
जून 2024 में, Anthropic ने Claude 3.5 Sonnet पेश किया, जिसने तर्क और कोडिंग क्षमताओं में और सुधार किया। मॉडल एक API, claude.ai पर एक उपभोक्ता चैटबॉट और उद्यम पेशकशों के माध्यम से उपलब्ध हैं। Claude मॉडल कोडिंग, लंबे संदर्भ समझ और सुरक्षा दिशानिर्देशों के पालन में अपने मजबूत प्रदर्शन के लिए जाने जाते हैं। इनका उपयोग विभिन्न क्षेत्रों की कंपनियों द्वारा किया जाता है, जिसमें वित्त, स्वास्थ्य सेवा और कानूनी सेवाएं शामिल हैं, दस्तावेज़ विश्लेषण, कोड निर्माण और ग्राहक सहायता जैसे कार्यों के लिए।
व्यवसाय मॉडल और साझेदारियाँ
Anthropic एक वाणिज्यिक व्यवसाय मॉडल संचालित करता है, जो अपने मॉडलों तक API पहुंच और सदस्यता सेवाओं के माध्यम से राजस्व उत्पन्न करता है। कंपनी अपने चैटबॉट के लिए एक मुफ्त स्तर के साथ-साथ व्यक्तियों और व्यवसायों के लिए भुगतान योजनाएं प्रदान करती है। क्लाउड प्रदाताओं के साथ इसकी प्रमुख साझेदारियाँ इसके संचालन के लिए महत्वपूर्ण हैं। सितंबर 2023 में घोषित AWS साझेदारी में $4 बिलियन का निवेश शामिल था, जिसमें AWS प्राथमिक प्रशिक्षण और तैनाती भागीदार बन गया। इस सौदे ने Claude मॉडलों को Amazon Bedrock, AWS की प्रबंधित AI सेवा पर भी उपलब्ध कराया। इसी तरह, फरवरी 2023 में घोषित Google Cloud साझेदारी में $300 मिलियन का निवेश शामिल था, जिसमें Google Cloud ने इंफ्रास्ट्रक्चर प्रदान किया और बाद में समझौते का विस्तार किया।
इन साझेदारियों ने Anthropic को अपने संचालन को तेजी से बढ़ाने की अनुमति दी है, लेकिन वे कंपनी की स्वतंत्रता के बारे में भी सवाल उठाते हैं, क्योंकि यह वित्त पोषण और कंप्यूट दोनों के लिए प्रमुख तकनीकी फर्मों पर निर्भर करता है। 2024 तक, Anthropic ने कुल $7 बिलियन से अधिक धन जुटाया है, जिसमें Amazon निवेश के बाद मूल्यांकन लगभग $18 बिलियन बताया गया है।
शासन और AI सुरक्षा वकालत
Anthropic ने खुद को AI सुरक्षा वकालत में एक नेता के रूप में स्थापित किया है, जो अक्सर कुछ प्रतिस्पर्धियों की तुलना में मॉडल तैनाती के लिए अधिक सतर्क दृष्टिकोण अपनाता है। कंपनी नीति चर्चाओं में शामिल रही है, जिसमें अमेरिकी कांग्रेस के समक्ष गवाही देना और उद्योग पहलों में भाग लेना शामिल है। 2023 में, Anthropic ने फ्रंटियर मॉडल फोरम की सह-स्थापना की, जो OpenAI, Google और Microsoft को भी शामिल करने वाला एक समूह है, जिसका उद्देश्य फ्रंटियर AI मॉडलों के सुरक्षित और जिम्मेदार विकास को बढ़ावा देना है।
कंपनी उन्नत AI के संभावित जोखिमों, जिसमें अस्तित्वगत जोखिम शामिल हैं, के बारे में भी मुखर रही है और विनियमन और पारदर्शिता की वकालत की है। इसकी "जिम्मेदार स्केलिंग नीति" तेजी से सक्षम मॉडलों से जुड़े जोखिमों का मूल्यांकन और शमन करने के लिए एक रूपरेखा की रूपरेखा तैयार करती है, जिसमें विशिष्ट "AI सुरक्षा स्तर" (ASL) सीमाएं शामिल हैं। यह नीति यह सुनिश्चित करने के लिए डिज़ाइन की गई है कि जैसे-जैसे मॉडल अधिक शक्तिशाली होते जाएं, उचित सुरक्षा उपाय मौजूद हों।
अनुसंधान योगदान और ओपन सोर्स
हालाँकि Anthropic ने अपने मॉडलों को ओपन सोर्स के रूप में जारी नहीं किया है, लेकिन इसने प्रकाशनों और उपकरणों के माध्यम से व्यापक AI अनुसंधान समुदाय में योगदान दिया है। कंपनी ने ध्यान तंत्र, मॉडल प्रूनिंग और व्याख्यात्मकता जैसे विषयों पर शोध प्रकाशित किया है। इसने डेटासेट और मूल्यांकन बेंचमार्क भी जारी किए हैं, जैसे "सहायक, ईमानदार, हानिरहित" (HHH) डेटासेट, जिसका उपयोग इन आयामों पर मॉडलों को प्रशिक्षित और मूल्यांकन करने के लिए किया जाता है।
Anthropic का व्याख्यात्मकता पर शोध विशेष रूप से प्रभावशाली रहा है। 2022 में, कंपनी ने "टॉय मॉडल्स ऑफ सुपरपोज़िशन" पर एक पेपर प्रकाशित किया, जिसमें पता लगाया गया कि तंत्रिका नेटवर्क अपने आयामों से अधिक सुविधाओं का प्रतिनिधित्व कैसे करते हैं। 2023 में, इसने "क्लाउड 3 सोनेट से व्याख्या योग्य विशेषताएं निकालना" पर एक पेपर जारी किया, जिसमें धोखे और चापलूसी जैसी अवधारणाओं से संबंधित आंतरिक सुविधाओं की पहचान और हेरफेर करने की तकनीकों का प्रदर्शन किया गया। ये प्रयास AI प्रणालियों को अधिक समझने योग्य और नियंत्रणीय बनाने के दीर्घकालिक लक्ष्य का हिस्सा हैं।
प्रतिस्पर्धी परिदृश्य और भविष्य का दृष्टिकोण
Anthropic अत्यधिक प्रतिस्पर्धी वातावरण में काम करता है, जिसमें प्रमुख प्रतिद्वंद्वी OpenAI, Google DeepMind और Meta AI शामिल हैं। कंपनी सुरक्षा पर अपने जोर और अपने संवैधानिक AI दृष्टिकोण के माध्यम से खुद को अलग करती है। हालाँकि, इसे प्रतिस्पर्धियों के तेजी से रिलीज़ चक्रों के साथ बनाए रखने और बड़े मॉडलों को प्रशिक्षित करने की उच्च लागतों के प्रबंधन में चुनौतियों का सामना करना पड़ता है। 2024 तक, Anthropic अपने उत्पाद पेशकशों का विस्तार करना जारी रखता है, जिसमें एक Claude मोबाइल ऐप और सहयोगी कार्य के लिए "प्रोजेक्ट्स" और "आर्टिफैक्ट्स" जैसी उद्यम-केंद्रित सुविधाएं शामिल हैं।
Anthropic की भविष्य की दिशा में संभवतः अपने मॉडलों का निरंतर स्केलिंग, उद्यम कार्यप्रवाहों के साथ गहरा एकीकरण और व्याख्यात्मकता में आगे की प्रगति शामिल होगी। सुरक्षा के प्रति कंपनी की प्रतिबद्धता नए शासन ढांचे को भी जन्म दे सकती है जो व्यापक उद्योग को प्रभावित कर सकते हैं। जैसे-जैसे AI तकनीक विकसित होती है, सुरक्षा-केंद्रित नवप्रवर्तक के रूप में Anthropic की भूमिका शोधकर्ताओं, नीति निर्माताओं और उद्योग पर्यवेक्षकों द्वारा बारीकी से देखी जाएगी।
यह भी देखें
संदर्भ
यह लेख 2024 तक सार्वजनिक रूप से उपलब्ध जानकारी पर आधारित है। सबसे वर्तमान विवरणों के लिए, Anthropic के आधिकारिक संचार और प्रतिष्ठित प्रौद्योगिकी समाचार स्रोतों का संदर्भ लें।