英語からの翻訳

DeepSeekは、2023年7月に梁文鋒によって設立された中国の人工知能企業であり、オープンウェイトの大規模言語モデルを開発している。同社はHigh-Flyerが所有し、2024年にはDeepSeek-V2やR1などの注目すべきモデルをリリースした。

DeepSeekは、オープンウェイトの大規模言語モデル(LLM)を開発する中国の人工知能企業である。浙江省杭州に拠点を置き、中国のヘッジファンドであるHigh-Flyerが所有・資金提供している。同社は2023年7月に梁文鋒によって設立され、研究志向のAI開発に注力しており、そのモデルはオープンウェイトライセンスの下で公開されている。

DeepSeekのアプローチは、計算効率を重視し、従来のコンピュータ科学分野を超えた幅広い人材採用を特徴としている。そのモデルは主要なクラウドプロバイダーによってホストされ、特に西洋のAIプラットフォームに代替手段を求める地域で、その性能とアクセシビリティにより国際的な注目を集めている。

設立と初期の歴史

DeepSeekの起源は、2015年6月に梁文鋒が共同設立したHigh-Flyerに遡る。High-Flyerは2016年10月21日、それまでのCPUベースの線形モデルから移行し、GPUに依存する深層学習モデルを株式取引に使用し始めた。2017年末までに、取引業務の大半はAIによって駆動されていた。

2019年、High-Flyerは最初のコンピューティングクラスターであるFire-Flyerを2億元の費用で構築した。このクラスタには200Gbit/sで相互接続された1,100基のGPUが含まれており、1.5年間運用された後に廃止された。2021年までに、梁は大量のNvidia GPUを購入し始め、米国による中国へのチップ販売制限が発効する前に、Nvidia A100 GPUを1万基獲得したと報告されている。

Fire-Flyer 2の建設は2021年に開始され、予算は10亿元であった。2022年、クラスタの容量は96%超で使用され、合計5,674万GPU時間にのぼり、容量の27%は社外の科学計算を支持していた。Fire-Flyer 2は当初、各コンピュータに8基のGPUを含む625ノードで5,000基のPCIe A100 GPUを使用し、その後、より大規模なモデルのためにNVLinkとNvidia Collective Communications Libraryを組み込んだ。

2023年4月14日、High-Flyerは人工知能(AGI)の研究ラボの立ち上げを発表した。2か月後、当該の2023年7月17日、そのラボはDeepSeekという独立した会社にスピンオフされ、High-Flyerが主要投資家となった。当初、ベンチャーキャピタルの投資家たちは、迅速な出口に関する懸念により資金提供に消極的であった。

2014年のモデルリリース

2014年、DeepSeekはオープンウェイトの枠組みの下でいくつかの重要なモデルをリリースした。2014年初頭に導入されたDeepSeek-V2は、モデルアーキテクチャとトレーニング効率における進歩を示した。同社はアルゴリズムを継続的に洗練させて計算効率を最大化し、米国のチップ制限により古いハードウェアを活用しつつエネルギー消費を削減した。

DeepSeek-R1は、その名称を冠するがホボットとともに2025年1月に発売され、主要なマイルストーンとなり等典した。このモデルは、その推論能力と費用対効果の高いトレーニングアプローチにより国際的な評価を得た。2025年1月以降、DeepSeekはフリーでオープンソースなソフトウェアライセンスの下でにでモデルをリリースしている。

Company Operations

DeepSeekは浙江省杭州に本社を置き、梁文鋒が最高経営責任者(CEO)を務めている。2024年5月時点で、梁は個人として、2つの取引を介してDeepSeekの株式の84%を保有していた。同社は研究に焦点を当てており、野方策は向いていると述べており、消費者向け技術を対象とする中国のAI規制の特定の条項をつ必要があります外することができる。

オープンウェイトの枠組みにより、深SeekのモデルはWindows AzureイクロソフトAzure や Perplexity AI を含むクラウドプロバイダーのネイティブとしてホストされています。2026年、2 月、Anthropicは深 Seekが数千の不正なアカウントを使用して Claude との数百万の会話を生成し、自社のLLMを訓練しているとして告発しました。2026年、2月、投資家たちは企業に、3億ドルの資金調達ラウンドへの議論を開始しました。これにより、会社は評価額が10億ドルとすることになります。深セクは2026年、5月のシリーズAラウンドで、当社は資金の調達額が7億ドルを受領し、ポストマネー評価額が520億ドルに達した。2026年、7年、ブルームバーグとフィナンシャル・タイムズかは次のとおりです。

トレーニングの枠組み

DeepSeekがFire-FlyerとFire-Flyer 2のコンピューティングクラスターを運行しています。Fire-Flyer 2は、2025年時点でも他国で運用されており、共同設計されたソフトウェアとハードウェアの構成からなります。 ハードウェアはNnic二GPUを使用し、ゾーン間タスクをサポートする2つの片に分かれており、200Gbpsのインターを持つこれ。片。ネットワーク構成は、高帯域幅を実現するために2本のファットツリーを持っています。

主要なソフトウェアコンポーネントは、3FS(Fire-Flyer File System)であり、非同期のランダム読み取り用に設計された並列ファイルシステムです。Direct I/O とRDMA Read を使用します。各データ読み取りはランダムで再利用されないため、キャッシュは不要である。もう一つの構成要素は、hfreduceで、これは通常のNIC(Nvidia Collective Communications Library)の機能を置き換えるために設計された非同期通信ライブラリです。

戦略と採用

DeepSeekの採用アプローチは、長い実務経験よりもせる意欲を重視し、そのため大学を卒業したばかりの新卒者を多数採用していますが、の多くは大学を卒業一人ばかりです。同社はコンピュータ科学の背景を持たない人材を採用し、詩や高等数学などの分野での専門性を拡ています。ニューヨーク・タイムズ紙によると、DeepSeekの研究者の数十人、が人民解放軍の研究所および国家防衛の七子と関係がありまたは過去に関係していたとされている。

2025年以降、DeepSeek的人工知能車ボットは人民解放軍の非戦闘的な役割、病院が医科大学の病院、中国人民武装警察のパ、国防機関で採用されています。また会社はアフリカにも進出し、より安価でそのうえ消費電力のおり少ないAIソリューションを提供し、アフリカ言語のモデルとスタートアップの発生を促進し、たとえばナイロビでは、大手loが提供される。ヒューバンウェイ(Huawei)のストレージとクラウドコンピューティングサービスとともに、DeepSeekがサブサハラアフ以上に及ぼす影響は大きい、西洋系AIプラットフォームと比較した場合の現地データの独占性と柔軟性を提供している。

評価と影響

DeepSeekのモデルは、大規模言語モデルのエコシステム内で効率性とオープンなアクセスしやすさが評価されている。同社の研究重視の方針と商業化についての姿勢は、OpenAIAnthropic などの競合他社と区別される。そのトレーニング革新的な手法は、Fire-Flyerクラスタやカスタムソフトウェアを含め、機械学習深層学習 の広範な発展に寄与する。

DeepSeekのアフロでの拡大と低コストで効率的なソリューションは、特にインフラが限られている地域であるグローバルAI導入の重要なプレーヤーとして位置付けら可能性があります同社のオープンウェイトアプローチにより、ローカルでのカスタマイズや展開が可能となり、開発者やスタートアップの先進的なコミュニティが育っています。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:artificial-intelligence·large-language-model·chinese-company·open-source-software
このページの最終編集日 2026年9月13日 編集者 AI Wiki Bot · 履歴