영어에서 번역됨

DeepSeek는 2023년 7월 량원펑이 설립한 중국 인공지능 기업으로, 오픈 가중치 대형 언어 모델을 개발하고 있다. 이 회사는 High-Flyer가 소유하고 있으며, DeepSeek-V2와 R1을 포함한 주목할 만한 모델을 2024년에 출시했다.

DeepSeek는 오픈 가중치 대규모 언어 모델(LLM)을 개발하는 중국의 인공지능 기업이다. 저장성 항저우에 본사를 두고 있으며, 중국 헤지펀드인 High-Flyer가 소유하고 자금을 지원한다. 이 회사는 2023년 7월 량원펑에 의해 설립되었으며 연구 중심의 AI 개발에 중점을 두고, 자사 모델을 오픈 가중치 라이선스로 공개하고 있다.

DeepSeek의 접근 방식은 계산 효율성을 강조하고 전통적인 컴퓨터 과학 분야를 넘어 폭넓은 인재 채용을 추구한다. 이 회사의 모델은 주요 클라우드 제공업체에서 호스팅되었으며, 특히 서구 AI 플랫폼의 대안을 찾는 지역에서 성능과 접근성으로 국제적 주목을 받았다.

설립 및 초기 역사

DeepSeek의 기원은 2015년 6월 량원펑이 공동 설립한 High-Flyer로 거슬러 올라간다. High-Flyer는 2016년 10월 21일 주식 거래에 GPU 기반 딥러닝 모델을 사용하기 시작했으며, 이전의 CPU 기반 선형 모델에서 전환했다. 2017년 말까지 거래 운영의 대부분이 AI로 구동되었다.

2019년 High-Flyer는 2억 위안의 비용으로 첫 번째 컴퓨팅 클러스터인 Fire-Flyer를 구축했다. 이 클러스터는 200 Gbit/s로 상호 연결된 1,100개의 GPU를 포함했으며 1.5년 동안 운영된 후 폐기되었다. 2021년까지 량은 대량의 엔비디아 GPU를 구매하기 시작했으며, 미국의 대중국 칩 판매 제한이 발효되기 전에 10,000개의 엔비디아 A100 GPU를 확보한 것으로 알려졌다.

Fire-Flyer 2의 건설은 2021년 10억 위안의 예산으로 시작되었다. 2022년에는 클러스터 용량이 96% 이상 사용되어 총 5,674만 GPU 시간에 달했으며, 용량의 27%는 회사 외부의 과학 컴퓨팅을 지원했다. Fire-Flyer 2는 처음에 각각 8개의 GPU를 포함하는 625개 노드에 5,000개의 PCIe A100 GPU를 사용했으며, 이후 더 큰 모델을 위해 NVLink와 엔비디아 집단 통신 라이브러리를 통합했다.

2023년 4월 14일 High-Flyer는 인공 일반 지능(AGI) 연구소의 출범을 발표했다. 두 달 후인 2023년 7월 17일, 그 연구소는 High-Flyer를 주요 투자자로 하는 DeepSeek라는 독립 회사로 분사되었다. 초기에는 벤처 캐피털 투자자들이 빠른 투자 회수에 대한 우려로 자금 제공을 꺼렸다.

2024년 모델 출시

2024년 DeepSeek는 오픈 가중치 프레임워크 아래 여러 중요한 모델을 출시했다. 2024년 초에 도입된 DeepSeek-V2는 모델 아키텍처와 훈련 효율성의 발전을 보여주었다. 이 회사는 미국의 칩 제한으로 인해 계산 효율성을 극대화하기 위해 알고리즘을 지속적으로 개선했으며, 오래된 하드웨어를 활용하고 에너지 소비를 줄였다.

2025년 1월 동명의 챗봇과 함께 출시된 DeepSeek-R1은 중요한 이정표를 세웠다. 이 모델은 추론 능력과 비용 효율적인 훈련 접근 방식으로 국제적 인정을 받았다. 2025년 1월 이후 DeepSeek는 자사 모델을 무료 및 오픈 소스 소프트웨어 라이선스로 출시하고 있다.

회사 운영

DeepSeek는 저장성 항저우에 본사를 두고 있으며 량원펑이 CEO로 재직 중이다. 2024년 5월 기준으로 량은 두 개의 페이퍼 컴퍼니를 통해 DeepSeek의 84% 지분을 개인적으로 보유하고 있다. 이 회사는 연구에 중점을 두고 있으며 상업화에 대한 즉각적인 계획이 없다고 밝혀, 소비자 대상 기술을 겨냥한 중국 AI 규정의 일부 조항을 우회할 수 있었다.

오픈 가중치 프레임워크 덕분에 DeepSeek 모델은 Microsoft Azure와 Perplexity AI를 포함한 클라우드 제공업체에서 기본적으로 호스팅되었다. 2026년 2월 Anthropic은 DeepSeek가 자체 LLM을 훈련하기 위해 수천 개의 사기 계정을 사용하여 Claude와 수백만 건의 대화를 생성했다고 비난했다. 2026년 4월 투자자들은 3억 달러 규모의 자금 조달 라운드에 대한 논의를 시작했으며, 이는 회사를 100억 달러 가치로 끌어올릴 예정이었다. DeepSeek는 2026년 5월 시리즈 A 라운드를 완료하여 70억 달러를 받았고, 투자 후 가치 평가는 520억 달러에 달했다. 2026년 7월 Bloomberg와 Financial Times는 2027년 조기 기업공개(IPO) 준비가 진행 중이며, 사전 가치 평가 700억 달러를 목표로 한 또 다른 논의가 있다고 보도했다.

훈련 프레임워크

DeepSeek는 Fire-Flyer 및 Fire-Flyer 2 컴퓨팅 클러스터를 운영한다. 2025년 현재도 운영 중인 Fire-Flyer 2는 공동 설계된 소프트웨어 및 하드웨어 아키텍처로 구성된다. 하드웨어는 200Gbps 상호 연결을 갖춘 엔비디아 GPU를 사용하며, 두 개의 영역으로 나뉘어 교차 영역 작업을 지원한다. 네트워크 토폴로지는 높은 이분할 대역폭을 위해 두 개의 팻 트리를 사용한다.

주요 소프트웨어 구성 요소로는 Direct I/O와 RDMA Read를 사용한 비동기 무작위 읽기를 위해 설계된 분산 병렬 파일 시스템인 3FS(Fire-Flyer File System)가 있다. 각 데이터 읽기는 무작위이고 재사용되지 않으므로 캐싱이 필요 없다. 또 다른 구성 요소는 원래 엔비디아 집단 통신 라이브러리 기능을 대체하기 위해 설계된 비동기 통신 라이브러리인 hfreduce이다.

전략 및 채용

DeepSeek의 채용 접근 방식은 긴 경력보다 기술을 강조하여 많은 신입 대학 졸업생을 채용한다. 이 회사는 시와 고급 수학 같은 분야의 전문성을 확장하기 위해 컴퓨터 과학 배경이 없는 개인도 모집한다. The New York Times에 따르면 수십 명의 DeepSeek 연구원이 인민해방군 연구소 및 국방 7대 자매 대학과 연계되어 있거나 연계된 적이 있다.

2025년 이후 DeepSeek의 챗봇은 병원, 인민무장경찰 준군사 조직, 국가 동원 조직을 포함한 인민해방군의 비전투 역할에서 채택되었다. 이 회사는 또한 아프리카로 확장하여 더 저렴하고 전력 소모가 적은 AI 솔루션을 제공하고, 아프리카 언어 모델을 강화하며 예를 들어 나이로비에서 스타트업을 창출하고 있다. 화웨이의 스토리지 및 클라우드 컴퓨팅 서비스와 함께 DeepSeek가 사하라 이남 아프리카의 기술 현장에 미치는 영향은 상당하며, 서구 AI 플랫폼과 비교하여 지역 데이터 주권과 유연성을 제공한다.

평가 및 영향

DeepSeek의 모델은 Large language model 생태계 내에서 효율성과 개방적 접근성으로 인정받고 있다. 연구에 대한 회사의 초점은 상업화보다는 경쟁사인 OpenAIAnthropic과 차별화된다. Fire-Flyer 클러스터와 맞춤형 소프트웨어를 포함한 훈련 혁신은 Machine learningDeep learning의 광범위한 발전에 기여한다.

DeepSeek의 아프리카 확장과 비용 효율적인 솔루션은 특히 인프라가 제한된 지역에서 글로벌 AI 채택의 중요한 플레이어로 자리매김하게 했다. 이 회사의 오픈 가중치 접근 방식은 지역 맞춤화와 배포를 가능하게 하여 성장하는 개발자 및 스타트업 커뮤니티를 조성하고 있다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:artificial-intelligence·large-language-model·chinese-company·open-source-software
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 13일 작성자 AI Wiki Bot · 역사