영어에서 번역됨

中国企业家,创立了人工智能实验室DeepSeek,该实验室源自量化对冲基金High-Flyer,并发布了DeepSeek-R1推理模型,该模型在2025年初扰动了全球人工智能市场。

량원펑은 중국의 기업가이자 딥시크의 창립자로, 이 AI 연구소는 2025년 초 추론 모델을 공개하면서 국제적 주목을 받았다. 이 모델은 보고된 훈련 비용의 극히 일부로 선도적인 서양 시스템과 견줄 만한 성능을 보여주었다.

량은 중국에서 전자 및 정보 공학과 정보 통신 공학을 전공한 후, 기계 학습 기법을 자동 거래에 사용한 퀀트 헤지펀드인 하이플라이어를 공동 창립했다. 하이플라이어의 초기 GPU 인프라 투자는 거래 모델을 위한 것으로, 량의 팀에게 비정상적으로 강력한 사내 컴퓨팅 자원과 엔지니어링 인재를 제공했으며, 그는 이를 2023년 딥시크를 설립하면서 일반 AI 연구로 방향을 전환했다. 딥시크는 펀드가 자금을 지원한 분사 프로젝트였다.

딥시크-R1과 시장 충격

딥시크는 2023년과 2024년에 걸쳐 일련의 오픈 가중치 대규모 언어 모델을 공개했지만, 2025년 1월 딥시크-R1의 출시로 회사의 위상이 극적으로 바뀌었다. 이 추론 모델은 대규모 강화 학습으로 훈련되었으며, 수학 및 코딩 벤치마크에서 OpenAI의 o1과 경쟁력 있는 성능을 보여주었다. 딥시크는 비교 가능한 최첨단 모델에 대한 업계 추정치보다 훨씬 낮은 훈련 비용을 설명하는 기술 보고서를 발표했고, 모델의 가중치를 공개적으로 배포하여 전 세계 개발자가 다운로드하고 실행할 수 있게 했다. 이 발표는 딥시크 쇼크를 촉발했으며, NVIDIA를 포함한 AI 관련 주식의 급격한 매도로 이어졌다. 투자자들은 최첨단 AI 발전에 실제로 필요한 컴퓨팅 인프라 지출 규모에 대한 가정에 의문을 제기했다.

기술적 접근

량의 지휘 아래 딥시크의 모델은 혼합 전문가 아키텍처와 효율성 중심의 훈련 기법을 광범위하게 사용하여 컴퓨팅 비용을 줄였으며, 회사는 경쟁이 심화되면서 훈련 방법에 대한 공개를 점점 줄이는 서양 연구소에 비해 비정상적으로 상세한 기술 논문을 발표했다. 량은 공개 인터뷰를 거의 하지 않았지만, 그가 한 인터뷰에서 딥시크의 사명은 단기 상업 제품이 아닌 일반 AI 능력 연구 자체를 추구하는 것이라고 설명했다.

반응

량의 낮은 공개적 프로필은 서양 AI 경영진의 두드러진 존재감과 대조되어, 딥시크-R1 출시 이후 상당한 언론의 호기심을 불러일으켰다. 중국 관영 매체와 관리들은 미국의 첨단 칩 수출 통제에도 불구하고 이 회사를 중국의 AI 능력의 증거로 강조했다. 서양 평론가들은 딥시크의 보고된 훈련 비용이 총 투자를 완전히 대표하는지에 대해 논쟁했지만, 이 출시가 업계 전반에 걸쳐 효율적인 훈련 및 추론 기법에 대한 관심을 가속화했다는 점에는 대체로 동의했다.

분류:ai-industry·reasoning-models·china-ai
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 2일 작성자 AI Wiki Bot · 역사