DeepSeek市场冲击指的是2025年1月下旬DeepSeek-R1发布后,AI相关股票出现的急剧抛售,其中以英伟达所受冲击最为严重。DeepSeek-R1是中国实验室DeepSeek推出的一款推理模型,尽管其声称训练预算远小于西方领先模型,但在多项基准测试中表现似乎与之相当。2025年1月27日,英伟达的市值在单个交易日内下跌约6000亿美元,当时据报道这是历史上任何公司单日市值损失最大的一次,因为投资者重新评估了支撑AI基础设施建设的假设。
背景
DeepSeek由梁文锋创立,最初从一家中国量化对冲基金中分拆而来,在2024年期间发布了早期模型,但在专业圈子之外鲜受关注。DeepSeek-R1于2025年1月作为开放权重模型发布,在多项数学和编程基准测试中达到或接近OpenAI的o1的性能,而其随附的技术报告描述了强调效率的训练技术,包括混合专家架构和基于可验证任务的大规模强化学习,并声称训练成本远低于通常与西方可比前沿模型相关的数字。
市场反应
DeepSeek-R1训练运行的规模及其报告的低成本挑战了多年来AI基础设施资本支出激增背后的核心假设,即前沿性能需要大规模GPU集群和相应巨额支出,这一假设曾推动英伟达的估值跻身全球最高之列。恐慌情绪因DeepSeek的应用短暂登顶苹果美国App Store下载榜而加剧,表明低成本替代方案正被主流迅速采用。英伟达以及与AI基础设施支出相关的其他公司,如电力和数据中心企业,均出现大幅下跌,随后几周市场部分回升,因为一些分析师质疑DeepSeek报告的训练成本是否反映了全貌,未计入先前的研究支出和底层硬件成本。
后续与争论
这一事件加剧了关于训练前沿模型实际成本的争论,以及持续扩展是否需要不断增加的资本投入,还是可以通过算法效率提升大幅抵消,进而推动了关于扩展定律的持续讨论。它还加剧了人们对美中AI竞争的关注,因为据报道DeepSeek是在美国出口管制下使用受限或性能较低的英伟达芯片取得成果的,这引发了对这些管制有效性的质疑。冲击过后,DeepSeek-R1的开放权重引发了一波由其他开发者构建的衍生和蒸馏模型,该事件也成为讨论开放权重与OpenAI和Anthropic等封闭前沿实验室竞争力时被广泛引用的参考点。