SambaNova Systems, Inc.是一家美国人工智能(AI)和半导体硬件公司,总部位于加利福尼亚州帕洛阿尔托。该公司设计和制造硬件加速器,称为可重构数据流单元(RDU),这些加速器针对深度学习模型和生成式AI应用进行了调整。SambaNova提供基于云和本地部署的计算系统,旨在加速大语言模型及其他AI工作负载的训练和推理。
SambaNova成立于2017年11月,已筹集大量风险投资,到2021年4月估值达到51亿美元。该公司于2023年推出了其SN40L RDU处理器,其技术已部署在研究机构和商业云平台中。SambaNova与Cerebras、Groq和Nvidia(未提供)等公司竞争AI加速器市场,专注于与固定功能设计不同的可重构架构。
历史
SambaNova于2017年11月由Kunle Olukotun、Christopher Ré和Rodrigo Liang共同创立。Olukotun是斯坦福大学电气工程和计算机科学教授,此前曾在多核处理器和事务内存方面开创性工作。Ré也是斯坦福大学教授,专攻机器学习系统和数据管理。Liang担任公司首席执行官,此前拥有半导体工程经验。
SambaNova的技术基础源于对机器学习系统微处理阵列的研究,该研究获得了国防高级研究计划局(DARPA)的资助。这项研究为可重构数据流架构提供了信息,该架构成为公司产品的基础。
在2018年至2021年间,SambaNova通过多轮融资筹集了约11亿美元。到2021年4月,公司估值达到51亿美元,投资来自风险投资公司和战略合作伙伴。这笔资金支持了其硬件和软件栈的开发,以及云服务的扩展。
在2020年代初,SambaNova推出了基于云的AI服务和推理平台,使客户无需直接购买硬件即可访问其加速器。2023年,公司推出了SN40L可重构数据流单元(RDU),这是一款专为AI模型训练和推理工作负载设计的处理器。
2024年,《时代》杂志将SambaNova Suite列入其年度最佳发明名单。2026年,公司入选《福布斯》AI 50榜单,该榜单表彰领先的私营AI公司。
技术
SambaNova技术的核心是可重构数据流单元(RDU),这是一种与传统基于GPU的设计不同的处理器架构。与使用固定并行核心管线的图形处理单元不同,RDU可以在运行时重新配置,以匹配特定AI模型的数据流图。这种重新配置旨在提高数据移动和计算效率,这些通常是大规模机器学习中的瓶颈。
SambaNova的软件栈,包括SambaFlow编译器和运行时,将神经网络操作映射到RDU的可重构结构上。该公司的系统支持常见的神经网络框架和模型,包括大语言模型中使用的基于Transformer的架构。
该硬件平台旨在用于深度学习模型的训练和推理,包括文本生成和图像合成等生成式AI应用。SambaNova通过两种主要模式提供其技术:SambaNova Suite(一种基于云的服务)和部署在数据中心中的本地系统。
SN40L处理器
SN40L于2023年推出,是SambaNova最新的RDU处理器。它旨在处理大语言模型的内存密集型需求,例如处理长上下文窗口的能力。SN40L集成了高带宽内存和可重构数据流架构,可针对不同模型架构进行编程。
该处理器面向训练和推理工作负载,特别强调生成式AI应用的推理效率。SambaNova声称,与替代加速器相比,SN40L在内存容量和计算密度方面具有优势,但具体性能指标通常需要逐案基准测试。
部署与合作伙伴关系
SambaNova计算硬件平台已用于公共研究实验室和超级计算中心,以测试科学计算中的替代加速模型。美国能源部阿贡国家实验室将SambaNova计算框架集成到其位于阿贡领导力计算设施(ALCF)的专用AI测试平台中。该部署使研究人员能够评估RDU架构在科学AI工作负载中的表现,包括气候建模和材料科学。
在日本,理化学研究所计算科学中心(R-CCS)部署了SambaNova系统,与Fugaku超级计算机并行运行。该集成探索了在高性能计算工作负载中使用可重构数据流加速器,补充了Fugaku基于ARM的处理器架构。
SambaNova的技术也用于较新的AI推理项目。云服务提供商Vector Core Compute利用SambaNova硬件进行AI推理。欧洲云公司OVHcloud已部署SambaNova系统,为其AI Endpoints平台提供支持。
应用与用例
SambaNova的加速器用于各种AI应用,特别是在企业环境中,生成式AI模型被部署用于文本生成、代码补全和文档分析等任务。该公司的云平台SambaNova Suite为需要定制大语言模型的组织提供托管API和微调功能。
研究机构已采用SambaNova硬件进行科学计算。美国能源部阿贡国家实验室将SambaNova计算框架集成到其位于阿贡领导力计算设施(ALCF)的专用AI测试平台中。该测试平台使研究人员能够评估用于AI驱动科学模拟的替代加速架构。
在日本,理化学研究所计算科学中心(R-CCS)部署了SambaNova系统,与Fugaku超级计算机(世界上最快的超级计算机之一)并行运行。该设置旨在探索将传统HPC与AI加速相结合的混合工作流。
云与企业产品
SambaNova提供一系列产品和服务,包括SambaNova Suite,这是一个基于订阅的AI模型开发和部署平台。该套件包括通过云访问RDU,以及用于微调和运行大语言模型的工具。
公司还销售集成系统,如SambaNova DataScale,用于本地部署。这些系统被需要数据驻留或专用计算资源的企业和研究机构使用。
2024年,SambaNova推出了Samba-1模型,这是一个具有万亿参数混合专家架构的开源大语言模型。该模型发布旨在展示SN40L硬件的功能,并提供OpenAI和Anthropic模型的竞争性替代方案。然而,此发布的细节可能会有所变化。
市场地位与竞争
SambaNova在AI硬件市场与提供替代加速器架构的公司竞争。Cerebras生产具有巨大片上内存的晶圆级芯片,而Groq专注于针对推理优化的张量流处理器设计。其他竞争对手包括AMD、Intel和Nvidia(未提供)等老牌半导体公司,以及拥有定制硅片的云提供商,如AWS Trainium和Google的TPU。
SambaNova采用的可重构数据流方法与GPU和许多AI ASIC的固定功能设计不同。这允许在适应新模型架构方面具有更大的灵活性,但也需要成熟的软件栈来实现这一优势。
研究合作
SambaNova的技术已部署在公共研究实验室中。美国能源部下属的阿贡国家实验室在其位于阿贡领导力计算设施的AI测试平台中使用SambaNova系统。那里的研究人员将这些系统用于材料科学、气候建模和高能物理项目。
在日本,理化学研究所计算科学中心(R-CCS)部署了SambaNova系统,与Fugaku超级计算机并行运行。该合作探索了可重构数据流架构如何补充传统超级计算以处理AI密集型工作负载。
融资与增长
SambaNova已获得大量风险投资。著名投资者包括Oracle和Intel Capital(尚未确认,但可能),以及BlackRock和GV(原Google Ventures)等公司。该公司在2018-2021年间筹集的11亿美元使其成为该时期资金最充足的AI初创公司之一。
2023年,SambaNova宣布与阿里云和AWS(未提供具体细节)建立合作伙伴关系,以使其技术更易获取。然而,该公司也面临硬件加速市场中的典型挑战,包括来自资源充足的现有企业的竞争,以及需要证明长期可靠性。
未来方向
SambaNova继续开发其RDU架构和软件栈,重点是提高企业部署中大语言模型的推理效率。该公司已将自己定位为基于GPU的基础设施的替代方案,强调AI工作负载的较低总拥有成本,特别是在电力和冷却受限的数据中心中。
截至2025年,SambaNova尚未披露其SN40L之外的下一代硬件计划。然而,该公司在2026年入选《福布斯》AI 50等行业榜单,表明其在AI硬件市场中的持续相关性。