译自英文

SambaNova Systems是一家美国AI和半导体公司,设计用于深度学习和生成式AI工作负载的可重构数据流单元(RDUs)。该公司成立于2017年,提供云和本地AI平台,包括SN40L处理器。

SambaNova Systems, Inc.是一家美国人工智能(AI)和半导体硬件公司,总部位于加利福尼亚州帕洛阿尔托。该公司设计和制造硬件加速器,称为可重构数据流单元(RDU),这些加速器针对深度学习模型和生成式AI应用进行了调整。SambaNova提供基于云和本地部署的计算系统,旨在加速大语言模型及其他AI工作负载的训练和推理。

SambaNova成立于2017年11月,已筹集大量风险投资,到2021年4月估值达到51亿美元。该公司于2023年推出了其SN40L RDU处理器,其技术已部署在研究机构和商业云平台中。SambaNova与CerebrasGroqNvidia(未提供)等公司竞争AI加速器市场,专注于与固定功能设计不同的可重构架构。

历史

SambaNova于2017年11月由Kunle Olukotun、Christopher Ré和Rodrigo Liang共同创立。Olukotun是斯坦福大学电气工程和计算机科学教授,此前曾在多核处理器和事务内存方面开创性工作。Ré也是斯坦福大学教授,专攻机器学习系统和数据管理。Liang担任公司首席执行官,此前拥有半导体工程经验。

SambaNova的技术基础源于对机器学习系统微处理阵列的研究,该研究获得了国防高级研究计划局(DARPA)的资助。这项研究为可重构数据流架构提供了信息,该架构成为公司产品的基础。

在2018年至2021年间,SambaNova通过多轮融资筹集了约11亿美元。到2021年4月,公司估值达到51亿美元,投资来自风险投资公司和战略合作伙伴。这笔资金支持了其硬件和软件栈的开发,以及云服务的扩展。

在2020年代初,SambaNova推出了基于云的AI服务和推理平台,使客户无需直接购买硬件即可访问其加速器。2023年,公司推出了SN40L可重构数据流单元(RDU),这是一款专为AI模型训练和推理工作负载设计的处理器。

2024年,《时代》杂志将SambaNova Suite列入其年度最佳发明名单。2026年,公司入选《福布斯》AI 50榜单,该榜单表彰领先的私营AI公司。

技术

SambaNova技术的核心是可重构数据流单元(RDU),这是一种与传统基于GPU的设计不同的处理器架构。与使用固定并行核心管线的图形处理单元不同,RDU可以在运行时重新配置,以匹配特定AI模型的数据流图。这种重新配置旨在提高数据移动和计算效率,这些通常是大规模机器学习中的瓶颈。

SambaNova的软件栈,包括SambaFlow编译器和运行时,将神经网络操作映射到RDU的可重构结构上。该公司的系统支持常见的神经网络框架和模型,包括大语言模型中使用的基于Transformer的架构。

该硬件平台旨在用于深度学习模型的训练和推理,包括文本生成和图像合成等生成式AI应用。SambaNova通过两种主要模式提供其技术:SambaNova Suite(一种基于云的服务)和部署在数据中心中的本地系统。

SN40L处理器

SN40L于2023年推出,是SambaNova最新的RDU处理器。它旨在处理大语言模型的内存密集型需求,例如处理长上下文窗口的能力。SN40L集成了高带宽内存和可重构数据流架构,可针对不同模型架构进行编程。

该处理器面向训练和推理工作负载,特别强调生成式AI应用的推理效率。SambaNova声称,与替代加速器相比,SN40L在内存容量和计算密度方面具有优势,但具体性能指标通常需要逐案基准测试。

部署与合作伙伴关系

SambaNova计算硬件平台已用于公共研究实验室和超级计算中心,以测试科学计算中的替代加速模型。美国能源部阿贡国家实验室将SambaNova计算框架集成到其位于阿贡领导力计算设施(ALCF)的专用AI测试平台中。该部署使研究人员能够评估RDU架构在科学AI工作负载中的表现,包括气候建模和材料科学。

在日本,理化学研究所计算科学中心(R-CCS)部署了SambaNova系统,与Fugaku超级计算机并行运行。该集成探索了在高性能计算工作负载中使用可重构数据流加速器,补充了Fugaku基于ARM的处理器架构。

SambaNova的技术也用于较新的AI推理项目。云服务提供商Vector Core Compute利用SambaNova硬件进行AI推理。欧洲云公司OVHcloud已部署SambaNova系统,为其AI Endpoints平台提供支持。

应用与用例

SambaNova的加速器用于各种AI应用,特别是在企业环境中,生成式AI模型被部署用于文本生成、代码补全和文档分析等任务。该公司的云平台SambaNova Suite为需要定制大语言模型的组织提供托管API和微调功能。

研究机构已采用SambaNova硬件进行科学计算。美国能源部阿贡国家实验室将SambaNova计算框架集成到其位于阿贡领导力计算设施(ALCF)的专用AI测试平台中。该测试平台使研究人员能够评估用于AI驱动科学模拟的替代加速架构。

在日本,理化学研究所计算科学中心(R-CCS)部署了SambaNova系统,与Fugaku超级计算机(世界上最快的超级计算机之一)并行运行。该设置旨在探索将传统HPC与AI加速相结合的混合工作流。

云与企业产品

SambaNova提供一系列产品和服务,包括SambaNova Suite,这是一个基于订阅的AI模型开发和部署平台。该套件包括通过云访问RDU,以及用于微调和运行大语言模型的工具。

公司还销售集成系统,如SambaNova DataScale,用于本地部署。这些系统被需要数据驻留或专用计算资源的企业和研究机构使用。

2024年,SambaNova推出了Samba-1模型,这是一个具有万亿参数混合专家架构的开源大语言模型。该模型发布旨在展示SN40L硬件的功能,并提供OpenAIAnthropic模型的竞争性替代方案。然而,此发布的细节可能会有所变化。

市场地位与竞争

SambaNova在AI硬件市场与提供替代加速器架构的公司竞争。Cerebras生产具有巨大片上内存的晶圆级芯片,而Groq专注于针对推理优化的张量流处理器设计。其他竞争对手包括AMDIntelNvidia(未提供)等老牌半导体公司,以及拥有定制硅片的云提供商,如AWS TrainiumGoogle的TPU

SambaNova采用的可重构数据流方法与GPU和许多AI ASIC的固定功能设计不同。这允许在适应新模型架构方面具有更大的灵活性,但也需要成熟的软件栈来实现这一优势。

研究合作

SambaNova的技术已部署在公共研究实验室中。美国能源部下属的阿贡国家实验室在其位于阿贡领导力计算设施的AI测试平台中使用SambaNova系统。那里的研究人员将这些系统用于材料科学、气候建模和高能物理项目。

在日本,理化学研究所计算科学中心(R-CCS)部署了SambaNova系统,与Fugaku超级计算机并行运行。该合作探索了可重构数据流架构如何补充传统超级计算以处理AI密集型工作负载。

融资与增长

SambaNova已获得大量风险投资。著名投资者包括OracleIntel Capital(尚未确认,但可能),以及BlackRock和GV(原Google Ventures)等公司。该公司在2018-2021年间筹集的11亿美元使其成为该时期资金最充足的AI初创公司之一。

2023年,SambaNova宣布与阿里云AWS(未提供具体细节)建立合作伙伴关系,以使其技术更易获取。然而,该公司也面临硬件加速市场中的典型挑战,包括来自资源充足的现有企业的竞争,以及需要证明长期可靠性。

未来方向

SambaNova继续开发其RDU架构和软件栈,重点是提高企业部署中大语言模型的推理效率。该公司已将自己定位为基于GPU的基础设施的替代方案,强调AI工作负载的较低总拥有成本,特别是在电力和冷却受限的数据中心中。

截至2025年,SambaNova尚未披露其SN40L之外的下一代硬件计划。然而,该公司在2026年入选《福布斯》AI 50等行业榜单,表明其在AI硬件市场中的持续相关性。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:artificial-intelligence·semiconductor-hardware·deep-learning·reconfigurable-computing
本页最后编辑于 2026年9月5日 编辑者 AI Wiki Bot · 历史