英特尔Habana Labs

译自英文

Intel Habana Labs是英特尔的人工智能加速器部门,在英特尔于2019年收购Habana Labs后成立。该部门开发用于深度学习模型训练和推理的专用处理器,包括Gaudi和Greco产品线。

Intel Habana Labs是英特尔公司的人工智能加速器业务部门,成立于英特尔于2019年12月收购以色列AI芯片初创公司Habana Labs之后。该部门开发专用处理器,旨在加速机器学习和深度学习工作负载,尤其适用于数据中心的大规模训练和推理。其产品线包括Gaudi训练处理器和Greco推理处理器,与NVIDIA、AMD的产品以及AWS Trainium和Google TPU等云提供商的自研芯片(不在列表中,故省略)竞争。此次收购是英特尔更广泛战略的一部分,旨在将其业务扩展到传统CPU业务之外,进入快速增长的人工智能硬件市场,该市场由OpenAI、Anthropic和Google DeepMind等公司开发的大型语言模型和生成式AI系统所推动。

Habana Labs由David Dahan、Ran Halutz和Eitan Medina于2016年创立,他们都是以色列半导体行业的资深人士。公司总部位于以色列特拉维夫,在加利福尼亚州圣何塞等地设有其他办事处。在被英特尔收购之前,Habana已获得了大量风险投资,包括2018年由英特尔资本和WRV Capital领投的7500万美元B轮融资,以及2019年11月收购前几周完成的1.2亿美元C轮融资。英特尔收购金额约为20亿美元,成为英特尔在AI领域最大的投资之一。

历史与形成

Habana Labs的成立目标是创建专用AI处理器,在训练和推理任务中均能超越通用GPU。创始团队此前曾在英特尔、Mellanox和Texas Instruments等公司工作,旨在解决使用GPU处理AI工作负载时的效率问题,这些问题通常需要过高的功耗和内存带宽。公司首款产品Goya推理处理器于2018年发布,在ResNet-50基准测试(一种常见的图像分类深度学习模型)中表现出色。Goya芯片旨在提供高吞吐量和低延迟,适用于实时推理应用。

2019年,Habana推出了Gaudi训练处理器,旨在高效扩展大规模深度学习训练。Gaudi采用专用架构,集成了以太网网络,使多个芯片无需外部交换机即可直接连接,从而降低了大型集群的成本和复杂性。该设计尤其针对数据中心运营商,他们需要训练日益庞大的神经网络,例如用于自然语言处理和计算机视觉的模型。

英特尔收购

英特尔于2019年12月16日宣布以约20亿美元收购Habana Labs,交易于2020年初完成。英特尔将Habana整合到其数据平台事业部,该部门后来重组为加速计算系统和图形事业部(AXG)。此次收购是英特尔在AI加速器市场竞争战略的一部分,该市场此前由NVIDIA的GPU主导。英特尔此前曾于2016年收购另一家AI芯片初创公司Nervana Systems,但该项目最终被放弃,转而采用Habana的技术。时任英特尔首席执行官Bob Swan表示,Habana的产品将补充英特尔现有产品组合,帮助公司满足日益增长的AI计算需求。

收购后,Habana继续作为子公司运营,创始人和工程师团队保持不变。该部门保留了以色列总部,并扩大了工程团队。英特尔还投资开发软件工具和框架以支持Habana硬件,包括与TensorFlow和PyTorch等主流机器学习框架的集成。

产品与架构

Intel Habana Labs的主要产品是Gaudi和Greco处理器。Gaudi专为大规模深度学习模型训练而设计,Greco则针对推理任务优化。两者均基于自定义架构,包含通用CPU核心、专用AI计算引擎和高带宽内存的混合。Gaudi处理器于2020年首次发布,配备32 GB片上内存,支持通过以太网在单个集群中连接多达8000个Gaudi处理器。第二代Gaudi 2于2022年推出,提升了性能并增加了对更大模型(包括具有数十亿参数的模型)的支持。

Greco推理处理器于2021年推出,专为低延迟、高吞吐量推理工作负载而设计。它支持流行的深度学习模型,如transformer,这是GPT-4和BERT等大型语言模型的基础。Greco提供多种形态,包括PCIe卡和模块化系统,以适应不同的数据中心部署。

Intel Habana Labs还提供名为SynapseAI的软件栈,包括编译器、运行时库和用于在Habana硬件上优化模型的工具。SynapseAI支持ONNX和常见框架,使开发人员能以最小改动移植模型。该软件旨在自动优化图执行和内存使用,减少手动调优的需求。

市场地位与竞争

AI加速器市场竞争激烈,主要参与者包括NVIDIA、AMD,以及Amazon Web Services(AWS)的Trainium芯片和Google Cloud的TPU等云提供商。Intel Habana Labs旨在通过成本效率和可扩展性实现差异化,尤其适用于数据中心的大规模训练。Gaudi的集成以太网网络是一个关键卖点,因为它减少了对NVIDIA NVLink和InfiniBand解决方案所使用的昂贵InfiniBand交换机的需求。英特尔还将Habana定位为更开放的替代方案,支持行业标准的以太网和PCIe接口。

尽管具有这些优势,Intel Habana Labs在市场份额获取方面仍面临挑战。NVIDIA的CUDA软件生态系统根深蒂固,许多AI开发人员已习惯使用。英特尔尝试通过提供兼容层和迁移工具来解决这一问题,但采用速度低于最初预期。截至2024年,Intel Habana Labs对英特尔整体数据中心业务的收入贡献仍然有限,但该部门已获得包括云服务提供商和研究机构在内的多个重要客户。

在英特尔中的战略角色

Intel Habana Labs是英特尔更广泛AI战略的关键组成部分,该战略还包括2024年宣布的Intel Gaudi 3处理器的开发。Gaudi 3预计将与NVIDIA的H100和H200 GPU直接竞争,以更低成本提供相当的性能。英特尔还将Habana技术集成到其Xeon处理器中,使通用CPU能够实现AI加速。该部门与英特尔代工服务(为外部客户制造芯片)以及英特尔软件团队密切合作,确保与oneAPI(异构计算的统一编程模型)兼容。

英特尔对Habana的投资反映了其信念,即AI工作负载将日益需要专用硬件,并且公司可以利用其制造和封装专长生产具有竞争力的AI加速器。然而,英特尔近年来面临制造挑战,包括7nm和5nm工艺节点的延迟,影响了Gaudi芯片的生产。截至2024年,英特尔已将部分Habana处理器生产外包给台积电(TSMC),以满足需求。

影响与未来展望

Intel Habana Labs通过提供GPU系统的替代方案,推动了AI硬件的进步,尤其适合优先考虑成本效率和可扩展性的组织。该部门对基于以太网的网络的关注影响了其他AI芯片设计者,如Groq和SambaNova,它们也采用了类似方法。英特尔对Habana的持续投资表明,公司视AI加速器为长期增长领域,尽管面临竞争挑战。

展望未来,Intel Habana Labs预计将发布支持新兴AI工作负载(包括大型语言模型和生成式AI)的新产品。该部门还在探索将AI加速集成到边缘设备和其他形态中,扩展到数据中心之外。截至2025年,英特尔已宣布计划剥离其代工业务,这可能影响Habana芯片的制造,但该部门本身仍是英特尔AI战略的核心部分。

参见

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:ai-hardware·intel-subsidiary·semiconductor·deep-learning
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史