Habana Labs是一家无晶圆厂半导体公司,专注于数据中心工作负载的人工智能(AI)加速器。该公司于2016年在以色列特拉维夫成立,开发旨在加速深度学习训练和推理任务的处理器,将自己定位为通用GPU的替代方案。2019年12月,英特尔以约20亿美元收购了Habana Labs,将其技术整合到英特尔的AI产品组合和数据中心战略中。
该公司的产品线包括Goya推理处理器和Gaudi训练处理器。Goya于2018年推出,面向神经网络的高吞吐量、低延迟推理。Gaudi于2019年发布,专为训练大规模深度学习模型而设计,支持跨多个加速器的可扩展性。Habana的处理器采用专用架构,平衡计算、内存和网络,以优化每瓦性能,这是数据中心运营商的关键考量因素。
历史与创立
Habana Labs于2016年由David Dahan、Ran Halutz和Eilon Reshef共同创立,三人均为以色列半导体行业的老将。创始人此前曾在英特尔和Mellanox等公司工作,旨在应对人工智能日益增长的计算需求。该公司最初以隐身模式运营,开发其架构并获取早期资金。到2018年,Habana携其首款产品Goya推理处理器亮相,并宣布与Intel建立战略合作伙伴关系,用于云和数据中心部署。
2019年12月被英特尔收购是一个重要里程碑。英特尔支付了约20亿美元,使Habana成为全资子公司。该交易是英特尔更广泛进军AI硬件的一部分,与NVIDIA和AMD竞争。收购后,Habana继续作为英特尔内的独立部门运营,其领导层直接向英特尔的数据平台集团汇报。该公司的技术被定位为补充英特尔现有的AI加速器,如Nervana系列,后者后来被淘汰,转而采用Habana的设计。
产品与技术
Habana的处理器基于定制架构构建,不同于传统的基于GPU的方法。Goya推理处理器于2018年发布,在ResNet-50推理(一个常见基准)中每秒可处理多达15,000张图像,同时功耗低于100瓦。这种每瓦性能使Goya对寻求降低运营成本的云提供商和企业具有吸引力。Gaudi训练处理器于2019年发布,集成了32GB的片上内存,并通过以太网支持高速互连,从而能够在多个节点间高效扩展。
一个关键设计原则是使用异构架构,包括专用张量处理核心、可编程控制处理器和高带宽内存子系统。这使得Habana的芯片能够处理卷积和基于变换器的神经网络,包括Large language model。该公司还提供软件栈,包括编译器和运行时,支持TensorFlow和PyTorch等流行框架,便于开发者采用。
市场地位与竞争
Habana Labs在由NVIDIA的GPU主导的竞争格局中运营,这些GPU已成为AI训练和推理的事实标准。英特尔收购Habana是挑战Nvidia主导地位的战略举措,利用英特尔的制造能力和客户关系。然而,截至2024年,Habana的市场份额与Nvidia相比仍然有限,后者控制着AI加速器市场80%以上的份额。其他竞争对手包括AMD及其Instinct系列、Cerebras及其晶圆级处理器,以及Groq及其语言模型推理芯片。
Habana的差异化在于其对效率和可扩展性的关注。例如,2022年发布的Gaudi 2处理器,在大型语言模型的训练性能上具有竞争力,同时功耗低于同类GPU。这吸引了Amazon Web Services等云服务提供商的兴趣,后者提供Gaudi实例,以及Microsoft Azure,后者已将Habana加速器集成到其云产品中。尽管取得了这些成果,Habana在软件生态系统成熟度方面仍面临挑战,因为许多AI开发者习惯于Nvidia的CUDA平台。
影响与未来展望
在英特尔的拥有下,Habana Labs为英特尔的AI战略做出了贡献,特别是在数据中心和边缘计算领域。该公司的处理器用于2024年发布的英特尔Gaudi 3,该产品面向生成式AI工作负载。Habana的技术还支持英特尔在Generative AI方面的努力,与OpenAI和Anthropic合作进行推理部署,尽管这些合作可能会发生变化。
展望未来,Habana旨在扩大其在AI加速器市场的影响力,利用对Machine learning和Deep learning应用日益增长的需求。该公司继续投资于软件开发以及与云提供商的合作,包括Google Cloud和Oracle Cloud Infrastructure。然而,市场正在快速演变,新进入者和技术变革(如Transformer (architecture)架构的兴起)要求持续创新。截至2025年,Habana的未来取决于英特尔对该产品线的承诺及其在成熟竞争对手中取得进展的能力。