Habana Labs는 데이터 센터 워크로드를 위한 인공지능(AI) 가속기를 전문으로 하는 팹리스 반도체 기업이다. 2016년 이스라엘 텔아비브에서 설립되었으며, 딥러닝 학습 및 추론 작업을 가속화하도록 설계된 프로세서를 개발하여 범용 GPU의 대안으로 자리매김하고 있다. 2019년 12월, Intel은 약 20억 달러에 Habana Labs를 인수하여 그 기술을 Intel의 AI 포트폴리오와 데이터 센터 전략에 통합했다.
이 회사의 제품 라인에는 Goya 추론 프로세서와 Gaudi 학습 프로세서가 포함된다. 2018년에 소개된 Goya는 신경망의 높은 처리량과 낮은 지연 시간 추론을 목표로 한다. 2019년에 발표된 Gaudi는 대규모 딥러닝 모델 학습을 위해 설계되었으며, 여러 가속기에서 확장성을 제공한다. Habana의 프로세서는 연산, 메모리, 네트워킹의 균형을 맞추는 특수 아키텍처를 사용하여 데이터 센터 운영자에게 핵심 고려 사항인 와트당 성능을 최적화한다.
역사와 설립
Habana Labs는 2016년 이스라엘 반도체 업계의 베테랑인 David Dahan, Ran Halutz, Eilon Reshef가 공동 설립했다. 창립자들은 이전에 Intel과 Mellanox 같은 기업에서 근무했으며, 인공지능의 증가하는 연산 수요를 해결하는 것을 목표로 했다. 이 회사는 처음에 비밀 모드로 운영되며 아키텍처를 개발하고 초기 자금을 확보했다. 2018년까지 Habana는 첫 제품인 Goya 추론 프로세서를 출시했으며, 클라우드 및 데이터 센터 배포를 위한 Intel과의 전략적 파트너십을 발표했다.
2019년 12월 Intel의 인수는 중요한 이정표였다. Intel은 약 20억 달러를 지불하여 Habana를 완전 소유 자회사로 만들었다. 이 거래는 Nvidia와 AMD에 대항하는 Intel의 AI 하드웨어 진출 확대의 일환이었다. 인수 후에도 Habana는 Intel 내에서 독립 부서로 계속 운영되었으며, 리더십은 Intel의 데이터 플랫폼 그룹에 직접 보고했다. 이 회사의 기술은 나중에 Habana의 설계로 대체된 Nervana 라인과 같은 Intel의 기존 AI 가속기를 보완하는 위치에 있었다.
제품과 기술
Habana의 프로세서는 전통적인 GPU 기반 접근 방식과 다른 맞춤형 아키텍처로 구축되었다. 2018년에 출시된 Goya 추론 프로세서는 일반적인 벤치마크인 ResNet-50 추론에서 초당 최대 15,000개의 이미지를 처리하면서 100와트 미만을 소비한다. 이러한 와트당 성능은 운영 비용을 줄이려는 클라우드 제공업체와 기업에게 Goya를 매력적으로 만들었다. 2019년에 발표된 Gaudi 학습 프로세서는 32GB의 온칩 메모리를 통합하고 이더넷을 통한 고속 상호 연결을 지원하여 여러 노드에서 효율적인 확장을 가능하게 한다.
핵심 설계 원칙은 전용 텐서 처리 코어, 프로그래밍 가능한 제어 프로세서, 고대역폭 메모리 하위 시스템을 포함하는 이기종 아키텍처의 사용이다. 이를 통해 Habana의 칩은 합성곱 및 트랜스포머 기반 신경망을 모두 처리할 수 있으며, 여기에는 대규모 언어 모델도 포함된다. 이 회사는 또한 컴파일러와 런타임을 포함한 소프트웨어 스택을 제공하여 TensorFlow 및 PyTorch와 같은 인기 프레임워크를 지원하며, 개발자 채택을 용이하게 한다.
시장 위치와 경쟁
Habana Labs는 AI 학습 및 추론의 사실상 표준이 된 Nvidia의 GPU가 지배하는 경쟁 환경에서 운영된다. Intel의 Habana 인수는 Intel의 제조 역량과 고객 관계를 활용하여 Nvidia의 지배력에 도전하는 전략적 움직임이었다. 그러나 2024년 기준으로 Habana의 시장 점유율은 AI 가속기 시장의 80% 이상을 장악한 Nvidia에 비해 여전히 미미하다. 다른 경쟁업체로는 AMD의 Instinct 라인, Cerebras의 웨이퍼 규모 프로세서, Groq의 언어 모델 추론 칩이 있다.
Habana의 차별화는 효율성과 확장성에 대한 초점에 있다. 예를 들어, 2022년에 출시된 Gaudi 2 프로세서는 대규모 언어 모델에 대해 경쟁력 있는 학습 성능을 제공하면서도 비교 가능한 GPU보다 적은 전력을 사용한다. 이는 Amazon Web Services와 같은 클라우드 서비스 제공업체의 관심을 끌었으며, 이들은 Gaudi 인스턴스를 제공하고, Azure는 Habana 가속기를 클라우드 제공에 통합했다. 이러한 성과에도 불구하고 Habana는 많은 AI 개발자가 Nvidia의 CUDA 플랫폼에 익숙하기 때문에 소프트웨어 생태계 성숙도 측면에서 어려움에 직면한다.
영향과 향후 전망
Intel의 소유 하에 Habana Labs는 특히 데이터 센터 및 엣지 컴퓨팅 분야에서 Intel의 AI 전략에 기여했다. 이 회사의 프로세서는 2024년에 발표된 Intel의 Gaudi 3에 사용되며, 생성형 AI 워크로드를 목표로 한다. Habana의 기술은 또한 생성형 AI 분야에서 Intel의 노력을 지원하며, 추론 배포를 위한 OpenAI 및 Anthropic과의 파트너십을 포함하지만, 이러한 협력은 변경될 수 있다.
앞으로 Habana는 머신 러닝 및 딥러닝 애플리케이션에 대한 증가하는 수요를 활용하여 AI 가속기 시장에서 입지를 확장하는 것을 목표로 한다. 이 회사는 Google Cloud 및 Oracle Cloud를 포함한 클라우드 제공업체와의 파트너십 및 소프트웨어 개발에 계속 투자하고 있다. 그러나 시장은 빠르게 진화하고 있으며, 트랜스포머의 부상과 같은 신규 진입자와 기술 변화로 인해 지속적인 혁신이 필요하다. 2025년 기준으로 Habana의 미래는 Intel의 제품 라인에 대한 헌신과 확립된 경쟁업체에 대한 입지 확보 능력에 달려 있다.