Intel Habana Labsは、Intel Corporationの人工知能アクセラレータ事業部門であり、2019年12月にIntelがイスラエルのAIチップスタートアップであるHabana Labsを買収した後に設立された。この部門は、機械学習および深層学習のワークロード、特にデータセンターにおける大規模なトレーニングと推論を加速するために設計された専用プロセッサを開発している。製品ラインには、GaudiトレーニングプロセッサとGreco推論プロセッサが含まれ、これらはNVIDIA、AMD、およびAWS TrainiumやGoogleのTPUなどのクラウドプロバイダーのカスタムシリコンと競合している。この買収は、Intelが従来のCPU事業を超えて急速に成長するAIハードウェア市場に拡大するという広範な戦略の一部であり、この市場はOpenAI、Anthropic、Google DeepMindなどの企業によって開発された大規模言語モデルと生成AIシステムの台頭によって牽引されてきた。
Habana Labsは、イスラエルの半導体業界のベテランであるDavid Dahan、Ran Halutz、Eitan Medinaによって2016年に設立された。同社はイスラエルのテルアビブに本社を置き、カリフォルニア州サンノゼやその他の場所にもオフィスを構えていた。Intelによる買収以前、Habanaは重要なベンチャーキャピタル資金を調達しており、2018年にはIntel CapitalとWRV Capitalが主導する7500万ドルのシリーズBラウンド、そして買収の数週間前の2019年11月には1億2000万ドルのシリーズCラウンドを含んでいた。Intelによる買収額は約20億ドルと評価され、IntelのAI関連投資の中で最大級のものとなった。
歴史と設立
Habana Labsは、トレーニングと推論の両方のタスクにおいて汎用GPUを上回る性能を発揮できる、目的特化型AIプロセッサを創り出すことを目的として設立された。創業者たちは以前、Intel、Mellanox、Texas Instrumentsなどの企業で働いており、AIワークロードにGPUを使用する際の非効率性、特に過剰な電力とメモリ帯域幅を必要とする問題に対処することを目指していた。同社の最初の製品であるGoya推論プロセッサは2018年に発表され、画像分類の一般的な深層学習モデルであるResNet-50ベンチマークで強力な性能を示した。Goyaチップは、高スループットと低レイテンシを実現するように設計されており、リアルタイム推論アプリケーションに適していた。
2019年、Habanaは大規模な深層学習トレーニング向けに効率的にスケールするように設計されたGaudiトレーニングプロセッサを発表した。Gaudiは、統合されたイーサネットネットワーキングを備えた専用アーキテクチャを特徴としており、複数のチップを外部スイッチなしで直接接続できるため、大規模クラスターにおけるコストと複雑さを削減した。この設計は、自然言語処理やコンピュータビジョンで使用されるような、ますます大規模化するニューラルネットワークをトレーニングする必要があるデータセンター事業者を特にターゲットにしていた。
Intelによる買収
Intelは2019年12月16日に、約20億ドルでHabana Labsの買収を発表した。この取引は2020年初頭に完了した。IntelはHabanaをデータプラットフォームグループに統合し、後にアクセラレーテッドコンピューティングシステムおよびグラフィックスグループ(AXG)に再編された。この買収は、NVIDIAのGPUが支配していたAIアクセラレータ市場で競争するというIntelの戦略の一部であった。Intelは以前、2016年に別のAIチップスタートアップであるNervana Systemsを買収していたが、そのプロジェクトは最終的にHabanaの技術を優先して中止された。当時のIntel CEOであるBob Swanは、Habanaの製品がIntelの既存ポートフォリオを補完し、AIコンピュートへの需要増大に対処するのに役立つと述べた。
買収後、Habanaは子会社として運営を継続し、創業者とエンジニアはそのまま留まった。この部門はイスラエルの本社を維持し、エンジニアリングチームを拡大した。Intelはまた、TensorFlowやPyTorchなどの一般的な機械学習フレームワークとの統合を含む、Habanaのハードウェアをサポートするソフトウェアツールとフレームワークの開発にも投資した。
製品とアーキテクチャ
Intel Habana Labsの主要製品は、GaudiプロセッサとGrecoプロセッサである。Gaudiは大規模な深層学習モデルのトレーニング用に設計されており、Grecoは推論タスク用に最適化されている。両方とも、汎用CPUコア、専用AIコンピュートエンジン、高帯域幅メモリの組み合わせを含むカスタムアーキテクチャに基づいている。2020年に初めてリリースされたGaudiプロセッサは、32 GBのオンチップメモリを備え、イーサネットを介して単一クラスター内で最大8,000個のGaudiプロセッサをサポートする。2022年に発売された第2世代のGaudi 2は、性能を向上させ、数十億のパラメータを持つモデルを含む大規模モデルのサポートを追加した。
推論プロセッサであるGrecoは2021年に導入され、低レイテンシ、高スループットの推論ワークロード用に設計されている。GPT-4やBERTなどの大規模言語モデルの基盤となるトランスフォーマーなどの一般的な深層学習モデルをサポートしている。Grecoは、PCIeカードやモジュラーシステムなど、さまざまなフォームファクタで提供され、さまざまなデータセンター展開に適合する。
Intel Habana Labsはまた、SynapseAIと呼ばれるソフトウェアスタックを提供しており、これにはHabanaハードウェア上でモデルを最適化するためのコンパイラ、ランタイムライブラリ、ツールが含まれる。SynapseAIはONNXおよび一般的なフレームワークをサポートしており、開発者は最小限の変更でモデルを移植できる。このソフトウェアは、グラフ実行とメモリ使用量を自動的に最適化するように設計されており、手動調整の必要性を減らす。
市場での位置づけと競争
AIアクセラレータ市場は非常に競争が激しく、主要プレーヤーにはNVIDIA、AMD、およびTrainiumチップを備えたAmazon Web Services(AWS)やTPUを備えたGoogle Cloudなどのクラウドプロバイダーが含まれる。Intel Habana Labsは、特にデータセンターにおける大規模トレーニングにおいて、コスト効率とスケーラビリティを通じて差別化を図ることを目指している。Gaudiの統合イーサネットネットワーキングは、NVIDIAのNVLinkおよびInfiniBandソリューションで使用される高価なInfiniBandスイッチの必要性を減らすため、重要なセールスポイントである。Intelはまた、業界標準のイーサネットおよびPCIeインターフェースをサポートする、よりオープンな代替案としてHabanaを位置づけている。
これらの利点にもかかわらず、Intel Habana Labsは市場シェアを獲得する上で課題に直面している。NVIDIAのCUDAソフトウェアエコシステムは深く根付いており、多くのAI開発者がそれを使用することに慣れている。Intelは、移行を容易にするための互換性レイヤーとツールを提供することでこれに対処しようとしているが、採用は当初の期待よりも遅い。2024年時点で、Intel Habana LabsのIntelのデータセンター事業全体への収益貢献は依然として控えめであるが、この部門はクラウドサービスプロバイダーや研究機関を含むいくつかの注目すべき顧客を確保している。
Intelにおける戦略的役割
Intel Habana Labsは、2024年に発表されたIntel Gaudi 3プロセッサの開発を含む、Intelの広範なAI戦略の重要な構成要素である。Gaudi 3は、NVIDIAのH100およびH200 GPUと直接競合し、同等の性能をより低コストで提供することが期待されている。Intelはまた、Habana技術をXeonプロセッサに統合し、汎用CPUでのAIアクセラレーションを可能にしている。この部門は、外部顧客向けにチップを製造するIntelのファウンドリサービス、および異種コンピューティング用の統一プログラミングモデルであるoneAPIとの互換性を確保するIntelのソフトウェアチームと緊密に連携している。
IntelのHabanaへの投資は、AIワークロードがますます専用ハードウェアを必要とするようになり、同社が製造およびパッケージングの専門知識を活用して競争力のあるAIアクセラレータを生産できるという信念を反映している。しかし、Intelは近年、7nmおよび5nmプロセスノードの遅延を含む製造上の課題に直面しており、これがGaudiチップの生産に影響を与えている。2024年時点で、Intelは需要を満たすために、Habanaプロセッサの一部の生産を主要な半導体ファウンドリであるTSMCに外注している。
影響と今後の見通し
Intel Habana Labsは、特にコスト効率とスケーラビリティを優先する組織向けに、GPUベースのシステムに代わる選択肢を提供することで、AIハードウェアの進歩に貢献してきた。この部門のイーサネットベースのネットワーキングへの焦点は、同様のアプローチを使用するGroqやSambaNovaなどの他のAIチップ設計者に影響を与えた。IntelのHabanaへの継続的な投資は、競争上の課題にもかかわらず、同社がAIアクセラレータを長期的な成長分野と見なしていることを示唆している。
今後、Intel Habana Labsは、大規模言語モデルや生成AIを含む新興AIワークロードをサポートする新製品をリリースすることが期待されている。この部門はまた、データセンターを超えて、エッジデバイスやその他のフォームファクタへのAIアクセラレーションの統合を模索している。2025年時点で、Intelはファウンドリ事業のスピンオフ計画を発表しており、これがHabanaチップの製造に影響を与える可能性があるが、部門自体はIntelのAI戦略の中核部分であり続けている。