Intel Habana Labs es la unidad de negocio de aceleradores de inteligencia artificial de Intel Corporation, formada después de que Intel adquiriera la startup israelí de chips de IA Habana Labs en diciembre de 2019. La división desarrolla procesadores especializados diseñados para acelerar cargas de trabajo de aprendizaje automático y aprendizaje profundo, particularmente para entrenamiento e inferencia a gran escala en centros de datos. Sus líneas de productos incluyen los procesadores de entrenamiento Gaudi y los procesadores de inferencia Greco, que compiten con ofertas de NVIDIA, AMD y los silicios personalizados de los proveedores de nube, como AWS Trainium y los TPU de Google. La adquisición fue parte de la estrategia más amplia de Intel para expandirse más allá de su negocio tradicional de CPU hacia el mercado de hardware de IA en rápido crecimiento, impulsado por el auge de los modelos de lenguaje grandes y los sistemas de IA generativa desarrollados por empresas como OpenAI, Anthropic y Google DeepMind.
Habana Labs fue fundada en 2016 por David Dahan, Ran Halutz y Eitan Medina, todos veteranos de la industria de semiconductores israelí. La empresa tenía su sede en Tel Aviv, Israel, con oficinas adicionales en San José, California, y otras ubicaciones. Antes de la adquisición por Intel, Habana había recaudado un importante financiamiento de capital de riesgo, incluyendo una ronda Serie B de 75 millones de dólares en 2018 liderada por Intel Capital y WRV Capital, y una ronda Serie C de 120 millones de dólares en noviembre de 2019, solo unas semanas antes de la adquisición. La adquisición por Intel se valoró en aproximadamente 2 mil millones de dólares, lo que la convierte en una de las mayores inversiones relacionadas con IA de Intel.
Historia y Formación
Habana Labs se estableció con el objetivo de crear procesadores de IA diseñados específicamente que pudieran superar a las GPU de propósito general tanto en tareas de entrenamiento como de inferencia. Los fundadores habían trabajado anteriormente en empresas como Intel, Mellanox y Texas Instruments, y buscaban abordar las ineficiencias del uso de GPU para cargas de trabajo de IA, que a menudo requerían un consumo excesivo de energía y ancho de banda de memoria. El primer producto de la empresa, el procesador de inferencia Goya, se anunció en 2018 y demostró un rendimiento sólido en los puntos de referencia ResNet-50, un modelo de aprendizaje profundo común para la clasificación de imágenes. El chip Goya fue diseñado para ofrecer alto rendimiento con baja latencia, lo que lo hace adecuado para aplicaciones de inferencia en tiempo real.
En 2019, Habana presentó el procesador de entrenamiento Gaudi, diseñado para escalar eficientemente en el entrenamiento de aprendizaje profundo a gran escala. Gaudi presentaba una arquitectura especializada con redes Ethernet integradas, lo que permitía conectar múltiples chips directamente sin necesidad de conmutadores externos, reduciendo costos y complejidad en clústeres grandes. Este diseño estaba dirigido particularmente a operadores de centros de datos que necesitaban entrenar redes neuronales cada vez más grandes, como las utilizadas en procesamiento de lenguaje natural y visión por computadora.
Adquisición por Intel
Intel anunció la adquisición de Habana Labs el 16 de diciembre de 2019, por aproximadamente 2 mil millones de dólares. El acuerdo se completó a principios de 2020. Intel integró Habana en su Grupo de Plataformas de Datos, que luego se reorganizó en el Grupo de Sistemas y Gráficos de Computación Acelerada (AXG). La adquisición fue parte de la estrategia de Intel para competir en el mercado de aceleradores de IA, que había estado dominado por las GPU de NVIDIA. Intel había adquirido previamente Nervana Systems en 2016, otra startup de chips de IA, pero ese proyecto finalmente se descontinuó en favor de la tecnología de Habana. El CEO de Intel en ese momento, Bob Swan, declaró que los productos de Habana complementarían la cartera existente de Intel y ayudarían a la empresa a abordar la creciente demanda de cómputo de IA.
Tras la adquisición, Habana continuó operando como subsidiaria, con sus fundadores e ingenieros permaneciendo en su lugar. La división conservó su sede israelí y expandió sus equipos de ingeniería. Intel también invirtió en el desarrollo de herramientas de software y marcos de trabajo para apoyar el hardware de Habana, incluida la integración con marcos de aprendizaje automático populares como TensorFlow y PyTorch.
Productos y Arquitectura
Los productos principales de Intel Habana Labs son los procesadores Gaudi y Greco. Gaudi está diseñado para el entrenamiento de modelos de aprendizaje profundo a gran escala, mientras que Greco está optimizado para tareas de inferencia. Ambos se basan en una arquitectura personalizada que incluye una combinación de núcleos de CPU de propósito general, motores de cómputo de IA dedicados y memoria de alto ancho de banda. El procesador Gaudi, lanzado por primera vez en 2020, cuenta con 32 GB de memoria en chip y admite hasta 8,000 procesadores Gaudi en un solo clúster mediante Ethernet. La segunda generación, Gaudi 2, lanzada en 2022, mejoró el rendimiento y añadió soporte para modelos más grandes, incluidos aquellos con miles de millones de parámetros.
Greco, el procesador de inferencia, se introdujo en 2021 y está diseñado para cargas de trabajo de inferencia de baja latencia y alto rendimiento. Admite modelos de aprendizaje profundo populares como los transformadores, que son la base de modelos de lenguaje grandes como GPT-4 y BERT. Greco está disponible en varios factores de forma, incluidas tarjetas PCIe y sistemas modulares, para adaptarse a diferentes despliegues en centros de datos.
Intel Habana Labs también proporciona una pila de software llamada SynapseAI, que incluye compiladores, bibliotecas de tiempo de ejecución y herramientas para optimizar modelos en hardware Habana. SynapseAI admite ONNX y marcos comunes, lo que permite a los desarrolladores portar modelos con cambios mínimos. El software está diseñado para optimizar automáticamente la ejecución de grafos y el uso de memoria, reduciendo la necesidad de ajuste manual.
Posición en el Mercado y Competencia
El mercado de aceleradores de IA es altamente competitivo, con actores principales como NVIDIA, AMD y proveedores de nube como Amazon Web Services (AWS) con sus chips Trainium, y Google Cloud con sus TPU. Intel Habana Labs busca diferenciarse mediante eficiencia de costos y escalabilidad, particularmente para entrenamiento a gran escala en centros de datos. La red Ethernet integrada de Gaudi es un punto de venta clave, ya que reduce la necesidad de conmutadores InfiniBand costosos utilizados por las soluciones NVLink e InfiniBand de NVIDIA. Intel también ha posicionado a Habana como una alternativa más abierta, que admite interfaces estándar de la industria como Ethernet y PCIe.
A pesar de estas ventajas, Intel Habana Labs enfrenta desafíos para ganar participación de mercado. El ecosistema de software CUDA de NVIDIA está profundamente arraigado, y muchos desarrolladores de IA están acostumbrados a usarlo. Intel ha intentado abordar esto proporcionando capas de compatibilidad y herramientas para facilitar la migración, pero la adopción ha sido más lenta de lo inicialmente esperado. A partir de 2024, la contribución de ingresos de Intel Habana Labs al negocio general de centros de datos de Intel sigue siendo modesta, pero la división ha asegurado varios clientes notables, incluidos proveedores de servicios en la nube e instituciones de investigación.
Rol Estratégico en Intel
Intel Habana Labs es un componente clave de la estrategia más amplia de IA de Intel, que también incluye el desarrollo del procesador Intel Gaudi 3, anunciado en 2024. Se espera que Gaudi 3 compita directamente con las GPU H100 y H200 de NVIDIA, ofreciendo un rendimiento comparable a un costo menor. Intel también ha integrado la tecnología de Habana en sus procesadores Xeon, lo que permite la aceleración de IA en CPU de propósito general. La división trabaja estrechamente con los servicios de fundición de Intel, que fabrican chips para clientes externos, y con los equipos de software de Intel para garantizar la compatibilidad con oneAPI, un modelo de programación unificado para computación heterogénea.
La inversión de Intel en Habana refleja su creencia de que las cargas de trabajo de IA requerirán cada vez más hardware especializado, y que la empresa puede aprovechar su experiencia en fabricación y empaquetado para producir aceleradores de IA competitivos. Sin embargo, Intel ha enfrentado desafíos de fabricación en los últimos años, incluidos retrasos en sus nodos de proceso de 7nm y 5nm, que han afectado la producción de chips Gaudi. A partir de 2024, Intel ha subcontratado parte de la producción de procesadores Habana a TSMC, una importante fundición de semiconductores, para satisfacer la demanda.
Impacto y Perspectivas Futuras
Intel Habana Labs ha contribuido al avance del hardware de IA al ofrecer una alternativa a los sistemas basados en GPU, particularmente para organizaciones que priorizan la eficiencia de costos y la escalabilidad. El enfoque de la división en redes basadas en Ethernet ha influido en otros diseñadores de chips de IA, como Groq y SambaNova, que también utilizan enfoques similares. La inversión continua de Intel en Habana sugiere que la empresa ve los aceleradores de IA como un área de crecimiento a largo plazo, a pesar de los desafíos competitivos.
De cara al futuro, se espera que Intel Habana Labs lance nuevos productos que admitan cargas de trabajo emergentes de IA, incluidos modelos de lenguaje grandes e IA generativa. La división también está explorando formas de integrar la aceleración de IA en dispositivos de borde y otros factores de forma, expandiéndose más allá de los centros de datos. A partir de 2025, Intel ha anunciado planes para escindir su negocio de fundición, lo que podría afectar la fabricación de chips Habana, pero la división en sí sigue siendo una parte central de la estrategia de IA de Intel.