Groq, Inc. est une entreprise américaine d'intelligence artificielle qui conçoit et vend des circuits intégrés spécifiques à une application (ASIC) accélérateurs d'IA, ainsi que des logiciels associés, pour accélérer l'inférence d'IA. L'architecture de l'entreprise a été initialement introduite sous le nom de Tensor Streaming Processor (TSP), mais a ensuite été rebaptisée Language Processing Unit (LPU) suite à l'adoption généralisée des grands modèles de langage après la percée de ChatGPT. La LPU de Groq est conçue pour exécuter des charges de travail d'IA telles que les grands modèles de langage, la classification d'images et l'analyse prédictive avec des performances et une efficacité élevées.
Basée à Mountain View, en Californie, Groq maintient également des bureaux à San Jose, en Californie ; Liberty Lake, dans l'État de Washington ; Toronto, au Canada ; et Londres, au Royaume-Uni, avec des employés à distance à travers l'Amérique du Nord et l'Europe. En décembre 2025, Nvidia et Groq ont annoncé un accord évalué à environ 20 milliards de dollars américains pour concéder sous licence la technologie d'inférence d'IA de Groq et transférer plusieurs cadres supérieurs de Groq à Nvidia, tandis que Groq a déclaré qu'elle continuerait à opérer en tant qu'entreprise indépendante.
Historique
Groq a été fondée en 2016 par un groupe d'anciens ingénieurs de Google, dirigé par Jonathan Ross, l'un des concepteurs de la Tensor Processing Unit (TPU), et Douglas Wightman, entrepreneur et ancien ingénieur chez Google X, qui a servi comme premier PDG de l'entreprise. L'entreprise a reçu un financement d'amorçage de Chamath Palihapitiya de Social Capital avec un investissement de 10 millions de dollars en 2017, suivi de financements supplémentaires.
En avril 2021, Groq a levé 300 millions de dollars lors d'un tour de série C mené par Tiger Global Management et D1 Capital Partners, valorisant l'entreprise à plus d'un milliard de dollars et en faisant une licorne. Les investisseurs actuels incluent Infinitum, The Spruce House Partnership, Addition, GCM Grosvenor, Xⁿ, Firebolt Ventures, General Global Capital et Tru Arrow Partners, avec des investissements de suivi d'Infinitum, TDK Ventures et XTX Ventures.
Le 1er mars 2022, Groq a acquis Maxeler Technologies, une entreprise connue pour ses technologies de systèmes de flux de données. Maxeler a conservé sa marque en raison des réalisations de longue date du Dr Oskar Mencer et de son équipe.
Le 16 août 2023, Groq a sélectionné la fonderie de Samsung Electronics à Taylor, au Texas, pour fabriquer ses puces de nouvelle génération sur le nœud de processus de 4 nanomètres (nm) de Samsung, marquant la première commande dans cette nouvelle usine.
Le 19 février 2024, Groq a lancé en douceur une plateforme pour développeurs, GroqCloud, pour attirer les développeurs à utiliser l'API Groq et à louer l'accès à ses puces. Le 1er mars 2024, Groq a acquis Definitive Intelligence, une startup proposant des solutions d'IA orientées entreprises, pour soutenir sa plateforme cloud.
En août 2024, Groq a levé 640 millions de dollars lors d'un tour de série D mené par BlackRock Private Equity Partners, valorisant l'entreprise à 2,8 milliards de dollars. Le 10 février 2025, Groq a annoncé un engagement de 1,5 milliard de dollars américains du Royaume d'Arabie saoudite pour étendre la livraison de son infrastructure d'inférence d'IA basée sur LPU, lié à un nouveau centre de données GroqCloud à Dammam, en Arabie saoudite. En 2025, Groq avait établi une douzaine de centres de données à travers les États-Unis, le Canada, le Moyen-Orient et l'Europe.
En décembre 2025, Nvidia a accepté d'acheter des actifs de Groq pour environ 20 milliards de dollars américains, un record pour Nvidia. Groq a décrit l'accord comme un accord de licence non exclusif. Dans le cadre de l'accord, le fondateur de Groq, Jonathan Ross, et le président Sunny Madra rejoindraient Nvidia. En mai 2026, Groq aurait levé 650 millions de dollars auprès d'investisseurs existants pour financer sa transition vers une entreprise cloud d'inférence d'IA, le tour étant structuré comme une offre au prorata soutenue par les investisseurs Disruptive et Infinitum.
Language Processing Unit
L'ASIC de Groq a été initialement nommé Tensor Streaming Processor (TSP), avec le nom de code « Alan », mais a ensuite été rebaptisé par Mark Heaps, vice-président de la marque, et Jonathan Ross, PDG et fondateur, en Language Processing Unit (LPU) pour rendre la nature du processeur plus évidente.
La LPU présente une microarchitecture fonctionnellement découpée, où les unités de mémoire sont entrelacées avec des unités de calcul vectoriel et matriciel. Cette conception facilite l'exploitation de la localité des flux de données dans les graphes de calcul d'IA, améliorant les performances et l'efficacité d'exécution. La LPU a été conçue sur la base de deux observations clés : les charges de travail d'IA présentent un parallélisme de données substantiel qui peut être mappé sur du matériel spécialisé, et une conception de processeur déterministe couplée à un modèle de programmation producteur-consommateur permet un contrôle et un raisonnement précis sur les composants matériels, optimisant les performances et l'efficacité énergétique.
La LPU possède également une architecture monocœur et déterministe. Elle évite les composants matériels réactifs traditionnels tels que les prédicteurs de branchement, les arbitres, les tampons de réorganisation et les caches, toute l'exécution étant explicitement contrôlée par le compilateur, garantissant une exécution déterministe d'un programme LPU.
La première génération de la LPU (TSP) produit une densité de calcul de plus de 1 TeraOp/s par millimètre carré de silicium pour sa puce 14 nm de 25×29 mm fonctionnant à une fréquence d'horloge nominale de 900 MHz. La deuxième génération (LPU v2) est fabriquée sur le nœud de processus 4 nm de Samsung.
Groq héberge des grands modèles de langage open source fonctionnant sur ses LPU pour un accès public, disponibles via le site Web de Groq et son terrain de jeu pour développeurs.
Plateforme GroqCloud
GroqCloud est la plateforme pour développeurs de l'entreprise qui fournit un accès API à ses services d'inférence basés sur LPU. Lancée en février 2024, elle permet aux développeurs de louer l'accès aux puces de Groq et d'intégrer l'inférence d'IA dans leurs applications. La plateforme prend en charge divers grands modèles de langage et a joué un rôle déterminant dans l'attraction d'une communauté de développeurs.
Financement et valorisation
L'historique de financement de Groq comprend un investissement d'amorçage de 10 millions de dollars en 2017, un tour de série C de 300 millions de dollars en avril 2021 (valorisant l'entreprise à plus d'un milliard de dollars) et un tour de série D de 640 millions de dollars en août 2024 (valorisant l'entreprise à 2,8 milliards de dollars). En février 2025, l'entreprise a obtenu un engagement de 1,5 milliard de dollars américains de l'Arabie saoudite. En mai 2026, Groq aurait levé 650 millions de dollars auprès d'investisseurs existants pour financer sa transition vers une entreprise cloud d'inférence d'IA.
Partenariats et fabrication
Groq a sélectionné la fonderie de Samsung Electronics à Taylor, au Texas, pour la fabrication de ses puces de nouvelle génération sur un nœud de processus 4 nm, un partenariat qui a commencé en août 2023. L'entreprise a également collaboré avec diverses organisations pour déployer sa technologie dans plusieurs centres de données à travers le monde.
Voir aussi
- Unité centrale de traitement
- Unité de traitement graphique
- Unité de traitement tensoriel
Références
Cet article est basé sur des informations provenant de sources publiques, y compris les annonces de l'entreprise et les communiqués de presse.