Graphcore Limited est une entreprise britannique de semi-conducteurs qui développe des accélérateurs pour l'IA et l'apprentissage automatique. Son produit phare, l'Intelligence Processing Unit (IPU), est un processeur massivement parallèle conçu pour contenir l'intégralité du modèle d'apprentissage automatique dans la puce, réduisant ainsi le besoin de déplacements constants de données entre la mémoire et le calcul. L'entreprise a été fondée en 2016 et est devenue un acteur notable dans le domaine du matériel d'IA avant d'être acquise par SoftBank Group en 2024.
L'architecture de l'IPU diffère des GPU traditionnels en utilisant un grand nombre de petits cœurs de traitement, appelés tuiles, chacun avec sa propre mémoire locale. Cette conception permet un accès à haute bande passante et à faible latence aux paramètres et activations du modèle, ce qui est particulièrement adapté aux charges de travail de apprentissage profond telles que l'entraînement et l'inférence de modèles de langage de grande taille. Graphcore a également développé la pile logicielle Poplar pour prendre en charge les frameworks d'apprentissage automatique populaires comme TensorFlow et PyTorch.
Historique
Graphcore a été fondée en 2016 par Simon Knowles et Nigel Toon, tous deux vétérans de l'industrie des semi-conducteurs. L'entreprise a rapidement attiré du capital-risque, avec un premier tour de financement mené par Robert Bosch Venture Capital à l'automne 2016, et un soutien supplémentaire de Samsung, Amadeus Capital Partners, C4 Ventures, Draper Esprit, Foundation Capital et Pitango. En juillet 2017, un tour de série B mené par Atomico a été suivi de 50 millions de dollars de Sequoia Capital. En décembre 2018, Graphcore a clôturé une série D de 200 millions de dollars à une valorisation de 1,7 milliard de dollars, faisant de l'entreprise une licorne, avec des investisseurs dont Microsoft, Samsung et Dell Technologies.
En novembre 2019, Graphcore a annoncé que ses cartes C2 IPU étaient disponibles en aperçu sur Microsoft Azure, marquant un déploiement cloud significatif. Début 2023, Meta Platforms a acquis l'équipe de technologie de mise en réseau IA de Graphcore, bien que l'entreprise ait poursuivi ses opérations principales. En juillet 2024, SoftBank Group a accepté d'acquérir Graphcore pour environ 500 millions de dollars, un accord qui était en cours d'examen par l'unité de sécurité des investissements du département des Affaires du Royaume-Uni.
Produits et technologie
La première annonce de produit de Graphcore est venue en 2016 avec la pile logicielle Poplar, décrite comme la première chaîne d'outils graphiques au monde pour l'intelligence machine. En juillet 2017, l'entreprise a dévoilé sa première puce, le Colossus GC2, un processeur à virgule flottante massivement parallèle, à précision mixte, de 16 nm, devenu disponible en 2018. Le GC2 était conditionné en deux puces sur une seule carte PCI Express, appelée Graphcore C2 IPU, conçue pour jouer le même rôle qu'un GPU en conjonction avec les frameworks d'apprentissage automatique standard. Le dispositif repose sur une mémoire de type bloc-notes pour les performances plutôt que sur des hiérarchies de cache traditionnelles.
En juillet 2020, Graphcore a introduit son processeur de deuxième génération, le GC200, construit en utilisant le processus FinFET 7nm de TSMC. Le GC200 est un circuit intégré de 59 milliards de transistors, de 823 millimètres carrés, avec 1 472 cœurs de calcul et 900 Mo de mémoire locale. En 2022, Graphcore et TSMC ont présenté le Bow IPU, un package 3D d'une puce GC200 soudée face à face à une puce de distribution d'énergie, permettant des fréquences d'horloge plus élevées à une tension de cœur plus basse. L'entreprise a également esquissé un objectif à long terme appelé la « bonne machine », nommée d'après I.J. Good, qui soutiendrait des modèles d'IA avec plus de paramètres que le cerveau humain n'a de synapses.
Détails de l'architecture
Les puces GC2 et GC200 prennent en charge 6 threads par tuile, produisant respectivement 7 296 et 8 832 threads. L'architecture utilise le parallélisme MIMD (Multiple Instruction, Multiple Data), avec une mémoire locale distribuée comme seule forme de mémoire sur le dispositif (sauf pour les registres). La puce GC2 plus ancienne a 256 Ko par tuile, tandis que le GC200 plus récent a environ 630 Ko par tuile, organisés en îlots de 4 tuiles, eux-mêmes organisés en colonnes ; la latence est la meilleure au sein d'une tuile. L'IPU prend en charge le FP16 IEEE avec arrondi stochastique, et le FP32 en simple précision à des performances inférieures. Le code et les données exécutés localement doivent tenir dans une tuile, mais le passage de messages permet d'utiliser toute la mémoire sur puce ou hors puce, et les logiciels pour l'IA rendent cela transparent, y compris la prise en charge de PyTorch.
Position sur le marché et impact
Graphcore s'est positionnée comme un challenger de Nvidia sur le marché des accélérateurs d'IA, en se concentrant sur une architecture unique qui diffère à la fois des GPU et d'autres puces d'IA comme celles de Cerebras ou Groq. Son IPU était particulièrement destiné à l'entraînement et à l'inférence de modèles de réseaux neuronaux, avec des adoptants précoces incluant Microsoft Azure et diverses institutions de recherche. L'acquisition par SoftBank en 2024 a été perçue comme une décision stratégique pour renforcer les ambitions d'IA de SoftBank, bien que l'accord ait fait face à un examen réglementaire au Royaume-Uni. La technologie de Graphcore continue d'être utilisée dans des environnements cloud et d'entreprise, et sa pile logicielle reste un domaine de développement actif.
Voir aussi
- Accélérateur d'IA
- Réseau de processeurs massivement parallèles