Decart est une entreprise technologique spécialisée dans l'infrastructure d'intelligence artificielle. L'organisation développe des solutions logicielles et matérielles conçues pour accélérer l'entraînement et l'inférence de modèles d'apprentissage automatique à grande échelle, avec un accent particulier sur l'amélioration de l'efficacité computationnelle et la réduction des coûts associés aux charges de travail d'IA. L'entreprise opère dans le contexte plus large de l'essor de l'IA générative, répondant à la demande croissante de ressources de calcul spécialisées.
Le travail de Decart recoupe plusieurs domaines clés du développement moderne de l'IA, notamment l'optimisation des architectures de transformers et le déploiement de grands modèles de langage. L'approche de l'entreprise implique souvent une collaboration étroite avec les fournisseurs de matériel pour maximiser les performances des réseaux de neurones sur des puces spécifiques, une pratique devenue de plus en plus critique à mesure que l'échelle des modèles d'IA continue de s'étendre.
Fondation et développement initial
Decart a été fondée en 2023 par Dean Leitersdorf et Moshe Shalom. L'entreprise est issue de l'écosystème de Berkeley AI Research, Leitersdorf ayant précédemment participé à des recherches académiques. Les fondateurs ont identifié un goulot d'étranglement critique dans l'industrie de l'IA : le coût computationnel immense de l'entraînement et de l'exécution des modèles de pointe. Leur objectif initial était de développer une plateforme capable d'optimiser l'exécution des modèles sur divers matériels, y compris les GPU AMD, souvent considérés comme une alternative plus rentable aux offres dominantes de Nvidia.
Au cours de sa première année, Decart a obtenu un financement important en capital-risque. En 2024, l'entreprise a annoncé un tour de financement de série A de 32 millions de dollars mené par Benchmark, une importante société de capital-risque de la Silicon Valley. Cet investissement a signalé une forte confiance du marché dans la technologie de Decart et son potentiel à perturber le paysage de l'infrastructure d'IA, alors dominé par quelques grands fournisseurs de cloud.
Technologie et produits principaux
Le produit principal de Decart est un moteur d'inférence et une plateforme d'orchestration conçus pour exécuter des modèles d'IA avec une vitesse et une efficacité exceptionnelles. La pile logicielle de l'entreprise est conçue pour être indépendante du matériel, ce qui lui permet d'optimiser les performances sur une gamme d'accélérateurs, y compris les puces AWS Trainium, les TPU Google Cloud et les accélérateurs Intel, en plus des GPU AMD. Cette flexibilité est un différenciateur clé, car elle permet aux clients d'éviter le verrouillage fournisseur et de choisir le matériel le plus rentable pour leurs besoins spécifiques.
Une réalisation notable de Decart a été le développement d'un système capable d'exécuter un modèle de génération d'images basé sur U-Net, tel que Stable Diffusion, à des vitesses significativement plus rapides que les implémentations typiques. L'entreprise a rapporté avoir atteint des vitesses d'inférence plusieurs fois supérieures à celles des principaux concurrents, en partie grâce à des techniques avancées comme le élagage de modèles et les optimisations de normalisation par lots. Cette performance a été démontrée lors d'une démonstration en direct qui exécutait un modèle texte-image sur du matériel AMD, mettant en évidence le potentiel pour des applications d'IA interactives en temps réel.
Position sur le marché et partenariats
Decart se positionne comme un challenger des fournisseurs de cloud IA établis comme Oracle Cloud et Microsoft Azure. Au lieu de construire des centres de données massifs et centralisés, la plateforme de Decart est conçue pour agréger et utiliser des ressources de calcul distribuées, y compris potentiellement des GPU de qualité grand public sous-utilisés. Cette approche vise à créer un marché de calcul plus efficace et accessible, abaissant la barrière à l'entrée pour les startups d'IA et les chercheurs.
L'entreprise a formé des partenariats stratégiques avec des fabricants de matériel pour co-optimiser son logiciel avec les nouvelles conceptions de puces. Une collaboration notable est celle avec AMD, où Decart a travaillé pour garantir que son moteur d'inférence exploite pleinement les capacités des accélérateurs de la série Instinct d'AMD. Ce partenariat s'inscrit dans une tendance industrielle plus large où les entreprises logicielles travaillent en étroite collaboration avec les concepteurs de puces pour combler l'écart de performance avec l'écosystème CUDA de Nvidia.
Impact et orientations futures
L'essor de Decart reflète un changement plus large dans l'industrie de l'IA vers l'efficacité et l'optimisation des coûts. Alors que le coût de l'entraînement et de l'exécution des modèles de IA générative a grimpé en flèche, il y a une pression croissante pour trouver des moyens de faire plus avec moins. L'accent mis par Decart sur la vitesse d'inférence est particulièrement pertinent, car les coûts d'inférence dominent souvent la dépense totale d'exploitation des services d'IA à grande échelle.
La technologie de l'entreprise a des implications pour le développement d'applications d'intelligence artificielle nécessitant des réponses en temps réel, telles que les agents interactifs, les jeux et les systèmes autonomes. En rendant l'inférence haute performance plus abordable, Decart vise à accélérer le déploiement de l'IA dans divers secteurs. En 2025, l'entreprise continue d'étendre son équipe d'ingénierie et de développer de nouvelles fonctionnalités, avec un objectif déclaré de devenir une couche fondamentale pour la prochaine génération d'applications d'IA.