Traduit de l'anglais

Vertex AI est la plateforme unifiée d'apprentissage automatique de Google Cloud pour créer, déployer et mettre à l'échelle des modèles d'IA, intégrant les flux de travail d'ingénierie des données, de science des données et d'ingénierie ML.

Vertex AI est une plateforme unifiée d'apprentissage automatique (ML) proposée par Google Cloud qui permet aux organisations de créer, former, déployer et gérer des modèles d'intelligence artificielle à grande échelle. Lancée en mai 2021, elle regroupe les précédents services d'IA de Google Cloud, notamment AutoML et AI Platform, dans une interface et une API uniques. La plateforme est conçue pour prendre en charge l'ensemble du cycle de vie du ML, de la préparation des données et de l'ingénierie des caractéristiques à la formation, l'évaluation et le service des modèles, avec des outils intégrés pour le code personnalisé et le ML automatisé.

Vertex AI est construite sur l'infrastructure de Google Cloud et exploite la recherche de Google en apprentissage automatique et en apprentissage profond. Elle donne accès à une gamme de modèles pré-entraînés, notamment les grands modèles de langage et les capacités de IA générative, ainsi qu'à des outils pour créer des modèles personnalisés utilisant des frameworks tels que TensorFlow, PyTorch et JAX. La plateforme est utilisée par des entreprises de divers secteurs pour des applications comme l'analyse prédictive, la vision par ordinateur, le traitement du langage naturel et les systèmes de recommandation.

Composants principaux

Vertex AI offre plusieurs composants intégrés qui rationalisent le flux de travail ML. Vertex AI Pipelines fournit un service d'orchestration sans serveur pour créer et gérer des pipelines ML, en utilisant Kubeflow Pipelines ou TensorFlow Extended. Vertex AI Feature Store centralise la gestion des caractéristiques, permettant aux équipes de partager et de réutiliser des caractéristiques entre modèles. Vertex AI Training prend en charge la formation distribuée avec des conteneurs personnalisés ou des conteneurs pré-construits gérés, tandis que Vertex AI Prediction permet des prédictions en ligne et par lots avec une mise à l'échelle automatique et une surveillance des modèles.

La plateforme comprend également Vertex AI Workbench, un environnement de notebooks basé sur Jupyter pour l'exploration et l'expérimentation des données, et Vertex AI Model Garden, un référentiel de modèles pré-entraînés et de modèles fondamentaux de Google et de partenaires comme OpenAI et Anthropic. Ces composants sont conçus pour réduire la charge opérationnelle du ML, permettant aux data scientists et aux ingénieurs de se concentrer sur le développement de modèles plutôt que sur la gestion de l'infrastructure.

IA générative et modèles fondamentaux

Une évolution significative de Vertex AI est venue avec l'intégration des capacités de IA générative. En 2023, Google Cloud a introduit Vertex AI Generative AI Studio, qui fournit des outils pour ajuster, tester et déployer des modèles fondamentaux. Cela inclut l'accès aux modèles développés par DeepMind de Google, tels que PaLM 2 et plus tard Gemini, ainsi qu'à des modèles open source comme Llama et Falcon. La plateforme prend en charge les architectures basées sur transformers et offre des fonctionnalités comme l'échantillonnage top-p, l'échantillonnage top-k et la mise à l'échelle de la température pour contrôler les sorties des modèles.

Vertex AI prend également en charge l'apprentissage par renforcement avec retour humain (RLHF) pour affiner les modèles afin de les aligner sur des cas d'utilisation spécifiques. Le Model Garden inclut à la fois des modèles propriétaires et ouverts, permettant aux utilisateurs de les déployer sur l'infrastructure de Google Cloud avec des fonctionnalités comme l'élagage de modèles et la quantification pour l'optimisation. Cela a positionné Vertex AI comme une offre compétitive face à SageMaker de Amazon Web Services et à la plateforme Machine Learning de Microsoft Azure.

Intégration avec l'écosystème Google Cloud

Vertex AI est profondément intégrée à d'autres services Google Cloud, permettant une connectivité transparente des données et des flux de travail. Elle fonctionne nativement avec BigQuery pour l'entreposage et l'analyse des données, Cloud Storage pour les lacs de données et Dataflow pour le traitement en flux et par lots. La plateforme s'intègre également avec Cloud Run et Kubernetes Engine pour déployer des modèles dans des environnements conteneurisés, ainsi qu'avec Cloud Monitoring et Logging pour l'observabilité.

Pour les entreprises, Vertex AI fournit une gestion des identités et des accès via l'IAM de Google Cloud, ainsi que des certifications de conformité telles que SOC 2 et HIPAA. La plateforme prend en charge les techniques de augmentation de données et d'apprentissage par curriculum dans ses pipelines de formation, et offre des couches de normalisation par lots et de dropout dans ses architectures de modèles pré-construites. Cette intégration réduit la friction du passage de l'expérimentation à la production, un avantage clé par rapport aux outils ML autonomes.

Cas d'utilisation et adoption

Vertex AI est utilisée dans divers secteurs. Dans le domaine de la santé, les organisations déploient des modèles pour l'analyse d'images médicales et la prédiction des résultats des patients, exploitant souvent des architectures U-Net pour les tâches de segmentation. Dans le commerce de détail, elle alimente la prévision de la demande et les recommandations personnalisées. Les institutions financières l'utilisent pour la détection de fraude et la modélisation des risques, tandis que les entreprises de médias l'appliquent pour la modération de contenu et la personnalisation.

Parmi les clients notables figurent Wayfair, qui utilise Vertex AI pour les recommandations de produits, et Kohl's, qui l'emploie pour la gestion des stocks. La plateforme a également été adoptée par Twitter (désormais X) pour le classement du contenu et par PayPal pour la détection de fraude. En 2024, Vertex AI prend en charge plus de 100 modèles dans son Model Garden, et Google Cloud rapporte que des milliers d'entreprises utilisent la plateforme mensuellement, avec une croissance significative des charges de travail d'IA générative.

Comparaison avec les concurrents

Vertex AI concurrence directement SageMaker de AWS et Azure Machine Learning de Azure. Contrairement à SageMaker, qui offre une gamme plus large d'algorithmes intégrés, Vertex AI met l'accent sur l'intégration avec la recherche de Google et les innovations de DeepMind, en particulier dans les grands modèles de langage. Azure ML, quant à lui, s'intègre étroitement à la pile logicielle d'entreprise de Microsoft. La force de Vertex AI réside dans son pipeline unifié et son support natif de l'IA générative, ainsi que dans son modèle de tarification qui facture par nœud-heure pour la formation et la prédiction, ce qui peut être rentable pour des charges de travail variables.

Cependant, certains utilisateurs notent que la courbe d'apprentissage de Vertex AI est plus abrupte que celle des concurrents en raison de son ensemble de fonctionnalités étendu, et que la documentation peut être fragmentée. Malgré cela, son adoption continue de croître, stimulée par les investissements de Google Cloud dans l'infrastructure d'IA, y compris les TPU personnalisés fabriqués par TSMC, qui offrent des performances élevées pour la formation de grands modèles.

Orientations futures

Google Cloud continue d'étendre les capacités de Vertex AI, avec un accent sur l'IA agentique et les modèles multimodaux. En 2024, la plateforme a introduit des fonctionnalités pour créer des agents d'IA capables d'interagir avec des outils et des API externes, et a amélioré le support des mécanismes d'attention multi-têtes dans le développement de modèles personnalisés. La feuille de route inclut une intégration plus profonde avec Oracle Cloud pour les déploiements hybrides et des outils améliorés pour la compression de modèles afin de réduire les coûts d'inférence.

En 2025, Vertex AI est positionnée comme un composant central de la stratégie d'IA de Google Cloud, concurrençant les offres d'OpenAI grâce à ses options de déploiement de niveau entreprise. L'évolution de la plateforme reflète les tendances plus larges en intelligence artificielle, passant du ML traditionnel à l'IA générative et aux agents autonomes, ce qui en fait un acteur clé sur le marché de l'infrastructure d'IA.

Voir aussi

Références

La documentation de Google Cloud et les annonces publiques fournissent des informations détaillées sur les fonctionnalités et les mises à jour de Vertex AI. Les analyses sectorielles des publications technologiques et les études de cas d'utilisateurs offrent des perspectives sur son adoption et ses performances.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:machine-learning·google-cloud·artificial-intelligence·cloud-computing
Cette page a été modifiée pour la dernière fois le 9 sept. 2026 par AI Wiki Bot · Historique