Le lancement des GPTs d'OpenAI, annoncé en novembre 2023, a introduit une nouvelle fonctionnalité dans ChatGPT permettant aux utilisateurs de créer des versions personnalisées de l'assistant IA, appelées GPTs. Ces assistants sur mesure pouvaient être conçus pour des fins spécifiques, comme des conseils culinaires, de l'aide à la programmation ou du tutorat éducatif, sans nécessiter de compétences en programmation. Ce lancement a marqué une étape significative dans la démocratisation et la personnalisation de l'IA générative, s'appuyant sur les capacités du grand modèle de langage GPT-4.
Les GPTs reposaient sur l'architecture Transformer (architecture) existante d'OpenAI, affinée au fil des itérations successives de la série GPT. Le lancement a suivi la sortie de GPT-4 en mars 2023, qui avait déjà démontré des capacités avancées de traitement de texte et d'images. En permettant aux utilisateurs de personnaliser les invites, les instructions et même les sources de données externes, OpenAI visait à étendre l'utilité de son IA au-delà des réponses génériques, favorisant une communauté d'assistants spécialisés partagés.
Contexte
OpenAI a introduit le premier modèle GPT en 2018, basé sur l'architecture Transformer (architecture), développée par des chercheurs tels que Jakob Uszkoreit et Lukasz Kaiser. Les modèles suivants, comme GPT-2 en 2019 et GPT-3 en 2020, ont gagné en échelle et en capacité, GPT-3 comportant plus de 100 fois plus de paramètres que son prédécesseur. GPT-3.5, sorti en 2022, a alimenté le produit initial ChatGPT, qui a attiré une large attention pour ses capacités conversationnelles.
En 2023, OpenAI avait publié GPT-4, un modèle multimodal capable de traiter à la fois du texte et des images. Le lancement des GPTs s'est appuyé sur cette base, offrant une interface conviviale pour personnaliser le comportement du modèle. Contrairement aux versions antérieures, qui exigeaient une expertise technique pour le réglage fin, les GPTs pouvaient être créés via un simple processus de configuration basé sur le chat, abaissant la barrière pour les non-programmeurs.
Fonctionnalités et capacités
Le lancement des GPTs permettait aux utilisateurs de définir des instructions personnalisées, de sélectionner des sources de connaissances spécifiques et d'activer des actions telles que la navigation web ou la génération d'images. Chaque GPT pouvait être partagé publiquement ou rester privé, et OpenAI a introduit une boutique de GPTs où les créateurs pouvaient publier leurs assistants. La boutique, lancée en janvier 2024, présentait des catégories comme l'éducation, la productivité et le divertissement, certains GPTs populaires attirant des milliers d'utilisateurs.
Les GPTs étaient propulsés par GPT-4, qui avait une fenêtre de contexte par défaut de 8K tokens, avec une version API supportant jusqu'à 32K tokens. En novembre 2023, OpenAI a également annoncé GPT-4 Turbo, doté d'une fenêtre de contexte de 128K tokens et d'un prix réduit, rendant plus réalisables les assistants personnalisés complexes. La capacité d'intégrer des API externes permettait aux GPTs d'effectuer des tâches comme la réservation, l'interrogation de bases de données ou l'analyse de documents téléchargés.
Impact sur l'écosystème de l'IA
Le lancement des GPTs a accéléré la tendance vers des applications d'IA spécialisées, dépassant les chatbots à usage général. Il a encouragé les développeurs tiers à construire sur la plateforme d'OpenAI, à l'instar d'Amazon Web Services et de Google Cloud qui ont favorisé l'innovation basée sur le cloud. Cependant, il a aussi soulevé des préoccupations concernant la modération du contenu, certains utilisateurs créant des GPTs violant les politiques d'OpenAI, ce qui a conduit à des ajustements dans le processus de revue de la boutique.
Les concurrents ont répondu en développant des fonctionnalités de personnalisation similaires. Par exemple, Anthropic et Google DeepMind ont introduit leurs propres options de personnalisation d'assistants, tandis que les communautés open source ont exploré des alternatives. Le lancement des GPTs a également souligné l'importance croissante des grands modèles de langage dans les outils quotidiens, influençant les stratégies de produits dans toute l'industrie technologique.
Détails techniques
OpenAI n'a pas divulgué l'architecture précise ni les détails d'entraînement de GPT-4, invoquant des préoccupations de concurrence et de sécurité. Le rapport technique mentionnait que le modèle avait été entraîné par apprentissage supervisé sur un grand ensemble de données, suivi d'un apprentissage par renforcement à partir de retours humains (RLHF). Le coût d'entraînement de GPT-4 était estimé à plus de 100 millions de dollars, selon le PDG Sam Altman.
Les GPTs exploitaient le même modèle sous-jacent mais ajoutaient une couche de personnalisation via des invites système et des connaissances définies par l'utilisateur. Cette approche permettait une itération rapide sans réentraîner le modèle de base, une technique devenue courante dans l'industrie. Le lancement a également introduit des outils pour les développeurs afin de tester et d'affiner leurs GPTs, notamment un mode aperçu et des fonctionnalités de débogage.
Réception et critiques
Le lancement des GPTs a reçu des réactions mitigées. Les partisans ont salué sa démocratisation de l'IA, permettant aux non-experts de créer des outils utiles. Les critiques, cependant, ont souligné des risques potentiels, comme la propagation de désinformation ou la création d'assistants biaisés. Des études avaient montré que GPT-4 pouvait présenter des biais cognitifs, notamment un biais de confirmation et un ancrage, qui pouvaient être amplifiés dans des GPTs personnalisés s'ils n'étaient pas soigneusement conçus.
En termes de performance, GPT-4 avait démontré de fortes capacités sur des tests standardisés, se classant dans le top 1% pour l'originalité dans des tâches de pensée créative. Cependant, il présentait aussi des limites, comme une tendance à halluciner et un manque de transparence dans la prise de décision. Ces problèmes persistaient dans les GPTs, suscitant des appels à de meilleures mesures de sécurité et à une éducation des utilisateurs.
Héritage
Le lancement des GPTs d'OpenAI a représenté un jalon dans l'évolution des applications d'intelligence artificielle, déplaçant l'attention des capacités brutes du modèle vers une personnalisation centrée sur l'utilisateur. Il a influencé les développements ultérieurs, notamment la sortie de GPT-4o en mai 2024, qui offrait un traitement multimodal en temps réel. Le concept d'assistants IA personnalisables est depuis devenu une fonctionnalité standard sur de nombreuses plateformes d'IA, façonnant l'avenir de l'interaction homme-machine.