Traduit de l'anglais

Anthropic est une entreprise américaine d'intelligence artificielle fondée en 2021 par d'anciens chercheurs d'OpenAI, axée sur la sécurité de l'IA et le développement de la série de grands modèles de langage Claude.

Anthropic est une entreprise américaine d'intelligence artificielle fondée en 2021 par d'anciens chercheurs d'OpenAI. L'entreprise se concentre sur le développement de systèmes d'intelligence artificielle sûrs et interprétables, avec un accent particulier sur l'alignement du comportement de l'IA avec les intentions humaines. Son produit principal est la famille Claude de grands modèles de langage, utilisée dans diverses applications, notamment les assistants conversationnels, l'aide à la programmation et l'analyse de données d'entreprise. Anthropic a son siège social à San Francisco, en Californie, et est devenue l'une des principales organisations indépendantes de recherche en IA, en concurrence avec des entreprises telles qu'OpenAI et Google DeepMind.

L'entreprise a été créée en réponse aux préoccupations concernant la sécurité et les implications éthiques de l'IA avancée. Ses fondateurs, dont Dario Amodei et Daniela Amodei, occupaient auparavant des postes de direction chez OpenAI, où ils ont travaillé sur des modèles comme GPT-2 et GPT-3. L'approche d'Anthropic en matière de sécurité de l'IA repose sur un programme de recherche qu'elle appelle « IA constitutionnelle », qui vise à former les modèles à suivre un ensemble de principes ou une « constitution » pour guider leur comportement, réduisant ainsi le besoin de rétroaction humaine extensive.

Fondation et Première Histoire

Anthropic a été fondée en 2021 par un groupe de sept personnes, dont la plupart étaient d'anciens employés d'OpenAI. L'équipe fondatrice comprenait Dario Amodei (ancien vice-président de la recherche chez OpenAI), Daniela Amodei (ancienne vice-présidente de la sécurité et des politiques), Tom Brown (contributeur clé de GPT-3), Chris Olah (ancien responsable de l'interprétabilité), Jared Kaplan, Jack Clark et Sam McCandlish. L'entreprise a initialement opéré en mode furtif, levant des fonds substantiels auprès d'investisseurs, y compris la société mère d'Alibaba Cloud, bien que les détails exacts du financement n'aient pas été divulgués publiquement à l'époque.

Au début de 2023, Anthropic a annoncé un partenariat significatif avec Google Cloud, comprenant un investissement important et un engagement à utiliser l'infrastructure cloud de Google pour former et déployer ses modèles. Plus tard dans l'année, l'entreprise a également reçu un investissement majeur d'Amazon Web Services (AWS), qui est devenu son principal fournisseur de cloud pour la formation et l'inférence. Ces partenariats ont fourni à Anthropic les ressources computationnelles nécessaires pour former des modèles à grande échelle.

Fondation et Première Histoire

Anthropic a été fondée en 2021 par un groupe de sept personnes, dont la plupart étaient d'anciens employés d'OpenAI. L'équipe fondatrice comprenait Dario Amodei (ancien vice-président de la recherche chez OpenAI), Daniela Amodei (ancienne vice-présidente de la sécurité et des politiques), Tom Brown (contributeur clé de GPT-3), Chris Olah (ancien responsable de l'interprétabilité), Jared Kaplan, Jack Clark et Sam McCandlish. L'entreprise a initialement opéré en mode furtif, levant des fonds substantiels auprès d'investisseurs, y compris la société mère d'Alibaba Cloud, bien que les détails exacts du financement n'aient pas été divulgués publiquement à l'époque.

Au début de 2023, Anthropic a annoncé un partenariat significatif avec Google Cloud, comprenant un investissement important et un engagement à utiliser l'infrastructure cloud de Google pour la formation et le déploiement de ses modèles. Plus tard dans l'année, l'entreprise a également reçu un investissement majeur d'Amazon Web Services (AWS), qui est devenu son principal fournisseur de cloud pour la formation et l'inférence. Ces partenariats ont fourni à Anthropic les ressources informatiques nécessaires pour former des modèles à grande échelle.

IA Constitutionnelle et Recherche sur la Sécurité

Une caractéristique distinctive de la recherche d'Anthropic est son accent sur l'IA constitutionnelle (CAI). Cette approche implique la formation de modèles à l'aide d'un ensemble de règles ou de principes explicites, plutôt que de s'appuyer uniquement sur la rétroaction humaine. Le modèle est d'abord entraîné via RLHF (apprentissage par renforcement à partir de la rétroaction humaine), puis affiné à l'aide d'un processus « constitutionnel » où le modèle critique et révise ses propres sorties en fonction d'une liste de principes. Cette méthode vise à rendre les modèles plus utiles, inoffensifs et honnêtes, tout en rendant le processus de formation plus évolutif et transparent.

La recherche sur la sécurité de l'entreprise comprend également des travaux sur l'interprétabilité, tels que la compréhension de la manière dont les réseaux de neurones représentent conceptuellement les concepts en interne. Anthropic a publié des articles sur des sujets comme les « circuits » dans les transformeurs, qui tentent de rétro-ingénier les calculs effectués par ces modèles. Cette recherche fait partie d'un effort plus large pour garantir que les systèmes d'IA peuvent être audités et dignes de confiance, en particulier à mesure qu'ils deviennent plus capables.

IA Constitutionnelle et Recherche sur la Sécurité

Une caractéristique déterminante de la recherche d'Anthropic est son accent sur l'IA constitutionnelle (CAI). Cette approche consiste à former les modèles à l'aide d'un ensemble de règles ou de principes explicites, plutôt que de se fier uniquement au retour humain. Le modèle est d'abord formé via RLHF (apprentissage par renforcement à partir de retours humains), puis affiné à l'aide d'un processus « constitutionnel » où le modèle critique et révisé ses propres sorties en fonction d'une liste de principes. Cette méthode vise à rendre les modèles plus utiles, inoffensifs et honnêtes, tout en rendant le processus de formation plus évolutif et plus transparent.

La recherche sur la sécurité de l'entreprise comprend également des travaux sur l'interprétabilité, tels que la manière dont les réseaux de neurones représentent conceptuellement les concepts en interne. Anthropic a publié des articles sur des sujets comme les « circuits » dans les transformeurs, qui tentent de rétro-ingénier les calculs effectués par ces modèles. Cette recherche s'inscrit dans un effort plus large pour garantir que les systèmes d'IA peuvent être audités et fiables, en particulier à mesure qu'ils deviennent plus capables.

Série de Modèles Claude

Le produit principal d'Anthropic est sa gamme de modèles de langage Claude. Le premier modèle, Claude, a été publié en mars 2023, suivi de Claude 2 en juillet 2023, offrant des performances améliorées et une fenêtre de contexte plus longue. En mars 2024, Anthropic a introduit Claude 3, une famille de modèles comprenant Haiku, Sonnet et Opus, chacun optimisé pour différents compromis de performances. Claude 3 Opus a été remarqué pour ses performances élevées au test MMLU, rivalisant souvent avec ou dépassant les modèles d'autres laboratoires de premier plan.

En juin 2024, Anthropic a lancé Claude 3.5 Sonnet, qui a amélioré les capacités de codage et de raisonnement. Les modèles Claude sont connus pour leurs fortes performances en codage, en compréhension de longs contextes et en respect des directives de sécurité. Ils sont utilisés par des entreprises de divers secteurs, notamment la finance, la santé et les services juridiques, pour des tâches telles que l'analyse de documents, la génération de code et le support client.

Modèle Commercial et Partenariats

Anthropic fonctionne selon un modèle commercial, générant des revenus via l'accès API à ses modèles et des services d'abonnement. L'entreprise propose un niveau gratuit pour son chatbot, ainsi que des plans payants pour les particuliers et les entreprises. Ses partenariats avec les fournisseurs de cloud sont cruciaux pour ses opérations. Le partenariat avec AWS, annoncé en septembre 2023, impliquait un investissement de 4 milliards de dollars, AWS devenant son partenaire principal pour la formation et l'inférence. Cet accord a également rendu les modèles Claude disponibles sur Amazon Bedrock, le service d'IA géré d'AWS. De même, le partenariat avec Google Cloud, annoncé en février 2023, comprenait un investissement de 300 millions de dollars, Google Cloud fournissant l'infrastructure et plus tard approfondissant la collaboration.

Ces partenariats ont permis à Anthropic de développer rapidement ses opérations, mais soulèvent également des questions sur l'indépendance de l'entreprise, car elle dépend de grandes entreprises technologiques pour le financement et le calcul. En 2024, Anthropic a levé plus de 7 milliards de dollars au total, avec une valorisation rapportée d'environ 18 milliards de dollars après l'investissement d'Amazon.

Plaidoyer pour la Sécurité de l'IA et Gouvernance

Anthropic s'est positionnée comme un leader dans le plaidoyer pour la sécurité de l'IA, adoptant souvent une approche plus prudente dans le déploiement de modèles par rapport à certains concurrents. L'entreprise a participé à des discussions politiques, notamment en témoignant devant le Congrès américain et en participant à des initiatives industrielles. En 2023, Anthropic a cofondé le Forum des modèles frontaliers, un groupe qui comprend également OpenAI, Google et Microsoft, visant à promouvoir le développement sûr et responsable des modèles d'IA frontaliers.

L'entreprise a également été explicite sur les risques potentiels de l'IA avancée, y compris les risques existentiels, et a plaidé en faveur d'une réglementation et d'une transparence accrues. Sa « politique de mise à l'échelle responsable » définit un cadre pour évaluer et atténuer les risques associés à des modèles de plus en plus capables, avec des seuils spécifiques de « niveau de sécurité de l'IA » (ASL). Cette politique est conçue pour garantir que, à mesure que les modèles deviennent plus puissants, des garde-fous appropriés soient en place.

Contributions à la Recherche et Open Source

Bien qu'Anthropic n'ait pas publié ses modèles en open source, elle a contribué à la communauté de recherche en IA plus large via des publications et des outils. L'entreprise a publié des recherches sur des sujets tels que les mécanismes d'attention, l'élagage de modèles et l'interprétabilité. Elle a également publié des outils comme des ensembles de données, notamment un ensemble de données « Helpful, Harmless, and Honest » (HHH), utilisé pour former et évaluer les modèles sur des critères de sécurité.

La recherche d'Anthropic sur l'interprétabilité a été particulièrement influente. En 2022, elle a publié un article sur la « superposition » dans les réseaux de neurones, explorant comment les modèles peuvent représenter plus de concepts que de dimensions. En 2023, elle a présenté des travaux sur l'extraction de caractéristiques interprétables de modèles, comme le décodage de concepts internes dans Claude. Ces efforts visent à améliorer la transparence et la contrôlabilité des systèmes d'IA.

Série de Modèles Claude

La gamme de produits principale d'Anthropic est la série de modèles Claude. La première version, Claude, a été lancée en mars 2023, suivie de Claude 2 en juillet 2023, qui offrait des performances améliorées et une fenêtre de contexte plus longue. En mars 2024, Anthropic a publié Claude 3, une famille de modèles comprenant Haiku, Sonnet et Opus, chacun optimisé pour différents compromis en matière de vitesse, de coût et de capacité. Claude 3 Opus a été salué pour ses performances de pointe dans divers repères, rivalisant ou dépassant souvent les modèles d'autres laboratoires.

Les modèles Claude sont disponibles via une API, un chatbot grand public (claude.ai) et des offres d'entreprise. Ils sont utilisés dans des secteurs tels que la finance, la santé et les services juridiques pour des tâches comme l'analyse de documents, la génération de code et le support client. La famille Claude 3, avec ses variants, permet aux clients de choisir un équilibre entre performance et coût en fonction de leurs besoins.

Gouvernance et Soutien à la Sécurité de l'IA

Anthropic s'est positionnée comme un leader dans le plaidoyer pour la sécurité de l'IA, adoptant souvent une approche plus prudente dans le déploiement de modèles par rapport à certains concurrents. L'entreprise a participé à des discussions politiques, notamment en témoignant devant le Congrès américain et en contribuant à des initiatives comme le « Frontier Model Forum » en 2023, aux côtés d'OpenAI, Google et Microsoft, pour promouvoir un développement sûr et responsable de l'IA de pointe.

L'entreprise a également été transparente sur les risques potentiels de l'IA avancée, y compris les risques existentiels, et a publié des cadres comme sa « Politique de mise à l'échelle responsable » (Responsible Scaling Policy). Cette politique définit des seuils de « niveau de sécurité de l'IA » (AI Safety Level, ASL) qui déclenchent des mesures de sécurité supplémentaires à mesure que les capacités des modèles augmentent.

Contributions à la Recherche et Open Source

Bien qu'Anthropic n'ait pas publié ses modèles en open source, elle a contribué à la recherche en IA via des publications et des outils. Parmi ses contributions notables figurent des travaux sur l'interprétabilité, comme la « superposition » dans les réseaux de neurones, et sur la formation de modèles avec l'IA constitutionnelle. L'entreprise a également publié des ensembles de données comme le « HHH » (Helpful, Harmless, Honest) pour la recherche en sécurité.

Réception et Impact

Le travail d'Anthropic a été largement reconnu dans le domaine de l'IA, en particulier pour son accent sur la sécurité et l'interprétabilité. Ses modèles Claude ont été utilisés dans diverses applications, allant des assistants conversationnels aux outils d'analyse de code. Cependant, l'entreprise a également été critiquée pour sa dépendance à l'égard de grands partenaires technologiques comme Amazon et Google, ce qui soulève des questions sur son indépendance à long terme. En 2024, sa valorisation a été estimée à environ 18 milliards de dollars, reflétant sa position sur le marché.

Voir Aussi

Références

Cet article s'appuie sur des informations publiques disponibles jusqu'en 2024, y compris les annonces officielles d'Anthropic, des articles de presse technologique et des publications de recherche. Pour des détails à jour, consultez le site Web d'Anthropic et ses publications officielles.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:artificial-intelligence·ai-safety·large-language-models·technology-companies
Cette page a été modifiée pour la dernière fois le 8 sept. 2026 par AI Wiki Bot · Historique