L'Institut américain pour la sécurité de l'IA (US AISI) est une organisation soutenue par l'État, créée en novembre 2023 sous l'égide de l'Institut national des normes et de la technologie (NIST), une agence du département du Commerce des États-Unis. Sa mission principale est d'évaluer et de garantir la sécurité des modèles avancés d'intelligence artificielle (IA), en particulier ceux connus sous le nom de modèles d'IA frontière. L'institut a été fondé lors du sommet sur la sécurité de l'IA tenu au Royaume-Uni, où le Royaume-Uni et les États-Unis ont annoncé la création de leurs organismes respectifs de sécurité de l'IA. Cela a marqué une étape importante dans l'effort mondial pour traiter les risques potentiels associés aux technologies d'IA en évolution rapide, notamment les grands modèles de langage et autres systèmes de IA générative.
La création de l'US AISI a reflété une reconnaissance croissante en 2023 des risques existentiels potentiels posés par l'IA, comme l'ont souligné les déclarations publiques de chercheurs et de leaders de l'industrie. L'institut opère au sein du NIST, tirant parti de l'expertise de l'agence en matière de normes de mesure et d'évaluation technologique. Son travail se concentre sur le développement de méthodologies de test, la réalisation d'évaluations de sécurité et la collaboration avec d'autres organismes nationaux et internationaux pour créer un cadre cohérent de supervision de l'IA. L'US AISI fait partie d'un réseau international plus large d'instituts de sécurité de l'IA issu des efforts diplomatiques de 2023 et 2024.
Fondation et mandat initial
L'US AISI a été officiellement créé le 1er novembre 2023, lors du sommet sur la sécurité de l'IA à Bletchley Park au Royaume-Uni. Le sommet, organisé par le Premier ministre de l'époque, Rishi Sunak, a réuni des représentants de gouvernements, d'entreprises d'IA et d'institutions académiques pour discuter du développement sûr de l'IA frontière. Le gouvernement américain, par l'intermédiaire du NIST, s'est engagé à créer un institut dédié pour mener des recherches et des évaluations sur la sécurité de l'IA. L'objectif initial de l'institut était de développer des procédures de test standardisées pour les modèles d'IA, y compris des évaluations des capacités dans des domaines tels que le apprentissage automatique, le apprentissage profond et les réseaux de neurones.
Dans ses premiers mois, l'US AISI a travaillé à définir son rôle dans le paysage plus large de la politique américaine en matière d'IA. Il a coordonné ses activités avec d'autres agences fédérales, notamment le Bureau de la politique scientifique et technologique de la Maison-Blanche, pour aligner ses actions sur les priorités nationales. L'institut a également commencé à collaborer avec les principaux développeurs d'IA, tels que OpenAI, Anthropic et Google DeepMind, pour accéder à leurs modèles les plus avancés en vue de tests de sécurité avant déploiement. Cette approche collaborative visait à répondre aux préoccupations selon lesquelles les entreprises d'IA ne pouvaient pas de manière fiable « corriger leurs propres devoirs » en matière d'évaluations de sécurité.
Collaboration avec l'Institut britannique de sécurité de l'IA
Un aspect clé du travail initial de l'US AISI a été son partenariat avec l'Institut britannique de sécurité de l'IA (UK AISI), créé simultanément lors du sommet de novembre 2023. Les deux instituts ont convenu de collaborer au développement de règles et de procédures d'évaluation communes, reconnaissant qu'une approche unifiée serait plus efficace que des efforts nationaux fragmentés. En avril 2024, les États-Unis et le Royaume-Uni ont officiellement conclu un accord pour mener au moins un test de sécurité conjoint sur un modèle d'IA partagé. Cette collaboration a été considérée comme un modèle de coopération internationale en matière de gouvernance de l'IA.
Le partenariat a également impliqué le partage de résultats de recherche et de méthodologies. L'US AISI et l'UK AISI ont exploré conjointement des questions telles que la robustesse des modèles, l'alignement avec les valeurs humaines et le potentiel des systèmes d'IA à fuiter des informations sensibles ou à être exploités pour des cyberattaques. Leur travail a éclairé le développement de normes internationales, l'UK AISI annonçant en mai 2024 qu'il ouvrirait un bureau à San Francisco pour se rapprocher des grandes entreprises d'IA, une décision complémentaire à la localisation de l'US AISI au sein du NIST.
Formation du réseau international
Lors du sommet de Séoul sur l'IA en mai 2024, les dirigeants internationaux ont convenu de former un réseau d'instituts de sécurité de l'IA, s'appuyant sur la coopération bilatérale entre les États-Unis et le Royaume-Uni. Le réseau comprenait initialement des instituts du Royaume-Uni, des États-Unis, du Japon, de la France, de l'Allemagne, de l'Italie, de Singapour, de la Corée du Sud, de l'Australie, du Canada et de l'Union européenne. L'US AISI a joué un rôle central dans ce réseau, aidant à coordonner des projets de recherche conjoints et des exercices d'évaluation. En juillet 2025, le réseau a organisé un exercice pour explorer les problèmes liés à l'évaluation des agents d'IA, en particulier concernant les fuites d'informations sensibles et les risques de cybersécurité. Les membres du réseau se sont également réunis lors de NeurIPS 2025 à San Diego pour discuter des défis émergents.
La participation de l'US AISI au réseau international s'inscrivait dans un effort plus large visant à établir des normes mondiales pour la sécurité de l'IA. L'institut a contribué aux discussions sur des sujets tels que les architectures de transformeurs, l'attention multi-têtes et d'autres aspects techniques des systèmes d'IA, garantissant que les évaluations de sécurité suivent le rythme des avancées rapides dans le domaine. Le réseau a également abordé des questions de gouvernance, notamment comment équilibrer l'innovation avec des mesures de précaution.
Évolution et changement de nom
En 2025, l'US AISI a subi un changement organisationnel significatif. Il a été renommé Centre pour les normes et l'innovation en IA (CAISI), reflétant un changement d'orientation vers le développement de normes et la promotion de l'innovation en matière de sécurité de l'IA. Ce changement de nom s'inscrivait dans une tendance plus large, l'Institut britannique de sécurité de l'IA ayant également été renommé Institut de sécurité de l'IA la même année. Ce changement a signalé une transition d'évaluations purement axées sur la sécurité vers une approche plus complète incluant la promotion d'un développement et d'un déploiement responsables de l'IA.
La transition vers le CAISI n'a pas modifié la mission principale de l'institut mais a élargi son champ d'action. Il a continué à mener des évaluations de sécurité des modèles d'IA frontière, mais a également commencé à travailler plus étroitement avec l'industrie pour développer des meilleures pratiques et des normes volontaires. Cette évolution a été perçue comme une réponse à la maturité croissante du domaine de l'IA et au besoin d'une supervision continue à mesure que les systèmes d'IA devenaient plus intégrés dans divers secteurs, notamment la santé, les transports et la finance.
Domaines techniques d'intervention
Le travail technique de l'US AISI couvre plusieurs domaines de la recherche et du développement en IA. Il évalue les modèles pour détecter les biais potentiels, la robustesse face aux entrées adverses et l'alignement avec les comportements prévus. L'institut étudie également l'interprétabilité des systèmes d'IA, cherchant à comprendre comment les réseaux de neurones prennent des décisions. Cela inclut l'étude de techniques telles que la normalisation de couche, la normalisation par lots et le décrochage pour améliorer la fiabilité des modèles.
Un autre axe concerne la sécurité des agents d'IA, qui sont des systèmes capables de prise de décision autonome. L'US AISI a exploré des scénarios où des agents d'IA pourraient fuiter des informations sensibles ou être manipulés pour effectuer des actions nuisibles. Il a également examiné les implications de l'RLAIF et d'autres méthodes d'entraînement reposant sur des retours générés par l'IA, qui peuvent introduire des biais ou des erreurs subtils. La recherche de l'institut contribue au développement de références d'évaluation et de protocoles de test utilisés à la fois par le gouvernement et l'industrie.
Impact et orientations futures
La création de l'US AISI a eu un impact significatif sur le paysage politique de l'IA. Il a fourni un mécanisme gouvernemental de supervision indépendante des technologies d'IA, complétant les efforts d'autorégulation des entreprises. Le travail de l'institut a éclairé les propositions législatives et réglementaires, tant aux États-Unis qu'à l'international. En 2025, l'institut continue d'évoluer, avec des plans pour étendre ses capacités de recherche et approfondir ses collaborations internationales.
À l'avenir, l'US AISI (désormais CAISI) est confronté à des défis liés au rythme rapide du développement de l'IA, notamment l'émergence de modèles plus performants et de nouvelles applications. Il doit également naviguer dans les questions concernant l'équilibre approprié entre sécurité et innovation, ainsi que l'allocation des ressources entre des priorités concurrentes. Le succès de l'institut dépendra de sa capacité à s'adapter aux circonstances technologiques et politiques changeantes tout en maintenant sa crédibilité en tant qu'évaluateur indépendant des systèmes d'IA.