Institut américain de la sécurité de l'IA - Recherche

Traduit de l'anglais

La recherche au sein de l'Institut américain de sécurité de l'IA se concentre sur l'évaluation et l'atténuation des risques liés à l'intelligence artificielle avancée, notamment en développant des normes de test et des protocoles de sécurité pour les modèles de pointe.

L'Institut américain de sécurité de l'IA (AISI), créé en 2023 au sein de l'Institut national des normes et de la technologie (NIST), mène des recherches visant à garantir le développement et le déploiement sûrs des systèmes d'intelligence artificielle avancés. Son programme de recherche couvre les évaluations techniques, les tests d'intrusion (red-teaming) et l'élaboration de normes de mesure pour les capacités et les risques de l'IA. L'institut collabore avec des institutions académiques, des partenaires industriels et des organismes internationaux pour relever les défis posés par la IA générative et d'autres technologies émergentes.

La recherche de l'AISI repose sur la conviction qu'un test empirique rigoureux est essentiel pour comprendre le comportement, les limites et les préjudices potentiels des systèmes d'IA. Les travaux de l'institut éclairent les recommandations politiques et les meilleures pratiques pour les développeurs d'IA, en mettant l'accent sur les modèles frontières qui présentent des capacités avancées dans des domaines tels que les grands modèles de langage et l'apprentissage profond.

Évaluations techniques et tests d'intrusion

Un élément central de la recherche de l'AISI consiste à concevoir et à mener des évaluations techniques des modèles d'IA. Ces évaluations testent des capacités dangereuses, notamment l'offensive cybernétique, la création de menaces biologiques et la réplication autonome. Les chercheurs utilisent des méthodologies de red-teaming, où des équipes tentent de provoquer des sorties nuisibles ou de contourner les mesures de sécurité. En 2024, l'AISI a publié un cadre pour évaluer les modèles d'IA frontières, qui comprend des références standardisées et des protocoles de test adverses. L'institut développe également des outils d'évaluation automatisée, permettant des évaluations à grande échelle du comportement des modèles dans divers scénarios.

Normes de sécurité et lignes directrices

L'AISI contribue à l'élaboration de normes de sécurité et de lignes directrices pour les systèmes d'IA. Cela inclut la définition de métriques pour la robustesse, l'équité et la transparence, ainsi que l'établissement de meilleures pratiques pour la documentation et le déploiement des modèles. L'institut travaille avec des organismes de normalisation pour créer des normes reconnues internationalement, telles que le cadre de gestion des risques de l'IA du NIST, qui fournit une approche structurée pour gérer les risques liés à l'IA. La recherche dans ce domaine explore également l'efficacité de techniques comme le élagage de modèles et l'augmentation de données pour améliorer la sécurité et la fiabilité des modèles.

Collaboration et partenariats

L'AISI collabore avec des institutions de recherche de premier plan en IA, notamment le MIT CSAIL, le Stanford AI Lab et le BAIR (Berkeley AI Research), ainsi qu'avec des acteurs industriels comme OpenAI, Anthropic et Google DeepMind. Ces partenariats facilitent l'accès aux modèles et à l'expertise de pointe, permettant à l'AISI de mener des tests pré-déploiement des systèmes frontières. L'institut s'engage également avec des homologues internationaux, tels que l'Institut de sécurité de l'IA du Royaume-Uni, pour harmoniser les approches d'évaluation et partager les résultats. En 2024, l'AISI a annoncé un partenariat avec l'université Carnegie-Mellon pour développer de nouvelles méthodes de vérification de la sécurité des systèmes d'IA.

Politique et engagement public

La recherche de l'AISI éclaire directement les décisions politiques et le discours public sur la sécurité de l'IA. L'institut publie des rapports et des briefings qui résument les résultats et formulent des recommandations pour les régulateurs et les législateurs. Il organise également des ateliers et des conférences pour favoriser le dialogue entre les parties prenantes, y compris la société civile et le monde académique. Les travaux de l'AISI ont influencé des décrets exécutifs et des propositions législatives liés à la supervision de l'IA, soulignant la nécessité d'une réglementation fondée sur des preuves. L'institut maintient un référentiel public de résultats d'évaluation et de recherche sur la sécurité, promouvant la transparence et la responsabilité.

Orientations futures

À l'avenir, l'AISI prévoit d'étendre ses recherches dans des domaines tels que l'interprétabilité, l'alignement et les impacts sociétaux de l'IA. L'institut explore l'utilisation de l'apprentissage par renforcement à partir de retours humains (RLHF) et d'autres techniques pour améliorer l'alignement des modèles avec les valeurs humaines. De plus, l'AISI étudie les risques potentiels de l'intelligence artificielle générale et les préoccupations de sécurité à long terme. À mesure que la technologie de l'IA évolue, l'AISI vise à rester à l'avant-garde de la recherche sur la sécurité, en adaptant ses méthodes pour relever de nouveaux défis et garantir que l'IA profite à la société tout en minimisant les préjudices.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:ai-safety·research-institute·government-agency
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique