Le Rapport international sur la sécurité de l'IA est une évaluation scientifique de référence des risques associés à l'intelligence artificielle avancée. Commandé par une coalition de gouvernements et d'organisations internationales, le rapport a été publié pour la première fois en 2025, marquant la première fois qu'un groupe mondial d'experts évaluait systématiquement les dangers de l'IA pour les décideurs politiques. Son objectif principal est de fournir une base rigoureuse et fondée sur des preuves pour les réglementations nationales et internationales sur l'IA, comblant le fossé entre les développements technologiques rapides et les processus législatifs plus lents.
Le rapport rassemble les conclusions d'un panel international diversifié de scientifiques et d'ingénieurs, couvrant des menaces allant des préjudices algorithmiques immédiats aux préoccupations existentielles à plus long terme. Il ne préconise pas de politiques spécifiques mais vise plutôt à établir une base factuelle commune que les gouvernements et les entreprises peuvent consulter. Dès sa publication initiale, le rapport a été décrit comme l'effort mondial le plus vaste à ce jour pour codifier le risque lié à l'IA, bien que ses auteurs reconnaissent que le domaine évolue si rapidement que des mises à jour régulières sont nécessaires.
Portée et taxonomie des risques
Le rapport organise les risques de l'IA en trois catégories temporelles : les risques actuels ou à court terme, les risques liés aux capacités intermédiaires et les risques liés aux systèmes avancés futurs. Les préoccupations à court terme incluent les biais dans les systèmes d'apprentissage automatique, les violations de la vie privée, la génération de désinformation, les vulnérabilités en cybersécurité et les déplacements d'emplois. Les risques intermédiaires couvrent des questions telles que la prolifération de la manipulation par grands modèles de langage. Les risques à long terme se concentrent sur la possibilité d'une perte de contrôle humain sur les systèmes d'intelligence artificielle dotés de capacités surhumaines. Le rapport évite délibérément d'attribuer des probabilités à des futurs lointains, citant le degré élevé d'incertitude.
Méthodologie et contributions des experts
Le processus de rédaction s'est appuyé sur un panel de plus de 100 experts issus du monde universitaire et de l'industrie, coordonné par un secrétariat intergouvernemental établi dans le cadre du sommet sur la sécurité de l'IA du Royaume-Uni. Parmi les contributeurs notables figuraient des chercheurs d'l'Université d'Oxford, de Berkeley AI Research, du MIT CSAIL et du Stanford AI Lab, ainsi que des représentants de grands développeurs tels que OpenAI, Anthropic et Google DeepMind. Le rapport a utilisé une approche structurée de sollicitation d'experts, combinant des revues de littérature avec des enquêtes anonymes pour évaluer le consensus. Il a mis l'accent sur la transparence : toutes les conclusions sont attribuées à des études citées, et les opinions divergentes sont notées lorsqu'un désaccord significatif persiste.
Principales conclusions sur les risques techniques
Un chapitre central analyse la fiabilité des systèmes actuels, notant que les modèles de réseaux neuronaux, malgré leur puissance, présentent une fragilité. Les exemples incluent la mauvaise classification d'images sous des perturbations adverses et les hallucinations dans les modèles de langage basés sur les transformeurs. Le rapport souligne la difficulté de vérifier le comportement de l'IA, en particulier dans les systèmes d'apprentissage profond où le raisonnement interne est opaque. Il recommande des cadres d'évaluation améliorés, tels que des tests de résistance standardisés pour l'IA générative, et souligne l'importance du élagage de modèles et de la augmentation de données comme atténuations partielles. Cependant, les auteurs avertissent que les correctifs techniques seuls sont insuffisants sans audit externe.
Dimensions géopolitiques et économiques
Le rapport souligne que le développement de l'IA est concentré parmi une poignée d'entreprises, notamment Google Cloud, Azure et Amazon Web Services, ce qui soulève des préoccupations concernant la concentration du marché et l'interopérabilité. Il note que la plupart des recherches de pointe ont lieu aux États-Unis, en Chine et au Royaume-Uni, avec des pays comme l'Inde et le Japon augmentant leurs investissements. L'écosystème de fabrication de TSMC, qui produit les puces utilisées pour l'entraînement de l'IA, est identifié comme un goulot d'étranglement critique. Le rapport recommande une coopération internationale sur les contrôles à l'exportation et des références de sécurité partagées, tout en reconnaissant les tensions géopolitiques qui compliquent de tels accords.
Réception et impact politique
Les réactions initiales au rapport ont été mitigées. Certains décideurs politiques ont salué son ton équilibré et son ampleur, tandis que les critiques ont soutenu qu'il minimise les risques urgents, tels que l'ingérence électorale. Fin 2025, plusieurs nations, dont le Canada et Singapour, avaient référencé le rapport dans des projets de loi. La loi sur l'IA de l'Union européenne intègre plusieurs de ses procédures d'évaluation recommandées. Les réponses du secteur privé ont varié : Apple et Samsung Electronics se sont publiquement engagés à des auto-évaluations annuelles alignées sur les catégories du rapport, tandis que certaines startups l'ont qualifié d'excessivement contraignant.
Limites et révisions futures
Les auteurs concèdent que le rapport comporte des lacunes. Il couvre principalement la recherche en langue anglaise, sous-représentant les travaux non occidentaux. Sa taxonomie des risques traite l'IA comme une technologie monolithique, bien que des outils comme l'apprentissage par renforcement à partir de retours humains et les modèles de diffusion aient des modes de défaillance distincts. Une deuxième édition est attendue en 2028, avec des plans pour inclure davantage de contributions de la société civile et des syndicats. Le rapport appelle également à la création d'un organe permanent indépendant pour surveiller la sécurité de l'IA, une proposition qui reste en cours de négociation au moment de la rédaction de cet article.