L'amélioration récursive de soi (RSI) est le processus par lequel un système d'IA améliore ses propres capacités - en modifiant directement son architecture ou son entraînement, ou en accélérant indirectement la recherche qui construit ses successeurs - de sorte que chaque génération rend la suivante plus facile à créer. Longtemps une préoccupation théorique de la littérature sur la sécurité de l'IA, elle est devenue une réalité technique au milieu des années 2020, lorsque les laboratoires de pointe ont commencé à utiliser leurs modèles pour écrire du code de recherche, concevoir des expériences, générer des données d'entraînement et déboguer les systèmes qui entraînent les modèles suivants.
Théorie
L'idée remonte à l'argument de l'« explosion de l'intelligence » d'I. J. Good en 1965 : une machine capable d'améliorer la conception de machines similaires à elle-même déclencherait un processus incontrôlable, en faisant « la dernière invention que l'homme n'ait jamais besoin de faire ». Ce concept sous-tend les scénarios de décollage brutal dans la littérature sur la singularité et motive une grande partie de la recherche sur l'alignement : un système qui s'améliore plus vite que les humains ne peuvent l'auditer concentre exactement les risques que la supervision est censée détecter.
Les analystes distinguent la RSI faible (les modèles accélèrent la recherche menée par les humains : assistance au codage, génération de données, tri des expériences) de la RSI forte (les systèmes se reconçoivent de manière autonome, sans intervention humaine). L'argument de la composition s'applique aux deux, mais les implications en matière de gouvernance diffèrent nettement.
En pratique (2025-2026)
D'ici 2025, les dirigeants de laboratoires décrivaient la RSI faible comme opérationnelle : Sam Altman a soutenu dans The Gentle Singularity que même une auto-amélioration « larvaire » se compose de manière spectaculaire, et les outils internes des grands laboratoires s'appuyaient sur des modèles de pointe pour une part croissante de l'ingénierie de recherche. En 2026, Dario Amodei a cité l'accélération de la RSI dans toute l'industrie - y compris chez Anthropic - comme un catalyseur principal de We Must Pace the Frontier, son appel à rythmer délibérément le développement de la frontière.