Nick Bostrom (né le 10 mars 1973) est un philosophe d'origine suédoise, connu pour ses travaux sur le risque existentiel, le principe anthropique, l'éthique de l'amélioration humaine, l'émulation cérébrale totale et les risques liés à la superintelligence. Il a été le directeur fondateur du Future of Humanity Institute à l'Université d'Oxford et est devenu chercheur principal à la Macrostrategy Research Initiative.
Bostrom est l'auteur de Anthropic Bias: Observation Selection Effects in Science and Philosophy (2002), Superintelligence: Paths, Dangers, Strategies (2014) et Deep Utopia: Life and Meaning in a Solved World (2024). Il soutient que les progrès de l'intelligence artificielle pourraient mener à une superintelligence, qu'il définit comme « tout intellect qui dépasse largement les performances cognitives des humains dans pratiquement tous les domaines d'intérêt », considérant cela comme une source majeure d'opportunités et de risques existentiels.
Vie et éducation
Né Niklas Boström en 1973 à Helsingborg, en Suède, il n'aimait pas l'école à un jeune âge et a passé sa dernière année de lycée à apprendre à la maison. Il s'intéressait à l'anthropologie, à l'art, à la littérature et à la science. Il a obtenu une licence à l'Université de Göteborg en 1994, une maîtrise en philosophie et physique à l'Université de Stockholm, et une maîtrise en neurosciences computationnelles au King's College de Londres en 1996. Pendant son séjour à l'Université de Stockholm, il a étudié la relation entre le langage et la réalité en analysant le philosophe analytique W. V. Quine. Il s'est également produit sur la scène du stand-up comedy à Londres.
En 2000, il a obtenu un doctorat en philosophie à la London School of Economics sous la supervision de Colin Howson et Craig Callender, avec une thèse intitulée « Observational selection effects and probability ». Il a occupé un poste d'enseignant à l'Université Yale de 2000 à 2002 et a été boursier postdoctoral de la British Academy à l'Université d'Oxford de 2002 à 2005.
Risque existentiel et Future of Humanity Institute
Les recherches de Bostrom portent sur l'avenir de l'humanité et les résultats à long terme. Il définit le risque existentiel comme un risque où un « résultat défavorable annihilerait soit la vie intelligente d'origine terrestre, soit réduirait de manière permanente et drastique son potentiel ». Il se concentre sur les risques anthropiques, en particulier ceux liés aux nouvelles technologies comme l'intelligence artificielle avancée, la nanotechnologie moléculaire ou la biologie synthétique.
En 2005, Bostrom a fondé le Future of Humanity Institute, qui a étudié l'avenir lointain de la civilisation humaine jusqu'à sa fermeture en 2024. Il est également conseiller auprès du Centre pour l'étude du risque existentiel. Dans le recueil d'essais Global Catastrophic Risks de 2008, les éditeurs Bostrom et Milan M. Ćirković ont caractérisé la relation entre le risque existentiel et la classe plus large des risques catastrophiques mondiaux, reliant le risque existentiel aux effets de sélection observationnelle et au paradoxe de Fermi.
Dans son article « The Vulnerable World Hypothesis », Bostrom suggère que certaines technologies pourraient détruire la civilisation humaine par défaut lorsqu'elles sont découvertes. Il propose un cadre pour classer et traiter ces vulnérabilités, y compris des expériences de pensée contrefactuelles comme des armes nucléaires plus faciles à développer ou l'ignition de l'atmosphère, comme Edward Teller l'avait craint.
Sentience numérique et raisonnement anthropique
Bostrom soutient le principe d'indépendance du substrat, l'idée que la conscience peut émerger sur divers substrats physiques, pas seulement dans les réseaux neuronaux biologiques à base de carbone comme le cerveau humain. Il considère que « la sentience est une question de degré » et que les esprits numériques pourraient être conçus pour avoir des taux et des intensités d'expérience subjective plus élevés que les humains, en utilisant moins de ressources. Ces machines hautement sentientes, qu'il appelle « super-bénéficiaires », seraient extrêmement efficaces pour atteindre le bonheur. Il recommande de trouver des chemins permettant aux esprits numériques et aux esprits biologiques de coexister de manière mutuellement bénéfique.
Bostrom a publié de nombreux articles sur le raisonnement anthropique, ainsi que le livre Anthropic Bias: Observation Selection Effects in Science and Philosophy. Dans ce livre, il critique les formulations précédentes du principe anthropique, y compris celles de Brandon Carter, John Leslie, John Barrow et Frank Tipler. Il soutient que la mauvaise gestion de l'information indexicale est un défaut courant dans de nombreux domaines de recherche, y compris la cosmologie, la philosophie, la théorie de l'évolution, la théorie des jeux et la physique quantique. Il introduit l'hypothèse d'auto-échantillonnage (SSA) et analyse l'hypothèse d'auto-indication (SIA), montrant comment elles mènent à des conclusions différentes et identifiant des paradoxes. Il argumente contre la SIA et propose d'affiner la SSA en une hypothèse d'auto-échantillonnage forte (SSSA), qui remplace les « observateurs » par des « moments-observateurs ».
Dans des travaux ultérieurs avec Milan M. Ćirković et Anders Sandberg, il a proposé le phénomène de l'ombre anthropique, un effet de sélection observationnelle qui empêche les observateurs d'observer certains types de catastrophes dans leur passé géologique et évolutif récent. Ils suggèrent que les événements dans l'ombre anthropique sont susceptibles d'être sous-estimés à moins que des corrections statistiques ne soient apportées.
Argument de simulation et amélioration humaine
L'argument de simulation de Bostrom postule qu'au moins une des affirmations suivantes est très probablement vraie : la fraction des civilisations de niveau humain qui atteignent un stade posthumain est très proche de zéro ; la fraction des civilisations posthumaines intéressées à exécuter des simulations d'ancêtres est très proche de zéro ; ou la fraction de toutes les personnes ayant nos types d'expériences vivant dans une simulation est très proche de un.
Bostrom est favorable à l'amélioration humaine, ou « l'auto-amélioration et la perfectibilité humaine par l'application éthique de la science », et critique les vues bio-conservatrices. En 1998, il a cofondé l'Association transhumaniste mondiale (aujourd'hui Humanity+) avec David Pearce. En 2004, il a cofondé l'Institut pour l'éthique et les technologies émergentes avec James Hughes, bien qu'il ne soit plus impliqué dans aucune de ces organisations. En 2005, il a publié la nouvelle « The Fable of the Dragon-Tyrant » dans le Journal of Medical Ethics, avec une version plus courte dans Philosophy Now en 2012.
Héritage et influence
Les travaux de Bostrom ont considérablement façonné les discussions sur la sécurité de l'IA et le risque existentiel. Son livre Superintelligence a été largement cité dans les cercles académiques et politiques, influençant les débats sur la manière de garantir que les systèmes d'IA avancés soient développés en toute sécurité. Son approche interdisciplinaire, combinant philosophie, théorie des probabilités et informatique, a fait de lui une figure centrale dans le domaine de l'éthique de l'IA. Au début des années 2020, ses idées continuent d'informer la recherche dans des institutions comme OpenAI et Google DeepMind, qui abordent les risques à long terme associés à l'apprentissage automatique et à l'apprentissage profond.