尼克·博斯特罗姆(生于1973年3月10日)是一位瑞典出生的哲学家,以其在存在风险、人择原理、人类增强伦理、全脑仿真以及超级智能风险方面的工作而闻名。他曾任牛津大学未来人类研究所的创始主任,并已成为宏观战略研究倡议的首席研究员。
博斯特罗姆是《人择偏差:科学与哲学中的观察选择效应》(2002年)、《超级智能:路径、危险、策略》(2014年)以及《深度乌托邦:解决世界中的生活与意义》(2024年)的作者。他认为,人工智能的进步可能导致超级智能,他将其定义为“在几乎所有感兴趣的领域中,大大超越人类认知表现的任何智能”,并将其视为机遇和存在风险的主要来源。
早年生活与教育
博斯特罗姆于1973年出生于瑞典赫尔辛堡,原名尼克拉斯·博斯特伦。他年幼时不喜欢学校,高中最后一年在家自学。他对人类学、艺术、文学和科学感兴趣。他于1994年获得哥德堡大学学士学位,斯德哥尔摩大学哲学与物理学硕士学位,并于1996年获得伦敦国王学院计算神经科学理学硕士学位。在斯德哥尔摩大学期间,他通过研究分析哲学家W·V·奎因,探讨了语言与现实之间的关系。他还在伦敦的脱口秀喜剧圈表演过。
2000年,他在伦敦政治经济学院获得哲学博士学位,导师为科林·豪森和克雷格·卡伦德,论文题为《观察选择效应与概率》。他于2000年至2002年在耶鲁大学任教,并于2002年至2005年在牛津大学担任英国学院博士后研究员。
存在风险与未来人类研究所
博斯特罗姆的研究关注人类的未来和长期结果。他将存在风险定义为“不利结果要么消灭源自地球的智能生命,要么永久且急剧地削减其潜力”的风险。他专注于人为风险,特别是来自先进人工智能、分子纳米技术或合成生物学等新技术的风险。
2005年,博斯特罗姆创立了未来人类研究所,该研究所研究人类文明的遥远未来,直至2024年关闭。他还是存在风险研究中心的顾问。在2008年的论文集《全球灾难性风险》中,编辑博斯特罗姆和米兰·M·奇尔科维奇将存在风险与更广泛的全球灾难性风险类别之间的关系进行了描述,将存在风险与观察者选择效应和费米悖论联系起来。
在他的论文《脆弱世界假说》中,博斯特罗姆提出,某些技术在被发现时可能默认摧毁人类文明。他提出了一个框架来分类和处理这些脆弱性,包括反事实思想实验,例如核武器更容易开发或点燃大气层,正如爱德华·泰勒所担心的那样。
数字感知与人择推理
博斯特罗姆支持基质独立性原则,即意识可以在各种物理基质上出现,而不仅仅是在像人脑这样的碳基生物神经网络中。他认为“感知是一个程度问题”,数字思维可以被设计为比人类具有更高频率和强度的主观体验,且使用更少的资源。这种高度感知的机器,他称之为“超级受益者”,将极其高效地实现幸福。他建议找到使数字思维和生物思维以互利方式共存的路径。
博斯特罗姆发表了大量关于人择推理的文章,以及《人择偏差:科学与哲学中的观察选择效应》一书。在书中,他批评了先前的人择原理表述,包括布兰登·卡特、约翰·莱斯利、约翰·巴罗和弗兰克·蒂普勒的表述。他认为,处理索引信息不当是许多研究领域中的常见缺陷,包括宇宙学、哲学、进化论、博弈论和量子物理学。他引入了自我采样假设(SSA),并分析了自我指示假设(SIA),展示了它们如何导致不同的结论并识别悖论。他反对SIA,并提议将SSA细化为强自我采样假设(SSSA),用“观察者时刻”取代“观察者”。
在与米兰·M·奇尔科维奇和安德斯·桑德伯格后来的工作中,他提出了人择阴影现象,这是一种观察选择效应,阻止观察者观察其近期地质和进化历史中的某些类别的灾难。他们建议,除非进行统计修正,否则人择阴影中的事件可能被低估。
模拟论证与人类增强
博斯特罗姆的模拟论证认为,以下陈述中至少有一个很可能为真:达到后人类阶段的人类级文明的比例非常接近于零;对运行祖先模拟感兴趣的后人类文明的比例非常接近于零;或者拥有我们这类经历的所有人中生活在模拟中的比例非常接近于1。
博斯特罗姆对人类增强持赞成态度,即“通过伦理应用科学实现自我改进和人类完善”,并且是生物保守主义观点的批评者。1998年,他与大卫·皮尔斯共同创立了世界超人类主义协会(现为人类+)。2004年,他与詹姆斯·休斯共同创立了新兴技术伦理研究所,尽管他不再参与这两个组织。2005年,他在《医学伦理杂志》上发表了短篇小说《龙暴君寓言》,2012年在《哲学现在》上发表了较短版本。
遗产与影响
博斯特罗姆的工作显著塑造了关于AI安全和存在风险的讨论。他的著作《超级智能》在学术和政策界被广泛引用,影响了关于如何确保先进AI系统安全开发的辩论。他的跨学科方法,结合哲学、概率论和计算机科学,使他成为AI伦理领域的核心人物。截至2020年代初,他的思想继续为OpenAI和Google DeepMind等机构的研究提供信息,这些机构应对与机器学习和深度学习相关的长期风险。