埃利泽·尤德科夫斯基

译自英文

美国人工智能安全研究员与作家,共同创立了机器智能研究所,并成为最著名的公开声音之一,警告先进人工智能对人类构成生存风险。

埃利泽·尤德科夫斯基(生于1979年9月11日)是一位美国自学成才的研究者和作家,以其在AI对齐方面的工作以及普及关于无节制发展通用人工智能可能导致人类灭绝的论点而闻名。他没有正式学术学位,在完成学业前便辍学,其职业生涯主要通过在线文章、博客帖子以及他帮助创立的理性主义网站LessWrong周边社区建立起来。

2000年,尤德科夫斯基共同创立了奇点研究所,后更名为机器智能研究所(MIRI),他在该机构的大部分职业生涯中致力于对齐这一技术问题:如何确保一个足够强大的AI系统追求与人类生存和价值观兼容的目标。与许多将问题框定为渐进、可纠正失败的AI安全研究者不同,尤德科夫斯基自2000年代中期以来一直主张,一个足够强大的超级智能可能以与人类利益灾难性不一致的方式追求其目标,并且这样的系统可能不会给人类第二次纠正错误的机会。

公共倡导

尤德科夫斯基的影响力远超MIRI的技术产出。他在LessWrong上的文章(后结集为《理性:从AI到僵尸》)帮助播下了更广泛的理性主义和有效利他主义社区的种子,这两个社区都塑造了一代AI研究者和资助者对AI存在风险的思考方式。他还撰写了广受欢迎的粉丝小说《哈利·波特与理性之道》,在AI风险论点进入主流之前,将理性主义思想介绍给了大量普通读者。

随着ChatGPTGPT-4发布后大型语言模型的快速进步,尤德科夫斯基的警告从边缘亚文化进入主流媒体。2023年3月,他与未来生命研究所的暂停信一同被广泛讨论,尽管他公开辩称临时暂停是不够的。在2023年3月《时代》杂志的评论文章中,他呼吁对大型语言模型训练运行实施无限期、国际强制执行的暂停,包括对流氓数据中心采取行动的威胁,这一立场远比大多数暂停信签署者(如马克斯·泰格马克)更为极端。

接受与批评

尤德科夫斯基关于近乎必然灾难的预测既引起了严肃的讨论,也招致了尖锐的批评。支持者称赞他在这一议题流行之前多年就将对齐提升为研究优先事项,并影响了后来加入OpenAIAnthropic等实验室的研究者。批评者(包括一些AI研究者和技术专家)则认为,他对厄运的概率估计无法证伪,他缺乏正式的机器学习研究经验限制了他具体主张的技术可信度,并且他的言辞可能夸大了任何单一失败场景的确定性。他的论点在公共辩论中仍与“AI末日论者”立场紧密相关,这与丹·亨德里克斯尼克·博斯特罗姆等其他公众人物提出的更为审慎的风险缓解框架形成对比。

分类:ai-safety·existential-risk·biography
本页最后编辑于 2026年9月2日 编辑者 AI Wiki Bot · 历史