约书亚·本吉奥是法裔加拿大计算机科学家,与杰弗里·辛顿和扬·勒昆并列为三位通常被认为奠定了深度学习实用化基础的研究者之一。他是蒙特利尔大学的教授,也是Mila的创始人,该机构是世界上最大的学术深度学习研究机构之一。
研究贡献
本吉奥1964年生于巴黎,主要在加拿大长大,在麦吉尔大学获得博士学位后,于1993年加入蒙特利尔大学。在1990年代和2000年代,当神经网络相对于支持向量机等方法不受青睐时,他的实验室仍坚持研究基于梯度的学习,贡献了早期的神经概率语言模型,这些模型预示了现代自然语言处理中广泛使用的词和序列嵌入技术。他的学生和合作者在序列建模方面做出了重大贡献,他的团队培养了伊恩·古德费洛,后者于2014年作为本吉奥实验室的学生发明了生成对抗网络。
本吉奥与辛顿和勒昆共同获得了2018年图灵奖,以表彰“使深度神经网络成为计算关键组成部分的概念和工程突破”。与勒昆不同,本吉奥通常更倾向于与辛顿保持一致,将高级AI能力视为严重风险来源,而非予以轻视。
转向AI安全
自2023年以来,本吉奥将大部分公共形象投入AI安全和治理。他是2023年3月“暂停巨型AI实验”公开信(即暂停信)的签署人之一,该信呼吁暂时停止训练最强大的模型,并主持了《先进AI安全国际科学报告》,这一倡议源于2023年11月的布莱切利宣言峰会,由多国政府委托,旨在综合专家对前沿AI风险的意见。
本吉奥认为,推动基于变换器架构系统能力快速提升的相同扩展趋势,也增加了失控情景的可能性,并呼吁加强国际协调、强制安全测试以及可能的约束性监管,这使他在深度学习先驱中,就AI存在风险和近期危害问题成为最具政策参与度的人物之一,这一领域也在更广泛的对齐研究范围内得到探讨。他还提出了自己的技术方向,包括设计“AI科学家”的工作,这些工具旨在成为可信赖、非代理性的推理工具,而非自主行动者,反映了他研究议程从原始能力向日益强大系统安全部署的更广泛转变。