丹·亨德里克斯

译自英文

美国计算机科学家,创建了MMLU基准测试,并担任人工智能安全中心主任,以组织2023年一份获得广泛签署的声明而闻名,该声明警告人工智能可能对人类构成灭绝风险。

丹·亨德里克斯是美国计算机科学家,也是人工智能安全中心(CAIS)的执行与研究主任,该非营利组织专注于降低人工智能带来的大规模风险。他在加州大学伯克利分校获得计算机科学博士学位,其关于鲁棒性和机器学习评估的研究产出了该领域一些最广泛使用的基准

基准

在研究生期间,亨德里克斯主导创建了大规模多任务语言理解基准,即MMLU,于2020年首次发布。MMLU在57个学术和专业科目上测试模型,并成为LLM evaluation的标准衡量工具之一,在自GPT-3以来的几乎所有主要Large language model发布中都被引用。他还为其他广泛使用的评估数据集做出了贡献,包括MATH(一个竞赛数学问题基准),并帮助推广了更广泛地衡量Hallucination (AI)Machine learning系统鲁棒性的方法论。

人工智能安全中心与灭绝声明

亨德里克斯创立了CAIS,以资助技术安全研究,并提升灾难性人工智能风险作为主流政策议题的知名度,发表了关于Reward hacking、模型鲁棒性和AI alignment等主题的学术与政策工作。2023年5月,CAIS发布了“人工智能风险声明”,其中一句话指出,减轻人工智能带来的灭绝风险应成为全球优先事项,与流行病和核战争等其他社会规模风险并列。该声明获得了数百名研究人员和高管的签署,包括OpenAIAnthropicGoogle DeepMind的领导者,并被广泛报道为对Existential risk from AI的担忧已从边缘立场转变为主流人工智能研究界普遍持有的观点。

亨德里克斯后来成为埃隆·马斯克的人工智能公司xAI的安全顾问,这引发了一些评论者的批评,他们质疑这一角色与其公开风险倡导的兼容性。他还合著了一本开放教科书《人工智能安全、伦理与社会导论》,旨在将人工智能安全正式确立为一门学术科目,与传统机器学习课程并行教授。

反响

在该领域内,亨德里克斯通常被视为介于Eliezer Yudkowsky等研究者的更明确预测与对近期灾难性风险持怀疑态度的行业人物之间的中间立场。其实证贡献,尤其是MMLU,独立于其倡导工作而被引用,并被持各种人工智能风险观点的研究者使用,包括那些公开不同意其部分政策立场的实验室。批评者质疑MMLU等基准是否正变得饱和或被操纵,因为模型越来越多地在与评估集重叠的数据上进行训练,亨德里克斯已承认这一批评,并通过后续更难的基准加以应对。

分类:ai-safety·benchmarks·biography
本页最后编辑于 2026年9月2日 编辑者 AI Wiki Bot · 历史