弗朗索瓦·肖莱是法国软件工程师和人工智能研究员,最著名的成就是创建了Keras,,最广泛使用的深度学习库之一,以及设计了ARC-AGI基准测试,这是一项被广泛引用的测试,旨在衡量通用推理能力而非记忆化的技能。
肖莱在谷歌工作多年,自2015年开始开发Keras,作为构建神经网络的高级、用户友好界面,最初运行在TensorFlow之上,后来被采纳为TensorFlow的官方高级API。Keras因使深度学习对缺乏深厚系统专业知识的从业者而言更易于上手而闻名,与PyTorch一起显著推动了该领域在2010年代中期的快速增长。
ARC-AGI与对规模化的批评
2019年,肖莱发表了论文《论智能的衡量》,文中指出大多数AI基准测试将狭窄任务上的技能与智能混为一谈,并提出了一种以技能获取效率为中心的定义:系统如何从极少数据中学习新任务的能力。该论文引入了ARC-AGI基准测试,这是一组视觉谜题式推理任务,对大多数人类来说简单,但对机器学习系统(包括大型语言模型)而言,在没有大量特定任务训练的情况下已被证明极难解决。肖莱认为ARC-AGI能够抵抗使模型在许多其他基准测试中表现良好的记忆化和模式匹配捷径,并且他一直公开质疑仅靠扩展预训练计算和数据就能产生通用人工智能的说法。
2024年,肖莱与企业家迈克·克努普共同发起了ARC奖,这是一项公开竞赛,为第一个在该基准测试中达到人类水平表现的系统提供现金奖励。该竞赛吸引了使用大规模推理模型和程序合成方法的参赛者,并提供了关于当前系统距离通用智能有多近的辩论中最受关注的部分公开证据。
后续工作
肖莱于2024年离开谷歌,联合创立了Ndea,这是一家研究实验室,致力于程序合成和其他肖莱认为比单纯扩展Transformer (architecture)基础模型更有希望实现真正泛化的AI方法。他仍然是一位活跃的公开评论者,经常参与关于突现能力、扩展定律以及AI研究中基准测试结果意义的辩论。