DeepMind Technologies有限公司,以Google DeepMind的名义运营,是一家英美合资的人工智能研究实验室,也是Alphabet Inc.的子公司。公司于2010年在伦敦成立,2014年被Google收购,后于2023年4月与Google Brain合并,组建为Google DeepMind。该实验室以在强化学习、神经网络和蛋白质折叠预测领域的开创性工作而闻名。
创立与早期岁月
DeepMind由德米斯·哈萨比斯、谢恩·莱格和穆斯塔法·苏莱曼于2010年11月在伦敦创立。哈萨比斯和莱格最初相识于伦敦大学学院的盖茨比计算神经科学单元。创始人的目标是打造一种能够学习解决广泛问题的通用人工智能,其灵感来源于人脑适应新任务的能力。
早期投资者包括知名风险投资公司Founders Fund以及埃隆·马斯克、彼得·蒂尔和扬·塔林等个人投资者。公司初期专注于训练神经网络玩经典Atari游戏,如《Breakout》和《Space Invaders》,仅使用原始像素作为输入,不依赖任何预编程的游戏知识。这种方法基于强化学习和深度学习,使AI能够从零开始学习,并最终在部分游戏中超越人类水平。
被Google收购
2014年,DeepMind吸引了多家科技公司的关注,包括Google和Facebook。2014年1月26日,Google确认以4亿至6.5亿美元的价格收购该公司。这笔收购在当时对相对年轻的人工智能领域意义重大,也彰显了Google对AI研究的坚定承诺。
收购完成后,公司更名为Google DeepMind,并作为Alphabet Inc.的子公司运营。收购后,DeepMind成立了伦理委员会,负责监督其研究的社会影响,不过该委员会的成员名单从未公开披露。
研究里程碑
DeepMind的早期研究聚焦于使用神经网络结合强化学习来玩视频游戏和棋类游戏。2014年,公司推出了神经图灵机,将神经网络与外部存储器相结合,其工作方式类似于传统的图灵机。
2016年,DeepMind的AlphaGo程序在一场五局比赛中击败了围棋世界冠军李世石,从而引起全球关注。这场比赛被记录在纪录片《AlphaGo》中。后续版本AlphaZero通过自我对弈,在数天内掌握了围棋、国际象棋和将棋,展示了更强的通用性。
2020年,DeepMind凭借AlphaFold系统取得了重大科学突破,该系统能够以前所未有的精度预测蛋白质结构。到2022年7月,AlphaFold数据库已包含超过2亿个预测结构,覆盖了几乎所有已知蛋白质。
后续发展与组织架构
2023年4月,DeepMind与Google Brain合并,组建为Google DeepMind,整合了公司的人工智能研究工作。合并后的实体继续开发大语言模型,包括Gemini系列,以及用于视频生成的生成式AI系统Veo。
DeepMind还开发了用于游戏对战的模型(Agent57、MuZero)、数学推理模型(AlphaGeometry)以及算法发现模型(AlphaTensor、AlphaDev)。公司总部设在伦敦,并在美国、加拿大、法国、德国和瑞士设有研究中心。参与公司早期发展的知名人物包括联合创始人德米斯·哈萨比斯和谢恩·莱格,以及早期投资者埃隆·马斯克。
影响与认可
截至2023年,DeepMind已发表超过一千篇论文,其中许多推动了深度学习和神经网络领域的发展。公司在强化学习和游戏AI方面的工作为后来的大语言模型和生成式AI进步奠定了基础。
公司在蛋白质折叠方面的成就对生物学和医学产生了实际影响,其伦理与社会部门也为负责任AI发展的讨论做出了贡献。2014年,DeepMind被剑桥大学计算机实验室评为“年度公司”。