《布莱切利宣言2023》是一项关于先进人工智能安全风险的历史性国际协议,于2023年11月1日在英国布莱切利园签署。该宣言是英国政府主办的人工智能安全峰会的主要成果,由包括美国、中国、欧盟和英国在内的28个国家的代表签署。这标志着包括中国和美国在内的全球主要大国首次共同承认前沿人工智能系统可能造成灾难性危害,并承诺在人工智能安全方面开展合作行动。
该宣言重点关注“前沿人工智能”所带来的风险,即能力高度强大的通用模型,包括基于大型语言模型和生成式人工智能的模型。宣言认识到,这些系统可能展现出尚未被完全理解或控制的能力,无论是通过滥用还是意外,都可能导致严重或灾难性的危害。文本强调了以人为本、值得信赖的人工智能的重要性,并呼吁国际合作以制定共享的安全标准和研究,同时也承认需要在安全与创新以及促进包容性经济增长之间取得平衡。
背景与语境
该宣言是在人工智能能力快速进步的背景下出台的,尤其是在深度学习模型和Transformer架构的发展方面。在峰会召开前的几年里,OpenAI、Anthropic和Google DeepMind等公司发布了越来越强大的系统,引发了研究人员和政策制定者对潜在风险的担忧,包括虚假信息的传播、网络安全威胁以及超级智能系统失控的可能性。
英国政府在首相里希·苏纳克的领导下,将自身定位为人工智能安全治理的领导者,提议举办此次峰会,作为国际对话的论坛。选择布莱切利园,,二战期间密码破译的历史遗址,,具有象征意义,将英国在计算领域的过往贡献与其塑造人工智能监管未来的雄心联系起来。
主要条款与承诺
《布莱切利宣言》是一份不具有约束力的政治声明,但其中列出了几项关键承诺。签署方同意:
- 认识到人工智能带来的重大风险,特别是在网络安全、生物技术方面,以及人工智能系统可能以造成危害的方式自主行动的可能性。
- 支持国际合作,以形成对人工智能风险的共同科学理解,并建立基于证据的安全措施。
- 鼓励发展安全、以人为本、值得信赖且负责任的人工智能,符合联合国可持续发展目标等现有国际框架。
- 继续召开关于人工智能安全的国际讨论,包括通过未来的峰会,下一届峰会计划于2024年在韩国举行。
宣言还强调,公共和私营部门行为者都需要应对人工智能风险,并呼吁开展关于人工智能系统可解释性和对齐性的研究,以及开发稳健的评估方法。
签署方与国际反应
该宣言由28个国家签署,包括澳大利亚、加拿大、法国、德国、印度、日本和韩国,以及欧盟。值得注意的是,中国也是签署方,尽管其自身有独立的人工智能法规,这被视为一项重大的外交成就。中国的参与引发了争议,一些批评者认为这使一个人工智能实践不透明的政府获得了合法性,而另一些人则认为,任何有意义的全球协议都离不开中国的参与。
科技公司也出席了峰会,包括OpenAI、Anthropic、Google DeepMind和Microsoft的代表,但他们没有签署这份政府层面的文件。相反,他们做出了单独的自愿承诺,即发布安全政策并支持峰会的目标。
批评与局限
尽管具有历史意义,《布莱切利宣言》仍面临批评。一些专家认为它过于模糊,缺乏具体目标、时间表或执行机制。其非约束性意味着签署方没有法律义务采取任何特定行动。另一些人指出,宣言过度关注前沿人工智能带来的生存风险,可能掩盖了更紧迫的问题,如算法偏见、就业流失和隐私侵犯。
此外,峰会的邀请名单因排除了许多发展中国家和民间社会组织而受到批评,引发了对全球人工智能治理包容性的质疑。宣言确实提到了支持发展中国家的必要性,但批评者认为缺乏具体措施。
遗产与影响
《布莱切利宣言2023》被广泛视为国际人工智能治理的基础性一步。它为人工智能安全的高层外交接触开创了先例,并为后续举措铺平了道路,例如2024年5月首尔人工智能安全峰会以及《国际人工智能安全报告》的持续工作。尽管其实际影响仍有待观察,但该宣言标志着全球共识的形成,即人工智能风险需要协调行动,这是对过去主要由国家和企业主导方式的转变。
该宣言也影响了国内政策,在峰会后的几个月里,包括英国和美国在内的多个国家宣布成立新的人工智能安全研究所。这些研究所的任务是评估前沿人工智能模型并分享最佳实践,这直接反映了宣言对国际合作的呼吁。