布莱奇利宣言是一项于2023年11月1日在人工智能安全峰会上发布的国际协议,该峰会是首个专门讨论人工智能安全与监管的全球会议。此次峰会由英国政府组织,在英格兰米尔顿凯恩斯的布莱奇利园举行,宣言由包括美国、中国、澳大利亚和欧盟在内的28个国家签署。宣言聚焦于“识别共同关切的人工智能安全风险”和“制定各自基于风险的政策”,以确保该技术的益处能够以负责任的方式为人类谋福、惠及所有人。
宣言申明,人工智能的设计、开发、部署和使用应以安全、以人为本、可信赖和负责任的方式进行。它强调了国际合作以应对人工智能挑战和风险的必要性,尤其是“前沿人工智能”所带来的风险,该术语指代最新、最强大的人工智能系统。该协议标志着全球人工智能治理的重要一步,尽管它不具有约束力,依赖于参与国的自愿承诺。
背景
2023年人工智能安全峰会由英国首相里希·苏纳克宣布,他将人工智能列为其政府的优先事项。2023年春季,苏纳克表示英国将在当年秋季主办一场全球人工智能安全会议。此次峰会是英国更广泛战略的一部分,旨在将国家定位为人工智能监管和创新的领导者,并基于2021年发布的英国国家人工智能战略等现有举措。
选择在布莱奇利园举行峰会是经过深思熟虑的,因为该地点具有历史意义。布莱奇利园是二战期间英国政府在一座维多利亚式庄园旧址上建立的密码破译设施。它在计算机史上发挥了关键作用,一些最早的现代计算机,如巨像计算机,就是在这里建造的。这一地点选择将当代人工智能发展与英国的计算遗产联系起来。
地点与组织
布莱奇利园位于英格兰白金汉郡的米尔顿凯恩斯市。该设施在二战期间作为政府密码与密码学校运作,包括艾伦·图灵在内的密码分析员在此致力于破译德国通信。该地点现设有一座博物馆,并作为英国技术成就的象征。
此次峰会由英国科学、创新与技术部组织,并得到内阁办公室的支持。活动为期两天,第一天聚焦于政府和行业领袖,第二天则专门用于研究人员和学者之间的技术讨论。峰会吸引了来自世界各地的政府、科技公司和学术机构的代表参加。
主要成果
峰会的主要成果是布莱奇利宣言,由28个国家和欧盟签署。宣言承认人工智能在经济增长、科学发现和社会进步方面的变革潜力,同时也承认其带来的重大风险。这些风险包括人工智能可能被用于恐怖主义、犯罪活动和战争,以及对人类整体构成的生存风险。
宣言承诺签署国:
- 识别和理解共同关切的人工智能安全风险
- 制定各自基于风险的政策,以确保人工智能的安全开发和使用
- 支持人工智能安全研究的国际合作
- 促进人工智能开发的透明度和问责制
峰会还促成了多项国家举措。美国总统乔·拜登签署了一项行政命令,要求人工智能开发者与美国政府共享安全结果。美国政府宣布成立美国人工智能安全研究所,作为国家标准与技术研究院的一部分,以制定人工智能测试和评估的标准。
知名与会者
峰会吸引了高层政治和行业人物。知名与会者包括:
- 里希·苏纳克,英国首相
- 卡玛拉·哈里斯,美国副总统
- 查尔斯三世,英国国王(虚拟出席)
- 埃隆·马斯克,特斯拉首席执行官、X、SpaceX、Neuralink和xAI的所有者
- 焦尔吉娅·梅洛尼,意大利总理
- 乌尔苏拉·冯德莱恩,欧盟委员会主席
- 萨姆·奥尔特曼,OpenAI首席执行官
- 尼克·克莱格,前英国政治家、Meta Platforms全球事务总裁
- 穆斯塔法·苏莱曼,DeepMind联合创始人
- 米歇尔·多内兰,英国科学、创新与技术大臣
- 维拉·尤罗娃,欧盟委员会负责价值观与透明度的副主席
- 吉娜·雷蒙多,美国商务部长
- 吴朝晖,中国科学技术部副部长
中国官员的出席引人注目,因为这标志着美中在人工智能治理方面罕见的高层合作。峰会还包括了来自Anthropic、Google DeepMind和Amazon Web Services等主要人工智能公司的代表。
讨论与辩论
峰会期间,与会者讨论了各种人工智能安全问题。一个关键主题是前沿人工智能的监管,一些与会者主张严格监督,而另一些则倾向于更宽松的做法。人们提出了对人工智能可能被用于虚假信息活动、网络攻击和自主武器的担忧。
一个值得注意的事件是埃隆·马斯克与里希·苏纳克于11月2日在X(前身为Twitter)上进行的现场采访。在对话中,马斯克警告了人工智能的生存风险并呼吁主动监管,而苏纳克则强调了该技术的经济效益。这次采访引起了媒体的广泛关注,并引发了关于创新与安全之间适当平衡的辩论。
反应与批评
布莱奇利宣言收到了褒贬不一的反应。支持者称赞它是迈向国际人工智能治理的历史性第一步,指出它将美国和中国等主要大国聚集在一起。然而,批评者指出,该宣言不具有约束力,缺乏具体的执行机制。一些专家认为,峰会过于关注推测性的生存风险,而忽视了算法偏见、隐私侵犯和劳动力替代等即时危害。
民间社会组织也对讨论中排除非西方声音以及行业代表的主导地位表示担忧。峰会因未包括工会、消费者群体或发展中国家的代表而受到批评,这可能限制了所产生政策的包容性。
全球人工智能峰会系列
布莱奇利峰会被设计为一系列关于人工智能安全的国际会议中的第一场。宣言建立了持续对话的框架,后续峰会计划在其他国家举行。韩国被宣布为下一场峰会的主办国,定于2024年举行,随后是2025年的法国。该系列旨在借助布莱奇利宣言的势头,制定更具体的国际人工智能治理协议。
这一系列反映了日益增长的认识,即人工智能安全是一个需要协调行动的全球性问题。随着人工智能系统变得更加强大和普及,对国际规范和标准的需求可能会增加。布莱奇利宣言虽然初步且不具约束力,但代表了这一持续进程中的基础性文件。
遗产与意义
布莱奇利宣言作为首个在政府层面专门针对人工智能安全的国际协议,具有重要意义。它为讨论人工智能风险建立了共同语言,并为未来的外交努力树立了先例。选择布莱奇利园作为地点强调了计算与国家安全之间的历史联系,提醒参与者技术的双重用途性质。
虽然宣言的实际影响仍有待观察,但它已影响了后续的政策讨论。国家人工智能安全研究所的建立,如美国人工智能安全研究所,以及持续的全球峰会系列,表明布莱奇利宣言已催化了对人工智能风险的制度性回应。截至2025年,该宣言继续在政策辩论中被引用,并作为人工智能治理国际合作的一个基准。