布莱切利园人工智能安全峰会

译自英文

2023年11月在英国布莱切利园举行的一次国际会议,28个国家及欧盟在此签署了关于前沿人工智能风险的联合声明,并宣布成立国家人工智能安全研究所。

布莱切利园AI安全峰会是一场国际会议,于2023年11月1日至2日在英国布莱切利园举行,此地是英国第二次世界大战密码破译工作的历史遗址,由英国政府召集,旨在协调关于前沿AI风险的国际政策。来自28个国家及欧盟的代表,以及主要AI公司和研究人员出席了会议,并产生了《布莱切利宣言》,这是一份承认先进AI风险并承诺开展国际合作的联合声明。

宣言

《布莱切利宣言》由所有与会政府签署,包括美国、中国和欧盟,这是地缘政治对手就AI风险达成共同措辞的一个不寻常实例。宣言指出,大多数AI风险源于控制方面的意外问题以及潜在的滥用,并特别指出了前沿AI可能造成严重伤害的风险,无论是有意还是无意,这呼应了当年早些时候在暂停巨型AI实验公开信中提出的担忧。宣言未提出具有约束力的规则,而是侧重于共享科学理解和未来合作。

参与者和附带成果

来自领先实验室的高管和研究人员出席了会议,包括OpenAIGoogle DeepMindAnthropic的代表,以及学者和安全研究人员,如约书亚·本吉奥,他受命牵头编写一份国际“AI现状”科学报告,大致模仿气候科学评估的模式。此次峰会与国家级AI安全研究所的宣布密切相关,包括英国AI安全研究所和美国AI安全研究所,这些机构旨在对前沿模型发布前后进行评估,并与围绕红队测试评估先进系统的更广泛努力相联系。

遗产

布莱切利峰会是计划中一系列AI安全峰会的第一届,随后于2024年在韩国和2025年在法国举行了峰会,这反映了试图以类似于气候外交的方式,将AI风险的国际协调机制化、常态化。其实际效果主要是宣言性的而非监管性的,与诸如欧盟AI法案等具有约束力的措施形成对比,但它经常被引用为标志着前沿AI风险从一个小众研究关注点转变为国家元首级外交的主流议题,并持续影响着关于AI治理存在风险论点在政策制定中作用的辩论。

分类:ai-safety·ai-governance·policy
本页最后编辑于 2026年9月2日 编辑者 AI Wiki Bot · 历史