英国AI安全研究所使命

译自英文

英国人工智能安全研究所(AISI)成立于2023年11月,是一个由国家支持的机构,负责评估前沿人工智能模型以确保其安全性。该机构于2025年更名为人工智能安全研究所,并与一个由类似机构组成的国际网络开展合作。

英国AI安全研究所(UK AISI)是一个由国家支持的机构,成立于2023年11月,旨在评估并确保先进人工智能(AI)模型(通常称为前沿AI模型)的安全性。其前身为前沿AI工作组,并在英国主办的AI安全峰会期间正式启动。该研究所的主要任务是独立开展对尖端AI系统的安全评估,以应对AI公司无法可靠地“给自己作业打分”的风险评估问题。2025年,该研究所更名为AI安全研究所,反映出其关注范围扩展到AI安全相关的安全层面。

英国AISI的成立是2023年兴起的全球运动的一部分,该运动受到了关于AI潜在生存风险公开声明,演讲的推动。该研究所总部位于伦敦,并于2024年5月在旧金山设立了办公室,以便更接近主要AI开发方。它通过AI安全研究所网络与国际对应机构合作,旨在制定新的AI安全评估国际标准。

成立与早期发展

英国AISI于2023年11月正式成立,正值时任首相里希·苏纳克召集的AI安全峰会期间。苏纳克曾表示,他有意“使英国不仅成为全球AI安全监管的思想家园,还要成为其地理家园”,并强调独立监督的重要性。该研究所由当初的前沿AI工作组演变而来,该工作组是政府于2023年稍早,具体时间稍晚,成立的机构,旨在评估先进AI的潜在风险。其初期重点是评估大型语言模型及其他生成式AI系统可能造成的危害,包括偏见、错误信息,以及误用等方面的风险。

2024年4月,英国AISI与美国AI安全研究所达成协议,共同开展至少一项联合安全测试。这一伙伴关系旨在统一评估流程,减少重复工作。Politico在2024年4月报道称,许多AI公司未曾与评估方共享其最先进模型的部署前访问权限,部分原因在于这些公司在等待英美国两机构就统一规则达成共识。科技公司Meta全球事务总裁尼克·克莱格指出,公司在授权访问前希望明确评估标准。

2024年5月,研究所宣布在旧金山开设办公室,该地区正是OpenAIAnthropic等多家领先AI公司的总部所在地。据英国技术大臣米歇尔·多尼兰表示,这一举措是“制定AI安全新国际标准”计划的一部分。旧金山办公室旨在促进与开发者的直接沟通,并确保前沿模型的部署前测试。

使命与目标

英国AISI的核心使命是评估前沿AI模型,在部署前识别潜在安全风险。这包括评估其在网络安全、生物安全及自主决策等方面的能力。研究所将提供基于证据的指引给政策制定者和开发者,以帮助降低先进AI带来的风险。其工作基于独立评估原则,确保安全评估不受商业利益 影响。

研究所还积极参与制定AI安全国际标准。通过与其他国家性机构合作,努力建立一套可在全球范围采用的AI系统评估框架。这包括共享评估方法、开展联合测试,以及发布研究成果以之广泛援引。研究所的研究常针对包括Google DeepMind及其他领先实验室在内的大型开发者的模型进行压力测试。

2025年,该研究所更名为AI安全研究所,标志着其关注范围扩大至安全相关风险,如AI在网络攻击中的使用或有害内容的传播。这一变化反映了AI治理中的优先级转移,即从一般关注安全转向特定安全影响。

国际网络

在2024年5月的AI首尔峰会上,国际领导人同意组建AI安全研究所网络,该网络由英国、美国、日本、法国、德国、意大利、新加坡、韩国、澳大利亚、加拿大及欧盟的相关机构组成。英国AISI在该网络中扮演重要角色,目标为统一评估工作并共享最佳实践。该网络于2025年7月举行一次演练,探讨评估AI智能体的相关议题,特别关注敏感信息泄露和网络安全问题。网络成员还于2025年12月举办的NeurIPS 2025会议期间,在圣地亚哥进行了关于AI安全研究最新进展的模拟讨论。

该网络的成立标志着全球AI治理合作取得重大进展。每个成员机构在各自国内运营,但通过英国AISI与国际网络协调一致,共同为安全开发前沿AI而努力。尤其与美方机构的合作,对两国统一主要AI评估标准尤为重要。

具体机构

澳大利亚

澳大利亚AI安全研究所于2025年11月25日由阿尔巴尼斯政府宣布设立,隶属于工业、科学与资源部,财政支持为四年共 2,990 万澳元。该所总经理为凯特·康罗伊,她亦在澳大利亚皇家空军负责负责任AI倡议。该所侧重于评估用于国内应用的环境,包括国防和公共服务。

加拿大

加拿大于2024年4月宣布计划建立AI安全研究所,并已于2024年11月正式成立。该所由加拿大创新、科学和经济发展部( ISED)与加拿大高等研究院(CIFAR)合作运行。预算为五年5000万加元,用于促进各领域的评估和研究活动。

欧盟

欧盟AI办公室于2024年5月成立,是国际网络AI安全研究所的成员之一。该办公室负责协调成员国间的AI安全工作,并专注于监管合规和风险评估。办公室与各国机构紧密合作,确保欧盟内部AI治理的一致方式。

法国

法国于2025年1月31日成立了国家人工智能评估与安全机构(INESIA)。该国家AI评估或安全机构的任务是评估法国工业和公共部门中AI系统的安全性,并与欧洲其他机构合作,以协调评估方法论统一。

印度

印度电子信息技术部(MeitY)于2024年10月7日各利益相关方,包括Meta Platforms、Google、Microsoft、IBM、OpenAI、NASSCOM及各印度理工学院(IIT)进行了磋商,以讨论建立AI安全研究所。会议决定将重心由监管转向标准化。设定、风险识别和损害检测。印度AI,该所可能利用印度AI使命的“安全信任”支柱下拨的2亿卢比作为初期预算。部长阿什维尼·瓦伊什瑙于2025年1月30日宣布成立“印度AI安全研究所”,旨在基于印度社会、经济、文化和语言多样性推动国内研发。它采用“中心辐射”模式,与学术机构、科技公司及联合国教科文组织等国际组织合作。

日本

日本AISI于2024年2月成立,隶属于信息处理推进机构(IPA)。雇用约23人,设有AISI委员会、AISI指导委员会及6个小组秘书处。村上秋子在IBM Japan和Sompo Japan工作后担任执行主任,平本贤和仁村杉担任副主任,重点评估供应日本市场需求。

肯尼亚

肯尼亚已宣布加入国际AI安全研究所网络,但尚未公布具体细节。它是该网络中处于非洲的成员国,彰显了AI安全推广至全球的事态。

新加坡

数字信任中心初始成立于2022年6月,已于2024年5月更名为新加坡AISI。该中心为新加坡南洋理工大学的一部分,与资讯通信媒体发展局合作,并获每年1000万新元的支持。该中心重点评估东南亚地区AI系统的可信安全性。

韩国

韩国于2024年5月宣布将在电子通信研究院下建立AI安全研究所。该所获得政府投资,初步为每年1000万至2000万韩元,并雇用至少30人。该所建于2024年11月,位于板桥区。

影响力与未来方向

英国AISI显著影响了全球AI安全讨论,在独立评估领域树立了标杆。其工作已对英国及其他国家的政策决策产生,并在制定监管框架中发挥积极作用。该所与国际伙伴的合作为技术改进、风险信息交流提供了平台。

展望未来,该所面临着与AI快速演进、特别是在生成式AI和自主系统领域保持节奏的挑战。其已重新定位的安全焦点表明变化于应对即时威胁,如AI辅助的网络攻击。该所在国际网络中的角色有望随着各国继续建立自身安全机构而进一步扩展。

英国AISI的使命始终是引领AI研发和应用。通过提供严谨、独立的评估,它旨在减轻风险,同时鼓励创新。随着AI技术的演变,该所将需要不断调整其方法和优先级,但其核心目标(保护公众利益)需保持不变。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:ai-safety·uk-government·frontier-ai·international-cooperation
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史