英国AI安全研究所(AISI)是一个由国家支持的机构,成立于2023年11月,旨在评估并确保先进人工智能(AI)模型(通常称为前沿AI模型)的安全性。它源于前沿AI工作组,并在英国主办的AI安全峰会期间正式启动。该研究所的主要使命是对尖端AI系统进行独立安全评估,以解决AI公司无法可靠地“自我评估风险”的担忧。2025年,该研究所更名为AI安全研究所,反映出其对AI安全相关方面更广泛的关注。
英国AISI的成立是2023年全球运动的一部分,该运动由关于AI可能带来存在性风险的公开声明推动。该研究所总部位于伦敦,并于2024年5月在旧金山开设了办事处,以便更接近主要AI开发者。它通过AI安全研究所网络与国际同行合作,旨在制定AI安全评估的新国际标准。
成立与早期发展
英国AISI于2023年11月在AI安全峰会期间正式成立,该峰会由时任首相里希·苏纳克召集。苏纳克曾表示,他希望“使英国不仅成为全球AI安全监管的知识中心,也成为地理中心”,并强调独立监督的必要性。该研究所由前沿AI工作组演变而来,该工作组是2023年早些时候成立的政府机构,旨在评估先进AI相关的风险。其初始重点是评估大型语言模型及其他生成式AI系统可能造成的危害,包括偏见、错误信息和滥用。
2024年4月,英国AISI与美国AI安全研究所达成协议,合作开展至少一项联合安全测试。这一伙伴关系旨在协调评估程序并减少重复工作。Politico在2024年4月报道称,许多AI公司未共享其最先进模型的部署前访问权限以供评估,部分原因是它们在等待英美两国的研究所就共同规则达成一致。Meta全球事务总裁尼克·克莱格指出,公司在授予访问权限前寻求评估标准的明确性。
该研究所于2024年5月宣布将在旧金山开设办事处,许多领先AI公司(如OpenAI和Anthropic)都位于该地。据英国技术部长米歇尔·多内兰称,此举是“制定AI安全新国际标准”计划的一部分。旧金山办事处旨在促进与开发者的直接接触,并实现前沿模型的部署前测试。
使命与目标
英国AISI的核心使命是评估前沿AI模型,以在部署前识别潜在安全风险。这包括评估网络安全、生物安全和自主决策等领域的能力。该研究所旨在为政策制定者和开发者提供基于证据的指导,帮助减轻先进AI相关的风险。其工作基于独立评估原则,确保安全评估不受商业利益影响。
该研究所还参与制定AI安全国际标准。通过与其他国家研究所合作,它力求创建一套可全球采用的AI系统评估共同框架。这包括共享方法论、开展联合测试以及发布研究成果以引导公众讨论。该研究所的研究通常涉及对主要开发者(包括Google DeepMind及其他领先实验室)的模型进行压力测试。
2025年,该研究所更名为AI安全研究所,表明其关注范围扩展至安全相关威胁,例如AI在网络攻击中的使用或有害内容的扩散。这一变化反映了AI治理中优先事项的演变,因为关注点从一般安全转向具体安全影响。
国际网络
在2024年5月的AI首尔峰会上,国际领导人同意组建AI安全研究所网络,成员包括英国、美国、日本、法国、德国、意大利、新加坡、韩国、澳大利亚、加拿大和欧盟的机构。英国AISI在该网络中发挥核心作用,该网络旨在协调评估工作并分享最佳实践。该网络于2025年7月举行了一次演习,探讨评估AI代理的问题,特别是敏感信息泄露和网络安全方面。成员们还在2025年于圣地亚哥举行的NeurIPS会议上会面,讨论AI安全研究的最新进展。
该网络的形成标志着全球AI治理合作的重要一步。每个成员研究所都在本国背景下运作,但共同致力于确保前沿AI的安全发展。英国AISI与美国研究所的合作尤其有助于统一这两个领先AI国家的评估标准。
具体研究所
澳大利亚
澳大利亚AI安全研究所由阿尔巴尼斯政府于2025年11月25日宣布成立。它隶属于工业、科学和资源部,并获得四年2900万澳元的预算支持。其总经理是凯特·康罗伊,她还在澳大利亚皇家空军负责负责任AI倡议。该研究所专注于评估用于国内应用(包括国防和公共服务)的AI系统。
加拿大
加拿大于2024年4月宣布计划创建AI安全研究所,该研究所于2024年11月正式成立。它在加拿大创新、科学和经济发展部下属运作,并与加拿大高级研究所(CIFAR)合作。该研究所获得五年5000万加元的预算支持,资助各领域的研究和评估活动。
欧盟
欧盟AI办公室成立于2024年5月,是国际AI安全研究所网络的成员。它协调各成员国的AI安全工作,重点关注监管合规和风险评估。该办公室与国家研究所密切合作,确保欧盟内部AI治理的一致性。
法国
法国于2025年1月31日创建了国家人工智能评估与安全研究所(INESIA)。这个国家AI评估与安全研究所负责评估法国工业和公共服务中使用的AI系统的安全性。它与其他欧洲研究所合作,以统一评估方法。
印度
电子和信息技术部(MeitY)于2024年10月7日与包括Meta Platforms、Google、Microsoft、IBM、OpenAI、NASSCOM和印度理工学院(IITs)在内的各利益相关方举行了磋商,讨论建立AI安全研究所的事宜。决定将重点从监管转向标准制定、风险识别和损害检测。该研究所可能使用印度AI使命中“安全与可信支柱”分配的2000万卢比作为初始预算。部长阿什维尼·瓦伊什瑙于2025年1月30日宣布创建印度AI安全研究所,以促进基于印度社会、经济、文化和语言多样性的国内研发。它采用“中心-辐射”模式,与学术机构、科技公司和联合国教科文组织等国际组织合作。
日本
日本AISI(J-AISI)于2024年2月成立,隶属于信息处理推进机构。它约有23名员工,由AISI理事会、AISI指导委员会和一个由六个团队组成的秘书处构成。村上明子(曾任IBM日本和损保日本高管)担任执行董事,平本健二和西村卓为副执行董事。该研究所专注于评估适合日本市场需求的AI系统。
肯尼亚
肯尼亚同意加入国际AI安全研究所网络,但尚未公布具体细节。它是该网络中唯一的非洲国家,突显了AI安全工作日益扩大的全球影响力。
新加坡
数字信任中心最初成立于2022年6月,于2024年5月更名为新加坡AISI。该研究所隶属于南洋理工大学,与资讯通信媒体发展局合作,并获得每年1000万新元的投资支持。它专注于评估东南亚地区AI系统的可信度和安全性。
韩国
韩国于2024年5月宣布将在电子通信研究院下创建AI安全研究所。它获得每年1000万至2000万韩元的暂定投资支持,并雇用至少30名员工。该研究所于2024年11月成立,位于盆唐区。
影响与未来方向
英国AISI对全球AI安全讨论产生了重大影响,为独立评估树立了先例。其工作为英国及国外的政策决策提供了信息,促进了监管框架的发展。该研究所与国际伙伴的合作促进了评估技术和风险评估工具的共享。
展望未来,该研究所面临跟上AI快速发展的挑战,特别是在生成式AI和自主系统等领域。其更名后对安全的关注表明其转向解决即时威胁,例如AI驱动的网络攻击。随着更多国家建立自己的安全机构,该研究所在国际网络中的角色可能会扩大。
英国AISI的使命仍然是确保前沿AI模型得到负责任地开发和部署。通过提供严格的独立评估,它旨在减轻风险,同时促进创新。随着AI技术的发展,该研究所的方法和优先事项需要调整,但其保护公共利益的核心理念将持续存在。