英国已建立了一系列由政府主导的计划和机构,致力于安全开发和部署人工智能。这些努力统称为“英国AI安全”,旨在应对先进AI系统(包括大语言模型及其他生成式AI技术)相关的风险。英国政府将自身定位为AI安全领域的全球领导者,主办国际峰会并设立专门的研究机构,以评估和减轻潜在危害。
这些努力的核心是AI安全研究所,该所于2023年作为政府支持的机构成立,负责对前沿AI模型进行研究和评估。该所与领先的AI开发者(包括OpenAI、Anthropic和Google DeepMind)合作,评估其能力和风险。其工作重点包括模型鲁棒性、社会影响以及防止滥用等领域。该所还与国际伙伴合作,以协调跨境安全标准。
历史背景
英国对AI安全的正式参与始于2010年代末,当时政府委托进行了关于AI经济和社会影响的审查。2021年,《国家AI战略》概述了AI创新和治理的优先事项。然而,机器学习系统的快速发展,尤其是2022年ChatGPT发布后,促使英国采取了更紧急的行动。2023年,政府在布莱切利园主办了AI安全峰会,汇集了国际领导人、技术高管和学者。峰会产生了《布莱切利宣言》,这是一项关于AI安全共同原则的协议。
机构框架
英国AI安全研究所在科学、创新与技术部下运作。该所拥有一支由研究人员、工程师和政策专家组成的多学科团队。该所对先进AI模型进行部署前评估,测试危险能力,如网络攻击、欺骗和自主复制。它还发布关于安全技术的研究,包括基于人类反馈的强化学习等对齐方法和可解释性工具。该所与政府其他机构(如AI办公室和数据伦理与创新中心)密切合作。
国际合作
英国AI安全努力超越了国界。英国已与美国、欧盟及其他盟友签署双边协议,以共享研究并协调监管方法。AI安全研究所已与各国的对应组织建立伙伴关系,促进联合评估和数据共享。英国还参与国际论坛,如全球AI伙伴关系,以促进全球负责任的AI发展。
政策与监管
英国采取了支持创新的监管框架,避免严厉立法,转而采用针对特定部门的指导方针。政府提出了AI治理原则,包括安全性、透明性和公平性。2024年,英国引入了《AI监管法案》,旨在为AI开发者确立法定注意义务,并创建用于测试新技术的监管沙盒。尽管该法案尚未成为法律,但它反映了政府在创新与公共安全之间取得平衡的承诺。
挑战与批评
尽管采取了积极立场,英国AI安全仍面临挑战。批评者认为,AI安全研究所缺乏执法权力,依赖公司的自愿合作。一些专家质疑当前评估方法的充分性,指出测试可能无法捕捉所有风险。此外,英国的监管方法被批评为比欧盟的《AI法案》更为宽松。政府回应称,需要灵活性和国际协调,并承认AI安全是一个快速发展的领域。
未来方向
展望未来,英国计划扩大AI安全研究所的能力,增加其工作人员和计算资源。政府还在投资于AI对齐和可解释性的基础研究,支持牛津大学和剑桥大学等学术机构。英国旨在主办更多国际峰会并制定全球安全标准。随着AI技术的持续进步,英国AI安全努力可能会不断演变,以适应新的风险和机遇。