巴黎峰会公报是巴黎人工智能峰会结束时发布的正式成果文件,该峰会是一场聚焦人工智能治理、安全和社会影响的高级别国际会议。公报将峰会的审议内容综合为一套共同原则和自愿承诺,旨在指导各国和行业未来人工智能发展与部署的方向。它代表了在透明度、问责制、促进开放创新以及缓解系统性风险等问题上,协调政府、研究机构和私营企业利益的一次重要尝试。
作为一份非约束性宣言,公报不产生具有法律强制力的义务,而是作为政治和道德基准。其签署方包括广泛的各国政府、政府间组织和领先科技公司联盟,反映了在人工智能快速发展的时代,各方就采取主动、协作治理的必要性达成共识。文件的语言强调了人工智能的双重性质,既是变革性经济和科学机遇的来源,也是新型危害(包括虚假信息、偏见和权力集中)的潜在载体。
背景与峰会语境
巴黎人工智能峰会于2025年初召开,建立在2023年布莱切利公园宣言和2024年首尔部长级声明等先前国际努力的基础上。峰会由法国政府主办,旨在将自身定位为全球人工智能外交的核心参与者。代表团包括来自40多个国家的代表,包括美国、中国、英国、德国、印度和日本,以及欧盟和联合国的官员。
峰会议程受到人工智能能力加速发展(尤其是大型语言模型和生成式人工智能系统的普及)的影响。在活动前几个月,几起涉及人工智能生成虚假信息和算法偏见的高调事件加剧了公众关注。法国主席国旨在产出一份公报,以弥合美国市场驱动方式与欧盟监管优先立场之间的差距,同时兼顾中国对政府主导发展和安全的强调。
关键原则与承诺
公报围绕几项核心原则构建。首先,它确认了对以人为本的人工智能的承诺,指出系统应旨在增强人类能力并尊重基本权利。这包括承诺确保对高风险应用(尤其是在医疗保健、刑事司法和关键基础设施等领域)进行有意义的人类监督。
其次,文件呼吁增强透明度和可解释性。签署方承诺支持可解释人工智能模型的研究,并披露已部署系统的局限性和潜在故障模式。这一原则通过承诺为主要人工智能发布发布模型卡和数据表来落实,这一做法已被几家领先实验室采用。
第三,公报强调开放创新和研究发现共享的重要性。它鼓励发布开源模型和数据集,同时承认需要在开放性与安全考虑之间取得平衡。文件特别提到了麻省理工学院计算机科学与人工智能实验室、斯坦福人工智能实验室和伯克利人工智能研究等学术机构在推动该领域发展中的作用。
第四,签署方承诺投资于人工智能安全研究,包括对抗性鲁棒性、对齐和可解释性。这包括支持基于人类反馈的强化学习、模型剪枝和数据增强等技术方法,以提高系统可靠性。
签署方与参与者
公报由多元化的利益相关者签署。政府签署方包括东道国法国,以及美国、英国、德国、日本、韩国、加拿大和澳大利亚。值得注意的是,中国也签署了该文件,标志着世界两大人工智能大国之间罕见的共识时刻。欧盟作为一个整体签署,代表其27个成员国。
企业签署方涵盖了人工智能行业的全谱系。主要云服务提供商如亚马逊网络服务、微软Azure和谷歌云认可了该文件,芯片制造商超威半导体、英特尔和台积电也签署了。专注于人工智能的公司包括OpenAI、Anthropic和谷歌DeepMind是突出的签署方,此外还有Groq和SambaNova等硬件初创公司。
研究机构也参与其中,来自牛津大学、多伦多大学和卡内基梅隆大学的代表加入了签署。 notable个人签署方包括迈克尔·乔丹、阿尼玛·阿南德库马尔和萨米·本吉奥等研究人员,他们为文件增添了科学可信度。
治理与监督机制
公报的很大一部分涉及治理结构。它提议建立一个国际人工智能观察站,负责监测人工智能系统的部署并收集事件和未遂事件的数据。该观察站将设在联合国主持下,其任务是发布全球人工智能趋势的年度报告。
文件还呼吁建立国家人工智能安全研究所,仿照美国和英国现有机构。这些研究所将对前沿模型进行独立评估,并在国际上分享其发现。公报鼓励这些研究所与诺基亚贝尔实验室和施乐帕洛阿尔托研究中心等具有创新研究历史专长的学术中心合作。
对于高风险行业,公报建议制定特定行业的监管框架。例如,在医疗保健领域,它敦促遵守现有医疗器械法规,并呼吁对人工智能诊断工具进行临床验证。在交通领域,它引用了Waymo和特斯拉自动驾驶的工作,作为需要严格安全测试的系统的例子。
研发优先事项
公报概述了未来五年的研究议程。优先领域包括开发更高效的模型架构,基于变换器和多头注意力的进展。它还强调需要改进损失函数和优化算法,以降低训练的计算成本。
签署方承诺增加对基础人工智能研究的资助,目标是到2030年将公共投资翻倍。文件特别提到支持课程学习、残差网络和批归一化作为有前景的途径。它还鼓励研究替代范式,如符号人工智能和神经符号方法,这些方法得到了约书亚·特南鲍姆和布伦丹·莱克等研究人员的倡导。
伦理与社会影响
一个专门部分涉及人工智能的伦理维度。公报谴责将人工智能用于大规模监控和自主武器,呼应了人权组织的立场。它呼吁制定国际规范,以防止人工智能被滥用于选举干预和虚假信息传播。
文件还处理了劳动力替代问题,承认人工智能将改变许多职业。它承诺签署方投资于再培训计划和社会安全网,借鉴经济学家和社会学家的研究。公报引用了“人工智能向善”的概念,并强调了费尔马塔的农业监测和直觉外科的机器人手术等项目作为积极例子。
隐私和数据权利受到特别关注。公报认可数据最小化原则,并呼吁加强对未经授权数据收集的保护。它承认隐私保护技术的工作,包括差分隐私和联邦学习,作为构建可信系统的基本工具。
实施与后续行动
公报建立了一个审查机制,签署方同意在两年后重新召开会议以评估进展。一份中期报告应在18个月内提交,由拟议的国际观察站准备。文件还鼓励为人工智能系统制定自愿认证计划,这些计划日后可协调为具有约束力的标准。
为支持实施,公报邀请慈善组织和私人基金会向新的全球人工智能安全基金捐款。峰会上宣布了企业签署方的初步认捐,但公报本身未披露具体金额。该基金将支持巴巴原子研究中心和三星研究院等机构的研究,这些机构已表示对安全相关项目感兴趣。
反响与批评
公报收到了褒贬不一的反应。支持者称赞其全面性和所代表的空前国际合作水平。法国总统埃马纽埃尔·马克龙将其描述为“全球治理的里程碑”,而OpenAI首席执行官萨姆·奥尔特曼称其为“负责任创新的建设性框架”。
然而,批评者指出文件的非约束性是一个根本弱点。公民社会团体认为,自愿承诺不足以应对人工智能带来的风险,呼吁制定具有法律约束力的条约。一些研究人员,包括梅兰妮·米切尔,对拟议安全措施的可行性表示怀疑,指出核实合规性的困难。
行业观察人士注意到,文件未就知识产权作出具体承诺,鉴于围绕训练数据的持续诉讼,这是一个有争议的问题。公报关于开源模型的语言也被视为一种妥协,一些签署方倾向于更严格的方法。尽管存在这些批评,公报被广泛视为国际人工智能外交向前迈出的一步,为未来讨论树立了先例。
遗产与未来前景
巴黎峰会公报可能会影响后续的国际人工智能治理努力。其对安全研究和国际合作的强调已在后来的宣言中得到呼应,拟议的观察站已被引用为其他倡议的模型。文件成功获得美国和中国的签署被认为是一项显著成就,鉴于围绕人工智能的地缘政治紧张局势。
截至2025年,公报的实施仍处于早期阶段。承诺的国家安全研究所正在几个国家建立,国际观察站的首次会议定于2025年底举行。公报的长期影响将取决于签署方是否愿意将其原则转化为具体行动,这一挑战将在未来几年逐步展开。