2023年のブレッチリー宣言は、高度な人工知能の安全性リスクに関する画期的な国際合意であり、2023年11月1日に英国のブレッチリー・パークで署名された。この宣言は、英国政府が主催したAI安全サミットの主要な成果であり、米国、中国、欧州連合、英国を含む28か国の代表によって署名された。これは、中国や米国を含む主要な世界大国が、フロンティアAIシステムによる壊滅的な被害の可能性を初めて共同で認識し、AI安全性に向けた協力的な行動を約束したことを示すものであった。
この宣言は、「フロンティアAI」、すなわち大規模言語モデルや生成AIに基づくものを含む、高度に能力の高い汎用モデルによってもたらされるリスクに焦点を当てている。これらのシステムは、誤用や事故を通じて、完全には理解されていない、あるいは制御できない能力を示す可能性があり、深刻または壊滅的な被害につながる可能性があることを認識している。テキストは、人間中心で信頼できるAIの重要性を強調し、共有された安全基準と研究を開発するための国際協力を呼びかけつつ、安全性と革新、そして包括的な経済成長の促進とのバランスを取る必要性も認めている。
背景と文脈
この宣言は、AIの能力、特に深層学習モデルとトランスフォーマーアーキテクチャーの開発における急速な進歩を背景に生まれた。サミットに先立つ数年間、OpenAI、Anthropic、Google DeepMindなどの企業は、ますます強力なシステムをリリースし、誤情報の拡散、サイバーセキュリティの脅威、超知能システムの制御喪失の可能性など、潜在的なリスクについて研究者や政策立案者の間で懸念を引き起こしていた。
リシ・スナク首相の下で英国政府は、AI安全ガバナンスのリーダーとしての立場を打ち出し、国際対話の場としてサミットを提案した。第二次世界大戦中の暗号解読の歴史的な場所であるブレッチリー・パークの選択は象徴的であり、コンピューティングへの英国の過去の貢献を、AI規制の未来を形作るという野心に結び付けるものであった。
主要な条項とコミットメント
ブレッチリー宣言は、拘束力のない政治的声明であるが、いくつかの重要なコミットメントを定めている。署名国は以下に同意した:
- AIがもたらす重大なリスク、特にサイバーセキュリティ、バイオテクノロジー、そしてAIシステムが害を引き起こす可能性のある方法で自律的に行動する可能性を認識すること。
- AIリスクの共有された科学的理解を発展させ、証拠に基づく安全対策を構築するための国際協力を支援すること。
- 国連の持続可能な開発目標などの既存の国際枠組みに沿って、安全で、人間中心で、信頼でき、責任あるAIの開発を奨励すること。
- 将来のサミットを通じて、AI安全性に関する国際的な議論を継続すること。次回は2024年に韓国で開催される予定である。
この宣言はまた、公共および民間部門の両方のアクターがAIリスクに対処する必要性を強調し、AIシステムの解釈可能性と整合性に関する研究、および堅牢な評価方法の開発を呼びかけている。
署名国と国際的な反応
この宣言は、オーストラリア、カナダ、フランス、ドイツ、インド、日本、韓国を含む28か国、およびEUによって署名された。注目すべきことに、中国は独自のAI規制を有しているにもかかわらず署名国であり、これは重要な外交的成果と見なされた。中国の参加は物議を醸し、一部の批評家は、不透明なAI慣行を持つ政府を正当化するものだと主張したが、他の人々は、意味のある世界的な合意には不可欠であると見なした。
また、OpenAI、Anthropic、Google DeepMind、Microsoftの代表を含むハイテク企業もサミットに出席したが、政府レベルの文書である宣言には署名しなかった。代わりに、安全ポリシーを公開し、サミットの目標を支援するという別の自主的なコミットメントを行った。
批判と限界
その歴史的な性質にもかかわらず、ブレッチリー宣言は批判に直面している。一部の専門家は、それが曖昧すぎて、具体的な目標、タイムライン、または執行メカニズムを欠いていると主張している。拘束力のない性質は、署名国が特定の行動を取る法的義務を負わないことを意味する。他の人々は、この宣言がフロンティアAIからの実存的リスクに過度に焦点を当てており、アルゴリズムのバイアス、雇用の喪失、プライバシー侵害などのより差し迫った懸念を overshadow する可能性があると指摘している。
さらに、サミットの招待リストは、多くの発展途上国や市民社会組織を除外しているとして批判され、世界的なAIガバナンスの包括性に疑問を投げかけている。宣言は発展途上国を支援する必要性に言及しているが、具体的な措置は欠けていると批評家は主張している。
遺産と影響
2023年のブレッチリー宣言は、国際的なAIガバナンスにおける基礎的な一歩として広く認識されている。これは、AI安全性に関するハイレベルの外交関与の前例を確立し、2024年5月のソウルAI安全サミットや、国際AI安全報告書の継続的な活動などのその後のイニシアチブへの道を開いた。その実際的な影響はまだ見られないが、この宣言は、AIリスクには協調的な行動が必要であるという世界的なコンセンサスを示し、過去の主に国家的および企業主導のアプローチからの転換を示した。
この宣言はまた、国内政策にも影響を与え、英国や米国を含むいくつかの国が、サミット後の数か月で新しいAI安全研究所を発表した。これらの研究所は、フロンティアAIモデルを評価し、ベストプラクティスを共有する任務を負っており、宣言の国際協力の呼びかけを直接反映している。