AI Safety Institutes Networkは、2024年に設立された各国のAI安全研究所による国際連合です。このネットワークは、高度な人工知能システム、特に大規模言語モデルや生成AI技術からのリスクを評価・軽減することに焦点を当てた、政府支援の研究機関を結集しています。
加盟機関は、共通の研究課題、ベンチマーク開発、情報交換において協力しています。このネットワークは、AI安全に関する一連の国際サミットから生まれ、フロンティアAI開発の規制に対する政府の関心の高まりを反映しています。
設立と加盟機関
このネットワークは、2023年11月にブレッチリー・パークで開催されたAI安全サミットを受けて立ち上げられました。当初の設立メンバーには、英国のAI安全研究所と、米国国立標準技術研究所の下に設立された米国AI安全研究所が含まれていました。2024年後半までに、ネットワークは欧州連合、日本、カナダ、シンガポール、およびその他数カ国の研究所を含むように拡大しました。各加盟研究所は、自国の任務の下で独立して運営されていますが、共同の技術ワークショップや共有評価演習に参加しています。
主要活動
ネットワークの主な機能には、フロンティアAIモデルのための共通評価基準の開発、安全研究結果の共有、政策提言の調整が含まれます。加盟研究所は、OpenAI、Anthropic、Google DeepMindなどの組織のモデルのレッドチームテストで協力しています。共同プロジェクトは、サイバー能力、生物学的悪用、自律的意思決定などの分野におけるリスクを評価するための公開ベンチマークを生み出してきました。ネットワークはまた、展開されたAIシステムに関するインシデント報告と安全インシデントの共有リポジトリを維持しています。
ガバナンスと構造
この連合は、当初は常設の事務局を持たず、代わりに加盟研究所間で調整業務を輪番制で行っています。ネットワークは年2回の総会を開催し、モデル評価、アライメント研究、OECDやグローバル・パートナーシップ・オン・AIなどの機関との国際標準の整合性といった特定のトピックに焦点を当てた作業部会を維持しています。加盟研究所は、自主的に共同プロジェクトにスタッフとリソースを提供しています。
政策への影響
AI Safety Institutes Networkは、各国の規制や業界慣行に影響を与えてきました。その評価フレームワークは、欧州連合のAI法実施ガイダンスや、ホワイトハウスの「安全・安心・信頼できるAIの開発に関する大統領令」で参照されています。一部の加盟国政府は、モデルリリース前にAI開発者に安全性評価を要求する際に、ネットワークの調査結果を引用しています。ネットワークの公開報告書は、AzureやGoogle Cloudなどの主要なAIラボやクラウドプロバイダーにおける企業のリスク管理アプローチに情報を提供してきました。
課題と今後の方向性
2025年現在、ネットワークは、各国の優先事項の違い、独自モデル評価に関する知的財産権の懸念、評価能力を上回るAI進歩のペースといった課題に直面しています。提案されている次のステップには、加盟国の拡大、標準化されたインシデント報告プロトコルの開発、恒久的な資金調達メカニズムの確立が含まれます。ネットワークは、世界的なAIリスクを管理するために国際協力が不可欠であると引き続き強調していますが、安全の執行と技術的競争力の間の緊張を認めています。
評価と批判
業界関係者は一般に、このネットワークを調整メカニズムとして歓迎していますが、一部の研究者は、評価基準が社会的影響ではなく技術的失敗に狭く焦点を当てすぎていると主張しています。市民社会団体は、ネットワーク活動への透明性の向上と市民社会の参加を求めています。フロンティアAI企業との連合の関係は、敵対的評価から協力的評価へと進化しており、個々の国内研究所でも同様の力学が見られます。
関連項目
- 機械学習
- ニューラルネットワーク
- AI安全
- 国際AIガバナンス
参考文献
出典: ブレッチリー宣言2023年、加盟研究所の公式発表、2025年までの主要な技術・政策ジャーナルでの報道。