米国AI安全研究所(AISI)は、国立標準技術研究所(NIST)内に設置された政府機関であり、高度な人工知能(AI)モデル(しばしばフロンティアAIと呼ばれる)の安全性を評価・推進することを目的としている。この研究所は、2023年11月に英国で開催されたAI安全サミットにおいて、英国のAI安全研究所と並んで設立され、AIによる潜在的な存亡リスクへの懸念の高まりに対応するものであった。2025年には、標準化と革新へのより広範な焦点を反映して、AI標準・革新センター(CAISI)に改名された。
この研究所は、米国商務省の非規制機関であるNISTの一部として運営されている。その主な使命は、AI安全性のための測定科学、標準、評価手法を開発することであり、バイアス、悪用、サイバーセキュリティ上の脆弱性などのリスクについてフロンティアモデルを試験することも含まれる。また、他の政府機関、学術機関、民間企業と協力して、AI安全性の研究と実践を推進している。
設立と初期の活動
米国AISIは、2023年11月1日に英国ブレッチリー・パークで開催されたAI安全サミットで発表され、米国と英国の両国が国内のAI安全研究所を設立することを約束した。米国研究所はNISTの下で発足し、初期資金と人員は既存のNISTのAIプログラムから拠出された。2024年4月には、米国と英国のAISIが少なくとも1回の共同安全試験を実施することに合意し、評価手順の調和を目指した。この連携は、多くのAI企業が最も先進的なモデルの展開前アクセスをまだ評価目的で共有していなかった中で、AI安全性の国際標準を設定するためのより広範な取り組みの一環であった。
国際ネットワークと協力
2024年5月のAIソウルサミットにおいて、国際的なリーダーたちは、米国、英国、日本、フランス、ドイツ、イタリア、シンガポール、韓国、オーストラリア、カナダ、欧州連合を含むAI安全研究所のネットワークを設立することに合意した。米国AISIはこのネットワークに参加しており、共同演習の実施やベストプラクティスの共有を行っている。2025年7月には、このネットワークはAIエージェントの評価に関する問題、特に機密情報の漏えいとサイバーセキュリティに関する問題を検討するための演習を開催した。メンバーはまた、AI安全性の評価手法について議論するため、サンディエゴで開催されたNeurIPS 2025でも会合を持った。
米国AISIはまた、二国間でも国際パートナーと関与している。例えば、英国AISIと協力して評価基準を整合させ、EU AIオフィスや他の各国研究所とフロンティアAI試験のための共通枠組みを開発するための議論に参加している。
重点分野と主要な成果物
この研究所は、大規模言語モデルやその他の生成AIシステムのための評価ベンチマークの開発、AIリスク管理のためのガイダンスの作成、MIT CSAILやスタンフォードAIラボなどの学術研究所との連携によるAI安全性研究の実施など、いくつかの重要な分野に焦点を当てている。また、AIの透明性、説明責任、堅牢性に関する標準にも取り組んでおり、多くの場合、NISTのより広範なAIイニシアチブと連携している。
主要な成果物には、AIモデル評価に関する技術報告書、安全性試験のための公開データセット、AIリスク評価のための枠組みが含まれる。また、この研究所は、国際標準化機構(ISO)が主導するものなど、国際標準の取り組みにも貢献し、AI安全性の実践が世界的に一貫していることを確保している。
産業界および学界との関係
米国AISIは、OpenAI、Anthropic、Google DeepMindなどの主要なAI企業と協力し、展開前試験のためのフロンティアモデルへのアクセスを得ている。また、バークレーAI研究やカーネギーメロン大学などの学術機関と提携し、AI安全性の研究を推進している。これらの連携は、理論的研究と実践的な安全性評価の間のギャップを埋めることを目的としている。
2024年には、研究所は一部の先進モデルへの展開前アクセスの取得に課題に直面したとPoliticoが報じている。しかし、研究所は自主的な評価プログラムの開発を継続し、企業に試験のためのモデル提出を奨励した。研究所の活動は、ホワイトハウスのAI権利章典やAI安全性に関する大統領令など、他の政府の取り組みによって補完されている。
CAISIへの進化
2025年、米国AISIはAI標準・革新センター(CAISI)に改名され、安全性と並んで革新の促進を含むより広範な任務への移行を示した。この変更は、AI評価のための標準設定と国際ネットワークへの参加における研究所の役割の拡大と一致している。この改名は、政府がAIガバナンスに取り組む方法における進行中の進化を反映しており、安全性と経済的競争力のバランスを取っている。
2025年現在、CAISIはNISTの下で運営を継続しており、AI技術が安全で、セキュアで、信頼できるものであることを確保するための標準、ツール、評価の開発に焦点を当てている。AIシステムがより高度化し、社会に統合されるにつれて、その活動は引き続き重要である。