米国AI安全研究所(US AISI)は、2023年11月に米国商務省の機関である国立標準技術研究所(NIST)の下に設立された政府支援組織である。その主な使命は、高度な人工知能(AI)モデル、特にフロンティアAIモデルとして知られるものの安全性を評価し、確保することである。この研究所は、英国で開催されたAI安全サミット中に設立され、英国と米国の両方がそれぞれのAI安全機関の創設を発表した。これは、急速に進歩するAI技術、特に大規模言語モデルやその他の生成AIシステムに関連する潜在的なリスクに対処するための世界的な取り組みにおける重要な一歩となった。
US AISIの設立は、研究者や業界リーダーによる公の宣言によって強調された、AIがもたらす潜在的な実存的リスクに対する2023年の認識の高まりを反映したものであった。この研究所はNIST内で運営され、同機関の測定基準と技術評価における専門知識を活用している。その活動は、テスト方法論の開発、安全性評価の実施、およびAI監視のための一貫した枠組みを構築するための国内外の他の機関との連携に焦点を当てている。US AISIは、2023年と2024年の外交努力から生まれたAI安全研究所のより広範な国際ネットワークの一部である。
設立と初期の任務
US AISIは、2023年11月1日に英国のブレッチリー・パークで開催されたAI安全サミット中に正式に設立された。当時の首相リシ・スナクが主催したこのサミットには、政府、AI企業、学術機関の代表者が集まり、フロンティアAIの安全な開発について議論した。米国政府はNISTを通じて、AI安全性に関する研究と評価を実施するための専用研究所を設立することを約束した。この研究所の初期の焦点は、AIモデルの標準化されたテスト手順の開発であり、機械学習、深層学習、ニューラルネットワークなどの分野での能力評価を含んでいた。
初期の数ヶ月間、US AISIは米国の広範なAI政策の状況における自らの役割を定義するために取り組んだ。それはホワイトハウス科学技術政策局を含む他の連邦機関と調整し、その活動を国家の優先事項と一致させた。また、研究所はOpenAI、Anthropic、Google DeepMindなどの主要なAI開発者との関わりを開始し、展開前の安全性テストのために彼らの最も先進的なモデルへのアクセスを得た。この協力的なアプローチは、AI企業が安全性評価に関して「自分の宿題を採点する」ことを確実に信頼できないという懸念に対処することを目的としていた。
英国AI安全研究所との連携
US AISIの初期の活動の重要な側面は、2023年11月のサミット中に同時に設立された英国AI安全研究所(UK AISI)とのパートナーシップであった。両研究所は、共通の評価規則と手順を開発するために協力することに合意し、断片的な国家努力よりも統一されたアプローチの方が効果的であることを認識した。2024年4月、米国と英国は、共有AIモデルに対して少なくとも1回の共同安全テストを実施するための協定を正式に締結した。この協力は、AIガバナンスにおける国際協力のモデルと見なされた。
このパートナーシップには、研究成果と方法論の共有も含まれていた。US AISIとUK AISIは、モデルの堅牢性、人間の価値観との整合性、AIシステムが機密情報を漏洩したりサイバー攻撃に悪用されたりする可能性などの問題を共同で調査した。彼らの活動は国際標準の開発に情報を提供し、UK AISIは2024年5月に主要なAI企業に近づくためにサンフランシスコに事務所を開設すると発表した。これは、NIST内に位置するUS AISIの立地を補完する動きであった。
国際ネットワークの形成
2024年5月のAIソウルサミットで、国際リーダーたちは、米国と英国の間の二国間協力に基づいて、AI安全研究所のネットワークを形成することに合意した。このネットワークは当初、英国、米国、日本、フランス、ドイツ、イタリア、シンガポール、韓国、オーストラリア、カナダ、および欧州連合の研究所で構成されていた。US AISIはこのネットワークで中心的な役割を果たし、共同研究プロジェクトと評価演習の調整を支援した。2025年7月、ネットワークはAIエージェントの評価に関する問題、特に機密情報の漏洩とサイバーセキュリティリスクに関して調査するための演習を実施した。ネットワークメンバーはまた、サンディエゴで開催されたNeurIPS 2025で新たな課題について議論するために会合した。
国際ネットワークへのUS AISIの参加は、AI安全性のための世界的な規範を確立するためのより広範な努力の一部であった。研究所は、トランスフォーマーアーキテクチャ、マルチヘッドアテンション、およびAIシステムの他の技術的側面などのトピックに関する議論に貢献し、安全性評価が分野の急速な進歩に追いつくことを確実にした。ネットワークはまた、イノベーションと予防措置のバランスを取る方法を含むガバナンスの問題にも取り組んだ。
進化と改名
2025年、US AISIは重要な組織変更を受けた。それはAI標準・イノベーションセンター(CAISI)に改名され、AI安全性における標準の開発とイノベーションの促進に焦点を移すことを反映した。この改名はより広範な傾向の一部であり、英国のAI安全研究所も同年にAIセキュリティ研究所に改名された。この変更は、純粋に安全性に焦点を当てた評価から、責任あるAI開発と展開を促進することを含むより包括的なアプローチへの移行を示した。
CAISIへの移行は研究所の核心的な使命を変えなかったが、その範囲を拡大した。それはフロンティアAIモデルの安全性評価を継続したが、ベストプラクティスと自主的な標準を開発するために業界とより緊密に協力し始めた。この進化は、AI分野の成熟度の高まりと、AIシステムが医療、輸送、金融などのさまざまなセクターに統合されるにつれて継続的な監視の必要性への対応と見なされた。
技術的な焦点分野
US AISIの技術的な活動は、AI研究と開発のいくつかの分野に及んでいる。それは、モデルの潜在的なバイアス、敵対的入力に対する堅牢性、および意図された行動との整合性を評価する。また、研究所はAIシステムの解釈可能性を調査し、ニューラルネットワークがどのように決定を下すかを理解しようとしている。これには、レイヤー正規化、バッチ正規化、ドロップアウトなどの技術を研究して、モデルの信頼性を向上させることが含まれる。
もう一つの焦点は、自律的な意思決定が可能なシステムであるAIエージェントの安全性である。US AISIは、AIエージェントが機密情報を漏洩したり、有害な行動を実行するように操作されたりする可能性のあるシナリオを調査してきた。また、微妙なバイアスやエラーを導入する可能性のあるAI生成フィードバックに依存するRLAIFやその他のトレーニング方法の影響も検討している。研究所の研究は、政府と業界の両方で使用される評価ベンチマークとテストプロトコルの開発に貢献している。
影響と今後の方向性
US AISIの設立は、AI政策の状況に大きな影響を与えてきた。それは、企業による自主規制の取り組みを補完する、AI技術の独立した監視のための政府のメカニズムを提供してきた。研究所の活動は、米国および国際的に立法および規制の提案に情報を提供してきた。2025年現在、研究所は進化を続けており、研究能力を拡大し、国際的な協力を深める計画がある。
今後、US AISI(現在はCAISI)は、より高性能なモデルや新しいアプリケーションの出現を含むAI開発の急速なペースに関連する課題に直面している。また、安全性とイノベーションの間の適切なバランスや、競合する優先事項間でのリソースの配分に関する問題を乗り越える必要がある。研究所の成功は、AIシステムの独立した評価者としての信頼性を維持しながら、変化する技術的および政治的な状況に適応する能力に依存するだろう。