UK AI Safety Institute(UK AISI)는 2023년에 설립된 정부 지원 기관으로, 고급 인공지능 시스템과 관련된 위험을 평가하고 완화하는 것을 목표로 한다. 이 기관은 영국 내에서 전용 연구 및 평가 기구로 운영되며, 최첨단 AI 모델과 그 잠재적 사회적 영향에 초점을 맞춘다. 연구소는 정책 입안자와 대중에게 AI 안전에 대한 증거 기반 지침을 제공하기 위해 노력하며, 영국을 이 분야의 선도자로 자리매김하게 한다.
과학혁신기술부(Department for Science, Innovation and Technology)의 한 부서로서, UK AISI는 주요 AI 모델에 대한 기술 연구와 안전 테스트를 수행한다. 국제 파트너 및 연구자들과 협력하여 엄격한 평가 방법을 개발하고, 위협이 현실화되기 전에 예측하고 대응하는 것을 목표로 한다. 이 기관의 설립은 영국에서 개최된 2023년 AI 안전 정상회의(AI Safety Summit) 이후 이루어졌으며, 이 회의에서 AI 위험에 대한 조율된 글로벌 행동의 중요성이 강조되었다.
설립 배경
UK AISI는 2023년 11월, 블레츨리 파크(Bletchley Park)에서 열린 AI 안전 정상회의 직후에 발표되었다. 이곳은 역사적인 암호 해독과 컴퓨팅 발전과 깊이 연관된 장소이다. 이 정상회의는 글로벌 지도자와 전문가들을 소집했고, 빠르게 발전하는 AI의 위험을 인정한 블레츨리 선언(Bletchley Declaration)으로 이어졌다. 이에 대응하여, 연구소는 리시 수낙(Rishi Sunak) 총리에 의해 영국의 AI 안전에 대한 약속을 실행에 옮기기 위해 설립되었다. 이는 2023년 4월에 유사한 목표로 시작된 초기 파운데이션 모델 태스크포스(Foundation Model Taskforce)를 흡수하고 확장한 것이다.
사명과 목표
그 사명은 세 가지 핵심 영역에 중점을 둔다: 세계적 수준의 AI 안전 연구 발전, 최첨단 모델의 심각한 위험 평가, 정부 정책에 정보 제공. 연구소는 정교한 대규모 언어 모델 및 기타 AI 시스템의 능력을 특성화하고 측정하는 데 초점을 맞추며, 사이버 공격, 생물 안전 위협, 체계적 사회적 피해와 같은 위험에 중점을 둔다. 모델 평가 및 연구 결과에 대한 접근을 제공함으로써, 개발자, 규제 기관, 대중 간의 지식 격차를 해소하고 더 안전한 AI 생태계를 조성하고자 한다.
활동 및 평가
UK AISI의 주요 활동 중 하나는 OpenAI, Anthropic, Google DeepMind를 포함한 주요 개발자들의 고급 모델에 대한 사전 출시 안전 평가를 수행하는 것이다. 이러한 평가는 자율 복제, 기만적 행동, 또는 무기 개발 촉진과 같은 위험한 능력에 대한 모델 스트레스 테스트를 포함한다. 연구소는 또한 연구 논문과 모델 안전 보고서를 발행하며, 2024년에는 첫 번째 AI 안전 평가 지침 세트를 공개했다. 학계 기관 및 미국 AI 안전 연구소(US AI Safety Institute)를 포함한 국제 파트너와 협력하여 전 세계적으로 테스트 표준을 조화시키고 있다.
영향 및 국제적 역할
설립 이후, UK AISI는 규제에 대한 목소리가 높아지는 가운데 글로벌 AI 정책 논의에 영향을 미쳐왔다. 2024년에는 두 번째 AI 안전 정상회의를 주최하여 AI 보안과 AI의 사회적 기회 및 위험을 포함하도록 그 역할을 확장했다. 이 기관의 작업은 AI 법안에 대한 영국 정부 논의에 정보를 제공했지만, 자체적으로 규제 권한을 보유하지는 않는다. 대신 기술 자문 역할을 하며, AI 사무소(Office for AI) 및 경쟁시장청(Competition and Markets Authority)과 같은 기관에 통찰력을 제공한다. 그 평가는 때때로 개발자들이 안전 기능을 개선하도록 유도했지만, 이러한 개입의 정확한 결과가 항상 공개되지는 않는다.
연구소의 리더십에는 2024년에 임명된 CEO와 학계 및 산업계 출신의 기술 연구자 팀이 포함된다. 예산은 꾸준히 증가했으며, 자금은 평가 역량 확장과 최고 인재 영입에 사용되었다. 2025년 현재, 100명 이상의 직원을 고용하고 있으며 대규모 모델 테스트를 위한 별도의 컴퓨팅 시설을 구축했다.
과제 및 향후 방향
야망에도 불구하고, UK AISI는 평가 방법을 능가할 수 있는 빠른 AI 개발 속도와 같은 상당한 과제에 직면해 있다. 투명성과 프라이버시 및 상업적 민감성 사이의 균형은 여전히 긴장 요소이며, 서로 다른 규제 체계와의 국제적 조정도 마찬가지이다. 앞으로 연구소는 더 역동적인 평가를 개발하고 오디오 및 비디오를 위한 생성형 AI와 같은 새로운 영역으로 초점을 확장하는 것을 목표로 한다. 영국이 AI 혁신의 글로벌 허브가 되기 위한 지속적인 강조 속에서, 그 작업은 최첨단 기술 관리에 대한 국내 및 국제적 접근 방식을 모두 형성할 가능성이 높다.
전반적으로, UK AI 안전 연구소는 AI 발전에서 안전을 핵심 고려 사항으로 포함시키기 위한 중요한 정부 차원의 노력을 대표한다. 연구, 파트너십, 정책 지원을 통해 더 안전하고 책임 있는 AI 환경에 기여하지만, 그 장기적 효과는 지속적인 헌신과 적응력에 달려 있을 것이다.
출처
- AI 안전 연구소 출범에 관한 Gov.uk 발표 (2023)
- 연구소의 공식 간행물 및 연례 보고서 (2023–2025)
- BBC, 파이낸셜 타임즈, 네이처의 AI 안전 개발에 대한 언론 보도.