영국 AI 안전 연구소 컨소시엄은 영국 AI 안전 연구소(AISI)의 업무를 지원하기 위해 설립된 협력 기구이다. 이 컨소시엄은 산업계, 학계, 시민 사회의 다양한 조직을 한데 모아 인공지능 시스템의 안전성을 증진하는 것을 목표로 한다. 컨소시엄은 연구를 촉진하고, 모범 사례를 공유하며, 고급 AI 기술과 관련된 위험을 완화하기 위한 평가 방법을 개발하는 것을 목표로 한다.
2024년에 결성된 이 컨소시엄에는 주요 기술 기업, 연구 기관, 그리고 AI 안전에 전념하는 기타 이해관계자들이 포함되어 있다. 그 창설은 점점 더 강력해지는 AI 시스템, 특히 대규모 언어 모델과 생성형 AI 응용 프로그램이 제기하는 과제를 해결하기 위한 조정된 노력의 필요성에 대한 인식이 높아지고 있음을 반영한다.
설립 및 회원 구성
컨소시엄은 2024년 초에 발표되었으며, 초기 회원에는 오픈AI, 앤트로픽, 구글 딥마인드와 같은 저명한 AI 개발자들이 포함되었다. 다른 창립 회원들은 아마존 웹 서비스, 애저, 구글 클라우드와 같은 클라우드 컴퓨팅 제공업체와 AMD, 인텔, ARM 홀딩스와 같은 반도체 기업을 포함한 다양한 분야에 걸쳐 있다. MIT CSAIL, 스탠퍼드 AI 연구소, 옥스퍼드 대학교와 같은 학술 기관도 합류했으며, 제록스 PARC와 노키아 벨 연구소와 같은 연구 기관도 참여했다.
컨소시엄의 회원 수는 100개 이상의 조직으로 성장하여 AI 안전에 대한 폭넓은 헌신을 반영하고 있다. 주요 회원으로는 애플, 삼성전자, TSMC, 브로드컴, 퀄컴, 오라클 클라우드가 있으며, AI21 랩스, 인플렉션 AI, 에센셜 AI와 같은 AI 전문 기업도 포함된다. 다양한 이해관계자의 참여는 AI 위험을 해결하는 다학제적 접근 방식을 보장한다.
목표 및 활동
컨소시엄의 주요 목표는 AI 시스템이 안전하게 개발되고 배포되도록 보장하는 영국 AI 안전 연구소의 임무를 지원하는 것이다. 주요 활동은 다음과 같다:
- 연구 협력: 회원들은 견고성, 해석 가능성, 정렬과 같은 AI 안전 관련 연구 프로젝트에 협력한다. 여기에는 연구 결과와 방법론을 공유하여 해당 분야를 발전시키는 것이 포함된다.
- 평가 및 테스트: 컨소시엄은 AI 모델을 위한 평가 벤치마크와 테스트 프레임워크 개발에 기여한다. 여기에는 편향, 잘못된 정보, 오용과 같은 잠재적 유해 행동에 대한 모델 스트레스 테스트가 포함된다.
- 정책 및 모범 사례: 회원들은 책임 있는 AI 개발을 위한 지침과 모범 사례를 수립하기 위해 협력한다. 또한 규제와 거버넌스를 알리기 위해 정책 입안자에게 의견을 제공한다.
- 지식 공유: 정기적인 워크숍, 세미나, 간행물을 통해 커뮤니티 전반에 걸쳐 아이디어와 교훈의 교환이 촉진된다.
주요 이니셔티브
주목할 만한 이니셔티브 중 하나는 최첨단 AI 모델을 위한 공동 평가 제품군의 개발이다. 이 제품군은 다양한 모델 간의 안전성 테스트를 표준화하여 비교를 가능하게 하고 공통 취약점을 식별하는 것을 목표로 한다. 컨소시엄은 또한 머신러닝 견고성에 초점을 맞춘 연구 프로그램을 시작했으며, 적대적 훈련 및 모델 가지치기와 같은 기법을 조사하여 회복력을 개선하고 있다.
또 다른 이니셔티브는 데이터 세트, 도구, 연구 논문을 포함한 AI 안전 자원의 공개 저장소를 만드는 것이다. 이 저장소는 소규모 조직과 연구자들의 진입 장벽을 낮추어 AI 안전 작업에 더 폭넓은 참여를 촉진하기 위한 것이다.
컨소시엄은 또한 회원들이 협력하여 AI 시스템에서 유해한 출력을 이끌어내려고 시도하는 일련의 레드팀 훈련을 조직했다. 이러한 훈련은 잠재적 위험을 발견하고 완화 전략을 알리는 데 도움이 된다.
영향 및 향후 방향
컨소시엄은 이미 주요 AI 개발자와 연구자 간의 협력을 촉진함으로써 AI 안전 관행에 영향을 미쳤다. 그 작업은 업계 전반에 걸쳐 점점 더 채택되고 있는 더 엄격한 평가 표준 개발에 기여했다. 컨소시엄의 투명성과 공동 책임에 대한 강조는 다른 조직들이 AI 개발 프로세스에서 안전을 우선시하도록 장려했다.
앞으로 컨소시엄은 딥러닝 안전, 신경망 해석 가능성, 생성형 AI의 사회적 영향과 같은 새로운 분야로 초점을 확장할 계획이다. 또한 다른 국가의 유사한 이니셔티브와 협력하여 AI 안전을 위한 글로벌 프레임워크를 구축함으로써 국제 협력을 강화하는 것을 목표로 한다.
AI 기술이 계속 진화함에 따라 연구를 조정하고 모범 사례를 촉진하는 컨소시엄의 역할은 AI의 이점을 실현하면서 잠재적 피해를 최소화하는 데 중요할 것이다. 그 협력 모델은 집단적 행동이 필요한 복잡한 기술적 과제를 해결하기 위한 템플릿 역할을 한다.