앨런 인공지능 연구소(Allen Institute for Artificial Intelligence)는 일반적으로 AI2로 알려져 있으며, 워싱턴주 시애틀에 본부를 둔 비영리 인공지능 연구 기관이다. 2014년 마이크로소프트 공동 창업자 폴 앨런이 설립했으며, 그는 이전에 앨런 뇌과학 연구소를 지원한 바 있고, 유사한 자선적 야망을 AI 연구에 적용하고자 했다. 오렌 에치오니(Oren Etzioni)는 설립부터 2022년까지 연구소의 초대 최고경영자를 역임했다.
역사
AI2는 처음부터 실리콘밸리에 등장한 상업적 AI 연구소에 맞서는 연구 우선의 균형추로 자리매김했다. 초기 프로젝트로는 과학 문헌에 머신러닝과 자연어 처리를 적용하는 무료 학술 검색 엔진인 시맨틱 스콜라(Semantic Scholar)와 PyTorch 기반의 오픈소스 NLP 연구 라이브러리인 AllenNLP가 있었다. 연구소는 또한 컴퓨터 비전 그룹인 PRIOR를 육성했고, 내부 연구 그룹에서 성장한 스핀아웃 기업들을 지원했다. 2018년 폴 앨런의 사망은 연구소의 종말을 의미하지 않았으며, 그의 유산 기금과 알리 파르하디(Ali Farhadi)를 포함한 후임 지도부 아래 계속 운영되었다.
OLMo와 공개 연구
AI2가 더 넓은 대규모 언어 모델 환경에 기여한 가장 두드러진 성과는 2024년부터 출시된 OLMo(Open Language Model)이다. OpenAI, Anthropic, Google DeepMind와 같은 연구소의 대부분의 최첨단 모델과 달리, OLMo는 최종 가중치뿐만 아니라 전체 훈련 데이터(Dolma 코퍼스), 훈련 및 평가 코드, 중간 체크포인트와 함께 공개되었다. 이는 연구자들이 완성된 산출물만이 아니라 전체 훈련 과정을 연구할 수 있는 몇 안 되는 진정한 오픈 가중치 모델 중 하나로 만들었으며, AI2는 이것이 재현 가능한 과학과 신흥 능력 및 훈련 데이터 효과 연구에 중요하다고 주장했다. 이후 OLMo 릴리스는 완전 공개 철학을 유지하면서 벤치마크 성능을 개선했고, AI2는 데이터 큐레이션, 파인튜닝, 지시 튜닝에 관한 동반 연구를 발표했다.
평가와 영향
AI2의 완전 공개 접근 방식은 AI 거버넌스와 상업 연구소가 사용하는 훈련 데이터의 투명성에 대한 논쟁에서 연구자와 정책 입안자들이 참조점으로 인용해 왔으며, 그중 여러 연구소는 공개되지 않은 훈련 코퍼스와 관련된 저작권 소송에 직면해 있다. OLMo 모델은 일반적으로 많은 벤치마크에서 최고의 독점 모델이나 Llama, Qwen과 같은 최고 수준의 오픈 가중치 모델보다 뒤처지기 때문에, AI2의 기여는 최첨단 능력에 대한 경쟁적 주장보다는 더 넓은 연구 커뮤니티를 위한 인프라 및 투명성 프로젝트로 자주 평가된다. 연구소는 영리 AI 연구소와 함께 비영리로 계속 운영되며, 하위 연구자와 소규모 기업이 라이선스 제한 없이 구축할 수 있는 오픈 도구, 데이터 세트, 모델을 지원하고 있다.