Anthropic은 2021년 전 OpenAI 연구원들이 설립한 미국의 인공지능 기업이다. 이 회사는 안전하고 해석 가능한 인공지능 시스템 개발에 중점을 두며, 특히 AI의 행동을 인간의 의도에 맞추는 정렬에 주력한다. 주요 제품은 대규모 언어 모델 계열인 Claude로, 대화형 어시스턴트, 코딩 지원, 기업 데이터 분석 등 다양한 애플리케이션에 사용된다. Anthropic은 캘리포니아주 샌프란시스코에 본사를 두고 있으며, OpenAI 및 Google DeepMind와 같은 기업과 경쟁하는 선도적인 독립 AI 연구 기관 중 하나가 되었다.
이 회사는 고급 AI의 안전성과 윤리적 영향에 대한 우려에 대응하여 설립되었다. Dario Amodei와 Daniela Amodei를 포함한 창립자들은 이전에 OpenAI에서 GPT-2 및 GPT-3와 같은 모델 작업에 참여하며 고위 직책을 역임했다. Anthropic의 AI 안전 접근 방식은 "헌법적 AI(Constitutional AI)"라고 부르는 연구 프로그램에 기반을 두며, 이는 광범위한 인간 피드백의 필요성을 줄이면서 모델이 일련의 원칙 또는 "헌법"을 따르도록 훈련하는 것을 목표로 한다.
설립 및 초기 역사
Anthropic은 2021년 대부분 전 OpenAI 직원이었던 일곱 명의 개인에 의해 설립되었다. 창립 팀에는 Dario Amodei(전 OpenAI 연구 부사장), Daniela Amodei(전 안전 및 정책 부사장), GPT-3의 핵심 기여자였던 Tom Brown, 전 해석 가능성 책임자였던 Chris Olah, Jared Kaplan, Jack Clark, Sam McCandlish가 포함되었다. 이 회사는 처음에 비공개 모드로 운영되며 알리바바 클라우드의 모회사를 포함한 투자자들로부터 상당한 자금을 조달했지만, 당시 정확한 자금 조달 세부 사항은 공개되지 않았다.
2023년 초, Anthropic은 Google Cloud와의 중요한 파트너십을 발표했으며, 여기에는 대규모 투자와 모델 훈련 및 배포에 Google의 클라우드 인프라를 사용하기로 한 약속이 포함되었다. 같은 해 말, 이 회사는 Amazon Web Services(AWS)로부터 주요 투자를 받았으며, AWS는 훈련 및 추론을 위한 주요 클라우드 제공업체가 되었다. 이러한 파트너십은 Anthropic에 대규모 모델을 훈련하는 데 필요한 컴퓨팅 리소스를 제공했다.
헌법적 AI 및 안전 연구
Anthropic 연구의 정의적 특징은 헌법적 AI(CAI)에 대한 초점이다. 이 접근 방식은 인간 피드백에만 의존하지 않고 명시적인 규칙 또는 원칙 세트를 사용하여 모델을 훈련하는 것을 포함한다. 모델은 먼저 RLHF(인간 피드백으로부터의 강화 학습)를 통해 훈련되지만, 그 후 모델이 원칙 목록에 따라 자체 출력을 비판하고 수정하는 "헌법적" 프로세스를 사용하여 정제된다. 이 방법은 모델을 더 유용하고, 무해하며, 정직하게 만드는 동시에 훈련 프로세스를 더 확장 가능하고 투명하게 만드는 것을 목표로 한다.
이 회사의 안전 연구에는 신경망이 내부적으로 개념을 어떻게 표현하는지 이해하는 것과 같은 해석 가능성 작업도 포함된다. Anthropic은 트랜스포머의 "회로"와 같은 주제에 대한 논문을 발표했으며, 이는 이러한 모델이 수행하는 계산을 역설계하려는 시도이다. 이 연구는 AI 시스템이 더 강력해짐에 따라 감사되고 신뢰될 수 있도록 보장하려는 더 광범위한 노력의 일부이다.
Claude 모델 시리즈
Anthropic의 주요 제품 라인은 대규모 언어 모델 시리즈인 Claude이다. 첫 번째 버전인 Claude는 2023년 3월에 출시되었으며, 2023년 7월에는 향상된 성능과 더 긴 컨텍스트 창을 제공하는 Claude 2가 출시되었다. 2024년 3월, Anthropic은 각각 다른 속도와 성능 균형에 최적화된 Haiku, Sonnet, Opus를 포함한 모델 계열인 Claude 3를 출시했다. Claude 3 Opus는 MMLU 테스트와 같은 벤치마크에서 강력한 성능을 보여주며 종종 다른 주요 연구소의 모델과 견주거나 능가하는 것으로 주목받았다.
2024년 6월, Anthropic은 추론 및 코딩 능력을 더욱 향상시킨 Claude 3.5 Sonnet을 도입했다. 이 모델들은 API, claude.ai의 소비자 챗봇, 기업용 제품을 통해 제공된다. Claude 모델은 코딩, 긴 컨텍스트 이해, 안전 지침 준수에서 강력한 성능으로 알려져 있다. 이들은 금융, 의료, 법률 서비스 등 다양한 분야의 기업에서 문서 분석, 코드 생성, 고객 지원과 같은 작업에 사용된다.
비즈니스 모델 및 파트너십
Anthropic은 모델에 대한 API 액세스 및 구독 서비스를 통해 수익을 창출하는 상업적 비즈니스 모델을 운영한다. 이 회사는 챗봇에 대한 무료 티어와 개인 및 기업을 위한 유료 플랜을 제공한다. 클라우드 제공업체와의 핵심 파트너십은 운영에 중요하다. 2023년 9월에 발표된 AWS 파트너십에는 40억 달러 투자가 포함되었으며, AWS는 주요 훈련 및 배포 파트너가 되었다. 이 거래로 Claude 모델은 AWS의 관리형 AI 서비스인 Amazon Bedrock에서도 사용할 수 있게 되었다. 마찬가지로 2023년 2월에 발표된 Google Cloud 파트너십에는 3억 달러 투자가 포함되었으며, Google Cloud는 인프라를 제공하고 나중에 계약을 확대했다.
이러한 파트너십을 통해 Anthropic은 운영을 빠르게 확장할 수 있었지만, 자금과 컴퓨팅 모두를 주요 기술 기업에 의존하고 있어 회사의 독립성에 대한 의문도 제기된다. 2024년 기준으로 Anthropic은 총 70억 달러 이상을 조달했으며, Amazon 투자 이후 평가 가치는 약 180억 달러로 보고되었다.
거버넌스 및 AI 안전 옹호
Anthropic은 일부 경쟁사보다 모델 배포에 더 신중한 접근 방식을 취하며 AI 안전 옹호의 선두주자로 자리매김했다. 이 회사는 미국 의회 증언 및 업계 이니셔티브 참여를 포함한 정책 논의에 관여해 왔다. 2023년, Anthropic은 OpenAI, Google, Microsoft도 포함하는 그룹인 Frontier Model Forum을 공동 설립하여 프론티어 AI 모델의 안전하고 책임 있는 개발을 촉진하는 것을 목표로 했다.
이 회사는 또한 존재론적 위험을 포함한 고급 AI의 잠재적 위험에 대해 목소리를 높이며 규제와 투명성을 옹호해 왔다. "책임 있는 확장 정책(Responsible Scaling Policy)"은 점점 더 강력해지는 모델과 관련된 위험을 평가하고 완화하기 위한 프레임워크를 설명하며, 특정 "AI 안전 수준(ASL)" 임계값을 설정한다. 이 정책은 모델이 더 강력해짐에 따라 적절한 안전장치가 마련되도록 보장하기 위해 설계되었다.
연구 기여 및 오픈 소스
Anthropic은 모델을 오픈 소스로 공개하지는 않았지만, 출판물과 도구를 통해 더 넓은 AI 연구 커뮤니티에 기여해 왔다. 이 회사는 어텐션 메커니즘, 모델 가지치기, 해석 가능성과 같은 주제에 대한 연구를 발표했다. 또한 "도움이 되고, 정직하며, 무해한(Helpful, Honest, Harmless, HHH)" 데이터셋과 같은 데이터셋과 평가 벤치마크를 공개하여 이러한 차원에서 모델을 훈련하고 평가하는 데 사용했다.
Anthropic의 해석 가능성 연구는 특히 영향력이 있었다. 2022년, 이 회사는 신경망이 차원보다 더 많은 특징을 어떻게 표현하는지 탐구한 "중첩의 장난감 모델(Toy Models of Superposition)"에 관한 논문을 발표했다. 2023년에는 "Claude 3 Sonnet에서 해석 가능한 특징 추출"에 관한 논문을 발표하여 기만과 아첨과 같은 개념과 관련된 내부 특징을 식별하고 조작하는 기술을 시연했다. 이러한 노력은 AI 시스템을 더 이해 가능하고 제어 가능하게 만들기 위한 장기적 목표의 일부이다.
경쟁 구도 및 향후 전망
Anthropic은 OpenAI, Google DeepMind, Meta AI를 포함한 주요 경쟁사들이 있는 매우 경쟁적인 환경에서 운영된다. 이 회사는 안전에 대한 강조와 헌법적 AI 접근 방식을 통해 차별화한다. 그러나 경쟁사의 빠른 출시 주기에 맞추고 대규모 모델 훈련의 높은 비용을 관리하는 데 어려움을 겪고 있다. 2024년 기준으로 Anthropic은 Claude 모바일 앱 출시와 협업 작업을 위한 "프로젝트" 및 "아티팩트"와 같은 기업 중심 기능을 포함하여 제품 제공을 계속 확장하고 있다.
Anthropic의 향후 방향은 모델의 지속적인 확장, 기업 워크플로우와의 더 깊은 통합, 해석 가능성의 추가 발전을 포함할 가능성이 높다. 안전에 대한 회사의 약속은 더 넓은 업계에 영향을 미칠 수 있는 새로운 거버넌스 프레임워크로 이어질 수도 있다. AI 기술이 진화함에 따라, 안전 중심 혁신가로서의 Anthropic의 역할은 연구자, 정책 입안자, 업계 관찰자 모두가 면밀히 주시할 것이다.
같이 보기
참고 문헌
이 문서는 2024년 기준 공개적으로 이용 가능한 정보를 기반으로 한다. 가장 최신 세부 사항은 Anthropic의 공식 커뮤니케이션 및 평판이 좋은 기술 뉴스 출처를 참조하라.