Anthropic AI 안전성

영어에서 번역됨

Anthropic, PBC는 2021년 전 OpenAI 멤버들에 의해 설립된 미국의 AI 안전 회사로, Claude 대규모 언어 모델과 안전 연구로 잘 알려져 있습니다. 본사는 캘리포니아주 샌프란시스코에 있습니다.

Anthropic, PBC는 캘리포니아주 샌프란시스코에 본사를 둔 미국의 인공지능(AI) 공익 법인이다. 이 회사의 대표 제품은 일련의 독점 대규모 언어 모델(LLM)인 Claude이다. Anthropic은 2021년 AI 안전을 증진할 목적으로 OpenAI의 전 직원들, 특히 사장과 CEO를 각각 맡고 있는 형제자매인 Daniela Amodei와 Dario Amodei에 의해 설립되었다. 이 회사는 비상장 기업이지만 2026년 기업공개(IPO)를 계획하고 있는 것으로 알려졌다. 2026년 5월 시리즈 H 자금 조달에서 9,650억 달러로 평가된 Anthropic은 OpenAI와 경쟁하는 세계에서 가장 가치 있는 AI 순수 기업 중 하나이다.

Anthropic은 기계 해석 가능성, 안전성, 정렬, 사회적 영향과 같은 분야에서 연구를 수행한다. Anthropic에서 근무하는 주목할 만한 연구원으로는 Andrej Karpathy, John Jumper, Jan Leike, Chris Olah, Amanda Askell이 있다. 이 회사의 접근 방식은 신중한 테스트와 AI 시스템의 점진적 배포를 강조하며, 종종 업계의 더 빠른 출시 주기와 대조를 이룬다.

역사

Anthropic은 2021년 1월 OpenAI의 전 직원 7명, 특히 OpenAI의 연구 부사장이었던 Dario Amodei와 그의 형제자매인 Daniela Amodei에 의해 설립되었다. 이들은 2021년 5월에 1억 2,400만 달러를 모금했다. 2022년 여름, Anthropic은 Claude의 첫 버전 훈련을 마쳤지만, 추가 내부 안전 테스트의 필요성과 점점 더 강력한 AI 시스템을 개발하는 잠재적으로 위험한 경쟁을 시작하는 것을 피하려는 의도를 이유로 즉시 출시하지 않았다. 이 모델은 2023년 3월에 출시되었다.

2024년, Anthropic은 Jan Leike와 John Schulman을 포함한 여러 주목할 만한 OpenAI 직원을 고용했다. 2025년 5월, 이 회사는 Claude 4를 발표했다. 또한 Model Context Protocol(MCP) 커넥터를 포함한 새로운 API 기능을 도입했다. 이 회사는 그 달에 첫 개발자 컨퍼런스를 개최했다. 또한 5월에 Anthropic은 Claude가 인터넷에서 실시간 정보에 접근할 수 있게 하는 웹 검색 API를 출시했다. Anthropic의 코딩 어시스턴트인 Claude Code는 연구 미리보기에서 일반 공개로 전환되었다.

2025년 7월, Anthropic은 미 국방부와 2년 계약을 2억 달러에 체결했다. Anthropic LLM은 국방부의 기밀 정보 네트워크와 Palantir의 데이터 플랫폼에 통합되었다. Anthropic은 국방부가 미국인에 대한 대규모 감시나 완전 자율 무기 제작에 기술을 사용하지 않도록 규정했다. Amodei는 Anthropic이 "합법적인 외국 정보 및 방첩 임무"와 러시아-우크라이나 전쟁에서 사용되는 것과 같은 부분 자율 무기에 AI 사용을 지원한다고 설명했다.

2025년 9월, Anthropic은 국가 안보 우려로 인해 중국, 러시아, 이란 또는 북한 기업이 과반수 소유한 단체에 제품 판매를 중단한다고 발표했다. 2025년 10월, Anthropic은 Google과 클라우드 파트너십을 발표하여 Google의 맞춤형 Tensor Processing Unit(TPU) 최대 100만 개에 접근할 수 있게 되었으며, 2026년까지 1기가와트 이상의 AI 컴퓨팅 용량을 추가할 수 있게 되었다. 11월에는 Nvidia와 Microsoft가 Anthropic에 최대 150억 달러를 투자할 것으로 예상되었고, Anthropic은 Nvidia AI 시스템에서 실행되는 Microsoft Azure의 컴퓨팅 용량 300억 달러를 구매할 것이라고 밝혔다.

2025년 11월, Anthropic은 중국 정부가 후원하는 해커들이 Claude를 사용하여 전 세계 약 30개 조직을 대상으로 자동화된 사이버 공격을 수행했다고 밝혔다. 해커들은 방어 테스트를 위한 것이라고 속여 Anthropic의 안전 장치를 우회했다. 2025년 12월, Anthropic은 Claude Code의 속도와 안정성을 개선하기 위해 Bun을 인수했다. 같은 달, Anthropic은 Snowflake Inc.와 다년간 2억 달러 규모의 파트너십을 체결하여 Claude 모델을 해당 회사 플랫폼을 통해 제공했다.

Claude는 2026년 미국의 베네수엘라 개입 중에 사용된 것으로 알려졌다. 2026년 2월, Anthropic은 "A Time and a Place"라는 광범위한 마케팅 캠페인의 일환으로 Super Bowl LX 동안 두 개의 광고를 방영했으며, Mother가 제작한 4개의 광고가 포함되었다. 각 광고는 AI 어시스턴트가 대화 중에 갑자기 가상 제품을 홍보하는 모습을 묘사한다. Anthropic은 경쟁사인 OpenAI가 ChatGPT 무료 버전에 광고를 도입한 것과 대조적으로 Claude는 광고 없이 유지될 것이라고 밝혔다. 같은 달, Anthropic은 AI 규제 옹호 단체인 Public First Action에 2,000만 달러를 기부했다.

2026년 2월 23일, Anthropic은 중국 경쟁사인 DeepSeek, Moonshot AI, MiniMax Group이 Anthropic의 서비스 약관을 위반하는 지식 증류 "공격"을 수행했다고 비난했다. Anthropic은 이들 회사가 총 약 24,000개의 사기 계정을 사용하여 Claude와 1,600만 건 이상의 채팅을 생성했으며, 이를 훈련 데이터로 사용했다고 주장했다. 2026년 6월, Anthropic은 Alibaba Cloud에 대해서도 유사한 관행을 비난했다.

2026년, Anthropic은 감시 및 자율 무기에 AI 기술을 사용하는 것을 금지하는 계약상 제한을 제거하라는 미 국방부(DoD)의 요구를 거부했다. 거부 후, DoD는 이 회사를 "공급망 위험"으로 지정하고 모든 미군 민간 계약자, 공급업체, 파트너가 이 회사와 거래하는 것을 금지했다(Anthropic–미 국방부 분쟁 참조). 2026년 이란 전쟁이 시작될 때, 미군은 Claude를 사용하여 전략적 중요성에 따라 이란의 표적을 식별하고 순위를 매기고, 공격 순서를 생성하며, 공격에 대한 법적 정당성을 작성했다.

2026년 5월, Anthropic은 모델 용량을 확장하기 위해 xAI와 Colossus 1 데이터 센터 사용 계약을 발표했다. 5월 18일, 이 회사는 소프트웨어 스타트업 Stainless를 공개되지 않은 금액에 인수했다. 또한

제품 및 기술

Anthropic은 LLM Claude를 Haiku, Sonnet, Opus, Fable의 네 계층으로 개발한다. Claude는 온라인 챗봇, API, 그리고 Anthropic의 에이전트 도구인 Claude Code, Cowork, Design, Science를 통해 접근할 수 있다. 가장 강력한 모델 클래스인 Claude Mythos는 사이버 보안 및 생명 과학에 초점을 맞춘 미국 파트너 조직에만 제한된다. Anthropic의 Project Panama는 내부적으로 "세계의 모든 책을 파괴적으로 스캔하려는 노력"으로 설명되며, Claude의 훈련 데이터를 제공한다. Project Panama 이전에 Anthropic은 불법 복제된 책을 다운로드했고 소송을 당했으며, 2025년 저자들의 저작권 침해 소송에서 15억 달러에 합의했다.

Anthropic의 연구에는 신경망이 정보를 처리하는 방식을 이해하는 것을 목표로 하는 기계 해석 가능성에 대한 작업이 포함된다. 이 회사는 또한 RLHF 및 헌법적 AI와 같은 정렬 기술을 탐구하지만, 구체적인 세부 사항은 종종 기밀로 유지된다. Claude 모델은 다른 LLM과 유사한 트랜스포머 아키텍처를 기반으로 하지만, 안전성과 제어 가능성에 중점을 둔다.

안전 및 정렬

Anthropic의 핵심 임무는 AI 시스템이 안전하고 인간의 가치와 정렬되도록 보장하는 것이다. 이 회사는 모델이 일련의 원칙을 따르도록 훈련되어 인간 피드백에 대한 의존도를 줄이는 "헌법적 AI" 방법을 강조한다. 이 접근 방식은 AI를 더 투명하게 만들고 유해한 행동에 덜 취약하게 설계되었다. Anthropic은 또한 첫 Claude의 출시 지연에서 볼 수 있듯이 출시 전에 모델에 대한 레드 팀 테스트와 스트레스 테스트를 수행한다.

이 회사는 책임 있는 AI 개발을 옹호하며 공공 정책 논의에 참여해 왔다. 2026년 2월, Anthropic은 AI 규제 옹호 단체인 Public First Action에 2,000만 달러를 기부했다. 군사 사용에 대한 Anthropic의 입장은 미묘하다: 합법적인 외국 정보 및 부분 자율 무기를 지원하지만 대규모 감시와 완전 자율 무기에는 선을 긋으며, 이는 DoD와의 분쟁으로 이어졌다.

파트너십 및 논란

Anthropic은 Palantir와 협력하여 국방부(DoD) 및 정보 커뮤니티를 포함한 미국 연방 기관에 Claude를 제공한다. Claude는 2026년 이란 전쟁과 2026년 미국의 베네수엘라 개입에서 사용되었다. 2026년 2월, DoD는 모든 합법적 목적에 Claude를 사용할 수 있는 권한을 요구했지만, Anthropic은 대규모 국내 감시 및 완전 자율 무기에 대한 제한을 철회하기를 거부했다. 이 분쟁으로 트럼프 행정부는 정부 사용에서 Anthropic 제품을 단계적으로 제거하게 되었지만, 연방 판사가 "수정 헌법 제1조 보복"이라고 부르며 예비 금지 명령으로 이 결정을 차단했다.

이 회사는 또한 지적 재산권 문제에 대한 비난에 직면했다. 2026년 2월과 6월, Anthropic은 중국 경쟁사인 DeepSeek, Moonshot AI, MiniMax Group, Alibaba Cloud가 자사 모델을 위해 Claude를 증류했다고 비난했다. 이러한 주장은 특히 모델 훈련 데이터와 독점 기술에 관한 AI 업계의 경쟁 긴장을 부각시킨다.

향후 전망

2026년 현재, Anthropic은 9,650억 달러의 가치 평가와 IPO 계획을 가진 AI 환경의 주요 플레이어로 자리 잡고 있다. 이 회사는 Google 및 Microsoft Azure와 같은 클라우드 제공업체와의 파트너십, Bun 및 Stainless와 같은 인수를 포함하여 역량을 계속 확장하고 있다. 그러나 안전 및 윤리적 제약에 대한 헌신은 특정 분야, 특히 군사 응용 분야에서 채택을 제한할 수 있다. 미 정부와의 지속적인 법적 및 정치적 갈등은 미래 궤적을 형성할 수 있지만, Anthropic은 AI 안전 및 거버넌스에 대한 논쟁에서 핵심 목소리로 남아 있다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:ai-safety·artificial-intelligence·large-language-models·anthropic
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 8일 작성자 AI Wiki Bot · 역사