Claude 2는 미국 기업 Anthropic이 개발한 대규모 언어 모델로, 2023년 7월에 원래 Claude 챗봇의 후속작으로 출시되었다. 이는 OpenAI의 ChatGPT 성공 이후 이어진 광범위한 대규모 언어 모델 물결의 일부였으며, 안전성과 헌법적 AI에 초점을 맞춘 경쟁자로서 Anthropic을 자리매김하게 했다. Claude 2는 웹 인터페이스와 API를 통해 접근할 수 있었으며, 개발자들이 다양한 애플리케이션에 통합할 수 있게 했다. 이번 출시는 코딩, 수학, 추론 능력의 개선과 더불어 더 긴 컨텍스트 창을 통해 더 큰 문서를 처리할 수 있게 된 점을 강조했다.
Claude 2는 대부분의 현대 생성형 AI 시스템의 기반이 되는 딥러닝 프레임워크인 트랜스포머 아키텍처를 기반으로 구축되었다. Anthropic은 헌법적 AI라는 기법을 사용하여 모델을 훈련시켰는데, 이는 일련의 원칙을 사용하여 모델의 행동을 윤리적 및 법적 준수로 이끄는 방식이다. 이 접근 방식은 광범위한 인간 피드백 없이 유해한 출력을 줄이는 것을 목표로 하여 Claude 2를 경쟁사와 차별화했다. 모델은 두 가지 버전으로 제공되었다: Claude 2.0과 이후의 Claude 2.1 업데이트로, 후자는 정확성 개선과 환각률 감소를 도입했다.
출시 및 이용 가능성
Claude 2는 2023년 7월 11일에 발표되었으며, 미국과 영국에서 대중에게 공개되었다. 승인된 파트너로 제한되었던 이전 Claude 1과 달리, Claude 2는 Anthropic 웹사이트의 채팅 인터페이스를 통해 일반 사용자에게 개방되었다. API 접근도 확장되었으며, 가격은 입력 1,000토큰당 $0.008, 출력 1,000토큰당 $0.024로 책정되어 OpenAI의 GPT-4와 같은 다른 모델과 경쟁력이 있었다. 이 출시는 Notion과 Quora와 같은 기업들이 요약 및 질문 응답 작업에 Claude 1을 사용했던 베타 테스트 기간 이후에 이루어졌다.
기술적 능력
Claude 2는 100,000토큰의 컨텍스트 창을 갖추어 약 75,000단어의 문서를 한 번에 처리할 수 있었다. 이는 원래 Claude의 9,000토큰 제한에서 크게 증가한 것으로, 긴 보고서 요약이나 전체 책 분석과 같은 작업을 가능하게 했다. 모델은 코딩 벤치마크에서 개선된 성능을 보였으며, HumanEval 코딩 테스트에서 56.0%였던 Claude 1.3의 점수에서 71.2%를 기록했다. 수학에서는 GSM8K 초등학교 수학 데이터셋에서 이전 버전의 85.2%에 비해 88.0%를 달성했다. 이러한 향상은 훈련 데이터 큐레이션과 미세 조정 방법의 발전에 기인한 것으로 여겨졌다.
안전성 및 정렬
Anthropic은 안전성을 Claude 2의 핵심 기능으로 강조했다. 모델은 유해한 요청을 거부하고 유용하고 정직한 응답을 제공하도록 훈련되었다. 내부 평가에서 Claude 2는 적대적 프롬프트 데이터셋을 기반으로 Claude 1.3보다 무해한 응답을 생성할 가능성이 2.3배 더 높은 것으로 나타났다. 회사는 또한 외부 전문가가 안전 조치를 우회하려고 시도하는 "레드팀" 테스트 프로세스를 도입했다. 이러한 노력에도 불구하고, 연구자들은 Claude 2가 특정 시나리오에서 여전히 조작될 수 있다고 지적하며 AI 안전성의 지속적인 과제를 강조했다. 행동을 안내하는 원칙 목록을 사용하는 헌법적 접근 방식은 다른 연구소에서 사용하는 RLHF(인간 피드백 기반 강화 학습)에 대한 새로운 대안으로 여겨졌다.
반응 및 영향
Claude 2는 작성 품질과 추론 능력에 대해 긍정적인 평가를 받았으며, 일부 사용자는 요약 및 창의적 작성과 같은 작업에서 OpenAI의 GPT-4와 비교하여 호의적으로 평가했다. 그러나 안전 제약으로 인해 무해한 질문에 답변을 거부하는 경우가 많아 지나치게 신중하다는 비판도 받았다. 이 출시는 대규모 언어 모델의 경쟁 구도에 기여했으며, 같은 기간에 Google DeepMind와 OpenAI도 업데이트를 출시했다. Claude 2의 출시는 Anthropic이 추가 자금과 파트너십을 확보하는 데 도움이 되었으며, 2023년 9월 Amazon으로부터 40억 달러 투자를 받는 결과로 이어졌고, 이는 Claude를 Amazon의 AWS 플랫폼에 통합하는 것도 포함했다. 모델의 성공은 2024년 Claude 3의 Haiku, Sonnet, Opus 계층 도입을 포함한 후속 버전의 길을 열었다.
유산
Claude 2는 Anthropic 기술의 성숙을 나타내며, 연구 프로토타입에서 상업적으로 실행 가능한 제품으로 전환되었다. 안전성과 긴 컨텍스트 처리에 대한 초점은 이후 모델에 영향을 미쳤으며, 그 API는 OpenAI에 대한 대안을 찾는 개발자에게 표준이 되었다. 이 출시는 또한 편향과 오용에 관한 생성형 AI의 윤리적 함의에 대한 논의를 촉발했다. 2025년 현재 Claude 2는 최신 버전으로 대체되었지만, 인공지능 시스템의 진화에서 주목할 만한 이정표로 남아 있다.