Anthropic은 2025년 5월 Claude 시리즈의 4세대 모델로 대규모 언어 모델인 Claude 4를 출시했다. 이 모델은 빠르고 직관적인 응답과 신중하고 단계적인 추론을 결합한 하이브리드 추론 아키텍처를 도입하여 수학, 코딩, 장문 문서 분석과 같은 복잡한 작업을 처리할 수 있게 했다. Claude 4는 1백만 토큰 컨텍스트 창을 갖추어 단일 처리로 전체 책이나 방대한 코드베이스를 처리할 수 있다. 이번 출시는 2025년 2월부터 미리보기로 제공되던 에이전트형 명령줄 도구인 Claude Code의 일반 공개도 함께 이루어졌다.
Claude 4는 현대 AI 시스템의 지배적인 신경망 설계인 트랜스포머 아키텍처를 기반으로 구축되었다. 이 모델은 윤리적 및 법적 준수를 개선하기 위해 Anthropic이 개발한 헌법 기반 접근 방식으로 훈련되었으며, AI 피드백 기반 강화 학습 및 커리큘럼 학습과 같은 기법을 사용하여 동작을 개선한다. 이 모델은 Claude 3에서 확립된 명명 규칙에 따라 Haiku, Sonnet, Opus 등 여러 크기로 제공되며, Opus가 가장 뛰어나고 Haiku가 가장 덜 뛰어나다.
하이브리드 추론 아키텍처
Claude 4의 하이브리드 추론 설계는 작업에 따라 빠르고 직관적인 응답과 확장된 단계별 추론 사이를 전환할 수 있게 한다. 이 접근 방식은 OpenAI 및 Google DeepMind의 다른 최첨단 모델에서 볼 수 있는 추론 기능과 유사하지만, Anthropic은 Claude 4가 쿼리의 복잡성에 따라 컴퓨팅을 동적으로 할당할 수 있다고 강조한다. 간단한 질문에는 모델이 빠르게 응답하고, 복잡한 문제에는 더 긴 사고 체인을 통해 고급 수학 및 다단계 코딩과 같은 작업의 정확도를 향상시킨다.
이 모델은 또한 멀티 헤드 어텐션 및 위치 인코딩의 개선 사항을 통합하여 긴 시퀀스에서 일관성을 유지하는 데 도움을 준다. 1백만 토큰 컨텍스트 창은 이전 버전에서 크게 업그레이드된 것으로, 사용자가 전체 코드 저장소, 긴 법률 문서 또는 여러 장으로 구성된 책을 입력할 수 있게 한다. 이 기능은 특히 소프트웨어 개발에서 유용하며, Claude가 단일 세션에서 대규모 코드베이스를 분석하고 수정할 수 있다.
Claude Code 및 에이전트형 도구
Claude 4와 함께 일반 공개 제품으로 출시된 Claude Code는 개발자가 자연어를 사용하여 코딩 작업을 위임할 수 있는 터미널 기반 에이전트형 도구이다. 이 도구는 파일을 읽고 쓰고, 명령을 실행하고, 단일 대화 내에서 다단계 작업을 연결할 수 있다. Anthropic은 2025년 7월까지 기업 채택에 힘입어 Claude Code 수익이 5.5배 증가했다고 보고했다. 이 도구는 Microsoft 및 Google을 포함한 주요 기업에서 사용되었으며, OpenAI 직원들도 2025년 8월까지 사용했지만, Anthropic이 서비스 약관 위반을 이유로 OpenAI의 API 액세스를 취소하면서 중단되었다.
2025년 10월, Anthropic은 Claude Code의 웹 버전과 샌드박싱 기능을 출시했다. 이 도구는 2025-2026년 겨울 휴가 기간 동안 많은 비프로그래머가 "바이브 코딩" - 사용자가 원하는 결과를 평이한 언어로 설명하고 AI가 코드를 생성하게 하는 방식 - 에 사용하면서 널리 주목을 받았다. 2025년 8월까지 Anthropic은 사이버 범죄자들이 데이터 갈취 캠페인에 Claude Code를 사용했다고 보고했으며, 2025년 11월에는 중국 기반 그룹이 30개 조직을 대상으로 한 간첩 공격의 80-90%를 자동화하는 데 이 도구를 사용했다.
API 및 컴퓨터 사용
Claude 4는 API를 통해서도 액세스할 수 있어 개발자가 자체 애플리케이션에 모델을 통합할 수 있다. 2024년 10월, Anthropic은 "컴퓨터 사용" 기능을 도입하여 애플리케이션이 화면 콘텐츠를 해석하고 키보드 및 마우스 입력을 시뮬레이션하여 컴퓨터를 제어하기 위해 Claude API를 호출할 수 있게 했다. 이 기능은 소프트웨어 인터페이스를 탐색할 수 있는 자율 에이전트를 구축하는 데 기초가 된다.
API는 온도 스케일링, top-p 샘플링, top-k 샘플링을 포함한 다양한 생성 제어 매개변수를 지원하여 개발자에게 출력 무작위성과 다양성에 대한 세밀한 제어를 제공한다. 이러한 기능은 현대 생성형 AI 플랫폼에서 표준이지만, Anthropic은 하이브리드 추론 모델에 맞게 최적화했다.
Claude for Chrome 및 Cowork
2025년 8월, Anthropic은 사용자를 대신하여 웹사이트를 탐색하고, 클릭하고, 양식을 작성할 수 있는 브라우저 확장 프로그램인 Claude for Chrome을 출시했다. 이는 1,000명의 Max 구독자를 대상으로 한 파일럿으로 시작되어 2026년 8월에 일반 공개되었다. Anthropic은 완화 조치 후 프롬프트 주입 공격이 11.2%의 확률로 성공했다고 보고했다.
2026년 1월 연구 미리보기로 출시된 Claude Cowork는 비기술 사용자를 대상으로 한 그래픽 사용자 인터페이스 도구이다. 이 도구는 Claude에게 샌드박스 셸과 사용자가 선택한 폴더에 대한 액세스를 제공하여 모델이 파일을 읽고, 쓰고, 편집하고, 코드를 실행하고, 다단계 작업을 연결할 수 있게 한다. 월스트리트저널 기자는 AI 에이전트에게 개인용 컴퓨터에 대한 광범위한 액세스를 부여하는 것에 대한 사용자 우려를 언급했으며, 초기 사용자는 Cowork가 아내의 데스크톱에서 모든 가족 사진을 삭제하여 iCloud 백업에서 복원해야 했다고 보고했다. 2026년 2월, Anthropic은 Google Drive, Gmail, Docusign 및 FactSet용 커넥터를 포함한 더 넓은 기업 공개를 발표했고, 2026년 3월에는 사용자가 휴대폰에서 컴퓨터로 작업을 보낼 수 있는 Dispatch를 추가했다.
보안 및 안전
Claude 4는 유해한 출력을 줄이는 것을 목표로 하는 헌법 기반 훈련 접근 방식을 포함한 여러 안전 기능을 통합한다. Anthropic은 또한 모델 가지치기 및 기타 효율성 기법을 구현하여 성능을 유지하면서 계산 비용을 줄였다. 회사는 2025년 8월과 11월에 보고된 사이버 공격에서 Claude의 사용에 대한 조사를 받았으며, 서비스 약관을 위반하는 엔티티에 대한 API 액세스 취소와 같은 오용을 완화하기 위한 조치를 취했다.
2026년 2월, 미국 국방부는 Anthropic을 "공급망 위험"으로 지정했으며, 연방 기관은 회사가 대규모 국내 감시 및 완전 자율 무기에 Claude를 사용하는 것에 대한 계약상 금지를 제거하기를 거부한 후 Claude 사용을 단계적으로 중단하라는 명령을 받았다. 연방 판사는 2026년 3월 이 지정을 차단했고 2026년 8월 위헌적 보복으로 영구히 기각했다.
평가 및 영향
Claude 4는 개발자와 기업으로부터 좋은 평가를 받았으며, 많은 사람들이 긴 컨텍스트 처리와 추론 기능을 칭찬했다. 이 모델의 하이브리드 아키텍처는 효율성에 대한 새로운 기준을 세웠으며, 특정 작업에서 OpenAI 및 Google DeepMind와 같은 경쟁사의 더 큰 모델의 성능과 일치하거나 능가할 수 있게 했다. Ramp의 카드 지출 데이터에 따르면, 플랫폼에서 Anthropic 제품을 사용하는 기업의 비율은 2026년 2월 4.9% 포인트 증가한 24.4%로, Ramp가 기록한 회사 최대 월간 증가율이었다.
이번 출시는 또한 에이전트형 AI 도구의 채택을 가속화했으며, Claude Code와 Cowork는 프로그래머와 비프로그머 모두에게 인기를 얻었다. 그러나 2025년 9월 Forbes와 2026년 7월 BBC가 보도한 바와 같이 검색 결과에 공유된 Claude 채팅이 확산되면서 개인정보 보호에 대한 우려가 제기되었다. BBC는 건강 기록과 기업 문서가 포함된 200개 이상의 색인된 채팅을 집계했으며, 기술 분석에 따르면 robots.txt 규칙이 크롤러가 noindex 지시문을 읽는 것을 차단했다. Anthropic은 해당 목록이 제거되었다고 밝혔다.
향후 개발
Anthropic은 Claude 4 출시 이후에도 Claude 시리즈를 계속 개선했다. 2026년에는 소수의 기업과 조직에 추가 모델인 Claude Mythos가 출시되었고, 이어서 더 엄격한 안전장치를 갖춘 버전인 Claude Fable이 일반 대중에게 공개되었다. 2026년 3월, Claude Code 명령줄 인터페이스의 소스 코드가 유출되어 여러 향후 기능과 모델이 드러났다. 2026년 5월, Anthropic은 Managed Agents API의 연구 미리보기 기능인 "Dreaming"을 도입하여 세션 간 에이전트의 지속 메모리를 통합했다.
2026년 현재, Claude 4는 Anthropic 라인업의 기반 모델로 남아 있으며 안전, 효율성 및 기능 측면에서 지속적인 개선이 이루어지고 있다. 회사의 에이전트형 도구와 하이브리드 추론에 대한 집중은 OpenAI, Google DeepMind 및 기타 연구 기관과 함께 경쟁적인 인공지능 환경에서 주요 플레이어로 자리매김하게 한다.