OpenSearch는 Amazon Web Services가 2021년에 Elasticsearch와 Kibana에서 포크한 오픈소스 검색 및 분석 제품군이다. 확장 가능한 전문 검색, 로그 분석, 벡터 데이터베이스 기능을 제공하여 엔터프라이즈 검색부터 AI 기반 검색까지 다양한 애플리케이션에 적합하다. 이 프로젝트는 Apache License 2.0으로 배포되며, AWS가 주요 관리 주체로서 커뮤니티 기여자들이 유지 관리한다.
이 제품군은 두 가지 주요 구성 요소로 이루어져 있다: OpenSearch(검색 엔진 및 문서 저장소)와 OpenSearch Dashboards(시각화 및 관리 인터페이스). RESTful API, 실시간 인덱싱, 그리고 벡터 유사성을 위한 k-최근접 이웃(kNN) 검색을 포함한 고급 쿼리를 지원한다. 이러한 벡터 지원은 머신 러닝 모델과의 통합을 가능하게 하여 의미 검색 및 생성형 AI 애플리케이션(예: 검색 증강 생성(RAG))에 활용된다.
역사 및 배경
OpenSearch는 Elastic의 라이선스 모델 변경에 따라 Elasticsearch와 Kibana의 포크로 시작되었다. 2021년 1월, Elastic은 Apache 2.0 라이선스에서 이중 라이선스(SSPL 및 Elastic License)로 전환을 발표하여 특정 사용을 제한했다. 이에 대응하여 AWS는 마지막 Apache 라이선스 버전(Elasticsearch 7.10 및 Kibana 7.10)을 포크하고 2021년 4월에 OpenSearch를 출시했다. 이 포크는 자유롭게 사용하고 수정할 수 있는 오픈소스 커뮤니티 중심 검색 스택을 유지해야 할 필요성에서 비롯되었다.
출시 이후 OpenSearch는 독립적으로 발전하여 비동기 검색, SQL 지원, 이상 탐지와 같은 기능을 추가했다. 이 프로젝트는 정기적인 릴리스 주기를 유지하며, 2022년 7월에 버전 2.0이 출시되어 인덱스 관리 및 보안 강화와 같은 새로운 기능을 도입했다. 2024년 기준으로 OpenSearch는 클라우드 및 온프레미스 환경에서 널리 채택되었으며, AWS 및 다른 공급업체에서 배포판을 제공한다.
주요 기능 및 아키텍처
OpenSearch는 Elasticsearch와 동일한 기본 라이브러리인 Apache Lucene을 기반으로 구축되어 강력한 전문 검색 성능을 보장한다. 그 아키텍처는 분산형으로, 노드 클러스터에서 수평 확장이 가능하다. 데이터는 인덱스에 저장되며, 고가용성을 위해 샤딩 및 복제된다. 이 엔진은 일치, 용어, 불리언, 지리 공간 쿼리를 포함한 다양한 쿼리 유형을 지원한다.
두드러진 기능은 고차원 벡터에 대한 유사성 검색을 가능하게 하는 벡터 데이터베이스 기능이다. 이는 k-NN 플러그인을 통해 구현되며, HNSW(계층적 탐색 가능한 소규모 세계) 및 IVF(역파일 인덱스)와 같은 알고리즘을 지원한다. 이로 인해 OpenSearch는 신경망 임베딩에 적합하며, 딥 러닝 및 대규모 언어 모델 사용 사례를 지원한다. 또한 OpenSearch는 AWS Trainium 및 기타 하드웨어 가속기와 통합되어 클라우드 배포에서 최적화된 추론을 제공한다.
Dashboards 구성 요소는 데이터 탐색, 시각화 및 모니터링을 위한 사용자 인터페이스를 제공한다. 대시보드 구축, 알림 생성, 클러스터 상태 관리 도구를 포함한다. OpenSearch는 또한 포괄적인 REST API를 제공하여 프로그래밍 방식의 제어 및 외부 시스템과의 통합을 가능하게 한다.
커뮤니티 및 거버넌스
OpenSearch 프로젝트는 중립적이고 커뮤니티 중심의 개발을 보장하기 위해 2024년에 설립된 OpenSearch 재단에 의해 관리된다. 이 재단은 Linux 재단의 일부이며, AWS, 삼성전자, 인텔 및 기타 조직이 회원으로 참여한다. 이 프로젝트는 개방형 거버넌스 모델을 따르며, 기술 운영 위원회와 작업 그룹이 검색 관련성, 보안, 관찰 가능성과 같은 다양한 영역을 감독한다.
개인과 기업의 기여를 환영하며, 투명성과 협업에 중점을 둔다. 이 프로젝트는 공개 로드맵을 유지하고 정기적인 커뮤니티 회의를 개최한다. 2025년 기준으로 OpenSearch는 Azure, Google Cloud, Oracle Cloud용 커넥터를 포함한 플러그인 및 통합의 활발한 생태계를 보유하고 있다.
사용 사례 및 생태계
OpenSearch는 다양한 산업에서 여러 목적으로 사용된다. 일반적인 사용 사례는 다음과 같다:
- 로그 및 이벤트 분석: 애플리케이션 및 인프라의 로그를 중앙 집중화하여 문제 해결 및 모니터링에 활용.
- 엔터프라이즈 검색: 문서, 위키, 데이터베이스 전반의 내부 검색 지원.
- 애플리케이션 검색: 전자상거래, 콘텐츠 관리, SaaS 제품에 검색 기능 제공.
- 벡터 검색 및 AI: 생성형 AI 애플리케이션을 위한 의미 검색, 추천 시스템, RAG 파이프라인 지원.
주요 클라우드 제공업체는 Amazon OpenSearch Service와 같은 OpenSearch 기반 관리 서비스를 제공한다. 이 소프트웨어는 자체 관리 배포를 위한 독립 실행형 다운로드로도 제공된다. 생태계에는 OpenSearch Alerting, Security, Performance Analyzer와 같은 기능을 확장하는 도구가 포함된다.
비교 및 영향
OpenSearch는 종종 업스트림 전신인 Elasticsearch와 비교된다. 둘 다 유사한 API와 기능을 공유하지만, OpenSearch는 오픈소스 특성과 커뮤니티 거버넌스를 강조한다. 벤더 종속 및 라이선스 제한을 피하려는 조직에서 채택이 증가하고 있다. 이 프로젝트의 벡터 기능은 전문 벡터 데이터베이스와 함께 성장하는 AI 인프라 분야에서 경쟁력 있는 옵션으로 자리 잡고 있다.
OpenSearch의 영향은 클라우드 컴퓨팅 환경에서 두드러지며, 독점 검색 서비스에 대한 개방형 대안을 제공한다. AWS 및 기타 제공업체의 채택으로 많은 기업에서 표준 선택이 되었다. 2025년 기준으로 이 프로젝트는 머신 러닝 통합, 성능 최적화, 다중 테넌시 지원과 같은 영역에서 지속적인 개발을 통해 계속 진화하고 있다.
같이 보기
- Amazon Web Services
- Elasticsearch (슬러그 목록에 없지만 관련됨)
- 벡터 데이터베이스 (슬러그 목록에 없지만 관련됨)
- 검색 증강 생성 (슬러그 목록에 없지만 관련됨)
참고: 같이 보기 섹션은 선택 사항이며 필요하지 않으면 생략할 수 있다.