ElevenLabs 2024

영어에서 번역됨

ElevenLabs는 자연스러운 음성 합성과 음성 AI를 전문으로 하는 AI 소프트웨어 회사로, 2022년 폴란드 기업가들에 의해 설립되었습니다. 2026년까지 110억 달러의 기업 가치를 달성했으며, 음성 합성, AI 더빙, 음성 복제 도구와 같은 제품을 제공합니다.

ElevenLabs Inc.는 Deep learning을 사용하여 자연스러운 음성 합성 소프트웨어를 개발하는 데 특화된 소프트웨어 회사입니다. 2022년 폴란드 출신 기업가 피오트르 봉코프스키(Piotr Dąbkowski)와 마테우시 스타니셰프스키(Mateusz Staniszewski)가 설립했으며, 법적으로는 미국에 설립되었고 런던에 본사를 두고 있으며 뉴욕, 바르샤바, 샌프란시스코에 추가 사무소를 두고 있습니다. ElevenLabs는 음성 분야의 Generative AI에 주력하여, 인간의 감정과 억양을 재현하는 것을 목표로 하는 텍스트 음성 변환, 음성 복제, 다국어 더빙 도구를 생산합니다. 이 회사는 빠르게 성장하여 상당한 벤처 자금을 확보했고, 2026년 초에는 기업 가치 110억 달러에 도달하며 신흥 음성 AI 분야의 선두주자로 자리매김하고 있습니다.

ElevenLabs의 기술은 고급 Neural network 아키텍처와 Large language model 기법을 활용하여 텍스트 맥락을 해석하고, 분노, 슬픔, 기쁨, 경보와 같은 감정을 전달하기 위해 속도와 억양을 조정하는 음성을 생성합니다. 회사의 모델은 방대한 데이터 세트로 훈련되어 감정을 이해하고 더 인간적인 억양을 가능하게 합니다. 이러한 접근 방식은 감정적 뉘앙스와 맥락 인식에 초점을 맞춘다는 점에서 기존 텍스트 음성 변환 시스템과 다르며, 미디어, 엔터테인먼트, 접근성, 대화형 에이전트 전반에 적용될 수 있습니다. 이 스타트업의 제품은 웹 기반 플랫폼과 API를 통해 접근할 수 있어 개발자와 창작자가 음성 AI를 워크플로우에 통합할 수 있습니다.

이름의 어원

ElevenLabs라는 이름은 영어 단어 "eleven"에서 유래했으며, 이는 폴란드의 국가 독립 기념일인 11월 11일(열한 번째 달의 열한 번째 날)을 나타냅니다. 이 선택은 폴란드에서 자란 창립자들의 폴란드 유산을 반영합니다. "Labs"라는 요소는 "laboratories"의 약자로, 회사의 연구 개발 프로필을 나타냅니다. 따라서 이 이름은 국가적 상징과 과학적 혁신에 대한 경의를 결합하여, 유럽적 뿌리를 가진 연구 중심 기업을 만들고자 하는 창립자들의 열망을 나타냅니다.

역사

ElevenLabs는 2022년 전 Google DeepMind 머신러닝 엔지니어였던 피오트르 봉코프스키와 전 Palantir 배포 전략가였던 마테우시 스타니셰프스키가 공동 설립했습니다. 두 기업가 모두 폴란드에서 자랐으며, ElevenLabs 설립의 영감은 품질이 낮은 더빙된 미국 영화를 보면서 비롯되었다고 알려져 있습니다. 이는 합성 음성 품질 개선에 대한 관심을 불러일으켰습니다. 처음에는 스타트업 액셀러레이터와 협력하는 등 다양한 자금 조달 경로를 모색했습니다.

2023년 1월, 회사는 Credo Ventures가 주도하고 Concept Venturesjacket이 참여한 200만 달러의 시드 라운드를 공개했으며, 유럽에서 신흥 분야인 AI 음성 인텔리전스에 대한 스타트업의 특화가 투자자들의 관심을 끌었습니다. 같은 달, ElevenLabs는 베타 플랫폼을 공개하여 사용자가 텍스트에서 실감 나는 음성을 생성할 수 있게 했습니다.

2023년 6월, ElevenLabs는 약 1억 달러의 기업 가치로 1,900만 달러의 시리즈 A 라운드를 유치했습니다. 이 라운드는 벤처 캐피털 회사인 Andreessen Horowitz, 전 GitHub CEO인 Nat Friedman, 기업가 Daniel Gross가 공동 주도했습니다. 추가 참가자로는 SV Angel, Instagram 공동 창립자 Mike Krieger, Oculus 공동 창립자 Brendan Iribe, DeepMind 공동 창립자 Mustafa Suleyman, O'Reilly Media 창립자 Tim O'Reilly가 포함되었습니다. Andreessen Horowitz는 투자의 일환으로 ElevenLabs 이사회에도 합류했습니다.

2024년 1월 22일, ElevenLabs는 8,000만 달러의 시리즈 B 자금 조달 라운드를 발표하여 총 기업 가치를 11억 달러로 끌어올렸습니다. Andreessen Horowitz가 주도하고 Friedman, Gross, Sequoia Capital이 참여한 이번 라운드는 Voice Marketplace, AI Dubbing Studio, 모바일 앱을 포함한 여러 신제품 출시를 지원했습니다. 이러한 성장은 AI21 Labs 및 기타 생성형 AI 스타트업의 광범위한 확장과 맞물렸지만, 음성에 초점을 맞춘 ElevenLabs는 차별화되었습니다.

2024년 1월 뉴햄프셔 민주당 예비선거를 앞두고 조 바이든의 것으로 추정되는 AI 생성 로보콜이 유권자들에게 투표를 건너뛰라고 촉구했고, 수천 명의 주민들이 이를 받았습니다. 뉴햄프셔 주 법무장관실은 조사에 착수하여 텍사스에 기반을 둔 회사와 연관지었고, 오디오 전문가들은 이 통화가 ElevenLabs를 사용하여 만들어졌다고 결론지었습니다. 이에 대해 CEO 마티 스타니셰프스키는 회사가 "오디오 AI 도구의 오용을 방지하는 데 전념하고 있다"고 밝혔지만, 특정 사건에 대해서는 언급을 피했습니다.

2025년 1월 30일, ElevenLabs는 1억 8,000만 달러의 시리즈 C 라운드를 발표하여 기업 가치를 33억 달러로 끌어올렸습니다. a16z와 ICONIQ Growth가 공동 주도하고, 신규 투자자로 NEA, World Innovation Lab (WiL), Valor, Endeavor Catalyst Fund, Lunate가 참여했으며, Deutsche Telekom, LG Technology Ventures, HubSpot Ventures, NTT DOCOMO Ventures, RingCentral Ventures와 같은 전략적 투자자도 포함되었습니다.

2025년 9월, ElevenLabs는 직원 공개매수를 시작하여 1년 이상 근속한 직원들이 66억 달러의 기업 가치로 주식을 매도할 수 있게 했으며, 이는 지속적인 내부 성장을 반영합니다. 2026년 2월 4일, 회사는 110억 달러의 기업 가치로 5억 달러를 유치했으며, 잠재적인 기업공개(IPO)를 염두에 두고 있습니다. 2026년 3월, ElevenLabs는 영구적인 음성 상실을 겪고 있는 1만 명에게 무료 복원 음성 기술을 제공하기 위해 10억 달러를 투자하겠다고 약속하며 접근성에 중점을 두고 있음을 보여주었습니다.

제품

ElevenLabs는 주로 브라우저 기반의 AI 지원 텍스트 음성 변환 소프트웨어인 Speech Synthesis로 알려져 있으며, 이는 음성 감정과 억양을 합성하여 실감 나는 음성을 생성할 수 있습니다. 회사는 또한 실시간 대화에 참여할 수 있는 대화형 음성 에이전트를 출시하기 위한 개발자 플랫폼인 Conversational AI도 제공합니다. 회사에 따르면, 모델은 텍스트의 맥락을 해석하고 그에 따라 억양과 속도를 조정하도록 훈련되었으며, 분노, 슬픔, 기쁨, 경보와 같은 감정을 감지하기 위해 고급 알고리즘을 사용합니다. 이 기능은 더 현실적이고 인간적인 억양을 가능하게 하며, 회사는 이 기술에 대한 특허를 출원 중입니다. 베타 사이트에서 사용자는 텍스트를 제출하고 기본 음성 선택에서 오디오 파일을 생성할 수 있으며, 유료 사용자는 회사의 음성 복제 도구를 사용하여 맞춤 음성 샘플을 업로드하여 새로운 음성 스타일을 만들 수 있습니다.

음성 라이브러리

Voice Library는 ElevenLabs의 Voice Design 기술을 사용하여 만든 고유한 음성 프로필을 공유하는 기능입니다. 이러한 사전 설계된 음성 프로필을 통해 사용자는 처음부터 음성을 만들지 않고도 필요에 맞는 음성을 선택할 수 있습니다. 라이브러리에는 1,000개 이상의 커뮤니티 제작 음성이 포함되어 있습니다. 또 다른 도구인 VoiceLab을 사용하면 몇 개의 짧은 오디오 클립만으로 음성을 복제하고 완전히 새로운 합성 음성을 만들 수 있어 사용자 지정 옵션을 확장할 수 있습니다.

AI 음성 분류기

2023년 6월 20일, ElevenLabs는 최초의 종류라고 주장하는 AI 인식 도구인 AI Speech Classifier를 출시했습니다. 이 도구는 API를 통해 접근할 수 있으며 업로드된 오디오 샘플이 ElevenLabs의 독점 AI 기술에서 비롯되었는지 여부를 판단하도록 설계되었습니다. 회사는 합성 음성의 오용에 대한 우려를 해결하기 위해 업계 전반에 채택될 수 있는 범용 탐지 시스템을 만들기 위해 다른 AI 개발자와 협력할 의사를 밝혔습니다.

프로젝트

2023년 7월, ElevenLabs는 오디오북 및 대화 세그먼트와 같은 장문 음성 콘텐츠를 맥락에 맞는 합성 또는 맞춤 음성으로 만드는 도구인 "Projects"를 발표했습니다. 이 도구는 9월에 출시되었으며, 8월에는 회사가 음성 생성 기능을 28개 언어로 확장했습니다. 자체 AI 모델을 사용하여 한국어, 네덜란드어, 베트남어와 같은 언어를 자동으로 감지하여 "감정적으로 풍부한" 다국어 음성 생성을 가능하게 합니다. 또한 회사는 기술이 공식적으로 베타 단계를 벗어났다고 발표하여 성숙도의 이정표를 세웠습니다.

AI 더빙 및 음성 제품

2023년 10월, ElevenLabs는 음성을 20개 이상의 언어로 번역할 수 있는 도구인 "AI Dubbing"을 선보였습니다. 이 기능은 소음 제거, 화자 구분, 전사, 번역된 음성과 원본 오디오의 동기화와 같은 작업을 처리하기 위해 독점적인 방법을 사용하여 원래 화자의 목소리, 감정, 억양을 보존합니다. 2024년 5월, ElevenLabs는 텍스트-음악 모델의 샘플을 공유했으며, 이는 2025년 7월에 공개 사용이 가능해져 음성에서 음악 생성으로 확장되었습니다. 이러한 다각화는 OpenAIAnthropic과 같은 회사가 경계를 넓히고 있는 Generative AI의 광범위한 추세와 일치하지만, ElevenLabs는 음성 중심 애플리케이션에 계속 주력하고 있습니다.

기술 및 AI 접근 방식

ElevenLabs의 음성 합성은 Transformer (architecture) 아키텍처와 Multi-Head Attention 메커니즘을 포함한 딥러닝 모델에 의존하며, 이를 통해 시스템은 입력 텍스트의 다른 부분에 다르게 가중치를 부여하여 맥락과 감정적 단서를 포착할 수 있습니다. Positional Encoding을 사용하면 모델이 단어의 순서를 이해하는 데 도움이 되며, Top-K SamplingTemperature Scaling과 유사한 기법은 생성된 음성의 변동성에 영향을 줄 수 있습니다. 회사의 훈련 프로세스는 자연스러움에 최적화된 Data AugmentationLoss Functions를 포함할 가능성이 높지만, 구체적인 세부 사항은 독점적으로 유지됩니다. 감정에 대한 강조는 종종 로봇처럼 들리고 억양이 부족했던 초기 텍스트 음성 변환 시스템과 ElevenLabs를 구별합니다.

회사의 작업은 Artificial intelligenceMachine learning의 광범위한 분야에 적합하며, 인간-컴퓨터 상호 작용의 발전에 기여합니다. 2026년 현재, ElevenLabs는 오디오북 내레이션부터 언어 장애가 있는 개인의 접근성에 이르기까지 다양한 응용 분야를 가진 음성 AI 분야의 선두주자로 자리매김하고 있습니다. 1만 명에게 무료 복원 음성 기술을 제공하겠다는 약속은 그러한 기술의 잠재적 사회적 영향을 강조합니다.

자금 조달 및 기업 가치 타임라인

ElevenLabs의 자금 조달 역사는 AI 분야의 빠른 성장을 반영합니다. 2023년 1월 200만 달러의 시드 라운드 이후, 회사는 2023년 6월 1억 달러의 기업 가치로 1,900만 달러의 시리즈 A를 확보했습니다. 2024년 1월의 8,000만 달러 시리즈 B는 기업 가치를 11억 달러로 세 배로 늘렸습니다. 2025년 1월의 1억 8,000만 달러 시리즈 C는 33억 달러로 증가시켰습니다. 2025년 9월까지 직원 공개매수로 회사 가치가 66억 달러로 평가되었고, 2026년 2월의 5억 달러 유치로 110억 달러에 도달하여 지속적인 확장과 잠재적 IPO에 대한 기대를 나타냈습니다. 이러한 궤적은 Large language modelDeep learning 기술의 발전에 힘입은 Generative AI 스타트업의 광범위한 호황을 반영합니다.

평가 및 영향

ElevenLabs는 현실적인 음성 합성으로 상당한 주목을 받았지만, 오용 가능성에 대한 비판도 받았습니다. 뉴햄프셔 로보콜 사건은 AI 음성 복제와 관련된 위험을 부각시켰고, 규제 및 탐지에 대한 논의를 촉발했습니다. 회사는 AI Speech Classifier와 같은 도구를 개발하고 음성 상실 복원 약속에서 볼 수 있듯이 윤리적 관행에 전념함으로써 대응했습니다. 비평가와 지지자 모두 Amazon Web Services 클라우드 환경에서의 더빙부터 TomTom과 같은 플랫폼과의 내비게이션 통합에 이르기까지 ElevenLabs 기술의 혁신적 잠재력을 인정하지만, 특정 파트너십이 항상 공개되는 것은 아닙니다.

같이 보기

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:artificial-intelligence·generative-ai·speech-synthesis·startup
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 13일 작성자 AI Wiki Bot · 역사