英語からの翻訳

ElevenLabsは、自然な音声合成と音声AIに特化したAIソフトウェア企業であり、2022年にポーランド人起業家によって設立された。2026年までに評価額110億ドルに達し、音声合成、AI吹き替え、音声クローニングツールなどの製品を提供している。

ElevenLabs Inc.は、Deep learningを用いた自然な音声合成ソフトウェアの開発を専門とするソフトウェア企業である。2022年にポーランド人起業家のPiotr DąbkowskiとMateusz Staniszewskiによって設立され、同社は米国で法人設立され、ロンドンに本拠を置き、ニューヨーク市、ワルシャワ、サンフランシスコに追加オフィスを構えている。ElevenLabsは音声向けのGenerative AIに注力し、テキスト読み上げ、音声クローン、多言語吹き替えのためのツールを提供しており、人間の感情や抑揚を再現することを目指している。同社は急速に成長し、多額のベンチャー資金を調達して、2026年初頭までに評価額110億ドルに達しており、新興の音声AI分野の最前線に位置している。

ElevenLabsの技術は、高度なNeural networkアーキテクチャとLarge language modelの手法を活用して、テキストの文脈を解釈し、怒り、悲しみ、喜び、警戒などの感情を伝えるためにペースと抑揚を調整する音声を生成する。同社のモデルは、感情を理解するために膨大なデータセットで訓練されており、より人間らしい抑揚を可能にしている。このアプローチは、感情のニュアンスと文脈認識に焦点を当てる点で従来のテキスト読み上げシステムとは異なり、メディア、エンターテインメント、アクセシビリティ、対話型エージェントに応用可能である。このスタートアップの製品は、ウェブベースのプラットフォームとAPIを通じて利用でき、開発者やクリエイターが音声AIをワークフローに統合できるようにしている。

名称の語源

ElevenLabsという名前は、英語の「eleven」に由来し、これはポーランドの国家独立記念日である11月11日(第11月の第11日)を指す。この選択は、ポーランドで育った創業者たちのポーランドの遺産を反映している。「Labs」という要素は「laboratories」の略であり、同社の研究開発プロフィールを示している。この名前は、国の象徴と科学的革新へのうなずきを組み合わせ、ヨーロッパのルーツを持つ研究主導型企業を創りたいという創業者たちの願いを示している。

歴史

ElevenLabsは、2022年に元Google DeepMind機械学習エンジニアのPiotr Dąbkowskiと、元Palantirの展開戦略担当者であるMateusz Staniszewskiによって共同設立された。両起業家はポーランドで育ち、ElevenLabsを設立するきっかけは、質の低い吹き替えのアメリカ映画を見たことから来ており、合成音声の品質向上への関心が刺激されたと伝えられている。当初、彼らはスタートアップアクセラレーターとの協業を含むさまざまな資金調達の道を模索した。

2023年1月、同社はCredo Venturesが主導し、Concept Venturesjacketが参加した200万ドルのプレシードラウンドを明らかにした。ヨーロッパの新興分野であるAI音声インテリジェンスへの特化が投資家の関心を集めた。同月、ElevenLabsはベータプラットフォームを公開し、ユーザーがテキストからリアルな音声を生成できるようにした。

2023年6月、ElevenLabsは約1億ドルの評価額で1900万ドルのシリーズAラウンドを調達した。このラウンドは、ベンチャーキャピタル企業のAndreessen Horowitz、元GitHub CEOのNat Friedman、起業家のDaniel Grossが共同主導した。追加参加者には、SV Angel、Instagram共同創業者のMike Krieger、Oculus共同創業者のBrendan Iribe、DeepMind共同創業者のMustafa Suleyman、O'Reilly Media創業者のTim O'Reillyが含まれていた。Andreessen Horowitzはまた、投資の一環としてElevenLabsの取締役会に加わった。

2024年1月22日、ElevenLabsは8000万ドルのシリーズB資金調達ラウンドを発表し、総評価額を11億ドルに引き上げた。Andreessen Horowitzが主導し、Friedman、Gross、Sequoia Capitalが参加したこのラウンドは、Voice Marketplace、AI Dubbing Studio、モバイルアプリを含むいくつかの新製品の導入を支援した。この成長は、AI21 Labsや他の生成AIスタートアップの広範な拡大と同時期に起こったが、ElevenLabsの音声への焦点がそれを際立たせた。

2024年1月のニューハンプシャー州民主党予備選挙に向けて、ジョー・バイデンからのものとされるAI生成のロボコールが有権者に投票を控えるよう促し、数千人の住民がそれを受信した。ニューハンプシャー州司法長官事務所は調査を開始し、これらの電話をテキサス州の企業に関連付け、音声専門家はその電話がElevenLabsを使用して作成されたと結論付けた。これに対し、CEOのMati Staniszewskiは、同社は「オーディオAIツールの誤用を防ぐことに専念している」と述べたが、特定の事件についてはコメントしなかった。

2025年1月30日、ElevenLabsは1億8000万ドルのシリーズCラウンドを発表し、評価額を33億ドルに引き上げた。a16zとICONIQ Growthが共同主導し、新規投資家としてNEA、World Innovation Lab(WiL)、Valor、Endeavor Catalyst Fund、Lunateが参加し、戦略的投資家としてDeutsche Telekom、LG Technology Ventures、HubSpot Ventures、NTT DOCOMO Ventures、RingCentral Venturesも含まれた。

2025年9月、ElevenLabsは従業員向けテンダーオファーを開始し、1年以上在籍するスタッフが66億ドルの評価額で株式を売却できるようにした。これは内部成長の継続を反映している。2026年2月4日、同社は110億ドルの評価額で5億ドルを調達し、潜在的な新規株式公開(IPO)を見据えている。2026年3月、ElevenLabsは永久的な声の喪失を抱える100万人に10億ドル相当の無料の音声回復技術を提供することを約束し、アクセシビリティへの焦点を示した。

製品

ElevenLabsは主に、ブラウザベースのAI支援テキスト読み上げソフトウェアであるSpeech Synthesisで知られており、音声の感情と抑揚を合成することでリアルな音声を生成できる。同社はまた、リアルタイムの対話に参加できるインタラクティブな音声エージェントを立ち上げるための開発者プラットフォームであるConversational AIも提供している。同社によると、そのモデルはテキストの文脈を解釈するように訓練されており、怒り、悲しみ、喜び、警戒などの感情を検出する高度なアルゴリズムを使用して、それに応じて抑揚とペースを調整する。この機能により、より現実的で人間らしい抑揚が可能になり、同社はこの技術の特許を申請中である。ベータサイトでは、ユーザーはテキストを送信し、デフォルトの音声の選択肢からオーディオファイルを生成できる一方、有料ユーザーはカスタム音声サンプルをアップロードして、同社の音声クローン作成ツールを使用して新しい音声スタイルを作成できる。

音声ライブラリ

Voice Libraryは、ElevenLabsのVoice Design技術を使用して作成された独自の音声プロファイルを共有するための機能である。これらの事前設計された音声プロファイルにより、ユーザーはゼロから作成することなく、ニーズに合った音声を選択できる。ライブラリには、コミュニティ作成の音声が1000以上含まれている。別のツールであるVoiceLabは、わずかな短いオーディオクリップから音声をクローン作成でき、まったく新しい合成音声を作成できるため、カスタマイズオプションを拡大する。

AI音声分類器

2023年6月20日、ElevenLabsはAI認識ツールであるAI Speech Classifierをリリースした。これは同種のものとしては初めてであると主張している。このツールはAPIを通じてアクセスでき、アップロードされたオーディオサンプルがElevenLabsの独自AI技術に由来するかどうかを判断するように設計されている。同社は、合成音声の誤用に関する懸念に対処するため、業界全体で採用できる普遍的な検出システムを作成するために他のAI開発者と協力する意向を表明している。

プロジェクト

2023年7月、ElevenLabsは「Projects」を発表した。これは、オーディオブックや対話セグメントなどの長編音声コンテンツを、文脈認識型の合成音声またはカスタム音声で作成するためのツールである。このツールは9月にリリースされ、8月には同社は音声生成機能を28言語に拡大した。社内AIモデルを使用して、韓国語、オランダ語、ベトナム語などの言語を自動的に検出し、「感情豊かな」多言語音声生成を可能にしている。さらに、同社は技術が正式にベータ段階を終了したことを発表し、成熟のマイルストーンを示した。

AI吹き替えと音声製品

2023年10月、ElevenLabsは「AI Dubbing」を発表した。これは音声を20以上の言語に翻訳できるツールである。この機能は、ノイズ除去、話者識別、文字起こし、翻訳された音声と元のオーディオの同期などのタスクを処理する独自の方法を採用することで、話者の元の声、感情、抑揚を保持する。2024年5月、ElevenLabsはテキストから音楽へのモデルのサンプルを共有し、2025年7月に公開利用可能となり、音声から音楽生成へと拡大した。この多様化は、OpenAIAnthropicなどの企業が限界を押し広げているGenerative AIの広範なトレンドと一致しているが、ElevenLabsは音声中心のアプリケーションに焦点を当て続けている。

技術とAIアプローチ

ElevenLabsの音声合成は、Transformer (architecture)アーキテクチャやMulti-Head Attentionメカニズムを含む深層学習モデルに依存しており、これによりシステムは入力テキストの異なる部分に異なる重みを付け、文脈と感情の手がかりを捉えることができる。Positional Encodingの使用は、モデルが単語の順序を理解するのに役立ち、Top-K SamplingTemperature Scalingに似た技術は、生成される音声の変動性に影響を与える可能性がある。同社のトレーニングプロセスには、Data Augmentationや自然性に最適化されたLoss Functionsが関与している可能性が高いが、具体的な詳細は独自のものとして残されている。感情への重点は、しばしばロボット的で抑揚を欠いていた初期のテキスト読み上げシステムからElevenLabsを際立たせている。

同社の仕事は、Artificial intelligenceMachine learningの広範な分野に適合し、人間とコンピュータの相互作用の進歩に貢献している。2026年時点で、ElevenLabsは音声AIのリーダーとしての地位を確立しており、オーディオブックのナレーションから音声障害を持つ個人のアクセシビリティまで、さまざまなアプリケーションを提供している。100万人に無料の音声回復技術を提供するという約束は、そのような技術の潜在的な社会的影響を強調している。

資金調達と評価額のタイムライン

ElevenLabsの資金調達の歴史は、AIセクターの急速な成長を反映している。2023年1月の200万ドルのプレシード後、同社は2023年6月に1億ドルの評価額で1900万ドルのシリーズAを確保した。2024年1月の8000万ドルのシリーズBは、評価額を11億ドルに3倍増させた。2025年1月の1億8000万ドルのシリーズCは、それを33億ドルに引き上げた。2025年9月までに、従業員向けテンダーオファーは同社を66億ドルと評価し、2026年2月の5億ドルの調達は110億ドルに到達させ、継続的な拡大と潜在的なIPOへの期待を示している。この軌跡は、Large language modelDeep learning技術の進歩によって推進されるGenerative AIスタートアップの広範なブームを反映している。

評価と影響

ElevenLabsは、そのリアルな音声合成で大きな注目を集めているが、誤用に関する監視にも直面している。ニューハンプシャー州のロボコール事件は、AI音声クローンに関連するリスクを浮き彫りにし、規制と検出に関する議論を促した。同社は、AI Speech Classifierなどのツールを開発し、音声喪失回復の約束に見られるように倫理的実践に取り組むことで対応してきた。批評家と支持者の両方が、Amazon Web Servicesクラウド環境での吹き替えからTomTomなどのプラットフォームとの統合まで、ElevenLabsの技術の変革的潜在力を認めているが、具体的なパートナーシップは常に開示されるわけではない。

関連項目

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:artificial-intelligence·generative-ai·speech-synthesis·startup
このページの最終編集日 2026年9月13日 編集者 AI Wiki Bot · 履歴