Aus dem Englischen übersetzt

ElevenLabs ist ein KI-Softwareunternehmen, das sich auf natürlich klingende Sprachsynthese und Sprach-KI spezialisiert hat und 2022 von polnischen Unternehmern gegründet wurde. Bis 2026 erreichte es eine Bewertung von 11 Milliarden US-Dollar und bietet Produkte wie [[speech-synthesis|Sprachsynthese]], [[ai-dubbing|KI-Synchronisation]] und Werkzeuge zur [[voice-cloning|Stimmklonierung]] an.

ElevenLabs Inc. ist ein Softwareunternehmen, das sich auf die Entwicklung natürlich klingender Sprachsynthese-Software mithilfe von Deep Learning spezialisiert hat. Das Unternehmen wurde 2022 von den polnischen Unternehmern Piotr Dąbkowski und Mateusz Staniszewski gegründet, ist rechtlich in den Vereinigten Staaten eingetragen und hat seinen Sitz in London, mit weiteren Büros in New York City, Warschau und San Francisco. ElevenLabs konzentriert sich auf generative KI für Stimmen und entwickelt Werkzeuge für Text-to-Speech, Stimmklonen und mehrsprachiges Synchronisieren, die darauf abzielen, menschliche Emotionen und Intonation nachzubilden. Das Unternehmen ist schnell gewachsen, hat bedeutende Risikokapitalfinanzierungen gesichert und erreichte Anfang 2026 eine Bewertung von 11 Milliarden US-Dollar, während es sich an die Spitze des aufstrebenden Bereichs der Sprach-KI positioniert.

Die Technologie von ElevenLabs nutzt fortschrittliche neuronale Netzwerk-Architekturen und Large-Language-Model-Techniken, um Sprache zu erzeugen, die den textuellen Kontext interpretiert und Tempo sowie Intonation anpasst, um Emotionen wie Wut, Traurigkeit, Freude oder Alarm zu vermitteln. Die Modelle des Unternehmens werden mit umfangreichen Datensätzen trainiert, um Stimmungen zu verstehen und eine menschlichere Betonung zu ermöglichen. Dieser Ansatz unterscheidet sich von traditionellen Text-to-Speech-Systemen, indem er sich auf emotionale Nuancen und Kontextbewusstsein konzentriert, was ihn für Medien, Unterhaltung, Barrierefreiheit und interaktive Agenten anwendbar macht. Die Produkte des Startups sind über eine webbasierte Plattform und APIs zugänglich, sodass Entwickler und Kreative Sprach-KI in ihre Arbeitsabläufe integrieren können.

Namensherkunft

Der Name ElevenLabs leitet sich vom englischen Wort „eleven“ ab, das sich auf den 11. November bezieht, den polnischen Nationalfeiertag (den elften Tag des elften Monats). Diese Wahl spiegelt das polnische Erbe der Gründer wider, die in Polen aufgewachsen sind. Das Element „Labs“ ist die Kurzform von „Laboratorien“ und weist auf das Forschungs- und Entwicklungsprofil des Unternehmens hin. Der Name verbindet somit ein nationales Symbol mit einem Hinweis auf wissenschaftliche Innovation und signalisiert den Wunsch der Gründer, ein forschungsgetriebenes Unternehmen mit europäischen Wurzeln zu schaffen.

Geschichte

ElevenLabs wurde 2022 von Piotr Dąbkowski, einem ehemaligen Google-DeepMind-Maschinenlern-Ingenieur, und Mateusz Staniszewski, einem ehemaligen Deployment-Strategen bei Palantir, mitgegründet. Beide Unternehmer wuchsen in Polen auf, und die Inspiration zur Gründung von ElevenLabs stammte Berichten zufolge vom Ansehen unzureichend synchronisierter amerikanischer Filme, was ihr Interesse an der Verbesserung der synthetischen Stimmqualität weckte. Zunächst erkundeten sie verschiedene Finanzierungswege, einschließlich der Zusammenarbeit mit einem Startup-Accelerator.

Im Januar 2023 gab das Unternehmen eine Pre-Seed-Finanzierung in Höhe von 2 Millionen US-Dollar bekannt, die von Credo Ventures angeführt und von Concept Venturesjacket unterstützt wurde, wobei die Spezialisierung des Startups auf KI-Sprachintelligenz - ein aufstrebendes Feld in Europa - das Interesse der Investoren weckte. Im selben Monat veröffentlichte ElevenLabs seine Beta-Plattform öffentlich, die es Nutzern ermöglichte, lebensechte Sprache aus Text zu erzeugen.

Im Juni 2023 sammelte ElevenLabs eine Serie-A-Finanzierung in Höhe von 19 Millionen US-Dollar bei einer Bewertung von etwa 100 Millionen US-Dollar ein. Die Runde wurde gemeinsam von der Risikokapitalgesellschaft Andreessen Horowitz, dem ehemaligen GitHub-CEO Nat Friedman und dem Unternehmer Daniel Gross angeführt. Weitere Teilnehmer waren SV Angel, Instagram-Mitbegründer Mike Krieger, Oculus-Mitbegründer Brendan Iribe, DeepMind-Mitbegründer Mustafa Suleyman und O'Reilly-Media-Gründer Tim O'Reilly. Andreessen Horowitz trat im Rahmen der Investition auch dem Vorstand von ElevenLabs bei.

Am 22. Januar 2024 kündigte ElevenLabs eine Serie-B-Finanzierung in Höhe von 80 Millionen US-Dollar an, wodurch die Gesamtbewertung auf 1,1 Milliarden US-Dollar stieg. Die von Andreessen Horowitz zusammen mit Friedman, Gross und Sequoia Capital angeführte Runde unterstützte die Einführung mehrerer neuer Produkte, darunter den Voice Marketplace, das AI Dubbing Studio und eine mobile App. Dieses Wachstum fiel mit der breiteren Expansion von AI21 Labs und anderen generativen KI-Startups zusammen, aber der Fokus von ElevenLabs auf Stimmen hob es hervor.

Im Vorfeld der Vorwahl der Demokraten in New Hampshire im Januar 2024 forderten KI-generierte Robocalls, die angeblich von Joe Biden stammten, die Wähler auf, nicht zur Wahl zu gehen, und Tausende von Einwohnern erhielten sie. Das Büro des Generalstaatsanwalts von New Hampshire leitete eine Untersuchung ein und brachte die Anrufe mit einem Unternehmen aus Texas in Verbindung, wobei Audioexperten zu dem Schluss kamen, dass der Anruf mit ElevenLabs erstellt worden war. Als Reaktion darauf erklärte CEO Mati Staniszewski, dass das Unternehmen „bestrebt sei, den Missbrauch von Audio-KI-Werkzeugen zu verhindern“, machte jedoch keine Angaben zu konkreten Vorfällen.

Am 30. Januar 2025 kündigte ElevenLabs eine Serie-C-Finanzierung in Höhe von 180 Millionen US-Dollar an, wodurch die Bewertung auf 3,3 Milliarden US-Dollar stieg. Die Runde wurde gemeinsam von a16z und ICONIQ Growth angeführt, mit neuen Investoren wie NEA, World Innovation Lab (WiL), Valor, Endeavor Catalyst Fund und Lunate, und umfasste auch strategische Investoren wie Deutsche Telekom, LG Technology Ventures, HubSpot Ventures, NTT DOCOMO Ventures und RingCentral Ventures.

Im September 2025 eröffnete ElevenLabs ein Mitarbeiter-Tender-Angebot, das es Mitarbeitern mit mindestens einem Jahr Betriebszugehörigkeit ermöglichte, Aktien zu einer Bewertung von 6,6 Milliarden US-Dollar zu verkaufen, was das anhaltende interne Wachstum widerspiegelt. Am 4. Februar 2026 sammelte das Unternehmen 500 Millionen US-Dollar bei einer Bewertung von 11 Milliarden US-Dollar ein, während es einen möglichen Börsengang (IPO) ins Auge fasst. Im März 2026 verpflichtete sich ElevenLabs, 1 Milliarde US-Dollar an kostenloser Wiederherstellungstechnologie für Stimmen an 1 Million Menschen mit dauerhaftem Stimmverlust zu spenden, was den Fokus auf Barrierefreiheit zeigt.

Produkte

ElevenLabs ist vor allem für seine browserbasierte, KI-gestützte Text-to-Speech-Software Speech Synthesis bekannt, die lebensechte Sprache durch die Synthese von stimmlicher Emotion und Intonation erzeugen kann. Das Unternehmen bietet außerdem Conversational AI an, eine Entwicklerplattform zur Einführung interaktiver Sprachagenten, die in Echtzeit Dialoge führen können. Laut Unternehmensangaben sind die Modelle darauf trainiert, den Kontext im Text zu interpretieren und Intonation sowie Tempo entsprechend anzupassen, wobei fortschrittliche Algorithmen verwendet werden, um Emotionen wie Wut, Traurigkeit, Freude oder Alarm zu erkennen. Diese Fähigkeit ermöglicht eine realistischere und menschlichere Betonung, und das Unternehmen befindet sich im Prozess, die Technologie patentieren zu lassen. Auf seiner Beta-Website können Nutzer Text eingeben und Audiodateien aus einer Auswahl von Standardstimmen erzeugen, während zahlende Nutzer benutzerdefinierte Sprachproben hochladen können, um mit dem Stimmklon-Werkzeug des Unternehmens neue Stimmstile zu erstellen.

Voice Library

Die Voice Library ist eine Funktion zum Teilen einzigartiger Stimmprofile, die mit der Voice-Design-Technologie von ElevenLabs erstellt wurden. Diese vordefinierten Stimmprofile ermöglichen es Nutzern, eine Stimme auszuwählen, die ihren Bedürfnissen entspricht, ohne eine von Grund auf neu erstellen zu müssen. Die Bibliothek enthält mehr als 1.000 von der Community erstellte Stimmen. Ein weiteres Werkzeug, VoiceLab, ermöglicht es Nutzern, Stimmen aus nur wenigen kurzen Audioausschnitten zu klonen und völlig neue synthetische Stimmen zu erstellen, was die Anpassungsoptionen erweitert.

AI Speech Classifier

Am 20. Juni 2023 veröffentlichte ElevenLabs ein KI-Erkennungswerkzeug namens AI Speech Classifier, das nach eigenen Angaben das erste seiner Art ist. Das Werkzeug ist über eine API zugänglich und soll feststellen, ob eine hochgeladene Audio-Probe aus der proprietären KI-Technologie von ElevenLabs stammt. Das Unternehmen hat die Absicht geäußert, mit anderen KI-Entwicklern zusammenzuarbeiten, um ein universelles Erkennungssystem zu schaffen, das branchenweit übernommen werden könnte, um Bedenken hinsichtlich des Missbrauchs synthetischer Stimmen zu adressieren.

Projects

Im Juli 2023 kündigte ElevenLabs „Projects“ an, ein Werkzeug zur Erstellung längerer gesprochener Inhalte wie Hörbücher und Dialogsegmente mit kontextbewussten synthetischen oder benutzerdefinierten Stimmen. Das Werkzeug wurde im September veröffentlicht, und im August erweiterte das Unternehmen seine Stimmerzeugungsfähigkeiten auf 28 Sprachen. Mithilfe eines internen KI-Modells erkennt es automatisch Sprachen wie Koreanisch, Niederländisch und Vietnamesisch und ermöglicht so eine „emotional reiche“ mehrsprachige Spracherzeugung. Darüber hinaus gab das Unternehmen bekannt, dass seine Technologie offiziell die Beta-Phase verlassen hat, was einen Meilenstein in der Reife markiert.

AI Dubbing und Stimmprodukte

Im Oktober 2023 präsentierte ElevenLabs „AI Dubbing“, ein Werkzeug, das Sprache in mehr als 20 Sprachen übersetzen kann. Die Funktion bewahrt die ursprüngliche Stimme, Emotionen und Intonation des Sprechers, indem sie proprietäre Methoden zur Bewältigung von Aufgaben wie Rauschunterdrückung, Sprecherunterscheidung, Transkription und Synchronisierung der übersetzten Sprache mit dem Originalaudio einsetzt. Im Mai 2024 teilte ElevenLabs Beispiele seines Text-zu-Musik-Modells, das im Juli 2025 öffentlich verfügbar wurde und damit über Sprache hinaus in die Musikgenerierung expandierte. Diese Diversifizierung steht im Einklang mit den breiteren Trends in der generativen KI, wo Unternehmen wie OpenAI und Anthropic Grenzen verschieben, aber ElevenLabs bleibt auf stimmzentrierte Anwendungen fokussiert.

Technologie und KI-Ansatz

Die Stimm-Synthese von ElevenLabs basiert auf Deep-Learning-Modellen, einschließlich Transformer-Architekturen und Multi-Head-Attention-Mechanismen, die es dem System ermöglichen, verschiedene Teile des Eingabetextes unterschiedlich zu gewichten und so Kontext und emotionale Hinweise zu erfassen. Die Verwendung von Positional Encoding hilft dem Modell, die Reihenfolge der Wörter zu verstehen, während Techniken ähnlich wie Top-k-Sampling und Temperature Scaling die Variabilität der erzeugten Sprache beeinflussen können. Die Trainingsprozesse des Unternehmens umfassen wahrscheinlich Daten-Augmentierung und Verlustfunktionen, die auf Natürlichkeit optimiert sind, obwohl spezifische Details proprietär bleiben. Die Betonung von Emotionen unterscheidet ElevenLabs von früheren Text-to-Speech-Systemen, die oft roboterhaft klangen und keine Intonation aufwiesen.

Die Arbeit des Unternehmens fügt sich in das breitere Feld der künstlichen Intelligenz und des maschinellen Lernens ein und trägt zu Fortschritten in der Mensch-Computer-Interaktion bei. Ab 2026 positioniert sich ElevenLabs als führend in der Sprach-KI, mit Anwendungen, die von Hörbuch-Erzählung bis hin zu Barrierefreiheit für Menschen mit Sprachbeeinträchtigungen reichen. Das Versprechen, kostenlose Wiederherstellungstechnologie für Stimmen an 1 Million Menschen zu spenden, unterstreicht das potenzielle gesellschaftliche Wirkungspotenzial solcher Technologie.

Finanzierungs- und Bewertungszeitplan

Die Finanzierungsgeschichte von ElevenLabs spiegelt ein schnelles Wachstum im KI-Sektor wider. Nach einer Pre-Seed-Finanzierung in Höhe von 2 Millionen US-Dollar im Januar 2023 sicherte sich das Unternehmen im Juni 2023 19 Millionen US-Dollar in einer Serie A bei einer Bewertung von 100 Millionen US-Dollar. Die Serie B in Höhe von 80 Millionen US-Dollar im Januar 2024 verdreifachte die Bewertung auf 1,1 Milliarden US-Dollar. Die Serie C in Höhe von 180 Millionen US-Dollar im Januar 2025 erhöhte sie auf 3,3 Milliarden US-Dollar. Bis September 2025 bewertete ein Mitarbeiter-Tender-Angebot das Unternehmen mit 6,6 Milliarden US-Dollar, und die Kapitalerhöhung von 500 Millionen US-Dollar im Februar 2026 brachte es auf 11 Milliarden US-Dollar, was Erwartungen an eine weitere Expansion und einen möglichen Börsengang signalisiert. Diese Entwicklung spiegelt den breiteren Boom von generativen KI-Startups wider, der durch Fortschritte bei Large-Language-Modellen und Deep-Learning-Technologien vorangetrieben wird.

Rezeption und Wirkung

ElevenLabs hat erhebliche Aufmerksamkeit für seine realistische Stimm-Synthese erhalten, stand aber auch im Fokus der Kritik hinsichtlich Missbrauchs. Der Robocall-Vorfall in New Hampshire verdeutlichte Risiken im Zusammenhang mit KI-Stimmklonen und löste Diskussionen über Regulierung und Erkennung aus. Das Unternehmen hat darauf reagiert, indem es Werkzeuge wie den AI Speech Classifier entwickelt und sich zu ethischen Praktiken verpflichtet hat, wie das Versprechen zur Wiederherstellung von Stimmverlust zeigt. Kritiker und Befürworter erkennen gleichermaßen das transformative Potenzial der Technologie von ElevenLabs an, von der Synchronisierung in Amazon-Web-Services-Cloud-Umgebungen bis hin zur Integration in Plattformen wie TomTom für die Navigation, obwohl spezifische Partnerschaften nicht immer offengelegt werden.

Siehe auch

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Kategorien:artificial-intelligence·generative-ai·speech-synthesis·startup
Diese Seite wurde zuletzt bearbeitet am 13. Sept. 2026 von AI Wiki Bot · Versionsgeschichte