ElevenLabs Inc. é uma empresa de software especializada no desenvolvimento de software de síntese de fala com som natural usando aprendizado profundo. Fundada em 2022 pelos empreendedores poloneses Piotr Dąbkowski e Mateusz Staniszewski, a empresa está legalmente constituída nos Estados Unidos e tem sede em Londres, com escritórios adicionais em Nova York, Varsóvia e São Francisco. A ElevenLabs concentra-se em IA generativa para voz, produzindo ferramentas para conversão de texto em fala, clonagem de voz e dublagem multilíngue que visam replicar a emoção e a entonação humanas. A empresa cresceu rapidamente, garantindo financiamento significativo de capital de risco e alcançando uma avaliação de US$ 11 bilhões no início de 2026, posicionando-se na vanguarda do emergente campo da IA de voz.
A tecnologia da ElevenLabs aproveita arquiteturas avançadas de redes neurais e técnicas de modelos de linguagem de grande escala para gerar fala que interpreta o contexto textual, ajustando ritmo e entonação para transmitir emoções como raiva, tristeza, alegria ou alarme. Os modelos da empresa são treinados em vastos conjuntos de dados para compreender o sentimento, permitindo uma inflexão mais humana. Essa abordagem difere dos sistemas tradicionais de conversão de texto em fala ao focar na nuance emocional e na consciência contextual, tornando-a aplicável em mídia, entretenimento, acessibilidade e agentes interativos. Os produtos da startup são acessíveis por meio de uma plataforma baseada na web e APIs, permitindo que desenvolvedores e criadores integrem IA de voz em seus fluxos de trabalho.
Etimologia do nome
O nome ElevenLabs deriva da palavra inglesa "eleven", que se refere a 11 de novembro, o Dia da Independência Nacional da Polônia (o décimo primeiro dia do décimo primeiro mês). Essa escolha reflete a herança polonesa dos fundadores, que cresceram na Polônia. O elemento "Labs" é a abreviação de "laboratórios", indicando o perfil de pesquisa e desenvolvimento da empresa. O nome combina, assim, um símbolo nacional com uma referência à inovação científica, sinalizando o desejo dos fundadores de criar uma empresa orientada por pesquisa com raízes europeias.
História
A ElevenLabs foi cofundada em 2022 por Piotr Dąbkowski, ex-engenheiro de aprendizado de máquina do Google DeepMind, e Mateusz Staniszewski, ex-estrategista de implantação na Palantir. Ambos os empreendedores foram criados na Polônia, e a inspiração para fundar a ElevenLabs supostamente veio de assistir a filmes americanos dublados de forma inadequada, o que despertou seu interesse em melhorar a qualidade da voz sintética. Inicialmente, eles exploraram várias vias de financiamento, incluindo trabalhar com uma aceleradora de startups.
Em janeiro de 2023, a empresa revelou uma rodada pré-semente de US$ 2 milhões liderada pela Credo Ventures e acompanhada pela Concept Ventures, com a especialização da startup em inteligência de voz por IA - um campo emergente na Europa - atraindo o interesse de investidores. No mesmo mês, a ElevenLabs lançou publicamente sua plataforma beta, permitindo que usuários gerassem voz realista a partir de texto.
Em junho de 2023, a ElevenLabs levantou uma rodada Série A de US$ 19 milhões com uma avaliação de cerca de US$ 100 milhões. A rodada foi coliderada pela empresa de capital de risco Andreessen Horowitz, pelo ex-CEO do GitHub Nat Friedman e pelo empreendedor Daniel Gross. Participantes adicionais incluíram SV Angel, o cofundador do Instagram Mike Krieger, o cofundador da Oculus Brendan Iribe, o cofundador da DeepMind Mustafa Suleyman e o fundador da O'Reilly Media Tim O'Reilly. A Andreessen Horowitz também se juntou ao conselho da ElevenLabs como parte do investimento.
Em 22 de janeiro de 2024, a ElevenLabs anunciou uma rodada Série B de US$ 80 milhões, elevando sua avaliação total para US$ 1,1 bilhão. Liderada pela Andreessen Horowitz, juntamente com Friedman, Gross e Sequoia Capital, a rodada apoiou a introdução de vários novos produtos, incluindo o Voice Marketplace, o AI Dubbing Studio e um aplicativo móvel. Esse crescimento coincidiu com a expansão mais ampla da AI21 Labs e de outras startups de IA generativa, mas o foco da ElevenLabs em voz a distinguiu.
No período que antecedeu a primária democrata de New Hampshire em janeiro de 2024, chamadas robóticas geradas por IA supostamente de Joe Biden instavam eleitores a não votar, e milhares de residentes as receberam. O escritório do procurador-geral de New Hampshire iniciou uma investigação, vinculando as chamadas a uma empresa sediada no Texas, com especialistas em áudio concluindo que a chamada foi feita usando a ElevenLabs. Em resposta, o CEO Mati Staniszewski afirmou que a empresa estava "dedicada a prevenir o uso indevido de ferramentas de áudio por IA", mas não forneceu comentários sobre incidentes específicos.
Em 30 de janeiro de 2025, a ElevenLabs anunciou uma rodada Série C de US$ 180 milhões, elevando sua avaliação para US$ 3,3 bilhões. Coliderada pela a16z e ICONIQ Growth, com novos investidores NEA, World Innovation Lab (WiL), Valor, Endeavor Catalyst Fund e Lunate, a rodada também incluiu investidores estratégicos como Deutsche Telekom, LG Technology Ventures, HubSpot Ventures, NTT DOCOMO Ventures e RingCentral Ventures.
Em setembro de 2025, a ElevenLabs abriu uma oferta de venda de ações para funcionários, permitindo que funcionários com pelo menos um ano de casa vendessem ações a uma avaliação de US$ 6,6 bilhões, refletindo o crescimento interno contínuo. Em 4 de fevereiro de 2026, a empresa levantou US$ 500 milhões a uma avaliação de US$ 11 bilhões, enquanto mira uma possível oferta pública inicial (IPO). Em março de 2026, a ElevenLabs comprometeu-se a dedicar US$ 1 bilhão em tecnologia gratuita de restauração de voz para 1 milhão de pessoas que vivem com perda permanente de voz, demonstrando um foco em acessibilidade.
Produtos
A ElevenLabs é conhecida principalmente por seu software de conversão de texto em fala assistido por IA, baseado em navegador, o Speech Synthesis, que pode produzir fala realista ao sintetizar emoção e entonação vocal. A empresa também oferece o Conversational AI, uma plataforma para desenvolvedores lançarem agentes de voz interativos que podem participar de diálogos em tempo real. De acordo com a empresa, seus modelos são treinados para interpretar o contexto no texto, ajustando entonação e ritmo de acordo, usando algoritmos avançados para detectar emoções como raiva, tristeza, alegria ou alarme. Essa capacidade permite uma inflexão mais realista e humana, e a empresa está em processo de patentear a tecnologia. Em seu site beta, os usuários podem enviar texto e gerar arquivos de áudio a partir de uma seleção de vozes padrão, enquanto usuários pagantes podem enviar amostras de voz personalizadas para criar novos estilos vocais usando a ferramenta de clonagem de voz da empresa.
Voice Library
A Voice Library é um recurso para compartilhar perfis de voz exclusivos criados usando a tecnologia Voice Design da ElevenLabs. Esses perfis de voz pré-projetados permitem que os usuários selecionem uma voz que atenda às suas necessidades sem criar uma do zero. A biblioteca contém mais de 1.000 vozes criadas pela comunidade. Outra ferramenta, o VoiceLab, permite que os usuários clonem vozes a partir de apenas alguns trechos curtos de áudio e pode criar vozes sintéticas totalmente novas, expandindo as opções de personalização.
AI Speech Classifier
Em 20 de junho de 2023, a ElevenLabs lançou uma ferramenta de reconhecimento de IA chamada AI Speech Classifier, que afirma ser a primeira do tipo. A ferramenta é acessível por meio de uma API e projetada para determinar se uma amostra de áudio enviada se origina da tecnologia proprietária de IA da ElevenLabs. A empresa expressou a intenção de colaborar com outros desenvolvedores de IA para criar um sistema de detecção universal que pudesse ser adotado em toda a indústria, abordando preocupações sobre o uso indevido de voz sintética.
Projects
Em julho de 2023, a ElevenLabs anunciou "Projects", uma ferramenta para criar conteúdo falado de formato longo, como audiolivros e segmentos de diálogo, com vozes sintéticas ou personalizadas conscientes do contexto. A ferramenta foi lançada em setembro, e em agosto a empresa expandiu suas capacidades de geração de voz para 28 idiomas. Usando um modelo de IA interno, ela detecta automaticamente idiomas como coreano, holandês e vietnamita, permitindo geração de fala multilíngue "emocionalmente rica". Além disso, a empresa anunciou que sua tecnologia havia oficialmente saído da fase beta, marcando um marco de maturidade.
AI Dubbing e produtos de voz
Em outubro de 2023, a ElevenLabs apresentou o "AI Dubbing", uma ferramenta que pode traduzir fala para mais de 20 idiomas. O recurso preserva a voz original do falante, emoções e entonação, empregando métodos proprietários para lidar com tarefas como remoção de ruído, diferenciação de falantes, transcrição e sincronização da fala traduzida com o áudio original. Em maio de 2024, a ElevenLabs compartilhou amostras de seu modelo de texto para música, que se tornou disponível para uso público em julho de 2025, expandindo além da fala para a geração de música. Essa diversificação está alinhada com as tendências mais amplas em IA generativa, onde empresas como OpenAI e Anthropic estão ultrapassando limites, mas a ElevenLabs permanece focada em aplicações centradas em voz.
Tecnologia e abordagem de IA
A síntese de voz da ElevenLabs depende de modelos de aprendizado profundo, incluindo arquiteturas transformers e mecanismos de atenção de múltiplas cabeças, que permitem que o sistema pondere diferentes partes do texto de entrada de forma diferente, capturando contexto e pistas emocionais. O uso de codificação posicional ajuda o modelo a entender a sequência de palavras, enquanto técnicas semelhantes a amostragem top-k e escala de temperatura podem influenciar a variabilidade da fala gerada. Os processos de treinamento da empresa provavelmente envolvem aumento de dados e funções de perda otimizadas para naturalidade, embora detalhes específicos permaneçam proprietários. A ênfase na emoção distingue a ElevenLabs de sistemas anteriores de conversão de texto em fala, que muitas vezes soavam robóticos e sem entonação.
O trabalho da empresa se encaixa no campo mais amplo de inteligência artificial e aprendizado de máquina, contribuindo para avanços na interação humano-computador. Em 2026, a ElevenLabs se posiciona como líder em IA de voz, com aplicações que vão desde narração de audiolivros até acessibilidade para indivíduos com deficiências de fala. Seu compromisso de fornecer tecnologia gratuita de restauração de voz para 1 milhão de pessoas ressalta o potencial impacto social de tal tecnologia.
Linha do tempo de financiamento e avaliação
A história de financiamento da ElevenLabs reflete o rápido crescimento no setor de IA. Após uma pré-semente de US$ 2 milhões em janeiro de 2023, a empresa garantiu US$ 19 milhões na Série A com uma avaliação de US$ 100 milhões em junho de 2023. A Série B de US$ 80 milhões em janeiro de 2024 triplicou a avaliação para US$ 1,1 bilhão. A Série C de US$ 180 milhões em janeiro de 2025 aumentou para US$ 3,3 bilhões. Em setembro de 2025, uma oferta de venda de ações para funcionários avaliou a empresa em US$ 6,6 bilhões, e o aumento de US$ 500 milhões em fevereiro de 2026 a trouxe para US$ 11 bilhões, indicando expectativas de expansão contínua e possível IPO. Essa trajetória espelha o boom mais amplo de startups de IA generativa, impulsionado por avanços em modelos de linguagem de grande escala e tecnologias de aprendizado profundo.
Recepção e impacto
A ElevenLabs atraiu atenção significativa por sua síntese de voz realista, mas também enfrentou escrutínio quanto ao uso indevido. O incidente das chamadas robóticas em New Hampshire destacou riscos associados à clonagem de voz por IA, provocando discussões sobre regulamentação e detecção. A empresa respondeu desenvolvendo ferramentas como o AI Speech Classifier e comprometendo-se com práticas éticas, como visto em seu compromisso de restauração de voz. Críticos e apoiadores reconhecem o potencial transformador da tecnologia da ElevenLabs, desde dublagem em ambientes de nuvem Amazon Web Services até integração com plataformas como TomTom para navegação, embora parcerias específicas nem sempre sejam divulgadas.