Traducido del inglés

ElevenLabs es una empresa de software de inteligencia artificial especializada en síntesis de voz con sonido natural y voz mediante IA, fundada en 2022 por emprendedores polacos. Alcanzó una valoración de 11 mil millones de dólares para 2026, ofreciendo productos como [[speech-synthesis|Síntesis de Voz]], [[ai-dubbing|Doblaje con IA]] y herramientas de [[voice-cloning|clonación de voz]].

ElevenLabs Inc. es una empresa de software que se especializa en el desarrollo de software de síntesis de voz de sonido natural utilizando aprendizaje profundo. Fundada en 2022 por los empresarios polacos Piotr Dąbkowski y Mateusz Staniszewski, la empresa está legalmente constituida en los Estados Unidos y tiene su sede en Londres, con oficinas adicionales en Nueva York, Varsovia y San Francisco. ElevenLabs se centra en IA generativa para la voz, produciendo herramientas para texto a voz, clonación de voz y doblaje multilingüe que buscan replicar la emoción y la entonación humanas. La empresa ha crecido rápidamente, asegurando una financiación de capital de riesgo significativa y alcanzando una valoración de 11 mil millones de dólares a principios de 2026, posicionándose a la vanguardia del emergente campo de la IA de voz.

La tecnología de ElevenLabs aprovecha arquitecturas avanzadas de redes neuronales y técnicas de modelos de lenguaje grandes para generar voz que interpreta el contexto textual, ajustando el ritmo y la entonación para transmitir emociones como ira, tristeza, felicidad o alarma. Los modelos de la empresa se entrenan con vastos conjuntos de datos para comprender el sentimiento, lo que permite una inflexión más humana. Este enfoque difiere de los sistemas tradicionales de texto a voz al centrarse en el matiz emocional y la conciencia contextual, lo que lo hace aplicable en medios, entretenimiento, accesibilidad y agentes interactivos. Los productos de la startup son accesibles a través de una plataforma web y API, lo que permite a desarrolladores y creadores integrar la IA de voz en sus flujos de trabajo.

Etimología del nombre

El nombre ElevenLabs deriva de la palabra inglesa "eleven", que se refiere al 11 de noviembre, el Día de la Independencia Nacional de Polonia (el undécimo día del undécimo mes). Esta elección refleja la herencia polaca de los fundadores, que crecieron en Polonia. El elemento "Labs" es la abreviatura de "laboratorios", lo que indica el perfil de investigación y desarrollo de la empresa. El nombre combina así un símbolo nacional con un guiño a la innovación científica, señalando el deseo de los fundadores de crear una empresa impulsada por la investigación con raíces europeas.

Historia

ElevenLabs fue cofundada en 2022 por Piotr Dąbkowski, ex ingeniero de aprendizaje automático en Google DeepMind, y Mateusz Staniszewski, ex estratega de despliegue en Palantir. Ambos empresarios se criaron en Polonia, y la inspiración para fundar ElevenLabs supuestamente provino de ver películas estadounidenses mal dobladas, lo que despertó su interés en mejorar la calidad de la voz sintética. Inicialmente, exploraron varias vías de financiación, incluido el trabajo con una aceleradora de startups.

En enero de 2023, la empresa reveló una ronda pre-semilla de 2 millones de dólares liderada por Credo Ventures y con la participación de Concept Ventures, y la especialización de la startup en inteligencia de voz con IA - un campo emergente en Europa - atrajo el interés de los inversores. Ese mismo mes, ElevenLabs lanzó públicamente su plataforma beta, permitiendo a los usuarios generar voz realista a partir de texto.

En junio de 2023, ElevenLabs recaudó una ronda Serie A de 19 millones de dólares con una valoración de aproximadamente 100 millones de dólares. La ronda fue co-liderada por la firma de capital de riesgo Andreessen Horowitz, el ex CEO de GitHub Nat Friedman y el empresario Daniel Gross. Otros participantes incluyeron a SV Angel, el cofundador de Instagram Mike Krieger, el cofundador de Oculus Brendan Iribe, el cofundador de DeepMind Mustafa Suleyman y el fundador de O'Reilly Media Tim O'Reilly. Andreessen Horowitz también se unió a la junta directiva de ElevenLabs como parte de la inversión.

El 22 de enero de 2024, ElevenLabs anunció una ronda de financiación Serie B de 80 millones de dólares, elevando su valoración total a 1.1 mil millones de dólares. Liderada por Andreessen Horowitz, junto con Friedman, Gross y Sequoia Capital, la ronda respaldó la introducción de varios productos nuevos, incluidos Voice Marketplace, AI Dubbing Studio y una aplicación móvil. Este crecimiento coincidió con la expansión más amplia de AI21 Labs y otras startups de IA generativa, pero el enfoque de ElevenLabs en la voz lo distinguió.

En los días previos a las primarias demócratas de New Hampshire de enero de 2024, llamadas automáticas generadas por IA supuestamente de Joe Biden instaban a los votantes a no votar, y miles de residentes las recibieron. La oficina del fiscal general de New Hampshire lanzó una investigación, vinculando las llamadas a una empresa con sede en Texas, y los expertos en audio concluyeron que la llamada se realizó utilizando ElevenLabs. En respuesta, el CEO Mati Staniszewski declaró que la empresa estaba "dedicada a prevenir el mal uso de las herramientas de audio con IA", pero no proporcionó comentarios sobre incidentes específicos.

El 30 de enero de 2025, ElevenLabs anunció una ronda Serie C de 180 millones de dólares, elevando su valoración a 3.3 mil millones de dólares. Co-liderada por a16z e ICONIQ Growth, con nuevos inversores como NEA, World Innovation Lab (WiL), Valor, Endeavor Catalyst Fund y Lunate, la ronda también incluyó inversores estratégicos como Deutsche Telekom, LG Technology Ventures, HubSpot Ventures, NTT DOCOMO Ventures y RingCentral Ventures.

En septiembre de 2025, ElevenLabs abrió una oferta de recompra de acciones para empleados, permitiendo al personal con al menos un año de antigüedad vender acciones a una valoración de 6.6 mil millones de dólares, lo que refleja el crecimiento interno continuo. El 4 de febrero de 2026, la empresa recaudó 500 millones de dólares con una valoración de 11 mil millones de dólares, mientras contempla una posible oferta pública inicial (OPI). En marzo de 2026, ElevenLabs se comprometió a destinar 1 mil millones de dólares en tecnología gratuita de restauración de voz para 1 millón de personas que viven con pérdida permanente de voz, demostrando un enfoque en la accesibilidad.

Productos

ElevenLabs es conocida principalmente por su software de texto a voz asistido por IA basado en navegador, Speech Synthesis, que puede producir voz realista sintetizando emoción y entonación vocal. La empresa también ofrece Conversational AI, una plataforma para desarrolladores para lanzar agentes de voz interactivos que pueden participar en diálogos en tiempo real. Según la empresa, sus modelos están entrenados para interpretar el contexto en el texto, ajustando la entonación y el ritmo en consecuencia, utilizando algoritmos avanzados para detectar emociones como ira, tristeza, felicidad o alarma. Esta capacidad permite una inflexión más realista y humana, y la empresa está en proceso de patentar la tecnología. En su sitio beta, los usuarios pueden enviar texto y generar archivos de audio a partir de una selección de voces predeterminadas, mientras que los usuarios de pago pueden cargar muestras de voz personalizadas para crear nuevos estilos vocales utilizando su herramienta de clonación de voz.

Voice Library

Voice Library es una función para compartir perfiles de voz únicos creados con la tecnología Voice Design de ElevenLabs. Estos perfiles de voz prediseñados permiten a los usuarios seleccionar una voz que se adapte a sus necesidades sin crear una desde cero. La biblioteca contiene más de 1,000 voces creadas por la comunidad. Otra herramienta, VoiceLab, permite a los usuarios clonar voces a partir de solo unos pocos fragmentos cortos de audio y puede crear voces sintéticas completamente nuevas, ampliando las opciones de personalización.

AI Speech Classifier

El 20 de junio de 2023, ElevenLabs lanzó una herramienta de reconocimiento de IA llamada AI Speech Classifier, que afirma ser la primera de su tipo. La herramienta es accesible a través de una API y está diseñada para determinar si una muestra de audio cargada se origina en la tecnología de IA propietaria de ElevenLabs. La empresa ha expresado su intención de colaborar con otros desarrolladores de IA para crear un sistema de detección universal que podría adoptarse en toda la industria, abordando las preocupaciones sobre el mal uso de la voz sintética.

Projects

En julio de 2023, ElevenLabs anunció "Projects", una herramienta para crear contenido hablado de formato largo como audiolibros y segmentos de diálogo con voces sintéticas o personalizadas conscientes del contexto. La herramienta se lanzó en septiembre, y en agosto la empresa amplió sus capacidades de generación de voz a 28 idiomas. Utilizando un modelo de IA interno, detecta automáticamente idiomas como coreano, neerlandés y vietnamita, lo que permite una generación de voz multilingüe "emocionalmente rica". Además, la empresa anunció que su tecnología había salido oficialmente de su fase beta, marcando un hito en su madurez.

AI Dubbing y productos de voz

En octubre de 2023, ElevenLabs presentó "AI Dubbing", una herramienta que puede traducir voz a más de 20 idiomas. La función preserva la voz original del hablante, las emociones y la entonación al emplear métodos propietarios para manejar tareas como eliminación de ruido, diferenciación de hablantes, transcripción y sincronización de la voz traducida con el audio original. En mayo de 2024, ElevenLabs compartió muestras de su modelo de texto a música, que estuvo disponible para uso público en julio de 2025, expandiéndose más allá de la voz hacia la generación de música. Esta diversificación se alinea con las tendencias más amplias en IA generativa donde empresas como OpenAI y Anthropic están empujando límites, pero ElevenLabs sigue centrada en aplicaciones centradas en la voz.

Tecnología y enfoque de IA

La síntesis de voz de ElevenLabs se basa en modelos de aprendizaje profundo, incluidas arquitecturas transformadoras y mecanismos de atención de múltiples cabezas, que permiten al sistema ponderar diferentes partes del texto de entrada de manera distinta, capturando contexto y señales emocionales. El uso de codificación posicional ayuda al modelo a comprender la secuencia de palabras, mientras que técnicas similares a muestreo top-k y escalado de temperatura pueden influir en la variabilidad de la voz generada. Los procesos de entrenamiento de la empresa probablemente implican aumento de datos y funciones de pérdida optimizadas para la naturalidad, aunque los detalles específicos siguen siendo propietarios. El énfasis en la emoción distingue a ElevenLabs de los sistemas anteriores de texto a voz, que a menudo sonaban robóticos y carecían de entonación.

El trabajo de la empresa se enmarca en el campo más amplio de la inteligencia artificial y el aprendizaje automático, contribuyendo a los avances en la interacción humano-computadora. A partir de 2026, ElevenLabs se posiciona como líder en IA de voz, con aplicaciones que van desde la narración de audiolibros hasta la accesibilidad para personas con discapacidades del habla. Su compromiso de proporcionar tecnología gratuita de restauración de voz a 1 millón de personas subraya el potencial impacto social de dicha tecnología.

Cronología de financiación y valoración

La historia de financiación de ElevenLabs refleja un crecimiento rápido en el sector de la IA. Después de una pre-semilla de 2 millones de dólares en enero de 2023, la empresa aseguró 19 millones de dólares en una Serie A con una valoración de 100 millones de dólares en junio de 2023. La Serie B de 80 millones de dólares en enero de 2024 triplicó la valoración a 1.1 mil millones de dólares. La Serie C de 180 millones de dólares en enero de 2025 la aumentó a 3.3 mil millones de dólares. Para septiembre de 2025, una oferta de recompra de acciones para empleados valoró la empresa en 6.6 mil millones de dólares, y la recaudación de 500 millones de dólares en febrero de 2026 la llevó a 11 mil millones de dólares, lo que indica expectativas de expansión continua y posible OPI. Esta trayectoria refleja el auge más amplio de las startups de IA generativa, impulsado por avances en tecnologías de modelos de lenguaje grandes y aprendizaje profundo.

Recepción e impacto

ElevenLabs ha atraído una atención significativa por su síntesis de voz realista, pero también ha enfrentado escrutinio por su mal uso. El incidente de las llamadas automáticas en New Hampshire destacó los riesgos asociados con la clonación de voz con IA, provocando discusiones sobre regulación y detección. La empresa ha respondido desarrollando herramientas como el AI Speech Classifier y comprometiéndose con prácticas éticas, como se ve en su compromiso de restauración de voz. Críticos y partidarios por igual reconocen el potencial transformador de la tecnología de ElevenLabs, desde el doblaje en entornos de nube Amazon Web Services hasta la integración con plataformas como TomTom para navegación, aunque las asociaciones específicas no siempre se divulgan.

Véase también

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:artificial-intelligence·generative-ai·speech-synthesis·startup
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial