Udio est un modèle d'intelligence artificielle générative qui produit de la musique à partir de simples invites textuelles, capable de générer à la fois des voix et de l'instrumentation. Développé par Uncharted Labs, une startup fondée en décembre 2023, le service utilise des techniques de IA générative pour créer des chansons originales à partir de descriptions d'utilisateurs. Sa version bêta gratuite a été publiée publiquement le 10 avril 2024, permettant aux utilisateurs de générer jusqu'à 600 chansons par mois sans frais. La plateforme propose des abonnements pour des fonctionnalités avancées telles que l'audio inpainting, qui permet de modifier des parties spécifiques d'une piste générée.
Le service est issu d'une équipe d'anciens chercheurs de Google DeepMind, le positionnant dans la vague plus large des outils créatifs d'intelligence artificielle qui inclut également des concurrents de texte à musique comme Suno et Stable Audio. Le lancement d'Udio a suscité une attention considérable pour sa synthèse vocale réaliste, tout en soulevant des questions sur les implications éthiques et juridiques de l'entraînement de modèles d'IA sur de la musique protégée par le droit d'auteur.
Historique
Udio a été créé en décembre 2023 par une équipe de quatre anciens chercheurs de Google DeepMind, dont le PDG David Ding, Conor Durkan, Charlie Nash et Yaroslav Ganin, ainsi qu'Andrew Sanchez, opérant sous le nom d'Uncharted Labs. La société de capital-risque Andreessen Horowitz a fourni un soutien financier, tout comme le distributeur de musique UnitedMasters, les musiciens will.i.am, Tay Keith et Common, l'investisseur Kevin Wall, le cofondateur d'Instagram Mike Krieger et le chercheur de DeepMind Oriol Vinyals. L'entreprise a levé 8,5 millions de dollars en financement initial et a été valorisée à 10 millions de dollars en financement d'amorçage.
Après plusieurs mois en phase bêta fermée, Udio a été publié publiquement le 10 avril 2024. Sanchez a décrit l'objectif comme permettant aux musiciens de créer de la grande musique et de gagner de l'argent avec cette musique à l'avenir. La sortie a suivi d'autres générateurs de texte à musique comme Suno et Stable Audio, marquant une période concurrentielle dans la génération musicale par IA.
Udio a gagné une attention virale lorsqu'il a été utilisé pour créer « BBL Drizzy » par Willonius Hatcher, une chanson parodique qui a circulé largement pendant la querelle entre Drake et Kendrick Lamar, accumulant plus de 23 millions de vues sur Twitter et 3,3 millions de streams sur SoundCloud au cours de sa première semaine. En août 2024, « Verknallt in einen Talahon » (Amoureux d'un Talahon), une chanson générée avec Udio par le producteur autrichien Butterbro, est devenue la première chanson générée par IA à atteindre le Top 50 allemand.
Capacités
Udio base les chansons qu'il crée sur des invites textuelles, qui peuvent spécifier le genre (y compris quatuor de barbiers, country, classique, hip hop, pop allemande et hard rock), les paroles, la direction de l'histoire et d'autres artistes sur lesquels baser le son. Le processus de génération sous-jacent, en date d'avril 2024, n'avait pas été divulgué. Le programme génère deux chansons basées sur les invites, et les utilisateurs peuvent remixer leurs chansons avec d'autres invites textuelles. Les chansons sont initialement générées comme des morceaux d'environ 30 secondes et peuvent être étendues par incréments supplémentaires de 30 secondes. Les abonnés payants peuvent accéder à des fonctionnalités avancées telles que l'audio inpainting, qui permet des modifications ciblées dans une piste.
Le service s'appuie sur des modèles de apprentissage profond, impliquant probablement des architectures de réseaux neuronaux similaires à celles utilisées dans d'autres systèmes d'IA générative. La capacité à produire des voix réalistes suggère l'utilisation de modèles sophistiqués basés sur transformeurs, bien que l'entreprise n'ait pas publiquement détaillé son approche technique. L'interface utilisateur met l'accent sur la simplicité, la rendant accessible aux personnes sans ou avec une capacité musicale minimale.
Réception
Les critiques ont offert des évaluations mitigées de la production d'Udio. Mark Hachman de PC World a comparé Udio aux générateurs d'art par IA et a loué sa capacité à transformer « quelques paroles plutôt médiocres » en une chanson « plutôt accrocheuse », qualifiant les voix d'« incroyablement réalistes et même émotionnelles ». Sabrina Ortiz de ZDNET a décrit les chansons générées comme « impressionnantes » et semblant avoir été produites professionnellement, notant qu'elles étaient « plus complètes et plus riches » que celles d'autres générateurs de texte à musique. Ryan Morrison de Tom's Guide a écrit qu'Udio avait « une capacité étrange à capturer l'émotion dans les voix synthétiques » et était le seul générateur de musique par IA à capturer la passion, la douleur et l'esprit d'une performance vocale.
Brian Hiatt de Rolling Stone a écrit qu'Udio était « plus personnalisable mais aussi peut-être moins intuitif à utiliser » que Suno, ajoutant que certains premiers utilisateurs suggéraient que la production d'Udio pouvait sembler plus nette. Cependant, Benj Edwards d'Ars Technica a trouvé la capacité de génération d'Udio imparfaite et « moins impressionnante » que celle de Suno, notant que ses chansons étaient considérablement plus courtes et les qualifiant de « à moitié cuites et presque cauchemardesques ». En réponse à l'annonce de la bêta sur Twitter, le membre de Telefon Tel Aviv, Joshua Eustis, a qualifié Udio d'« application pour remplacer les musiciens » et a remis en question les données qu'il utilisait. Udio a également été critiqué en ligne comme « sans âme » et pour son potentiel à créer des deepfakes audio. Lucas Ropek de Gizmodo a déclaré qu'Udio était « plein de non-sens acoustique » et que ses chansons étaient « extraordinairement mauvaises ».
Préoccupations concernant le droit d'auteur
Les critiques ont remis en question les données utilisées pour entraîner Udio et si elles consistaient en musique protégée par le droit d'auteur. Rolling Stone a écrit qu'il y avait « des raisons substantielles de croire » qu'Udio et Suno avaient tous deux été entraînés avec de la musique protégée par le droit d'auteur, tandis que Benj Edwards d'Ars Technica a écrit que ses données d'entraînement étaient « probablement remplies de matériel protégé par le droit d'auteur ». Udio ne recrée pas directement des chansons protégées par le droit d'auteur si on le lui demande. Ding a déclaré qu'Udio avait « des filtres de droit d'auteur automatisés étendus » et que l'entreprise affinait continuellement ses mesures de protection. Stability AI a adopté une approche différente avec Stable Audio 2.0, utilisant un ensemble de données explicitement licencié appelé AudioSparx.
En juin 2024, une poursuite judiciaire menée par la Recording Industry Association of America a été déposée contre Udio et Suno, alléguant une violation généralisée des enregistrements sonores protégés par le droit d'auteur. La poursuite cherchait à interdire aux entreprises de s'entraîner sur de la musique protégée par le droit d'auteur et exigeait des dommages-intérêts allant jusqu'à 150 000 dollars par œuvre pour les violations déjà commises.
En octobre 2025, une poursuite en droit d'auteur de Universal Music Group a été réglée avec des accords de licence. Udio a accepté de lancer une plateforme entraînée uniquement avec de la musique « autorisée et licenciée ». L'entreprise a ensuite annoncé que les utilisateurs existants auraient 48 heures pour télécharger leurs créations avant de passer à un nouveau modèle commercial basé sur le streaming.