译自英文

Udio是一项生成式人工智能音乐创作服务,能够根据文本提示生成歌曲。它由前谷歌DeepMind研究人员于2023年12月创立,并于2024年4月推出免费测试版,同时因其训练数据面临版权诉讼。

Udio 是一种生成式人工智能模型,能够根据简单的文本提示创作音乐,并能生成人声和乐器伴奏。该服务由 Uncharted Labs 开发,这是一家成立于 2023 年 12 月的初创公司,它利用生成式人工智能技术,根据用户的描述创作原创歌曲。其免费测试版于 2024 年 4 月 10 日公开发布,允许用户每月免费生成多达 600 首歌曲。该平台还提供订阅层级,以使用高级功能,例如音频修复,该功能允许用户修改生成曲目中的特定部分。

该服务由一群前谷歌深度思维研究人员组成的团队打造,将其置于更广泛的人工智能创意工具浪潮之中,该浪潮还包括 Suno 和 Stable Audio 等文本转音乐竞争对手。Udio 的发布因其逼真的人声合成而备受关注,同时也引发了关于在受版权保护的音乐上训练 AI 模型的伦理和法律影响的质疑。

历史

Udio 于 2023 年 12 月由四位前谷歌深度思维研究人员(包括 CEO David Ding、Conor Durkan、Charlie Nash 和 Yaroslav Ganin)以及 Andrew Sanchez 共同创立,以 Uncharted Labs 的名义运营。风险投资公司 Andreessen Horowitz 提供了资金支持,音乐发行商 UnitedMasters、音乐人 will.i.am、Tay Keith 和 Common、投资人 Kevin Wall、Instagram 联合创始人 Mike Krieger 以及深度思维研究员 Oriol Vinyals 也提供了支持。该公司在初始融资中筹集了 850 万美元,并在种子融资中估值达到 1000 万美元。

在经历了数月的封闭测试阶段后,Udio 于 2024 年 4 月 10 日公开发布。Sanchez 将目标描述为让音乐家能够创作出伟大的音乐,并在未来从这些音乐中获利。此次发布紧随 Suno 和 Stable Audio 等其他文本转音乐生成器之后,标志着 AI 音乐生成领域的一个竞争时期。

Udio 因被用于创作 Willonius Hatcher 的恶搞歌曲“BBL Drizzy”而迅速走红,这首歌在 Drake 与 Kendrick Lamar 的不和期间被广泛传播,在发布的第一周内,在 Twitter 上获得了超过 2300 万次观看,在 SoundCloud 上获得了 330 万次播放。2024 年 8 月,由奥地利制作人 Butterbro 使用 Udio 生成的歌曲“Verknallt in einen Talahon”(爱上 Talahon)成为第一首进入德国 Top 50 榜单的 AI 生成歌曲。

功能

Udio 根据文本提示创作歌曲,提示可以指定音乐类型(包括理发店四重唱、乡村、古典、嘻哈、德语流行和硬摇滚)、歌词、故事方向,以及可以模仿的其他艺术家。截至 2024 年 4 月,其底层生成过程尚未公开。该程序会根据提示生成两首歌曲,用户可以通过进一步的文本提示对其歌曲进行混音。歌曲最初生成为约 30 秒的片段,并且可以以 30 秒为增量进行扩展。付费订阅者可以使用高级功能,例如音频修复,该功能允许对曲目内的特定部分进行针对性编辑。

该服务利用深度学习模型,可能涉及与其他生成式 AI 系统使用的神经网络架构类似的架构。其生成逼真人声的能力表明其使用了复杂的基于Transformer的模型,尽管该公司尚未公开其技术方法的细节。用户界面强调简洁性,使没有或只有极少音乐能力的人也能使用。

评价

评论家对 Udio 的输出评价不一。PC World 的 Mark Hachman 将 Udio 与 AI 艺术生成器进行比较,并称赞它能将“一些相当糟糕的歌词”变成一首“相当朗朗上口”的歌曲,称其歌声“极其逼真,甚至富有情感”。ZDNET 的 Sabrina Ortiz 称生成的歌曲“令人印象深刻”,听起来像是专业制作的,并指出它们比其他文本转音乐生成器的歌曲“更饱满、更丰富”。Tom's Guide 的 Ryan Morrison 写道,Udio 具有“在合成人声中捕捉情感的不可思议的能力”,并且是唯一能够捕捉到声乐表演中的激情、痛苦和精神的 AI 音乐生成器。

Rolling Stone 的 Brian Hiatt 写道,Udio 比 Suno “更可定制,但可能也不太直观”,并补充说一些早期用户认为 Udio 的输出可能听起来更清晰。然而,Ars Technica 的 Benj Edwards 认为 Udio 的生成能力不完美,且“不如 Suno 令人印象深刻”,他指出其歌曲明显更短,并称其“半生不熟,几乎像噩梦一样”。在 Twitter 上回应测试版公告时,Telefon Tel Aviv 成员 Joshua Eustis 称 Udio 是“一个取代音乐家的应用”,并质疑其使用的数据。Udio 也因其“缺乏灵魂”以及可能制造音频深度伪造而受到在线批评。Gizmodo 的 Lucas Ropek 表示,Udio “充满了听觉上的胡言乱语”,其歌曲“糟糕透顶”。

版权问题

评论家质疑 Udio 使用了哪些数据进行训练,以及这些数据是否包含受版权保护的音乐。Rolling Stone 写道,有“充分理由相信”Udio 和 Suno 都使用了受版权保护的音乐进行训练,而 Ars Technica 的 Benj Edwards 写道,其训练数据“很可能充满了受版权保护的材料”。Udio 在被提示时不会直接重现受版权保护的歌曲。Ding 表示,Udio 拥有“广泛的自动版权过滤器”,并且公司正在不断改进其安全措施。Stability AI 在 Stable Audio 2.0 中采取了不同的方法,使用了明确许可的数据集 AudioSparx。

2024 年 6 月,由美国唱片业协会牵头的一起诉讼针对 Udio 和 Suno 提起,指控其广泛侵犯受版权保护的音乐录音。该诉讼旨在禁止这些公司使用受版权保护的音乐进行训练,并要求对已经发生的侵权行为支付每部作品最高 15 万美元的赔偿。

2025 年 10 月,来自环球音乐集团的版权诉讼通过许可协议得到解决。Udio 同意启动一个仅使用“授权和许可音乐”进行训练的平台。随后,该公司宣布,现有用户将有 48 小时的时间下载他们的创作,然后过渡到新的基于流媒体的商业模式。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:generative-ai·music-technology·artificial-intelligence·startup
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史