Synthesia是一家总部位于英国伦敦的英国跨国人工智能公司。它专注于合成媒体生成软件,包括人工智能驱动的视频创作、数字虚拟人和文本转语音工具。该公司的平台允许用户从文本生成逼真的视频,使用预构建的人工智能演示者或自定义虚拟人来模仿人类语音和面部表情。Synthesia被企业广泛采用,用于员工培训、营销和客户服务应用。
技术与特性
Synthesia的核心技术利用深度学习架构来创建逼真的视频内容。该平台结合了机器学习和计算机视觉技术,将语音模式和面部动作映射到数字虚拟人上。用户可以用超过140种语言和口音创建视频,并提供性别特定语音选项。该系统还支持语音克隆,允许用户生成自己声音的合成版本。2025年,Synthesia推出了“富有表现力的虚拟人”,能够传达情感和自然手势,增强了生成内容的真实感。
该公司的软件基于神经网络模型,特别是变换器架构,这些架构能够高效处理文本和音频输入。Synthesia的平台与各种大型语言模型API集成,以提高文本转语音的准确性和上下文理解能力。该公司还开发了专有的数据增强技术,以提高模型鲁棒性并减少生成内容中的偏见。
历史与融资
Synthesia于2017年由Lourdes Agapito、Matthias Niessner、Victor Riparbelli和Steffen Tjerrild共同创立。该公司最初专注于娱乐应用,但在销售困难后扩展到企业解决方案。2020年,Synthesia的用户群包括亚马逊、蒂芙尼和洲际酒店集团等大型企业。该公司在2019年筹集了310万美元的种子资金,随后在2021年4月进行了1250万美元的A轮融资,并在2021年12月进行了5000万美元的B轮融资。
2023年6月,Synthesia在由Accel和Nvidia领投的C轮融资中筹集了9000万美元,估值达到10亿美元。该公司持续增长,在2025年1月由NEA领投的D轮融资中筹集了1.8亿美元,参与者包括World Innovation Lab、Atlassian Ventures和PSP Growth。这一轮融资使Synthesia的估值翻倍至21亿美元。2025年4月,Adobe投资了1000万英镑用于战略合作,但Synthesia拒绝了Adobe提出的30亿美元收购要约,以保持独立。到2025年10月,由GV领投的E轮融资筹集了2亿美元,使Synthesia的估值达到40亿美元。
应用与使用场景
Synthesia的平台被超过60%的财富100强公司和70%的富时100指数公司用于各种应用。常见的使用场景包括本地化沟通、员工入职、培训视频、广告活动、产品演示和客户服务。该公司的人工智能虚拟人可用于创建个性化消息,例如与乐事合作的梅西消息活动,该活动在2021年获得了戛纳金狮铜奖。Synthesia的技术还被用于配音和翻译服务,使企业能够高效地本地化视频内容。
2025年,Synthesia推出了交互式视听虚拟人“代理”,能够就各种主题进行对话,专为自动化销售培训和企业沟通而设计。该公司还与瑞士银行瑞银合作,为面向客户的内容创建金融专家的人工智能虚拟人。截至2026年,Synthesia继续扩展其产品线,专注于提高虚拟人真实感和扩大语言支持。
伦理考量与安全
Synthesia已实施严格准则以防止其技术被滥用。该平台禁止创建未经同意的克隆,包括名人或政治人物的克隆,并要求使用个人肖像时必须获得明确同意。该公司改进了其滥用检测系统,并雇佣人工审核员来审查内容。尽管采取了这些措施,仍有政府使用Synthesia工具创建假新闻视频的情况,促使该公司加强其筛选流程。Synthesia对伦理人工智能的承诺体现在其与人工智能伙伴关系等组织的合作,以及参与关于深度伪造监管的行业讨论中。