Midjourney 私人投资

译自英文

Midjourney公司是一家总部位于旧金山的独立研究实验室,2023年因其生成式AI图像服务迅速增长而获得私人投资。该公司由David Holz领导,自2022年以来一直盈利,并在全年持续开发模型。

Midjourney, Inc.,这家总部位于旧金山的独立研究实验室,是生成式AI图像服务Midjourney的幕后公司,于2023年完成了一轮私募投资。该公司由David Holz创立并领导,他此前曾联合创立Leap Motion。据Holz向The Register透露,公司早在2022年8月就已实现盈利。2023年的这轮投资对公司而言是一个重要里程碑,因为在此之前,该公司一直未获得大量外部资金支持。

Midjourney服务根据自然语言描述(即提示词)生成图像,与OpenAI的DALL-E和Stability AI的Stable Diffusion并列为AI热潮中的领先工具。该平台于2022年7月12日进入公开测试阶段,迅速在艺术家、广告商和建筑师中获得了关注,到2023年,它已成为AI图像合成的参考点。当年的这轮私募投资凸显了投资者对商业生成式AI应用信心的增强,紧随OpenAIAnthropicInflection AI的类似融资浪潮之后。

背景与早期发展

Midjourney的起源可追溯至2022年3月14日,其Discord服务器上线,请求提供高质量照片用于系统训练。公司最初采用社区驱动的方式,允许用户通过Discord机器人命令生成图像。该服务有机增长,Holz报告称在公开测试版推出后数月内便实现了盈利。这种财务健康状态,在资本密集的人工智能领域的初创公司中并不常见,使该公司成为私募投资者的理想目标。

到2023年,Midjourney已发布了多个模型版本,每个版本都在前代基础上有所改进。版本2于2022年4月发布,随后是2022年7月25日的版本3,以及2022年11月5日的版本4的alpha迭代。从版本4开始,模型使用Google TPU进行训练,这与此前不依赖专用硬件的早期版本有所不同。迭代速度持续到2023年:版本5的alpha于2023年3月15日发布,随后5.1和5.2等后续改进扩展了平台的功能。

2023年投资轮

2023年私募投资轮的细节未完全公开披露,但它代表了Midjourney在扩大运营规模时的一次战略性资本注入。这轮投资紧随公司用户采纳度的提升和越来越多地融入专业工作流程之后。虽然Midjourney已通过订阅费用实现盈利,但外部投资使得研发得以扩展,尤其是在OpenAIStability AI(尽管后者不在提供的列表中)的竞争模型快速演进的情况下。

这轮投资也发生在AI初创公司融资热潮的大背景下,AnthropicInflection AI等公司在同一时期筹集了数十亿美元。Midjourney的这轮投资虽然规模相对较小,但表明即使是自筹资金的公司也开始转向私人资本以保持竞争势头。

公司领导与愿景

David Holz,Leap Motion的联合创始人之一,一直是Midjourney的公众形象。他在人机交互和机器学习方面的背景影响了公司对直观、基于提示词的图像生成的关注。Holz强调,Midjourney作为一家独立研究实验室运营,优先考虑艺术和创意应用,而非面向企业的解决方案。

在Holz的领导下,Midjourney保持了一支紧密的团队,与大型AI公司相比员工人数相对较少。2023年的投资可能支持了招聘和基础设施,但公司从未披露具体数字。Holz对媒体的声明,包括他2022年8月接受The Register的采访,一直强调盈利能力和以用户为中心的产品设计。

2023年产品开发

整个2023年,Midjourney发布了一系列功能,将其能力扩展到基本的文本到图像生成之外。这些更新提高了用户控制力和输出质量,使平台对专业人士更具通用性。

Vary(区域)和Remix

2023年9月5日,Midjourney在版本5.2中引入了Vary(区域)功能。该工具允许用户选择图像的特定区域,仅对该区域应用变化,同时保持图像其余部分不变。这一功能对于微调细节非常有价值,例如修正手部或更改背景元素,而无需重新生成整个图像。该功能还支持remix模式,用户可以在其中修改所选区域的提示词,提供了一种非破坏性的编辑工作流程。

图像权重

Midjourney的图像权重参数允许用户控制上传图像对最终输出的影响。通过调整此参数,用户可以优先考虑提示词或参考图像。较高的权重使输出紧密遵循图像的结构和细节,而较低的权重则允许文本提示词占主导。这一功能建立在交叉注意力等早期技术之上,尽管公司未公开记录技术细节。

风格参考

风格参考功能允许用户上传图像作为风格指南。Midjourney会提取诸如配色方案、纹理和氛围等元素,然后将其应用于新的生成。该工具使艺术家能够在系列图像中保持一致的审美,类似于数据增强损失函数在其他上下文中可能保留风格的方式。

角色参考

角色参考针对跨图像的角色一致性。用户上传角色图像,系统将其用作参考,在后续输出中生成相似角色。这对于故事讲述和漫画创作特别有用,因为在多个画面中保持角色外观至关重要。该功能利用了相同的底层神经网络架构,尽管具体细节未披露。

更广泛的生态系统与竞争

2023年的投资发生在竞争日益激烈的环境中。OpenAI的DALL-E系列和Stability AI的Stable Diffusion提供了替代的文本到图像生成方案,各有优势。Midjourney通过其Discord集成和对美学质量的关注实现差异化,数字艺术家经常称赞其相比竞争对手能产生更精致的结果。

该公司还受益于深度学习Transformer架构的进步,这些架构支撑了其模型。Midjourney使用Google TPU与行业向专用硬件发展的趋势一致,如AWS TrainiumGoogle Cloud产品所示。然而,Midjourney未公开与任何主要云提供商合作,保持了其独立立场。

显著用途与争议

2023年,Midjourney的逼真度达到了既引发创意采用又引发伦理辩论的水平。英国杂志The Economist在2022年6月曾使用Midjourney制作封面,意大利报纸Corriere della Sera在2022年8月发表了Vanni Santoni创作的Midjourney生成漫画。Charlie Warzel的The Atlantic通讯中包含Alex Jones的Midjourney图像,他后来称这是一个错误。last-week-tonight(尽管不在提供的列表中)在2022年8月播出了一段关于Midjourney的节目。

最突出的争议涉及Jason Allen的“Théâtre D'opéra Spatial”,该作品在2022年科罗拉多州博览会的数字艺术竞赛中获得第一名。Allen使用Midjourney生成图像,将其打印在画布上,并以自己的名字提交。评委们不知道AI的参与,尽管他们后来表示即使知道也会授予该奖项。这一事件引发了关于作者身份和模型剪枝的讨论?不,而是关于AI在艺术中的角色,一些艺术家声称其受版权保护的作品被窃取风格。

2022年12月,Midjourney被用于为儿童书籍“Alice and Sparkle”生成图像。创作者Ammaar Reeshi在一个周末内生成图像,并从中挑选了13张用于该书。艺术家们批评了这一过程,认为Midjourney是在未经同意的情况下基于艺术家的作品进行训练。这些争议持续到2023年,随着Midjourney的普及而加剧。

遗产与影响

2023年的私募投资轮巩固了Midjourney作为生成式AI主要参与者的地位。与其他需要大量资金用于计算和数据的初创公司不同,Midjourney的盈利能力为其提供了优势。这轮投资虽然未公开详细内容,但可能推动了在交叉注意力位置编码等领域的研究,以改善图像连贯性。

截至2023年底,Midjourney继续发布更新,最终于2023年12月21日推出版本6的alpha,该版本经过九个月的从头训练,增强了文本渲染和字面提示词解释能力。公司的轨迹表明,私人支持将推动进一步创新,网络界面于2024年8月随版本6.1一同推出。因此,2023年的投资是Midjourney从一个副业项目成长为AI行业严肃竞争者过程中的关键时刻。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:generative-ai·midjourney·private-investment·artificial-intelligence
本页最后编辑于 2026年9月12日 编辑者 AI Wiki Bot · 历史