Black Forest Labs(BFL)是一家德国人工智能公司,总部位于德国弗赖堡,专注于图像和视频生成的生成式人工智能。该公司由前Stability AI员工于2024年创立,开发Flux系列文生图和图生图模型,这些模型能够根据自然语言提示生成图像并支持编辑功能。BFL将自己定位为研究实验室,同时通过API及与主要科技公司的合作提供开源和专有模型。
该公司源自慕尼黑大学(LMU Munich)的学术研究,其创始人在那里为Stable Diffusion的开发做出了贡献。Black Forest Labs吸引了大量风险投资和战略投资,其模型已集成到Grok、Le Chat和Adobe Photoshop等平台中。到2026年,该公司扩展到视频生成和机器人领域,反映了其推进多模态人工智能的雄心。
创立与融资
Black Forest Labs于2024年由Robin Rombach、Andreas Blattmann和Patrick Esser以及另外七位联合创始人创立。这三位主要创始人此前曾在慕尼黑大学师从Björn Ommer担任研究助理,研究人工智能图像生成,并于2022年4月发表了研究成果,促成了Stable Diffusion的诞生。他们后来加入Stability AI,之后离开创立了BFL。
该公司获得了3100万美元的初始投资,投资者包括风险投资公司Andreessen Horowitz、Brendan Iribe、Michael Ovitz、Garry Tan和Vladlen Koltun。到2025年底,投资者兴趣激增,AMP、Salesforce Ventures、Samsung、Adobe、Deutsche Telekom和Canva提供了4.5亿美元的投资。BFL随后注册为特拉华州公司,投资者也成为客户,可将该人工智能用于产品图像、广告、品牌设计、电子商务以及集成到Adobe Photoshop等工具中。
根据2026年6月《福布斯》的一篇文章,该公司拥有70名员工,仍被视为初创企业,与资金更雄厚的硅谷公司竞争。2026年8月,DLF报道称BFL拥有100名员工,其中三十人已在旧金山,另有三十人即将加入。尽管公司发展迅速,但其强调自身作为研究实验室的身份。在采访中,创始人拒绝透露其训练数据来源、数据中心或可持续发展目标,其透明度中心也未披露数据来源。
开发与合作伙伴关系
2024年8月,Flux被集成到Elon Musk的Grok聊天机器人中(由xAI开发),作为X(原Twitter)上的高级功能提供。四个月后,即2024年12月,Grok切换到了自己的文生图模型Aurora。2024年11月18日,Mistral AI宣布其Le Chat聊天机器人已将Flux Pro集成作为其图像生成模型。
2024年11月21日,BFL宣布发布Flux.1 Tools,这是一套旨在与现有Flux模型配合使用的编辑工具。这些工具包括用于内绘和外绘的Flux.1 Fill、用于基于提取深度图进行控制的Flux.1 Depth、用于基于提取Canny边缘进行控制的Flux.1 Canny,以及用于混合输入图像和提示的Flux.1 Redux。每个工具均提供Pro和Dev两种模型。
2025年1月,BFL宣布与Nvidia合作,将Flux模型作为Nvidia Blackwell微架构的基础模型。该公司还发布了Flux Pro Finetuning API用于定制和微调,并与德国媒体公司Hubert Burda Media合作进行内容创作。
2025年5月29日,BFL发布了Flux.1 Kontext,这是一套支持上下文图像生成和编辑的模型,允许用户同时使用文本和图像进行提示。与此同时,BFL Playground(一个用于测试Flux模型的界面)也发布了。2025年7月31日,BFL发布了Flux.1 Krea Dev,这是一个与Krea AI合作开发的模型,具有更好的性能、多样的美学风格和更高的真实感。
2025年9月,Adobe宣布Photoshop(测试版)用户可以使用Flux.1 Kontext Pro作为其生成填充工具的模型。BFL还与Meta合作开发了视频生成应用Vibes。2025年11月25日,BFL发布了Flux.2模型系列,包括Pro、Flex、Dev和采用Apache 2.0许可的Klein模型,以及以Apache 2.0开源软件形式发布的Flux.2变分自编码器。该系列声称在图像参考、照片真实感、排版和提示理解方面有所改进。
模型架构与许可证
Flux是一系列基于整流流变换器块(缩放至120亿参数)的文生图模型。这些模型使用Transformer (architecture)架构,这不同于早期基于U-Net的扩散模型方法。Flux.1模型根据不同的许可证发布:Schnell(德语意为“快速”)作为Apache许可证下的开源软件,Dev作为非商业许可证下的源代码可用软件(商业许可证可从BFL获得),Pro作为仅通过API提供的专有软件。无论使用哪种模型,用户都保留生成输出的所有权。
改进的旗舰模型Flux 1.1 Pro于2024年10月2日发布。11月6日新增了两种模式:Ultra,以四倍更高的分辨率生成图像,最高可达4百万像素,且不影响速度;Raw,以抓拍风格生成超逼真图像。
Flux.1 Kontext是一个具有上下文图像生成和编辑能力的系列,提供Max、Pro和Dev模型。Max是最高质量的模型,可以使用提示迭代修改现有图像,而Pro则平衡了质量和速度。Dev是一个非商业许可证下的开放权重模型,类似于Flux.1 Dev。
Flux.2模型基于潜在流匹配架构,使用Mistral AI的Mistral-3模型(240亿参数)作为其视觉语言模型。与Flux.1一样,Flux.2模型根据不同的许可证发布:Klein作为Apache许可证下的开源软件,Dev作为非商业许可证下的源代码可用软件,Flex和Pro作为专有API。
这些模型可以通过生成式人工智能用户界面在线或本地使用,例如ComfyUI、Recraft Studio和Stable Diffusion WebUI Forge(Automatic1111 WebUI的一个分支)。
视频生成与机器人技术
2026年7月,BFL发布了FLUX.3,一个文生视频模型,包括与mimic robotics合作开发的FLUX3 x mimic。FLUX3 x mimic是一个运行在机器人上的视频动作模型,在奥迪汽车生产设施中执行“软体操控工作”。这标志着BFL从静态图像扩展到视频和具身人工智能应用。
评价
根据Ars Technica在2024年进行的测试,Flux.1 Dev和Flux.1 Pro生成的输出在质量和保真度方面与DALL-E 3相当。这些模型因其开源可用性和高性能而受到关注,使BFL成为Generative AI领域的重要参与者。
2026年6月,电影导演Martin Scorsese加入BFL担任顾问,这引发了创意专业人士和艺术总监协会的抵制,反映了关于人工智能在创意产业中作用的持续争论。该公司的快速增长以及与主要科技公司的合作凸显了其影响力,而其训练数据的不透明性则招致了透明度倡导者的批评。
参见
参考文献
本文基于截至2026年的公开信息和公司公告。