Mistral AI是一家总部位于巴黎的公司,成立于2023年4月,由Arthur Mensch、Guillaume Lample和Timothee Lacroix三位研究者共同创立,他们此前曾在Google DeepMind和Meta AI从事大规模Large language model研究。公司从一开始就将自身定位为欧洲对美国实验室(如OpenAI和Anthropic)以及中国实验室(如DeepSeek)的制衡力量,并紧密关联于欧洲“AI主权”的论点,即欧洲大陆需要自身的前沿能力,而非完全依赖美国或中国的基础设施。
Mistral在成立后数周内筹集了欧洲科技史上规模最大的种子轮融资之一,后续轮次吸引了包括微软在内的投资者,微软于2024年作为更广泛的算力和分销合作伙伴关系的一部分入股少数股权,同时还有法国及其他欧洲投资者参与。
模型与产品
Mistral最初凭借Mistral 7B引起关注,该模型于2023年9月以宽松的开源许可发布,在多个AI benchmark测试套件上优于同尺寸的较大型同期模型。随后推出了Mixtral,这是一个稀疏Mixture of experts模型系列,每个令牌仅激活其参数的一小部分,这种设计选择相对于同等质量的完全密集模型提高了效率。Mistral已以Open-weights models许可发布了部分模型,特别是采用Apache 2.0许可的Mistral和Mixtral系列,同时将其更强大的Mistral Large模型保持为专有且仅限API访问,这种混合策略区别于完全封闭的实验室或完全开放的实验室(如Allen Institute for AI)。其面向消费者的助手Le Chat与ChatGPT及其他聊天产品竞争,公司还销售企业部署和Fine-tuning服务。
在AI治理辩论中的立场
Mistral的创始人在EU AI Act起草期间公开游说,认为对通用模型提供商施加严格义务可能使欧洲初创企业相对于资源更充足的美国和中国竞争对手处于不利地位。该公司的存在在欧洲政策讨论中经常被引用,作为该地区能够培养出具有竞争力的Foundation model开发者的证据,尽管批评者指出,Mistral仍依赖来自NVIDIA等供应商的非欧洲硬件计算集群来训练其最大模型。
反响
Mistral的开源发布受到开源研究社区的赞扬,因为它拓展了小型高效训练模型的能力边界,呼应了其他地方关于Scaling laws和训练效率的论点,类似于后来围绕DeepSeek-R1提出的主张。怀疑者质疑,一家资本远少于OpenAI、Anthropic或Google DeepMind的公司能否在能力前沿的最顶端保持步伐,而Mistral已日益强调企业和政府客户,包括欧洲公共部门部署,作为差异化市场,而非在最强模型称号上正面竞争。