OpenAI是一家美国人工智能(AI)公益公司,总部位于旧金山。它开发专有的生成式AI模型,特别是其生成式预训练变换器(GPT)系列大型语言模型。其于2022年11月发布的ChatGPT被认为催化了AI热潮;截至2026年9月,ChatGPT是全球访问量第五大的网站。OpenAI还发布了GPT Image模型和AI编码代理Codex。2026年3月,OpenAI完成了一轮融资,投后估值为8520亿美元,使其成为全球最有价值的AI纯业务公司之一,唯一可匹敌的是Anthropic。
OpenAI于2015年在特拉华州成立,最初为非营利组织,埃隆·马斯克和萨姆·奥尔特曼担任联合主席;马斯克于2018年辞职。2019年创建了一个营利性子公司,2025年的重组将该子公司转变为OpenAI Group PBC,其中非营利组织OpenAI Foundation持有26%的股份。微软已向OpenAI投资超过130亿美元。OpenAI通过Stargate Project基础设施合资企业与美国政府合作,并与国防部、洛斯阿拉莫斯国家实验室以及武器公司Anduril Industries合作。前OpenAI员工创立了竞争性AI公司,包括Anthropic、Safe Superintelligence Inc.、SpaceXAI和Thinking Machines Lab。2026年6月,它提交了首次公开募股申请。
2024年产品发布
2024年,OpenAI发布了多款主要产品,塑造了当年的AI格局。最突出的是GPT-4o,这是一个于2024年5月宣布的多模态模型。GPT-4o实时接受并生成文本、音频和图像,响应时间与人类对话相当。它向免费和付费ChatGPT用户开放,标志着向高级AI更广泛可及性的转变。该模型的架构基于Transformer (architecture)框架,使用Multi-Head Attention机制处理混合输入。
2024年晚些时候,OpenAI推出了o1系列,这是一组推理模型,旨在响应前花费更多时间思考。o1模型使用类似于Chain-of-thought提示的技术,内部生成中间推理步骤以解决数学、编码和科学中的复杂问题。OpenAI报告称,o1在具有挑战性的基准任务上表现与博士生相当。该版本还附带o1-mini,这是一个针对编码任务优化的更小、更快的变体。
OpenAI还在2024年扩展了其开发者平台,提供GPT-4o的微调能力,并推出了Assistants API。这些工具允许第三方开发者在OpenAI模型之上构建自定义AI代理,并与Amazon Web Services和Microsoft Azure等服务集成以进行云部署。
研究与安全发展
OpenAI在2024年的研究重点是改进模型对齐和可解释性。该公司发表了关于基于AI反馈的强化学习(RLAIF)的工作,该方法使用AI生成的偏好来训练模型,减少对人类标注者的依赖。研究人员还探索了Model Pruning技术,以使模型更高效而不显著损失性能。
然而,2024年也是安全治理动荡的一年。大约一半的OpenAI AI安全研究人员在年内离职,理由是安全问题被降级。这一外流包括几位参与董事会2023年11月决定罢免萨姆·奥尔特曼CEO职务的高级人物。奥尔特曼在董事会重组五天后复职,但这些离职突显了商业加速与安全研究之间的内部紧张关系。
OpenAI于2024年5月成立了新的安全与安保委员会,由董事会成员和技术人员主持。该委员会的任务是评估和制定模型部署的安全协议。尽管有这些努力,外部批评者和前员工认为,相对于其快速发布节奏,OpenAI的安全文化已经削弱。
公司与财务里程碑
2024年,OpenAI的估值在巨额投资下继续攀升。微软保持其最大外部投资者的地位,累计投资超过130亿美元。OpenAI的计算需求通过与Microsoft Azure的合作满足,运行在基于Azure的超级计算平台上。该公司还开始多样化其云基础设施,探索与Oracle Cloud Infrastructure和其他提供商的选项,以减少对单一供应商的依赖。
OpenAI的收入模式扩展到ChatGPT订阅之外。该公司推出了企业产品,包括ChatGPT Enterprise和自定义模型API,这些成为重要的收入驱动力。到2024年底,据报道OpenAI的年化收入达到数十亿美元,尽管具体数字未公开披露。该公司还谈判了二级股票销售,到2024年10月估值超过1500亿美元,使其成为世界上最有价值的私营公司之一。
这一年还看到OpenAI加深了与美国政府的合作。Stargate Project是一个于2025年初宣布的基础设施合资企业,其基础工作于2024年奠定,OpenAI承诺与联邦机构合作建设新的数据中心。OpenAI还与国防部合作进行AI安全研究,此举引起了一些AI伦理研究者的关注。
竞争格局
2024年,OpenAI面临来自其他AI实验室的激烈竞争。Anthropic发布了Claude 3和Claude 3.5模型,这些模型被广泛认为是推理和安全方面的强劲对手。Google DeepMind推出了Gemini模型,并将其整合到Google的产品生态系统中。来自Meta和Mistral等组织的开源模型也获得了关注,挑战了OpenAI的专有优势。
作为回应,OpenAI强调其模型的多模态和推理能力。GPT-4o的实时语音交互被定位为差异化因素,而o1的深思熟虑推理吸引了法律、金融和研究领域的专业用户。OpenAI还投资于定制硅开发,据报道与Broadcom和TSMC合作设计AI加速器,以减少对Nvidia GPU的依赖并降低推理成本。
人才争夺战也加剧了。OpenAI的高知名度研究人员被竞争对手和初创公司挖走。前员工创立或加入了Safe Superintelligence Inc.和Thinking Machines Lab等企业,而成熟实验室提供丰厚待遇以吸引OpenAI员工。OpenAI通过留任奖金和股权计划进行反击,但安全团队的流失仍然是一个担忧。
技术创新
GPT-4o引入了多项优于早期GPT模型的架构改进。它使用统一的Neural network,通过共享编码器处理文本、音频和图像输入,而不是分离的流水线。这种设计减少了延迟并改善了跨模态理解。该模型使用监督学习和强化学习技术的组合进行训练,并应用Data Augmentation来扩展训练多样性。
o1系列代表了对标准自回归生成的偏离。o1模型不是直接预测下一个标记,而是生成内部推理轨迹,然后产生最终答案。这种方法有时被称为测试时计算扩展,允许模型为困难问题分配更多计算。OpenAI在推理期间使用Beam Search和Temperature Scaling来平衡探索和确定性。
OpenAI还在2024年改进了其对齐技术。该公司完善了对宪法AI类原则的使用,训练模型遵循明确规则并拒绝有害请求。Gradient Clipping和Layer Normalization被用于稳定超大型模型的训练,这些模型在内部实验中达到了数万亿参数。
法律与伦理挑战
OpenAI在2024年面临多起诉讼。作者和媒体公司,包括《纽约时报》,提出版权侵权诉讼,指控OpenAI未经许可在受版权保护的文本上训练其模型。OpenAI辩称其使用公开数据构成合理使用,但截至年底这些案件仍未解决。该公司还面临与其聊天机器人有害输出相关的诉讼,原告声称ChatGPT提供了导致伤害或死亡的危险建议。
全球监管审查加剧。欧盟的AI法案于2024年最终确定,对通用AI模型施加了新的透明度和安全要求。OpenAI通过发布模型文档和实施风险评估来努力合规。在美国,联邦贸易委员会和其他机构调查了OpenAI的数据实践和商业伙伴关系。
伦理辩论集中在生成式AI的社会影响上。批评者提出了对工作替代、错误信息和AI权力集中在少数公司中的担忧。OpenAI通过资助AI经济学研究并与MIT CSAIL和Stanford AI Lab等学术机构合作来回应这些问题。
未来展望
随着2024年结束,OpenAI表示其意图在应对商业压力的同时追求人工通用智能(AGI)。该公司的路线图包括更强大的推理模型、改进的多模态能力以及与企业工作流的更深层次整合。OpenAI还计划扩展其定制芯片工作,预计与TSMC和Broadcom合作于2026年生产。
2025年完成的OpenAI Group PBC重组旨在平衡利润激励与非营利使命。2026年6月的IPO申请将提供公开市场准入,但也会增加对其安全实践和治理的审查。OpenAI的轨迹继续受到AI社区、政策制定者和公众的密切关注,因为其模型继续塑造Generative AI格局。