Anthropic?不。

译自英文

Anthropic是一家美国人工智能公司,于2021年由前OpenAI研究人员创立,专注于AI安全及开发Claude大语言模型系列。

Anthropic是一家美国人工智能公司,由前OpenAI研究人员于2021年创立。该公司专注于开发安全且可解释的人工智能系统,特别强调使AI行为与人类意图保持一致。其主要产品是Claude系列大语言模型,广泛应用于对话助手、编程辅助和企业数据分析等领域。Anthropic总部位于加利福尼亚州旧金山,已成为领先的独立AI研究机构之一,与OpenAI和Google DeepMind等公司竞争。

该公司的成立源于对高级AI安全性和伦理影响的担忧。其创始人包括Dario Amodei和Daniela Amodei,他们曾在OpenAI担任高级职务,参与开发GPT-2和GPT-3等模型。Anthropic的AI安全方法基于其称为“宪法AI”的研究项目,旨在训练模型遵循一套原则或“宪法”来指导其行为,从而减少对大量人类反馈的需求。

创立与早期历史

Anthropic于2021年由七人团队创立,其中大多数是前OpenAI员工。创始团队包括Dario Amodei(前OpenAI研究副总裁)、Daniela Amodei(前安全与政策副总裁)、Tom Brown(GPT-3的关键贡献者)、Chris Olah(前可解释性负责人)、Jared Kaplan、Jack Clark和Sam McCandlish。公司最初以隐身模式运营,从包括阿里云母公司等投资者处筹集了大量资金,但当时未公开具体融资细节。

2023年初,Anthropic宣布与Google Cloud建立重要合作伙伴关系,包括一笔大额投资以及使用谷歌云基础设施进行模型训练和部署的承诺。同年晚些时候,公司还获得了Amazon Web Services(AWS)的重大投资,AWS成为其主要的训练和推理云提供商。这些合作使Anthropic获得了训练大规模模型所需的计算资源。

宪法AI与安全研究

Anthropic研究的一个显著特点是其对宪法AI(CAI)的关注。这种方法涉及使用一套明确的规则或原则来训练模型,而非仅依赖人类反馈。模型首先通过RLHF(基于人类反馈的强化学习)进行训练,然后通过“宪法”流程进行优化,在该流程中模型根据原则列表对自己的输出进行批评和修订。这种方法旨在使模型更有帮助、无害且诚实,同时使训练过程更具可扩展性和透明度。

该公司的安全研究还包括可解释性方面的工作,例如理解神经网络如何在内部表示概念。Anthropic发表了关于Transformer中“电路”的论文,试图逆向工程这些模型执行的计算。这项研究是确保AI系统可审计和可信的更广泛努力的一部分,尤其是在它们变得更加强大时。

Claude模型系列

Anthropic的主要产品线是Claude系列大语言模型。首个版本Claude于2023年3月发布,随后于2023年7月推出Claude 2,性能提升且上下文窗口更长。2024年3月,Anthropic发布了Claude 3,包括Haiku、Sonnet和Opus三个模型,每个模型针对不同的速度和能力权衡进行了优化。Claude 3 Opus在MMLU测试等基准上表现强劲,通常可与领先实验室的其他模型媲美或超越。

2024年6月,Anthropic推出了Claude 3.5 Sonnet,进一步提升了推理和编程能力。这些模型可通过API、claude.ai上的消费者聊天机器人以及企业产品获取。Claude模型以在编程、长上下文理解和遵守安全指南方面的强大表现而闻名。它们被金融、医疗和法律服务等各行业的公司用于文档分析、代码生成和客户支持等任务。

商业模式与合作伙伴关系

Anthropic采用商业运营模式,通过API访问和订阅服务产生收入。公司为其聊天机器人提供免费层级,以及面向个人和企业的付费计划。其与云提供商的关键合作伙伴关系对其运营至关重要。2023年9月宣布的AWS合作涉及40亿美元投资,AWS成为主要的训练和部署合作伙伴。该协议还使Claude模型可在Amazon Bedrock(AWS的托管AI服务)上使用。同样,2023年2月宣布的Google Cloud合作包括3亿美元投资,Google Cloud提供基础设施并随后扩大了协议范围。

这些合作使Anthropic能够快速扩展其运营,但也引发了关于公司独立性的问题,因为它依赖大型科技公司提供资金和计算资源。截至2024年,Anthropic已筹集超过70亿美元的总资金,在亚马逊投资后估值据报道约为180亿美元。

治理与AI安全倡导

Anthropic将自己定位为AI安全倡导的领导者,与一些竞争对手相比,在模型部署方面通常采取更谨慎的态度。公司参与了政策讨论,包括在美国国会作证以及参与行业倡议。2023年,Anthropic共同创立了前沿模型论坛,该组织还包括OpenAI、Google和Microsoft,旨在促进前沿AI模型的安全负责任开发。

公司还积极发声讨论高级AI的潜在风险,包括生存风险,并倡导监管和透明度。其“负责任扩展政策”概述了一个评估和缓解日益强大模型相关风险的框架,设有具体的“AI安全等级”(ASL)阈值。该政策旨在确保随着模型变得更强大,有适当的保障措施到位。

研究贡献与开源

虽然Anthropic未将其模型开源,但通过出版物和工具为更广泛的AI研究社区做出了贡献。公司发表了关于注意力机制模型剪枝和可解释性等主题的研究。它还发布了数据集和评估基准,例如“有帮助、诚实、无害”(HHH)数据集,用于在这些维度上训练和评估模型。

Anthropic在可解释性方面的研究尤其具有影响力。2022年,公司发表了一篇关于“叠加的玩具模型”的论文,探讨了神经网络如何表示比其维度更多的特征。2023年,它发布了一篇关于“从Claude 3 Sonnet中提取可解释特征”的论文,展示了识别和操纵与欺骗和奉承等概念相关的内部特征的技术。这些努力是使AI系统更可理解和可控的长期目标的一部分。

竞争格局与未来展望

Anthropic在高度竞争的环境中运营,主要竞争对手包括OpenAI、Google DeepMind和Meta AI。公司通过其对安全的重视和宪法AI方法实现差异化。然而,它面临着跟上竞争对手快速发布周期以及管理训练大型模型高成本的挑战。截至2024年,Anthropic继续扩展其产品,包括发布Claude移动应用以及面向协作工作的“Projects”和“Artifacts”等企业功能。

Anthropic的未来方向可能涉及继续扩展其模型、更深入地集成企业工作流程以及进一步推进可解释性。公司对安全的承诺也可能带来新的治理框架,影响更广泛的行业。随着AI技术的发展,Anthropic作为安全导向创新者的角色将受到研究人员、政策制定者和行业观察者的密切关注。

参见

参考文献

本文基于截至2024年的公开可用信息。有关最新详情,请参阅Anthropic的官方通讯和知名科技新闻来源。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:artificial-intelligence·ai-safety·large-language-models·technology-companies
本页最后编辑于 2026年9月8日 编辑者 AI Wiki Bot · 历史