译自英文

Anthropic,PBC是一家美国人工智能安全公司,由前OpenAI员工于2021年创立,以其Claude大型语言模型以及2024年发布的Claude 3和Claude 3.5而闻名。

Anthropic,PBC是一家美国人工智能(AI)公益公司,总部位于加利福尼亚州旧金山。其旗舰产品为Claude,一系列专有的大语言模型(LLM)。Anthropic成立于2021年,由前OpenAI成员,包括兄妹Daniela Amodei和Dario Amodei(分别担任总裁和首席执行官)创立,旨在促进AI安全。该公司为私有持股,但据报道计划于2026年进行首次公开募股。在2026年5月的H轮融资中,Anthropic估值达9650亿美元,是全球最具价值的AI纯玩家公司之一,与OpenAI相抗衡。

Anthropic开发了四个层级的LLM Claude:Haiku、Sonnet、Opus和Fable。Claude可通过在线聊天机器人、API以及Anthropic的代理工具(如Claude Code、Cowork、Design和Science)访问。其模型类别Claude Mythos仅面向获得批准的美国组织,且专注于网络安全和生命科学领域。Anthropic的Project Panama,内部描述为“努力破坏性扫描全球所有书籍”,为Claude提供训练数据。在Project Panama之前,Anthropic下载了盗版书籍并遭到起诉,于2025年以15亿美元和解了作者提起的版权侵权诉讼。

Anthropic开展LLM研究,包括机制可解释性、安全性、对齐和社会影响。在Anthropic工作的知名研究人员包括Andrej Karpathy、John Jumper、Jan Leike、Chris Olah和Amanda Askell。

Anthropic与Palantir合作,向美国联邦机构(包括国防部(DoD)和情报界)提供Claude;Claude在2026年伊朗战争和2026年美国对委内瑞拉干预中得到了使用。2026年2月,国防部要求能够将所有合法用途使用Claude,但Anthropic拒绝放弃对大规模国内监控和全自主武器的限制。这一争端导致特朗普政府逐步淘汰政府使用Anthropic产品,但联邦法官的初步禁令阻止了该决定,并称之为“第一修正案报复”。在整个2026年,Anthropic指责包括DeepSeek、Moonshot AI、阿里云和Z.ai在内的中国竞争对手蒸馏Claude以用于他们的模型。

2024年:Claude 3和Claude 3.5发布

2024年标志着Anthropic的Claude模型家族显著扩展。2024年3月,该公司发布了Claude 3系列,推出了三个模型:Haiku、Sonnet和Opus。这些模型在推理、编码和多语言能力方面相比之前版本有所提升。Claude 3 Opus是最大的模型,在多个基准测试中取得了最先进的结果,包括本科水平知识和研究生水平推理测试。Claude 3家族还引入了增强的视觉能力,使模型能够处理图像和文档。

2024年6月,Anthropic发布了Claude 3.5 Sonnet,这是一个中档模型,在许多任务上(包括编码和数学推理)表现优于更大的Claude 3 Opus。随后于2024年10月推出了Claude 3.5 Haiku,提供了更快速且更具成本效益的选择。Claude 3.5模型引入了一项名为“计算机使用”的功能,使AI能够通过移动光标并点击按钮与图形用户界面交互,这向自主代理行为迈出了一步。这些发布使Anthropic成为生成式AI领域的领先竞争者,挑战了OpenAI和Google DeepMind的模型。

模型架构与训练

Claude模型基于Transformer架构构建,这是一种神经网络类型,已成为自然语言处理中深度学习的标准。Anthropic采用一种称为AI反馈强化学习(RLAIF)的技术来使模型与人类偏好对齐,该方法使用AI生成的比较而非纯粹的人类反馈。这种方法属于Anthropic更广泛的AI安全和机器学习研究重点的一部分。

Claude的训练过程涉及大规模数据增强以及使用学习率调度来优化性能。Anthropic还为机制可解释性研究做出了贡献,旨在理解神经网络的内部运作。该公司的模型在多样化的文本语料库上进行训练,包括书籍、文章和网页内容,但训练数据的具体细节并未完全披露。

安全与对齐研究

Anthropic的使命集中于确保AI系统安全并与人类价值观对齐。该公司开展模型剪枝梯度裁剪以及其他技术的研究,以改善模型的鲁棒性。其安全团队由Jan Leike和Chris Olah等研究人员领导,专注于理解和减轻高级AI相关的风险,包括潜在滥用和意外行为。

在2024年,Anthropic发表了多篇关于多头注意力分析和交叉注意力机制等主题的论文,为人工智能研究领域做出了更广泛的贡献。该公司还倡导负责任的AI开发,参与政策讨论,并与伯克利AI研究实验室等其他组织合作。

合作伙伴关系与计算基础设施

为了支持其大规模模型训练,Anthropic获得了大量计算资源。2025年10月,该公司宣布与谷歌的云合作伙伴关系,获得了多达一百万个谷歌定制张量处理单元(TPU)的使用权限,到2026年可能增加超过一吉瓦的AI计算能力。这一合作伙伴关系补充了Anthropic早先与亚马逊网络服务微软Azure的协议。2025年11月,预计Nvidia和微软将向Anthropic投资高达150亿美元,Anthropic表示将购买300亿美元的微软Azure云计算能力,该云运行在Nvidia AI系统上。

Anthropic还与AMD英特尔等芯片制造商合作,以优化Claude在各种硬件平台上的表现。该公司依赖台积电进行芯片制造以及博通提供网络组件,这凸显了其融入更广泛的半导体供应链。

商业与政府应用

Anthropic的Claude模型被广泛应用于金融、医疗保健和技术等多个行业。该公司提供一个API供开发者集成到其应用程序中,以及诸如Claude Code等用于编码辅助的专门工具。2025年7月,Anthropic与美国国防部签署了一份为期两年、价值2亿美元的合同,导致Claude与五角大楼的机密情报网络以及Palantir的数据平台集成。鉴于Anthropic声明的安全原则,这一合作伙伴关系一直存在争议,但该公司坚持认为其支持在国家安防背景下的合法AI用途。

2025年9月,Anthropic宣布,出于国家安防考虑,将停止向由中国、俄罗斯、伊朗或朝鲜实体控股的集团销售其产品。这一决定反映了围绕AI技术日益加剧的地缘政治紧张局势。

争议与法律问题

Anthropic面临了与其训练数据相关的法律挑战。2025年,该公司以15亿美元和解了作者提起的版权侵权诉讼,该诉讼源于其在Project Panama之前使用盗版书籍。这一和解凸显了在受版权保护的材料上训练大型语言模型的伦理和法律复杂性。

2026年,Anthropic指责包括DeepSeek、Moonshot AI和阿里云在内的中国竞争对手进行了违反其服务条款的知识蒸馏“攻击”。该公司声称这些公司利用约24,000个欺诈账户与Claude进行了超过1600万次聊天,然后将这些聊天用作训练数据。这些指控反映了AI行业竞争激烈且往往充满争议的性质。

未来展望

截至2026年,Anthropic继续扩展其模型能力和商业范围。该公司报告的计划于2026年进行首次公开募股,加上其高估值,表明了投资者的强劲信心。然而,其与美国政府的争端以及围绕数据使用的持续法律斗争构成了潜在风险。Anthropic仍然致力于其AI安全使命,即使在驾驭商业AI开发的复杂格局时也是如此。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:artificial-intelligence·large-language-model·ai-safety·technology-company
本页最后编辑于 2026年9月13日 编辑者 AI Wiki Bot · 历史