Claude 2 是由美国公司Anthropic开发的大型语言模型,于2023年7月发布,作为原始Claude聊天机器人的继任者。它是继OpenAI的ChatGPT成功之后更广泛大型语言模型浪潮的一部分,将Anthropic定位为专注于安全和宪法AI的竞争对手。Claude 2可通过网页界面和API访问,允许开发者将其集成到各种应用中。此次发布强调了在编码、数学和推理方面的改进,同时提供了更长的上下文窗口,以支持处理更大的文档。
Claude 2基于transformer架构构建,这是一种支撑大多数现代生成式AI系统的深度学习框架。Anthropic使用一种称为宪法AI的技术训练该模型,该技术利用一套原则引导模型行为符合道德和法律规范。这种方法使Claude 2与竞争对手区别开来,旨在无需大量人类反馈即可减少有害输出。该模型提供两个版本:Claude 2.0和后来的Claude 2.1更新,后者引入了准确性改进并降低了幻觉率。
发布与可用性
Claude 2于2023年7月11日宣布,并在美国和英国向公众开放。与早期仅限合作伙伴使用的Claude 1不同,Claude 2通过Anthropic网站上的聊天界面向普通用户开放。API访问范围也扩大,定价为输入每1000个令牌$0.008,输出每1000个令牌$0.024,使其能与OpenAI的GPT-4等模型竞争。此次发布是在与Notion和Quora等公司进行测试阶段后进行的,这些公司曾使用Claude 1进行摘要生成和问答任务。
技术能力
Claude 2具有100,000个令牌的上下文窗口,使其能够一次处理约75,000字的文档。这比原始Claude的90,000令牌限制显著提升,并使得诸如总结长篇报告或分析全书等任务成为可能。该模型在编码基准测试中表现出色,例如在HumanEval编码测试中得分达到71.2%,而Claude 1.2为56.0%。在数学方面,它在GSM8K小学数学数据集上达到88.0%的成绩,而早期版本为85.2%。这些提升归因于训练数据整理的进步和微调方法的发展。
安全与对齐
Anthropic强调安全性是Claude 2的核心功能。该模型被训练为拒绝映射请求并提供有益、诚实的响应。在内部评估中,Claude 2在攻击提示数据集上产生无害响应的可能性是Claude 1.3的2.3倍。该公司还引入了“红队”测试流程,由外部专家尝试绕过安全措施。尽管有这些努力,研究人员指出,Claude 2在某些场景下可能仍能被操纵,这凸显了AI安全领域的持久挑战。基于原则列表指导行为的宪法方法,被视为RLHF(基于人类反馈的强化学习)的新奇替代方案,后者被其他实验室广泛使用。
接受度与影响
Claude 2因出色的写作质量和推理能力而获得正面评价,部分用户认为在摘要和创意写作等任务中优于OpenAI的GPT-4。然而,它因过于谨慎而受到批评,常常由于安全约束而拒绝回答一些无害问题。这一发布加剧了大型语言模型领域的竞争格局,同期Google DeepMind和OpenAI也发布了更新。Claude 2的发布帮助Anthropic获得了更多资金和合作,包括2023年9月来自[[am</|]]的4亿美元投资,该投资亦涉及将Claude集成到Amazon的AWS平台中。该模型为后续版本(如2024年推出的Claude 2)奠定了基础,引入了Haiku、Sonnet和Opus等分层版本。
遗产
Claude 2标志着Anthropic技术的成熟,从研究原型转向商业化可行产品。其对安全性和长上下文处理的关注影响了后续模型,其API成为开发者寻求OpenAI替代品的标准。这一发布也引发了关于生成式AI伦理影响讨论,特别是围绕偏见和滥用问题。、截至2025年,Claude 2已被较新版本基本取代,但在目前,它在AI系统中的人工智能演变中仍然是一个里程碑。