Anthropic于2025年5月发布了Claude 4,作为其Claude系列大语言模型的第四代产品。该模型引入了混合推理架构,将快速、直观的响应与深思熟虑、逐步推理相结合,使其能够处理数学、编程和长文档分析等复杂任务。Claude 4拥有100万token的上下文窗口,能够一次性处理整本书籍或大型代码库。此次发布还标志着Claude Code的全面可用,这是一款代理型命令行工具,可通过自然语言提示委派编码任务,该工具自2025年2月起一直处于预览阶段。
Claude 4基于Transformer架构构建,这是现代AI系统主导的神经网络设计。它采用Anthropic开发的基于宪法的训练方法进行训练,以提高伦理和法律合规性,并运用基于AI反馈的强化学习和课程学习等技术来优化其行为。该模型提供多种尺寸,,Haiku、Sonnet和Opus,,沿用Claude 3确立的命名惯例,其中Opus能力最强,Haiku最弱。
混合推理架构
Claude 4的混合推理设计使其能够根据任务在快速、直观的响应与扩展的逐步推理之间切换。这种方法与OpenAI和Google DeepMind等其他前沿模型中的推理能力相似,但Anthropic强调,Claude 4可以根据查询的复杂性动态分配计算资源。对于简单问题,模型会快速响应;对于复杂问题,它可以进行更长的思维链,从而提高高级数学和多步编码等任务的准确性。
该模型还改进了多头注意力和位置编码,帮助其在长序列中保持连贯性。100万token的上下文窗口是相较之前版本的重大升级,允许用户输入整个代码库、冗长的法律文件或多章节书籍。这一能力对软件开发尤为有用,Claude可以在单次会话中分析和修改大型代码库。
Claude Code与代理型工具
Claude Code与Claude 4一同作为全面可用产品发布,是一款基于终端的代理型工具,让开发者可以通过自然语言委派编码任务。它可以读写文件、执行命令,并在单次对话中串联多步操作。Anthropic报告称,截至2025年7月,Claude Code的收入增长了5.5倍,主要受企业采用推动。该工具已被微软和谷歌等大型公司使用,OpenAI员工也一直使用至2025年8月,当时Anthropic以违反服务条款为由撤销了OpenAI的API访问权限。
2025年10月,Anthropic推出了Claude Code的网页版和沙盒功能。该工具在2025-2026年冬季假期期间广受关注,许多非程序员使用它进行“氛围编码”,,即用户用通俗语言描述期望结果,让AI生成代码。截至2025年8月,Anthropic报告称,网络犯罪分子已利用Claude Code进行数据勒索活动;2025年11月,一个中国背景的组织使用它自动化了针对30个组织的80-90%的间谍攻击。
API与计算机使用
Claude 4也可通过API访问,允许开发者将模型集成到自己的应用中。2024年10月,Anthropic推出了“计算机使用”功能,使应用能够调用Claude API,通过解释屏幕内容并模拟键盘和鼠标输入来控制计算机。这一能力是构建可导航软件界面的自主代理的基础。
API支持一系列控制生成的参数,包括温度缩放、top-p采样和top-k采样,让开发者能够精细控制输出的随机性和多样性。这些功能是现代生成式AI平台的标准配置,但Anthropic已针对混合推理模型进行了优化。
Claude for Chrome与Cowork
2025年8月,Anthropic发布了Claude for Chrome,这是一款浏览器扩展,让Claude可以代表用户浏览网站、点击和填写表单。它最初作为1000名Max订阅者的试点推出,并于2026年8月全面可用。Anthropic报告称,在采取缓解措施后,提示注入攻击的成功率为11.2%。
Claude Cowork于2026年1月作为研究预览发布,是一款面向非技术用户的图形用户界面工具。它为Claude提供对沙盒shell和用户选定文件夹的访问权限,使模型能够读取、写入和编辑文件、执行代码并串联多步任务。《华尔街日报》的一名记者指出,用户对授予AI代理个人计算机广泛访问权限表示担忧;一位早期用户报告称,Cowork删除了他妻子桌面上的所有家庭照片,需要从iCloud备份中恢复。2026年2月,Anthropic宣布更广泛的企业发布,并集成Google Drive、Gmail、Docusign和FactSet连接器;2026年3月新增了Dispatch功能,允许用户从手机向计算机发送任务。
安全与保障
Claude 4包含多项安全功能,包括基于宪法的训练方法,旨在减少有害输出。Anthropic还实施了模型剪枝和其他效率技术,以在保持性能的同时降低计算成本。该公司因Claude在网络攻击中的使用而受到审查,如2025年8月和11月所报道,并已采取措施减轻滥用,例如撤销违反服务条款实体的API访问权限。
2026年2月,美国国防部将Anthropic指定为“供应链风险”,联邦机构被命令逐步淘汰Claude,因为该公司拒绝移除禁止将Claude用于大规模国内监控和完全自主武器的合同条款。2026年3月,一名联邦法官阻止了该指定,并于2026年8月以违宪报复为由永久撤销。
反响与影响
Claude 4受到开发者和企业的广泛好评,许多人称赞其长上下文处理和推理能力。该模型的混合架构为效率设立了新基准,使其在某些任务上能够匹配或超越OpenAI和Google DeepMind等竞争对手的更大模型。根据Ramp的卡片支出数据,2026年2月,其平台上为Anthropic产品付费的企业比例上升了4.9个百分点,达到24.4%,这是Ramp记录中该公司最大的月度增幅。
此次发布还加速了代理型AI工具的采用,Claude Code和Cowork在程序员和非程序员中都很受欢迎。然而,正如《福布斯》在2025年9月和BBC在2026年7月所报道,共享Claude聊天在搜索结果中的泛滥引发了隐私担忧。BBC统计了200多个被索引的聊天记录,其中一些包含健康记录和企业文件,技术分析表明,robots.txt规则阻止了爬虫读取noindex指令。Anthropic表示这些列表已被移除。
未来发展
Anthropic在Claude 4发布后继续迭代Claude系列。2026年,一款名为Claude Mythos的附加模型发布给少数公司和组织,随后向公众发布了Claude Fable,这是具有更严格保障措施的版本。2026年3月,Claude Code命令行界面的源代码被泄露,揭示了多个即将推出的功能和模型。2026年5月,Anthropic推出了“Dreaming”,这是其Managed Agents API的研究预览功能,用于整合代理在会话之间的持久记忆。
截至2026年,Claude 4仍是Anthropic产品线中的基础模型,安全、效率和能力方面持续改进。该公司对代理型工具和混合推理的关注,使其在竞争激烈的人工智能领域与OpenAI、Google DeepMind及其他研究机构并列为重要参与者。