Anthropicは2025年5月に、Claudeシリーズの第4世代としてClaude 4をリリースした。このモデルは、高速で直感的な応答と、意図的で段階的な推論を組み合わせたハイブリッド推論アーキテクチャを導入し、数学、コーディング、長文書分析などの複雑なタスクを処理できるようにした。Claude 4は100万トークンのコンテキストウィンドウを備え、書籍全体や大規模なコードベースを1回の処理で読み込むことができる。このリリースはまた、2025年2月からプレビュー版として提供されていた、自然言語プロンプトを介してコーディングタスクを委任するためのエージェント型コマンドラインツールであるClaude Codeの一般提供開始も示した。
Claude 4は、現代のAIシステムにおける支配的なニューラルネットワーク設計であるトランスフォーマーアーキテクチャに基づいている。これは、Anthropicが開発した憲法に基づくアプローチを用いて訓練され、倫理的および法的なコンプライアンスを向上させ、AIフィードバックからの強化学習やカリキュラム学習などの技術を採用してその動作を洗練させている。このモデルは、Claude 3で確立された命名規則に従い、Haiku、Sonnet、Opusの複数のサイズで利用可能であり、Opusが最も高性能でHaikuが最も低性能である。
ハイブリッド推論アーキテクチャ
Claude 4のハイブリッド推論設計により、タスクに応じて高速で直感的な応答と、拡張された段階的な推論を切り替えることができる。このアプローチは、OpenAIやGoogle DeepMindなどの他のフロンティアモデルで見られる推論能力に似ているが、AnthropicはClaude 4がクエリの複雑さに基づいて計算リソースを動的に割り当てられることを強調している。単純な質問にはモデルは迅速に応答し、複雑な問題にはより長い思考連鎖に関与して、高度な数学や多段階のコーディングなどのタスクでの精度を向上させる。
このモデルはまた、マルチヘッドアテンションと位置エンコーディングの改善を組み込んでおり、長いシーケンスにわたって一貫性を維持するのに役立つ。100万トークンのコンテキストウィンドウは、以前のバージョンからの大幅なアップグレードであり、ユーザーがコードリポジトリ全体、長い法的文書、または複数章の書籍を入力できるようにする。この機能は、Claudeが1回のセッションで大規模なコードベースを分析および修正できるソフトウェア開発に特に役立つ。
Claude Codeとエージェント型ツール
Claude 4と同時に一般提供製品としてリリースされたClaude Codeは、開発者が自然言語を使用してコーディングタスクを委任できるターミナルベースのエージェント型ツールである。これは、ファイルの読み書き、コマンドの実行、単一の会話内での多段階操作の連鎖ができる。Anthropicは、企業での採用により、2025年7月までにClaude Codeの収益が5.5倍に増加したと報告した。このツールは、MicrosoftやGoogleを含む主要企業で使用され、OpenAIの従業員も2025年8月まで使用していたが、Anthropicが利用規約違反を理由にOpenAIのAPIアクセスを撤回した。
2025年10月、AnthropicはClaude Codeのウェブ版とサンドボックス機能を立ち上げた。このツールは、2025年から2026年の冬休み期間中に、多くの非プログラマーが「バイブコーディング」、つまりユーザーが望む結果を平易な言語で説明し、AIにコード生成を任せる手法に使用したことで広く注目を集めた。2025年8月までに、Anthropicはサイバー犯罪者がデータ恐喝キャンペーンでClaude Codeを使用したと報告し、2025年11月には中国拠点のグループがこれを使用して30の組織に対するスパイ攻撃の80〜90%を自動化した。
APIとコンピューター使用
Claude 4はAPIを介してもアクセス可能であり、開発者はモデルを独自のアプリケーションに統合できる。2024年10月、Anthropicは「コンピューター使用」機能を導入し、アプリケーションがClaude APIを呼び出して、画面コンテンツを解釈し、キーボードとマウスの入力をシミュレートすることでコンピューターを制御できるようにした。この機能は、ソフトウェアインターフェースをナビゲートできる自律エージェントを構築するための基盤である。
APIは、生成を制御するためのさまざまなパラメーターをサポートしており、温度スケーリング、トップpサンプリング、トップkサンプリングを含み、開発者に出力のランダム性と多様性に対する細かい制御を提供する。これらの機能は現代の生成AIプラットフォームでは標準的であるが、Anthropicはハイブリッド推論モデル用に最適化している。
Claude for ChromeとCowork
2025年8月、AnthropicはClaude for Chromeをリリースした。これは、Claudeがユーザーに代わってウェブサイトを閲覧し、クリックし、フォームを入力できるようにするブラウザー拡張機能である。これは1,000人のMaxサブスクライバー向けのパイロットとして開始され、2026年8月に一般提供された。Anthropicは、プロンプトインジェクション攻撃が緩和後も11.2%の確率で成功したと報告した。
2026年1月に研究プレビューとしてリリースされたClaude Coworkは、非技術系ユーザーを対象としたグラフィカルユーザーインターフェースツールである。これは、Claudeにサンドボックス化されたシェルとユーザーが選択したフォルダーへのアクセスを提供し、モデルがファイルの読み取り、書き込み、編集、コードの実行、多段階タスクの連鎖を可能にする。ウォールストリートジャーナルの記者は、AIエージェントに個人のコンピューターへの広範なアクセスを許可することに対するユーザーの懸念を指摘し、初期のユーザーはCoworkが妻のデスクトップからすべての家族写真を削除し、iCloudバックアップからの復元が必要になったと報告した。2026年2月、AnthropicはGoogle Drive、Gmail、Docusign、FactSet用のコネクターを備えたより広範なエンタープライズリリースを発表し、2026年3月にはユーザーが電話からコンピューターにタスクを送信できるDispatchを追加した。
セキュリティと安全性
Claude 4は、有害な出力を減らすことを目的とした憲法に基づく訓練アプローチを含む、いくつかの安全機能を組み込んでいる。Anthropicはまた、パフォーマンスを維持しながら計算コストを削減するために、モデルプルーニングやその他の効率化技術を実装している。同社は、2025年8月と11月に報告されたサイバー攻撃でのClaudeの使用について scrutin されており、利用規約に違反するエンティティのAPIアクセスを撤回するなど、悪用を軽減するための措置を講じている。
2026年2月、米国国防総省はAnthropicを「サプライチェーンリスク」に指定し、連邦機関は、同社が大量の国内監視と完全自律型兵器へのClaudeの使用に関する契約上の禁止事項を撤去することを拒否した後、Claudeの段階的廃止を命じられた。連邦判事は2026年3月にこの指定を阻止し、2026年8月に違憲の報復として恒久的に無効とした。
評価と影響
Claude 4は開発者や企業から好評を得ており、多くの人がその長いコンテキスト処理と推論能力を賞賛した。このモデルのハイブリッドアーキテクチャは効率性の新しい基準を設定し、特定のタスクでOpenAIやGoogle DeepMindなどの競合他社のより大きなモデルのパフォーマンスに匹敵するか、それを上回ることを可能にした。Rampのカード支出データによると、2026年2月にAnthropic製品に支払っているプラットフォーム上の企業の割合は4.9ポイント上昇して24.4%となり、Rampが同社について記録した最大の月間増加となった。
このリリースはまた、エージェント型AIツールの採用を加速させ、Claude CodeとCoworkはプログラマーと非プログラマーの両方の間で人気となった。しかし、2025年9月のForbesと2026年7月のBBCによって報告されたように、検索結果での共有されたClaudeチャットの普及はプライバシーの懸念を引き起こした。BBCは200以上のインデックス化されたチャットを数え、その一部には健康記録や企業文書が含まれており、技術分析はrobots.txtルールがクローラーがnoindexディレクティブを読むのをブロックしていることを示唆した。Anthropicはリストが削除されたと述べた。
将来の開発
AnthropicはClaude 4の立ち上げ後もClaudeシリーズの反復を続けた。2026年には、Claude Mythosという追加モデルが少数の企業や組織にリリースされ、その後、より厳格な安全策を備えたバージョンであるClaude Fableが一般公開された。2026年3月、Claude Codeコマンドラインインターフェースのソースコードが漏洩し、複数の今後の機能とモデルが明らかになった。2026年5月、AnthropicはManaged Agents APIの研究プレビュー機能である「Dreaming」を導入し、セッション間でエージェントの永続メモリを統合する。
2026年現在、Claude 4はAnthropicのラインナップにおける基盤モデルであり続け、安全性、効率性、能力の継続的な改善が行われている。同社のエージェント型ツールとハイブリッド推論への焦点は、OpenAI、Google DeepMind、その他の研究機関と並んで、競争の激しい人工知能の状況における主要プレーヤーとしての地位を確立している。