Claude 2は、アメリカの企業Anthropicによって開発された大規模言語モデルであり、2023年7月に元のClaudeチャットボットの後継としてリリースされた。これは、OpenAIのChatGPTの成功に続くより広範な大規模言語モデルの波の一部であり、安全性と憲法AIに焦点を当てた競争者としてAnthropicを位置づけた。Claude 2は、ウェブインターフェースとAPIを通じてアクセス可能であり、開発者が様々なアプリケーションに統合できるようにした。このリリースでは、コーディング、数学、推論の改善とともに、より長いコンテキストウィンドウが強調され、より大きな文書の処理が可能になった。
Claude 2は、トランスフォーマーアーキテクチャに基づいて構築されており、これはほとんどの現代の生成AIシステムを支える深層学習フレームワークである。Anthropicは、憲法AIと呼ばれる技術を使用してモデルを訓練し、これはモデルの行動を倫理的および法的な遵守に向けて導くための一連の原則を使用する。このアプローチは、広範な人間のフィードバックなしに有害な出力を減らすことを目指すことで、Claude 2を競合他社と区別した。モデルは、Claude 2.0と後のClaude 2.1アップデートの2つのバージョンで提供され、後者では精度の向上と幻覚率の低減が導入された。
リリースと利用可能性
Claude 2は2023年7月11日に発表され、米国と英国で一般公開された。承認されたパートナーに限定されていた初期のClaude 1とは異なり、Claude 2はAnthropicのウェブサイトのチャットインターフェースを通じて一般ユーザーに開放された。APIアクセスも拡張され、入力1,000トークンあたり$0.008、出力1,000トークンあたり$0.024の価格設定で、OpenAIのGPT-4などの他のモデルと競争力を持たせた。このリリースは、NotionやQuoraなどの企業によるベータテスト期間に続くものであり、これらの企業はClaude 1を要約や質問応答タスクに使用していた。
技術的能力
Claude 2は、100,000トークンのコンテキストウィンドウを備えており、約75,000語の文書を1回のパスで処理することができた。これは、元のClaudeの9,000トークンの制限からの大幅な増加であり、長いレポートの要約や書籍全体の分析などのタスクを可能にした。モデルは、コーディングベンチマークでのパフォーマンス向上を示し、HumanEvalコーディングテストで71.2%のスコアを達成し、Claude 1.3の56.0%から上昇した。数学では、GSM8K小学校算数データセットで88.0%を達成し、以前のバージョンの85.2%と比較された。これらの向上は、トレーニングデータのキュレーションとファインチューニング手法の進歩に帰された。
安全性とアラインメメント
Anthropicは、Claude 2のコア機能として安全性を強調した。モデルは、有害な要求を拒否し、役立つ正直な応答を提供するように訓練された。内部評価では、Claude 2は、敵対的プロンプトのデータセットに基づいて、Claude 1.3と比べて2.3倍有害でない応答を生成する可能性が高いことが見いだされた。同社はまた、外部の専門家が安全対策を迂回しようとする「レッドチーム」テストプロセスも導入した。これらの努力にもかかわらず、研究者は、Claude 2が特定のシナナリオで操作される可能性があることを指摘し、AI安全性における継続的な課題を浮き彫りにした。行動を導くための原則のリストを使用する憲法的アプローチは、他のラボで使用されるRLHF(人間のフィードバックからの強化学習)の新規な代替案と見なされた。
受容と影響
Claude 2は、その文章品質と推論能力について肯定的なレビューを受け、一部のユーザーは、要約や創造的執筆などのタスクでOpenAIのGPT-4と好意的に比較した。しかし、安全制約のために無害な質問に答えることをしばしば拒否する過度に慎重であると批判された。このリリースは、大規模言語モデルの競争的景観に貢献し、Google DeepMindとOpenAIも同じ期間にアップデートをリリースした。Claude 2のローンチは、Anthropicが追加の資金調達とパートナーシップを確保するのに役立ち、2023年9月にAmazonからの40億ドルの投資を含み、これにはClaudeをAmazonのAWSプラットフォームに統合することも含まれた。モデルの成功は、2024年のClaude 3など、その後のバージョンの道を開き、Haiku、Sonnet、Opusのティアを導入した。
遺産
Claude 2は、Anthropicの技術の成熟を示し、研究プロトタイプから商業的に実行可能な製品へと移行した。安全性と長いコンテキスト処理への焦点は、その後のモデルに影響を与え、そのAPIは、OpenAIの代案を求める開発者にとっての標準となった。このリリースはまた、生成AIの倫理的含意、特にバアスと誤用に関する議論を引き起こした。2025年現在、Claude 2は新しいバージョンに大きく取って代わられているが、人工知能システムの進化における注目すべきマイルストーンであり続けている。