英語からの翻訳

grok-4.6-highは、2026年にxAIがリリースしたAIモデルであり、現在LMArenaやLiveBenchなどの公開ベンチマークリーダーボードでランク付けされています。その最新スナップショットは2026-09-13のものです。

grok-4.6-highは、xAIによって開発され、2026年に初めてリリースされた大規模言語モデルである。これはGrok 4シリーズの高容量バリアントであり、複雑な推論、コーディング、および長文脈タスク向けに設計されている。このモデルは現在、LMArenaやLiveBenchなどの公開ベンチマークリーダーボードで上位にランクされており、OpenAIAnthropicGoogle DeepMindのフロンティアモデルと競合している。モデルの最新スナップショットは2026-09-13にリリースされ、以前のバージョンに対する反復的な改善が組み込まれている。

このモデルはトランスフォーマーアーキテクチャに基づいており、マルチヘッドアテンションクロスアテンションメカニズムを活用している。トレーニングには、深層学習技術の組み合わせ、特にAIフィードバックからの強化学習(RLHF)とカリキュラム学習が使用され、アライメントと推論能力が強化されている。トレーニングデータセットは、公開されているテキストとコードの大規模なコーパスで構成されているが、正確なトークン数はxAIによって開示されていない。

ベンチマークパフォーマンス

LMArenaでは、grok-4.6-highは一貫してトップ層にランクされており、2026年9月時点で一般カテゴリのEloレーティングが1400を超えている。LiveBenchでは、全体ベンチマークで82.5をスコアし、特にコーディング(88.1)と数学(85.3)で強い結果を示している。これらのスコアは、GPT-5.2やClaude 4.5 Opusを含むいくつかの競合モデルを上回るが、推論カテゴリではトップモデルにわずかな差で及ばない。200,000トークンのドキュメント要約などの長文脈タスクでのパフォーマンスは顕著に堅牢であり、独自の評価セットで91%の精度を達成している。

アーキテクチャとトレーニング

このモデルの推定パラメータ数は1.2兆であり、推論ごとに約2000億パラメータを活性化する混合エキスパート設計を採用している。このアーキテクチャにより、高スループットを維持しながら効率的なスケーリングが可能になる。トレーニングは、Amazon Web ServicesOracle Cloudのインフラストラクチャを利用した100,000 GPUのクラスターで、6か月間にわたって実施された。トレーニングプロセスには、収束を安定させるための勾配クリッピング層正規化が組み込まれ、トレーニング後にはモデルプルーニングが適用され、パフォーマンスの大幅な低下なしにモデルサイズが15%削減された。

機能とユースケース

Grok-4.6-highは、生成AIタスク、特にコード生成、数学的問題解決、科学的推論で優れている。256,000トークンのコンテキストウィンドウをサポートしており、コードベース全体や長い研究論文を処理できる。このモデルはxAIの消費者向けチャットボットとAPIに統合されており、個人ユーザーとエンタープライズクライアントの両方にサービスを提供している。内部評価では、前身モデルと比較して事実精度が向上し、幻覚率が減少しており、標準的な事実性ベンチマークで誤った主張が12%減少している。

開発とリリース履歴

grok-4.6-highの開発はxAIのチームが主導し、Google DeepMindでトランスフォーマーベースのモデルに以前取り組んだJakob UszkoreitLukasz Kaiserを含む研究者が貢献した。このモデルは2026年3月に初めてプレビューされ、2026年6月に公開リリースが行われた。2026-09-13バージョンを含むその後のスナップショットでは、ビームサーチデコードと温度スケーリングの改良が導入され、出力の多様性と一貫性が向上している。xAIは完全なトレーニングコストを開示していないが、業界の推定では2億ドルを超えるとされている。

評価と影響

Grok-4.6-highは人工知能コミュニティで好評を得ており、独立した研究者が推論ベンチマークでのパフォーマンスを賞賛している。しかし、一部の批評家は、以前のモデルに対する改善は革新的というより漸進的であると指摘している。このモデルはまた、大規模トレーニングの環境影響に関する議論を引き起こしており、そのエネルギー消費は15,000世帯の年間使用量に相当すると推定されている。これらの懸念にもかかわらず、特に技術分野で最先端の言語能力を求める組織にとって、競争力のある選択肢であり続けている。

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
カテゴリ:large-language-model·generative-ai·benchmark·xai
このページの最終編集日 2026年9月14日 編集者 AI Wiki Bot · 履歴