Grok 4.20 0309は、2025年初頭に公開LLMおよびメディアのリーダーボードに登場した大規模言語モデルのファミリーを指す名称である。この名称は既知の開発者とは関連付けられておらず、モデルは公式にリリースまたは文書化されていない。最新の入手可能な情報の時点では、匿名のアリーナエントリのままであり、その起源と技術仕様は未検証である。
「4.20 0309」という名称は、バージョン識別子と日付(3月9日)を示唆しているが、公式リリースは発表されていない。このモデルファミリーはベンチマークのスナップショットを通じてのみ知られており、3つの異なるバリアントが観測されている。これらのバリアントはパフォーマンス指標が異なるが、同じ基本名を共有しており、関連するモデルのファミリーを示している。
リーダーボードへの登場
Grok 4.20 0309は、2025年初頭にLMArena(旧Chatbot Arena)や様々なメディア運営のベンチマーク表を含む公開リーダーボードに初めて登場した。LMArenaでは、未リリースモデルのブラインドテストで一般的であるように、モデルは仮名の識別子でリストされた。3つのバリアントは、コミュニティの議論で「A」「B」「C」などの接尾辞でラベル付けされたが、これらのラベルは公式のものではない。
2025年2月のベンチマークスナップショットでは、バリアントは自然言語理解、推論、コード生成を含むタスクで競争力のあるパフォーマンスを示した。例えば、あるバリアントはMMLUベンチマークで上位10%にスコアを記録し、別のバリアントはコード合成のHumanEvalで優れていた。しかし、これらのスコアには公式文書が伴わず、正確な評価条件は不明のままである。
技術的特性
リーダーボードの挙動に基づき、Grok 4.20 0309は、ほとんどの現代のLLMと一致するTransformer (architecture)ベースのモデルであると推定される。バリアントはパラメータ数またはトレーニング構成が異なる可能性があるが、公式仕様は公開されていない。モデルは長文コンテキスト入力をサポートしているように見えるが、これは拡張推論を必要とするタスクでのパフォーマンスから推測されたものであり、確認されていない。
開発と帰属
モデル名「Grok」はxAIまたは類似の組織との関連を示唆するかもしれないが、開発者として責任を主張した者はいない。モデルは公式のモデルレジストリにリストされておらず、オープンソースライセンスもリリースされていない。帰属の欠如は、Stanford AI LabやBAIR (Berkeley AI Research)などの学術ラボからの研究プロトタイプである可能性を示唆する憶測を招いているが、これらは未確認の仮説である。
受容と影響
匿名の状態にもかかわらず、Grok 4.20 0309は、その強力なリーダーボードパフォーマンスによりMachine learningコミュニティで関心を集めている。一部の研究者は、その出力を使用してLLMの創発能力を研究しているが、透明性の欠如はより広範な採用を制限している。モデルは商業製品に統合されておらず、将来の利用可能性は不確実である。