Banana 2は、公開リーダーボードやメディアのベンチマークスナップショットに登場した大規模言語モデルのファミリーに適用される呼称である。最新の入手可能なデータの時点で、このファミリーには3つの異なるバリアントが含まれており、それぞれパラメータ数と性能プロファイルが異なる。公式の開発者、リリース日、技術文書は公開されておらず、この名称は公式発表ではなく、第三者による評価の文脈でのみ登場する。
このモデルファミリーは、広く引用されるベンチマークでの競争力のあるスコアにより主に注目を集めているが、検証可能なソース資料が存在しないため、特定の能力やアーキテクチャの詳細を帰属させることは困難である。公開リーダーボードには3つのバリアントがBanana 2ラベルで掲載されているが、トレーニングデータ、計算リソース、またはその作成を担当する組織に関する情報は提供されていない。その結果、モデルの内部設計に関するいかなる主張も推測の域を出ない。
ベンチマークでの登場
Banana 2のバリアントは、いくつかの独立した評価取り組みによるベンチマークスナップショットに記録されている。3つのバリアントは通常、サイズ(小、中、大)でラベル付けされるが、正確なパラメータ数は一貫して報告されていない。標準的な推論および知識タスクでは、最大のバリアントがテストされたモデルの上位パーセンタイル内でスコアを獲得し、最小のバリアントは中規模のオープンウェイトモデルと同等の性能を示す。これらのスコアは定期的に更新される公開リーダーボードから得られており、新しいモデルが追加されるにつれてランキングは変動している。
公開の利用可能性
最新の確認時点で、Banana 2は公式のダウンロードポータル、APIエンドポイント、またはクラウドサービスを通じて利用できない。OpenAI、Anthropic、またはGoogle DeepMindのモデルとは異なり、確認された配布チャネルは存在しない。その存在の唯一の証拠は、この名称を参照するベンチマーク表とメディア記事から来ている。これにより、Banana 2が匿名のアリーナエントリまたは評価者が使用するプレースホルダー指定である可能性があるとの推測が生じているが、決定的な証拠はまだ出ていない。
技術仕様
公式文書が存在しないため、Banana 2の技術仕様は不明である。このモデルファミリーは、事実上すべての現代の大規模言語モデルがこの設計を使用していることから、Transformer (architecture)アーキテクチャに基づいていると推定されるが、これは推測であり検証された事実ではない。同様に、RLHFやCurriculum Learningなどのトレーニング方法も確認できない。3つのバリアントは、レイヤー数、隠れ次元、トレーニングデータ量が異なる可能性が高いが、これらの詳細は公に記録されていない。
受け止めと論争
リーダーボードでのBanana 2の登場は、Artificial intelligenceコミュニティ内で議論を引き起こしている。一部の研究者は、このモデルファミリーが本物かテストアーティファクトかを疑問視しており、他の研究者は、そのベンチマークスコアが十分に訓練されたモデルにとって妥当であると指摘している。メディアの報道は慎重であり、Banana 2を「謎めいた」または「未検証」と表現することが多い。MIT CSAIL、Stanford AI Lab、またはBAIR (Berkeley AI Research)を含む主要な研究機関は関与を主張しておらず、個々の研究者がこのプロジェクトに公に関連付けられたこともない。
今後の見通し
公式のリリースや声明がないため、Banana 2の将来は不確実なままである。このモデルファミリーが実際に匿名のエントリである場合、将来のベンチマーク更新で撤回または改名される可能性がある。あるいは、公式発表がその起源と技術的詳細を明確にするかもしれない。現時点では、信頼できる情報は、3つのバリアントとそのスコアをリストするベンチマークスナップショット自体からのみ得られる。さらなる証拠が現れるまで、Banana 2は大規模言語モデルと生成AIの広範な状況における未検証のエンティティとして扱われるべきである。