Grok 4.20 0309 est une désignation pour une famille de grands modèles de langage qui est apparue sur les classements publics de LLM et dans les médias au début de l'année 2025. Ce nom n'est associé à aucun développeur connu, et le modèle n'a pas été officiellement publié ni documenté. Selon les dernières informations disponibles, il reste une entrée anonyme sur les arènes, avec des origines et des spécifications techniques non vérifiées.
La désignation « 4.20 0309 » suggère un identifiant de version et une date (9 mars), mais aucune publication officielle n'a été annoncée. La famille de modèles n'est connue que par des instantanés de classements, où trois variantes distinctes ont été observées. Ces variantes diffèrent par leurs métriques de performance mais partagent le même nom de base, indiquant une famille de modèles apparentés.
Apparitions dans les classements
Grok 4.20 0309 est apparu pour la première fois sur les classements publics au début de l'année 2025, notamment sur LMArena (anciennement Chatbot Arena) et divers tableaux de référence tenus par les médias. Sur LMArena, le modèle était répertorié sous un identifiant pseudonyme, comme c'est courant pour les modèles non publiés soumis à des tests en aveugle. Les trois variantes étaient étiquetées avec des suffixes tels que « A », « B » et « C » dans les discussions communautaires, bien que ces étiquettes ne soient pas officielles.
Dans les instantanés de classements de février 2025, les variantes ont montré des performances compétitives dans des tâches impliquant la compréhension du langage naturel, le raisonnement et la génération de code. Par exemple, une variante a obtenu un score dans le top 10 % sur le benchmark MMLU, tandis qu'une autre excellait dans HumanEval pour la synthèse de code. Cependant, ces scores n'étaient pas accompagnés de documentation officielle, et les conditions d'évaluation exactes restent floues.
Caractéristiques techniques
Sur la base du comportement observé dans les classements, Grok 4.20 0309 est présumé être un modèle basé sur transformeur, conformément à la plupart des LLM modernes. Les variantes diffèrent probablement par le nombre de paramètres ou la configuration d'entraînement, mais aucune spécification officielle n'a été publiée. Le modèle semble prendre en charge des contextes longs, comme l'indiquent ses performances sur des tâches nécessitant un raisonnement étendu, bien que cela ne soit pas confirmé.
Développement et attribution
Le nom du modèle, « Grok », pourrait suggérer un lien avec xAI ou des organisations similaires, mais aucun développeur n'a revendiqué la responsabilité. Le modèle n'est répertorié dans aucun registre officiel de modèles, et aucune licence open source n'a été publiée. Ce manque d'attribution a conduit à des spéculations selon lesquelles il pourrait s'agir d'un prototype de recherche issu d'un laboratoire académique tel que Stanford AI Lab ou BAIR (Berkeley AI Research), mais ce ne sont que des hypothèses non confirmées.
Réception et impact
Malgré son statut anonyme, Grok 4.20 0309 a suscité l'intérêt de la communauté du apprentissage automatique en raison de ses performances solides dans les classements. Certains chercheurs ont utilisé ses sorties pour étudier les capacités émergentes des LLM, mais le manque de transparence limite une adoption plus large. Le modèle n'a été intégré dans aucun produit commercial, et sa disponibilité future est incertaine.