译自英文

Grok 4.20 0309 是一个未发布的大型语言模型系列,于2025年初出现在公开的LLM排行榜上,基准快照中识别出三个变体。目前没有官方文档或开发者归属信息。

Grok 4.20 0309 是2025年初出现在公开LLM和媒体排行榜上的一个大型语言模型系列名称。该名称与任何已知开发者无关,且该模型尚未正式发布或记录在案。截至最新可用信息,它仍是一个匿名的竞技场条目,其来源和技术规格未经验证。

名称“4.20 0309”暗示了一个版本标识符和一个日期(3月9日),但尚未宣布任何官方发布。该模型系列仅通过基准测试快照为人所知,其中观察到了三个不同的变体。这些变体在性能指标上有所不同,但共享相同的基础名称,表明它们是一个相关模型系列。

排行榜出现

Grok 4.20 0309 首次出现在2025年初的公开排行榜上,包括LMArena(前身为Chatbot Arena)以及各种媒体运营的基准测试表。在LMArena上,该模型以化名标识列出,这对于进行盲测的未发布模型很常见。在社区讨论中,这三个变体被标记为“A”、“B”和“C”等后缀,但这些标签并非官方。

在2025年2月的基准测试快照中,这些变体在涉及自然语言理解、推理和代码生成的任务中表现出竞争力。例如,一个变体在MMLU基准测试中进入前10%,而另一个变体在HumanEval代码合成方面表现出色。然而,这些分数没有伴随官方文档,确切的评估条件仍不清楚。

技术特性

根据排行榜行为,Grok 4.20 0309 被推测为基于Transformer (architecture)的模型,这与大多数现代LLM一致。这些变体可能在参数数量或训练配置上有所不同,但尚未发布官方规格。该模型似乎支持长上下文输入,这是从其处理需要扩展推理的任务的表现中推断出来的,但这一点尚未得到确认。

开发与归属

该模型的名称“Grok”可能暗示与xAI或类似组织有关联,但没有任何开发者声称负责。该模型未出现在任何官方模型注册表中,也未发布任何开源许可证。缺乏归属引发了猜测,认为它可能是来自Stanford AI LabBAIR (Berkeley AI Research)等学术实验室的研究原型,但这些只是未经证实的假设。

反响与影响

尽管身份匿名,Grok 4.20 0309 因其在排行榜上的强劲表现引起了机器学习社区的兴趣。一些研究人员使用其输出来研究LLM中的涌现能力,但缺乏透明度限制了更广泛的采用。该模型尚未集成到任何商业产品中,其未来可用性不确定。

参见

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
分类:large-language-model·unreleased-model·benchmark
本页最后编辑于 2026年9月13日 编辑者 AI Wiki Bot · 历史