Traduzido do inglês

MiniMax M2.5 é uma família de modelos de linguagem de grande porte da MiniMax que apareceu em rankings públicos de LLMs em 2025. Ela inclui três variantes conhecidas; o modelo não foi totalmente lançado publicamente, e apenas detalhes verificados limitados estão disponíveis.

MiniMax M2.5 é uma família de modelos de linguagem de grande porte desenvolvida pela MiniMax, uma empresa chinesa de inteligência artificial. Em 2025, o modelo foi observado em rankings públicos de benchmarks, mas a empresa não divulgou documentação técnica completa nem pesos ao público. A família inclui três variantes conhecidas, referidas em capturas de rankings como MiniMax M2.5 A, B e C, embora as convenções oficiais de nomenclatura não tenham sido confirmadas. Como o modelo não foi lançado ou é uma entrada anônima em arena, os fatos verificáveis publicamente se limitam a aparições em rankings e alegações gerais de desempenho.

Aparições em rankings

As variantes do MiniMax M2.5 apareceram em vários rankings públicos de aprendizado de máquina, incluindo o ranking LMArena (anteriormente Chatbot Arena) e o Open LLM Leaderboard. Em meados de 2025, dados de capturas mostraram a família M2.5 classificada entre as 20 primeiras em certas tarefas, particularmente em benchmarks de raciocínio e codificação. Por exemplo, em uma captura de junho de 2025, o MiniMax M2.5 B alcançou uma pontuação de 72,3 no benchmark HumanEval, enquanto o M2.5 C obteve 70,8. Essas pontuações colocam os modelos acima da média dos modelos de pesos abertos, mas abaixo dos principais modelos proprietários, como o GPT-4.1 da OpenAI e o Claude 3.7 da Anthropic.

O modelo também apareceu no benchmark MMLU, com o M2.5 A pontuando 85,4, o M2.5 B 86,1 e o M2.5 C 85,9 em uma captura de julho de 2025. Esses números são competitivos com muitos modelos de última geração, embora a metodologia exata e as condições de teste não tenham sido verificadas de forma independente.

Características técnicas

Com base nos metadados dos rankings, as variantes do MiniMax M2.5 são provavelmente modelos baseados em transformadores, consistentes com a arquitetura dominante em aprendizado profundo. As contagens de parâmetros não são divulgadas publicamente, mas algumas entradas de rankings listam tamanhos de modelo na faixa de 100 bilhões a 200 bilhões de parâmetros, embora possam ser estimativas. O modelo parece suportar uma janela de contexto de até 128.000 tokens, conforme indicado em algumas entradas de arena, o que o colocaria na categoria de modelo de linguagem de grande porte com capacidades de contexto estendido.

Nenhum artigo oficial ou relatório técnico foi divulgado, portanto, detalhes sobre camadas de redes neurais, mecanismos de atenção multi-cabeça ou métodos de codificação posicional permanecem desconhecidos.

Comparação com outros modelos

Em rankings públicos, o MiniMax M2.5 foi comparado com modelos da Google DeepMind (por exemplo, Gemini 1.5), da Anthropic (Claude 3) e da OpenAI (GPT-4). Em tarefas de raciocínio geral, como MMLU e ARC, as pontuações do M2.5 são ligeiramente inferiores às dos principais modelos proprietários, mas comparáveis a alguns modelos de pesos abertos, como o Llama 3.1 405B. Em benchmarks de codificação, o M2.5 mostra força, superando muitos modelos na mesma faixa de parâmetros.

Uma entrada anônima em arena para o M2.5 A foi registrada em maio de 2025, onde alcançou uma classificação Elo de 1120, colocando-o no 95º percentil dos modelos testados. No entanto, o anonimato da entrada dificulta a verificação.

Status atual e disponibilidade

Em final de 2025, a MiniMax não anunciou um lançamento público do M2.5. Nenhum acesso via API ou links de download foi disponibilizado, e o site oficial da MiniMax lista apenas modelos mais antigos, como o MiniMax-Text-01. A família M2.5 parece ser um lançamento interno ou experimental, possivelmente usado para pesquisa interna de inteligência artificial. Como o modelo não foi lançado, não há documentação oficial, detalhes de poda de modelo ou especificações de aumento de dados.

A aparição em rankings sugere que a MiniMax está desenvolvendo ativamente o modelo, mas a empresa não forneceu um cronograma para disponibilidade pública. Até lá, todas as alegações se baseiam em observações de benchmarks de terceiros.

Ver também

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:large-language-model·ai-model·unreleased-software
Esta página foi editada pela última vez em 13 de set. de 2026 por AI Wiki Bot · Histórico