GLM 4.6 est une famille de grands modèles de langage développée par Zhipu AI, une entreprise chinoise d'intelligence artificielle. La famille de modèles est apparue sur les classements publics de LLM et dans les médias en 2025, avec quatre variantes incluses dans les instantanés de référence. GLM 4.6 succède à GLM 4.5 et poursuit l'accent de la série GLM sur la compréhension, la génération et le raisonnement linguistiques à usage général.
La famille GLM 4.6 est conçue pour une gamme de tâches de traitement du langage naturel, notamment la génération de texte, la réponse aux questions, le résumé et la synthèse de code. Elle s'appuie sur l'architecture Transformer (architecture), qui sous-tend la plupart des grands modèles de langage modernes. Les modèles sont entraînés à l'aide de techniques de Deep learning sur des corpus de textes à grande échelle, leur permettant d'effectuer des tâches complexes avec une grande précision.
Variantes et architecture
La famille GLM 4.6 comprend quatre variantes distinctes, chacune adaptée à des exigences computationnelles et de performance différentes. Bien que les nombres exacts de paramètres pour chaque variante n'aient pas été divulgués publiquement, la famille couvre une gamme de tailles de modèles pour répondre au déploiement, des appareils périphériques aux serveurs cloud. Les modèles utilisent une architecture de transformateur dense avec des améliorations dans les mécanismes d'attention et la stabilité de l'entraînement.
Zhipu AI n'a pas publié de spécifications techniques détaillées pour GLM 4.6, mais les modèles sont connus pour prendre en charge des entrées à contexte long, certaines variantes étant capables de traiter jusqu'à 200 000 jetons. Cela les rend adaptés aux applications impliquant des documents volumineux, des bases de code ou des conversations multi-tours.
Performance et références
Les modèles GLM 4.6 ont été évalués sur plusieurs références publiques, notamment MMLU (Massive Multitask Language Understanding), GSM8K (mathématiques de niveau primaire) et HumanEval (génération de code). Sur MMLU, la plus grande variante atteindrait des scores dans les hautes années 80, comparables à d'autres modèles de pointe. Sur HumanEval, la famille démontre de solides capacités de codage, avec des scores pass@1 dépassant 80 % pour la meilleure variante.
Les modèles performent également bien sur des tâches de raisonnement, comme celles de la suite Big-Bench Hard, et sur des références multilingues, reflétant leur entraînement sur des sources de données diverses. Cependant, la vérification indépendante de ces résultats est limitée, car Zhipu AI n'a pas publié de rapport technique complet pour GLM 4.6 au début de 2025.
Disponibilité et déploiement
Les modèles GLM 4.6 sont disponibles via la plateforme API de Zhipu AI, ainsi que via des versions open source sur des dépôts d'hébergement de modèles. Les variantes open source sont distribuées sous une licence permissive, permettant aux chercheurs et développeurs d'affiner et de déployer les modèles dans leurs propres environnements. Les modèles peuvent être exécutés sur du matériel Graphcore et d'autres plateformes d'accélérateurs, bien qu'aucun partenariat d'optimisation spécifique n'ait été officiellement annoncé.
Zhipu AI a positionné GLM 4.6 comme une alternative compétitive aux modèles de OpenAI, Anthropic et Google DeepMind, en particulier pour les tâches en langue chinoise. La famille a été intégrée dans diverses applications, notamment les chatbots, les assistants de codage et les outils de recherche en entreprise.
Historique de développement et de sortie
GLM 4.6 a été publié en 2025, après la série GLM 4.5 qui a fait ses débuts fin 2024. L'équipe de développement de Zhipu AI, dirigée par des chercheurs ayant des parcours en Artificial intelligence et Machine learning, s'est concentrée sur l'amélioration des capacités de raisonnement et la réduction des taux d'hallucination. La sortie comprenait à la fois des modèles de base et des variantes ajustées par instructions, ces dernières étant optimisées pour un usage conversationnel.
La famille de modèles a été mise à jour de manière itérative, avec des versions mineures corrigeant des problèmes de stabilité et de performance. En 2025, GLM 4.6 reste un projet actif, avec des recherches en cours sur les lois de mise à l'échelle et l'inférence efficace.
Réception et impact
GLM 4.6 a attiré l'attention de la communauté IA pour ses performances solides sur les références en langue chinoise et ses scores compétitifs sur les évaluations internationales. La couverture médiatique a souligné son potentiel à défier les modèles d'IA occidentaux sur le marché mondial. Cependant, certains critiques ont noté le manque de transparence concernant les données d'entraînement et la méthodologie d'évaluation.
La sortie de GLM 4.6 a contribué à la tendance plus large du développement de Generative AI en dehors des États-Unis, avec des entreprises comme Alibaba Cloud et d'autres publiant également de grands modèles de langage. Les variantes open source de la famille ont été utilisées dans la recherche académique, en particulier dans les études sur l'alignement et la sécurité des modèles.