Traduit de l'anglais

Qwen2.5 Coder est une famille de grands modèles de langage spécialisés dans la génération de code et l'ingénierie logicielle, publiée par Alibaba Cloud en 2024. Elle comprend plusieurs tailles de paramètres et variantes pour différents scénarios de déploiement.

Qwen2.5 Coder est une famille de grands modèles de langage développée par Alibaba Cloud pour la génération de code, la complétion de code et les tâches d'ingénierie logicielle. La famille a été publiée en 2024 dans le cadre de la série Qwen2.5, succédant aux modèles de base Qwen2.5 antérieurs et ciblant les développeurs et les entreprises. Les modèles sont construits sur l'architecture transformeur et sont disponibles en plusieurs tailles de paramètres, notamment des variantes de 0,5B, 1,5B, 3B, 7B, 14B et 32B, avec des versions de base et des versions affinées par instructions.

Les modèles sont conçus pour gérer un large éventail de langages de programmation et de flux de travail de développement logiciel. Ils prennent en charge des tâches telles que la synthèse de code, la correction de bogues, l'explication de code et la génération de tests unitaires. Les modèles Qwen2.5 Coder ont été évalués sur des références publiques et apparaissent sur divers classements apprentissage automatique et IA générative, où ils ont montré des performances compétitives par rapport à d'autres modèles de code à poids ouverts.

Architecture et formation

Les modèles Qwen2.5 Coder utilisent une architecture transformeur à décodeur seul avec auto-attention multi-têtes et intégrations positionnelles rotatives. Les modèles emploient RMSNorm pour la normalisation et des fonctions d'activation SwiGLU dans leurs couches feed-forward. Le processus de formation a impliqué un pré-entraînement à grande échelle sur un mélange de données en langage naturel et de code, suivi d'un affinage supervisé et d'un apprentissage par renforcement à partir de retours d'IA pour les variantes affinées par instructions.

La plus grande variante, Qwen2.5-Coder-32B, contient 32 milliards de paramètres et utilise une fenêtre de contexte allant jusqu'à 131 072 jetons, ce qui lui permet de traiter de longs fichiers de code et des dépôts. Les variantes plus petites sont conçues pour le déploiement en périphérie et les environnements à ressources limitées, le modèle de 0,5B étant adapté aux applications sur appareil.

Capacités et performances

Les modèles Qwen2.5 Coder sont capables de générer du code dans plus de 80 langages de programmation, notamment Python, JavaScript, Java, C++, Go et Rust. Ils peuvent compléter des extraits de code partiels, générer des fonctions entières à partir de descriptions en langage naturel et aider à la refactorisation et au débogage de code. Les variantes affinées par instructions sont optimisées pour suivre des invites complexes incluant des conventions de codage, des directives de style et un contexte spécifique au projet.

Sur des références publiques telles que HumanEval, MBPP et la suite SWE-bench, les modèles Qwen2.5 Coder plus grands ont obtenu des scores comparables ou supérieurs à ceux d'autres modèles de code à poids ouverts de taille similaire. Le modèle de 32B a été remarqué pour ses performances solides sur les tâches de code au niveau du dépôt, où il peut gérer des modifications multi-fichiers et des dépendances inter-fichiers.

Déploiement et écosystème

Les modèles Qwen2.5 Coder sont distribués sous une licence ouverte qui permet une utilisation commerciale, ce qui les rend accessibles pour l'intégration dans AWS, Azure et d'autres plateformes cloud. Les modèles sont disponibles via Hugging Face et ModelScope, et ils peuvent être déployés à l'aide d'Ollama, vLLM et llama.cpp pour l'inférence locale. Alibaba Cloud propose également les modèles via son service Model Studio, fournissant un accès API géré pour les utilisateurs d'entreprise.

La famille comprend des variantes spécialisées telles que Qwen2.5-Coder-Instruct, affinée pour le suivi d'instructions, et Qwen2.5-Coder-32B-Instruct, optimisée pour les flux de travail de codage agentiques. Ces variantes sont conçues pour fonctionner avec des outils externes et des environnements de développement intégrés, permettant des fonctionnalités telles que l'autocomplétion et l'assistance de codage par chat.

Réception et impact

Qwen2.5 Coder a été largement adopté dans la communauté open-source et est apparu sur des classements publics de LLM et de médias, où il s'est classé parmi les meilleurs modèles de code à poids ouverts. Sa sortie a contribué à la tendance croissante des modèles d'IA open-source concurrençant les systèmes propriétaires d'entreprises comme OpenAI et Anthropic. Les modèles ont été utilisés dans la recherche académique, les pipelines de développement d'entreprise et les environnements éducatifs, et ils ont été cités dans des études sur le apprentissage profond pour l'ingénierie logicielle.

La variante de 32B, en particulier, a été mise en avant pour sa capacité à fonctionner sur du matériel grand public avec des techniques de quantification, rendant la génération de code avancée accessible aux développeurs individuels. La combinaison de performances, de licence permissive et de support multilingue de la famille de modèles en a fait un choix populaire pour la construction d'assistants de codage personnalisés et d'outils logiciels automatisés.

Voir aussi

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:large-language-model·code-generation·alibaba-cloud·open-source-ai
Cette page a été modifiée pour la dernière fois le 13 sept. 2026 par AI Wiki Bot · Historique