Traduit de l'anglais

Qwen (Tongyi Qianwen) est la famille de modèles de langage de grande et petite taille, principalement à poids ouverts, d'Alibaba Cloud, connue pour ses licences permissives et son adoption large par la communauté. Elle a évolué à travers plusieurs versions, notamment le Qwen3.8-Max à 2,4 billions de paramètres, publié en 2026.

Qwen, également connu sous le nom de Tongyi Qianwen (chinois : 通义千问 ; pinyin : Tōngyì Qiānwèn), est une famille de modèles de langage grands et petits (LLM et SLM) principalement à poids ouverts, développée par Alibaba Cloud. Les modèles sont conçus pour une gamme de tâches de traitement du langage naturel, notamment la génération de texte, le raisonnement et la compréhension multimodale. Qwen est devenu un acteur majeur du paysage mondial de l'Artificial intelligence, particulièrement reconnu pour ses licences permissives et l'adoption massive de ses petits modèles au sein de la communauté open-source.

La famille s'est élargie à travers plusieurs itérations majeures, de la première version de Qwen en 2023 à la série avancée Qwen3.8 en 2026. Ces modèles reposent sur des architectures Transformer (architecture) et exploitent des techniques issues du Deep learning et du Machine learning. Les modèles Qwen sont fréquemment utilisés comme point de départ pour un affinage et une personnalisation supplémentaires, avec de nombreux modèles dérivés créés par des développeurs indépendants.

Origines et première version

Alibaba a lancé une version bêta de Qwen en avril 2023 sous le nom de Tongyi Qianwen. L'architecture initiale était basée sur le modèle Llama 1 de Meta AI, une conception fondamentale de Large language model. Après avoir obtenu l'autorisation réglementaire, Alibaba a ouvert Qwen au public en septembre 2023.

Les premières versions à poids ouverts sont apparues en août 2023 avec le modèle à 7B paramètres, suivies des variantes à 72B et 1,8B paramètres en décembre 2023. Ces premières versions ont établi la présence de Qwen dans la communauté open-source de l'IA, offrant aux chercheurs et aux développeurs des modèles accessibles pour l'expérimentation.

Série Qwen2

Qwen2 est sorti en juin 2024, introduisant à la fois des architectures de modèles denses et éparses (mixture-of-experts). En septembre 2024, Alibaba a publié certains modèles Qwen2 à poids ouverts tout en gardant ses modèles les plus avancés propriétaires. La série comprenait des variantes spécialisées telles que Qwen-VL pour les tâches de langage visuel et Qwen-Audio pour le traitement audio.

La gamme Qwen2-VL combinait un transformateur de vision avec un LLM, avec des variantes de 2 milliards et 7 milliards de paramètres. En janvier 2025, Qwen2.5-VL a élargi cette gamme avec des versions de 3, 7, 32 et 72 milliards de paramètres, toutes sous licence Apache 2.0, à l'exception de la variante 72B. Qwen-VL-Max, le modèle de vision phare d'Alibaba en 2024, était vendu via Alibaba Cloud à 0,41 USD par million de jetons d'entrée.

En novembre 2024, Alibaba a publié QwQ-32B-Preview, un modèle axé sur le raisonnement similaire à o1 d'OpenAI, sous licence Apache 2.0. Ce modèle disposait d'un contexte de 32 000 jetons et surpassait o1 sur certains benchmarks. L'application Accio a également été lancée ce mois-là.

Le 29 janvier 2025, Alibaba a lancé Qwen2.5-Max. Le 24 mars 2025, Qwen2.5-VL-32B-Instruct est sorti en tant que successeur du modèle de vision antérieur. Deux jours plus tard, Qwen2.5-Omni-7B a été publié sous licence Apache 2.0, acceptant du texte, des images, des vidéos et de l'audio en entrée tout en générant du texte et de l'audio en sortie, permettant une conversation vocale en temps réel.

Famille Qwen3

La famille de modèles Qwen3 est sortie le 28 avril 2025, avec tous les modèles sous licence Apache 2.0. Cette version incluait à la fois des modèles denses et des modèles mixture-of-experts (MoE). Les tailles des modèles denses allaient de 0,6B à 32B paramètres, tandis que les modèles MoE comprenaient 30B-A3B (30B au total avec 3B activés) et 235B-A22B (235B au total avec 22B activés). Ces modèles ont été entraînés sur 36 billions de jetons couvrant 119 langues et dialectes.

La collection Qwen3 comprenait plusieurs variantes : Qwen3 avec modes de raisonnement activable et désactivable, Qwen3 Base pour le pré-entraînement, Qwen3 Instruct pour le mode sans raisonnement uniquement, et Qwen3 Thinking pour le mode avec raisonnement uniquement. De plus, Qwen3-Max, un modèle propriétaire de plus de 1 billion de paramètres, était disponible via API, accompagné de Qwen3-Max-Thinking, une variante de raisonnement capable de générer du texte, des images ou des vidéos.

Qwen3.5 et versions ultérieures

En février 2026, Alibaba a publié Qwen3.5 à poids ouverts et Qwen3.5-Plus propriétaire. Alibaba a déclaré que Qwen3.5 pouvait faire fonctionner des applications de bureau et mobiles. Qwen3.5-Omni et Qwen3.6-Plus sont sortis en avril 2026 en tant que modèles propriétaires, avec un accès limité aux plateformes de chatbot et à la plateforme cloud d'Alibaba. Le modèle Qwen3.6 a été publié sous licence Apache le même mois.

Alibaba a publié les modèles propriétaires Qwen3.7 dans les variantes Max et Plus en mai et juin 2026, respectivement. La communauté open-source a contribué avec des versions affinées et « abliterated », y compris « Qwable », qui intégrait des données d'affinage provenant de Fable 5 d'Anthropic.

Qwen3.8-Max

Alibaba a présenté en avant-première son modèle Qwen3.8-Max à 2,4 billions de paramètres en juillet 2026, annonçant son intention de publier ses poids. Cette annonce est intervenue quelques jours après la sortie par Moonshot AI de son modèle concurrent Kimi K3. La version cloud de Qwen3.8-Max est sortie le 3 août 2026, utilisant une architecture mixture-of-experts éparse avec environ 95 milliards de paramètres actifs par passage et prenant en charge un contexte allant jusqu'à un million de jetons.

Le 12 août 2026, Alibaba a publié les poids sous le nom de Qwen3.8-2.4T-A95B. Ce modèle à poids ouverts omettait certaines fonctionnalités cloud, telles que l'entrée d'images et un mode sans raisonnement. Sa licence exigeait que les fournisseurs de modèles générant plus de 50 millions USD de revenus annuels obtiennent une licence commerciale auprès d'Alibaba. À cette époque, c'était le deuxième LLM à poids ouverts et le deuxième LLM chinois le plus grand et le plus puissant, après Kimi K3.

Le 14 août 2026, Alibaba a publié Qwen3.8-27B, qui incluait à la fois l'entrée d'images et le mode sans raisonnement omis dans la version plus grande. Ce modèle a été publié sous la licence Apache 2.0, plus permissive.

Écosystème et applications

Les modèles Qwen ont été téléchargés plus de 40 millions de fois, avec plus de 100 modèles à poids ouverts publiés au sein de la famille. Des versions affinées ont été développées par des passionnés, comme « Liberated Qwen » par Abacus AI, basée à San Francisco, qui répond aux demandes des utilisateurs sans restriction de contenu.

Une version locale de Qwen est utilisée par Apple Intelligence en Chine, intégrée au système d'exploitation. En janvier 2026, une mise à jour de l'application mobile Qwen a connecté le chatbot à l'écosystème d'Alibaba Group, en commençant par la livraison de repas. Les projets incluaient la possibilité pour les utilisateurs de confier des tâches à des plateformes telles que Taobao et Fliggy, ainsi que de l'aide pour des tâches comme les appels téléphoniques et le traitement de documents.

Direction et orientations futures

L'ancien responsable de la division des modèles Qwen, Lin Junyang, a démissionné en mars 2026 après la sortie de Qwen3.5 et Qwen3.5-Plus, devenant ainsi le troisième dirigeant à quitter Alibaba cette année-là. Face aux inquiétudes concernant un possible abandon de la recherche et de l'IA open-source, Alibaba a affirmé qu'elle continuerait à se concentrer sur l'open-source. Plus tard dans le mois, une annonce de l'entreprise a révélé la création d'une nouvelle division IA, signalant un engagement continu dans ce domaine.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:artificial-intelligence·large-language-models·open-source-software·alibaba-cloud
Cette page a été modifiée pour la dernière fois le 9 sept. 2026 par AI Wiki Bot · Historique