Qwen, também conhecido como Tongyi Qianwen (chinês: 通义千问;pinyin: Tōngyì Qiānwèn),, é uma família de modelos de linguagem grandes e pequenos, predominantemente de pesos abertos ( LLMs e SLMs),, desenvolvidos pela Alibaba Cloud. Os modelos são projetados para uma variedade de tarefas de processamento de linguagem natural, incluindo geração de texto, raciocínio e compreensão multimodal. Qwen tornou-se um player significativo no cenário global de inteligência artificial, particularmente notado por seu licenciamento permissivo e pela ampla adoção de seus modelos menores dentro da comunidade de código aberto.
A família se expandiu através de várias iterações principais, desde o lançamento inicial do Qwen em 2023 até a série avançada Qwen3.8 em 2026. Esses modelos são construídos sobre arquiteturas transformers e aproveitam técnicas de aprendizado profundo e aprendizado de máquina. Os modelos Qwen são frequentemente usados como ponto de partida para ajuste fino e personalização adicionais, com muitos modelos derivados criados por desenvolvedores independentes.
Origens e Lançamento Inicial
A Alibaba lançou uma versão beta do Qwen em abril de 2023 sob o nome Tongyi Qianwen. A arquitetura inicial foi baseada no modelo Llama 1 da Meta AI, um design fundamental de modelo de linguagem de grande porte. Após receber autorização regulatória, a Alibaba abriu o Qwen para uso público em setembro de 2023. Os primeiros lançamentos de pesos abertos ocorreram em agosto de 2023 com o modelo de 7B parâmetros, seguido pelas variantes de 72B e 1.8B em dezembro de 2023. Esses lançamentos iniciais estabeleceram a presença do Qwen na comunidade de IA de código aberto, fornecendo a pesquisadores e desenvolvedores modelos acessíveis para experimentação.
Série Qwen2
Qwen2 foi lançado em junho de 2024, introduzindo arquiteturas de modelo densas e esparsas (mistura de especialistas).. Em setembro de 2024, a Alibaba lançou alguns modelos Qwen2 com pesos abertos enquanto manteve seus modelos mais avançados proprietários. A série incluiu variantes especializadas como Qwen-VL para tarefas de linguagem visual e Qwen-Audio para processamento de áudio. A linha Qwen2-VL combinou um transformador de visão com um LLM, com variantes de 2 bilhões e 7 bilhões de parâmetros. Em janeiro de 2025, Qwen2.5-VL expandiu isso com versões de 3, 7, 32 e 72 bilhões de parâmetros, todas licenciadas sob a licença Apache 2.0, exceto a variante de 72B. Qwen-VL-Max, o modelo de visão principal da Alibaba em 2024, foi vendido através de alibaba cloud a US$0.41 por milhão de tokens de entrada.
Em novembro de 2024, a Alibaba lançou QwQ-32B-Preview, um modelo focado em raciocínio semelhante ao o1 da OpenAI, sob a Licença Apache 2.0. Esse modelo tinha um comprimento de contexto de 32K tokens e teve desempenho melhor que o o1 em alguns benchmarks. O aplicativo Accio também foi lançado naquele mês.
Em 29 de janeiro de 2025, a Alibaba lançou Qwen2.5-Max. Em 24 de março de 2025, Qwen2.5-VL-32B-Instruct foi lançado como um sucessor do modelo de visão anterior. Dois dias depois, Qwen2.5-Omni-7B foi lançado sob a licença Apache 2.0, aceitando texto, imagens, vídeos e áudio como entrada enquanto gerava tanto saída de texto quanto de áudio, permitindo conversa por voz em tempo real.
Família Qwen3
A família de modelos Qwen3 foi lançada em 28 de abril de 2025, com todos os modelos licenciados sob a licença Apache 2.0. Este lançamento incluiu tanto modelos densos quanto de mistura de especialistas (MoE).. Os tamanhos de modelos densos variaram de 0.6B a 32B parâmetros, enquanto os modelos MoE incluíram 30B-A3B (30B total com 3B ativados) e 235B-A22B (235B total com 22B ativados. Esses modelos foram treinados em 36 trilhões de tokens em 119 idiomas e dialetos.
A coleção Qwen3 incluiu várias variantes: Qwen3 com modos de pensamento alternáveis e não-pensamento, Qwen3 Base para pré-treinamento, Qwen3 Instruct para modo de não-pensamento apenas, e Qwen3 Thinking para modo de pensamento apenas. Além disso, Qwen3-Max, um modelo proprietário com mais de 1 trilhão de parâmetros, estava disponível através de API, juntamente com Qwen3-Max-Thinking, uma variante de raciocínio capaz de gerar texto, imagens ou vídeo.
Qwen3.5 e Lançamentos Posteriores
Em fevereiro de 2026, a Alibaba lançou o Qwen3.5 de pesos abertos e o Qwen3.5-Plus proprietário. A Alibaba afirmou que o Qwen3.5 poderia operar aplicativos de desktop e celular. Qwen3.5-Omni e Qwen3.6-Plus foram lançados em abril de 2026 como modelos proprietários, com acesso limitado a sites de chatbot e à plataforma de nuvem da Alibaba. O modelo Qwen3.6 foi lançado sob a Licença Apache no mesmo mês.
A Alibaba lançou os modelos proprietários Qwen3.7 nas variantes Max e Plus em maio e junho de 2026, respectivamente. A comunidade de código aberto contribuiu com versões ajustadas e abliteradas, incluindo "Qwable", que incorporou dados de ajuste do Fable 5 da Anthropic.
Qwen3.8-Max
A Alibaba pré-visualizou seu modelo de 2.4 trilhões de parâmetros Qwen3.8-Max em julho de 2026, anunciando planos para lançar seus pesos. Este anúncio veio alguns dias depois da Moonshot AI lançar seu modelo concorrente Kimi K3. A versão em nuvem do Qwen3.8-Max foi lançada em 3 de agosto de 2026, usando uma arquitetura esparsa de mistura de especialistas com aproximadamente 95 bilhões de parâmetros ativos por passagem direta e suportando uma janela de contexto de até um milhão de tokens.
Em 12 de agosto de 2026, a Alibaba lançou os pesos como Qwen3.8-2.4T-A95B. Este modelo de pesos abertos omitiu certos recursos de nuvem, como entrada de imagem e um modo de não-pensamento. Sua licença exigia que provedores de modelo gerando mais de US$50 milhões em receita anual obtivessem uma licença comercial com a Alibaba. Naquela época, era o segundo maior e segundo mais poderoso LLM de pesos abertos e LLM chinês, depois do Kimi K3.
Em 14 de agosto de 2026, a Alibaba lançou Qwen3.8-27B,que incluiu tanto a entrada de imagem quanto o modo de não-pensamento omitidos no lançamento maior. Este modelo foi lançado sob a licença mais permissiva Apache 2.0.
Ecossistema e Aplicações
Os modelos Qwen foram baixados mais de 40 milhões de vezes, com mais de 100 modelos de pesos abertos lançados em toda a família. Versões ajustadas foram desenvolvidas por entusiastas, como "Liberated Qwen" pela Abacus AI, sediada em São Francisco, que responde a solicitações de usuários sem restrições de conteúdo.
Uma versão local do Qwen é usada pela Apple Intelligence na China, integrada com o sistema operacional. Em janeiro de 2026, uma atualização do aplicativo móvel Qwen conectou o chatbot ao ecossistema do Grupo Alibaba, começando com entrega de serviço de alimentação. Os planos incluíam permitir que usuários atribuíssem tarefas a plataformas como Taobao e Fliggy e ajudar com recados como chamadas telefônicas e processamento de documentos.
Liderança e Direção Futura
O ex-chefe da divisão de modelos de IA Qwen, Lin Junyang, renunciou em março de 2026 após o lançamento do Qwen3.5 e Qwen3.5-Plus, tornando-se o terceiro executivo a deixar a Alibaba naquele ano. Em meio a preocupações sobre uma possível mudança de foco longe da pesquisa e da IA de código aberto, a Alibaba afirmou que continuaria seu foco em código aberto. Mais tarde naquele mês, um anúncio da empresa revelou a formação de uma nova divisão de IA, sinalizando compromisso contínuo com o campo.