Qwen (também conhecido como Tongyi Qianwen, chinês: 通义千问; pinyin: Tōngyì Qiānwèn) é uma família de modelos de linguagem grandes e pequenos (LLM e SLM) predominantemente de pesos abertos, desenvolvida pela Alibaba Cloud. A série inclui arquiteturas densas e de mistura de especialistas, variando de modelos pequenos adequados para dispositivos de borda a modelos de grande escala com trilhões de parâmetros. Os modelos Qwen são amplamente usados como base para ajuste fino e abliteração na comunidade de código aberto, e uma versão local alimenta a Apple Intelligence na China.
A primeira iteração, baseada na arquitetura Llama 1 da Meta AI, foi lançada como versão beta em abril de 2023 e liberou seus pesos de 72B em dezembro de 2023. Versões subsequentes, Qwen2 e Qwen3, expandiram a família com capacidades visuais, de áudio e omni-modais, e introduziram modelos focados em raciocínio. O lançamento mais recente, Qwen3.8, inclui o Qwen3.8-Max, com 2,4 trilhões de parâmetros, que foi o segundo maior e o segundo LLM de pesos abertos e LLM chinês mais poderoso em 12 de agosto de 2026, depois do Kimi K3.
Arquitetura e Treinamento do Modelo
Os modelos Qwen são construídos sobre a arquitetura Transformer, adotando inicialmente o design Llama da Meta AI. Versões posteriores incorporam inovações como atenção de múltiplas cabeças, camadas de mistura de especialistas esparsa (MoE) e janelas de contexto longas. Por exemplo, o Qwen3.8-Max usa uma arquitetura MoE esparsa com aproximadamente 95 bilhões de parâmetros ativos por passagem direta e suporta uma janela de contexto de até um milhão de tokens. Os dados de treinamento para o Qwen3 incluíram 36 trilhões de tokens em 119 idiomas e dialetos, permitindo amplas capacidades multilíngues.
A família inclui tanto modelos densos (por exemplo, variantes densas do Qwen3 de 0,6B a 32B de parâmetros) quanto modelos MoE (por exemplo, Qwen3-30B-A3B e Qwen3-235B-A22B). O Qwen3.8-Max, com 2,4 trilhões de parâmetros totais, é o maior modelo de pesos abertos da série. Os modelos são treinados usando técnicas padrão de aprendizado profundo, incluindo otimização Adam e agendamento de taxa de aprendizado, embora detalhes específicos de treinamento muitas vezes não sejam totalmente divulgados.
Variantes e Capacidades do Modelo
O Qwen abrange múltiplas linhas de modelos especializados. A série Qwen-VL combina um transformador de visão com um LLM para tarefas de linguagem visual, com variantes como Qwen2-VL (2B e 7B) e Qwen2.5-VL (3B, 7B, 32B, 72B). O Qwen2.5-Omni-7B aceita texto, imagens, vídeos e áudio como entrada e gera tanto texto quanto áudio como saída, permitindo interação por voz em tempo real. O Qwen-Audio lida com tarefas de áudio, e o Qwen2-Math foca em raciocínio matemático. A série QwQ, começando com o QwQ-32B-Preview em novembro de 2024, enfatiza raciocínio semelhante ao OpenAI o1, com um comprimento de contexto de 32K tokens.
O Qwen3 introduziu um modo de pensamento que pode ser ativado ou desativado, permitindo que o modelo delibere antes de responder ou responda diretamente. O Qwen3.8-Max, lançado com pesos abertos em 12 de agosto de 2026, omite certos recursos de nuvem, como entrada de imagem e modo sem pensamento, mas o destilado Qwen3.8-27B inclui esses recursos e é licenciado sob a permissiva Licença Apache.
Lançamentos e Licenciamento
A Alibaba lançou mais de 100 modelos de pesos abertos, com downloads cumulativos excedendo 40 milhões no início de 2025. O licenciamento varia por modelo: muitas versões menores e destiladas usam a licença Apache 2.0, enquanto modelos maiores frequentemente exigem um acordo de compartilhamento de receita para provedores que geram mais de US$ 50 milhões anualmente. Por exemplo, o Qwen3.8-2.4T-A95B requer tal licença comercial, enquanto o Qwen3.8-27B é Apache 2.0. Essa estratégia equilibra abertura com interesses comerciais, tornando o Qwen um ponto de partida comum para ajuste fino pela comunidade.
Datas-chave de lançamento incluem: beta do Qwen em abril de 2023; pesos do Qwen 7B em agosto de 2023; Qwen 72B e 1.8B em dezembro de 2023; Qwen2 em junho de 2024; Qwen2.5-VL em janeiro de 2025; Qwen2.5-Max em 29 de janeiro de 2025; Qwen2.5-VL-32B-Instruct em 24 de março de 2025; Qwen2.5-Omni-7B em 26 de março de 2025; Qwen3 em 28 de abril de 2025; Qwen3.5 em fevereiro de 2026; prévia do Qwen3.8-Max em julho de 2026; lançamento na nuvem em 3 de agosto de 2026; pesos abertos em 12 de agosto de 2026; e Qwen3.8-27B em 14 de agosto de 2026.
Ecossistema e Aplicações
Os modelos Qwen estão integrados aos serviços de nuvem e aplicativos de consumo da Alibaba. O aplicativo móvel Qwen, atualizado em janeiro de 2026, conecta-se ao ecossistema da Alibaba, começando com entrega de serviços de alimentação, com planos de se estender a plataformas como Taobao e Fliggy. Uma versão local do Qwen é usada pela Apple Intelligence na China, integrada ao sistema operacional. O aplicativo Accio, lançado em novembro de 2024, aproveita o Qwen para assistência de compras orientada por IA.
Na comunidade de código aberto, as licenças permissivas do Qwen levaram a inúmeros derivados de ajuste fino e abliteração, como "Liberated Qwen" da Abacus AI, que remove restrições de conteúdo, e "Qwable", incorporando dados de ajuste do Fable 5 da Anthropic. Esses derivados destacam o papel do Qwen como modelo fundamental para experimentação.
Desenvolvimentos Recentes
Em março de 2026, Lin Junyang, ex-chefe da divisão de modelos de IA Qwen, renunciou após o lançamento do Qwen3.5 e Qwen3.5-Plus, tornando-se o terceiro executivo a deixar a Alibaba naquele ano. A Alibaba reafirmou seu compromisso com IA de código aberto apesar dessas saídas. Mais tarde naquele mês, um anúncio da empresa revelou a formação de uma nova entidade, embora os detalhes permaneçam limitados no início de 2026. A série Qwen3.8, incluindo o proprietário Qwen3.8-Max e o aberto Qwen3.8-27B, representa o avanço mais recente, com a Alibaba continuando a empurrar os limites da escala e capacidade de modelos de pesos abertos.