Qwen (también conocido como Tongyi Qianwen, chino: 通义千问; pinyin: Tōngyì Qiānwèn) es una familia de modelos de lenguaje grandes y pequeños (LLM y SLM) predominantemente de pesos abiertos desarrollados por Alibaba Cloud. La serie incluye arquitecturas densas y de mezcla de expertos, que van desde modelos pequeños adecuados para dispositivos de borde hasta modelos a gran escala con billones de parámetros. Los modelos Qwen se utilizan ampliamente como base para el ajuste fino y la abliteración en la comunidad de código abierto, y una versión local impulsa Apple Intelligence en China.
La primera iteración, basada en la arquitectura Llama 1 de Meta AI, se lanzó como versión beta en abril de 2023 y publicó sus pesos de 72B en diciembre de 2023. Las versiones posteriores, Qwen2 y Qwen3, ampliaron la familia con capacidades visuales, de audio y omni-modales, e introdujeron modelos centrados en el razonamiento. El último lanzamiento, Qwen3.8, incluye el Qwen3.8-Max de 2,4 billones de parámetros, que fue el segundo LLM de pesos abiertos y LLM chino más grande y potente al 12 de agosto de 2026, después de Kimi K3.
Arquitectura del modelo y entrenamiento
Los modelos Qwen se construyen sobre la arquitectura Transformer, adoptando inicialmente el diseño Llama de Meta AI. Las versiones posteriores incorporan innovaciones como atención de múltiples cabezas, capas de mezcla dispersa de expertos (MoE) y ventanas de contexto largas. Por ejemplo, Qwen3.8-Max utiliza una arquitectura MoE dispersa con aproximadamente 95 mil millones de parámetros activos por pasada hacia adelante y admite una ventana de contexto de hasta un millón de tokens. Los datos de entrenamiento para Qwen3 incluyeron 36 billones de tokens en 119 idiomas y dialectos, lo que permite amplias capacidades multilingües.
La familia incluye tanto modelos densos (por ejemplo, variantes densas de Qwen3 de 0.6B a 32B parámetros) como modelos MoE (por ejemplo, Qwen3-30B-A3B y Qwen3-235B-A22B). Qwen3.8-Max, con 2,4 billones de parámetros totales, es el modelo de pesos abiertos más grande de la serie. Los modelos se entrenan utilizando técnicas estándar de aprendizaje profundo, incluida la optimización Adam y la programación de la tasa de aprendizaje, aunque los detalles específicos del entrenamiento a menudo no se divulgan por completo.
Variantes y capacidades del modelo
Qwen abarca múltiples líneas de modelos especializados. La serie Qwen-VL combina un transformador de visión con un LLM para tareas de lenguaje visual, con variantes como Qwen2-VL (2B y 7B) y Qwen2.5-VL (3B, 7B, 32B, 72B). Qwen2.5-Omni-7B acepta texto, imágenes, videos y audio como entrada y genera tanto texto como audio como salida, lo que permite la interacción de voz en tiempo real. Qwen-Audio maneja tareas de audio, y Qwen2-Math se centra en el razonamiento matemático. La serie QwQ, que comenzó con QwQ-32B-Preview en noviembre de 2024, enfatiza el razonamiento similar al de OpenAI o1, con una longitud de contexto de 32K tokens.
Qwen3 introdujo un modo de pensamiento que se puede activar o desactivar, lo que permite al modelo deliberar antes de responder o responder directamente. Qwen3.8-Max, lanzado con pesos abiertos el 12 de agosto de 2026, omite ciertas funciones en la nube como la entrada de imágenes y el modo sin pensamiento, pero el destilado Qwen3.8-27B incluye estas funciones y está licenciado bajo la permisiva Licencia Apache.
Lanzamientos y licencias
Alibaba ha lanzado más de 100 modelos de pesos abiertos, con descargas acumuladas que superan los 40 millones a principios de 2025. La licencia varía según el modelo: muchas versiones más pequeñas y destiladas utilizan la licencia Apache 2.0, mientras que los modelos más grandes a menudo requieren un acuerdo de reparto de ingresos para proveedores que generen más de 50 millones de dólares estadounidenses anuales. Por ejemplo, Qwen3.8-2.4T-A95B requiere dicha licencia comercial, mientras que Qwen3.8-27B es Apache 2.0. Esta estrategia equilibra la apertura con los intereses comerciales, haciendo de Qwen un punto de partida común para el ajuste fino comunitario.
Las fechas clave de lanzamiento incluyen: Qwen beta en abril de 2023; pesos de Qwen 7B en agosto de 2023; Qwen 72B y 1.8B en diciembre de 2023; Qwen2 en junio de 2024; Qwen2.5-VL en enero de 2025; Qwen2.5-Max el 29 de enero de 2025; Qwen2.5-VL-32B-Instruct el 24 de marzo de 2025; Qwen2.5-Omni-7B el 26 de marzo de 2025; Qwen3 el 28 de abril de 2025; Qwen3.5 en febrero de 2026; vista previa de Qwen3.8-Max en julio de 2026; lanzamiento en la nube el 3 de agosto de 2026; pesos abiertos el 12 de agosto de 2026; y Qwen3.8-27B el 14 de agosto de 2026.
Ecosistema y aplicaciones
Los modelos Qwen están integrados en los servicios en la nube y las aplicaciones de consumo de Alibaba. La aplicación móvil Qwen, actualizada en enero de 2026, se conecta al ecosistema de Alibaba, comenzando con la entrega de servicios de alimentos, con planes de extenderse a plataformas como Taobao y Fliggy. Una versión local de Qwen es utilizada por Apple Intelligence en China, integrada con el sistema operativo. La aplicación Accio, lanzada en noviembre de 2024, aprovecha Qwen para la asistencia de compras impulsada por IA.
En la comunidad de código abierto, las licencias permisivas de Qwen han llevado a numerosos derivados ajustados y abliterados, como "Liberated Qwen" de Abacus AI, que elimina las restricciones de contenido, y "Qwable", que incorpora datos de ajuste de Fable 5 de Anthropic. Estos derivados destacan el papel de Qwen como modelo fundamental para la experimentación.
Desarrollos recientes
En marzo de 2026, Lin Junyang, ex jefe de la división de modelos de IA Qwen, renunció después del lanzamiento de Qwen3.5 y Qwen3.5-Plus, convirtiéndose en el tercer ejecutivo en dejar Alibaba ese año. Alibaba reafirmó su compromiso con la IA de código abierto a pesar de estas salidas. Más tarde ese mes, un anuncio de la compañía reveló la formación de una nueva entidad, aunque los detalles siguen siendo limitados a principios de 2026. La serie Qwen3.8, incluidos el propietario Qwen3.8-Max y el abierto Qwen3.8-27B, representa el avance más reciente, con Alibaba continuando empujando los límites de la escala y la capacidad de los modelos de pesos abiertos.