Qwen, también conocido como Tongyi Qianwen (en chino: 通义千问; pinyin: Tōngyì Qiānwèn), es una familia de modelos de lenguaje grandes y pequeños (LLM y SLM) predominantemente de pesos abiertos, desarrollados por Alibaba Cloud. Los modelos están diseñados para una variedad de tareas de procesamiento del lenguaje natural, incluida la generación de texto, el razonamiento y la comprensión multimodal. Qwen se ha convertido en un actor importante en el panorama global de la inteligencia artificial, destacando particularmente por su licencia permisiva y la amplia adopción de sus modelos más pequeños dentro de la comunidad de código abierto.
La familia se ha expandido a través de varias iteraciones principales, desde el lanzamiento inicial de Qwen en 2023 hasta la avanzada serie Qwen3.8 en 2026. Estos modelos se basan en arquitecturas de transformadores y aprovechan técnicas de aprendizaje profundo y aprendizaje automático. Los modelos Qwen se utilizan frecuentemente como punto de partida para un ajuste fino y una personalización adicionales, con muchos modelos derivados creados por desarrolladores independientes.
Orígenes y Lanzamiento Inicial
Alibaba lanzó una versión beta de Qwen en abril de 2023 bajo el nombre de Tongyi Qianwen. La arquitectura inicial se basó en el modelo Llama 1 de Meta AI, un diseño fundamental de modelo de lenguaje grande. Tras recibir la aprobación regulatoria, Alibaba abrió Qwen para uso público en septiembre de 2023.
Los primeros lanzamientos de pesos abiertos ocurrieron en agosto de 2023 con el modelo de 7 mil millones de parámetros, seguido de las variantes de 72 mil millones y 1.8 mil millones en diciembre de 2023. Estos primeros lanzamientos establecieron la presencia de Qwen en la comunidad de IA de código abierto, proporcionando a investigadores y desarrolladores modelos accesibles para la experimentación.
Serie Qwen2
Qwen2 se lanzó en junio de 2024, introduciendo arquitecturas de modelos tanto densas como dispersas (mezcla de expertos). En septiembre de 2024, Alibaba lanzó algunos modelos Qwen2 con pesos abiertos mientras mantenía sus modelos más avanzados como propietarios. La serie incluyó variantes especializadas como Qwen-VL para tareas de lenguaje visual y Qwen-Audio para procesamiento de audio.
La línea Qwen2-VL combinó un transformador de visión con un LLM, con variantes de 2 mil millones y 7 mil millones de parámetros. En enero de 2025, Qwen2.5-VL expandió esto con versiones de 3, 7, 32 y 72 mil millones de parámetros, todas licenciadas bajo la licencia Apache 2.0, excepto la variante de 72 mil millones. Qwen-VL-Max, el modelo de visión insignia de Alibaba en 2024, se vendió a través de alibaba-cloud a 0,41 dólares estadounidenses por millón de tokens de entrada.
En noviembre de 2024, Alibaba lanzó QwQ-32B-Preview, un modelo centrado en el razonamiento similar al o1 de OpenAI, bajo la Licencia Apache 2.0. Este modelo tenía una longitud de contexto de 32K tokens y superaba a o1 en algunos puntos de referencia. La aplicación Accio también se lanzó ese mes.
El 29 de enero de 2025, Alibaba lanzó Qwen2.5-Max. El 24 de marzo de 2025, se lanzó Qwen2.5-VL-32B-Instruct como sucesor del modelo de visión anterior. Dos días después, se lanzó Qwen2.5-Omni-7B bajo la licencia Apache 2.0, aceptando texto, imágenes, videos y audio como entrada, mientras generaba tanto texto como audio como salida, lo que permitía conversaciones por voz en tiempo real.
Familia Qwen3
La familia de modelos Qwen3 se lanzó el 28 de abril de 2025, con todos los modelos licenciados bajo la licencia Apache 2.0. Este lanzamiento incluyó tanto modelos densos como de mezcla de expertos (MoE). Los tamaños de los modelos densos variaron de 0.6B a 32B parámetros, mientras que los modelos MoE incluyeron 30B-A3B (30B en total con 3B activados) y 235B-A22B (235B en total con 22B activados). Estos modelos se entrenaron con 36 billones de tokens en 119 idiomas y dialectos.
La colección Qwen3 incluyó varias variantes: Qwen3 con modos de pensamiento y no pensamiento conmutables, Qwen3 Base para preentrenamiento, Qwen3 Instruct solo para modo no pensamiento y Qwen3 Thinking solo para modo pensamiento. Además, Qwen3-Max, un modelo propietario con más de 1 billón de parámetros, estaba disponible a través de API, junto con Qwen3-Max-Thinking, una variante de razonamiento capaz de generar texto, imágenes o video.
Qwen3.5 y Lanzamientos Posteriores
En febrero de 2026, Alibaba lanzó los pesos abiertos de Qwen3.5 y el propietario Qwen3.5-Plus. Alibaba declaró que Qwen3.5 podía operar aplicaciones de escritorio y móviles. Qwen3.5-Omni y Qwen3.6-Plus se lanzaron en abril de 2026 como modelos propietarios, con acceso limitado a sitios web de chatbots y la plataforma en la nube de Alibaba. El modelo Qwen3.6 se lanzó bajo la Licencia Apache en el mismo mes.
Alibaba lanzó los modelos propietarios Qwen3.7 en variantes Max y Plus en mayo y junio de 2026, respectivamente. La comunidad de código abierto contribuyó con versiones ajustadas finamente y "abliteradas", incluida "Qwable", que incorporaba datos de ajuste de Fable 5 de Anthropic.
Qwen3.8-Max
Alibaba presentó en vista previa su modelo de 2,4 billones de parámetros Qwen3.8-Max en julio de 2026, anunciando planes para lanzar sus pesos. Este anuncio llegó unos días después de que Moonshot AI lanzara su modelo competidor Kimi K3. La versión en la nube de Qwen3.8-Max se lanzó el 3 de agosto de 2026, utilizando una arquitectura de mezcla de expertos dispersa con aproximadamente 95 mil millones de parámetros activos por paso hacia adelante y soportando una ventana de contexto de hasta un millón de tokens.
El 12 de agosto de 2026, Alibaba lanzó los pesos como Qwen3.8-2.4T-A95B. Este modelo de pesos abiertos omitió ciertas características de la nube, como la entrada de imágenes y un modo de no pensamiento. Su licencia requería que los proveedores de modelos que generaran más de 50 millones de dólares estadounidenses en ingresos anuales obtuvieran una licencia comercial con Alibaba. En ese momento, era el segundo LLM de pesos abiertos y LLM chino más grande y más potente, después de Kimi K3.
El 14 de agosto de 2026, Alibaba lanzó Qwen3.8-27B, que incluía tanto la entrada de imágenes como el modo de no pensamiento omitidos en el lanzamiento más grande. Este modelo se lanzó bajo la licencia Apache 2.0 más permisiva.
Ecosistema y Aplicaciones
Los modelos Qwen se han descargado más de 40 millones de veces, con más de 100 modelos de pesos abiertos lanzados en toda la familia. Entusiastas han desarrollado versiones ajustadas finamente, como "Liberated Qwen" de Abacus AI con sede en San Francisco, que responde a solicitudes de usuarios sin restricciones de contenido.
Una versión local de Qwen es utilizada por Apple Intelligence en China, integrada con el sistema operativo. En enero de 2026, una actualización de la aplicación móvil de Qwen conectó el chatbot con el ecosistema del Grupo Alibaba, comenzando con la entrega de servicios de alimentos. Los planes incluían permitir a los usuarios asignar tareas a plataformas como Taobao y Fliggy y ayudar con recados como llamadas telefónicas y procesamiento de documentos.
Liderazgo y Dirección Futura
El ex jefe de la división de modelos de IA de Qwen, Lin Junyang, renunció en marzo de 2026 después del lanzamiento de Qwen3.5 y Qwen3.5-Plus, convirtiéndose en el tercer ejecutivo en dejar Alibaba ese año. En medio de preocupaciones sobre un posible cambio de enfoque hacia la investigación y la IA de código abierto, Alibaba declaró que continuaría su enfoque en el código abierto. Más tarde ese mes, un anuncio de la compañía reveló la formación de una nueva división de IA, lo que indica un compromiso continuo con el campo.