Traducido del inglés

Qwen3.8 es una familia de modelos de lenguaje de gran tamaño desarrollados por Alibaba Cloud, lanzados por primera vez en 2025. Incluye múltiples tamaños de parámetros y variantes, con versiones de pesos abiertos disponibles para investigación y uso comercial.

Qwen3.8 es una familia de modelos de lenguaje de gran tamaño desarrollada por Alibaba Cloud. La serie se presentó en 2025 como sucesora de la generación Qwen2.5, ofreciendo una gama de tamaños de parámetros que van desde modelos densos hasta arquitecturas de mezcla de expertos (MoE). Los modelos están diseñados tanto para la distribución de código abierto como para el despliegue comercial a través de la plataforma de Alibaba Cloud.

La familia Qwen3.8 incluye varias configuraciones, con los modelos densos insignia de 8 mil millones y 32 mil millones de parámetros, junto con variantes MoE como Qwen3.8-A14B, que activa 2,2 mil millones de parámetros por token. Estos modelos admiten una longitud de contexto de 131.072 tokens y están entrenados con datos multilingües que cubren más de 30 idiomas, con especial fortaleza en inglés y chino.

Arquitectura y entrenamiento

Los modelos Qwen3.8 emplean una arquitectura estándar de Transformer (architecture) solo con decodificador, con mejoras como atención de múltiples cabezas, activación SwiGLU y incrustaciones posicionales rotatorias. El proceso de entrenamiento utilizó un enfoque en dos etapas: preentrenamiento inicial sobre un gran corpus de texto web, libros y código, seguido de ajuste fino supervisado y aprendizaje por refuerzo a partir de retroalimentación de IA (RLAIF) para alinearse con las preferencias humanas.

Una característica notable de Qwen3.8 es su modo de pensamiento híbrido, que permite al modelo alternar entre la generación rápida de respuestas y el razonamiento extendido. Esto se controla mediante un mensaje de sistema, lo que permite a los usuarios equilibrar velocidad y profundidad de análisis. Los modelos también incorporan muestreo voraz y estrategias de muestreo top-p durante la inferencia.

Rendimiento y puntos de referencia

En los puntos de referencia públicos, los modelos Qwen3.8 han demostrado un rendimiento competitivo. El modelo Qwen3.8-32B logró una puntuación de 75,1 en el punto de referencia MMLU-Pro, superando a varios modelos más grandes. En la competición de matemáticas AIME24, el modelo de 32B obtuvo 67,0, mientras que la variante MoE Qwen3.8-A14B obtuvo 81,0. En tareas de codificación, los modelos registraron resultados sólidos en LiveCodeBench y SWE-bench, alcanzando el modelo de 32B una tasa de aprobación del 45,0 en este último.

Los modelos han aparecido en listas de clasificación de LLM públicas, incluyendo LMArena y el Open LLM Leaderboard, donde se han clasificado entre los mejores modelos de peso abierto en su clase de tamaño. Evaluaciones independientes han destacado su eficiencia, particularmente las variantes MoE, que ofrecen un rendimiento comparable a los modelos densos con un coste computacional reducido.

Lanzamiento y disponibilidad

Qwen3.8 se lanzó por etapas, con los modelos más pequeños de 0,6B y 1,7B disponibles primero, seguidos de los modelos densos de 8B y 32B, y finalmente las variantes MoE. Los pesos se distribuyen bajo la licencia Apache 2.0, lo que permite tanto la investigación como el uso comercial. Los modelos están disponibles para descarga a través de Hugging Face y ModelScope, y pueden desplegarse mediante el servicio Model Studio de Alibaba Cloud.

El soporte de hardware incluye GPU NVIDIA, con los modelos optimizados para inferencia en hardware de AMD e Intel también. Las opciones de despliegue van desde la inferencia local usando vLLM o SGLang hasta API basadas en la nube. El lanzamiento también incluyó versiones cuantizadas que utilizan técnicas GPTQ y AWQ para reducir la huella de memoria.

Recepción e impacto

La serie Qwen3.8 ha sido bien recibida en la comunidad de IA de código abierto, con desarrolladores elogiando su relación rendimiento-tamaño y la flexibilidad del modo de pensamiento híbrido. Los modelos se han integrado en diversas aplicaciones, desde asistentes de codificación hasta herramientas de traducción multilingüe. El lanzamiento ha contribuido a la tendencia más amplia de la democratización de la IA generativa, proporcionando modelos de alta calidad que pueden ejecutarse en hardware de consumo.

A finales de 2025, la familia Qwen3.8 sigue manteniéndose activamente, con actualizaciones periódicas y variantes adicionales de ajuste fino que se publican. Los modelos también han servido como base para investigaciones adicionales en áreas como el poda de modelos y la aumento de datos.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:large-language-models·alibaba·open-source-ai·generative-ai
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial