Llama 3.1 Nemotron

Traducido del inglés

Llama 3.1 Nemotron es una familia de modelos de lenguaje grandes desarrollados por NVIDIA, basados en la arquitectura Llama 3.1 de Meta, optimizados para razonamiento y seguimiento de instrucciones. Aparece en los rankings públicos de LLM con tres variantes en las instantáneas de referencia.

Llama 3.1 Nemotron es una familia de modelos de lenguaje de gran tamaño desarrollados por NVIDIA, construidos sobre la arquitectura de Llama 3.1 de Meta. Los modelos están diseñados para un razonamiento mejorado, el seguimiento de instrucciones y la alineación con las preferencias humanas. Se han publicado como modelos de pesos abiertos, lo que permite a investigadores y desarrolladores ajustarlos y desplegarlos en diversas aplicaciones. La familia incluye múltiples tamaños de parámetros, con tres variantes que aparecen en las instantáneas de los puntos de referencia públicos en los rankings de LLM.

Desarrollo y lanzamiento

NVIDIA anunció la familia Llama 3.1 Nemotron a finales de 2024, tras el lanzamiento de los modelos Llama 3.1 de Meta en julio de 2024. El lanzamiento inicial incluyó la variante Nemotron-70B, que rápidamente llamó la atención por su rendimiento en los puntos de referencia de razonamiento. NVIDIA posicionó estos modelos como una contribución al ecosistema de IA de código abierto, enfatizando su uso de técnicas avanzadas de alineación. Los modelos se pusieron a disposición en plataformas como Hugging Face, con pesos accesibles tanto para uso comercial como de investigación bajo una licencia permisiva.

Arquitectura y entrenamiento

Los modelos se basan en la arquitectura transformador, específicamente en el diseño de solo decodificador utilizado en Llama 3.1. Incorporan técnicas como atención de múltiples cabezas y codificaciones posicionales rotativas. NVIDIA empleó un pipeline de entrenamiento que incluía ajuste fino supervisado y aprendizaje por refuerzo a partir de retroalimentación de IA (RLAIF), utilizando un modelo de recompensa para alinear las salidas con las preferencias humanas. Los datos de entrenamiento comprendían una mezcla de corpus disponibles públicamente y datos sintéticos generados por otros modelos de gran tamaño. NVIDIA no ha revelado la composición exacta del conjunto de datos ni el cómputo total utilizado para el entrenamiento.

Rendimiento y puntos de referencia

Los modelos Llama 3.1 Nemotron han sido evaluados en una variedad de puntos de referencia estándar, incluyendo MMLU (Massive Multitask Language Understanding), GSM8K (matemáticas de escuela primaria) y HumanEval (generación de código). Se informó que la variante de 70B logró puntuaciones competitivas o superiores a las de ciertos modelos propietarios más grandes en tareas de razonamiento específicas. En rankings públicos como LMArena (anteriormente Chatbot Arena), los modelos han sido listados con calificaciones Elo en el nivel superior, aunque los números específicos varían según la instantánea. Las tres variantes en las instantáneas de los puntos de referencia corresponden a diferentes tamaños de parámetros, probablemente 8B, 70B y una configuración más grande, aunque las especificaciones exactas de todas las variantes no se han publicado de manera uniforme.

Aplicaciones y ecosistema

NVIDIA ha integrado Llama 3.1 Nemotron en su pila de software NVIDIA AI Enterprise, permitiendo su despliegue en Azure, Google Cloud y AWS a través de sus respectivos mercados. Los modelos también son compatibles con Groq y SambaNova para inferencia de baja latencia. Los desarrolladores han utilizado los modelos para tareas como generación de código, razonamiento matemático y agentes conversacionales. La naturaleza de pesos abiertos de los modelos ha facilitado el ajuste fino para aplicaciones específicas de dominio, incluyendo en salud y finanzas.

Recepción e impacto

El lanzamiento de Llama 3.1 Nemotron fue recibido con interés por parte de la comunidad de aprendizaje automático, particularmente por su uso de RLAIF, que ofrecía una alternativa al RLHF tradicional. Algunos investigadores señalaron que los modelos demostraban un rendimiento sólido en los puntos de referencia de razonamiento, reduciendo la brecha entre los modelos abiertos y cerrados. Sin embargo, algunas evaluaciones también destacaron inconsistencias en el rendimiento entre diferentes tareas, y los modelos no fueron clasificados universalmente en los primeros puestos. NVIDIA ha continuado iterando en la línea Nemotron, publicando versiones posteriores con capacidades mejoradas.

Licencia y disponibilidad

Los modelos Llama 3.1 Nemotron se distribuyen bajo la Licencia de Modelo Abierto de NVIDIA, que permite el uso comercial, la modificación y la redistribución, con el requisito de que las obras derivadas incluyan términos de licencia similares. Los pesos están disponibles para descargar desde Hugging Face, y los modelos pueden ejecutarse localmente en hardware compatible, incluyendo GPUs de AMD e Intel, así como GPUs de NVIDIA. La licencia no restringe el uso de los modelos para fines de investigación, y NVIDIA proporciona documentación y código de ejemplo para el ajuste fino y el despliegue.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:large-language-models·nvidia·open-source-ai·generative-ai
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial