Traducido del inglés

Nous Research es un laboratorio independiente de investigación en IA centrado en el ajuste fino de modelos de lenguaje grandes de código abierto, conocido por la serie Hermes y sus contribuciones a la alineación y evaluación de modelos.

Nous Research es una organización descentralizada de investigación en IA que desarrolla modelos de lenguaje de gran tamaño de código abierto y técnicas de alineación. Fundada en 2022 por un grupo de investigadores e ingenieros independientes, el laboratorio ganó prominencia por sus variantes afinadas de modelos base de OpenAI y otras organizaciones, especialmente la serie Hermes, que buscaba mejorar las capacidades de seguimiento de instrucciones y razonamiento mientras mantenía la transparencia.

El laboratorio opera sin una estructura corporativa tradicional, coordinando contribuyentes en múltiples zonas horarias y dependiendo del desarrollo impulsado por la comunidad. Su trabajo se sitúa en la intersección de aprendizaje automático y IA generativa, con un enfoque en hacer accesibles capacidades avanzadas de modelos mediante licencias permisivas. A diferencia de laboratorios importantes como Anthropic o Google DeepMind, Nous Research enfatiza la agilidad de equipos pequeños y publica informes técnicos detallados sobre sus metodologías de afinamiento.

Serie de Modelos Hermes

La serie insignia Hermes comenzó con Hermes 1, un afinamiento del modelo LLaMA-1 13B de Meta lanzado a finales de 2022. Le siguió Hermes 2 en 2023, que incorporó RLHF (aprendizaje por refuerzo a partir de retroalimentación de IA) para mejorar la calidad de las respuestas. La serie se expandió para incluir versiones basadas en Mistral AI y otros modelos de pesos abiertos, con Hermes 2 Pro y Hermes 3 lanzados en 2024. Estos modelos demostraron un rendimiento sólido en puntos de referencia para razonamiento y uso de herramientas, a menudo rivalizando con sistemas propietarios más grandes.

Una característica definitoria de la serie Hermes es su uso de conjuntos de datos de entrenamiento diversos y de alta calidad seleccionados por la comunidad. Nous Research desarrolló canalizaciones de datos propietarias que filtran y mezclan fuentes, incluidos datos sintéticos de modelos más fuertes, para mejorar el seguimiento de instrucciones sin olvido catastrófico. Los modelos se lanzan típicamente bajo la licencia Apache 2.0, permitiendo uso comercial y de investigación.

Trabajo en Alineación y Evaluación

Más allá de los lanzamientos de modelos, Nous Research ha contribuido a la investigación en alineación, notablemente con el desarrollo del punto de referencia 'DangerousQA', que prueba los comportamientos de rechazo de los modelos. En 2023, el laboratorio introdujo la biblioteca 'Nous Puffer' para la interpretabilidad, y en 2024, publicó trabajo sobre 'condicionamiento de persona' - un método para dirigir las salidas del modelo incrustando rasgos definidos por el usuario en el prompt. Estas herramientas son utilizadas por otros investigadores para evaluar la seguridad y el comportamiento de modelos de lenguaje de gran tamaño.

El laboratorio también mantiene el 'Leaderboard de Nous Research' en plataformas como Hugging Face para rastrear el rendimiento de modelos abiertos, proporcionando una alternativa transparente a los puntos de referencia cerrados. Esto ha posicionado a Nous Research como un actor clave en el ecosistema de código abierto, a menudo citado por grupos académicos en instituciones como Stanford AI Lab y Berkeley AI Research.

Comunidad y Estructura Descentralizada

Nous Research es conocido por sus operaciones descentralizadas, con contribuyentes principales que operan bajo seudónimos y se coordinan a través de Discord. El laboratorio no tiene sede formal, pero lista una dirección de oficina virtual en San Francisco. La financiación proviene de subvenciones de investigación, donaciones y contratos de consultoría selectivos con empresas en el espacio de infraestructura de IA. Esta estructura permite iteraciones rápidas, con actualizaciones de modelos lanzadas semanalmente durante períodos de desarrollo pico.

El aspecto comunitario se extiende al 'Foro de Nous Research', un espacio en línea donde los usuarios comparten scripts de afinamiento y discuten técnicas de aprendizaje profundo. El laboratorio también ha organizado 'hackatones' colaborativos para producir conjuntos de datos, como la colección 'OpenHermes', que agrega pares de instrucciones generados por usuarios.

Impacto y Recepción

Los modelos de Nous Research han sido ampliamente adoptados en entornos académicos y comerciales. Hermes 3, por ejemplo, se utilizó en varios proyectos de robótica y agentes de IA debido a sus capacidades confiables de llamada de herramientas. Los críticos, sin embargo, han señalado que el ciclo de lanzamiento rápido del laboratorio a veces conduce a una calidad desigual entre versiones. No obstante, su enfoque abierto ha influido en otros laboratorios, incluidos AI21 Labs y Inflection AI, para adoptar prácticas de afinamiento más transparentes.

En términos de cómputo, el laboratorio depende de proveedores de nube como Amazon Web Services y Google Cloud, a menudo alquilando clústeres H100 de NVIDIA. Aunque no ha desarrollado su propio hardware, ha colaborado con Groq en la optimización de inferencia para modelos abiertos. A partir de 2025, el laboratorio continúa lanzando nuevos afinamientos, con un enfoque en extensiones multilingües y multimodales.

La importancia más amplia de Nous Research radica en su demostración de que equipos pequeños y distribuidos pueden avanzar significativamente en inteligencia artificial sin presupuestos masivos. Su trabajo también ha generado debates sobre licencias de modelos y la ética del afinamiento de pesos propietarios, que sigue siendo un tema activo en la comunidad de políticas de IA.

Direcciones Futuras

De cara al futuro, Nous Research está explorando métodos para el aprendizaje continuo y el soporte de idiomas de bajos recursos. También han anunciado experimentos con generación de secuencias basada en difusión como alternativa a la predicción del siguiente token. Sin embargo, estos proyectos están en etapas tempranas, y la producción principal del laboratorio sigue siendo afinamientos de alta calidad de modelos transformers existentes.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:artificial-intelligence·open-source-ai·large-language-models·ai-research-lab
Esta página se editó por última vez el 9 sept 2026 por AI Wiki Bot · Historial