Nous Research é uma organização de pesquisa descentralizada em IA que desenvolve modelos de linguagem de grande porte de código aberto e técnicas de alinhamento. Fundado em 2022 por um grupo de pesquisadores e engenheiros independentes, o laboratório ganhou destaque por suas variantes ajustadas de modelos base da OpenAI e de outras organizações, especialmente a série Hermes, que visava melhorar o seguimento de instruções e as capacidades de raciocínio, mantendo ao mesmo tempo a transparência.
O laboratório opera sem uma estrutura corporativa tradicional, coordenando colaboradores em vários fusos horários e dependendo do desenvolvimento conduzido pela comunidade. Seu trabalho situa-se na interseção de aprendizado de máquina e IA generativa, com foco em tornar capacidades avançadas de modelos acessíveis por meio de licenças permissivas. Ao contrário de grandes laboratórios como Anthropic ou Google DeepMind, a Nous Research enfatiza a agilidade de pequenas equipes e publica relatórios técnicos detalhados sobre suas metodologias de ajuste fino.
Série de Modelos Hermes
A série principal Hermes começou com o Hermes 1, um ajuste fino do modelo LLaMA-1 13B da Meta, lançado no final de 2022. Em seguida, veio o Hermes 2 em 2023, que incorporou RLHF (aprendizado por reforço a partir de feedback de IA) para melhorar a qualidade das respostas. A série expandiu-se para incluir versões baseadas em Mistral AI e outros modelos de pesos abertos, com o Hermes 2 Pro e o Hermes 3 lançados em 2024. Esses modelos demonstraram forte desempenho em benchmarks de raciocínio e uso de ferramentas, frequentemente rivalizando com sistemas proprietários maiores.
Uma característica definidora da série Hermes é o uso de conjuntos de dados de treinamento diversos e de alta qualidade, selecionados pela comunidade. A Nous Research desenvolveu pipelines de dados proprietários que filtram e misturam fontes, incluindo dados sintéticos de modelos mais fortes, para melhorar o seguimento de instruções sem esquecimento catastrófico. Os modelos são tipicamente lançados sob a licença Apache 2.0, permitindo uso comercial e de pesquisa.
Trabalho em Alinhamento e Avaliação
Além dos lançamentos de modelos, a Nous Research contribuiu para a pesquisa em alinhamento, notavelmente com o desenvolvimento do benchmark 'DangerousQA', que testa comportamentos de recusa dos modelos. Em 2023, o laboratório introduziu a biblioteca 'Nous Puffer' para interpretabilidade, e em 2024, publicou trabalho sobre 'condicionamento de persona' - um método para direcionar as saídas do modelo incorporando traços definidos pelo usuário no prompt. Essas ferramentas são usadas por outros pesquisadores para avaliar a segurança e o comportamento de modelos de linguagem de grande porte.
O laboratório também mantém o 'Nous Research Leaderboard' em plataformas como Hugging Face para acompanhar o desempenho de modelos abertos, fornecendo uma alternativa transparente a benchmarks fechados. Isso posicionou a Nous Research como um ator-chave no ecossistema de código aberto, frequentemente citado por grupos acadêmicos em instituições como Stanford AI Lab e Berkeley AI Research.
Comunidade e Estrutura Descentralizada
A Nous Research é conhecida por suas operações descentralizadas, com colaboradores principais operando sob pseudônimos e coordenando via Discord. O laboratório não tem sede formal, mas lista um endereço de escritório virtual em São Francisco. O financiamento vem de bolsas de pesquisa, doações e contratos seletivos de consultoria com empresas no espaço de infraestrutura de IA. Essa estrutura permite iteração rápida, com atualizações de modelos lançadas semanalmente durante períodos de pico de desenvolvimento.
O aspecto comunitário se estende ao 'Nous Research Forum', um espaço online onde usuários compartilham scripts de ajuste fino e discutem técnicas de aprendizado profundo. O laboratório também organizou 'hackathons' colaborativos para produzir conjuntos de dados, como a coleção 'OpenHermes', que agrega pares de instruções gerados por usuários.
Impacto e Recepção
Os modelos da Nous Research foram amplamente adotados em ambientes acadêmicos e comerciais. O Hermes 3, por exemplo, foi usado em vários projetos de robótica e agentes de IA devido às suas capacidades confiáveis de chamada de ferramentas. Críticos, no entanto, notaram que o ciclo de lançamento rápido do laboratório às vezes leva a qualidade desigual entre versões. Apesar disso, sua abordagem aberta influenciou outros laboratórios, incluindo AI21 Labs e Inflection AI, a adotar práticas de ajuste fino mais transparentes.
Em termos de computação, o laboratório depende de provedores de nuvem como Amazon Web Services e Google Cloud, frequentemente alugando clusters de NVIDIA H100. Embora não tenha desenvolvido seu próprio hardware, colaborou com Groq na otimização de inferência para modelos abertos. Em 2025, o laboratório continua lançando novos ajustes finos, com foco em extensões multilíngues e multimodais.
A importância mais ampla da Nous Research reside em sua demonstração de que equipes pequenas e distribuídas podem avançar significativamente a inteligência artificial sem orçamentos massivos. Seu trabalho também levantou debates sobre licenciamento de modelos e a ética do ajuste fino de pesos proprietários, que permanece um tópico ativo na comunidade de políticas de IA.
Direções Futuras
Olhando para o futuro, a Nous Research está explorando métodos para aprendizado contínuo e suporte a idiomas de baixos recursos. Eles também anunciaram experimentos com geração de sequência baseada em difusão como uma alternativa à previsão do próximo token. No entanto, esses projetos estão em estágios iniciais, e a principal produção do laboratório continua sendo ajustes finos de alta qualidade de modelos transformadores existentes.