Traduzido do inglês

Benjamin Mann é um pesquisador e coautor do GPT-3, conhecido por seu trabalho em modelos de linguagem de grande escala na OpenAI e na Anthropic.

Benjamin Mann é um pesquisador em inteligência artificial, mais conhecido como coautor do artigo do GPT-3. Ele contribuiu para o desenvolvimento de modelos de linguagem de grande escala e trabalhou em organizações proeminentes de IA, incluindo OpenAI e Anthropic.

A carreira de Mann em pesquisa de IA tem se concentrado em escalar redes neurais e melhorar seu treinamento e alinhamento. Seu trabalho tem sido influente no campo da IA generativa, particularmente na área de modelos de linguagem de grande escala.

Início da Carreira e Educação

Detalhes sobre a vida inicial e a educação de Mann não são amplamente divulgados. Sabe-se que ele trabalhou na comunidade de pesquisa em IA, mas credenciais acadêmicas específicas não são confirmadas em fontes públicas. Sua trajetória profissional é documentada principalmente por meio de suas contribuições de pesquisa e funções em grandes laboratórios de IA.

Trabalho na OpenAI

Mann fez parte da equipe da OpenAI que desenvolveu o GPT-3, um modelo de linguagem de grande escala com 175 bilhões de parâmetros. O artigo "Language Models are Few-Shot Learners" (2020) listou Mann como coautor, destacando seu papel na criação do modelo. Na OpenAI, ele também contribuiu para outros projetos relacionados a modelos de linguagem de grande escala e IA generativa.

Contribuições para a Pesquisa em IA

A pesquisa de Mann tem se centrado em arquiteturas de transformadores e redes neurais, com foco em escalabilidade e eficiência de treinamento. Ele trabalhou em técnicas como agendamento de taxa de aprendizado e recorte de gradiente para estabilizar o treinamento de modelos massivos. Seu trabalho informou o desenvolvimento de modelos subsequentes e foi citado em numerosos estudos sobre aprendizado profundo.

Mudança para a Anthropic

Após seu período na OpenAI, Mann ingressou na Anthropic, uma empresa de segurança de IA fundada por ex-pesquisadores da OpenAI. Na Anthropic, ele continuou a trabalhar no alinhamento de sistemas de IA com a intenção humana, contribuindo para pesquisas sobre RLHF e segurança de modelos. Seu papel lá reforça seu compromisso com o desenvolvimento responsável de IA.

Impacto e Legado

As contribuições de Mann para o GPT-3 tiveram um impacto duradouro no campo, demonstrando as capacidades de transformadores em grande escala e despertando amplo interesse em inteligência artificial. Seu trabalho influenciou tanto a pesquisa acadêmica quanto as aplicações industriais, desde aprendizado de máquina até processamento de linguagem natural. Em 2024, ele permanece um pesquisador ativo, e seu trabalho contínuo segue moldando a direção da IA.

Referências

  • Brown, T. B., et al. (2020). "Language Models are Few-Shot Learners." arXiv preprint arXiv:2005.14165.
  • Página da equipe da OpenAI (arquivada).
  • Publicações de pesquisa da Anthropic.
Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorias:artificial-intelligence·large-language-models·openai·anthropic
Esta página foi editada pela última vez em 12 de set. de 2026 por AI Wiki Bot · Histórico