Dirk Hovy é um cientista social computacional cuja pesquisa se concentra em processamento de linguagem natural (PLN), aprendizado de máquina e justiça em inteligência artificial. Ele é particularmente conhecido por seu trabalho sobre vieses demográficos em modelos de linguagem e justiça algorítmica, examinando como atributos sociais como gênero, idade e nacionalidade são codificados em textos e como esses vieses se propagam por sistemas de IA. Hovy contribuiu para o desenvolvimento de métodos de detecção e mitigação de vieses em PLN, e seu trabalho influenciou discussões sobre o desenvolvimento responsável de IA.
Hovy é afiliado à Universidade Bocconi, em Milão, Itália, onde lidera a unidade de Data and Marketing Insights e é professor no Departamento de Ciências da Computação. Ele também ocupou cargos na Universidade do Sul da Califórnia e na Universidade de Copenhague. Sua pesquisa une métodos computacionais e ciências sociais, abordando questões sobre como a linguagem reflete e molda estruturas sociais.
Início da Vida e Educação
Dirk Hovy nasceu na Alemanha e desenvolveu um interesse precoce tanto em ciência da computação quanto em linguística. Ele cursou seus estudos de graduação em linguística computacional na Universidade de Tübingen, onde foi exposto à interseção entre linguagem e computação. Em seguida, mudou-se para os Estados Unidos para estudos de pós-graduação, obtendo um doutorado em ciência da computação pela Universidade do Sul da Califórnia (USC). Sua pesquisa de doutorado focou em tradução automática estatística e no uso de informações sintáticas em modelos de PLN, estabelecendo as bases para seu trabalho posterior sobre dimensões sociais da linguagem.
Carreira Acadêmica
Após concluir seu doutorado, Hovy ingressou no Information Sciences Institute da Universidade do Sul da Califórnia como cientista de pesquisa. Durante esse período, colaborou com colegas em projetos envolvendo PLN multilíngue e o desenvolvimento de recursos para línguas de baixos recursos. Em 2015, mudou-se para a Universidade de Copenhague, onde se tornou professor associado e, posteriormente, professor titular. Em Copenhague, fundou a seção de PLN e liderou pesquisas em ciência social computacional, incluindo estudos sobre correlatos demográficos do uso da linguagem.
Em 2021, Hovy ingressou na Universidade Bocconi como professor titular. Lá, estabeleceu um grupo de pesquisa focado em justiça e transparência em IA, com ênfase particular em aplicações de PLN. Ele também esteve envolvido em iniciativas de pesquisa europeias, incluindo projetos financiados pelo Conselho Europeu de Pesquisa, e atuou em comitês de programa de conferências importantes de PLN, como ACL, EMNLP e NAACL.
Contribuições de Pesquisa
A pesquisa de Hovy fez contribuições significativas para a compreensão e mitigação de vieses em sistemas de PLN. Um de seus trabalhos notáveis, "Learning Word Vectors for 157 Languages", introduziu um modelo de embeddings de palavras multilíngue amplamente utilizado em tarefas de PLN interlinguais. Ele também publicou artigos influentes sobre a inferência automática de atributos demográficos a partir de textos, demonstrando que modelos podem prever o gênero, a idade e outras características de uma pessoa com base em seu estilo de escrita. Essa linha de pesquisa levantou questões éticas importantes sobre privacidade e o potencial de uso indevido de tais previsões.
Na área de justiça, Hovy investigou como vieses em dados de treinamento levam a resultados discriminatórios em modelos de aprendizado de máquina. Seu trabalho mostrou que embeddings de palavras e modelos de linguagem de grande escala frequentemente codificam estereótipos, como associar certas profissões a gêneros específicos. Ele propôs métodos para eliminar vieses nesses modelos, incluindo técnicas de pós-processamento e estratégias de aumento de dados. Sua pesquisa foi publicada em veículos de destaque, incluindo os Anais da Associação de Linguística Computacional e o Journal of Artificial Intelligence Research.
Impacto e Reconhecimento
O trabalho de Hovy tem sido amplamente citado e influenciou tanto a pesquisa acadêmica quanto as práticas da indústria. Suas descobertas sobre vieses em PLN foram referenciadas em diretrizes para o desenvolvimento responsável de IA por organizações como OpenAI e Google DeepMind. Ele foi convidado a palestrar em conferências e workshops em todo o mundo, incluindo a Conferência sobre Justiça, Responsabilidade e Transparência (FAccT) e a Conferência Internacional sobre Aprendizado de Máquina (ICML).
Em 2020, Hovy recebeu uma prestigiosa bolsa do Conselho Europeu de Pesquisa para seu projeto sobre "Processamento de Linguagem Natural Socialmente Consciente", que visa desenvolver modelos de PLN mais sensíveis ao contexto social e menos propensos a vieses. Ele também foi reconhecido com prêmios de melhor artigo em várias conferências, incluindo uma menção honrosa na EMNLP 2016 por seu trabalho sobre inferência demográfica.
Publicações Selecionadas
Hovy é autor de mais de 100 artigos revisados por pares. Alguns de seus trabalhos mais citados incluem:
- "Learning Word Vectors for 157 Languages" (com Anders Søgaard, 2017)
- "Demographic Information from Text: A Survey" (com outros, 2019)
- "A Corpus for Sentence-Level Subjectivity Detection in German" (com outros, 2013)
- "The Social Impact of Natural Language Processing" (com outros, 2021)
Sua pesquisa foi apoiada por múltiplas bolsas da Fundação Nacional de Ciência, da União Europeia e de fundações privadas.
Ver Também
- Inteligência artificial
- Processamento de linguagem natural
- Justiça algorítmica
- Ciência social computacional