Dirk Hovy es un científico social computacional cuya investigación se centra en el procesamiento del lenguaje natural (PLN), el aprendizaje automático y la equidad en la inteligencia artificial. Es particularmente conocido por su trabajo sobre sesgos demográficos en modelos de lenguaje y equidad algorítmica, examinando cómo atributos sociales como el género, la edad y la nacionalidad se codifican en el texto y cómo estos sesgos se propagan a través de los sistemas de IA. Hovy ha contribuido al desarrollo de métodos para detectar y mitigar el sesgo en el PLN, y su trabajo ha influido en los debates sobre el desarrollo responsable de la IA.
Hovy está afiliado a la Universidad Bocconi en Milán, Italia, donde dirige la unidad de Datos y Perspectivas de Marketing y es profesor en el Departamento de Ciencias de la Computación. También ha ocupado puestos en la Universidad del Sur de California y la Universidad de Copenhague. Su investigación une métodos computacionales y ciencias sociales, abordando preguntas sobre cómo el lenguaje refleja y moldea las estructuras sociales.
Vida Temprana y Educación
Dirk Hovy nació en Alemania y desarrolló un interés temprano tanto en la informática como en la lingüística. Realizó sus estudios de grado en lingüística computacional en la Universidad de Tubinga, donde se expuso a la intersección entre el lenguaje y la computación. Luego se trasladó a los Estados Unidos para realizar estudios de posgrado, obteniendo un doctorado en informática en la Universidad del Sur de California (USC). Su investigación doctoral se centró en la traducción automática estadística y el uso de información sintáctica en modelos de PLN, sentando las bases para su trabajo posterior sobre las dimensiones sociales del lenguaje.
Carrera Académica
Después de completar su doctorado, Hovy se unió al Instituto de Ciencias de la Información de la Universidad del Sur de California como científico investigador. Durante este período, colaboró con colegas en proyectos que involucraban PLN multilingüe y el desarrollo de recursos para lenguas de bajos recursos. En 2015, se trasladó a la Universidad de Copenhague, donde se convirtió en profesor asociado y más tarde en profesor titular. En Copenhague, fundó la sección de PLN y lideró investigaciones sobre ciencia social computacional, incluidos estudios sobre los correlatos demográficos del uso del lenguaje.
En 2021, Hovy se unió a la Universidad Bocconi como profesor titular. Allí, estableció un grupo de investigación centrado en la equidad y la transparencia en la IA, con un énfasis particular en aplicaciones de PLN. También ha participado en iniciativas de investigación europeas, incluidos proyectos financiados por el Consejo Europeo de Investigación, y ha formado parte de comités de programa para conferencias importantes de PLN como ACL, EMNLP y NAACL.
Contribuciones de Investigación
La investigación de Hovy ha realizado contribuciones significativas para comprender y mitigar el sesgo en los sistemas de PLN. Uno de sus trabajos notables, "Learning Word Vectors for 157 Languages", introdujo un modelo multilingüe de incrustaciones de palabras que ha sido ampliamente utilizado en tareas de PLN translingüísticas. También ha publicado artículos influyentes sobre la inferencia automática de atributos demográficos a partir del texto, demostrando que los modelos pueden predecir el género, la edad y otros rasgos de una persona a partir de su estilo de escritura. Esta línea de investigación planteó importantes cuestiones éticas sobre la privacidad y el posible uso indebido de tales predicciones.
En el área de la equidad, Hovy ha investigado cómo los sesgos en los datos de entrenamiento conducen a resultados discriminatorios en los modelos de aprendizaje automático. Su trabajo ha demostrado que las incrustaciones de palabras y los grandes modelos de lenguaje a menudo codifican estereotipos, como asociar ciertas profesiones con géneros específicos. Ha propuesto métodos para eliminar el sesgo en estos modelos, incluidas técnicas de posprocesamiento y estrategias de aumento de datos. Su investigación se ha publicado en foros de primer nivel, incluidos los Proceedings of the Association for Computational Linguistics y el Journal of Artificial Intelligence Research.
Impacto y Reconocimiento
El trabajo de Hovy ha sido ampliamente citado y ha influido tanto en la investigación académica como en las prácticas industriales. Sus hallazgos sobre el sesgo en el PLN han sido referenciados en directrices para el desarrollo responsable de la IA por organizaciones como OpenAI y Google DeepMind. Ha sido invitado a hablar en conferencias y talleres en todo el mundo, incluida la Conferencia sobre Equidad, Responsabilidad y Transparencia (FAccT) y la Conferencia Internacional sobre Aprendizaje Automático (ICML).
En 2020, Hovy recibió una prestigiosa subvención del Consejo Europeo de Investigación para su proyecto sobre "Procesamiento del Lenguaje Natural Socialmente Consciente", que tiene como objetivo desarrollar modelos de PLN más sensibles al contexto social y menos propensos al sesgo. También ha sido reconocido con premios al mejor artículo en varias conferencias, incluida una mención honorífica en EMNLP 2016 por su trabajo sobre inferencia demográfica.
Publicaciones Seleccionadas
Hovy ha sido autor de más de 100 artículos revisados por pares. Algunos de sus trabajos más citados incluyen:
- "Learning Word Vectors for 157 Languages" (con Anders Søgaard, 2017)
- "Demographic Information from Text: A Survey" (con otros, 2019)
- "A Corpus for Sentence-Level Subjectivity Detection in German" (con otros, 2013)
- "The Social Impact of Natural Language Processing" (con otros, 2021)
Su investigación ha sido respaldada por múltiples subvenciones de la Fundación Nacional de Ciencias, la Unión Europea y fundaciones privadas.
Véase También
- Inteligencia artificial
- Procesamiento del lenguaje natural
- Equidad algorítmica
- Ciencia social computacional