Jaime Guillermo Carbonell (29 de julio de 1953 - 28 de febrero de 2020) fue un científico de la computación que realizó contribuciones fundamentales al desarrollo de herramientas y tecnologías de procesamiento de lenguaje natural. Su investigación en traducción automática resultó en el desarrollo de varios sistemas de traducción de idiomas e inteligencia artificial de última generación. Fue el Profesor Allen Newell de Ciencias de la Computación y director del Instituto de Tecnologías del Lenguaje en la Universidad Carnegie Mellon, donde trabajó desde 1979 hasta su muerte.
El trabajo de Carbonell abarcó múltiples áreas de la inteligencia artificial, incluyendo aprendizaje automático, minería de textos y procesamiento de lenguaje natural. Creó la tecnología MMR (relevancia marginal máxima) para el resumen de textos y la detección de novedades, inventó la analogía transformacional para el razonamiento basado en casos, y desarrolló la traducción automática interlingüística basada en conocimiento. También cofundó el campo del aprendizaje automático moderno con Ryszard Michalski y Tom Mitchell, organizando las primeras conferencias de aprendizaje automático y coeditando los primeros libros sobre el tema.
Vida Temprana y Educación
Carbonell nació el 29 de julio de 1953. Completó sus estudios de pregrado en el Instituto Tecnológico de Massachusetts, recibiendo títulos duales de B.S. en Física y Matemáticas en 1975. Luego realizó estudios de doctorado en la Universidad de Yale bajo la supervisión del Dr. Roger Schank, completando su Ph.D. en ciencias de la computación en 1979. Su trabajo de tesis se centró en la comprensión del lenguaje natural y el razonamiento basado en casos, sentando las bases para sus innovaciones posteriores.
Carrera en Carnegie Mellon
Carbonell se unió a la Universidad Carnegie Mellon como profesor asistente de ciencias de la computación en 1979, mudándose a Pittsburgh para comenzar su carrera académica. Fue nombrado profesor titular en 1987, convirtiéndose en el profesor catedrático más joven de la Escuela de Ciencias de la Computación en ese momento. En 1995, recibió la cátedra dotada Allen Newell, y en 2012 fue nombrado Profesor Universitario, una distinción rara que reconocía sus contribuciones excepcionales.
Estuvo afiliado con varios departamentos en Carnegie Mellon, incluyendo el Instituto de Tecnologías del Lenguaje, el Departamento de Ciencias de la Computación, el Departamento de Aprendizaje Automático, y el Departamento de Biología Computacional. Carbonell sirvió como director fundador del Instituto de Tecnologías del Lenguaje, que creció hasta convertirse en la institución global preeminente para estudios del lenguaje, con más de $12 millones en financiamiento anual y 200 investigadores. El instituto logró los máximos honores en traducción automática, motores de búsqueda, síntesis de voz, y educación, y su modelo fue adoptado posteriormente por instituciones en Alemania (DFKI), Japón(Universidad de Tokio) y los Estados Unidos(Johns Hopkins.
Contribuciones de Investigación
Los intereses de investigación de Carbonell fueron amplios, abarcando inteligencia artificial, tecnologías del lenguaje, y aprendizaje automático. Hizo importantes contribuciones técnicas en varios campos, incluyendo la creación de la tecnología MMR para el resumen de textos y la detección de novedades informativas en motores de búsqueda. Este trabajo se volvió fundamental para los sistemas modernos de recuperación de información, influyendo en cómo los motores de búsqueda clasifican y presentan resultados.
Inventó la analogía transformacional y derivacional, métodos generalizados para el razonamiento basado en casos que permiten a los sistemas reutilizar, modificar, y componer planes exitosos pasados para problemas cada vez más complejos. En traducción automática, desarrolló enfoques interlingüísticos basados en conocimiento y posteriormente trabajó en métodos estadísticos y basados en ejemplos entrenables, incluyendo un método simétrico de alineación frasal óptima. Sus equipos lograron varios primeros notables:el primer sistema de traducción automática interlingüística escalable y de alta precisión en 1991, el primer sistema de traducción automática de voz a voz en 1992, y el primer spider y motor de búsqueda a gran escala en 1994.
Carbonell también contribuyó a la bioinformática, desarrollando campos aleatorios condicionales vinculados para predecir pliegues de proteínas terciarios y cuaternarios. Fue instrumental en el establecimiento del Programa de Biolingüística Computacional, una empresa conjunta entre Carnegie Mellon y la Universidad de Pittsburgh que combinaba tecnologías del lenguaje y aprendizaje automático para modelar estructuras 3D genómicas, proteómicas, y glicómicas. Su equipo logró el primer predictor entrenable y a gran escala de topología de estructura de proteínas en 2005.
Pionero del Aprendizaje Automático
Carbonell fue un cofundador del aprendizaje automático moderno, trabajando junto a Ryszard Michalski y Tom Mitchell para establecer el campo como una disciplina distinta. Comenzando en 1980, coeditó los primeros tres libros sobre aprendizaje automático, incluyendo el seminal "Machine Learning: An Artificial Intelligence Approach" (1983)y su segundo volumen(1986). Organizó las primeras cuatro conferencias de aprendizaje automático, comenzando con el taller de 1981 en Carnegie Mellon, y fue cofundador y editor en jefe del Machine Learning Journal.
Su trabajo en aprendizaje automático incluyó aprendizaje automático proactivo para aprendizaje activo sensible al costo de múltiples fuentes, aprendizaje de espacio de versiones sembrado, y modelado de anomalías de series para detección de fraude financiero y vigilancia sindrómica. Estas contribuciones ayudaron a establecer el aprendizaje automático como una tecnología habilitadora fundamental en motores de búsqueda, minería de datos, y redes sociales.
Emprendimiento e Impacto
Las innovaciones de Carbonell llevaron a varias empresas emergentes exitosas. Estuvo involucrado con Carnegie Group, que se centró en sistemas expertos de IA; Lycos, un motor de búsqueda web fundado por su estudiante de doctorado Michael Mauldin; Wisdom, que aplicaba optimización financiera y aprendizaje automático; Carnegie Speech, que desarrollaba sistemas de tutoría de lenguaje hablado; Dynamix, que se especializaba en minería de datos y descubrimiento de patrones; y Meaningful Machines, que trabajaba en traducción automática basada en contexto. Estas empresas demostraron su capacidad para traducir la investigación académica en aplicaciones prácticas con impacto comercial.
Premios y Honores
Carbonell recibió numerosos premios a lo largo de su carrera. Fue elegido miembro de la Asociación para el Avance de la Inteligencia Artificial(AAAI)en 1991. Recibió el Premio Okawa en 2015 por sus contribuciones a la investigación en información y telecomunicaciones. En 1997, ganó un premio al mejor artículo por"Translingual Search"con Yang en la Conferencia Internacional Conjunta sobre IA. Anteriormente en su carrera, recibió el premio de enseñanza Herbert Simon en 1986, la Beca Sperry por excelencia en investigación de IA en 1986, y el premio de enseñanza de ciencias de la computación en Carnegie Mellon en 1987. También sirvió como presidente del Grupo de Interés Especial de la ACM sobre Inteligencia Artificial(SIGART)desde 1983 hasta 1985, recibiendo un premio de"Reconocimiento de Servicio"de la ACM. En 1990, proporcionó testimonio congresional sobre traducción automática, reflejando su influencia en discusiones de política nacional.
Legado
Carbonell escribió más de 300 artículos técnicos y dio más de 500 presentaciones invitadas o revisadas durante su carrera. Murió después de una larga enfermedad el 28 de febrero de 2020. Su legado continúa a través del Instituto de Tecnologías del Lenguaje en Carnegie Mellon,que sigue siendo un centro líder para la investigación en procesamiento de lenguaje natural. Sus contribuciones a la traducción automática, el resumen de textos, y el aprendizaje automático han tenido un impacto duradero en el campo, influyendo en desarrollos posteriores en aprendizaje profundo y grandes modelos de lenguaje. En 2023, Mona Talat Diab se convirtió en la directora del Instituto de Tecnologías del Lenguaje, continuando la tradición de liderazgo que Carbonell estableció.