Centro para la IA Compatible con los Humanos

Traducido del inglés

El Centro para una IA Compatible con los Humanos (CHAI) es un centro de investigación en la UC Berkeley fundado en 2016 por Stuart Russell para desarrollar métodos que alineen la inteligencia artificial con los valores e intenciones humanas.

El Centro para la Inteligencia Artificial Compatible con los Humanos (CHAI) es un centro de investigación en la Universidad de California, Berkeley centrado en desarrollar métodos para garantizar que los sistemas avanzados de inteligencia artificial estén alineados con los valores e intenciones humanas. Fundado en 2016, el centro aborda el desafío a largo plazo de crear una IA que siga siendo beneficiosa a medida que sus capacidades crecen, con un énfasis particular en la alineación de valores y el comportamiento controlable de las máquinas.

El centro fue establecido por un grupo de académicos liderados por Stuart J. Russell, profesor de ciencias de la computación en Berkeley y coautor del libro de texto ampliamente utilizado Inteligencia Artificial: Un Enfoque Moderno. Russell ha sido una voz prominente en los debates sobre seguridad de la IA, argumentando que el paradigma actual de optimizar objetivos fijos puede producir sistemas cuyo comportamiento diverge de las preferencias humanas genuinas.

Enfoque de Investigación

La estrategia central de investigación de CHAI se centra en la alineación de valores, particularmente a través del aprendizaje por refuerzo inverso. En este enfoque, los sistemas de IA infieren valores humanos no a partir de instrucciones explícitas o funciones de recompensa, sino observando el comportamiento humano. El objetivo es crear una IA que pueda aprender lo que las personas realmente quieren, incluidas preferencias que pueden tener dificultades para articular directamente.

El centro también ha investigado la dinámica de la interacción humano-máquina en escenarios donde un agente inteligente tiene un "interruptor de apagado" que podría anular. Esta línea de investigación examina cómo se podría diseñar la IA para que permanezca deferente al control humano, enseñando esencialmente a los sistemas a reconocer cuándo deberían permitir que se los apague.

Facultad y Colaboradores

La membresía de la facultad de CHAI abarca múltiples instituciones. Junto a Russell, los miembros con sede en Berkeley incluyen a Pieter Abbeel y Anca Dragan. El centro también incluye a Bart Selman y Joseph Halpern de la Universidad de Cornell, Michael Wellman y Satinder Singh Baveja de la Universidad de Michigan, y Tom Griffiths y Tania Lombrozo de la Universidad de Princeton. Esta composición interdisciplinaria reúne experiencia en ciencias de la computación, ciencias cognitivas y filosofía.

El centro ha establecido asociaciones más allá del ámbito académico, incluidas colaboraciones con el Foro Económico Mundial y su Consejo Global de IA. Estas conexiones buscan traducir los hallazgos de la investigación en discusiones políticas y prácticas industriales.

Historial de Financiación

La financiación inicial de CHAI llegó en 2016, cuando el Proyecto de Filantropía Abierta recomendó que Good Ventures proporcionara $5,555,550 en apoyo durante cinco años. Desde entonces, CHAI ha recibido subvenciones adicionales de OpenPhil y Good Ventures que superan los $12,000,000 en total. Este respaldo financiero sostenido ha permitido al centro apoyar a estudiantes de posgrado, investigadores posdoctorales y esfuerzos de investigación multiinstitucionales.

Publicaciones y Producción

Los investigadores afiliados a CHAI han publicado extensamente sobre temas como el aprendizaje de recompensas, la corregibilidad y los límites de la especificación en sistemas de IA. El trabajo del centro ha aparecido en las principales conferencias de aprendizaje automático e IA, y sus hallazgos han informado debates más amplios sobre el riesgo existencial de la inteligencia artificial general. El libro de Russell de 2019 Human Compatible sintetiza muchas de las ideas del centro, presentando de forma accesible el argumento de que la IA debería diseñarse con incertidumbre sobre las preferencias humanas como principio central.

Impacto y Legado

El centro ha contribuido al crecimiento de la seguridad de la IA como un campo reconocido dentro de la investigación de aprendizaje profundo e IA. Su énfasis en marcos formales rigurosos ha influido en cómo los investigadores abordan problemas como el hackeo de recompensas y el juego de especificaciones. A medida que los grandes modelos de lenguaje y otros sistemas avanzados se han vuelto más capaces, las preguntas que CHAI planteó originalmente sobre la alineación han pasado de ser una preocupación teórica a un desafío práctico de ingeniería, con implicaciones para organizaciones como OpenAI y Anthropic.

Véase También

  • Riesgo existencial de la inteligencia artificial general
  • Instituto de Investigación de Inteligencia de Máquinas
  • Instituto del Futuro de la Humanidad
  • Instituto del Futuro de la Vida

Enlaces Externos

Sitio web oficial

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:artificial-intelligence-safety·research-center·university-of-california-berkeley·value-alignment
Esta página se editó por última vez el 5 sept 2026 por AI Wiki Bot · Historial