El Instituto de Seguridad de IA de EE. UU. (US AISI) es una organización respaldada por el estado, establecida en noviembre de 2023 bajo el Instituto Nacional de Estándares y Tecnología (NIST), una agencia del Departamento de Comercio de EE. UU. Su misión principal es evaluar y garantizar la seguridad de los modelos avanzados de inteligencia artificial (IA), en particular aquellos conocidos como modelos de IA fronteriza. El instituto fue fundado durante la Cumbre de Seguridad de IA celebrada en el Reino Unido, donde tanto el Reino Unido como EE. UU. anunciaron la creación de sus respectivos organismos de seguridad de IA. Esto marcó un paso significativo en el esfuerzo global para abordar los riesgos potenciales asociados con las tecnologías de IA en rápido avance, incluidos los modelos de lenguaje grandes y otros sistemas de IA generativa.
El establecimiento del US AISI reflejó un reconocimiento creciente en 2023 de los posibles riesgos existenciales planteados por la IA, como destacaron las declaraciones públicas de investigadores y líderes de la industria. El instituto opera dentro del NIST, aprovechando la experiencia de la agencia en estándares de medición y evaluación de tecnología. Su trabajo se centra en desarrollar metodologías de prueba, realizar evaluaciones de seguridad y colaborar con otros organismos nacionales e internacionales para crear un marco coherente para la supervisión de la IA. El US AISI forma parte de una red internacional más amplia de institutos de seguridad de IA que surgió de los esfuerzos diplomáticos en 2023 y 2024.
Fundación y Mandato Inicial
El US AISI fue creado formalmente el 1 de noviembre de 2023, durante la Cumbre de Seguridad de IA en Bletchley Park, en el Reino Unido. La cumbre, organizada por el entonces Primer Ministro Rishi Sunak, reunió a representantes de gobiernos, empresas de IA e instituciones académicas para discutir el desarrollo seguro de la IA fronteriza. El gobierno de EE. UU., a través del NIST, se comprometió a establecer un instituto dedicado a realizar investigaciones y evaluaciones sobre la seguridad de la IA. El enfoque inicial del instituto fue desarrollar procedimientos de prueba estandarizados para modelos de IA, incluidas evaluaciones de capacidades en áreas como el aprendizaje automático, el aprendizaje profundo y las redes neuronales.
En sus primeros meses, el US AISI trabajó para definir su papel dentro del panorama más amplio de la política de IA de EE. UU. Se coordinó con otras agencias federales, incluida la Oficina de Política Científica y Tecnológica de la Casa Blanca, para alinear sus actividades con las prioridades nacionales. El instituto también comenzó a colaborar con los principales desarrolladores de IA, como OpenAI, Anthropic y Google DeepMind, para obtener acceso a sus modelos más avanzados para pruebas de seguridad previas al despliegue. Este enfoque colaborativo buscaba abordar las preocupaciones de que las empresas de IA no pudieran "calificar su propio trabajo" de manera confiable en términos de evaluaciones de seguridad.
Colaboración con el Instituto de Seguridad de IA del Reino Unido
Un aspecto clave del trabajo inicial del US AISI fue su asociación con el Instituto de Seguridad de IA del Reino Unido (UK AISI), que se estableció simultáneamente durante la cumbre de noviembre de 2023. Los dos institutos acordaron colaborar en el desarrollo de reglas y procedimientos de evaluación comunes, reconociendo que un enfoque unificado sería más efectivo que los esfuerzos nacionales fragmentados. En abril de 2024, EE. UU. y el Reino Unido concluyeron formalmente un acuerdo para realizar al menos una prueba de seguridad conjunta en un modelo de IA compartido. Esta colaboración se consideró un modelo para la cooperación internacional en la gobernanza de la IA.
La asociación también implicó compartir hallazgos de investigación y metodologías. El US AISI y el UK AISI exploraron conjuntamente cuestiones como la robustez de los modelos, la alineación con los valores humanos y el potencial de los sistemas de IA para filtrar información sensible o ser explotados para ciberataques. Su trabajo informó el desarrollo de estándares internacionales, y el UK AISI anunció en mayo de 2024 que abriría una oficina en San Francisco para estar más cerca de las principales empresas de IA, un movimiento que complementó la ubicación del US AISI dentro del NIST.
Formación de la Red Internacional
En la Cumbre de IA de Seúl en mayo de 2024, los líderes internacionales acordaron formar una red de institutos de seguridad de IA, basándose en la cooperación bilateral entre EE. UU. y el Reino Unido. La red inicialmente comprendía institutos del Reino Unido, EE. UU., Japón, Francia, Alemania, Italia, Singapur, Corea del Sur, Australia, Canadá y la Unión Europea. El US AISI desempeñó un papel central en esta red, ayudando a coordinar proyectos de investigación conjuntos y ejercicios de evaluación. En julio de 2025, la red realizó un ejercicio para explorar problemas en la evaluación de agentes de IA, particularmente en relación con la fuga de información sensible y los riesgos de ciberseguridad. Los miembros de la red también se reunieron en NeurIPS 2025 en San Diego para discutir desafíos emergentes.
La participación del US AISI en la red internacional fue parte de un esfuerzo más amplio para establecer normas globales para la seguridad de la IA. El instituto contribuyó a discusiones sobre temas como las arquitecturas de transformadores, la atención de múltiples cabezas y otros aspectos técnicos de los sistemas de IA, asegurando que las evaluaciones de seguridad siguieran el ritmo de los rápidos avances en el campo. La red también abordó cuestiones de gobernanza, incluido cómo equilibrar la innovación con medidas de precaución.
Evolución y Renombramiento
En 2025, el US AISI experimentó un cambio organizativo significativo. Fue renombrado como Centro para Estándares e Innovación en IA (CAISI), reflejando un cambio de enfoque hacia el desarrollo de estándares y la promoción de la innovación en la seguridad de la IA. El renombramiento fue parte de una tendencia más amplia, ya que el Instituto de Seguridad de IA del Reino Unido también fue renombrado como Instituto de Seguridad de IA en el mismo año. El cambio señaló una transición de evaluaciones puramente centradas en la seguridad a un enfoque más integral que incluía fomentar el desarrollo y despliegue responsable de la IA.
La transición a CAISI no alteró la misión central del instituto, pero amplió su alcance. Continuó realizando evaluaciones de seguridad de modelos de IA fronteriza, pero también comenzó a trabajar más estrechamente con la industria para desarrollar mejores prácticas y estándares voluntarios. Esta evolución se consideró una respuesta a la creciente madurez del campo de la IA y la necesidad de una supervisión continua a medida que los sistemas de IA se integraban más en diversos sectores, incluidos la atención médica, el transporte y las finanzas.
Áreas de Enfoque Técnico
El trabajo técnico del US AISI abarca varias áreas de investigación y desarrollo de IA. Evalúa los modelos en busca de posibles sesgos, robustez frente a entradas adversarias y alineación con los comportamientos previstos. El instituto también investiga la interpretabilidad de los sistemas de IA, buscando comprender cómo las redes neuronales toman decisiones. Esto incluye estudiar técnicas como la normalización de capas, la normalización por lotes y el abandono para mejorar la fiabilidad de los modelos.
Otro enfoque es la seguridad de los agentes de IA, que son sistemas capaces de tomar decisiones autónomas. El US AISI ha explorado escenarios donde los agentes de IA podrían filtrar información sensible o ser manipulados para realizar acciones dañinas. También ha examinado las implicaciones de RLAIF y otros métodos de entrenamiento que dependen de retroalimentación generada por IA, lo que puede introducir sesgos o errores sutiles. La investigación del instituto contribuye al desarrollo de puntos de referencia de evaluación y protocolos de prueba utilizados tanto por el gobierno como por la industria.
Impacto y Direcciones Futuras
La fundación del US AISI ha tenido un impacto significativo en el panorama de la política de IA. Ha proporcionado un mecanismo gubernamental para la supervisión independiente de las tecnologías de IA, complementando los esfuerzos de autorregulación de las empresas. El trabajo del instituto ha informado propuestas legislativas y regulatorias, tanto en EE. UU. como a nivel internacional. A partir de 2025, el instituto continúa evolucionando, con planes para expandir sus capacidades de investigación y profundizar sus colaboraciones internacionales.
De cara al futuro, el US AISI (ahora CAISI) enfrenta desafíos relacionados con el rápido ritmo del desarrollo de la IA, incluida la aparición de modelos más capaces y nuevas aplicaciones. También debe navegar preguntas sobre el equilibrio apropiado entre seguridad e innovación, así como la asignación de recursos entre prioridades en competencia. El éxito del instituto dependerá de su capacidad para adaptarse a circunstancias tecnológicas y políticas cambiantes mientras mantiene su credibilidad como evaluador independiente de los sistemas de IA.