La Oficina de Derechos de Autor de los Estados Unidos (USCO), una unidad de la Biblioteca del Congreso, ha examinado el uso de obras protegidas por derechos de autor en el entrenamiento de sistemas de inteligencia artificial. Sus hallazgos, publicados en una serie de informes a partir de 2024, abordan si la ley de derechos de autor existente se aplica y cómo a la ingesta de materiales protegidos por modelos de aprendizaje automático, incluidos los grandes modelos de lenguaje y otras herramientas de IA generativa. El análisis de la Oficina se ha convertido en un punto de referencia para discusiones legislativas y judiciales sobre IA y propiedad intelectual.
El papel de la Oficina de Derechos de Autor en esta área deriva de su mandato más amplio de administrar la ley de derechos de autor de EE. UU. y asesorar al Congreso. Como parte del poder legislativo, no hace cumplir los derechos de autor, pero proporciona recomendaciones de políticas y registra reclamaciones. Sus informes sobre datos de entrenamiento de IA se han basado en comentarios públicos, testimonios de expertos y comparaciones internacionales, con el objetivo de aclarar el panorama legal sin prescribir nueva legislación a menos que el Congreso lo solicite.
Antecedentes: Derechos de autor y entrenamiento de IA
Entrenar un modelo de IA típicamente implica alimentar grandes conjuntos de datos de texto, imágenes u otras obras en una arquitectura de red neuronal o transformador. Este proceso, conocido como aprendizaje automático, permite que el modelo reconozca patrones y genere nuevas salidas. Los conjuntos de datos a menudo incluyen libros, artículos, fotografías y obras de arte protegidos por derechos de autor, lo que plantea preguntas sobre si dicho uso constituye infracción o cae bajo excepciones como el uso justo.
Antes de la participación de la USCO, los tribunales habían comenzado a abordar estos problemas en casos que involucran a empresas como OpenAI y Anthropic, pero no había surgido un estándar uniforme. Los informes de la Oficina de Derechos de Autor tienen como objetivo proporcionar una visión general completa de los principios legales y las implicaciones prácticas, ayudando a guiar tanto a los responsables políticos como a las partes interesadas.
La Notificación de Investigación de 2023
En agosto de 2023, la Oficina de Derechos de Autor emitió una notificación de investigación en el Registro Federal, solicitando comentarios públicos sobre derechos de autor e IA, centrándose específicamente en los datos de entrenamiento. La investigación preguntó sobre la naturaleza del entrenamiento de IA, el grado en que se utilizan obras protegidas y los argumentos legales a favor y en contra de la responsabilidad. Se presentaron más de 10,000 comentarios de individuos, empresas, instituciones académicas y grupos de defensa, reflejando las altas apuestas del tema.
La Oficina también celebró sesiones de escucha con partes interesadas, incluidos creadores, empresas tecnológicas y expertos legales. Estas sesiones destacaron puntos de vista divergentes: algunos argumentaron que entrenar con obras protegidas sin permiso es un uso justo transformador, mientras que otros sostuvieron que requiere licencias o compensación. Los comentarios y sesiones informaron el informe posterior.
El Informe de 2024: Derechos de autor e inteligencia artificial
En marzo de 2024, la Oficina de Derechos de Autor publicó la primera parte de su informe, titulado "Derechos de autor e inteligencia artificial", centrándose en réplicas digitales y el uso de obras protegidas en el entrenamiento. El informe concluyó que la ley de derechos de autor existente, particularmente la doctrina del uso justo, puede aplicarse al entrenamiento de IA, pero se negó a respaldar una exención general o una nueva licencia obligatoria. En cambio, enfatizó un análisis caso por caso, considerando factores como el propósito del uso, la naturaleza de la obra protegida, la cantidad utilizada y el efecto en el mercado.
El informe señaló que el proceso de aprendizaje profundo a menudo implica copiar obras completas en conjuntos de datos de entrenamiento, lo que puede pesar en contra del uso justo, pero también reconoció que la naturaleza transformadora de las salidas de IA podría respaldar una defensa. La Oficina recomendó que el Congreso monitoree los desarrollos y considere legislación específica si es necesario, pero se detuvo antes de proponer cambios estatutarios específicos.
Hallazgos clave sobre datos de entrenamiento
Los hallazgos clave del informe sobre datos de entrenamiento incluyen:
- Ingesta como reproducción: Entrenar un modelo de IA típicamente implica hacer copias de obras, lo que implica el derecho de reproducción bajo la ley de derechos de autor.
- El uso justo no es automático: La Oficina rechazó el argumento de que el entrenamiento de IA es inherentemente uso justo, enfatizando que cada caso debe evaluarse según sus hechos.
- Impacto en el mercado: El informe consideró si el entrenamiento de IA daña o beneficia el mercado de obras originales, señalando que este factor a menudo es disputado.
- Transparencia y procedencia: La Oficina fomentó la divulgación voluntaria de fuentes de datos de entrenamiento, pero no la exigió, citando desafíos prácticos.
Estos hallazgos han sido citados en litigios en curso, como las demandas presentadas por autores contra empresas de IA, y en audiencias del Congreso sobre políticas de IA.
La Actualización de 2025 y Trabajo en Curso
A principios de 2025, la Oficina de Derechos de Autor emitió un informe de seguimiento que aborda réplicas digitales y la intersección con los derechos de publicidad estatales. También anunció planes para examinar otros aspectos de la IA, incluida la protegibilidad de las salidas generadas por IA. El trabajo de la Oficina se ha visto complicado por una disputa de liderazgo: en mayo de 2025, el presidente Donald Trump afirmó haber despedido a la registradora Shira Perlmutter, pero el puesto es un empleado del Congreso, y la autoridad de Perlmutter ha sido confirmada en los tribunales. Esta incertidumbre ha planteado preguntas sobre la continuidad de las iniciativas de IA de la Oficina.
A pesar de la disputa, la Oficina ha continuado publicando orientación y participando en discusiones internacionales, como las de la Organización Mundial de la Propiedad Intelectual. Sus informes siguen siendo un recurso clave para comprender cómo se aplica la ley de derechos de autor de EE. UU. al entrenamiento de IA.
Implicaciones para la industria y las políticas
Los hallazgos de la USCO tienen implicaciones significativas para los desarrolladores de IA, creadores de contenido y responsables políticos. Para empresas como OpenAI, Anthropic y Google DeepMind, los informes aclaran que no pueden asumir protección de uso justo, lo que potencialmente aumenta la necesidad de acuerdos de licencia o cambios en las prácticas de entrenamiento. Para los creadores, los informes afirman que sus obras están protegidas, pero también destacan la dificultad de hacer cumplir los derechos contra procesos de entrenamiento opacos.
Legislativamente, los informes han informado proyectos de ley propuestos, como la Ley de Divulgación de Derechos de Autor de IA Generativa, que requeriría que las empresas de IA divulguen sus datos de entrenamiento. La Oficina de Derechos de Autor no ha respaldado este proyecto de ley específico, pero ha apoyado la idea de transparencia como objetivo de política.
Críticas y debates
El enfoque de la Oficina de Derechos de Autor ha enfrentado críticas de ambos lados. Algunos defensores de la tecnología argumentan que los informes son demasiado cautelosos y podrían sofocar la innovación, mientras que algunos grupos de creadores sostienen que no van lo suficientemente lejos en la protección de derechos. Los académicos legales también han debatido la interpretación de la Oficina del uso justo, con algunos argumentando que el enfoque caso por caso es poco práctico para la escala del entrenamiento de IA.
Otro punto de controversia es el papel de la propia Oficina de Derechos de Autor. Como parte de la Biblioteca del Congreso, opera dentro del poder legislativo, pero su papel consultivo no es vinculante para los tribunales. Los informes son influyentes, pero no tienen fuerza de ley, y los tribunales pueden llegar a conclusiones diferentes.
Direcciones futuras
De cara al futuro, se espera que la Oficina de Derechos de Autor continúe su trabajo en IA, con informes adicionales sobre protegibilidad y posibles recomendaciones legislativas. El resultado de la disputa de liderazgo puede afectar las prioridades de la Oficina, pero su mandato de asesorar al Congreso permanece sin cambios. A medida que la tecnología de IA evolucione, la Oficina probablemente revisará sus hallazgos para abordar nuevos desafíos, como el uso de datos sintéticos y el impacto de la IA en las industrias creativas.
Por ahora, los informes de la USCO sobre datos de entrenamiento proporcionan un marco fundamental para navegar la compleja intersección de derechos de autor e inteligencia artificial. Subrayan la necesidad de un enfoque equilibrado que respete tanto la innovación como los derechos de los creadores, un objetivo que requerirá un diálogo continuo entre todas las partes interesadas.