Getty Images presentó una demanda contra Stability AI en el Tribunal de Distrito de los Estados Unidos para el Distrito de Delaware el 3 de febrero de 2023. El caso se centra en las acusaciones de que Stability AI, la desarrolladora del modelo Stable Diffusion, copió millones de imágenes con derechos de autor de la base de datos de Getty sin permiso para entrenar su sistema de Generative AI. La demanda busca daños legales, medidas cautelares y la destrucción de los datos de entrenamiento y los modelos supuestamente infractores.
Getty Images, una importante agencia de fotografía de archivo, afirma que Stability AI extrajo su sitio web y utilizó sus imágenes con marca de agua para entrenar a Stable Diffusion, que puede generar nuevas imágenes bajo demanda. La denuncia sostiene que el modelo de IA reproduce el contenido protegido por derechos de autor de Getty de maneras que violan la ley de derechos de autor de los EE. UU., incluyendo la infracción directa y la contributiva. Stability AI ha argumentado que su uso de imágenes disponibles públicamente constituye un uso justo, una defensa que ha sido central en otras disputas de derechos de autor relacionadas con la IA.
Antecedentes y Partes
Getty Images, con sede en Seattle, Washington, es un proveedor líder de fotografías de archivo, imágenes editoriales y material de video. La empresa otorga licencias de su contenido a medios de comunicación, anunciantes y profesionales creativos. Stability AI, fundada en 2020 y con sede en Londres, es una empresa de investigación en IA conocida por lanzar Stable Diffusion, un modelo de texto a imagen de código abierto que ganó gran atención en 2022. El modelo fue entrenado con un gran conjunto de datos llamado LAION-5B, que contenía miles de millones de pares de imagen y texto extraídos de internet, incluyendo imágenes de las colecciones de Getty.
La demanda fue presentada en el Tribunal de Distrito de los EE. UU. para el Distrito de Delaware, un foro común para litigios corporativos. El caso fue asignado al juez Richard G. Andrews. Getty Images también presentó una demanda relacionada en el Tribunal Superior de Justicia de Londres en enero de 2023, alegando infracción de derechos de autor según la ley del Reino Unido.
Reclamaciones Legales
La denuncia de Getty incluye varias causas de acción bajo la ley de derechos de autor de los EE. UU. Las reclamaciones principales son la infracción directa de derechos de autor, la infracción contributiva y la infracción vicaria. Getty alega que Stability AI copió directamente sus imágenes durante el proceso de entrenamiento, y que el modelo resultante permite a los usuarios generar imágenes que infringen los derechos de autor de Getty. La empresa también afirma que Stability AI eliminó o alteró la información de gestión de derechos de autor, como las marcas de agua, en violación de la Ley de Derechos de Autor del Milenio Digital (DMCA).
Getty busca daños legales de hasta $150,000 por obra infringida, lo que podría ascender a miles de millones de dólares dada la escala de la copia supuesta. La empresa también solicita una orden judicial para impedir que Stability AI use sus imágenes en futuros entrenamientos y para exigir la destrucción del modelo entrenado y sus derivados.
Defensa de Stability AI
Stability AI ha respondido afirmando que su uso de imágenes para el entrenamiento constituye un uso justo bajo la ley de los EE. UU. La empresa argumenta que las imágenes se utilizan con fines transformadores, ya que el modelo no almacena ni reproduce las imágenes originales, sino que aprende patrones estadísticos. Stability AI también sostiene que los datos de entrenamiento están disponibles públicamente y que la empresa no copió directamente ninguna imagen específica. La defensa se basa en los factores del uso justo: el propósito y el carácter del uso, la naturaleza de la obra protegida, la cantidad y la sustancialidad de la porción utilizada, y el efecto en el mercado potencial.
Los expertos legales han señalado que el resultado de este caso podría sentar un precedente para el uso de material protegido por derechos de autor en el entrenamiento de Machine learning. El caso es uno de varios juicios de alto perfil contra empresas de IA, incluyendo acciones de autores y artistas contra OpenAI y otros desarrolladores.
Historia Procesal
Después de que se presentara la denuncia, el tribunal concedió una moción para suspender el descubrimiento de pruebas pendiente de una decisión sobre la moción de desestimación. Stability AI presentó una moción para desestimar en mayo de 2023, argumentando que el tribunal carecía de jurisdicción personal y que las reclamaciones no estaban suficientemente fundamentadas. En julio de 2023, el juez Andrews denegó la moción en parte, permitiendo que el caso continuara en la mayoría de las reclamaciones. El tribunal consideró que Getty había alegado de manera plausible que Stability AI había dirigido deliberadamente sus actividades hacia los Estados Unidos, dado que el modelo estaba disponible para los usuarios estadounidenses y que Stability AI tenía inversores con sede en los EE. UU.
A principios de 2024, el tribunal ordenó a las partes participar en una mediación, pero no se alcanzó ningún acuerdo. El caso se encuentra actualmente en la fase de descubrimiento de pruebas, con ambas partes intercambiando evidencia e informes de expertos. Aún no se ha fijado una fecha para el juicio, pero los observadores esperan que el caso se decida en 2025 o más tarde.
Litigios Relacionados y Contexto
La demanda de Getty es parte de una ola más amplia de desafíos legales a los sistemas de Generative AI. En enero de 2023, tres artistas presentaron una demanda colectiva contra Stability AI, Midjourney y DeviantArt, alegando violaciones similares de derechos de autor. Ese caso, Andersen v. Stability AI, fue parcialmente desestimado en octubre de 2023, pero el tribunal permitió a los artistas enmendar su denuncia. En diciembre de 2023, The New York Times demandó a OpenAI y Microsoft por infracción de derechos de autor por el uso de sus artículos en el entrenamiento de Large language models. Estos casos se observan de cerca porque podrían definir los límites del uso justo para el entrenamiento de IA.
El caso de Getty es notable porque la empresa tiene una gran biblioteca de imágenes con licencia, y ha adoptado una postura proactiva contra las empresas de IA. En 2022, Getty prohibió la carga de imágenes generadas por IA en su plataforma, y se ha asociado con otras agencias de fotografía para crear modelos de licencia para datos de entrenamiento de IA.
Implicaciones para la Industria de la IA
El resultado de Getty v. Stability AI podría tener implicaciones significativas para la industria de la Artificial intelligence. Si el tribunal dictamina que el entrenamiento con imágenes protegidas por derechos de autor sin permiso no es un uso justo, los desarrolladores de IA podrían necesitar obtener licencias para los datos de entrenamiento, lo que podría aumentar los costos y frenar la innovación. Por el contrario, un fallo a favor de Stability AI podría reforzar la práctica de extraer datos disponibles públicamente para el entrenamiento, que es común en el campo.
Algunas empresas ya han comenzado a otorgar licencias de contenido para el entrenamiento de IA. Por ejemplo, OpenAI ha firmado acuerdos con editores como Axel Springer y Associated Press. La propia Getty Images ha lanzado su propia herramienta de IA generativa, entrenada con su contenido con licencia, para ofrecer a los clientes una alternativa legalmente segura. El caso también podría influir en el desarrollo de técnicas de Data Augmentation y el uso de datos sintéticos para reducir la dependencia de material protegido por derechos de autor.
Estado Actual y Perspectivas Futuras
A principios de 2025, el caso sigue pendiente en el tribunal de distrito de Delaware. Las partes han intercambiado divulgaciones iniciales y están llevando a cabo el descubrimiento de hechos. El tribunal aún no se ha pronunciado sobre la defensa del uso justo, que probablemente se decidirá mediante sentencia sumaria o en el juicio. Los analistas legales esperan que el caso sea apelado independientemente del resultado, lo que significa que una resolución final podría llevar años.
El caso también se observa a nivel internacional, ya que han surgido disputas similares en el Reino Unido y Europa. En el Reino Unido, la demanda paralela de Getty aún se encuentra en sus primeras etapas. La Ley de IA de la Unión Europea, adoptada en 2024, incluye requisitos de transparencia para los datos de entrenamiento, pero no resuelve las cuestiones de derechos de autor.
Mientras tanto, la comunidad de Machine learning continúa debatiendo la ética del entrenamiento con datos protegidos por derechos de autor. Algunos investigadores abogan por conjuntos de datos abiertos y licencias permisivas, mientras que otros piden una regulación más estricta. El caso Getty probablemente será un hito en esta conversación en curso, dando forma a cómo las empresas de IA abordan la adquisición de datos y el cumplimiento de los derechos de autor.
Conclusión
Getty v. Stability AI (EE. UU.) es un juicio fundamental sobre derechos de autor que pone a prueba la legalidad de usar imágenes protegidas para entrenar modelos de IA. El caso plantea preguntas fundamentales sobre la naturaleza del Deep learning y los derechos de los creadores de contenido. Su resultado influirá no solo en las partes involucradas, sino también en el ecosistema más amplio de la Generative AI y el futuro de las industrias creativas. A medida que el litigio avanza, las partes interesadas en la tecnología, el derecho y las artes observarán de cerca una decisión que podría redefinir los límites del uso justo en la era de la inteligencia artificial.