Getty Images apresentou um processo judicial contra Stability AI no Tribunal de Distrito dos Estados Unidos para o Distrito de Delaware em 3 de fevereiro de 2023. O caso centra-se em alegações de que Stability AI, a desenvolvedora do modelo Stable Diffusion, copiou milhões de imagens protegidas por direitos de autor da base de dados de Getty sem autorização para treinar seu sistema de IA generativa. O processo busca danos legais, medidas cautelares e a destruição dos dados de treinamento e modelos supostamente infractores.
Getty Images, uma importante agência de fotografia de stock, afirma que Stability AI extrajo seu site e utilizó suas imágenes con marca de agua para entrenar Stable Diffusion, que puede generar nuevas imágenes bajo demanda. La denuncia sostiene que el modelo de IA reproduce el contenido protegido por derechos de autor de Getty de maneras que violan la ley de derechos de autor de los Estados Unidos, incluida la infracción directa y contributiva. Stability AI ha argumentado que su uso de imágenes disponibles públicamente constituye un uso justo, una defensa que ha sido central en otras disputas de derechos de autor relacionadas con la IA.
Antecedentes y Partes
Getty Images, con sede en Seattle, Washington, es un proveedor líder de fotografías de stock, imágenes editoriales y material de video. La empresa otorga licencias de su contenido a medios de comunicación, anunciantes y profesionales creativos. Stability AI, fundada en 2020 y con sede en Londres, es una empresa de investigación en IA conocida por lanzar Stable Diffusion, un modelo de texto a imagen de código abierto que ganó gran atención en 2022. El modelo fue entrenado con un gran conjunto de datos llamado LAION-5B, que contenía miles de millones de pares de imagen y texto extraídos de internet, incluidas imágenes de las colecciones de Getty.
La demanda fue presentada en el Tribunal de Distrito de los Estados Unidos para el Distrito de Delaware, un foro común para litigios corporativos. El caso fue asignado al juez Richard G. Andrews. Getty Images también presentó una demanda relacionada en el Tribunal Superior de Justicia de Londres en enero de 2023, alegando infracción de derechos de autor bajo la ley del Reino Unido.
Reclamaciones Legales
La denuncia de Getty incluye varias causas de acción bajo la ley de derechos de autor de los Estados Unidos. Las reclamaciones principales son infracción directa de derechos de autor, infracción contributiva e infracción vicaria. Getty alega que Stability AI copió directamente sus imágenes durante el proceso de entrenamiento y que el modelo resultante permite a los usuarios generar imágenes que infringen los derechos de autor de Getty. La empresa también afirma que Stability AI eliminó o alteró información de gestión de derechos de autor, como marcas de agua, en violación de la Ley de Derechos de Autor del Milenio Digital (DMCA).
Getty busca daños legales de hasta $150,000 por obra infringida, lo que podría ascender a miles de millones de dólares dada la escala de la copia alegada. La empresa también solicita una orden judicial para impedir que Stability AI use sus imágenes en entrenamientos futuros y para exigir la destrucción del modelo entrenado y sus derivados.
Defensa de Stability AI
Stability AI ha respondido afirmando que su uso de imágenes para entrenamiento constituye un uso justo bajo la ley de los Estados Unidos. La empresa argumenta que las imágenes se utilizan con fines transformadores, ya que el modelo no almacena ni reproduce las imágenes originales, sino que aprende patrones estadísticos. Stability AI también sostiene que los datos de entrenamiento están disponibles públicamente y que la empresa no copió directamente ninguna imagen específica. La defensa se basa en los factores de uso justo: el propósito y carácter del uso, la naturaleza de la obra protegida, la cantidad y sustancialidad de la porción utilizada y el efecto en el mercado potencial.
Expertos legales han señalado que el resultado de este caso podría sentar un precedente para el uso de material protegido por derechos de autor en el entrenamiento de aprendizaje automático. El caso es uno de varios procesos judiciales de alto perfil contra empresas de IA, incluidas acciones de autores y artistas contra OpenAI y otros desarrolladores.
Historia Procesal
Después de que se presentara la denuncia, el tribunal otorgó una moción para suspender el descubrimiento de pruebas pendiente de una decisión sobre la moción de desestimación. Stability AI presentó una moción de desestimación en mayo de 2023, argumentando que el tribunal carecía de jurisdicción personal y que las reclamaciones no estaban suficientemente fundamentadas. En julio de 2023, el juez Andrews denegó la moción en parte, permitiendo que el caso continuara en la mayoría de las reclamaciones. El tribunal consideró que Getty había alegado de manera plausible que Stability AI había dirigido deliberadamente sus actividades hacia los Estados Unidos, dado que el modelo estaba disponible para usuarios estadounidenses y que Stability AI tenía inversores con sede en los Estados Unidos.
A principios de 2024, el tribunal ordenó a las partes participar en mediación, pero no se alcanzó ningún acuerdo. El caso se encuentra actualmente en la fase de descubrimiento de pruebas, con ambas partes intercambiando evidencia e informes de expertos. Aún no se ha fijado una fecha para el juicio, pero los observadores esperan que el caso se decida en 2025 o más tarde.
Litigios Relacionados y Contexto
La demanda de Getty es parte de una ola más amplia de desafíos legales a los sistemas de IA generativa. En enero de 2023, tres artistas presentaron una demanda colectiva contra Stability AI, Midjourney y DeviantArt, alegando violaciones similares de derechos de autor. Ese caso, Andersen v. Stability AI, fue parcialmente desestimado en octubre de 2023, pero el tribunal permitió a los artistas enmendar su denuncia. En diciembre de 2023, The New York Times demandó a OpenAI y Microsoft por infracción de derechos de autor por el uso de sus artículos en el entrenamiento de modelos de lenguaje de gran tamaño. Estos casos se observan de cerca porque podrían definir los límites del uso justo para el entrenamiento de IA.
El caso de Getty es notable porque la empresa tiene una gran biblioteca de imágenes con licencia y ha adoptado una postura proactiva contra las empresas de IA. En 2022, Getty prohibió la carga de imágenes generadas por IA en su plataforma y se ha asociado con otras agencias de stock para crear modelos de licencia para datos de entrenamiento de IA.
Implicaciones para la Industria de la IA
El resultado de Getty v. Stability AI podría tener implicaciones significativas para la industria de la inteligencia artificial. Si el tribunal dictamina que entrenar con imágenes protegidas por derechos de autor sin permiso no es uso justo, los desarrolladores de IA podrían necesitar obtener licencias para los datos de entrenamiento, lo que podría aumentar los costos y frenar la innovación. Por el contrario, un fallo a favor de Stability AI podría reforzar la práctica de extraer datos disponibles públicamente para el entrenamiento, que es común en el campo.
Algunas empresas ya han comenzado a licenciar contenido para el entrenamiento de IA. Por ejemplo, OpenAI ha firmado acuerdos con editores como Axel Springer y Associated Press. La propia Getty Images ha lanzado su propia herramienta de IA generativa, entrenada con su contenido con licencia, para ofrecer a los clientes una alternativa legalmente segura. El caso también podría influir en el desarrollo de técnicas de aumento de datos y el uso de datos sintéticos para reducir la dependencia de material protegido por derechos de autor.
Estado Actual y Perspectivas Futuras
A principios de 2025, el caso sigue pendiente en el tribunal de distrito de Delaware. Las partes han intercambiado divulgaciones iniciales y están llevando a cabo el descubrimiento de hechos. El tribunal aún no se ha pronunciado sobre la defensa de uso justo, que probablemente se decidirá mediante sentencia sumaria o en el juicio. Los analistas legales esperan que el caso sea apelado independientemente del resultado, lo que significa que una resolución final podría tardar años.
El caso también se observa a nivel internacional, ya que han surgido disputas similares en el Reino Unido y Europa. En el Reino Unido, la demanda paralela de Getty aún se encuentra en etapas tempranas. La Ley de IA de la Unión Europea, adoptada en 2024, incluye requisitos de transparencia para los datos de entrenamiento, pero no resuelve las cuestiones de derechos de autor.
Mientras tanto, la comunidad de aprendizaje automático continúa debatiendo la ética de entrenar con datos protegidos por derechos de autor. Algunos investigadores abogan por conjuntos de datos abiertos y licencias permisivas, mientras que otros piden una regulación más estricta. El caso Getty probablemente será un hito en esta conversación en curso, moldeando cómo las empresas de IA abordan la adquisición de datos y el cumplimiento de los derechos de autor.
Conclusión
Getty v. Stability AI (EE. UU.) es un proceso judicial de derechos de autor fundamental que pone a prueba la legalidad de usar imágenes protegidas por derechos de autor para entrenar modelos de IA. El caso plantea preguntas fundamentales sobre la naturaleza del aprendizaje profundo y los derechos de los creadores de contenido. Su resultado influirá no solo en las partes involucradas, sino también en el ecosistema más amplio de la IA generativa y el futuro de las industrias creativas. A medida que avanza el litigio, las partes interesadas en tecnología, derecho y artes observarán de cerca una decisión que podría redefinir los límites del uso justo en la era de la inteligencia artificial.