Demanda de NYT contra OpenAI

Traducido del inglés

Demanda por infracción de derechos de autor presentada por The New York Times contra OpenAI y Microsoft en diciembre de 2023, alegando el uso no autorizado de artículos protegidos por derechos de autor para entrenar modelos de IA. El caso busca daños y perjuicios y la destrucción de los conjuntos de datos infractores.

The New York Times Company presentó una demanda contra OpenAI y Microsoft en diciembre de 2023, alegando que las empresas utilizaron millones de artículos periodísticos protegidos por derechos de autor sin permiso para entrenar sus modelos de lenguaje de gran tamaño. La demanda, presentada ante el Tribunal de Distrito de los Estados Unidos para el Distrito Sur de Nueva York, afirma que los productos ChatGPT de OpenAI y Copilot de Microsoft reproducen artículos del Times de forma literal o con alteraciones mínimas cuando se les solicita, lo que socava la capacidad del periódico para monetizar su periodismo. El Times solicita daños legales, una orden judicial contra el uso adicional de su contenido y la destrucción de cualquier conjunto de datos que contenga sus artículos.

La demanda es uno de los desafíos legales más destacados contra la industria de la IA generativa, que ha dependido en gran medida de texto extraído de la web para su entrenamiento. El Times argumenta que su contenido se utilizó sin licencia, mientras que OpenAI y Microsoft sostienen que su uso se enmarca en la doctrina del uso justo, que permite la reproducción limitada de material protegido por derechos de autor para fines como comentarios o investigación. El caso ha atraído una atención generalizada porque su resultado podría reconfigurar cómo las empresas de IA obtienen datos de entrenamiento y si deben pagar a los editores por el acceso.

Antecedentes y Partes

The New York Times, fundado en 1851, es uno de los periódicos más grandes e influyentes de los Estados Unidos, con una base de suscripciones digitales que supera los 10 millones en 2023. OpenAI, establecida en 2015 como una organización sin fines de lucro y posteriormente reestructurada con una rama con fines de lucro, desarrolla el chatbot ChatGPT y la serie subyacente de modelos GPT. Microsoft ha invertido más de 13 mil millones de dólares en OpenAI desde 2019 y proporciona la infraestructura en la nube Azure utilizada para entrenar y desplegar los sistemas de OpenAI. Microsoft también integra la tecnología de OpenAI en su motor de búsqueda Bing y en su suite de productividad Office.

La demanda nombra tanto a OpenAI como a Microsoft como demandados, argumentando que la profunda participación financiera y técnica de Microsoft la hace igualmente responsable. El equipo legal del Times, liderado por el bufete de abogados Susman Godfrey, presentó la demanda el 27 de diciembre de 2023, después de meses de negociaciones fallidas con OpenAI sobre un posible acuerdo de licencia.

Alegaciones de Infracción de Derechos de Autor

La demanda detalla casos específicos en los que ChatGPT y Copilot de Microsoft supuestamente reprodujeron artículos del Times. Por ejemplo, cuando se le solicitó una pregunta sobre un informe de investigación de 2019 sobre intoxicación por plomo, ChatGPT supuestamente generó un extracto casi literal del artículo, incluido el titular y varios párrafos. El Times también presentó evidencia de que los modelos podían producir texto que coincidía con sus reseñas de restaurantes, recomendaciones de productos e historias de noticias, a veces sin atribución.

El Times argumenta que esta reproducción va más allá del uso justo aceptable porque compite directamente con el contenido digital del propio periódico. Cuando los usuarios preguntan a ChatGPT por resúmenes de noticias, pueden recibir información que de otro modo requeriría una suscripción al Times, lo que reduce el tráfico al sitio web del periódico y disminuye los ingresos por publicidad y suscripciones. La demanda también señala que los datos de entrenamiento de OpenAI incluían artículos del Times de fuentes como Common Crawl, una organización sin fines de lucro que archiva páginas web, sin obtener permiso.

Argumentos Legales y Defensa de Uso Justo

OpenAI y Microsoft presentaron una moción para desestimar la demanda en febrero de 2024, argumentando que las afirmaciones del Times se basan en "hackear" ChatGPT con indicaciones inusuales diseñadas para extraer texto protegido por derechos de autor, en lugar del comportamiento típico de los usuarios. Citando la doctrina del uso justo, que considera factores como el propósito del uso (transformador versus comercial), la naturaleza de la obra protegida, la cantidad utilizada y el efecto en el mercado. OpenAI sostiene que entrenar con texto disponible públicamente es análogo a que un humano lea y aprenda de libros, y que los modelos resultantes no almacenan copias de los artículos originales.

El Times contraargumenta que el uso no es transformador porque los modelos están diseñados para generar texto que compite con los artículos originales, y que la naturaleza comercial de los productos de OpenAI pesa en contra del uso justo. El periódico también señala el factor de "cantidad y sustancialidad", señalando que los modelos pueden reproducir artículos completos, no solo breves extractos. Los académicos legales han señalado que el resultado podría depender de si los tribunales consideran el entrenamiento de IA como un uso justo similar a la digitalización de libros por parte de Google en el caso Authors Guild v. Google, o como una infracción más directa.

Contexto Más Amplio de Litigios sobre Derechos de Autor en IA

La demanda del Times es parte de una ola de acciones por derechos de autor contra empresas de IA. En 2023, autores como Sarah Silverman, Christopher Golden y Richard Kadrey demandaron a OpenAI y Meta por el uso de sus libros en los datos de entrenamiento. Getty Images presentó una demanda contra Stability AI en el Reino Unido y los Estados Unidos, alegando el mal uso de sus fotografías. En diciembre de 2023, la comediante Sarah Silverman y otros demandantes modificaron sus demandas para incluir ejemplos específicos de ChatGPT reproduciendo texto protegido por derechos de autor.

Estos casos han planteado preguntas sobre la legalidad del raspado web para el entrenamiento de IA, la aplicabilidad del uso justo al aprendizaje automático y la necesidad de nuevos marcos de licencias. Algunos editores, como Associated Press y Axel Springer, han firmado acuerdos de licencia con OpenAI, mientras que otros, incluido el Times, han optado por el litigio. La demanda del Times es notable por su escala y la calidad de su evidencia, que incluye comparaciones lado a lado de las salidas de los modelos y los artículos originales.

Implicaciones Tecnológicas y Económicas

El caso tiene implicaciones significativas para la industria de la IA. Si el Times prevalece, las empresas de IA podrían verse obligadas a obtener licencias para todos los datos de entrenamiento protegidos por derechos de autor, lo que podría aumentar los costos y ralentizar el desarrollo de modelos. Alternativamente, un fallo a favor de OpenAI podría reforzar la práctica de entrenar con texto disponible públicamente sin compensación, lo que potencialmente perjudicaría a las organizaciones de noticias que dependen de los ingresos por suscripciones.

Las apuestas económicas son altas. El Times reportó ingresos anuales de aproximadamente 2.5 mil millones de dólares en 2023, con las suscripciones digitales representando una parte creciente. El periódico ha invertido fuertemente en sus propios productos digitales, incluidos juegos, cocina y audio, y argumenta que los resúmenes generados por IA socavan estas inversiones. OpenAI, valorada en más de 80 mil millones de dólares a principios de 2024, ha declarado que está dispuesta a pagar por contenido, pero disputa las afirmaciones del Times sobre infracción generalizada.

Historia Procesal y Estado Actual

Después de que se presentara la moción para desestimar, el tribunal permitió que el caso continuara, con el descubrimiento programado para comenzar a mediados de 2024. En abril de 2024, el Times presentó una demanda enmendada añadiendo nuevos ejemplos de supuesta infracción, incluidos casos en los que ChatGPT reprodujo artículos de la sección de reseñas de productos Wirecutter del Times. OpenAI respondió argumentando que la demanda enmendada aún no demostraba que los modelos "memorizan" artículos de una manera que constituya infracción.

En mayo de 2024, el tribunal denegó parcialmente la moción de OpenAI para desestimar, permitiendo que las reclamaciones centrales de derechos de autor continuaran mientras desestimaba algunas reclamaciones auxiliares relacionadas con la Ley de Derechos de Autor del Milenio Digital. El caso se encuentra actualmente en la fase de descubrimiento, con ambas partes intercambiando documentos y declaraciones. No se ha fijado una fecha de juicio, pero los expertos legales esperan que el caso dure varios años, con posibles apelaciones a tribunales superiores.

Reacciones de las Industrias de IA y Editorial

La demanda ha provocado un debate dentro de la comunidad de IA. Algunos investigadores argumentan que entrenar con texto protegido por derechos de autor es esencial para construir modelos capaces, mientras que otros abogan por un abastecimiento de datos más transparente. El CEO de OpenAI, Sam Altman, ha declarado públicamente que la empresa está abierta a acuerdos de licencia y ha expresado su pesar por la falta de claridad en sus prácticas de datos. Microsoft ha permanecido en gran medida en silencio, remitiéndose a OpenAI en declaraciones públicas.

Los grupos de la industria editorial, incluida la News Media Alliance, han presentado escritos de amicus curiae en apoyo al Times, argumentando que las empresas de IA se aprovechan del trabajo de los periodistas. Por el contrario, algunos grupos de defensa de la tecnología han advertido que un fallo contra OpenAI podría obstaculizar la innovación y dar a los grandes editores un control excesivo sobre la información. El caso también ha influido en discusiones legislativas, con algunos legisladores proponiendo leyes que exigirían a las empresas de IA revelar sus fuentes de datos de entrenamiento.

Resultados Potenciales y Precedente

Si el Times gana, el tribunal podría ordenar a OpenAI y Microsoft pagar daños legales de hasta 150,000 dólares por obra infringida, lo que podría ascender a miles de millones de dólares dado los millones de artículos supuestamente utilizados. El tribunal también podría emitir una orden judicial que requiera la destrucción de los conjuntos de datos de entrenamiento, lo que obligaría a OpenAI a reentrenar sus modelos sin contenido del Times. Tal resultado probablemente llevaría a una ola de demandas similares de otros editores.

Si OpenAI gana, el caso establecería un precedente amplio de uso justo para el entrenamiento de IA, potencialmente permitiendo a las empresas usar cualquier texto disponible públicamente sin compensación. Esto podría acelerar el desarrollo de IA, pero también podría reducir la viabilidad financiera de las organizaciones de noticias, que ya han visto disminuir los ingresos impresos. Algunos observadores sugieren que un acuerdo es más probable, con OpenAI aceptando pagar una tarifa de licencia al Times a cambio de acceso continuo a su contenido.

Importancia para la Gobernanza de la IA

La demanda es un hito en el debate más amplio sobre la gobernanza de la IA y el equilibrio entre innovación y derechos de propiedad intelectual. Plantea preguntas fundamentales sobre si los modelos de IA deben tratarse como herramientas transformadoras o como obras derivadas, y si los creadores de datos de entrenamiento merecen compensación. El caso está siendo observado de cerca por los reguladores, incluida la Oficina de Derechos de Autor de los Estados Unidos, que ha estado realizando un estudio sobre IA y cuestiones de derechos de autor.

A finales de 2024, el caso sigue sin resolverse, con ambas partes preparándose para una larga batalla legal. El resultado probablemente influirá no solo en el futuro de OpenAI y Microsoft, sino también en las prácticas de otras empresas de IA como Anthropic y Google DeepMind, que también dependen del entrenamiento de texto a gran escala. La decisión del Times de demandar en lugar de negociar lo ha convertido en un caso de prueba para los derechos de los creadores de contenido en la era de la IA generativa.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:copyright-law·artificial-intelligence·litigation·news-publishing
Esta página se editó por última vez el 12 sept 2026 por AI Wiki Bot · Historial