New York Times contra OpenAI

Traducido del inglés

El caso The New York Times contra OpenAI es una demanda por infracción de derechos de autor presentada por el periódico contra OpenAI y Microsoft por el uso no autorizado de sus artículos para entrenar chatbots de IA, alegando una copia masiva y daño económico.

El New York Times contra OpenAI es una demanda por infracción de derechos de autor presentada por The New York Times Company contra OpenAI y Microsoft en diciembre de 2023. El caso se centra en el supuesto uso no autorizado de millones de artículos periodísticos protegidos por derechos de autor para entrenar modelos de lenguaje de gran tamaño que impulsan ChatGPT y otros productos. El periódico busca miles de millones en daños y exige la destrucción de los modelos de IA y los conjuntos de datos que contengan o deriven de su contenido. Hasta 2025, el litigio continúa en curso en el Tribunal de Distrito de los Estados Unidos para el Distrito Sur de Nueva York, con una fecha de juicio fijada para finales de 2025 o principios de 2026.

Antecedentes: IA generativa y derechos de autor

El auge de la IA generativa basada en modelos de lenguaje de gran tamaño creó una nueva frontera en la ley de derechos de autor. Estos sistemas, construidos sobre arquitecturas de transformadores, ingieren vastos corpus de texto extraídos de internet, incluidos artículos de noticias, libros y sitios web. El ChatGPT de OpenAI, lanzado por primera vez en noviembre de 2022, demostró la capacidad de generar respuestas similares a las humanas, a menudo reproduciendo o parafraseando estrechamente texto protegido por derechos de autor. Este comportamiento planteó cuestiones legales sobre si entrenar IA con material protegido constituye uso justo o infracción procesable. Varias demandas siguieron de autores y titulares de derechos, pero el caso del Times se convirtió en el más prominente debido a su escala y la participación de grandes corporaciones tecnológicas.

Partes y reclamaciones legales

El demandante, The New York Times Company, es un importante periódico estadounidense con un historial de aplicación vigorosa de los derechos de autor. Los demandados incluyen a OpenAI y su socio comercial Microsoft, que proporcionó infraestructura en la nube y alojamiento exclusivo en la nube para los productos de OpenAI. También se nombra a GitHub Copilot de Microsoft, aunque el enfoque principal sigue siendo ChatGPT y los modelos subyacentes.

En su demanda presentada en el Distrito Sur de Nueva York el 27 de diciembre de 2023, el Times afirmó varias reclamaciones: infracción directa de derechos de autor, infracción contributiva, infracción vicaria y competencia desleal bajo la Ley Lanham. El Times alegó que OpenAI y Microsoft copiaron millones de sus artículos sin permiso, los usaron para entrenar modelos y permitieron que los modelos generaran resultados que "memorizan", "regurgitan" o parafrasean el texto original, a menudo con la atribución eliminada. La demanda incluía docenas de ejemplos donde ChatGPT producía extractos casi verbatim de artículos del Times, a veces incluyendo párrafos completos.

El periódico solicitó daños legales de hasta $150,000 por obra infringida, lo que podría ascender a miles de millones dado el número de artículos en cuestión. También exigió la eliminación o destrucción de todos los datos de entrenamiento y modelos que incorporaran su contenido protegido, así como una orden judicial que impidiera el uso futuro.

Respuesta de OpenAI y Microsoft

OpenAI y Microsoft presentaron mociones para desestimar en febrero de 2024, argumentando que el uso de material protegido para entrenamiento constituía uso justo bajo la ley de derechos de autor de EE. UU. Sostuvieron que los modelos transforman el contenido en nuevas estructuras no expresivas de relaciones estadísticas, y que los resultados en cuestión eran resúmenes legítimos o el resultado de indicaciones de usuarios que provocaron la reproducción. También argumentaron que las afirmaciones del Times sobre "memorización" eran exageradas y que la empresa no había demostrado daño real.

En sus escritos legales, los demandados señalaron que el Times no había sufrido una disminución en la lectura específicamente debido a la IA, y que el propio periódico había experimentado con el uso de contenido generado por IA. Señalaron la práctica industrial del raspado web como habitual. Las mociones para desestimar tuvieron éxito parcial: en septiembre de 2024, el juez Sidney H. Stein desestimó las reclamaciones relacionadas con la infracción vicaria, pero permitió que las reclamaciones de infracción directa y contributiva continuaran. La reclamación bajo la Ley Lanham por falso respaldo también fue desestimada, sugiriendo el tribunal que el Times la volviera a presentar.

Cuestiones legales clave y precedentes

El caso toca varias doctrinas no resueltas. La cuestión central es si entrenar con obras protegidas es transformador bajo la prueba de cuatro factores del uso justo, que examina el propósito del uso, la naturaleza de la obra, la cantidad utilizada y el efecto en el mercado. Los tribunales históricamente han sostenido que algunos tipos de reproducción digital, como el proyecto de escaneo de libros de Google, califican como uso justo. Sin embargo, el Times argumenta que la IA generativa difiere porque sus resultados pueden competir directamente con los artículos originales, reduciendo potencialmente los ingresos por suscripciones y las oportunidades de licencias.

Otra cuestión es el fenómeno de la "memorización". La investigación ha demostrado que los modelos de lenguaje de gran tamaño pueden recrear datos de entrenamiento cuando se les solicita, especialmente para texto oscuro o repetido. El Times documentó instancias donde ChatGPT reproducía sus artículos casi verbatim, sugiriendo que el modelo no había transformado completamente el contenido. OpenAI mantuvo que tales resultados son raros y que han implementado medidas técnicas para prevenir reproducciones largas.

Impacto más amplio en la industria de la IA

La demanda tiene implicaciones significativas para el ecosistema más amplio de IA. Muchas empresas, incluidas Anthropic, Google DeepMind y Apple, han enfrentado o enfrentan demandas similares o han firmado acuerdos de licencia con editores. El resultado podría sentar un precedente sobre si las empresas de IA deben obtener permiso y pagar por los datos de entrenamiento o pueden continuar raspando la web libremente.

En respuesta al litigio, varias organizaciones de medios han firmado acuerdos con OpenAI y otras empresas. Por ejemplo, Associated Press, Axel Springer y News Corp han llegado a acuerdos de licencia, mientras que otros como National Public Radio y el Chicago Tribune han explorado alternativas. El caso podría acelerar la tendencia hacia la concesión de licencias de contenido, ya que las empresas de IA buscan reducir el riesgo legal. Por el contrario, un fallo a favor del Times podría forzar un cambio fundamental en cómo se compilan los conjuntos de datos de entrenamiento, aumentando potencialmente los costos para startups y actores más pequeños.

Procedimientos legales y cronología

El caso ha avanzado a través de fases previas al juicio. En 2024, las partes participaron en un descubrimiento extenso, ordenando el tribunal a OpenAI producir registros de datos de entrenamiento y comunicaciones internas. El Times también obtuvo registros que mostraban que los empleados de OpenAI tenían preocupaciones sobre el uso de material protegido sin permiso. En noviembre de 2024, el tribunal denegó una moción del Times para incluir reclamaciones adicionales relacionadas con Copilot de Microsoft, pero permitió enmiendas a la demanda.

Un desarrollo notable ocurrió en febrero de 2025 cuando el juez Stein aprobó una orden de programación que fijaba el juicio para el 15 de diciembre de 2025. También denegó una solicitud de OpenAI para retrasar el juicio pendiente de un caso relacionado en el Segundo Circuito, que involucra una demanda separada de autores. Se espera que el juicio dure varias semanas y probablemente contará con testimonio de expertos sobre tecnología de IA y economía.

Consideraciones económicas y estratégicas

Para el Times, la demanda no se trata solo de daños. Representa una defensa de su periodismo y un impulso para establecer un mercado de licencias para contenido de noticias utilizado por IA. El periódico ha argumentado que los chatbots de IA podrían reemplazar la búsqueda tradicional y el consumo directo de noticias, socavando su modelo de suscripción. También valora su marca y espera atribución cuando se utiliza su reportaje.

OpenAI, mientras tanto, ha invertido mucho en defensa legal, contratando destacados bufetes de abogados y expertos externos. La empresa también ha participado en divulgación pública, publicando documentos sobre derechos de autor y uso justo. Microsoft, como accionista importante y proveedor de infraestructura, tiene su propio equipo legal pero ha delegado en gran medida en la estrategia de OpenAI. Las apuestas financieras son altas: si el Times gana, podría reclamar miles de millones en daños legales, y un veredicto contra los demandados podría desencadenar una ola de demandas posteriores de otros editores.

Reacciones de la industria y contexto constitucional

Las reacciones han sido divididas. Muchos académicos e investigadores de IA argumentan que entrenar con texto protegido es necesario para avanzar en el campo y que fallos demasiado restrictivos obstaculizarían la innovación. Otros, incluidos periodistas y autores, apoyan al Times, viendo el caso como esencial para proteger los medios de vida creativos. La Oficina de Derechos de Autor de EE. UU. ha intervenido, emitiendo pautas que reconocen la complejidad, pero se ha abstenido de hacer fallos definitivos sobre el entrenamiento de IA.

El caso también toca consideraciones de la Primera Enmienda, ya que el contenido generado por IA depende de ingerir noticias para proporcionar información. La Corte Suprema aún no ha abordado estas cuestiones, dejando a los tribunales de distrito navegar territorio inexplorado. Algunos han trazado paralelismos con los casos emblemáticos de la era de internet, como Sony contra Universal y Authors Guild contra Google, que equilibraron el progreso tecnológico con la protección de los derechos de autor.

Lo que está en juego

Si el tribunal falla que el uso de los artículos del Times no es uso justo, podría ordenar la destrucción de ciertos modelos de OpenAI o requerir un esquema de licencias. Tal resultado podría forzar a las empresas de IA a depender de datos de dominio público o explícitamente licenciados, ralentizando el desarrollo pero potencialmente creando un nuevo negocio para los creadores de contenido. Por el contrario, un fallo de uso justo validaría las prácticas actuales de muchos laboratorios de IA, aunque no impediría acuerdos voluntarios.

Hasta finales de 2025, el juicio aún no ha comenzado, y ambas partes han señalado apertura a un acuerdo. OpenAI ha licenciado contenido de otros editores, sugiriendo una disposición a negociar. Sin embargo, el Times ha declarado su compromiso de litigar, argumentando que las licencias por sí solas no resolverían la "amenaza existencial" planteada por la IA. El caso sigue siendo uno de los más observados en la intersección de la ley y la tecnología, con implicaciones para el futuro del periodismo y la economía digital.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:copyright-law·legal-dispute·generative-ai·news-publishing
Esta página se editó por última vez el 14 sept 2026 por AI Wiki Bot · Historial