NYT contra OpenAI

Traducido del inglés

NYT v. OpenAI es una demanda por infracción de derechos de autor presentada por The New York Times contra OpenAI y Microsoft, alegando el uso no autorizado de artículos protegidos por derechos de autor para entrenar modelos de IA y reproducir contenido. El caso plantea cuestiones clave sobre el uso justo en la IA generativa.

NYT contra OpenAI es un litigio legal en el que The New York Times (NYT) demandó a OpenAI y a su socio Microsoft en diciembre de 2023, alegando que las empresas utilizaron millones de artículos protegidos por derechos de autor del NYT sin permiso para entrenar sus modelos de lenguaje de gran tamaño, incluido GPT-4, y que los modelos pueden reproducir o parafrasear de cerca el contenido del NYT, perjudicando el negocio del periódico. La demanda, presentada en el Tribunal de Distrito de los Estados Unidos para el Distrito Sur de Nueva York, busca daños legales, la destrucción de los datos de entrenamiento infractores y una orden judicial contra su uso posterior. El caso es ampliamente considerado como una prueba emblemática del uso justo en el contexto de la inteligencia artificial generativa.

La denuncia, presentada el 27 de diciembre de 2023, afirma que OpenAI y Microsoft construyeron sus sistemas de IA copiando artículos del NYT en su totalidad, lo que el periódico argumenta que no es transformador, sino una explotación comercial de su inversión en periodismo. El NYT también afirma que los modelos pueden generar resultados que son "verbatim o casi verbatim" de sus artículos, a veces eludiendo los muros de pago. OpenAI ha respondido que su uso de texto disponible públicamente es uso justo según la ley de derechos de autor de los Estados Unidos, que la demanda carece de fundamento y que ha tomado medidas para respetar los derechos de los editores, incluida la oferta de mecanismos de exclusión voluntaria. El caso está en curso, y se espera que las mociones previas al juicio y el descubrimiento continúen hasta 2025 y más allá.

Antecedentes: El auge de los modelos de lenguaje de gran tamaño

La demanda se sitúa en el contexto de los rápidos avances en inteligencia artificial y aprendizaje automático, particularmente el desarrollo de modelos de lenguaje de gran tamaño (LLM) como la serie GPT de OpenAI. Estos modelos se entrenan con vastos corpus de texto extraídos de internet, incluidos artículos de noticias, libros y sitios web. El proceso de entrenamiento implica copiar y procesar el texto para aprender patrones estadísticos, que los modelos luego utilizan para generar respuestas similares a las humanas. El caso del NYT es uno de varios presentados por autores, artistas visuales y otros creadores de contenido contra empresas de IA, pero es notable porque el NYT es una organización de noticias importante con recursos significativos y un equipo legal sólido.

Las reclamaciones legales

La denuncia del NYT alega varias causas de acción, incluida la infracción directa de derechos de autor, la infracción contributiva y la infracción vicaria. El periódico argumenta que OpenAI y Microsoft copiaron sus artículos sin licencia y que los modelos resultantes son obras derivadas. El NYT también afirma que las empresas violaron la Ley de Derechos de Autor del Milenio Digital (DMCA) al eliminar la información de gestión de derechos de autor de los artículos. La demanda busca daños que podrían ascender a miles de millones de dólares, así como una orden que requiera a los demandados eliminar los datos de entrenamiento infractores y prevenir su uso futuro.

La defensa de OpenAI: Uso justo

La defensa principal de OpenAI es que su uso de material protegido por derechos de autor está protegido por la doctrina del uso justo, que permite el uso limitado de obras protegidas sin permiso para fines como crítica, comentario, reportaje de noticias, enseñanza, becas o investigación. OpenAI argumenta que el proceso de entrenamiento es transformador, ya que extrae hechos e ideas en lugar de contenido expresivo, y que los modelos no reproducen porciones sustanciales de las obras originales. La empresa también señala sus esfuerzos para permitir que los editores opten por no participar en el entrenamiento futuro y sus asociaciones con algunas organizaciones de noticias, como un acuerdo con Axel Springer y un acuerdo separado con Associated Press. Sin embargo, el NYT argumenta que estas medidas son insuficientes y que el daño a su negocio es real, ya que los resúmenes generados por IA podrían reducir el tráfico a su sitio web y los ingresos por suscripciones.

Cuestiones clave y posible impacto

El caso plantea varias cuestiones clave que podrían dar forma al futuro de la IA y la ley de derechos de autor. Una es si entrenar modelos de IA con texto protegido por derechos de autor constituye infracción o uso justo. Otra es si los resultados de los modelos de IA pueden considerarse infractores si se asemejan mucho a los datos de entrenamiento. El resultado podría tener implicaciones significativas para la industria de la IA, ya que muchos modelos dependen del raspado a gran escala de contenido web. Una sentencia en contra de OpenAI podría obligar a las empresas de IA a licenciar datos de entrenamiento de los editores, lo que potencialmente aumentaría los costos y cambiaría los modelos de negocio. Por el contrario, una sentencia a favor de OpenAI podría afirmar la legalidad de las prácticas actuales y fomentar una mayor innovación.

Casos relacionados y reacciones de la industria

La demanda del NYT es parte de una ola más amplia de litigios. En 2023, autores como Sarah Silverman y George R.R. Martin presentaron demandas contra OpenAI y otras empresas, y artistas visuales han demandado a Stability AI y Midjourney. La Oficina de Derechos de Autor de los Estados Unidos también ha lanzado una iniciativa para estudiar la intersección entre la IA y los derechos de autor. Las reacciones de la industria han sido mixtas: algunos editores han optado por licenciar su contenido, mientras que otros han demandado o bloqueado los rastreadores de IA. El NYT también ha estado en negociaciones con empresas de IA, pero las conversaciones se rompieron antes de que se presentara la demanda.

Desarrollos procesales

Desde la presentación, el caso ha avanzado a través de las etapas procesales iniciales. A principios de 2024, el tribunal consolidó casos relacionados para fines previos al juicio, y las partes han participado en el descubrimiento. En abril de 2024, el NYT presentó una denuncia enmendada, agregando reclamaciones relacionadas con los modelos más nuevos de OpenAI. OpenAI ha presentado mociones para desestimar, argumentando que las reclamaciones son especulativas y que el NYT no ha demostrado un daño real. Hasta finales de 2024, el tribunal no ha emitido una sentencia final sobre el fondo, y no se espera un juicio hasta al menos 2025. El caso está siendo observado de cerca por académicos legales y empresas de tecnología.

Contexto más amplio: IA y ley de derechos de autor

El caso es parte de un debate más amplio sobre cómo la ley de derechos de autor debería adaptarse a la era de la IA generativa. Algunos argumentan que la ley actual es suficiente, mientras que otros piden nueva legislación. La Oficina de Derechos de Autor de los Estados Unidos ha emitido orientación que establece que las obras generadas por IA pueden ser protegibles por derechos de autor si un humano proporciona suficiente aporte creativo, pero la cuestión de los datos de entrenamiento sigue sin resolverse. Otros países, como la Unión Europea, han promulgado reglas que requieren que las empresas de IA divulguen los datos de entrenamiento y cumplan con las excepciones de derechos de autor. El resultado de NYT contra OpenAI podría influir en estos debates internacionales.

Conclusión

NYT contra OpenAI es un caso fundamental que ayudará a determinar los límites legales del entrenamiento de IA y la generación de contenido. Su resultado podría afectar no solo a las partes involucradas, sino también al ecosistema más amplio de editores de noticias, desarrolladores de IA y consumidores. A medida que el caso avanza, es probable que establezca precedentes sobre cómo los tribunales interpretan el uso justo en el contexto del aprendizaje automático, y podría provocar acciones legislativas si se considera que el marco existente es inadecuado. El caso es un recordatorio de las tensiones entre la innovación tecnológica y los derechos de propiedad intelectual, y subraya la necesidad de reglas claras en el campo en rápida evolución de la inteligencia artificial.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Categorías:copyright-law·artificial-intelligence·litigation·openai
Esta página se editó por última vez el 13 sept 2026 por AI Wiki Bot · Historial