Getty v. Stability (2023)

Traduit de l'anglais

Getty v. Stability (2023) est une action en justice intentée par Getty Images contre Stability AI, alléguant une violation du droit d'auteur concernant l'utilisation de millions d'images dans l'entraînement du modèle Stable Diffusion.

Getty c. Stability (2023) est une action en justice pour violation de droits d'auteur intentée par Getty Images contre Stability AI, le développeur du modèle de génération d'images Stable Diffusion. L'affaire, initiée en janvier 2023 devant le tribunal de district des États-Unis pour le district du Delaware, allègue que Stability AI a copié et traité des millions d'images de la base de données de Getty sans autorisation pour entraîner son modèle Generative AI. La poursuite demande des dommages-intérêts légaux, une injonction et la destruction des données d'entraînement contrefaisantes.

Le litige porte sur l'utilisation d'images extraites du web dans l'entraînement de systèmes Deep learning. Getty Images, une grande agence de photos de stock, affirme que les actions de Stability AI violent ses droits d'auteur et ceux de ses contributeurs. Stability AI a fait valoir que son utilisation d'images accessibles au public relève de l'usage équitable, une défense qui a été centrale dans plusieurs affaires similaires dans le domaine de l'Artificial intelligence.

Contexte de l'affaire

En 2022, Stability AI a publié Stable Diffusion, un modèle Neural network open-source capable de générer des images détaillées à partir de invites textuelles. Le modèle a été entraîné sur un ensemble de données appelé LAION-5B, qui contenait des milliards de paires image-texte extraites d'Internet. Getty Images, qui concède sous licence des millions de photographies, a allégué qu'une partie substantielle de ses images propriétaires était incluse dans cet ensemble de données sans autorisation.

Getty Images a déposé sa plainte le 13 janvier 2023 devant le tribunal de district des États-Unis pour le district du Delaware. La poursuite nomme Stability AI, ainsi que son PDG, Emad Mostaque, et la filiale américaine de l'entreprise, Stability AI Ltd. La plainte allègue une violation directe, contributive et indirecte des droits d'auteur, ainsi que des violations de la loi sur le droit d'auteur du millénaire numérique (DMCA) pour avoir supprimé ou modifié des informations de gestion des droits d'auteur.

Revendications juridiques et arguments

La revendication principale de Getty Images est que Stability AI a reproduit et stocké des millions d'images protégées par le droit d'auteur pendant le processus d'entraînement. L'entreprise soutient que cette reproduction n'est pas transformative et que la nature commerciale de l'utilisation par Stability AI pèse contre l'usage équitable. Getty affirme également que Stable Diffusion peut générer des images qui ressemblent étroitement aux photographies originales, y compris des filigranes et d'autres marques d'identification, ce qui sape davantage la défense d'usage équitable.

Stability AI a répondu en affirmant que l'entraînement sur des images accessibles au public est un usage équitable licite, similaire à un artiste humain apprenant à partir d'œuvres existantes. L'entreprise a également fait valoir que les images générées par Stable Diffusion sont de nouvelles œuvres transformatives qui ne portent pas atteinte à un droit d'auteur spécifique. Stability AI a cherché à faire rejeter l'affaire, mais le tribunal a permis aux revendications de procéder, indiquant que les questions juridiques sont substantielles.

Poursuites connexes et impact sur l'industrie

L'affaire Getty c. Stability fait partie d'une vague plus large de litiges contre les entreprises de Generative AI. En janvier 2023, trois artistes - Sarah Andersen, Kelly McKernan et Karla Ortiz - ont déposé une action collective contre Stability AI, Midjourney et DeviantArt, alléguant des violations similaires des droits d'auteur. Cette affaire, Andersen c. Stability AI, a ensuite été partiellement rejetée mais autorisée à procéder sur certaines revendications. D'autres poursuites ont été déposées par des auteurs contre OpenAI et Anthropic concernant l'utilisation de textes protégés par le droit d'auteur dans l'entraînement de Large language models.

Ces affaires ont des implications significatives pour l'industrie de l'Artificial intelligence. Si les tribunaux statuent contre les entreprises d'IA, elles pourraient être tenues de concéder sous licence les données d'entraînement, ce qui pourrait augmenter les coûts et modifier le développement des futurs modèles. À l'inverse, une décision en faveur de l'usage équitable pourrait consolider la légalité de l'entraînement sur des données accessibles au public, encourageant une innovation supplémentaire.

Le rôle des données d'entraînement

Le cœur du litige réside dans la manière dont les modèles Machine learning sont entraînés. Stable Diffusion est un type de modèle Generative AI qui utilise une architecture U-Net et un processus appelé diffusion pour générer des images. Le processus d'entraînement implique de fournir au modèle des millions d'images et leurs descriptions textuelles associées, lui permettant d'apprendre les relations statistiques entre les caractéristiques visuelles et le langage.

Getty Images soutient que ce processus implique une reproduction non autorisée de ses œuvres protégées. L'entreprise a souligné que Stable Diffusion peut parfois reproduire des copies quasi exactes d'images de sa base de données, y compris le filigrane de Getty Images. Cela, affirme Getty, démontre que le modèle a mémorisé et peut produire du contenu protégé par le droit d'auteur, ce qui n'est pas un usage équitable.

Historique procédural et statut actuel

Après que Getty a déposé sa plainte, Stability AI a demandé le rejet de l'affaire, arguant que les revendications étaient spéculatives et que l'entreprise n'avait pas directement violé un droit d'auteur. Dans une décision de fin 2023, le tribunal a refusé la motion de rejet, permettant à l'affaire de procéder à la phase de découverte. Le tribunal a estimé que Getty avait plausiblement allégué que Stability AI avait copié ses images et que la défense d'usage équitable ne suffisait pas à rejeter les revendications à ce stade.

En début 2025, l'affaire est toujours en phase de découverte. Les deux parties ont été engagées dans une production extensive de documents et des dépositions. Une date de procès n'a pas encore été fixée. L'issue de cette affaire pourrait établir un précédent sur la manière dont le droit d'auteur s'applique à l'entraînement de l'Artificial intelligence, affectant non seulement Stability AI mais aussi d'autres entreprises comme OpenAI, Anthropic et Google DeepMind.

Contexte plus large : IA et droit d'auteur

L'affaire Getty c. Stability est l'un des nombreux litiges très médiatisés qui ont suscité des discussions juridiques et réglementaires sur l'IA et le droit d'auteur. Aux États-Unis, le bureau du droit d'auteur a publié des directives indiquant que les œuvres générées entièrement par l'IA ne sont pas éligibles à la protection du droit d'auteur, mais la question de savoir si l'entraînement sur des œuvres protégées constitue une violation reste non résolue. Dans l'Union européenne, la loi sur l'IA inclut des dispositions exigeant la transparence sur les données d'entraînement, mais elle n'aborde pas explicitement le droit d'auteur.

Certains experts soutiennent que la loi actuelle sur le droit d'auteur est mal équipée pour gérer les complexités de l'entraînement de l'IA. Ils suggèrent qu'une nouvelle législation pourrait être nécessaire pour équilibrer les intérêts des titulaires de droits d'auteur et des développeurs d'IA. D'autres croient que l'usage équitable est suffisant et que les tribunaux finiront par confirmer la légalité de l'entraînement sur des données accessibles au public.

Résultats potentiels et implications

Si Getty Images prévaut, Stability AI pourrait être condamnée à payer des dommages-intérêts substantiels et à supprimer ou détruire ses ensembles de données d'entraînement. Cela pourrait avoir un effet dissuasif sur le développement de modèles d'IA open-source, car d'autres développeurs pourraient hésiter à s'entraîner sur des données extraites du web sans licences. Cela pourrait également conduire à un marché pour les données d'entraînement sous licence, où des entreprises comme Getty Images vendraient l'accès à leurs archives à des fins d'entraînement de l'IA.

Si Stability AI gagne, cela renforcerait la notion que l'entraînement sur des données accessibles au public est un usage équitable, ce qui pourrait accélérer le développement de l'IA. Cependant, cela pourrait aussi conduire à des pratiques d'extraction plus agressives, nuisant potentiellement aux photographes et autres créateurs de contenu qui dépendent des frais de licence.

L'affaire est étroitement suivie par la communauté de l'Artificial intelligence, les juristes et les créateurs de contenu. Sa résolution influencera probablement la manière dont les entreprises d'IA abordent la collecte de données et si elles cherchent des licences auprès des titulaires de droits d'auteur. À ce jour, l'affaire reste en instance et aucun jugement final n'a été rendu.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:copyright-law·artificial-intelligence·litigation·generative-ai
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique