Getty Images contre Stability AI

Traduit de l'anglais

Getty Images contre Stability AI est une action en justice pour violation de droit d'auteur déposée en 2023, alléguant l'utilisation non autorisée d'images de Getty dans l'entraînement de Stable Diffusion, un modèle d'IA générative. L'affaire porte sur la question de savoir si l'entraînement de l'IA constitue un usage équitable.

Getty Images v. Stability AI est une action civile déposée devant la cour de district des États-Unis pour le district du Delaware le 3 février 2023, par Getty Images contre Stability AI, le développeur du modèle de génération d'images Stable Diffusion. La plainte allègue que Stability AI a copié des millions de photographies et d'images protégées par le droit d'auteur provenant de la base de données de Getty Images sans autorisation pour entraîner son système de Generative AI, en violation du droit d'auteur. Cette affaire est l'un des nombreux défis juridiques très médiatisés concernant l'utilisation de matériel protégé par le droit d'auteur dans l'entraînement de modèles d'Artificial intelligence, et son issue pourrait façonner de manière significative l'avenir du Machine learning et des industries créatives.

Le procès demande des dommages-intérêts légaux, une injonction, et une ordonnance du tribunal exigeant que Stability AI détruise ses ensembles de données d'entraînement. Getty Images affirme que Stability AI a extrait des données de son site Web et de son contenu sous licence, utilisant les images pour construire un modèle capable de générer de nouvelles images ressemblant aux originales. Stability AI a répondu en arguant que son utilisation des images relève de la doctrine de l'usage équitable, un principe juridique qui permet une utilisation limitée de matériel protégé sans permission à des fins telles que la critique, le commentaire, le reportage, l'enseignement ou la recherche. L'affaire a attiré l'attention généralisée des juristes, des entreprises technologiques et des artistes, car elle teste les limites du droit d'auteur à l'ère du Deep learning.

Contexte : Stable Diffusion et données d'entraînement

Stable Diffusion est un modèle texte-à-image publié par Stability AI en août 2022. Il a été développé en utilisant une variante de l'architecture U-Net, un type de Neural network conçu pour le traitement d'images, et entraîné sur un grand ensemble de données appelé LAION-5B, assemblé par l'organisation à but non lucratif LAION. L'ensemble de données contient des milliards de paires image-texte extraites d'Internet, y compris des images hébergées sur les sites Web de Getty Images. Getty Images, une agence majeure de photographie de stock, concède ses images sous licence à des médias, des entreprises et des particuliers, et maintient un contrôle strict sur la manière dont son contenu est utilisé. La société allègue que l'extraction de ses images par Stability AI sans licence constitue une violation directe et contributive du droit d'auteur.

Le processus d'entraînement de Stable Diffusion impliquait de fournir au modèle des millions d'images et leurs légendes associées, lui permettant d'apprendre des relations statistiques entre les caractéristiques visuelles et les descriptions textuelles. Cette approche est courante dans le Deep learning et repose sur des techniques de Data Augmentation à grande échelle pour améliorer les performances du modèle. Cependant, l'utilisation d'images protégées par le droit d'auteur dans les ensembles de données d'entraînement est devenue une question controversée, car les modèles peuvent générer des sorties qui ressemblent étroitement aux données d'entraînement, soulevant des questions sur la question de savoir si ces sorties portent atteinte aux droits des créateurs originaux.

Revendications légales et arguments

La plainte de Getty Images invoque plusieurs causes d'action, notamment la violation directe du droit d'auteur, la violation contributive et la responsabilité indirecte. La société soutient que Stability AI a copié ses images en bloc, sans transformation, et les a utilisées pour créer un produit concurrent qui sape le marché de la photographie sous licence. Getty Images affirme également que le modèle de Stability AI peut reproduire des éléments reconnaissables de ses images, tels que des filigranes et des logos, ce qui démontre en outre une copie non autorisée.

La défense de Stability AI repose sur la doctrine de l'usage équitable, que les tribunaux évaluent en fonction de quatre facteurs : le but et le caractère de l'utilisation, la nature de l'œuvre protégée, la quantité et l'importance de la partie utilisée, et l'effet sur le marché potentiel de l'œuvre originale. Stability AI soutient que son utilisation est transformative car le modèle ne reproduit pas simplement des images mais génère de nouvelles sorties originales basées sur des motifs appris. La société affirme également que le processus d'entraînement implique une copie intermédiaire nécessaire pour le Machine learning et que les images ne sont pas directement distribuées aux utilisateurs. Les experts juridiques notent que l'issue pourrait dépendre de la manière dont les tribunaux interprètent la transformation dans le contexte de l'IA, une question qui n'a pas été définitivement résolue dans la jurisprudence antérieure.

Historique procédural

Après le dépôt initial en février 2023, l'affaire a été assignée au juge Stephanos Bibas dans le district du Delaware. En mai 2023, Getty Images a déposé une plainte modifiée, ajoutant des allégations plus détaillées sur l'ampleur de la copie et les images spécifiques impliquées. Stability AI a déposé une motion de rejet en juillet 2023, arguant que la plainte ne présentait pas de réclamation valable car les images n'étaient pas directement copiées dans les sorties du modèle et que le processus d'entraînement était protégé par l'usage équitable. En novembre 2023, le juge Bibas a partiellement rejeté la motion de rejet, permettant aux réclamations de violation du droit d'auteur de procéder tout en rejetant certaines réclamations de responsabilité secondaire pour manque d'allégations factuelles suffisantes.

La décision du tribunal de permettre à l'affaire de continuer a été considérée comme un développement significatif, car elle a rejeté l'argument de Stability AI selon lequel les réclamations étaient trop spéculatives. La phase de découverte est en cours, les deux parties échangeant des informations sur les ensembles de données d'entraînement et les détails techniques du modèle. Début 2025, l'affaire n'a pas été jugée et aucun accord n'a été annoncé. Le tribunal a programmé une conférence de statut pour mi-2025 afin de discuter des procédures ultérieures.

Litiges connexes et contexte

Getty Images v. Stability AI fait partie d'une vague plus large de poursuites contre les entreprises d'IA. En janvier 2023, trois artistes ont déposé une action collective contre Stability AI, Midjourney et DeviantArt, alléguant des violations similaires du droit d'auteur. Cette affaire, Andersen v. Stability AI, a également fait face à des défis procéduraux, un juge fédéral ayant rejeté certaines réclamations mais permis à d'autres de continuer. De plus, plusieurs auteurs ont poursuivi OpenAI et d'autres entreprises pour l'utilisation de leurs livres dans l'entraînement de Large language models, soulevant des questions analogues sur l'usage équitable et l'utilisation transformative.

Le paysage juridique est encore compliqué par des débats en cours sur l'éthique de l'entraînement de l'IA. Certains chercheurs soutiennent que l'utilisation de données publiquement disponibles pour l'entraînement est analogue à l'apprentissage humain et devrait être permise, tandis que d'autres affirment que les créateurs méritent une compensation pour l'utilisation de leur travail. Le Bureau du droit d'auteur des États-Unis a lancé une étude sur l'IA et le droit d'auteur, et l'Union européenne a adopté la loi sur l'IA, qui inclut des exigences de transparence pour les données d'entraînement. Ces efforts réglementaires pourraient influencer le raisonnement du tribunal, bien qu'ils ne soient pas contraignants pour les tribunaux américains.

Implications potentielles

Si Getty Images l'emporte, la décision pourrait exiger que les entreprises d'IA obtiennent des licences pour toutes les données d'entraînement, ce qui augmenterait considérablement le coût de développement des modèles de Generative AI. Cela pourrait également conduire à la destruction des modèles existants entraînés sur des données non autorisées, une mesure que Stability AI a qualifiée d'excessivement lourde. À l'inverse, si Stability AI gagne sur le terrain de l'usage équitable, cela pourrait établir un précédent large permettant aux entreprises d'IA d'utiliser du matériel protégé sans compensation, nuisant potentiellement à l'industrie de la photographie de stock et à d'autres secteurs créatifs.

L'affaire a également des implications pour la communauté technique. Des chercheurs d'institutions telles que MIT CSAIL et Stanford AI Lab ont publié des articles sur les aspects juridiques et techniques de l'entraînement de l'IA, mais la décision du tribunal fournira la première interprétation judiciaire majeure de ces questions. Certains experts suggèrent que l'affaire pourrait conduire au développement de nouveaux modèles de licence, tels que des systèmes de licence collective similaires à ceux utilisés dans l'industrie musicale, pour faciliter une utilisation légale du contenu protégé.

Réactions publiques et industrielles

Getty Images a présenté le procès comme une défense des droits des photographes, arguant que les entreprises d'IA profitent du travail des autres sans compensation. La société a également lancé ses propres outils d'IA générative, entraînés sur du contenu sous licence, se positionnant comme une alternative responsable à Stability AI. Stability AI, quant à elle, a souligné la nature transformative de sa technologie et son potentiel à démocratiser la création d'images, tout en exprimant sa volonté de négocier des licences avec les propriétaires de contenu.

Les artistes et photographes ont exprimé des réactions mitigées. Certains soutiennent l'action en justice de Getty Images, la voyant comme un frein nécessaire à l'empiètement de l'IA dans les domaines créatifs. D'autres craignent que des décisions restrictives sur le droit d'auteur puissent étouffer l'innovation et limiter la disponibilité des outils d'IA. L'affaire a également suscité des discussions sur la nécessité de nouveaux cadres juridiques qui équilibrent les intérêts des créateurs, des développeurs d'IA et du public.

Statut actuel et perspectives

Début 2025, Getty Images v. Stability AI reste en instance devant le tribunal fédéral. La phase de découverte a été extensive, les deux parties soumettant des rapports d'experts sur les aspects techniques de l'entraînement de l'IA et l'impact économique de la violation alléguée. Une motion de jugement sommaire est attendue fin 2025, ce qui pourrait résoudre l'affaire sans procès si le tribunal constate que les faits ne sont pas contestés. Si l'affaire va en procès, ce serait probablement l'un des premiers procès avec jury à aborder les questions de droit d'auteur dans l'entraînement de l'IA, établissant un précédent pour les litiges futurs.

L'issue est incertaine, et les commentateurs juridiques ont noté que l'analyse de l'usage équitable est très spécifique aux faits. Le tribunal devra peser la nature transformative des sorties de Stable Diffusion, la quantité de copie impliquée et le préjudice potentiel au marché de Getty Images. Quel que soit le résultat, l'affaire est susceptible d'influencer la manière dont les entreprises d'IA abordent la collecte de données et les licences, et elle pourrait inciter à une action législative pour clarifier les règles de l'entraînement de l'IA. Les implications plus larges pour le développement de l'Artificial intelligence et le droit d'auteur sont substantielles, faisant de cette affaire un cas marquant pour l'ère numérique.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:copyright-law·artificial-intelligence·litigation·generative-ai
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique