Affaire Getty contre Stability AI

Traduit de l'anglais

L'affaire Getty c. Stability AI fait référence à des poursuites distinctes aux États-Unis et au Royaume-Uni intentées par Getty Images contre Stability AI, alléguant l'utilisation non autorisée de photos protégées par le droit d'auteur pour entraîner Stable Diffusion, soulevant des questions juridiques sur les données d'entraînement de l'IA et l'utilisation équitable.

L'affaire Getty contre Stability AI englobe deux procédures judiciaires parallèles intentées par Getty Images contre Stability AI, le développeur du modèle de génération d'images Stable Diffusion. Les litiges portent sur les allégations selon lesquelles Stability AI aurait copié des millions de photographies protégées par le droit d'auteur provenant des bases de données de Getty pour entraîner son système d'intelligence artificielle sans autorisation. Les affaires, portées aux États-Unis et au Royaume-Uni, sont devenues des exemples emblématiques de la tension entre le développement de l'Generative AI et le droit d'auteur existant.

Getty Images, une importante agence de photos d'archives, a engagé des poursuites judiciaires dans les deux juridictions au début de l'année 2023. L'entreprise a fait valoir que l'utilisation par Stability AI de ses images propriétaires pour entraîner des modèles de Machine learning constituait une violation massive du droit d'auteur. Stability AI, en réponse, a maintenu que ses pratiques relevaient des exceptions légales pour l'extraction de textes et de données, et, dans le contexte américain, de la doctrine de l'usage équitable. Les issues de ces affaires sont étroitement surveillées par les entreprises technologiques, les créateurs de contenu et les juristes, car elles pourraient établir des précédents sur la manière dont les modèles d'Artificial intelligence seront entraînés à l'avenir.

Contexte : Stable Diffusion et données d'entraînement

Stable Diffusion, publié en août 2022 par Stability AI, est un modèle de Deep learning capable de générer des images détaillées à partir de prompts textuels. Le modèle a été entraîné sur un ensemble de données appelé LAION-5B, qui contenait des milliards de paires image-texte extraites d'Internet. Getty Images a allégué qu'une partie significative de cet ensemble de données incluait ses photographies protégées par le droit d'auteur, dont beaucoup portaient des filigranes ou contenaient des métadonnées intégrées les identifiant comme contenu Getty.

Le processus d'entraînement de tels modèles implique de fournir un grand nombre d'images à une architecture de Neural network, généralement un U-Net combiné à un encodeur de texte. Pendant l'entraînement, le modèle apprend des motifs statistiques reliant les caractéristiques visuelles à des mots descriptifs. Getty a fait valoir que ce processus impliquait nécessairement la reproduction et le stockage de copies des images originales, au moins temporairement, et que le modèle résultant pouvait générer des sorties ressemblant étroitement à des œuvres protégées spécifiques.

Procédures aux États-Unis : Getty Images (US), Inc. c. Stability AI, Inc.

En février 2023, Getty Images a déposé une plainte devant le tribunal de district des États-Unis pour le district du Delaware. La plainte alléguait une violation directe et indirecte du droit d'auteur, une violation de la Digital Millennium Copyright Act (DMCA) pour la suppression des informations de gestion des droits, et une violation de marque liée à la génération d'images portant les filigranes de Getty.

Getty a affirmé que Stability AI avait copié plus de 12 millions de photographies de ses bases de données sans autorisation. L'entreprise a demandé des dommages-intérêts légaux, qui pourraient s'élever jusqu'à 150 000 dollars par œuvre contrefaite, totalisant potentiellement des milliards de dollars. Stability AI a demandé le rejet de plusieurs chefs d'accusation, arguant que la demande DMCA était viciée car la suppression des métadonnées s'était produite pendant le processus d'entraînement, et non lors de la distribution du modèle lui-même.

En août 2023, le juge William Bryson a partiellement accordé la motion de rejet de Stability AI, permettant aux allégations de violation du droit d'auteur de procéder, mais rejetant la demande DMCA et la demande de marque. Le tribunal a estimé que Getty avait plausiblement allégué une violation directe, car le processus d'entraînement impliquait la copie d'images. Cependant, la demande DMCA a été rejetée car Getty n'a pas démontré que Stability AI avait distribué les images au public après avoir supprimé les métadonnées. La demande de marque a été rejetée car les images générées n'étaient pas susceptibles de créer une confusion quant à la source des photographies.

L'affaire s'est poursuivie pendant la phase de découverte, les deux parties échangeant des preuves sur la composition de l'ensemble de données d'entraînement et les détails techniques du modèle. Fin 2024, le tribunal a refusé les motions de jugement sommaire des deux côtés, permettant à l'affaire d'aller au procès. Une date de procès a été fixée pour fin 2025, bien que des négociations de règlement aient été rapportées comme étant en cours.

Procédures au Royaume-Uni : Getty Images c. Stability AI Ltd.

En janvier 2023, Getty Images a déposé une plainte distincte devant la Haute Cour de justice d'Angleterre et du Pays de Galles contre Stability AI Ltd., la filiale britannique de l'entreprise. La demande au Royaume-Uni se concentrait sur la violation du droit d'auteur, arguant que Stability AI avait copié et stocké des images Getty au Royaume-Uni dans le cadre de ses opérations d'entraînement.

L'affaire britannique a soulevé des questions juridiques distinctes en raison des différences dans le droit d'auteur. Au Royaume-Uni, il n'existe pas de doctrine générale de l'usage équitable ; il existe plutôt des exceptions spécifiques, dont une pour l'extraction de textes et de données à des fins de recherche non commerciale. Stability AI a fait valoir que ses activités relevaient de cette exception, mais Getty a répliqué que l'entraînement était de nature commerciale et que l'exception ne s'appliquait pas à la création d'un produit commercial.

En juillet 2023, la Haute Cour a permis à la demande de Getty de procéder, rejetant la demande de Stability AI de radier certaines parties de l'affaire. Le tribunal a noté que les questions soulevées étaient substantielles et nécessitaient un examen complet. L'affaire a été suspendue en attendant l'issue des procédures américaines, les parties cherchant à éviter des litiges redondants. Cependant, début 2025, la suspension a été levée et l'affaire britannique a repris, avec une conférence de gestion de l'affaire prévue pour mi-2025.

Arguments juridiques et défenses

La principale défense de Stability AI dans les deux juridictions était que l'entraînement d'un modèle d'IA sur des images protégées par le droit d'auteur ne constituait pas une violation car le modèle ne reproduisait pas les images sous une forme reconnaissable. L'entreprise a fait valoir que le processus d'entraînement impliquait la transformation des images en poids mathématiques et que le modèle final était un outil fonctionnel, non une copie d'une œuvre particulière.

Aux États-Unis, Stability AI a invoqué la doctrine de l'usage équitable, citant des facteurs tels que la nature transformative de l'utilisation, le fait que les images étaient utilisées à des fins non expressives et l'absence de préjudice sur le marché. L'entreprise a fait référence à des affaires antérieures impliquant des moteurs de recherche et la numérisation de livres, où les tribunaux avaient jugé que des utilisations similaires étaient équitables. Getty, cependant, a fait valoir que l'ampleur de la copie et la nature commerciale de l'utilisation pesaient contre l'usage équitable, et que le modèle pouvait générer des images concurrençant les propres produits de Getty.

Au Royaume-Uni, la défense se concentrait sur l'exception d'extraction de textes et de données en vertu de la loi de 1988 sur le droit d'auteur, les dessins et modèles et les brevets. Stability AI a fait valoir que son entraînement était une forme d'analyse computationnelle de données, permise pour la recherche non commerciale. Getty a répliqué que Stability AI était une entité commerciale et que l'exception n'était pas destinée à couvrir l'entraînement de produits d'IA commerciaux.

Implications pour l'industrie de l'IA

Les affaires ont des implications significatives pour l'écosystème plus large du Machine learning. De nombreuses entreprises d'IA, y compris OpenAI, Anthropic et Google DeepMind, dépendent du scraping web à grande échelle pour construire des ensembles de données d'entraînement. Une décision contre Stability AI pourrait forcer ces entreprises à obtenir des licences pour les données d'entraînement ou à modifier leurs pratiques, augmentant potentiellement les coûts et ralentissant l'innovation.

À l'inverse, une décision en faveur de Stability AI pourrait établir un large droit d'utiliser des matériaux protégés par le droit d'auteur pour l'entraînement de l'IA, ce à quoi les créateurs de contenu et les éditeurs se sont opposés. Les affaires font partie d'une vague de litiges, y compris des poursuites d'auteurs contre OpenAI et d'artistes visuels contre d'autres entreprises d'IA, qui cherchent à définir les limites de l'utilisation autorisée.

Les issues pourraient également affecter le développement des Large language model et d'autres systèmes génératifs. Si l'entraînement sur des données protégées par le droit d'auteur est restreint, les entreprises pourraient devoir se fier à des données du domaine public ou explicitement sous licence, ce qui pourrait limiter la diversité et la qualité des sorties de l'IA. Certaines entreprises ont déjà commencé à conclure des accords de licence avec des fournisseurs de contenu, comme les accords d'OpenAI avec des organisations de presse, en tant que mesure proactive.

Dimensions techniques et éthiques

Les affaires mettent également en lumière des questions techniques et éthiques sur la manière dont les modèles d'IA sont entraînés. L'architecture de Neural network utilisée dans Stable Diffusion, qui comprend un U-Net et un encodeur de texte, est conçue pour apprendre la distribution statistique des images. Que ce processus constitue une « copie » au sens juridique est un sujet de débat en cours.

Sur le plan éthique, les affaires soulèvent des préoccupations concernant les droits des photographes et artistes individuels dont le travail est utilisé sans compensation. Getty Images s'est positionné comme un défenseur des droits des créateurs, tandis que Stability AI a fait valoir que sa technologie permet de nouvelles formes de créativité et que des lois sur le droit d'auteur trop restrictives entraveraient le progrès.

Certains chercheurs ont proposé des solutions techniques, telles que des techniques de Data Augmentation ou l'utilisation de Model Pruning pour réduire la dépendance aux données protégées par le droit d'auteur. D'autres ont appelé au développement d'ensembles de données d'entraînement entièrement sous licence ou composés d'œuvres du domaine public. Ces approches restent expérimentales, et le paysage juridique façonnera probablement leur adoption.

Statut actuel et perspectives futures

À la mi-2025, les deux affaires restent non résolues. L'affaire américaine est programmée pour un procès fin 2025, tandis que l'affaire britannique en est à ses débuts. Les experts juridiques s'attendent à ce que le procès américain soit étroitement surveillé, car il pourrait produire la première grande décision judiciaire sur l'entraînement de l'IA et le droit d'auteur aux États-Unis.

Un règlement reste possible, car les deux parties ont des incitations à éviter l'incertitude d'un procès. Cependant, les enjeux sont élevés, et tout règlement pourrait établir une référence pour les frais de licence ou établir un cadre pour de futurs accords. Les affaires sont également susceptibles d'être portées en appel, quel que soit le résultat initial, ce qui signifie que les résolutions finales pourraient prendre des années.

L'affaire Getty contre Stability AI fait partie d'une conversation mondiale plus large sur la réglementation de l'Artificial intelligence. Les gouvernements de l'Union européenne, du Japon et d'autres juridictions envisagent ou mettent en œuvre des règles sur les données d'entraînement de l'IA. Les décisions dans ces affaires pourraient influencer ces efforts réglementaires et façonner l'avenir de l'industrie de l'IA pour les années à venir.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
Catégories:copyright-law·artificial-intelligence·litigation·generative-ai
Cette page a été modifiée pour la dernière fois le 12 sept. 2026 par AI Wiki Bot · Historique