Getty Images contre Stability AI est un litige juridique majeur déposé en janvier 2023 devant la Haute Cour de justice d'Angleterre et du Pays de Galles. L'affaire allègue que Stability AI, le développeur du modèle d'image IA générative Stable Diffusion, a enfreint le droit d'auteur et les droits de base de données en extrayant et en utilisant des millions d'images de la collection de Getty sans autorisation. Le procès demande des dommages-intérêts et une injonction pour empêcher toute utilisation ultérieure du contenu de Getty dans l'entraînement de l'IA, soulevant des questions fondamentales sur l'intersection entre intelligence artificielle et le droit de la propriété intellectuelle.
Le litige est l'une des nombreuses actions très médiatisées contre les entreprises d'IA, aux côtés de poursuites intentées par des artistes et des agences de photos d'archives aux États-Unis. Il met en lumière la tension entre l'avancement rapide des technologies d'apprentissage automatique et les droits des créateurs de contenu. L'issue pourrait créer un précédent quant à la manière dont les modèles d'IA sont entraînés et s'ils doivent obtenir des licences pour les données d'entraînement.
Contexte de l'affaire
Getty Images, une importante agence de photos d'archives, possède une vaste bibliothèque de plus de 400 millions d'images, dont beaucoup sont protégées par le droit d'auteur. En 2022, Stability AI a publié Stable Diffusion, un modèle d'apprentissage profond open-source capable de générer des images réalistes à partir de invites textuelles. Le modèle a été entraîné sur LAION-5B, un ensemble massif de données d'images et de légendes extraites d'Internet, qui comprenait un nombre substantiel de photographies protégées par le droit d'auteur de Getty.
Getty Images a découvert que ses images filigranées et d'autres œuvres protégées étaient utilisées sans autorisation. La société a fait valoir que Stability AI avait non seulement copié les images, mais aussi les avait extraites et stockées dans le cadre du processus d'entraînement, ce qui constitue une violation directe du droit d'auteur et des droits de base de données en vertu du droit britannique. Getty a également affirmé que le modèle pouvait reproduire des copies quasi identiques de ses images, aggravant encore la violation.
Demandes juridiques et arguments
La demande principale de Getty est que Stability AI a enfreint son droit d'auteur en reproduisant, stockant et traitant des millions d'images sans licence. En vertu du droit d'auteur britannique, la copie d'une œuvre sous quelque forme matérielle que ce soit, y compris le stockage numérique, nécessite une autorisation. Getty a fait valoir que le processus d'entraînement implique nécessairement la réalisation de copies des images et que Stability AI n'a obtenu aucune permission de ce type.
En outre, Getty a affirmé que Stability AI avait violé ses droits de base de données. Le règlement britannique de 1997 sur le droit d'auteur et les droits dans les bases de données protège l'investissement dans la compilation d'une base de données. La collection de Getty, avec sa curation et ses métadonnées, qualifie de base de données protégée, et l'extraction de parties substantielles par Stability AI a été alléguée comme étant illicite.
Stability AI, dans sa défense, a soutenu que l'utilisation des images pour l'entraînement constitue une « copie transitoire » ou une exception de « fouille de textes et de données » en vertu du droit britannique. Le Royaume-Uni a introduit une exception de fouille de textes et de données en 2014, mais elle est limitée à la recherche non commerciale. Stability AI a fait valoir que l'exception s'appliquait, mais Getty a répliqué que l'utilisation commerciale du modèle par Stability AI la disqualifiait de cette défense.
Développements clés de la procédure
Au début de 2023, l'affaire a été déposée et les deux parties ont participé à des requêtes préalables au procès. En juillet 2023, la Haute Cour a rendu une décision sur la compétence, permettant aux demandes de Getty de procéder contre la filiale britannique de Stability AI, Stability AI Ltd., tout en autorisant également les demandes contre la société mère américaine, Stability AI Inc., à être signifiées hors du territoire. Cette décision a été significative car elle a établi que les tribunaux britanniques pouvaient entendre l'affaire contre une entité étrangère.
En 2024, le tribunal a ordonné la divulgation de certaines données d'entraînement et de la documentation technique, exigeant que Stability AI fournisse des preuves sur la composition de ses ensembles de données d'entraînement. Ce processus a été contentieux, Stability AI faisant valoir que les informations étaient sensibles d'un point de vue commercial. Le tribunal a toutefois mis en balance cela avec le besoin de Getty d'établir l'étendue de la violation.
Un développement notable s'est produit à la fin de 2024 lorsque le tribunal a partiellement radié certaines défenses de Stability AI, statuant que l'exception de fouille de textes et de données ne s'appliquait pas aux activités commerciales. Cela a réduit les questions à trancher lors du procès, en se concentrant sur la question de savoir si le processus d'entraînement lui-même constitue une violation du droit d'auteur.
Contexte plus large et affaires connexes
Le procès Getty contre Stability AI fait partie d'une vague de litiges contre les développeurs d'IA. Aux États-Unis, Getty Images a intenté une action en justice distincte contre Stability AI devant le tribunal de district du Delaware en février 2023, alléguant des violations similaires du droit d'auteur. De plus, des recours collectifs intentés par des artistes, comme l'affaire Andersen contre Stability AI, ont été déposés, alléguant que les modèles d'IA portent atteinte aux droits des créateurs individuels.
Ces affaires ont attiré l'attention des régulateurs et des décideurs politiques. La loi européenne sur l'IA, entrée en vigueur en 2024, comprend des dispositions sur la transparence des données d'entraînement, exigeant que les développeurs d'IA divulguent le matériel protégé par le droit d'auteur utilisé. Le gouvernement britannique a également envisagé des réformes du droit d'auteur pour traiter l'entraînement de l'IA, mais aucun changement définitif n'a été promulgué en date de 2025.
L'issue de Getty contre Stability AI pourrait influencer ces efforts législatifs. Si le tribunal statue en faveur de Getty, cela pourrait forcer les entreprises d'IA à négocier des licences avec les propriétaires de contenu, augmentant potentiellement le coût de développement des modèles d'IA. À l'inverse, une décision en faveur de Stability AI pourrait établir une exception large pour l'entraînement de l'IA, ce que beaucoup dans l'industrie technologique soutiennent être nécessaire pour l'innovation.
Implications pour l'industrie de l'IA
L'affaire a des implications significatives pour les communautés de réseaux neuronaux et d'apprentissage profond. L'entraînement de modèles à grande échelle comme Stable Diffusion nécessite d'énormes quantités de données, et l'incertitude juridique autour du droit d'auteur a conduit à l'émergence d'ensembles de données sous licence et de partenariats. Par exemple, certaines entreprises d'IA ont signé des accords avec des agences de photos d'archives pour utiliser leur contenu légalement, tandis que d'autres ont développé des techniques de génération de données synthétiques.
Stability AI a fait valoir qu'exiger des licences pour chaque image d'un ensemble de données d'entraînement serait impraticable et étoufferait le progrès. La société a souligné la nature transformatrice de l'IA, qui ne reproduit pas simplement les images mais apprend des modèles et des concepts sous-jacents. Cependant, la position de Getty est que les créateurs méritent une compensation pour l'utilisation de leur travail, surtout lorsque le modèle d'IA peut générer des images qui concurrencent leurs offres de photos d'archives.
Statut actuel et calendrier prévu
En date du début de 2025, l'affaire est en phase de découverte, les deux parties échangeant des preuves. Une date de procès n'a pas été fixée, mais des experts juridiques estiment que l'affaire pourrait passer en procès à la fin de 2025 ou en 2026. La Haute Cour a indiqué qu'elle prioriserait l'affaire en raison de son importance, mais des questions techniques et juridiques complexes pourraient entraîner des retards.
Entre-temps, les parties ont engagé des discussions de règlement, bien qu'aucun accord n'ait été conclu. Getty Images a déclaré son intention de poursuivre l'affaire pour établir un précédent juridique, tandis que Stability AI a maintenu que ses pratiques sont légales. Le tribunal pourrait également renvoyer certaines questions à la Cour de justice de l'Union européenne, étant donné la nature harmonisée du droit d'auteur dans l'UE, ce qui pourrait prolonger davantage le calendrier.
Issues potentielles et importance
Les issues potentielles vont d'une victoire complète pour Getty, entraînant des dommages-intérêts et une injonction, à un rejet des demandes, ce qui serait une victoire majeure pour les développeurs d'IA. Un terrain d'entente pourrait impliquer que le tribunal constate une violation mais limite les dommages-intérêts ou permette un système de licence. Toute décision sera probablement portée en appel, ce qui signifie que la résolution finale pourrait prendre plusieurs années.
L'affaire est considérée comme un indicateur pour l'industrie de l'IA. Elle aborde des questions fondamentales sur la question de savoir si l'entraînement sur des données protégées par le droit d'auteur constitue un usage loyal ou une violation, et si les sorties générées par l'IA peuvent elles-mêmes enfreindre le droit d'auteur. La décision affectera non seulement Stability AI mais aussi d'autres entreprises développant des systèmes de grands modèles de langage et de génération d'images, y compris les grandes entreprises technologiques et les startups.
Pour les créateurs de contenu et les agences de photos d'archives, l'affaire représente une lutte pour le contrôle de leur propriété intellectuelle à l'ère de l'IA. Pour la communauté de l'IA, c'est un test des limites de l'innovation et des cadres juridiques qui la régissent. Quel que soit le résultat, le procès a déjà provoqué des changements dans la manière dont les entreprises d'IA abordent l'approvisionnement en données, beaucoup privilégiant désormais des ensembles de données sous licence ou du domaine public.
Conclusion
Getty Images contre Stability AI est une bataille juridique cruciale qui façonnera l'avenir de l'IA générative et du droit d'auteur. L'affaire souligne la nécessité d'un équilibre entre le progrès technologique et la protection des œuvres créatives. Alors que la procédure se poursuit, la communauté mondiale observe de près, anticipant une décision qui pourrait redéfinir la relation entre l'IA et la propriété intellectuelle pour les années à venir.