Getty v. Stability (2023)은 Getty Images가 Stable Diffusion 이미지 생성 모델의 개발자인 Stability AI를 상대로 제기한 저작권 침해 소송입니다. 2023년 1월 미국 델라웨어주 지방법원에 제기된 이 소송은 Stability AI가 허가 없이 Getty의 데이터베이스에서 수백만 장의 이미지를 복사하고 처리하여 자사의 Generative AI 모델을 훈련시켰다고 주장합니다. 이 소송은 법정 손해배상, 금지 명령, 그리고 침해하는 훈련 데이터의 폐기를 요구합니다.
이 분쟁은 Deep learning 시스템 훈련에 웹에서 수집된 이미지를 사용하는 것에 초점을 맞추고 있습니다. 주요 스톡 사진 기관인 Getty Images는 Stability AI의 행위가 자사 및 기여자들의 저작권을 침해한다고 주장합니다. Stability AI는 공개적으로 이용 가능한 이미지의 사용이 공정 이용에 해당한다고 주장해 왔으며, 이는 Artificial intelligence 분야의 여러 유사 사건에서 핵심적인 방어 논리였습니다.
사건 배경
2022년, Stability AI는 텍스트 프롬프트에서 상세한 이미지를 생성할 수 있는 오픈소스 Neural network 모델인 Stable Diffusion을 출시했습니다. 이 모델은 인터넷에서 수집된 수십억 개의 이미지-텍스트 쌍을 포함한 LAION-5B라는 데이터 세트로 훈련되었습니다. 수백만 장의 사진을 라이선스하는 Getty Images는 자사의 독점 이미지 중 상당 부분이 허가 없이 이 데이터 세트에 포함되었다고 주장했습니다.
Getty Images는 2023년 1월 13일 미국 델라웨어주 지방법원에 소장을 제출했습니다. 이 소송은 Stability AI와 그 CEO인 Emad Mostaque, 그리고 회사의 미국 자회사인 Stability AI Ltd.를 피고로 지목합니다. 소장은 직접, 기여, 대위적 저작권 침해와 함께 저작권 관리 정보를 제거하거나 변경한 것에 대한 디지털 밀레니엄 저작권법(DMCA) 위반을 주장합니다.
법적 주장 및 논거
Getty Images의 주요 주장은 Stability AI가 훈련 과정에서 수백만 장의 저작권 있는 이미지를 복제하고 저장했다는 것입니다. 회사는 이러한 복제가 변형적이지 않으며 Stability AI 사용의 상업적 성격이 공정 이용에 불리하게 작용한다고 주장합니다. Getty는 또한 Stable Diffusion이 워터마크 및 기타 식별 표시를 포함하여 원본 사진과 매우 유사한 이미지를 생성할 수 있다고 주장하며, 이는 공정 이용 방어를 더욱 약화시킵니다.
Stability AI는 공개적으로 이용 가능한 이미지에 대한 훈련이 인간 예술가가 기존 작품에서 배우는 것과 유사한 합법적인 공정 이용이라고 주장하며 대응했습니다. 회사는 또한 Stable Diffusion이 생성한 이미지는 특정 저작권을 침해하지 않는 새롭고 변형적인 작품이라고 주장했습니다. Stability AI는 사건을 기각하려 했지만, 법원은 청구가 실질적인 법적 질문을 제기한다고 판단하여 진행을 허용했습니다.
관련 소송 및 업계 영향
Getty v. Stability 사건은 Generative AI 기업을 상대로 한 더 광범위한 소송 물결의 일부입니다. 2023년 1월, 세 명의 예술가 - Sarah Andersen, Kelly McKernan, Karla Ortiz - 가 Stability AI, Midjourney, DeviantArt를 상대로 유사한 저작권 위반을 주장하는 집단 소송을 제기했습니다. 그 사건인 Andersen v. Stability AI는 나중에 일부 기각되었지만 특정 청구에 대해서는 진행이 허용되었습니다. 저자들이 OpenAI와 Anthropic을 상대로 Large language model 훈련에 저작권 있는 텍스트를 사용한 것에 대해 다른 소송도 제기되었습니다.
이러한 사건들은 Artificial intelligence 업계에 중요한 영향을 미칩니다. 법원이 AI 기업에 불리한 판결을 내리면, 그들은 훈련 데이터에 대한 라이선스를 취득해야 할 수 있으며, 이는 비용을 증가시키고 향후 모델 개발을 변경할 수 있습니다. 반대로, 공정 이용을 지지하는 판결은 공개 데이터 훈련의 합법성을 확고히 하여 추가 혁신을 장려할 수 있습니다.
훈련 데이터의 역할
분쟁의 핵심은 Machine learning 모델이 어떻게 훈련되는지에 있습니다. Stable Diffusion은 U-Net 아키텍처와 확산(diffusion)이라는 과정을 사용하는 Generative AI 모델의 한 유형입니다. 훈련 과정은 모델에 수백만 개의 이미지와 관련 텍스트 설명을 공급하여 시각적 특징과 언어 사이의 통계적 관계를 학습하게 합니다.
Getty Images는 이 과정이 자사의 저작권 있는 작품을 무단 복제하는 것과 관련된다고 주장합니다. 회사는 Stable Diffusion이 때때로 Getty Images 워터마크를 포함하여 자사 데이터베이스의 이미지와 거의 정확한 복사본을 재생산할 수 있다고 지적했습니다. Getty는 이것이 모델이 저작권 있는 콘텐츠를 암기하고 출력할 수 있음을 보여주며, 이는 공정 이용이 아니라고 주장합니다.
절차적 경과 및 현재 상태
Getty가 소장을 제기한 후, Stability AI는 청구가 추측적이며 회사가 직접 저작권을 침해하지 않았다고 주장하며 사건 기각을 신청했습니다. 2023년 후반의 판결에서 법원은 기각 신청을 거부하고 사건이 증거 개시 단계로 진행되도록 허용했습니다. 법원은 Getty가 Stability AI가 자사 이미지를 복사했다는 점을 그럴듯하게 주장했으며 공정 이용 방어가 이 단계에서 청구를 기각하기에 충분하지 않다고 판단했습니다.
2025년 초 현재, 사건은 여전히 증거 개시 단계에 있습니다. 양측은 광범위한 문서 생산과 증언 녹취에 참여해 왔습니다. 재판 날짜는 아직 정해지지 않았습니다. 이 사건의 결과는 저작권법이 Artificial intelligence 훈련에 어떻게 적용되는지에 대한 선례를 설정할 수 있으며, Stability AI뿐만 아니라 OpenAI, Anthropic, Google DeepMind와 같은 다른 기업에도 영향을 미칠 수 있습니다.
더 넓은 맥락: AI와 저작권법
Getty v. Stability 사건은 AI와 저작권에 대한 법적 및 규제 논의를 촉발한 여러 고위험 분쟁 중 하나입니다. 미국에서 저작권청은 완전히 AI가 생성한 작품은 저작권 보호 대상이 아니라는 지침을 발표했지만, 저작권 있는 작품에 대한 훈련이 침해인지 여부는 여전히 해결되지 않았습니다. 유럽 연합에서 AI 법은 훈련 데이터에 대한 투명성 요구 사항을 포함하지만 저작권을 명시적으로 다루지는 않습니다.
일부 전문가들은 현재 저작권법이 AI 훈련의 복잡성을 처리하기에 부적합하다고 주장합니다. 그들은 저작권 보유자와 AI 개발자의 이익을 균형 잡기 위해 새로운 법안이 필요할 수 있다고 제안합니다. 다른 이들은 공정 이용이 충분하며 법원이 궁극적으로 공개 데이터 훈련의 합법성을 지지할 것이라고 믿습니다.
잠재적 결과 및 영향
Getty Images가 승소하면 Stability AI는 상당한 손해 배상을 지급하고 훈련 데이터 세트를 제거하거나 폐기하라는 명령을 받을 수 있습니다. 이는 다른 개발자들이 라이선스 없이 웹에서 수집된 데이터를 훈련하는 것을 꺼릴 수 있기 때문에 오픈소스 AI 모델 개발에 위축 효과를 가져올 수 있습니다. 또한 Getty Images와 같은 기업이 AI 훈련 목적으로 아카이브 접근 권한을 판매하는 라이선스 훈련 데이터 시장으로 이어질 수 있습니다.
Stability AI가 승소하면 공개 데이터 훈련이 공정 이용이라는 개념을 강화하여 AI 개발을 가속화할 수 있습니다. 그러나 이는 더 공격적인 데이터 수집 관행으로 이어져 라이선스 비용에 의존하는 사진작가 및 기타 콘텐츠 제작자에게 해를 끼칠 수 있습니다.
이 사건은 Artificial intelligence 커뮤니티, 법률 학자, 콘텐츠 제작자들이 면밀히 지켜보고 있습니다. 그 해결은 AI 기업이 데이터 수집에 접근하는 방식과 저작권 보유자로부터 라이선스를 구할지 여부에 영향을 미칠 가능성이 높습니다. 현재로서는 사건이 계류 중이며 최종 판결은 내려지지 않았습니다.