Getty v. Stability AI 사건은 Getty Images가 Stable Diffusion 이미지 생성 모델의 개발사인 Stability AI를 상대로 제기한 두 건의 병행 소송을 포함합니다. 분쟁의 핵심은 Stability AI가 허가 없이 Getty의 데이터베이스에서 수백만 장의 저작권 보호 사진을 복제하여 인공지능 시스템을 훈련시켰다는 주장입니다. 미국과 영국에서 제기된 이 소송은 Generative AI 개발과 기존 저작권법 간의 긴장 관계를 보여주는 획기적인 사례로 자리 잡았습니다.
주요 스톡 사진 기관인 Getty Images는 2023년 초 두 관할권에서 법적 조치를 시작했습니다. 회사는 Stability AI가 Machine learning 모델 훈련을 위해 자사의 독점 이미지를 사용한 것이 대규모 저작권 침해에 해당한다고 주장했습니다. 이에 대해 Stability AI는 자사의 관행이 텍스트 및 데이터 마이닝에 대한 법적 예외와 미국 맥락에서의 공정 사용 원칙에 해당한다고 주장했습니다. 이 사건들의 결과는 기술 기업, 콘텐츠 제작자, 법률 학자들이 예의주시하고 있으며, 향후 Artificial intelligence 모델이 어떻게 훈련되는지에 대한 선례를 설정할 수 있습니다.
배경: Stable Diffusion 및 훈련 데이터
2022년 8월 Stability AI가 출시한 Stable Diffusion은 텍스트 프롬프트에서 상세한 이미지를 생성할 수 있는 Deep learning 모델입니다. 이 모델은 인터넷에서 수집된 수십억 개의 이미지-텍스트 쌍을 포함하는 LAION-5B라는 데이터셋으로 훈련되었습니다. Getty Images는 이 데이터셋의 상당 부분에 자사의 저작권 보호 사진이 포함되어 있으며, 그중 다수가 워터마크가 있거나 Getty 콘텐츠임을 식별하는 메타데이터가 포함되어 있다고 주장했습니다.
이러한 모델의 훈련 과정은 일반적으로 U-Net과 텍스트 인코더를 결합한 Neural network 아키텍처에 방대한 수의 이미지를 입력하는 것을 포함합니다. 훈련 중에 모델은 시각적 특징과 설명 단어를 연결하는 통계적 패턴을 학습합니다. Getty는 이 과정이 필연적으로 원본 이미지의 복제와 저장을 적어도 일시적으로 수반하며, 결과 모델이 특정 저작권 보호 작품과 매우 유사한 출력을 생성할 수 있다고 주장했습니다.
미국 소송: Getty Images (US), Inc. 대 Stability AI, Inc.
2023년 2월, Getty Images는 미국 델라웨어 지방법원에 소송을 제기했습니다. 소장은 직접 및 간접 저작권 침해, 저작권 관리 정보 제거에 따른 디지털 밀레니엄 저작권법(DMCA) 위반, 그리고 Getty 워터마크가 있는 이미지 생성과 관련된 상표권 침해를 주장했습니다.
Getty는 Stability AI가 허가 없이 데이터베이스에서 1,200만 장 이상의 사진을 복제했다고 주장했습니다. 회사는 침해 작품당 최대 150,000달러에 달하는 법정 손해배상을 요구했으며, 총액은 수십억 달러에 이를 수 있습니다. Stability AI는 여러 청구를 기각하기 위한 신청을 제기하며, DMCA 청구는 메타데이터 제거가 모델 자체의 배포가 아닌 훈련 과정에서 발생했기 때문에 결함이 있다고 주장했습니다.
2023년 8월, William Bryson 판사는 Stability AI의 기각 신청을 부분적으로 인용하여 저작권 침해 청구는 진행을 허용했지만 DMCA 청구와 상표권 청구는 기각했습니다. 법원은 훈련 과정이 이미지 복제를 포함하므로 Getty가 직접 침해를 그럴듯하게 주장했다고 판단했습니다. 그러나 Getty가 메타데이터 제거 후 Stability AI가 이미지를 공개적으로 배포했다는 점을 입증하지 못했기 때문에 DMCA 청구는 기각되었습니다. 상표권 청구는 생성된 이미지가 사진의 출처에 대해 혼동을 일으킬 가능성이 없기 때문에 기각되었습니다.
사건은 증거 개시 절차를 통해 진행되었으며, 양측은 훈련 데이터셋의 구성과 모델의 기술적 세부 사항에 대한 증거를 교환했습니다. 2024년 말, 법원은 양측의 약식 판결 신청을 모두 기각하여 사건이 재판으로 진행되도록 허용했습니다. 재판 날짜는 2025년 말로 설정되었지만, 화해 협상이 진행 중인 것으로 보고되었습니다.
영국 소송: Getty Images 대 Stability AI Ltd.
2023년 1월, Getty Images는 영국 자회사인 Stability AI Ltd.를 상대로 잉글랜드 및 웨일즈 고등법원에 별도의 소송을 제기했습니다. 영국 청구는 저작권 침해에 초점을 맞추었으며, Stability AI가 훈련 운영의 일환으로 영국에서 Getty 이미지를 복제하고 저장했다고 주장했습니다.
영국 사건은 저작권법의 차이로 인해 별개의 법적 질문을 제기했습니다. 영국에는 일반적인 공정 사용 원칙이 없으며, 대신 비상업적 연구를 위한 텍스트 및 데이터 마이닝 예외를 포함한 특정 예외가 있습니다. Stability AI는 자사의 활동이 이 예외에 해당한다고 주장했지만, Getty는 훈련이 상업적 성격을 띠며 예외가 상업 제품의 창작에는 적용되지 않는다고 반박했습니다.
2023년 7월, 고등법원은 Stability AI의 사건 일부 기각 신청을 거부하고 Getty의 청구 진행을 허용했습니다. 법원은 제기된 문제가 중요하며 완전한 검토가 필요하다고 지적했습니다. 사건은 중복 소송을 피하기 위해 미국 소송의 결과를 기다리며 중단되었습니다. 그러나 2025년 초, 중단이 해제되어 영국 사건이 재개되었으며, 2025년 중반에 사건 관리 회의가 예정되었습니다.
법적 주장 및 방어
두 관할권 모두에서 Stability AI의 주요 방어는 저작권 보호 이미지로 AI 모델을 훈련하는 것이 모델이 이미지를 인식 가능한 형태로 재생산하지 않기 때문에 침해에 해당하지 않는다는 것이었습니다. 회사는 훈련 과정이 이미지를 수학적 가중치로 변환하는 것을 포함하며 최종 모델은 특정 작품의 복사본이 아닌 기능적 도구라고 주장했습니다.
미국에서 Stability AI는 사용의 변형적 성격, 이미지가 비표현적 목적으로 사용된 점, 시장 피해 부재와 같은 요소를 인용하여 공정 사용 원칙을 주장했습니다. 회사는 법원이 유사한 사용을 공정 사용으로 판결한 검색 엔진 및 도서 디지털화 사례를 언급했습니다. 그러나 Getty는 복제 규모와 사용의 상업적 성격이 공정 사용에 반하며, 모델이 Getty의 자체 제품과 경쟁하는 이미지를 생성할 수 있다고 주장했습니다.
영국에서 방어는 1988년 저작권, 디자인 및 특허법에 따른 텍스트 및 데이터 마이닝 예외에 중점을 두었습니다. Stability AI는 자사의 훈련이 비상업적 연구를 위해 허용된 데이터의 계산적 분석 형태라고 주장했습니다. Getty는 Stability AI가 상업적 법인이며 예외가 상업적 AI 제품의 훈련을 포함하도록 의도되지 않았다고 반박했습니다.
AI 산업에 대한 시사점
이 사건들은 더 넓은 Machine learning 생태계에 중요한 시사점을 제공합니다. OpenAI, Anthropic, Google DeepMind를 포함한 많은 AI 기업들은 훈련 데이터셋 구축을 위해 대규모 웹 스크래핑에 의존합니다. Stability AI에 대한 불리한 판결은 이러한 기업들이 훈련 데이터를 라이선스하거나 관행을 변경하도록 강제하여 비용을 증가시키고 혁신을 늦출 수 있습니다.
반대로 Stability AI에 유리한 판결은 AI 훈련을 위한 저작권 보호 자료 사용에 대한 광범위한 권리를 확립할 수 있으며, 이는 콘텐츠 제작자와 출판사가 반대해 왔습니다. 이 사건들은 OpenAI를 상대로 한 작가들의 소송과 다른 AI 기업을 상대로 한 시각 예술가들의 소송을 포함한 일련의 소송의 일부로, 허용 가능한 사용의 경계를 정의하려고 합니다.
결과는 Large language model 및 기타 생성 시스템의 개발에도 영향을 미칠 수 있습니다. 저작권 보호 데이터에 대한 훈련이 제한되면 기업은 공개 도메인 또는 명시적으로 라이선스된 데이터에 의존해야 할 수 있으며, 이는 AI 출력의 다양성과 품질을 제한할 수 있습니다. 일부 기업은 OpenAI의 뉴스 조직과의 계약과 같은 선제적 조치로 콘텐츠 제공자와 라이선스 계약을 이미 체결하기 시작했습니다.
기술적 및 윤리적 차원
이 사건들은 AI 모델이 어떻게 훈련되는지에 대한 기술적 및 윤리적 질문도 강조합니다. Stable Diffusion에 사용된 Neural network 아키텍처는 U-Net과 텍스트 인코더를 포함하며, 이미지의 통계적 분포를 학습하도록 설계되었습니다. 이 과정이 법적 의미에서 "복제"에 해당하는지 여부는 계속되는 논쟁의 대상입니다.
윤리적으로 이 사건들은 보상 없이 작업이 사용되는 개별 사진가와 예술가의 권리에 대한 우려를 제기합니다. Getty Images는 창작자 권리의 수호자로 자리매김한 반면, Stability AI는 자사의 기술이 새로운 형태의 창의성을 가능하게 하며 지나치게 제한적인 저작권법이 진보를 방해할 것이라고 주장했습니다.
일부 연구자들은 Data Augmentation 기술이나 Model Pruning 사용과 같은 기술적 해결책을 제안하여 저작권 보호 데이터에 대한 의존도를 줄였습니다. 다른 이들은 완전히 라이선스되거나 공개 도메인 작품으로 구성된 훈련 데이터셋 개발을 촉구했습니다. 이러한 접근 방식은 여전히 실험적이며, 법적 환경이 그 채택을 형성할 것입니다.
현재 상태 및 향후 전망
2025년 중반 현재, 두 사건 모두 해결되지 않았습니다. 미국 사건은 2025년 말 재판이 예정되어 있으며, 영국 사건은 초기 단계에 있습니다. 법률 전문가들은 미국 재판이 미국에서 AI 훈련과 저작권에 대한 첫 주요 사법 결정을 생산할 수 있기 때문에 예의주시될 것이라고 기대합니다.
화해 가능성은 여전히 존재하며, 양측 모두 재판의 불확실성을 피하려는 인센티브가 있습니다. 그러나 이해관계가 크며, 어떤 화해든 라이선스 비용의 기준을 설정하거나 향후 계약을 위한 프레임워크를 확립할 수 있습니다. 이 사건들은 초기 결과와 관계없이 항소될 가능성이 높으며, 최종 해결에는 수년이 걸릴 수 있습니다.
Getty v. Stability AI 사건은 Artificial intelligence 규제에 대한 더 넓은 글로벌 논의의 일부입니다. 유럽 연합, 일본 및 기타 관할권의 정부는 AI 훈련 데이터에 대한 규칙을 고려하거나 시행하고 있습니다. 이 사건들의 결정은 이러한 규제 노력에 영향을 미치고 향후 수년간 AI 산업의 미래를 형성할 수 있습니다.