작가들의 OpenAI 집단 소송

영어에서 번역됨

미국 소설 작가들이 OpenAI를 상대로 제기한 훈련 데이터 사용 관련 저작권 소송들이 통합된 사건으로, 대규모 언어 모델에서 저작물이 무단 복제되었다고 주장한다. 이 사건들은 2024년 뉴욕 남부 지방 법원에서 통합되었으며, 공정 사용 및 일부 청구 기각에 대한 주요 판결이 내려졌다.

작가들이 OpenAI를 상대로 제기한 집단 소송(Author Class Actions Against OpenAI)은 소설 작가들이 OpenAI - ChatGPT와 같은 제품의 기반이 되는 대규모 언어 모델의 개발사 - 를 상대로 제기한 일련의 통합된 미국 연방 소송입니다. 원고들은 OpenAI가 허가 없이 저작권이 있는 자신들의 책을 복제하여 모델을 훈련시켰고, 이는 직접적 및 간접적 저작권 침해에 해당하며, 회사가 그러한 무단 사용으로 이익을 얻었다고 주장합니다. 뉴욕 남부 연방지방법원에 통합된 이 소송은 생성형 AI 시스템 훈련에 저작권법이 어떻게 적용되는지에 대한 핵심 시험대가 되었습니다.

이 사건들은 2022년 말 ChatGPT의 상업적 출시와 이후 OpenAI의 모델 제품군 확장의 여파로 등장했습니다. 작가들은 자신들의 저작물이 허가나 보상 없이 훈련에 사용된 방대한 텍스트 코퍼스에 포함되었고, 모델이 자신들의 책에 있는 구절을 재생산하거나 밀접하게 의역할 수 있다고 주장했습니다. OpenAI는 기계 학습의 변형적 성격과 모델이 학습하는 비표현적 통계적 패턴을 근거로 저작권 있는 자료의 사용이 공정 이용 원칙에 해당한다고 대응했습니다.

소송 절차 및 통합

첫 번째 주요 작가 소송은 2023년 6월 코미디언이자 작가인 사라 실버만(Sarah Silverman)이 작가 리처드 카드레이(Richard Kadrey)와 크리스토퍼 골든(Christopher Golden)과 함께 캘리포니아 북부 지방법원에 제기했습니다. 이 사건인 Silverman v. OpenAI는 OpenAI의 훈련 데이터에 불법 복제된 도서 저장소가 포함되어 있다고 주장했습니다. 2023년 7월, 같은 로펌이 대리하는 작가 폴 트렘블레이(Paul Tremblay)와 모나 아와드(Mona Awad)가 OpenAI와 파트너사인 마이크로소프트를 상대로 뉴욕 남부 지방법원에 별도의 집단 소송을 제기했습니다.

2023년 9월, 사법부 다지역 소송 통합 위원회(Judicial Panel on Multidistrict Litigation)는 여러 중복되는 작가 소송을 In re OpenAI ChatGPT Litigation이라는 단일 절차로 통합하여 뉴욕 남부 지방법원의 제드 S. 라코프(Jed S. Rakoff) 판사에게 배정했습니다. 통합 소송에는 조지 R.R. 마틴, 존 그리샴, 조디 피콜트 등 이후 합류한 작가들의 청구가 포함되었지만, 일부 작가들은 별도로 소송을 제기했다가 나중에 본 사건에 포함되었습니다. 2024년 초까지 주 원고들은 통합 수정 고소장을 제기하여 부당 이득 및 과실 청구를 추가하고 OpenAI와 CEO 샘 올트먼을 피고로 지목했습니다.

핵심 법적 주장

원고들의 주요 주장은 17 U.S.C. § 501에 따른 직접 저작권 침해로, OpenAI가 훈련 중 및 모델 출력에서 자신들의 저작물을 복제하고 배포했다고 주장합니다. 또한 OpenAI가 침해 활동을 통제할 권리와 능력을 가지고 있었고 그로부터 이익을 얻었다고 주장하며 대리 및 기여 침해도 주장했습니다. 고소장은 ChatGPT가 저작권이 있는 책에서 거의 그대로의 발췌문을 생성한 특정 사례를 인용하며, 이는 모델이 표현적 콘텐츠를 저장하고 검색함을 보여준다고 주장했습니다.

두 번째 주요 주장은 훈련 데이터에서 저자 이름과 제목과 같은 저작권 관리 정보(CMI)를 제거한 것이 디지털 밀레니엄 저작권법(DMCA)을 위반했다는 것이었습니다. 원고들은 CMI 제거가 침해를 용이하게 하고 작가들의 권리 행사를 방해한다고 주장했습니다. OpenAI는 이 주장에 대한 기각 신청을 하며, DMCA 조항이 침해를 유도할 의도를 요구하는데 원고들이 이를 그럴듯하게 주장하지 못했다고 항변했습니다.

주요 판결

2024년 2월, 라코프 판사는 원고들이 OpenAI가 침해를 은폐하기 위해 의도적으로 CMI를 제거했다는 점을 적절히 주장하지 못했다고 보고 DMCA 주장을 기각했습니다. 그는 핵심 저작권 주장이 진행되도록 허용하면서, OpenAI의 주장인 주(state)법에 의한 선점(preemption)과 모든 저작물을 등록하지 않았기 때문에 원고 적격이 없다는 주장을 기각했습니다.

2024년 11월, 라코프 판사는 공정 이용에 대한 중대한 판결을 내렸습니다. 그는 직접 침해 주장에 대한 OpenAI의 기각 신청을 기각하고, 공정 이용 항변이 소장 단계에서 해결될 수 없다고 판시했습니다. 법원은 사용이 변형적인지, 모델이 원저작물과 경쟁하는지 여부는 사실관계에 대한 질문으로 증거 개시(discovery)가 필요하다고 강조했습니다. 판결은 또한 고품질 텍스트 데이터의 부족에 대한 내부 커뮤니케이션을 포함한 OpenAI의 자체 문서가 사용의 목적과 성격을 판단하는 데 영향을 미칠 수 있다고 언급했습니다.

그러나 같은 달의 별도 판결에서 라코프 판사는 부당 이득 및 과실 주장을 저작권 주장과 중복되고 경제적 손실 원칙에 의해 배제된다고 보아 기각했습니다. 또한 모델 출력이 도서 판매를 감소시킬 것이라는 추측적 피해 이론에 의존하는 일부 주장도 삭제했습니다.

공정 이용 논쟁

OpenAI의 공정 이용 항변은 네 가지 법정 요소, 즉 사용의 목적과 성격, 저작권 있는 저작물의 성격, 사용된 양과 실질성, 잠재적 시장에 미치는 영향에 기반합니다. 회사는 신경망 훈련이 표현적 사용이 아니라고 주장했습니다. 모델이 특정 표현을 재생산하기보다 통계적 패턴을 학습하기 때문입니다. OpenAI는 변형적 목적을 위한 코드 복제가 공정 이용이라고 판시한 대법원의 Google v. Oracle (2021) 판결과 검색을 위한 구글의 도서 스캔이 공정 이용이라고 판시한 제2순회 항소법원의 Authors Guild v. Google (2015) 판결을 인용했습니다.

원고들은 OpenAI의 사용이 상업적이며 모델이 원저작물과 경쟁하는 텍스트를 생성하여 허가된 복제 시장에 해를 끼칠 수 있다고 반박했습니다. 또한 수백만 권의 책에서 수십억 단어를 복제한 규모는 Google Books 사건의 제한된 발췌문과 유사하지 않다고 주장했습니다. 법원의 2024년 11월 판결은 이러한 쟁점들을 재판으로 넘겼으며, 실제 출력과 경제적 영향을 평가하려면 증거 개시가 필요하다고 언급했습니다.

관련 소송 및 맥락

작가 사건들은 AI 회사들을 상대로 한 더 광범위한 저작권 소송의 일부입니다. 2023년에는 시각 예술가들이 Stability AI, Midjourney, DeviantArt를 상대로 집단 소송을 제기했고, 2024년에는 음악 출판사들이 가사 재생산에 대해 Anthropic을 상대로 소송을 제기했습니다. Anthropic 사건인 Concord Music Group v. Anthropic은 훈련 데이터와 출력 재생산에 관한 유사한 주장을 포함했습니다. 작가 사건들은 또한 2023년 12월에 제기된 OpenAI와 마이크로소프트에 대한 뉴욕타임스 소송과도 교차합니다. 이 소송은 모델이 뉴스 기사를 그대로 재생산했다고 주장했습니다.

작가 소송에서 법원은 뉴욕타임스 사건과 증거 개시를 조정하여 문서 생산과 전문가 증언을 공유하도록 했습니다. 이러한 조정은 소송 진행 속도를 늦추었고, 법원은 2025년 말 또는 2026년 초에 재판 날짜를 잡았습니다. 2025년 초 현재, 당사자들은 OpenAI 임원 및 기술 직원에 대한 증언 녹취(depositions)와 훈련 데이터 메타데이터 교환을 포함한 사실 증거 개시 단계에 있었습니다.

AI 개발에 미치는 영향

작가 집단 소송의 결과는 인공지능 산업에 중대한 영향을 미칠 수 있습니다. 허가 없이 저작권 있는 저작물을 훈련에 사용하는 것이 공정 이용이 아니라는 판결이 나오면 AI 개발자들은 출판사 및 작가와 라이선스를 협상해야 하며, 이는 비용을 증가시키고 훈련 데이터의 다양성을 제한할 수 있습니다. 반대로 OpenAI에 유리한 판결은 현재 훈련 관행의 합법성을 확인하는 것이지만 출력 재생산에 대한 질문을 해결하지는 못할 수 있습니다.

이 사건은 또한 입법적 관심을 불러일으켰습니다. 2024년, 여러 미국 상원의원이 훈련 데이터 투명성 요구 사항과 저작권 있는 저작물에 대한 법정 라이선스 제도를 제안하는 법안을 발의했습니다. 작가 소송은 더 명확한 규칙의 필요성에 대한 증거로 이러한 논쟁에서 인용되었습니다. 국제적으로 2024년에 채택된 유럽연합의 AI법은 훈련 데이터 요약 공개 요구 사항을 포함하지만 저작권 책임을 직접 다루지는 않습니다.

현재 상태 및 전망

2025년 초 현재, 통합 소송은 증거 개시 단계에 있습니다. 법원은 집단 인증 신청을 기각했지만, 원고들은 사실 증거 개시 후 다시 인증을 신청할 것이라고 밝혔습니다. 라코프 판사는 2025년 중반에 재판 전 회의를 예정했으며, 2026년 재판 가능성이 있습니다. 이 사건은 법률 학자와 업계 관찰자들이 널리 주시하고 있으며, 대규모 기계 학습에 공정 이용을 미국 법원이 어떻게 적용하는지에 대한 선례를 세울 수 있습니다.

OpenAI는 또한 캐나다의 집단 소송과 미국 저작권청에 대한 이의 제기 등 다른 관할권에서도 병행 소송에 직면했습니다. 회사는 Axel Springer 및 Associated Press와 같은 일부 출판사와 라이선스 계약을 체결하기 시작했지만 개별 소설 작가들과는 계약을 체결하지 않았습니다. 작가 집단 소송은 OpenAI의 훈련 관행에 대한 가장 포괄적인 도전으로 남아 있으며, 그 해결은 생성형 AI와 저작권법의 미래를 형성할 가능성이 높습니다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:copyright-law·openai·class-action·generative-ai
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사