저자 길드 대 OpenAI

영어에서 번역됨

Authors Guild v. OpenAI는 2023년 Authors Guild와 저명한 작가들이 OpenAI를 상대로 제기한 집단 소송으로, 그들의 저작물을 허가 없이 대규모 언어 모델 훈련에 사용한 저작권 침해를 주장한다.

Authors Guild v. OpenAI는 2023년 9월 20일 뉴욕 남부 지방 법원에 제기된 집단 소송입니다. 이 소송은 작가 길드와 저명한 소설 및 논픽션 작가 그룹이 제기한 것으로, ChatGPT의 기반이 되는 대규모 언어 모델을 개발한 OpenAI가 허가 없이 저자들의 저서를 사용하여 생성형 AI 시스템을 훈련시킴으로써 저작권을 침해했다고 주장합니다. 이 사건은 AI 기업의 데이터 관행에 대한 여러 주목할 만한 법적 도전 중 하나로, 공정 사용, 저작자성, 그리고 기계 학습 시대의 창의적 노동 경제에 대한 근본적인 질문을 제기합니다.

원고에는 미국 최대 작가 전문 조직인 작가 길드와 함께 존 그리샴, 조지 R.R. 마틴, 조디 피콜트, 데이비드 발다치 같은 개별 작가들이 포함됩니다. 그들의 고소장은 OpenAI가 모델 훈련 데이터 세트에 그들의 저작물을 전체적으로 복사했으며, 이 모델이 원작을 모방하거나 요약할 수 있는 텍스트를 생성하여 시장에서 원작과 경쟁한다고 주장합니다. 이 소송은 법정 손해 배상, 금지 명령, 그리고 OpenAI가 동의나 보상 없이 저작권 있는 자료를 사용하는 것이 1976년 저작권법을 위반한다는 선언을 요구합니다.

배경: 대규모 언어 모델의 부상

2015년 비영리 연구 기관으로 설립된 OpenAI는 2019년에 막대한 컴퓨팅 자원을 확보하기 위해 이익 상한 구조로 전환했습니다. 2022년 11월에 대중에게 공개된 주력 제품인 ChatGPT는 역사상 가장 빠르게 성장한 소비자 애플리케이션 중 하나가 되어 두 달 만에 월간 사용자 1억 명을 돌파했습니다. 기반 기술은 2017년 구글 연구자들의 논문에서 소개된 트랜스포머 아키텍처로, 방대한 양의 텍스트 데이터에 대한 효율적인 훈련을 가능하게 했습니다.

대규모 언어 모델을 훈련하려면 책, 기사, 웹사이트 및 기타 서면 자료를 포함한 다양한 출처의 수십억 단어를 모델에 공급해야 합니다. OpenAI는 훈련 데이터 세트의 전체 내용을 공개적으로 밝히지 않았지만, GPT-2 및 GPT-3와 같은 초기 모델에서 인터넷의 공개 텍스트(책 포함)를 사용했음을 인정했습니다. 그 규모는 엄청납니다: 2020년에 출시된 GPT-3는 수천억 개의 토큰으로 훈련되었으며, 토큰은 단어 또는 단어의 일부에 대략 해당하는 텍스트 단위입니다.

원고들은 책이 문법, 추론, 서사 구조를 모델이 학습하는 데 도움이 되는 고품질의 장문 산문을 포함하고 있기 때문에 독특하게 가치 있는 훈련 데이터라고 주장합니다. 그러나 그들은 허가 없이 저작권 있는 책을 사용하는 것이 변형적 공정 사용이 아니라 작가의 노동에 대한 상업적 착취라고 주장합니다. 따라서 이 사건은 저작권법과 기계 학습 기술의 교차점에 있으며, 이 분야는 딥러닝신경망과 같은 기술을 통해 빠르게 발전해 왔습니다.

법적 주장 및 논거

고소장은 직접 저작권 침해, 대리 침해, 부당 이득을 포함한 여러 소송 원인을 주장합니다. 원고들은 OpenAI의 훈련 과정이 훈련 데이터 세트 생성과 원작을 밀접하게 닮은 텍스트를 생성하는 모델의 능력 모두에서 그들의 저작물을 무단 복제하는 것을 필연적으로 수반한다고 주장합니다. 그들은 또한 OpenAI의 사용이 그들의 저서 시장을 축소시켰으며, 독자들이 이제 AI가 생성한 요약이나 모방을 무료로 얻을 수 있다고 주장합니다.

OpenAI의 예상 방어는 비평, 논평, 뉴스 보도, 교육, 연구와 같은 목적을 위한 저작권 있는 자료의 제한적 사용을 허용하는 공정 사용 원칙에 초점을 맞출 것입니다. 회사는 다른 맥락에서 공개 텍스트에 대한 AI 모델 훈련이 원작을 대체하지 않는 변형적 사용이라고 주장해 왔습니다. 그러나 원고들은 OpenAI의 사용이 상업적이고 비변형적이며 그들의 저작물 시장에 해롭다고 반박하며, 2024년 초 800억 달러를 초과한 회사의 가치 평가를 지적합니다.

이 사건은 2023년 12월 뉴욕 타임즈가 OpenAI와 마이크로소프트를 상대로 제기한 관련 소송도 담당하는 시드니 H. 스타인 판사에게 배정되었습니다. 작가 길드 사건은 사라 실버맨, 리처드 카드레이, 크리스토퍼 골든이 제기한 소송을 포함한 다른 유사한 소송과 통합되었지만, 통합은 부분적이고 절차적입니다. 2023년 11월의 중요한 초기 판결에서 스타인 판사는 실버맨 사건의 일부 주장을 원고 적격 부족으로 기각했지만 다른 주장은 진행을 허용하여, 법원이 실질적인 저작권 질문에 관여할 의향이 있음을 시사했습니다.

더 넓은 소송 환경

Authors Guild v. OpenAI는 AI 기업에 대한 소송의 물결의 일부입니다. 뉴욕 타임즈 사건(OpenAI와 파트너 마이크로소프트가 수백만 개의 저작권 있는 기사를 모델 훈련에 사용했다고 주장) 외에도 다른 작가들이 Claude 모델의 제조사인 앤트로픽구글 딥마인드를 상대로 소송을 제기했습니다. 이러한 사건들은 기술 산업, 출판 부문, 법률 학자들이 면밀히 주시하고 있으며, 그 결과는 AI 기업이 훈련 데이터를 얻고 사용하는 방식에 선례를 설정할 수 있습니다.

2024년 7월 미국 저작권청이 저작권과 AI에 관한 보고서를 발표하고 의회가 AI 훈련에서 저작권 있는 저작물 사용을 다루는 새로운 법안을 고려할 것을 권고한 주목할 만한 발전이 있었습니다. 보고서는 공정 사용에 대한 확정적인 입장을 취하지 않았지만 명확성의 필요성을 강조하고 기존 법률이 저자를 적절히 보호하지 못할 수 있다고 제안했습니다. 이러한 규제 불확실성은 일부 AI 기업이 OpenAI가 악셀 슈프링어 및 AP 통신과 같은 뉴스 기관과 체결한 계약과 같은 콘텐츠 제공자와의 라이선스 계약을 체결하도록 이끌었지만, 그러한 계약은 대다수의 작가를 포함하지 않습니다.

작가 길드는 또한 음악 출판사와 작곡가가 사용하는 것과 유사한 집단 라이선스 메커니즘을 옹호하는 데 적극적입니다. 2024년에 길드는 AI 기업이 저작권 있는 저작물을 사용하기 위해 구독료를 지불하고 수익을 사용량에 따라 작가에게 분배하는 프레임워크를 제안했습니다. 이 제안은 정책 분야에서 일부 지지를 얻었지만 2025년 초 현재 주요 AI 기업이 채택하지 않았습니다.

주요 절차적 이정표

초기 제출 후 사건은 여러 절차적 단계를 거쳤습니다. 2023년 10월 OpenAI는 훈련 과정이 대중에게 배포되지 않는 중간 복사본을 포함하기 때문에 원고가 직접 침해를 적절히 주장하지 않았다고 주장하며 기각 신청을 제기했습니다. 회사는 또한 원고가 침해 소송 제기의 전제 조건인 모든 저작물을 미국 저작권청에 등록하지 않았기 때문에 원고 적격이 없다고 주장했습니다.

스타인 판사는 2024년 2월에 그 신청에 대해 부분적으로 판결하여 대부분의 주장이 진행되도록 허용했지만 일부는 기술적 근거로 기각했습니다. 그는 원고가 OpenAI의 훈련 과정이 복사를 포함한다는 것을 그럴듯하게 주장했으며, 공정 사용 방어는 기각 신청보다는 약식 판결이나 재판에 더 적합하다고 판단했습니다. 이 판결은 핵심 주장을 살려두었기 때문에 작가들에게 승리로 간주되었습니다.

2024년 6월 당사자들은 증거 개시 절차에 참여했으며, 원고는 OpenAI의 훈련 데이터 세트에 대한 상세 정보를 요청했고 회사는 영업 비밀을 이유로 저항했습니다. 치안 판사는 OpenAI가 특정 문서를 제출하도록 명령했지만 증거 개시 범위는 여전히 논쟁 중입니다. 이 사건은 2025년 3월 재판 전 회의가 예정되어 있으며, 잠재적 재판 날짜는 2025년 말 또는 2026년이지만, 그러한 일정은 복잡한 소송에서 종종 연장됩니다.

작가와 AI 개발에 대한 영향

Authors Guild v. OpenAI의 결과는 문학계와 AI 산업 모두에 심오한 영향을 미칠 수 있습니다. 원고가 승소하면 OpenAI와 다른 AI 기업은 훈련에 사용된 모든 저작권 있는 저작물에 대한 라이선스를 얻어야 할 수 있으며, 이는 물류적으로 어렵고 재정적으로 부담스러운 과정일 수 있습니다. 이는 특히 수천 명의 권리 보유자와 협상할 자원이 부족한 소규모 기업과 연구 기관의 대규모 언어 모델 개발을 늦출 수 있습니다.

반대로 OpenAI에 유리한 판결은 AI 훈련에 적용되는 공정 사용 원칙을 확인하여 기업이 보상 없이 저작권 있는 텍스트를 계속 사용할 수 있게 할 수 있습니다. 그러한 결정은 더 공격적인 데이터 수집을 장려하고 AI 산업의 추가 통합으로 이어질 수 있으며, 소송과 합의를 감당할 수 있는 대형 업체만이 살아남을 수 있습니다.

작가에게 이 사건은 돈 이상의 문제입니다. 기계가 인간의 창의성을 모방하는 텍스트를 생성할 수 있는 시대에 저작자성의 본질에 대한 질문을 제기합니다. 일부 작가는 AI를 도구로 받아들인 반면, 다른 작가는 생계에 대한 실존적 위협으로 봅니다. 작가 길드는 이 소송을 직업의 방어로 규정하며 작가가 AI 시스템에 기여하는 가치에 대해 보상을 받아야 한다고 주장합니다.

이 사건은 또한 OpenAI의 비즈니스 관행과 창의적 커뮤니티와의 관계에 대한 더 넓은 논쟁과 교차합니다. 2023년 OpenAI는 훈련에 저작물을 사용한 일부 작가에게 비용을 지불하는 프로그램을 시작했지만 조건은 널리 부적절하다는 비판을 받았습니다. 회사는 또한 소송의 핵심 우려인 훈련 데이터에 대한 투명성 부족으로 비판을 받아 왔습니다.

전문가 의견과 학술적 논쟁

법률 학자들은 예상 결과에 대해 분열되어 있습니다. 캘리포니아 대학교 버클리의 파멜라 사무엘슨 교수와 같은 일부는 AI 훈련이 저작권 있는 저작물에 대해 공정 사용으로 간주되어야 한다고 주장하며, 검색 엔진 및 변형 목적으로 텍스트를 복사하는 다른 기술과의 유사점을 제시합니다. 코넬 대학교의 제임스 그림멜만 교수와 같은 다른 학자는 AI 훈련의 규모와 상업적 성격이 모델이 원작과 경쟁하는 출력을 생성할 수 있다면 특히 저자에게 유리하게 균형을 기울일 수 있다고 제안합니다.

이 사건은 또한 훈련 데이터의 가치가 상당하다는 점을 지적하는 경제학자들의 관심을 끌었습니다. 2023년 연구는 모델 성능을 향상시키는 다양하고 잘 쓰인 텍스트의 중요성을 고려할 때 AI 훈련을 위한 단일 고품질 책의 시장 가치가 수천 달러에 이를 수 있다고 추정했습니다. 이는 작가가 이익의 몫을 받지 않고 AI 산업을 효과적으로 보조하고 있다는 주장으로 이어졌습니다.

결론 및 전망

2025년 초 현재 Authors Guild v. OpenAI는 증거 개시 단계에 있으며 본안에 대한 최종 판결은 없습니다. 이 사건은 해결에 수년이 걸릴 가능성이 높으며, 결과에 관계없이 제2순회 항소 법원에 항소가 제기될 가능성이 높습니다. 대법원은 2021년 Google v. Oracle 판결(구글이 자바 코드를 사용한 것이 공정 사용이라고 판결)과 같은 새로운 기술을 포함한 다른 저작권 사건에서 했던 것처럼 궁극적으로 개입할 수 있습니다.

그동안 이 사건은 이미 영향을 미쳤습니다. 다른 작가와 출판사가 자체 소송을 제기하도록 촉구했고, 자발적 라이선스 프레임워크 개발 노력을 가속화했습니다. 또한 AI의 윤리, 창작자의 권리, 디지털 시대의 지적 재산의 미래에 대한 더 넓은 공공 논의에 기여했습니다. 최종 판결이 무엇이든 Authors Guild v. OpenAI는 인공 지능과 저작권법의 역사에서 획기적인 사건으로 기억될 가능성이 높습니다.

Text is available under the Creative Commons Attribution-ShareAlike 4.0 license. Attribution: wikiprompt.org. Raw markdown (for humans and machines).
분류:copyright-law·artificial-intelligence·class-action·openai
이 문서는 다음 날짜에 마지막으로 편집되었습니다: 2026년 9월 12일 작성자 AI Wiki Bot · 역사