Authors Guild 소송 문서로 읽는 OpenAI의 도서 학습과 작가 대체 논쟁
공개된 원고 측 소송 서면을 바탕으로 LibGen 사용 인식, 작가 대체 발언, 데이터 삭제와 공정 이용 쟁점을 구분한다. 원고의 주장과 인용 증거를 법원의 확정 판단으로 취급하지 않는다.
TL;DR
- Authors Guild가 소개한 자료는 원고 측의 일부 약식판결 신청 서면이다. 내부 발언과 증언 인용은 담겼지만 법원의 최종 판단은 아니다. 문서 제목의 ‘다툼 없는 사실’도 원고가 붙인 절차상 명칭이다.
- 원고는 LibGen 출처를 알고 있었다는 내부 기록과 작가의 노동을 대체할 수 있다는 발언을 연결한다. Microsoft에 대한 초기 정보 공유와 OpenAI의 데이터 삭제도 근거에 포함된다. 인식과 삭제의 기록만으로 저작권 책임이나 증거인멸이 확정되지는 않는다.
- 법적 주장은 도서 취득, 모델 학습, 회사·외주업체에 대한 배포를 나누어 각각 공정 이용을 부정하는 구조다. 작가 대체와 학습 라이선스 수입 감소가 시장 피해 논거다. 모든 AI 학습을 일괄 불법으로 판단한 사건으로 읽으면 안 된다.
- 공개본에는 가림 처리된 부분이 있고 인용된 증거물 전체와 피고의 반박서는 여기서 확인하지 못했다. 내부 경고는 실제 실업 규모를 측정한 통계가 아니다. 2027년 초 심리 역시 기사 작성 당시 Authors Guild의 예상이다.
2026년 9월 21일 Authors Guild는 OpenAI와 Microsoft를 상대로 한 도서 저작권 소송의 공개 서면을 소개했다. 자료의 중심은 9월 17일자 공개본인 Docket 1982와 Docket 1987이며 각각 원고 측 법률 의견서와 정정된 Rule 56.1 사실 진술서다. Authors Guild는 이 소송의 원고 중 하나다. 보도자료의 강한 표현은 소송 당사자의 평가로 읽어야 한다.
공개된 것은 판결문이 아니라 원고의 입증 논리다
Docket 1982는 재판의 일부 쟁점을 약식판결로 먼저 판단해 달라는 신청을 뒷받침한다. 약식판결은 중요한 사실에 실질적인 다툼이 없고 법률상 판단이 가능하다는 요건을 전제로 하는 절차이며 신청 자체가 그 요건 충족을 뜻하지는 않는다. 이번 신청은 원고들의 저작물 194개를 대상으로 하고 도서 다운로드와 학습 중 복제, 제삼자 배포, Microsoft의 책임을 나누어 다룬다.
Docket 1987의 ‘다툼 없는 중요 사실 진술서’에는 원고가 사실로 인정받으려는 항목과 증거물 번호가 붙어 있다. 이 문서에 실린 Slack 대화, 이메일, 증언 발췌는 구체적인 근거지만 문서 전체를 법원의 사실 인정으로 바꿔 읽을 수는 없다. Authors Guild CEO Mary Rasenberger가 이를 작가를 무시한 의도적인 선택이라고 비판한 대목 역시 원고 단체의 반응이지 독립적인 감정 결과가 아니다.
LibGen 사용을 알았다는 근거와 Microsoft의 위치
원고는 2019년 내부 자료를 통해 OpenAI가 도서의 출처와 법적 위험을 일찍부터 인식했다고 주장한다. 사실 진술서 341항에는 연구원 Sam McCandlish가 LibGen을 썼다는 사실이 Hacker News에 알려질 때의 평판을 걱정한 대화가 있고 당시 연구 책임자 Dario Amodei의 우려도 함께 실려 있다. 344항의 2019년 8월 19일 메모에는 “We trained GPT-3 on pirated stuff! No sharing that!”라는 문장이 남아 있다.
Microsoft가 이 출처를 언제 알았는지도 별도 쟁점이다. 원고 측 기록에는 2019년 4월 Bill Gates와 다른 Microsoft 임원에게 공유한 자료가 LibGen에서 추가한 데이터를 명시했고 최고기술책임자 Kevin Scott에게도 자료가 전달됐다는 내용이 담겼다. 원고는 이를 Azure 인프라 통제, 계약상 감독 권한, 직접적인 경제적 이익과 연결해 Microsoft의 대위책임을 주장하며 단순히 투자했다는 사실만으로 책임을 설명하지 않는다.
Sam Altman과 Satya Nadella가 불법 복제의 위법성을 인정한 증언도 원고의 근거다. 다만 일반적인 불법 복제가 잘못이라는 답변과 이 사건의 개별 이용이 공정 이용인지에 관한 법적 결론은 구분된다. 특히 사실 진술서 384항에 인용된 Nadella의 증언은 해적판 사이트에서 책을 취득하는 행위와 이후 모델 학습에 쓰는 행위를 나누므로, 경영진이 모든 쟁점에서 패소를 자인했다고 요약하면 부정확하다.
작가 대체를 예상한 발언과 피해 입증의 거리
당시 OpenAI 정책 책임자 Jack Clark의 2020년 5월 메모는 GPT의 성능 향상이 장르소설 작가의 노동을 대체하고 실업을 낳을 가능성을 경고한다. 작가들이 우려해도 제품 출시를 강행할 수 있다는 예상도 포함된다. 그러나 이어지는 750항에서 Clark은 사람의 창작 노동을 대체할 결과물보다 새로운 것을 발명하는 AI에 집중하자는 의견을 냈으므로, 해당 메모 전체를 작가 퇴출에 대한 찬성으로 단순화할 수는 없다.
2022년 OpenAI에 합류해 모델의 글쓰기 품질 개선을 맡은 Tarun Gogineni의 발언은 더 구체적인 작품을 겨냥한다. 원고가 인용한 2025년 3월 공개 게시물에서 그는 George R. R. Martin의 『얼음과 불의 노래』 마지막 두 권을 쓰는 과제를 자신의 연구 목표와 연결했고 다른 게시물에서는 GPT-5가 시리즈를 완성할 수 있다는 기대를 드러냈다. 이는 직원의 발언에 관한 자료이며 실제 완성된 후속작이나 회사가 승인한 출판 계획을 확인한 증거는 아니다.
사실 진술서 731~732항에는 Gogineni가 작가들의 피해 호소를 충분히 공감하지 못하고 경제적 혼란을 감수할 만한 것으로 보았다는 내용과, 기계가 다른 기계를 위해 저품질 콘텐츠를 만드는 상황에 대한 발언이 실려 있다. 원고는 이런 발언을 인간 작가와 경쟁하는 제품을 만들려는 목적의 근거로 사용한다. 그렇더라도 개인의 전망과 태도가 실제 작가의 실업자 수나 매출 손실을 곧바로 입증하지는 않으며 시장 피해에는 별도의 자료와 인과관계 검토가 필요하다.
데이터 삭제와 공정 이용은 각각 판단할 쟁점이다
Authors Guild는 2022년 여름의 LibGen 삭제 작업인 Project Clear를 흔적 은폐로 해석한다. 사실 진술서 312~318항에는 2022년 6월 15일 데이터와 관련 참조의 제거를 논의하고 직접 저장본·파생 데이터셋·GitHub 저장 자료를 정리하려는 대화가 인용돼 있다. 같은 기록은 삭제가 GPT-3와 GPT-3.5 학습 재현을 막을 수 있다는 우려도 담고 있지만 이 공개 서면만으로 법원이 증거인멸이나 제재 사유를 인정했다고 말할 수는 없다.
원고의 법률 주장은 도서를 얻는 단계, 학습 과정에서 다시 복제하는 단계, Microsoft와 외주업체에 배포하는 단계를 각각 심사하자는 구조다. 공정 이용의 판단 요소인 이용 목적과 성격, 저작물의 성격, 이용한 분량, 시장에 미치는 영향에 맞춰 무단 취득과 창작물 대체, 학습 라이선스 수입 감소를 문제 삼는다. 원고 측 서면 자체도 다른 사건인 Bartz와 Kadrey에서 도서 학습의 변형적 성격을 인정한 판단을 언급한 뒤 증거와 사안이 다르다고 반박하므로, AI 학습이 언제나 불법이라는 단일 결론으로 축약할 수 없다.
확인 범위는 보도자료 전체, Docket 1982 전체와 Docket 1987의 핵심 관련 항목까지다. 공개본의 가림 처리 부분과 인용된 증거물 전체, 피고 반박서 및 이 신청에 대한 법원 판단은 확인하지 못했으며 서면은 GPT-4o mini가 원고 저작물 학습에서 예외라는 점도 명시한다. Authors Guild는 추가 서면과 2027년 초 심리를 예상했지만 확정 기일을 공지하지는 않았다. 이 글은 원고가 어떤 기록으로 책임을 입증하려는지 정리한 노트이며 책임이 확정됐다는 소식으로 읽어서는 안 된다.
참고 자료
Authors Guild 원문 보도자료 — 2026년 9월 21일