미국 작가협회와 공동 원고가 오픈AI와 마이크로소프트를 상대로 낸 저작권 소송의 서면이 공개됐다. 2026년 9월 17일 공개된 문서를 작가협회가 9월 21일 소개했다. 원고들은 오픈AI가 책을 확보해 AI 학습에 쓴 과정을 문제 삼았다. 그리고 쟁점 일부를 먼저 판단해 달라고 법원에 요청했다.
책 57만 권, 어디에 쓰였나
원고 측은 오픈AI가 LibGen이라는 사이트에서 확보한 책으로 AI를 학습시켰다고 주장한다. 서면에는 직원이 2018년 약 11만 7,500권을 내려받았다는 내용이 담겼다. 2019년 9월부터 2020년 1월 사이에는 약 35테라바이트 분량의 자료를 추가로 받았다는 주장도 있다. 모두 원고 측이 소송 자료에서 제시한 수치다.
학습에 사용됐다고 지목한 자료는 약 57만 권 규모다. 원고는 LibGen에서 만든 이 학습 자료가 GPT-3와 GPT-3.5에 쓰였다고 본다. 책을 확보한 시기와 양, 실제로 모델 학습에 썼다는 주장이 한자리에 모인 것이다. 다만 법원이 이 수치와 사용 내역을 사실로 확정한 단계는 아니다.
두 회사는 알고 있었나
원고는 내부 기록과 증언을 근거로 두 회사의 인식도 문제 삼았다. 자료의 출처와 작가에게 미칠 영향을 알면서도 책을 복제했다는 주장이다. 이번 공개로 원고가 어떤 기록과 증언을 근거로 책임을 묻는지 드러났다. 서면이 공개됐다는 사실 자체가 경영진의 법적 책임이나 저작권 침해를 인정한 판단은 아니다.
양측은 AI 학습을 저작권법상 허용되는 ‘공정 이용’으로 볼 수 있는지를 놓고 맞서고 있다. 작가협회는 허가 없는 복제와 학습이 작가의 권리와 시장을 해친다고 주장한다. 그래서 피고 측의 공정 이용 주장을 받아들이지 말아 달라고 법원에 요청했다. 오픈AI는 AI 학습이 원래 자료와 목적과 성격이 다른 변형적 이용이라며, 공정 이용에 해당한다는 입장을 밝혔다.
그래서 무엇이 달라지나
이번 서면 공개는 2023년 9월 시작된 소송의 후속 절차다. 사건은 다른 저작권 소송과 함께 뉴욕 연방법원에서 묶여 진행 중이다. 오픈AI도 9월 4일 정식 재판 없이 결론을 내려 달라는 신청서를 냈다. 지금 공개된 자료는 양측이 법원의 판단을 구하는 과정의 일부로 읽어야 한다.
AI를 쓰는 독자에게 이번 소식의 핵심은 하나다. 모델이 어떤 책으로 학습했고, 그 책을 쓸 권한이 있었는지를 다투는 일이다. 새 제품이나 요금, 이용 대상이 바뀐다는 발표는 아니다. 작가 쪽에서 보면 자신의 책이 허가 없이 복제되고 학습에 쓰였다는 주장이 중심에 있다.
앞으로 볼 대목은 법원이 원고가 내놓은 기록과 수치를 어떻게 평가하느냐다. 공정 이용을 둘러싼 양측 주장에 대한 판단도 남아 있다. 책을 썼다는 주장과 그 사용이 위법하다는 법적 판단은 구분해서 볼 필요가 있다.
