목차
▪️ 9월 11일 서면, 악보·가사집 포함 주장과 증거개시 요구
▪️ 표1: 앤트로픽 소송·조사 연표 (2024~2026)
▪️ 법원은 앤트로픽의 실물 책 파쇄와 스캔을 왜 공정이용으로 판단했나?
▪️ 학습 데이터 확인 불가능은 창작자의 권리 행사에 어떤 영향을 미치나?
▪️ AI 학습 데이터 투명성과 한국 창작자·법제의 과제
▪️ FAQ
▪️ 핵심 인사이트 3가지
▪️ 핵심 참고 자료
▪️ 전문 용어 사전
▪️ 함께 읽으면 좋을 기사
지난 9월 11일, 미국 캘리포니아 북부연방지방법원에서 진행 중인 Concord II v. Anthropic 사건에서 유니버설뮤직그룹(UMG), 콘코드, ABKCO 등 음반사들과 앤트로픽이 법원 지시 서면을 제출했다.
음반사 측은 앤트로픽이 무단 스캔한 실물 도서에 수백 권 이상의 악보·가사집이 포함되어 있다고 밝히며, 스캔 관련 증거개시를 1단계 조사 대상에 포함하라고 요구했다. 재판부는 아직 최종 결정을 내리지 않았으나, 이번 다툼으로 앤트로픽 저작권 소송의 쟁점은 스캔 방식의 적법성 판단을 넘어 AI 학습 데이터 출처 투명성과 창작자의 확인 가능성 문제로 이동했다.

실물 종이책과 악보가사집이 기계 안으로 입력되어 데이터로 변환되는 과정과 AI 학습에 대한 창작자의 우려를 묘사한 일러스트.
이번 서면 다툼은 단순한 저작물 수집 방식의 적법성을 넘어 인공지능 모델 내부에 흡수된 데이터의 구체적 실체를 드러낸다. 법원이 물리적 도서의 스캔 자체를 공정 이용으로 인정한 선례가 존재하는 상황에서, 스캔된 데이터의 출처와 구성 내역이 은폐될 경우 창작자의 저작권 행사는 실질적 무력화 위기에 직면하게 된다.
9월 11일 서면, 악보·가사집 포함 주장과 증거개시 요구
음반사 대리인단은 캘리포니아 북부연방지방법원에 제출한 3페이지 분량의 서면 진술서 2페이지(¶97)에서 앤트로픽이 '프로젝트 파나마'를 위해 매입·스캔한 실물 도서 중 수백 권 이상의 악보 및 가사집 모음집('hundreds or more songbooks and sheet music collections')이 포함되었다고 명시했다.
음반사들은 이러한 무단 스캔과 디지털화 프로그램이 토렌트 해적 사이트 다운로드와 마찬가지로 별개의 저작권 침해 행위에 해당하므로, 현재 진행 중인 1단계 증거개시(Discovery) 범위에 스캔 관련 자료를 즉시 포함해야 한다고 주장했다.
반면 앤트로픽 측은 실물 도서 스캔과 관련된 다툼이 모델 학습 및 출력과 연계된 2단계 증거개시 쟁점이라며 요약판결 이후로 논의를 미루어야 한다고 맞섰다.
외신 보도 등 일각에서는 음반사들이 구체적인 곡 목록 공개를 직접 요구했다는 해석을 내놓았으나, 법원 제출 서면 원문에는 스캔 행위의 증거개시 포함 요구가 명시되어 있으며 재판부의 판단은 아직 내려지지 않은 상태다. 이 다툼은 단순한 절차상 입장을 넘어, 스캔된 원본에 정확히 어떤 창작물이 포함되었는지를 규명하려는 법적 전략으로 볼 수 있다.

앤트로픽 소송의 시간적 흐름과 쟁점 이동을 보여주는 연표. 2024년 Bartz 소송부터 2026년 9월 11일 서면 제출까지의 주요 사건을 정리했다. (표 설명문) 이 연표는 앤트로픽 소송이 문학 저작권의 공정 이용 판결에서 음악 저작권 및 데이터 출처 검증으로 이동해 온 과정과 시의적 배경을 보여준다.
법원은 앤트로픽의 실물 책 파쇄와 스캔을 왜 공정이용으로 판단했나?
법원이 적법하게 구매한 실물 책을 스캔하고 원본을 파쇄한 행위를 공정 이용(Fair Use)으로 평가한 까닭은 구매권리와 포맷 전환의 정당성에 기반한다.
2025년 6월 23일 윌리엄 알섭 판사는 Bartz v. Anthropic 사건 요약판결에서 앤트로픽이 실물 책을 정당하게 구입하여 1 대 1 디지털 파일로 전환한 뒤 원본을 폐기하고 내부 검색용 도서관으로 보관한 행위는 변환적 사용에 해당한다고 판시했다. 반면 립젠이나 필리미 등 해적 도서관 토렌트를 통해 무단 복제본을 다운로드하여 보관한 행위에 대해서는 공정 이용을 인정하지 않고 저작권 침해로 판단했다.
음반사 측 역시 서면에서 알섭 판사의 판결을 인용하며, 정당 구매 및 1 대 1 포맷 전환이라는 엄격한 조건이 충족되었을 때만 공정 이용이 성립한다는 점을 강조했다. 스캔과 파쇄라는 기술적 과정이 정당화된 까닭은 적법하게 구매한 책을 1 대 1로 전환하고 추가 유통을 차단했다는 엄격한 조건이 전제되었기 때문이다.
법원이 저작권 침해 여부를 매체 취득 경로와 조건에 따라 다르게 평가한 만큼, 음악 저작권 소송에서도 스캔 대상의 성격과 데이터 출처를 둘러싼 검증이 주요 쟁점으로 떠오르고 있다.

파쇄된 악보가사집이 데이터화되는 현장과 판사의 법봉을 통해 앤트로픽 소송과 음악저작권의 법적 불확실성을 풍자한 일러스트.
학습 데이터 확인 불가능은 창작자의 권리 행사에 어떤 영향을 미치나?
AI 모델 학습에 쓰인 데이터의 확인 가능성이 차단될 경우, 창작자는 저작권법상 보장된 자신의 권리를 실질적으로 행사할 수 없는 문제에 직면한다. 작곡가나 작사가 등 음악 저작권자가 침해 소송을 제기하기 위해서는 해당 작품이 모델에 입력되었음을 입증하거나 출력물에서 재현되었음을 증명해야 한다.
그러나 악보와 가사집이 물리적으로 제본 해체되어 파쇄되고 디지털화된 데이터의 상세 목록이 미공개 상태로 남는다면, 원작자는 자신의 곡이 인공지능 시스템에 흡수되었는지조차 확인할 방법이 없다.
소니뮤직과 워너챕펠 등 대형 음악출판사들조차 증거개시 절차를 통해 스캔 대상의 구체적 내역을 확인하고자 다투는 이유가 여기에 있다.
데이터 출처에 대한 투명성이 확보되지 않을 경우 창작자는 자신의 작품에 대한 권리를 주장할 기본적 통로를 상실하게 되며, 이는 무단 학습에 대한 사후 구제 가능성 자체를 무력화하는 결과를 초래할 수 있다.
AI 학습 데이터 투명성과 한국 창작자·법제의 과제
앤트로픽 소송이 던지는 본질적 메시지는 인공지능 개발 과정에서 학습 데이터 출처 기록과 투명성 확보가 법적·제도적으로 뒷받침되어야 한다는 점이다.
주요국들은 이미 학습 데이터의 계보와 구성 항목을 공개하도록 하는 입법적·행정적 기준을 구체화하고 있다. 유럽연합(EU)의 AI 법안(AI Act) 제53조는 일반목적 AI 모델 제공자에게 학습에 사용된 콘텐츠의 요약본을 공개할 의무를 부여하고 있으며, 일본 문화청 역시 2026년 8월 AI 학습 데이터 투명성 원칙을 발표하며 권리자의 확인 가능성을 강조했다.
국내 저작권 법제와 AI 정책 논의에서도 단순히 학습 허용 범위만을 다룰 것이 아니라, 어떤 데이터가 학습되었는지 창작자가 검증할 수 있는 출처 공개 제도가 병행되어야 한다.
학습 데이터의 출처를 기록하고 검증할 수 있는 제도적 장치가 마련되지 않는다면, 창작자는 자신의 작품이 사라져도 권리를 다툴 최소한의 통로조차 얻지 못하게 된다. 결국 데이터 출처 투명성은 AI 시대에 창작자의 정체성과 저작권을 지켜내는 최소한의 방파제인 셈이다.

악보가사집이 파쇄되어 이진 코드로 전환되는 현장에서 앤트로픽 소송의 핵심 쟁점인 데이터 출처 투명성을 지목하는 모습을 묘사한 일러스트.
FAQ
Q1: 음반사들이 주장하는 '수백 권의 악보·가사집'에 어떤 곡이 들어갔는지 목록이 공개되었는가?
A: 공개되지 않았다. 음반사는 법원 제출 서면에서 악보·가사집이 스캔 대상에 포함되었다고 명시했을 뿐, 구체적인 곡명 목록은 서면에 올리지 않았다. 법원의 증거개시 결정도 아직 내리지 않은 상태다.
Q2: 소니·워너 소송과 Concord II 소송은 같은 사건인가?
A: 별개의 사건이다. 소니·워너 등은 2026년 8월 28일 별도 소장(사건번호 5:26-cv-09217)을 제출했으나, Concord II 사건과 동일하게 이유미(Eumi K. Lee) 판사에 배당되어 심리가 진행 중이며, 법원은 9월 23일까지 조정·관리 계획안을 제출받아 통합 심리 여부를 결정할 예정이다.
Q3: 문학 작품 스캔과 음악(악보·가사) 스캔은 저작권법상 무엇이 다른가?
A: 문학은 단일 저자 중심의 텍스트 복제가 주로 다뤄지나, 음악은 작곡가·작사가·음악출판사 등 복잡한 권리 관계가 곡 단위로 얽혀 있다. 실물 책의 제본이 뜯겨 파쇄되면, 권리자가 본인의 곡이 포함되었는지 식별하고 침해를 입증하기가 훨씬 어려워진다.
Q4: 유럽(EU)과 일본 등 해외에서는 AI 학습 데이터 투명성을 어떻게 다루고 있는가?
A: EU AI 법안(AI Act) 제53조는 생성형 AI 개발사에 학습 콘텐츠 요약본 공개 의무를 부과하고 있으며, 일본 문화청도 2026년 8월 AI 학습 데이터 투명성 원칙을 발표해 권리자의 열람 및 검증 가능성을 지침으로 명시했다.
Q5: 학습 데이터 출처 기록과 증거개시 확대가 AI 산업에 미치는 영향은 무엇인가?
A: 스캔 내역과 학습 데이터 출처 검증이 의무화되면, AI 기업은 학습 데이터의 계보(Data Provenance)를 엄격히 기록해야 하는 법적 부담을 지게 된다. 이는 무단 데이터 수집을 억제하고 정식 라이선스 계약 체결을 촉진하는 계기가 된다.
[핵심 인사이트 3가지]
1. '악보·가사집도 스캔됐다'는 주장의 핵심은 조사 범위 확대다
— 음반사들이 스캔 사실을 강조한 까닭은, 재판 초기 조사(증거개시) 단계부터 앤트로픽이 가져간 음악 데이터의 실체를 확인하기 위해서다.
2. 책을 사서 스캔했다고 해서 무조건 합법이 되는 것은 아니다
— 법원이 과거 앤트로픽의 책 스캔을 허용한 이유는 '정당하게 구매한 책을 1대1로만 전환해 내부 검색용으로 보관했다'는 엄격한 조건 때문이었다. 음악 데이터처럼 취득 경로가 다르면 법적 판단도 달라진다.
3. 내 노래가 AI 학습에 쓰였는지 알 수 없으면 권리 주장도 불가능하다
— AI 기업이 학습한 곡 목록을 밝히지 않으면 창작자는 피해 사실조차 입증할 수 없다. 학습 데이터 출처 공개는 창작자가 자기 권리를 지키기 위한 최소한의 조건이다.
[핵심 참고 자료]
Concord II v. Anthropic 음반사 측 진술서 (2026.09.11)
앤트로픽의 수백 권 이상 악보 및 가사집 스캔 주장과 증거개시 요구가 담긴 법원 서면
Concord II v. Anthropic 앤트로픽 측 진술서 (2026.09.11)
스캔 증거개시를 2단계로 미루어야 한다는 앤트로픽 측의 반박 서면
Sony Music Publishing et al. v. Anthropic 소장 (2026.08.28)
수만 곡의 가사 및 악보 무단 이용을 주장하며 제기된 음악출판사들의 소장
[전문 용어 사전]
▪️ 증거개시 (Discovery): 재판이 시작되기 전, 소송 당사자들이 상대방에게 관련된 내부 문서나 데이터 등 증거 자료를 의무적으로 제출하도록 법원이 명령하는 제도.
▪️ 1 대 1 디지털 전환 (1:1 Digital Conversion): 돈을 주고 정당하게 구매한 실물 책 한 권을 스캔해 디지털 파일 한 개로 만드는 행위. 복제본을 추가로 유통하지 않는 것을 전제로 한다.
▪️ 데이터 출처 투명성 (Data Provenance Transparency): AI를 만들 때 어떤 책, 어떤 노래, 어떤 출처의 데이터를 사용했는지 기록하고 외부에서 확인할 수 있도록 밝히는 성질.
▪️ 요약판결 (Summary Judgment): 재판에서 핵심 사실관계에 다툼이 없을 때, 정식 재판까지 가지 않고 판사가 서면 심리만으로 판결을 내리는 절차.
▪️ 학습 데이터 목록 공개 (Training Data Disclosure): AI 개발사가 모델을 훈련시키는 과정에서 수집·흡수한 저작물의 세부 목록을 창작자와 대중에 공개하도록 하는 제도.
[함께 읽으면 좋을 기사]
[Pocus 심층 진단 기획] AI가 수학의 본질을 훼손한다: 필즈상 25명의 경고와 AI 정답 경쟁
[Pocus 심층 분석 기획] 美 시민단체, “앤스로픽 종이책 사재기 후 파기” FTC 반독점 고발
[Pocus 심층 해설•분석 기획] 200 만 달러 선인세, AI 의혹에 계약 파기…출판계가 본 ‘검증 가능한 저자성’의 기준은?
※ AI 활용 고지: 본 기사는 The Imaginary Pocus의 기획과 편집 방향에 따라 관련 법령·공식 문서·학술자료를 검토해 구성했으며, 자료 구조화와 표·이미지 제작 과정에 AI를 활용했습니다. 최종 내용의 사실 확인과 편집 책임은 The Imaginary Pocus에 있습니다.


















