특히 원고 측은 회사가 **LibGen, PiLiMi 같은 ‘섀도 라이브러리(shadow library)’**에서 책을 다운로드했다고 지적했다. 이런 사이트들은 저작권 보호 도서를 무단으로 공유하는 것으로 알려져 있다.
소송은 이후 **집단소송(class action)**으로 확대됐고, 최종적으로 약 482,460권의 책에 대한 권리가 사건에 포함됐다.
합의안에 따르면 앤트로픽은 15억 달러 규모의 보상 기금을 조성하고, 최종 승인 시 권리 보유자에게 책 한 권당 약 3,000달러 수준의 보상이 지급될 수 있다.
이 합의는 이미 **2025년 9월 예비 승인(preliminary approval)**을 받은 상태였다. 이는 법원이 합의의 기본 구조를 인정해 청구 절차를 진행할 수 있도록 허용했다는 의미다.
하지만 **2026년 5월 14일 공정성 심리(fairness hearing)**에서 샌프란시스코 연방법원의 아라셀리 마르티네스‑올긴 판사는 최종 승인을 바로 내리지 않았다. 대신 몇 가지 핵심 사항에 대해 추가 정보를 요청했다.
판사가 특히 확인하려 한 부분은 다음과 같다.
이 조치는 합의가 거부됐다는 뜻은 아니다. 미국 집단소송에서는 법원이 합의가 전체 참여자에게 공정한지 확인하기 위해 추가 자료를 요구하는 경우가 흔하다.
이 사건은 AI 모델 학습에 저작권 콘텐츠를 사용하는 것이 합법인지라는 더 큰 논쟁의 중심에 있다.
2025년 이 사건에서 내려진 중요한 판결에서 윌리엄 알섭 판사는 앤트로픽의 행위를 두 가지로 나눠 판단했다.
1. 합법적으로 구입한 책을 AI 학습에 사용
→ 법원은 이를 **공정 이용(fair use)**에 해당할 수 있다고 봤다. AI가 새로운 텍스트를 생성하는 과정이 “매우 변형적(transformative)”이라는 이유다.
2. 해적판 도서를 대량으로 다운로드해 라이브러리를 구축
→ 이 부분은 공정 이용으로 보호되지 않는다고 판단됐다.
법원 문서에 따르면 앤트로픽은 내부 데이터 라이브러리를 구축하는 과정에서 해적 사이트에서 700만 권 이상을 다운로드한 것으로 나타났다.
이처럼 **‘AI 학습 자체’와 ‘데이터를 확보한 방식’**을 구분하는 접근법은 생성형 AI 법률 논쟁에서 매우 중요한 기준이 되고 있다.
합의 대상은 482,460권의 책과 관련된 권리다.
2026년 3월 마감된 청구 절차 결과:
이는 일반적인 집단소송에서 청구 참여율이 10% 정도인 것과 비교하면 매우 높은 수준이다.
다만 이 수치는 ‘작품 수’ 기준이다. 대형 출판사가 수천 권의 권리를 보유할 수 있기 때문에 실제 참여한 저자 수의 비율은 더 낮을 수 있다는 분석도 있다.
이 사건이 중요한 이유는 단순한 합의금 규모 때문만이 아니다.
15억 달러 규모는 알려진 미국 저작권 사건 중 가장 큰 합의액이다. 향후 AI 기업과 콘텐츠 산업 간 협상에서 기준점이 될 가능성이 있다.
“대형 보상 기금 + 작품별 지급” 구조는 AI 학습 데이터 관련 대량 분쟁을 해결하는 새로운 합의 모델로 활용될 수 있다.
이 사건의 판결은 AI 학습이 공정 이용이 될 수 있는지에 대한 최초의 실질적 판단 중 하나로 평가된다.
합의 자체는 법적 판례를 만들지는 않지만, 이미 다른 AI 저작권 소송에서 법적 논거와 전략에 영향을 주고 있다.
현재 합의안은 여전히 법원의 최종 심사를 받고 있다. 판사가 추가 정보를 검토한 뒤 승인을 내리면, 합의 기금에서 저자와 출판사에게 보상금이 지급될 예정이다.
최종 결과와 관계없이 Bartz v. Anthropic 사건은 생성형 AI 시대에 인간 창작물과 AI 학습 사이의 법적 경계를 시험하는 대표적 사례로 남을 가능성이 크다.