Date: 2026-07-21 Topic: AI·저작권 Primary source: 미국 캘리포니아 북부연방지방법원 최종 승인 명령
미국 캘리포니아 북부연방지방법원은 2026년 7월 20일, 작가들이 AI 기업 앤트로픽을 상대로 낸 집단 저작권 소송의 15억 달러 합의를 최종 승인했다. 합의 대상은 앤트로픽이 LibGen과 PiLiMi에서 내려받은 자료 가운데 저작권 등록 등 조건을 충족한 48만2,460개 작품이다.
이번 결정으로 해당 작품의 권리자들은 비용과 수수료를 공제하기 전 작품당 약 3,000달러를 배분받을 전망이다. 다만 법원이 AI 모델을 책으로 훈련하는 행위 전체를 불법이라고 판단한 것은 아니다. 앞선 재판에서는 학습 목적의 이용과 해적 사이트에서 책을 취득해 보관한 행위를 구분했고, 이번 합의는 후자에서 남은 책임을 정리했다.
최종 승인은 작가와 출판사에는 배상 절차가 본격화된다는 의미가 있다. AI 기업에는 데이터의 활용 목적뿐 아니라 어떤 경로로 원본을 확보했는지도 별도의 법적 위험이 될 수 있다는 신호다.
News Brief
- 사건명은
Bartz et al. v. Anthropic PBC이며 사건번호는3:24-cv-05417-AMO다. - 아라셀리 마르티네즈-올긴 연방지방법원 판사는 7월 20일 합의가 공정하고 합리적이며 충분하다고 판단해 최종 승인하고 판결을 입력했다.
- 합의 기금은 앤트로픽이 내는 15억 달러와 이자로 구성되며, 남은 돈이 회사로 돌아가지 않는 방식이다.
- 대상은 작품 목록에 포함된 48만2,460개 책이다. 2026년 4월 16일 기준 44만490개 작품, 약 91.3%에 대해 청구가 접수됐다.
- 재판부는 약 1억156만 달러의 변호사 보수와 관련 비용·예비비도 승인했다. 실제 권리자 배분액은 비용과 권리 관계에 따라 달라질 수 있다.
Key Details
소송의 출발점은 앤트로픽이 Claude 학습용 자료를 구축하면서 저작권이 있는 책을 어떻게 확보했는가였다. 집단에는 앤트로픽이 내려받은 LibGen 또는 PiLiMi 자료에 포함되고, 미국 저작권청 등록 시점 등 합의 조건을 충족한 작품의 복제권자가 포함된다. 모든 책이나 모든 작가가 자동으로 대상이 되는 것은 아니다.
법원은 작품당 예상 지급액 약 3,000달러가 일반 저작권 침해의 법정 최저배상액 750달러보다 네 배 높다는 점, 소송을 계속할 경우 결과와 지급 시점이 불확실하다는 점을 합의 승인 근거로 들었다. 접수율도 통상적인 집단소송보다 높다고 평가했다.
금전 배상 외 조치도 있다. 앤트로픽은 법적 보존 의무가 있는 경우를 제외하고 Library Genesis와 Pirate Library Mirror에서 토렌트로 내려받은 원본 파일과 그 복제본을 폐기해야 한다. 작품별 지급액은 저자와 출판사 사이의 계약 또는 선택한 기본 배분 방식에 따라 나뉜다.
합의는 목록에 포함된 작품의 과거 AI 입력 과정과 관련된 청구를 정리한다. 그러나 과거 AI 출력물에 관한 청구나 2025년 8월 25일 이후의 행위에 관한 청구까지 포기시키지는 않는다. 법원은 최종 판결을 내리고 사건을 종결했지만, 합의 집행과 배분을 감독할 권한은 유지한다.
Background
이 사건에서 가장 혼동하기 쉬운 부분은 ‘훈련’과 ‘취득’이 같은 쟁점이 아니라는 점이다. 윌리엄 알섭 판사는 2025년 앞선 명령에서 책을 분석해 새로운 모델을 만드는 학습 용도를 변형적 이용으로 보고 공정 이용 판단을 내렸다. 반면 해적 사이트에서 수백만 권을 내려받아 중앙 라이브러리를 만든 행위는 그 목적과 별개로 판단해야 한다고 봤다.
따라서 15억 달러라는 금액만 보고 “저작권이 있는 자료로 AI를 훈련하면 작품당 3,000달러를 내야 한다”는 일반 규칙이 생겼다고 해석해서는 안 된다. 이 합의는 특정 자료원, 특정 작품 목록, 특정 원고 집단을 대상으로 한 미국 연방지방법원 사건의 종결이다. 학습의 공정 이용에 관한 판단 역시 다른 법원과 사실관계에 자동으로 적용되는 전국 단위의 확정 규칙은 아니다.
Core Lens
이번 사건의 핵심은 AI가 데이터를 사용했느냐만이 아니라, 그 데이터를 합법적으로 확보하고 추적할 수 있느냐에 있다.
What It Means
AI 개발사에는 데이터 거버넌스가 단순한 기술 문서 작업이 아니라 재무 위험을 좌우하는 통제 수단이 됐다. 같은 책을 학습에 쓰더라도 정식 구매·라이선스·공개 조건 확인을 거친 자료와 해적 사이트에서 대량 수집한 자료는 법정에서 전혀 다른 취급을 받을 수 있다. 데이터의 출처, 권리 상태, 취득 시점, 보관 경로를 기록하지 못하면 모델의 성능과 무관하게 큰 비용을 부담할 수 있다.
창작자에게 이번 합의는 의미 있는 배상 사례지만, AI 학습 전반의 허락이나 보상 체계를 확정한 결과는 아니다. 오히려 앞으로의 논쟁은 불법 취득이 명확한 사례에서 라이선스가 불분명한 웹 자료, 정식으로 구매했지만 대규모 학습에 사용된 자료, 모델 출력이 원작 시장을 대체하는 경우로 이동할 가능성이 크다.
What To Watch
- 합의 관리자가 권리 중복과 출판 계약을 정리한 뒤 실제 작품별 지급액을 어떻게 확정하는지
- 최종 명령이나 배분 과정에 대한 항소가 제기돼 지급 일정에 영향을 주는지
- 다른 AI 기업의 저작권 소송에서 법원이 학습 목적과 데이터 취득 방식을 같은 방식으로 분리하는지
- AI 기업이 학습 데이터 구매, 라이선스 계약, 출처 기록과 삭제 절차를 강화하는지
- 향후 사건에서 AI 출력물이 원작의 시장을 침해했다는 주장이 어떻게 판단되는지