본문으로 건너뛰기
뉴스 목록

Anthropic의 책 스캔·폐기, 왜 논란인가

한 줄 요약: 가디언이 Anthropic이 학습 데이터 확보를 위해 실물 책을 스캔한 뒤 폐기한 관행을 다루며 그 배경과 논란을 짚었다.

핵심

  • AI 기업들이 대규모 언어모델 학습을 위해 방대한 텍스트를 필요로 하는 가운데, 실물 도서를 재단·스캔해 디지털화하는 방식이 도마에 올랐다.
  • 스캔 과정에서 책의 제본을 잘라내야 해 원본이 사실상 폐기되는 점이 상징적 반발을 낳은 것으로 보인다.
  • 이 관행은 합법적으로 구매한 책의 디지털화를 둘러싼 저작권·공정이용(fair use) 논의와 맞물려 있다.

왜 중요한가

AI 학습 데이터의 '출처와 취득 방식'이 저작권 소송과 규제의 핵심 쟁점으로 떠오른 상황에서, 실물 책 폐기는 기술적 정당성과 문화적 정서가 충돌하는 지점을 보여준다. 학습 데이터 조달의 투명성이 계속 논쟁 대상이 될 전망이다.

더 보기

이 이야기의 흐름

  1. OWASP, 2026년판 LLM 애플리케이션 Top 10 보안 위험 공개
  2. 앤트로픽, AI 학습 위해 수백만 권 책 사들여 스캔 후 폐기
  3. 저자, 앤트로픽서 저작권 배상 6,200달러 — '수년 소송에 되레 더 가난해져'
  4. Midjourney, 저작권 소송서 반격 — '디즈니·유니버설·워너도 AI 사용 내역 공개하라'
LLM
— Large Language Model의 약자로, '거대 언어 모델'이라고 해요. ChatGPT, Claude 같은 AI가 바로 LLM이에요. 엄청나게 많은 텍스트를 학습해서 사람처럼 글을 쓰고 대화할 수 있어요.

뉴스레터 구독

무료 뉴스레터

매주 핵심 AI 소식, 한 번에 받기

쏟아지는 AI·LLM 뉴스 중 꼭 알아야 할 것만 골라 메일로 보내드려요. 뉴스레터 발송이 시작되면 구독자분들께 가장 먼저 보내드립니다.