Amazon, AI 학습을 위한 희귀 도서 파괴적 스캔 논란
8/18/2026
토킹 포인트
- Amazon의 AI 학습 데이터 확보를 위한 희귀 도서 대량 구매 및 파괴적 스캔 정황 포착
- AirTag를 통한 추적으로 라스베이거스 소재 Amazon AI 훈련 시설의 도서 파괴 공정 확인
- ISBN 목록을 기반으로 전 세계 모든 인쇄 도서를 체계적으로 수집하려는 전략적 움직임
- 물리적 역사 가치 훼손에 대한 윤리적 비판과 디지털 보존이라는 실용적 관점의 대립
시황 포커스
- Amazon이 경쟁 우위 확보를 위해 희귀 도서라는 특수 데이터셋을 물리적으로 수집 및 파괴하고 있음이 드러남.
- 희귀 도서의 정의를 두고 수집가적 가치가 있는 '진귀한 책'인지, 단순히 절판되어 구하기 힘든 '흔한 옛날 책'인지에 대한 논쟁이 치열함.
- AI 기업들이 수집한 데이터를 외부와 공유하지 않고 폐쇄적으로 운용함으로써 지식의 사유화 및 데이터 사일로 현상을 심화시킨다는 우려가 있음.
- 과거 Google Books의 스캔 작업과 비교하며, 효율성을 위해 제본을 파괴하는 방식의 비윤리성과 디스토피아적 성격에 대한 비판이 제기됨.
- 일부에서는 방치되어 썩어갈 책들을 디지털화하여 콘텐츠를 보존하는 것이 결과적으로 더 이득이라는 실용주의적 관점을 보임.
- AI 모델의 성능 향상을 위해 물리적 유산을 파괴하는 행태가 향후 AI의 보존 및 윤리 가치관에 부정적인 영향을 미칠 수 있다는 공포가 존재함.
- 저작권법의 허점을 이용하여 소유권을 획득한 후 데이터를 추출하고 원본을 폐기하는 전략적 접근으로 해석됨.
- 시장에서는 이번 사건을 단순한 데이터 수집을 넘어 지식 자원에 대한 거대 IT 기업의 공격적인 독점 시도로 인식하는 경향이 있음.
트렌드 키워드
- 프런티어 모델 (Frontier Model, Frontier Models):
최첨단 성능을 지닌 최상위 AI 모델
1 / 9“Google, OpenAI, Anthropic과 같은 선도 기업들과 경쟁하기 위해 방대한 양의 고유 훈련 데이터가 필요한 최첨단 AI 모델프런티어 모델” - 파괴적 스캔 (Destructive Scanning):
도서의 제본을 강제로 뜯어내고 페이지를 스캔하는 방식
“책의 제본을 뜯어내고 페이지를 스캔하는 팀이 운영되는 Amazon의 AI 훈련 시설파괴적 스캔” - ISBN (국제표준도서번호):
전 세계 도서에 부여되는 고유 식별 번호
“AI 기업들이 ISBN 목록을 따라가며 전 세계의 모든 인쇄 도서를 체계적으로 스캔하려 한다는 이론” - 최초 판매 원칙 (First Sale Doctrine):
적법하게 구매한 물건에 대해 소유자가 가지는 처분 권리
“자신이 소유한 물건에 대해 무엇이든 할 수 있다는 원칙최초 판매 원칙” - 독점 데이터 (Proprietary Data):
특정 기업이 독점적으로 보유하여 외부로 공개하지 않는 데이터
“독점 데이터는 시간이 지나면 소실되는 경향이 있음”