AI 학습용 도서 데이터 확보를 위한 고서 파괴 논란 확산
AI 학습 데이터 확보를 위해 희귀 도서를 수집 후 폐기한다는 의혹이 제기되며 업계 윤리 및 데이터 소싱 이슈 부상.
요약
Anthropic이 인류의 문화유산인 희귀 도서를 대량으로 파괴하며 AI 학습 데이터를 구축했다는 의혹이 제기되었습니다. AI 학습을 위해 책의 제본을 절단하여 훼손하는 방식이 사용되었으며, 이로 인해 원본 도서에 대한 접근이 영구적으로 불가능해졌습니다. 유럽의 고서점상들은 2077AI나 Zoom Books와 같은 생소한 업체들로부터 3,000권 단위의 무작위 도서 매입 요청이 밤 시간대에 쏟아지고 있다고 전했습니다. 이들 업체는 희귀 서적이나 학술 자료 등을 포함한 도서들을 대량으로 수거하고 있으며, 일부는 이를 단순한 재활용 및 거래 모델이라고 주장하고 있습니다. AI 개발 기업들이 모델 학습을 위해 데이터 확보에 열을 올리는 가운데, 지식 자산의 물리적 훼손에 대한 윤리적 논란이 확산되고 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @IntCyberDigest: ‼️ Anthropic was hiding a secret internal project to destructively scan every book in the world, irreversibly damaging heritage. T
원문 보기 ↗