← promppy_ 실시간 AI 뉴스
참고X

AI 기업들의 고서(古書) 대량 매입, 모델 붕괴(Model Collapse) 대응 목적

AI 생성 데이터로 인한 학습 효율 저하를 막기 위해 양질의 인간 저작물을 확보하려는 업계 흐름을 보여줍니다.

요약

최근 AI 기업들이 AI 생성 콘텐츠로 오염된 인터넷 데이터의 한계를 극복하기 위해 오래된 실물 서적을 대량으로 매입하고 있다. AI가 생성한 텍스트로 학습한 모델의 성능이 저하되는 '모델 붕괴(Model Collapse)' 현상을 막기 위해, 인간이 작성하고 전문적으로 편집된 양질의 데이터가 필요하기 때문이다. 실제로 Anthropic은 책의 제본을 제거하고 스캔한 뒤 AI 학습 데이터로 활용한 사실이 법원 기록을 통해 확인되었다. ISBNdb와 같은 기업은 AI 연구소를 대상으로 이러한 서적 대량 확보 방안을 공개적으로 제안하고 있다. 그러나 이 과정에서 원작자의 동의나 보상 없이 데이터화가 이루어지고 실물 서적이 파괴된다는 점은 데이터 저작권과 윤리적 측면에서 큰 논란이 되고 있다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @VaibhavSisinty: AI companies are now buying old physical books in bulk. Why? Because the internet is becoming too polluted with AI-generated conte

원문 보기 ↗
다음 뉴스 →

중요소식통: OpenAI·Anthropic, 오픈소스 AI 규제 위해 워싱턴에 조용히 로비

규제화 시 로컬·오픈소스 모델 도입 전략 재검토 필요. 폐쇄 API 의존도 심화 가능성 주시.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스