AI 학습 데이터 저작권 법적 논란: 저작물 활용은 합법인가?
학습 데이터의 저작권 이슈는 현재 진행형인 법적 쟁점입니다. Anthropic 판례를 중심으로 실무자들이 참고해야 할 법적 리스크를 요약합니다.
요약
ChatGPT, Gemini, Claude와 같은 AI 모델들은 수억 권의 책과 인터넷상의 방대한 데이터를 학습하며 저작권 논란의 중심에 서 있다. 지식재산권 전문 변호사 캐시 겔리스는 이 문제가 복잡한 이해관계와 다양한 법적 쟁점이 얽혀 있어 쉽게 결론 내리기 어렵다고 분석했다. 지난해 윌리엄 알섭 판사는 앤스로픽(Anthropic)이 AI 학습 과정에서 작가들의 저작물을 사용한 것에 대해 판결을 내렸다. 당시 법원은 앤스로픽의 AI 학습 자체는 적법하다고 보았으나, 학습 데이터 확보 과정에서 불법 온라인 ‘쉐도우 라이브러리’를 통해 저작물을 해적판으로 이용한 점을 문제 삼아 15억 달러의 합의금을 지급하도록 명령했다. 즉, AI 모델의 학습 행위 자체는 법적 보호를 받을 여지가 있으나, 데이터 수집 경로의 적법성은 엄격히 다뤄져야 한다는 것이 법원의 시각이다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Is it legal to train AI models on copyrighted books? It’s complicated
원문 보기 ↗