Claude 워터마크, 하루 만에 우회 코드 등장…GitHub서 확산
AI 생성물 표식 정책이 우회 가능함이 드러남. 워터마크에 의존한 출처 검증 설계는 재검토 필요.
요약
앤스로픽(Anthropic)이 EU AI 법 준수를 위해 Claude 모델이 생성한 텍스트에 기계가 읽을 수 있는 보이지 않는 워터마크를 도입한 지 4시간 만에 이를 무력화하는 코드가 개발되었습니다. 개발자 기욤 메이어(Guillaume Meyer)가 공개한 이 코드는 깃허브(GitHub)에서 화제가 되며 100명 이상의 기여자가 참여했고, X(구 트위터)에서도 2만 번 이상 북마크되었습니다. 메이어와 일부 개발자들은 AI 생성물에 대한 의무적 라벨링에 반대하거나 기술적 도전이라는 이유로 워터마크 제거 코드를 개발했다고 밝혔습니다. 이번 조치는 앤스로픽과 OpenAI 같은 모델 제공자가 AI 생성물을 라벨링하지 않을 경우 연간 매출의 최대 3%에 달하는 벌금을 부과받을 수 있는 EU AI 법 규정에 따른 것입니다. 해당 우회 기술이 빠르게 확산되면서 AI 생성물 식별을 위한 제도적 장치의 실효성 논란이 실무자들 사이에서 제기되고 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Coders Say They Already Found Workarounds to Claude’s Invisible Watermarks
원문 보기 ↗