앤트로픽, Claude 워터마크 작동 원리 FAQ 공개…단어 선택에 은닉, 키 있어야 탐지
Claude 출력물에 보이지 않는 워터마크 삽입. 콘텐츠 재판매·저작권 정책 세울 때 검토 필요.
요약
Anthropic이 Claude 모델에 적용된 워터마크 기술에 대한 상세 FAQ를 공개했다. Claude는 문맥상 동일하게 사용 가능한 단어들 중에서 워터마크 기준에 따라 단어를 선택하며, 사용자는 이를 식별할 수 없으나 전용 키를 가진 사람은 확인이 가능하다. 이 워터마크는 사용자 데이터나 채팅 기록과는 무관하며, 오직 해당 텍스트가 Claude에 의해 생성되었는지만을 증명한다. 코드 생성이나 95% 이상 사용자가 작성한 문장의 문법 수정 등에는 영향이 미미하며, 전체 문장을 다시 쓰지 않는 이상 가벼운 편집으로는 삭제가 어렵다. 현재 모든 신규 모델에 워터마크가 적용되었으며 향후 구모델에도 확대될 예정이다. 추후 공개될 탐지 API를 통해 Claude 생성물 여부를 확인할 수 있게 되므로, AI 사용 제한 정책이 있는 환경에서는 주의가 필요하다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @VaibhavSisinty: Anthropic published a full FAQ on how Claude's watermark works. Here is what you need to know. 🤯 → Claude picks between equally g
원문 보기 ↗