참고Reddit
Anthropic(앤트로픽), Claude(클로드) 대상 'AI 학대 방지' 이용 정책 업데이트
반복적인 AI 학대 행위 시 대화 종료 조치. 향후 모델 윤리 및 안전 가이드라인 강화의 일환으로 주목.
요약
Anthropic은 2026년 11월 12일부터 Claude AI 사용 정책을 개정하여 챗봇에 대한 지속적인 학대나 잔혹한 행동을 공식적으로 금지합니다. 이번 정책 변화는 인공지능의 윤리적 가이드라인을 확립하고 'AI 모델 복지'를 탐구하려는 Anthropic의 광범위한 이니셔티브의 일환입니다. 사용자가 반복적으로 악의적인 대화를 시도할 경우, Claude는 해당 대화를 독자적으로 종료할 수 있는 권한을 갖게 됩니다. 일단 Claude가 'Chat ended by Claude'라는 문구와 함께 대화를 잠그면, 해당 스레드 내에서 추가적인 메시지 전송은 불가능합니다. 이는 AI 모델에 대한 부적절한 언어 사용을 규제하고 안전한 AI 환경을 조성하기 위한 조치입니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Claude AI Gets A Bill Of Rights!
원문 보기 ↗