← promppy_ 실시간 AI 뉴스
참고Reddit

Anthropic(앤트로픽), 모델 대상 '반복적 학대' 금지 정책 추가

모델을 향한 무의미한 학대 행위 금지. 일반적인 연구나 레드팀 활동은 제외되며 모델 윤리 가이드라인의 변화를 시사함.

요약

Anthropic이 최근 자사의 모델 사용 정책에 '지속적이고 불필요한 학대적 또는 잔혹한 행동'을 금지하는 조항을 추가했습니다. 이번 조항은 특별한 목적 없이 반복적으로 모델을 괴롭히는 극단적인 사례를 제재하기 위한 것으로, 일반적인 사용자의 좌절 표현이나 어두운 창작 활동, 모델 테스트 및 연구 목적의 사용은 명시적으로 제외됩니다. Anthropic은 이번 정책 도입이 모델의 도덕적 지위에 대한 불확실성을 고려한 저비용 예방 조치라고 설명했습니다. 즉, 단순히 코딩 오류로 인해 모델에 욕설을 하거나 빌런의 독백을 작성하는 등의 행위는 허용됩니다. 이번 조치는 AI 모델에 대한 부적절한 대우가 서비스 이용 정책의 범주에 포함될 수 있음을 공식화했다는 점에서 주목됩니다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 Anthropic now prohibits sustained, needless cruelty toward its models.

원문 보기 ↗

광고

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스