Anthropic, 안전장치로 차단된 요청에도 과금 재개
생물학·증류공격 등 고위험 카테고리 차단 요청 과금. 오탐률 0.1% 미만이나 /feedback 이의제기 경로 숙지 권장.
요약
앤스로픽(Anthropic)은 Claude가 답변하기 전 안전장치(safeguards)에 의해 차단된 요청에 대해서도 비용을 부과하기로 정책을 변경했습니다. 이번 조치는 생물학, 증류 공격, 프론티어 LLM 개발 등 오탐률(false positive rate)이 낮은 특정 범주에만 적용됩니다. 최근 확인된 조직적인 시스템 공격에 대응하기 위한 방어책의 일환이며, 적용 대상 분류기는 0.1% 미만의 낮은 오탐률을 유지하도록 설정되었습니다. 실제 테스트 결과, Claude Code, Claude.ai, Cowork 이용 계정의 99.7%는 이번 과금 대상 블록에 해당하지 않았습니다. 잘못된 차단이라고 판단될 경우 Claude Code 내 '/feedback' 기능을 통해 신고할 수 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @ClaudeDevs: Today, we'll resume charging for requests our safeguards block before Claude responds. This only applies in categories with low fa
원문 보기 ↗