참고Reddit
Claude 3.5 Opus, 오퍼레이션 작업 내 보안 필터 과잉 반응 보고
SSH 및 시스템 자동화 작업 시 보안(cyber) 필터가 정상 업무를 차단하는 현상 발생. Claude 활용 툴링 설계 시 프롬프트 엔지니어링 조정 필요.
요약
Claude 3.5 모델이 정당한 시스템 운영 업무를 사이버 보안 위협으로 오인하여 작업을 거부하는 사례가 빈번하게 발생하고 있다. 특히 다중 호스트 연결이나 터널링을 포함한 복잡한 SSH 작업, 그리고 자격 증명을 반환하는 API 호출 작업에서 [cyber] 태그와 함께 모델이 거부 반응을 보인다. 사용자가 로컬에서 실행할 검증 도구를 개발하거나 기존 도구를 개선하려고 할 때, AI가 이를 해킹 도구 제작으로 오해하면서 안전장치가 과도하게 작동하는 것으로 보인다. 이러한 보안 정책의 지나친 민감성으로 인해 실제 산업용 사물인터넷(IIoT) 기기를 관리하는 현업 사용자들의 업무 효율성이 저하되고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Opus 5 keeps refusing legitimate ops tasks due to [cyber] issues.
원문 보기 ↗