참고ZDNet Korea
AI 에이전트 인간 승인 체계의 허점: 위험 명령 33% 통과
에이전트 시스템 도입 시 권한 피로(Permission Fatigue)로 인해 위험 작업이 승인될 가능성이 높다는 보안 인사이트.
요약
알렉스 워터스 커스터메이트 CTO의 실험 결과, AI 에이전트의 명령을 사람이 직접 검토하는 방식이 보안 사고를 막기에 불충분하다는 분석이 나왔다. 약 4만 회의 게임 플레이 데이터를 분석한 결과, 참가자들은 위험한 명령의 33.7%를 무심코 승인했으며, 평범한 작업으로 위장된 데이터 유출 명령의 승인율은 64.7%에 달했다. 이는 반복되는 승인 요청으로 인한 '권한 피로(Permission Fatigue)' 때문에 사용자가 명령의 위험성을 기계적으로 판단하게 되기 때문이다. 특히 정보 탈취나 외부 서버 전송과 같이 겉보기에 정상적인 명령은 시스템 파괴 명령보다 더 쉽게 통과되는 경향을 보였다. 따라서 단순히 승인 버튼을 누르는 방식에 의존하기보다, 샌드박싱과 같은 도구적 안전장치를 강화하고 명령의 실행 맥락을 명확히 파악할 수 있는 체계를 우선적으로 구축해야 한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 AI 최종 승인, 인간이면 충분할까…위험 명령 3건 중 1건 허용
원문 보기 ↗