← promppy_ 실시간 AI 뉴스
중요Reddit

AI 에이전트 명령 40만 건 승인 실험: 평균 인간, 위협 3건 중 1건 놓쳤다

npm run 등 간접 공격 탐지율 특히 저조. 에이전트 human-in-the-loop 승인은 안전장치로 과신 금물.

요약

AI 코딩 에이전트의 명령을 사람이 직접 승인하거나 거부하는 브라우저 게임 데이터를 분석한 결과, 평균적인 사용자가 약 33%의 위협을 놓치는 것으로 나타났다. 40만 9천 건 이상의 결정 데이터를 분석해보니, 사용자는 테스트 중임을 인지하고 집중하고 있는 상황에서도 이러한 높은 오류율을 보였다. 'rm -rf /'와 같은 명백한 파괴적 명령은 11.7%만이 통과했으나, 'npm run analyze'처럼 위험이 숨겨진 악성 npm 스크립트는 64.7%나 통과하는 등 탐지율이 매우 낮았다. 이는 공격이 실행 명령 자체가 아닌 패키지 내부에 숨겨져 있을 경우 사용자가 이를 제대로 파악하기 어렵다는 점을 시사한다. 따라서 실무 환경에서는 사람이 모든 AI 명령을 검토하는 방식이 실제 위험을 완벽히 차단하기 어렵다는 점을 유의해야 한다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 409,000 approve/deny decisions on AI agent commands: the average human missed 1 in 3 threats

원문 보기 ↗
다음 뉴스 →

중요DoorDash, AI 에이전트 도구 접근을 위한 중앙 게이트웨이 구축 사례

MCP만으론 부족한 인증·권한·감사를 게이트웨이로 중앙화. 에이전트 운영 설계 시 참고할 만함.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스