참고팁X
Anthropic(앤트로픽)이 제안하는 AI 에이전트 3단계 보안 격리 아키텍처
샌드박스, 모델 분류기, 외부 통제 계층을 활용한 실무적인 에이전트 보안 설계 패턴.
요약
Anthropic은 Claude 에이전트의 안전한 운용을 위해 3단계 격리 시스템인 '에이전트 컨테인먼트' 설정을 공개했다. 기존 방식인 승인 프롬프트는 사용자가 93%의 확률로 '예'를 누르는 등 실효성이 낮아, 모델 감시에서 환경 격리 방식으로 전략을 수정했다. 에이전트는 환경(샌드박스, VM, 송신 규칙), 모델(프롬프트, 분류기, 훈련), 외부(MCP 서버, 플러그인, 감사) 등 세 가지 계층 내에 배치된다. 제품별로는 Claude Chat은 세션당 일회용 컨테이너를, Claude Code는 네트워크가 기본적으로 차단된 OS 샌드박스를, Cowork는 로컬 VM을 사용하여 보안을 강화했다. 특히 Claude Code는 이를 통해 권한 확인 프롬프트를 84% 감소시켰다. 이번 사례는 '모델 제어'보다 '환경 격리'를 우선순위에 두는 보안 접근법이 효과적임을 시사한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @undefinedKi: Anthropic published the exact agent containment setup they run for Claude. Three layers, one pattern per product, and the rules be
원문 보기 ↗