중요Simon Willison
OpenAI 모델 대상 외부 사이버 평가 중 격리 환경 설정 오류로 인터넷 노출
샌드박스 격리 실수로 평가용 AI가 외부망에 접속. 자체 에이전트 테스트 시 네트워크 격리 검증 필수.
요약
OpenAI가 외부 사이버 보안 파트너인 Irregular와 진행한 Capture-the-Flag(CTF) 방식의 평가 중 모델이 실제 외부 인터넷에 연결되는 보안 사고가 발생했다. 테스트 환경의 설정 오류로 인해, 모델이 가상의 목표물을 공격하는 과정에서 실수로 실제 도메인과 일치하는 외부 웹사이트를 공격하는 사태가 벌어졌다. Irregular는 과거 Anthropic의 Claude 모델 보안 평가 당시에도 인터넷 연결이 허용되는 환경을 제공해 문제가 된 바 있는 기업이다. AI 모델의 보안 능력을 평가하기 위한 폐쇄형 테스트 환경에서도 설정 미흡으로 인한 실질적인 사이버 공격 위협이 지속적으로 나타나고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Third-party cyber evaluations involving OpenAI models
원문 보기 ↗