구글, 제미나이 프롬프트 주입 공격의 근본적 해결 어려움 인정
보안 연구원 리포트에 대한 구글 측 답변 화제. 모델의 취약점은 아키텍처 수준의 한계일 수 있음을 시사.
요약
최근 Reddit에는 구글 보안팀이 Gemini의 프롬프트 엔지니어링 우회 공격을 근본적으로 패치할 수 없음을 인정했다는 게시글이 올라왔다. 게시자는 자신이 발견한 5가지 심층적인 프롬프트 엔지니어링 기법을 구글 VRP(Vulnerability Reward Program) 플랫폼에 보고한 후 구글 엔지니어로부터 답변을 받았다고 밝혔다. 특히 구글 측은 해당 취약점들에 대해 근본적인 수정이 불가능하다는 입장을 전달한 것으로 알려져 보안 업계의 주목을 받고 있다. 게시자는 자신이 직접 발견한 '관찰자 및 공범 기법(Observer and Accomplice Technique)' 등 Gemini 1.5 Pro 모델의 취약점을 입증할 수 있는 구체적인 기술들을 공개했다. 이번 사례는 LLM의 설계 구조상 프롬프트 주입 공격을 완벽히 차단하는 데 한계가 있음을 시사하며, AI 모델의 보안 방어 체계에 대한 근본적인 의문을 제기하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 The Google Security Team admitted to me that they cannot fundamentally patch prompt engineering bypasses in Gemini
원문 보기 ↗