중요The Verge
보안 연구팀, Claude로 72시간 만에 OpenAI 직원 계정 침투 성공
AI가 실제 공격 도구로 쓰인 사례. 사내 Codex·GitHub·서드파티 서비스 접근권한 점검 필요.
요약
독립 보안 연구팀인 Hacktron이 Anthropic의 Claude Opus 4.8 및 5 모델을 활용하여 72시간 이내에 OpenAI 직원 계정을 해킹하는 데 성공했다. 이번 해킹을 통해 연구팀은 OpenAI의 알고리즘 기밀이 포함된 'Monorepo'라는 GitHub 저장소에 접근했다. 연구팀은 실제 내부 코드에 침입하는 대신, 직원 계정을 도용해 풀 리퀘스트를 전송하는 방식으로 접근 권한을 증명했다. 침입 경로는 OpenAI 커뮤니티 호스팅을 담당하는 타사 서비스인 Discourse를 통해 이루어졌다. 이번 사건은 AI 모델이 사이버 보안 공격 도구로 악용될 수 있다는 우려와 함께 기업 내부 시스템 보안의 취약점을 드러낸 사례로 주목받고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Security researchers used Claude to help them hack into OpenAI
원문 보기 ↗