Anthropic, Claude 악용해 미 해군 기지 표적화·영향력 공작 벌인 이란 세력 적발
국가 배후 세력의 LLM 오용 실사례 확인. 오·남용 탐지·차단 정책 점검 필요.
요약
AI 기업 Anthropic이 자사의 AI 모델 Claude를 악용한 이란의 사이버 활동을 적발하고 이를 차단했다고 밝혔다. 이란은 Claude를 활용해 미 해군 기지를 표적으로 삼고 미국인들에 대한 상세한 정보 보고서를 자동화하며, 미국 소셜 미디어 상에서 영향력 확대 캠페인을 벌인 것으로 드러났다. 특히 이 과정에서 이란 측이 아야톨라 장례식 조직 계획을 포함한 민감한 내부 자료를 Claude에 업로드하는 등 보안상의 치명적인 실수를 범한 것으로 나타났다. Anthropic은 즉각적인 대응을 통해 해당 계정을 차단했으며, 향후 이러한 오용 사례를 방지하기 위해 안전 조치를 더욱 강화할 방침이다. 이번 사건은 AI 모델이 국가 차원의 사이버 정보전과 악의적인 선전 도구로 이용될 수 있음을 보여주는 구체적인 사례로 주목받고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @ComfortablySmug: Holy shit. Anthropic caught Iran using Claude to target Navy bases, automate dossiers on Americans, and run influence campaigns on
원문 보기 ↗