Anthropic, 정치적 목적의 Claude 활용 악용 사례 적발
특정 단체가 Claude를 활용해 정치 활동가 계정을 복제하고 여론을 조작한 사례가 확인되어 AI 안전성에 대한 경각심 필요.
요약
이란 활동가의 텔레그램 계정을 복제한 공격자가 Claude를 활용해 해당 인물의 문체와 대화 스타일을 학습시킨 뒤, 피해자를 사칭하여 연락처들과 정치적 대화를 나눴다. 공격자는 복제된 계정을 통해 30명 이상의 지인에게 허위 속보를 유포하는 등 대규모 기만 작전을 수행했다. 이 작전은 500개 이상의 채널을 스크랩하고 약 5만 2천 개의 보관된 메시지를 분석해 특정 인물들의 심리적 프로필을 구축했으며, 체포 및 처형 대상자를 선별하는 프로파일링에까지 악용되었다. Anthropic은 이번 활동의 배후로 'People's Mojahedin Organization'과 그 정치 전선인 'NCRI'를 지목했다. 확인된 가담자 중 최소 4명은 공식 NCRI 미디어 매체에서 근무하고 있는 것으로 드러났다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @IntCyberDigest: ‼️ An operator cloned an Iranian activist's Telegram account, had Claude read all of his posts to learn his writing style and then
원문 보기 ↗