미 NSA·CISA·FBI 합동 권고문, 증류 의심 요청엔 몰래 답변 품질 낮추라 지침
프런티어 API가 증류 방어로 답변을 은밀히 다운그레이드할 수 있음. 외부 모델 API 결과의 일관성·신뢰성 재검토 필요.
요약
9월 8일 미국 NSA, CISA, FBI는 중국 AI 기업 6곳(딥시크, 문샷AI, 알리바바, MiniMax, 스텝펀, Z.AI)이 미국 프런티어 모델의 데이터를 활용해 자사 모델을 학습시키는 '지식 증류' 행위를 수행했다는 합동 사이버보안 권고문(AA26-251A)을 발표했다. 보고서는 딥시크가 클로드, GPT, 제미나이, 그록 등 14개 모델을 활용해 법률 최적화 및 사고 사슬(CoT) 데이터를 확보했음을 지목하며, 이를 단순 약관 위반이 아닌 MITRE ATLAS 프레임워크 기반의 보안 위협으로 규정했다. 권고문은 미국 AI 기업들에 증류 의심 요청 시 응답 내용을 의도적으로 변경하거나 덜 정교한 모델로 답해 데이터 가치를 떨어뜨리는 방어 전략을 권고했다. 또한, 다운그레이드 사실을 사용자에게 알리지 말고 AI 안전 연구자 및 평가기관에만 공유하여 공격자의 회피 기법 개선을 차단할 것을 당부했다. 이번 조치는 AI 모델 증류가 민사 영역을 넘어 국가 안보 차원의 공격 기법으로 분류되고 있음을 시사한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 [안광섭 AI 진테제] 미 정부 사이버보안 권고문이 의미하는 것
원문 보기 ↗