중요AI타임스
OpenAI·Anthropic 암호화 '사고 과정', API 설계 허점으로 복원 가능
저가 모델을 해독기로 악용해 CoT 평문화 가능. API 연동 서비스 보안 설계 재점검 필요.
요약
오픈AI, 앤트로픽, 구글 등 주요 AI 기업의 대형언어모델(LLM)이 API 설계 허점으로 인해 내부 사고 과정(CoT) 데이터가 유출될 위험에 처했다. 독일 튀빙겐의 ELLIS 연구소와 막스플랑크 지능시스템연구소 연구진은 고성능 모델 자체를 직접 공격하지 않고도, 같은 생태계 내 저렴하고 보안이 약한 모델을 '해독기'로 활용해 암호화된 추론 데이터를 평문으로 복원할 수 있음을 입증했다. 이는 경쟁력 보호를 위해 숨겨둔 추론 과정이 외부로 노출될 수 있다는 점에서 AI 보안 및 API 설계에 큰 파장을 예고하고 있다. 연구진은 공격자가 API 호출 과정을 악용해 모델의 핵심 사고 과정을 가로챌 수 있다고 경고했다. 이번 연구 결과는 기업들이 보안이 강화된 API 설계와 추론 데이터 보호를 위해 즉각적인 조치에 나서야 함을 시사한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 오픈AI·앤트로픽 암호화 '사고 과정' 통째 유출...API 설계 허점 파문
원문 보기 ↗