중요TechCrunch
OpenAI Astra, '불투명 재귀' 추론 도입…AI 안전 전문가 경계령
CoT 모니터링이 어려워지는 방식. 안전성·설명가능성 요구 서비스는 채택 전 검증 강화 필요.
요약
OpenAI가 개발 중인 차세대 모델 Astra에 순차적 사고 과정을 벗어나는 'recurrent depth(또는 opaque recurrence)' 추론 기법이 도입될 것으로 알려졌다. 이 기술은 기존 모델의 사고 과정(Chain of Thought)을 모니터링하기 어렵게 만들어 AI 안전성 전문가들의 우려를 사고 있다. Redwood의 CEO Buck Shlegeris는 이 기술이 확산될 경우 모델의 추론 과정을 파악하기 불가능해질 수 있다고 경고했다. AI 안전 옹호가 Zvi Mowshowitz 또한 이러한 기술적 접근이 AI 연구소 간의 경쟁을 부추겨 모니터링 가능성을 훼손할 위험이 있다고 지적했다. 현재 Astra에서의 사용 범위는 제한적이지만, 전문가들은 향후 이 기술이 확대 적용될 가능성에 대해 강한 경계심을 보이고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 OpenAI’s new reasoning technique alarms AI safety experts
원문 보기 ↗