중요Reddit
OpenAI 수석 과학자, '뉴럴리즈' 논란에 입장 표명…추론 감시 유지 강조
CoT 감시가 취약·악화 추세임을 인정. 추론 모델 정렬·안전성 검증에 참고할 관점.
요약
OpenAI의 수석 과학자는 최근 모델의 'neuralese(신경어)' 논란에 대해 오해를 바로잡기 위한 입장을 밝혔다. 현재 Astra를 포함한 프런티어 모델들의 계산 그래프 깊이는 GPT-4와 비교했을 때 2배 이내 수준에 머물러 있다. OpenAI는 초기 추론 모델부터 'chain-of-thought(사고 과정)' 모니터링을 지속적으로 유지 및 활용해왔으며, 이를 통해 모델 정렬의 일반화 과정을 파악하고 있다. 다만 현재 이 기법이 취약해지고 부정적인 방향으로 흐르고 있다고 평가하며, 이를 보완하는 것이 현재 연구 프로그램의 핵심 목표라고 강조했다. 그는 이러한 현상이 아키텍처 변화와는 무관하며, 조만간 상세한 이유를 공개할 예정이라고 밝혔다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 OpenAl's chief scientist on the neuralese controversy
원문 보기 ↗