중요X
OpenAI, 안전성 강화 위해 차세대 모델 RL 학습 2주간 중단
최대 규모 프론티어 RL 실행 보류 중. 차기 모델 출시 일정 지연 가능성 염두에 둘 것.
요약
OpenAI는 모델의 성능이 향상됨에 따라 내부 개발 및 테스트 과정의 위험 또한 커지고 있다고 판단해 관련 안전 조치를 강화하고 있습니다. 이에 따라 배포를 목표로 하는 최신 모델의 강화학습(RL) 훈련을 2주간 일시 중단했습니다. 이 기간 동안 연구 환경에 대한 보안 강화와 레드팀(Red-teaming) 운영, 모니터링 범위를 확대하는 작업을 진행했습니다. 현재 가장 규모가 큰 프런티어 모델의 강화학습은 여전히 보류 상태입니다. 대신 소규모 훈련과 평가를 통해 안전 장치를 검증하고, AI 정렬(Alignment)에 대한 증거를 확보하는 데 집중하고 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @OpenAI: As models become more capable, the risks associated with developing and testing them internally also grow. We temporarily paused r
원문 보기 ↗