참고X
OpenAI, 대규모 프론티어 RL 학습 재개…일부 고난도 학습은 여전히 보류
Astra 개발 과정에서 중단되었던 대규모 RL 학습이 부분 재개됨. 차세대 모델 개발 현황 참고.
요약
OpenAI가 기존에 일시 중단했던 대규모 프론티어 강화학습(RL) 실험을 다시 시작했다. 중단 기간 동안 소규모 관련 연구는 강화된 통제 하에 지속적으로 진행되어 왔다. 다만 차세대 Astra 버전을 위한 일부 대규모 강화학습 실험은 여전히 보류 상태를 유지하고 있다. 이번 결정은 안전 및 통제 기준을 점검하며 실험을 재개하려는 OpenAI의 전략적 접근으로 풀이된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @haider1: OpenAI restarted a previously paused large frontier RL run smaller-scale work continued under stricter controls, but some of the b
원문 보기 ↗