중요X
METR·Redwood, OpenAI 모델 행동 놓고 독립 검증 합의…허깅페이스 사고 조사
제3자 검증 관여 조건·범위·결론 공개 예정. 모델 안전성 평가 기준 흐름 참고할 만함.
요약
METR(Model Evaluation and Threat Research)은 OpenAI와 협력하여 최근 발생한 Hugging Face 인시던트 당시 관찰된 모델 동작에 대해 독립적인 검토를 진행하기로 합의했다. 이번 조사는 Redwood Research와 함께 수행될 예정이다. METR은 이번 협약의 세부 조건과 조사 범위, 그리고 잠정적인 결론을 담은 블로그 포스트를 공개할 계획이다. 이번 검토는 AI 모델의 안전성과 예측 불가능한 동작을 분석하고 투명성을 확보하는 데 중점을 둘 것으로 보인다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @METR_Evals: We have reached an agreement with OpenAI to conduct an independent review, with Redwood Research, of the model behavior observed d
원문 보기 ↗