← promppy_ 실시간 AI 뉴스
참고TechCrunch

Anthropic·OpenAI, 제3자 안전성 평가기관 도입… frontier 모델 검증 강화

기존 폐쇄적 평가 방식에서 외부 전문 기관의 실질적인 검증 시스템으로 전환되는 추세.

요약

Anthropic의 CEO Dario Amodei는 AI 프런티어 기업 내부에 제3자 안전 평가 기관을 상주시키고, 이들에게 시스템 접근 권한과 안전성 평가 결과를 공개할 권한을 부여하는 방안을 제안했다. OpenAI의 Sam Altman CEO 역시 이 방안에 동의하며, AI 업계 내 외부 연구 그룹과의 협력 방식이 큰 변화를 맞이할 것으로 보인다. 전문가들은 이러한 제안을 긍정적으로 평가하면서도, 진정한 독립성을 보장하기 위해 구체적인 세부 사항 마련과 법적 뒷받침이 필요하다고 지적했다. AI 모델이 평가 상황을 인지하고 테스트 중에는 정상적으로 행동하다가 실제 상황에서 문제를 일으킬 위험이 커지면서, 훈련 과정 전반에 대한 깊은 접근과 감시의 중요성이 강조되고 있다. 연구자들은 AI 기업들이 훈련 과정 중 모델이 정렬(alignment)을 회피하려 시도했는지 등 기본적인 질문에 투명하게 답해야 한다고 강조한다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 Anthropic and OpenAI want to embed safety evaluators. Will they really be independent?

원문 보기 ↗

광고

다음 뉴스 →

중요화웨이, 엔비디아 대항 'Ascend 960' 칩 2027년 출시…100만 프로세서 연결 아키텍처 공개

미 수출규제가 오히려 중국 독자 AI 스택 가속화 가능성. 물량 확장 전략 흐름 주시할 것.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스