참고AI타임스
오픈AI가 GPT-6 Astra 출시에서 안전성에 집중한 이유
성능 경쟁을 넘어 탈옥, 프롬프트 인젝션 등 실질적 안전성 검증이 모델 신뢰도의 핵심 지표로 부상.
요약
오픈AI가 차세대 AI 모델 GPT-6 아스트라를 공개하며 성능보다 안전성 검증에 집중한 행보를 보이고 있다. 기존 AI 출시 관례와 달리 오픈AI는 벤치마크 성적보다 별도의 안전성 테스트 결과를 강조했다. 이번 발표와 함께 공개된 시스템 카드에는 정렬 수준을 비롯해 탈옥 및 프롬프트 인젝션 내성, 실제 컴퓨터 사용 시 행동 감시 등이 포함됐다. 또한 모델의 사고 과정에 대한 투명한 검증을 중요하게 다루며 기술적 완성도만큼이나 안전한 AI 구축을 위한 의지를 드러냈다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 [9월4일] 오픈AI가 '아스트라' 성능보다 안전 설명에 집중한 이유
원문 보기 ↗