참고Mistral AI
미스트랄 AI, 정책 적응형 멀티모달 안전 분류기 'Shieldstral' 공개
별도 재학습 없이 자연어로 정책을 설정해 텍스트와 이미지를 동시에 안전성 평가하는 3B 모델. 프로덕션 서비스 도입 검토 가치 있음.
요약
Mistral AI가 콘텐츠 조정 문제를 정책 적응형 질의응답 방식으로 해결하는 3B 파라미터 규모의 멀티모달 안전 분류기 'Shieldstral'을 공개했다. 이 모델은 별도의 재학습 없이 추론 시점에 평문 정책을 입력하는 것만으로 텍스트와 이미지 안전성을 동시에 평가할 수 있다. 기존의 고정된 유해성 분류 모델들과 달리, 특정 제품이나 서비스 환경에 맞춰 유연하게 안전 정책을 조정할 수 있는 것이 특징이다. 3B 모델임에도 기존 모델 대비 최대 7배 큰 크기의 모델들과 대등한 성능을 보이며 멀티모달 조정 분야에서 새로운 기준을 제시했다. 단일 16GB NVIDIA GPU 환경에서 효율적으로 구동 가능하며, Apache 2.0 라이선스로 배포되어 누구나 사용할 수 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Introducing Shieldstral.
원문 보기 ↗