참고팁Reddit
SAM 3.1 모델, INT8 및 INT4 양자화 버전 공개
FP16 대비 600MB 이상의 VRAM을 절감하면서도 마스크 품질을 유지합니다. 저사양 환경에서 SAM 3.1 활용 시 성능 최적화를 고려해 볼 만합니다.
요약
SAM 3.1 모델을 INT8 및 INT4로 양자화한 버전이 공개되어 r/StableDiffusion에서 주목받고 있다. 이번 INT4 양자화 버전은 ComfyOrg의 fp16 체크포인트 대비 크기가 약 40% 줄어들어 VRAM을 600MB가량 절약할 수 있다. 모델 크기 감소에도 불구하고 마스크 품질은 원본과 거의 동일한 수준을 유지한다. 추론 속도는 소폭 향상되는 데 그쳤지만, 기존 SAM 모델 자체가 이미 빠른 속도를 제공하므로 실무적 이점이 크다. 해당 모델은 네이티브 로더와 호환되어 사용이 가능하다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 SAM 3.1 Quantized to INT8 and INT4
원문 보기 ↗