webAI의 3.66B 경량화 모델, RTX 3090서 준수한 성능 입증
2GB 용량으로 95.4%의 논리 벤치마크 점수 기록. 로컬 환경에서 특정 목적용 모델 운용 시 참고할 만한 대안.
요약
WebAI가 3.66B 파라미터 규모의 새로운 모델을 공개했다. 이번 모델은 양자화(quantized) 빌드 기준 2GB 수준의 가벼운 용량으로 구현되었음에도 불구하고, BBH 로직 벤치마크에서 95.4%의 성능을 기록했다. 지난달 Qwen 3.8 27B 모델이 RTX 3090에서 로컬 구동 가능했던 사례에 이어, 고효율 소형 모델의 발전이 가속화되고 있다. 특히 전문적인 사후 학습(post-training)을 거친 소형 모델들이 특정 작업에서 매우 뛰어난 성능을 보이고 있다는 점이 주목된다. 앞으로 이와 같이 최적화된 경량 모델의 활용 사례가 더욱 증가할 것으로 전망된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @haider1: last month, qwen 3.8 27b surprised me running locally on my RTX 3090 now webAI has released a 3.66B model with a quantized build o
원문 보기 ↗