참고X
Qwen 125B 모델, 75GB RAM 환경에서 로컬 구동 성공
Unsloth를 활용해 대규모 파라미터 모델을 일반적인 하드웨어 환경에서 효율적으로 실행 가능한 사례.
원문 제목 @Alibaba_Qwen: A high-performance 125B model now running locally on just 75GB RAM! Thank you @UnslothAI for the day-0 support.🥳
원문 보기 ↗Unsloth를 활용해 대규모 파라미터 모델을 일반적인 하드웨어 환경에서 효율적으로 실행 가능한 사례.
원문 제목 @Alibaba_Qwen: A high-performance 125B model now running locally on just 75GB RAM! Thank you @UnslothAI for the day-0 support.🥳
원문 보기 ↗중요Qwen3.8-Flash-Next·GLM-5.3-Flash 오픈웨이트 공개, 벤치마크서 Claude Opus 추월
MoE로 활성 파라미터는 6~18B지만 전체 가중치 저장 필요—로컬은 워크스테이션급 요구, MIT 라이선스 주목
promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.
15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공