ComfyUI(콤피UI), 80B 규모 HunyuanImage 3.0 로컬 구동 지원
80B 모델을 소비자 GPU에서 메모리 최적화로 구동하는 ComfyUI(콤피UI) 활용법 및 성능 벤치마크 공유.
요약
텐센트의 80B 규모 이미지 생성 모델인 HunyuanImage 3.0(스텝당 13B 활성)이 ComfyUI에서 네이티브로 구동 가능해졌다. 이 구현은 기존 파이프라인을 단순히 감싼 형태가 아니라, KSampler와 VAE Decode 등 ComfyUI의 표준 노드를 사용하며 자체 메모리 관리 기능을 통해 전문가 모델을 시스템 RAM에서 스트리밍한다. 덕분에 12~24GB VRAM을 갖춘 일반 소비자용 GPU 환경에서도 단일 카드로 모델 실행이 가능하다. 현재 4비트 양자화 모델을 사용하여 텍스트-이미지 생성, 이미지 편집, 스타일 전송 등의 기능을 지원한다. RTX 3090 환경에서 Instruct-Distil 모델 기준 8스텝 생성 시 장당 약 30초가 소요된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 HunyuanImage 3.0 (80B) running natively in ComfyUI on a single 12–24 GB GPU: text-to-image, editing and style transfer, ~30 s per image
원문 보기 ↗