참고팁Reddit
H3 Minimax 모델 추론 속도 2.5배 향상: Sparse Attention 노드 공개
ComfyUI용 Sparse Attention 노드로 H3 Minimax 추론 속도 개선. 이미지 생성 워크플로우 최적화 시 참고.
요약
ComfyUI 사용자들을 위한 H3 Minimax 전용 Sparse attention SLA 노드가 새롭게 공개되어 최대 2.5배의 추론 속도 향상을 기대할 수 있다. 이 노드는 특정 LoRA 사용 여부와 관계없이 모든 터보 모델과 호환되며, ComfyUI-PlagueKind-Nodes 패키지를 통해 설치 가능하다. 메모리 부족(OOM) 현상이 발생할 경우 Comfykitch attention 노드를 함께 사용하면 추가적인 5~10%의 성능 개선 효과를 얻을 수 있다. 최적의 구동을 위해 최신 PyTorch 버전과 CU130 환경이 권장된다. 현재 해당 노드는 LoRA 로더 뒤에 배치하여 사용하는 방식이 가장 안정적인 것으로 확인되었다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Sparse attention for H3 minimax, enjoy up to 2.5x speed up.
원문 보기 ↗