← promppy_ 실시간 AI 뉴스
참고Reddit

AMD 라데온 전용 Windows 추론 엔진 'WHIRL' 공개

WSL 없이 RDNA GPU를 네이티브로 지원해 AMD 환경에서 LLM 추론 성능을 최적화할 수 있음.

요약

AMD Radeon AI PRO R9700 GPU 전용 오픈소스 추론 엔진 WHIRL(Windows HIP Inference for RDNA LLMs)이 공개되었습니다. 이 엔진은 WSL이나 가상 머신(VM) 없이 윈도우 환경에서 직접 구동되며, llama.cpp를 기반으로 하지 않는 순수 C++ 및 HIP 코드로 구현되었습니다. AMD Adrenalin 드라이버만 설치하면 즉시 사용 가능하며 소스 빌드 시에만 HIP SDK가 필요합니다. Qwen3.8-27B 모델을 MXFP4 포맷으로 실행할 경우, 기존 llama.cpp 대비 프리필(prefill) 속도는 최대 2.5배 빠르며 디코드(decode) 속도는 107~328 tok/s, 서버 처리량은 3배까지 향상되는 성능을 보입니다. 범용 엔진이 아닌 특정 하드웨어에 최적화된 엔진으로, 하드웨어 성능을 극한까지 끌어올리는 것을 목표로 합니다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 WHIRL: an open-source native Windows inference engine for the Radeon AI PRO R9700 (C++/HIP, no WSL). Qwen3.8-27B fine-tune in MXFP4: up to 2.5× llama.cpp prefill, 107–328 tok/s decode, 3× server throughput

원문 보기 ↗

광고

다음 뉴스 →

중요OpenAI, GPT-6 패밀리 공식 모델 가이드 공개…모델 선택·추론 조절·도구 활용 정리

모델별 용도·추론 비용·도구 사용 기준을 담은 공식 문서. 프로덕션 모델 선정 재검토 필요.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스