Nvidia GPU P2P 잠금 논란, 로컬 LLM 환경서 효율 최적화 이슈
드라이버 설정 변경으로 P2P를 활성화해 로컬 GPU 효율을 개선할 수 있다는 커뮤니티 주장이 공유되었습니다.
요약
최근 Reddit의 r/LocalLLM 커뮤니티에서 Nvidia가 P2P(Peer-to-Peer) 기능을 소프트웨어적으로 제한하여 GPU 성능을 인위적으로 저하시키고 있다는 의혹이 제기되었습니다. 일부 사용자들은 드라이버 코드를 10여 줄 수정하는 것만으로 P2P 기능을 활성화할 수 있으며, 이를 통해 llama.cpp의 'split-mode: tensor' 작동 효율이 향상됨을 확인했습니다. 두 개의 5060ti GPU를 사용하는 작성자는 이 기능 활성화 후 GPU가 100% 사용률을 지속하지 않고도 동일한 성능을 낼 수 있어 하드웨어 부하가 줄어든다고 주장했습니다. 사용자들은 이러한 조치가 제품 수명을 의도적으로 단축시키는 '계획적 구식화'가 아닌지 강력히 비판하고 있습니다. 이번 논란은 고가의 GPU 성능을 소프트웨어로 제한하는 Nvidia의 정책에 대한 실무자들의 반발을 시사합니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Don't you feel scammed by Nvidia with them hiding P2P behind just a dozen lines of code?
원문 보기 ↗