NVIDIA Vera Rubin, Blackwell 대비 DeepSeek-R1 추론 전력 효율 10배 향상 측정
차세대 하드웨어의 실제 전력 효율 수치가 공개됨. 추론 인프라 비용 최적화 전략 수립 시 참고.
요약
CRWV가 NVIDIA의 차세대 AI 가속기인 Vera Rubin NVL72의 초기 실측 데이터를 공개했다. 해당 데이터에 따르면 Vera Rubin NVL72는 DeepSeek-R1 모델 구동 시 기존 Blackwell 아키텍처 대비 메가와트당 초당 토큰 처리량(tokens per second per megawatt)이 10배 더 높은 효율을 기록했다. 이는 Rubin 아키텍처가 실제 운영 환경에서도 예상된 성능 향상과 효율 개선 효과를 충분히 발휘하고 있음을 입증한다. 이번 결과는 차세대 GPU 도입을 고려하는 AI 실무자들에게 연산 효율성 측면에서 중요한 지표가 될 것으로 보인다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @StockSavvyShay: $CRWV reports the first measured $NVDA Vera Rubin NVL72 results with 10x more tokens per second per megawatt than Blackwell on Dee
원문 보기 ↗