NVIDIA 'Vera Rubin', DeepSeek R1에서 GB200 대비 와트당 토큰 최대 10배
토큰당 비용 급감 시 상시가동 에이전트 경제성 확보. GPU 인프라 원가·용량 재산정 필요.
요약
NVIDIA의 차세대 아키텍처인 Vera Rubin이 이전 세대 대비 획기적인 성능 도약을 보일 것으로 전망된다. CoreWeave가 측정한 실리콘 결과에 따르면, DeepSeek R1 모델 구동 시 GB200 Blackwell NVL72 대비 메가와트당 토큰 처리량이 최대 10배 증가한 것으로 나타났다. 사용자 반응성은 기존과 유사한 수준을 유지하면서 토큰당 비용을 획기적으로 낮출 수 있다는 점이 핵심이다. 동일한 전력 예산 안에서 추론 및 에이전트 트래픽을 최대 10배까지 처리할 수 있는 성능이다. 이러한 하드웨어적 발전은 대규모 상시 가동형 AI 에이전트의 경제성을 확보하는 데 결정적인 역할을 할 것으로 기대된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @mark_k: Nvidia news: @NVIDIA Vera Rubin is shaping up to be a massive generational leap. CoreWeave's first measured silicon results show u
원문 보기 ↗