← promppy_ 실시간 AI 뉴스
중요X

NVIDIA 'Vera Rubin', DeepSeek R1에서 GB200 대비 와트당 토큰 최대 10배

토큰당 비용 급감 시 상시가동 에이전트 경제성 확보. GPU 인프라 원가·용량 재산정 필요.

요약

NVIDIA의 차세대 아키텍처인 Vera Rubin이 이전 세대 대비 획기적인 성능 도약을 보일 것으로 전망된다. CoreWeave가 측정한 실리콘 결과에 따르면, DeepSeek R1 모델 구동 시 GB200 Blackwell NVL72 대비 메가와트당 토큰 처리량이 최대 10배 증가한 것으로 나타났다. 사용자 반응성은 기존과 유사한 수준을 유지하면서 토큰당 비용을 획기적으로 낮출 수 있다는 점이 핵심이다. 동일한 전력 예산 안에서 추론 및 에이전트 트래픽을 최대 10배까지 처리할 수 있는 성능이다. 이러한 하드웨어적 발전은 대규모 상시 가동형 AI 에이전트의 경제성을 확보하는 데 결정적인 역할을 할 것으로 기대된다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @mark_k: Nvidia news: @NVIDIA Vera Rubin is shaping up to be a massive generational leap. CoreWeave's first measured silicon results show u

원문 보기 ↗
다음 뉴스 →

중요미 정부 "Moonshot AI, Anthropic 모델 증류로 무단 추출" 공개 성명

Kimi 등 중국 모델의 IP 침해 의혹 공식화. 제재·API 차단 리스크 대비해 대체 모델 검토 권고.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스