참고AI타임스
엔비디아 GB300 NVL72, MoE 모델 학습 성능 3배 개선
최신 MoE 아키텍처 학습 최적화로 GPU당 1648 TFLOPs 성능 기록. 차세대 인프라 구성 시 참고.
요약
엔비디아가 새로운 AI 인프라 플랫폼 'GB300 NVL72'를 활용해 대형 전문가 혼합(MoE) 모델 사전학습에서 업계 최고 수준의 성능을 기록했다. 21일(현지시간) 공개된 테스트 결과에 따르면, 'DeepSeek-V3 671B' 모델 사전학습 환경에서 256개의 GPU를 사용해 GPU당 초당 1648테라플롭스(TFLOPs)의 연산 성능을 달성했다. 이는 MoE 아키텍처에 최적화된 풀스택 설계를 통해 이전 세대 대비 3배 향상된 처리 성능을 보여준 것이다. 이번 성과는 최근 주요 AI 모델이 도입하는 MoE 구조에서 엔비디아 하드웨어의 효율성이 크게 개선되었음을 입증한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 엔비디아, 'GB300 NVL72'로 MoE 모델 사전학습 성능 3배 향상
원문 보기 ↗