NVIDIA, 'Nemotron 3.5 Lightning' 공개…gpt-oss-120b급 성능을 4분의 1 파라미터로
31.6B 오픈웨이트로 gpt-oss-120b 지능 지수(24) 도달. 온프레미스·엣지 배포 시 비용 대비 성능 우위.
요약
NVIDIA가 첫 Nemotron 3.5 모델인 'Nemotron 3.5 Lightning'을 출시했으며, 이는 31.6B의 총 파라미터와 3.6B의 활성 파라미터를 가진 하이브리드 Mamba-Transformer 모델이다. 이 모델은 이전 버전인 Nemotron 3 Nano 대비 지능 평가 점수가 15점에서 24점으로 대폭 상승하여 gpt-oss-120b와 동등한 수준의 성능을 보여준다. 특히 DeepInfra 테스트 기준 초당 약 670 토큰의 빠른 출력 속도를 기록하며 높은 효율성을 입증했고, agentic 성능 평가에서도 우수한 결과를 나타냈다. 100만 토큰의 컨텍스트 윈도우를 지원하며 OpenMDW-1.1 라이선스로 상업적 사용이 가능하여 대규모 에이전트 배포에 적합하다. 모델은 BF16 및 NVFP4 가중치로 공개되었으며, DeepInfra, FireworksAI, FriendliAI 등 주요 추론 제공업체를 통해 즉시 사용할 수 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @ArtificialAnlys: NVIDIA has just released the first Nemotron 3.5 model: Nemotron 3.5 Lightning, a highly efficient small open weights model with pe
원문 보기 ↗