← promppy_ 실시간 AI 뉴스
중요X

NVIDIA, 'Nemotron 3.5 Lightning' 공개…gpt-oss-120b급 성능을 4분의 1 파라미터로

31.6B 오픈웨이트로 gpt-oss-120b 지능 지수(24) 도달. 온프레미스·엣지 배포 시 비용 대비 성능 우위.

요약

NVIDIA가 첫 Nemotron 3.5 모델인 'Nemotron 3.5 Lightning'을 출시했으며, 이는 31.6B의 총 파라미터와 3.6B의 활성 파라미터를 가진 하이브리드 Mamba-Transformer 모델이다. 이 모델은 이전 버전인 Nemotron 3 Nano 대비 지능 평가 점수가 15점에서 24점으로 대폭 상승하여 gpt-oss-120b와 동등한 수준의 성능을 보여준다. 특히 DeepInfra 테스트 기준 초당 약 670 토큰의 빠른 출력 속도를 기록하며 높은 효율성을 입증했고, agentic 성능 평가에서도 우수한 결과를 나타냈다. 100만 토큰의 컨텍스트 윈도우를 지원하며 OpenMDW-1.1 라이선스로 상업적 사용이 가능하여 대규모 에이전트 배포에 적합하다. 모델은 BF16 및 NVFP4 가중치로 공개되었으며, DeepInfra, FireworksAI, FriendliAI 등 주요 추론 제공업체를 통해 즉시 사용할 수 있다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @ArtificialAnlys: NVIDIA has just released the first Nemotron 3.5 model: Nemotron 3.5 Lightning, a highly efficient small open weights model with pe

원문 보기 ↗
다음 뉴스 →

중요OpenAI, ChatGPT Work·Codex에 타 에이전트 작업 동기화 기능 추가

프로젝트·채팅·스킬·플러그인을 가져오고 자동 업데이트 설정 가능. 여러 도구 병행 시 통합 검토 가치.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

다른 매체 보도

관련 뉴스

최신 뉴스