OpenAI 자체 추론 칩 'Jalapeño', NVIDIA GB200·GB300 능가 주장…2026년 말 배치
와트당 성능 1.5~1.9배, 지연 1.7~3.6배 개선 주장. GPU 공급망·추론 비용 구조 변화 예의주시.
요약
OpenAI가 공개한 첫 자체 추론 칩 'Jalapeño'가 Nvidia의 GB200 및 GB300 시스템 대비 성능과 효율성에서 앞서는 것으로 나타났다. 테스트 결과 GPT‑OSS 120B, DeepSeek R1 670B, Kimi K2.5 1T 모델에서 전력 대비 1.5~1.9배 높은 처리량과 1.7~3.6배 낮은 지연 시간을 기록했다. 특히 고도의 인터랙티브 워크로드에서는 최대 2.1~4.1배 높은 성능을 보였으며, 정격 700W인 칩이 실제 워크로드 테스트에서는 550W 이하를 유지하는 전력 효율성을 입증했다. OpenAI는 2026년 말부터 Jalapeño 배포를 시작할 예정이며, 이미 Gen 2 개발과 Gen 3 설계를 진행 중이다. 이번 성과는 향후 1~2년 내에 750 token/s가 추론 속도의 기본값이 될 것이라는 전망을 뒷받침하고 있다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @kimmonismus: Holy: OpenAI says its first custom inference chip is already beating Nvidia GB200 and GB300 systems on speed and efficiency. Acros
원문 보기 ↗