← promppy_ 실시간 AI 뉴스
중요X

OpenAI 자체 추론 칩 'Jalapeño', NVIDIA GB200·GB300 능가 주장…2026년 말 배치

와트당 성능 1.5~1.9배, 지연 1.7~3.6배 개선 주장. GPU 공급망·추론 비용 구조 변화 예의주시.

요약

OpenAI가 공개한 첫 자체 추론 칩 'Jalapeño'가 Nvidia의 GB200 및 GB300 시스템 대비 성능과 효율성에서 앞서는 것으로 나타났다. 테스트 결과 GPT‑OSS 120B, DeepSeek R1 670B, Kimi K2.5 1T 모델에서 전력 대비 1.5~1.9배 높은 처리량과 1.7~3.6배 낮은 지연 시간을 기록했다. 특히 고도의 인터랙티브 워크로드에서는 최대 2.1~4.1배 높은 성능을 보였으며, 정격 700W인 칩이 실제 워크로드 테스트에서는 550W 이하를 유지하는 전력 효율성을 입증했다. OpenAI는 2026년 말부터 Jalapeño 배포를 시작할 예정이며, 이미 Gen 2 개발과 Gen 3 설계를 진행 중이다. 이번 성과는 향후 1~2년 내에 750 token/s가 추론 속도의 기본값이 될 것이라는 전망을 뒷받침하고 있다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @kimmonismus: Holy: OpenAI says its first custom inference chip is already beating Nvidia GB200 and GB300 systems on speed and efficiency. Acros

원문 보기 ↗
다음 뉴스 →

중요Perplexity, NVIDIA DGX Spark용 로컬 우선 에이전트 스택 'Portable Computer' 공개

원클릭 로컬 추론 설정 제공. 온프레미스·데이터 민감 환경의 에이전트 구축 대안으로 검토 가치.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스