웨카(WEKA), AI 추론 경제성 높이는 소프트웨어 'NeuralMesh 6' 공개
에이전틱 AI 등 고부하 워크로드 운영 시 인프라 효율과 토큰 처리량을 개선할 수 있는 스택 업데이트.
요약
AI 데이터·메모리 인프라 기업 웨카(WEKA)는 2026년 7월 21일 엔터프라이즈 및 에이전틱 AI 워크로드의 실운영 규모를 지원하는 'WEKA NeuralMesh 6'를 발표했다. 해당 플랫폼은 하이퍼스케일 네이티브 멀티테넌시, NVMe 기반 통합 프로토콜 스택, Kubernetes 네이티브 운영 등 AI 추론 경제성을 극대화하는 기능을 단일 스택으로 통합 제공한다. 특히 오라클 클라우드 인프라스트럭처(OCI) 환경에서 'Augmented Memory Grid' 기술을 적용한 결과, 기존 대비 토큰 처리량 10배, 동시 서비스 사용자 수 10배, GPU당 처리 토큰 수 7배의 성능 향상을 입증했다. 주요 기능인 하이퍼스케일 멀티테넌시는 물리적 격리 방식인 'Composable Clusters'와 네트워크 격리를 지원하는 'Virtual Multi-Tenancy'를 결합해 클러스터당 1,000개 이상의 논리 테넌트를 구성할 수 있다. 이번 출시는 AI 인프라의 중심이 학습에서 프로덕션 추론으로 이동함에 따라 메모리 병목 현상을 해결하고 고비용 인프라 운영 효율을 개선하려는 기업들을 겨냥했다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 웨카, 엔터프라이즈 및 에이전틱 AI 워크로드의 실제 운영 규모 지원하는 NeuralMesh 6 공개
원문 보기 ↗