← promppy_ 실시간 AI 뉴스
참고X

Qwen3.8-27B, SGLang 지원으로 RTX 5090서 206 tok/s 달성

SGLang 최적화로 추론 속도 대폭 향상. 로컬 모델 서빙 성능을 극대화하려는 경우 테스트 필수.

원문 제목 @Alibaba_Qwen: Yes, we are back👑, with 206 tok/s on a single RTX 5090! Amazing Day-0 work from the SGLang team. Give it a try~@sgl_project

원문 보기 ↗
다음 뉴스 →

중요GLM-5.3, 리버스 엔지니어링으로 Cursor의 심각한 취약점 발견…비공개 제보 후 수정 진행

AI 모델이 실제 개발 도구 취약점을 찾아낸 사례. Cursor 사용 팀은 향후 패치 적용 필수.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스