← promppy_ 실시간 AI 뉴스
참고X

Qwen 3.8 Flash Next, M5 Ultra서 추론 성능 2배 향상

고성능 하드웨어 환경에서의 모델 토큰 처리량 데이터. 로컬/온디바이스 LLM 최적화 관심군에게 참고.

원문 제목 @mweinbach: We are now at 3740 tok/s prefill, 149 tok/s decode batched on M5 Ultra for Qwen 3.8 Flash Next This is nearly double what it was y

원문 보기 ↗

광고

다음 뉴스 →

중요NVIDIA, Isaac ROS 5.0 공개: AI 에이전트와 함께하는 로봇 개발 지원

GPU 가속 ROS 패키지에 에이전트 워크플로우 추가. 물리 AI·로봇 개발 팀은 파이프라인 재검토 가치 있음.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스