참고X
LLM 추론 속도 최적화: 'Discrete Diffusion' 활용 논문 공개
기존 대비 손실 없는 추론 속도 향상을 위한 새로운 확산 기법 제안. 모델 서빙 최적화에 관심 있다면 참고할 만함.
원문 제목 @_akhaliq: Unlocking Lossless Speedups in LLMs via Discrete Diffusion paper: https://t.co/POqau2xMHp https://t.co/iqz1jNoD4t
원문 보기 ↗