참고AI타임스
인셉션 랩스, 확산 언어모델 '머큐리 2.5' 공개... 초당 1107 토큰 처리
고속 추론에 최적화된 확산 LLM 등장. 실시간 생성 AI 서비스의 비용 및 속도 최적화 대안으로 고려할 만함.
요약
확산 언어모델(Diffusion LLM) 개발사 인셉션 랩스가 기존 LLM의 느린 응답 속도와 비용 문제를 개선한 새 모델 ‘머큐리 2.5(Mercury 2.5)’를 8일(현지시간) 공개했다. 머큐리 2.5는 이전 버전인 머큐리 2 대비 지능 성능이 40% 향상되었으며, 초당 1107토큰을 생성하는 뛰어난 처리 속도를 자랑한다. 인셉션은 이 모델이 현재까지 출시된 확산 LLM 중 가장 큰 규모이자 성능이 뛰어난 모델이라고 강조했다. 높은 생성 품질을 유지하면서도 초저지연과 저비용 특성을 구현해 실무 환경에서 효율적인 활용이 가능할 것으로 기대된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 인셉션, 초당 1107토큰 생성하는 ‘머큐리 2.5’ 공개..."지능·비용 다 잡았다"
원문 보기 ↗