← promppy_ 실시간 AI 뉴스
참고AI타임스

인셉션 랩스, 확산 언어모델 '머큐리 2.5' 공개... 초당 1107 토큰 처리

고속 추론에 최적화된 확산 LLM 등장. 실시간 생성 AI 서비스의 비용 및 속도 최적화 대안으로 고려할 만함.

요약

확산 언어모델(Diffusion LLM) 개발사 인셉션 랩스가 기존 LLM의 느린 응답 속도와 비용 문제를 개선한 새 모델 ‘머큐리 2.5(Mercury 2.5)’를 8일(현지시간) 공개했다. 머큐리 2.5는 이전 버전인 머큐리 2 대비 지능 성능이 40% 향상되었으며, 초당 1107토큰을 생성하는 뛰어난 처리 속도를 자랑한다. 인셉션은 이 모델이 현재까지 출시된 확산 LLM 중 가장 큰 규모이자 성능이 뛰어난 모델이라고 강조했다. 높은 생성 품질을 유지하면서도 초저지연과 저비용 특성을 구현해 실무 환경에서 효율적인 활용이 가능할 것으로 기대된다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 인셉션, 초당 1107토큰 생성하는 ‘머큐리 2.5’ 공개..."지능·비용 다 잡았다"

원문 보기 ↗

광고

다음 뉴스 →

중요미국, 딥시크·문샷 등 중국 AI 기업 6곳 '미국 기술 악의적 복제' 지목

증류 방식 IP 갈등 격화. 중국 오픈 모델을 서비스에 쓴다면 규제·법적 리스크 재점검 필요.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스