← promppy_ 실시간 AI 뉴스
참고X

Meta, 실시간 오디오 인식 모델 'Muse Voice Transcribe' 발표

실시간 스트리밍 ASR 및 20명 이상의 화자 분리 성능이 뛰어나며, 벤치마크 1위를 기록했습니다.

요약

Meta Superintelligence Labs가 실시간 음성 인식 모델인 Muse Voice Transcribe를 공개했다. 이 모델은 실시간 스트리밍 ASR(자동 음성 인식)과 20명 이상의 화자를 구분하는 다이어라이제이션(diarization), 엔드포인팅 기능을 제공한다. 다국어를 지원하며 자연스러운 코드 스위칭이 가능하고, 언어와 키워드, 문맥 바이어싱을 통해 인식 정확도를 높였다. 특히 Artificial Analysis의 스트리밍 음성 인식 성능 평가와 공개 다이어라이제이션 벤치마크에서 모두 1위를 기록했다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 @AIatMeta: Introducing Muse Voice Transcribe, the first real-time audio perception model from Meta Superintelligence Labs. Muse Voice Transcr

원문 보기 ↗
다음 뉴스 →

중요Gemini, 토큰 88% 절감하는 에이전트형 영상 분석 기능 출시

Gemini Flash 계열에서 영상 분석 토큰 88%·비용 66% 절감. 영상 처리 서비스라면 agentic 모드 적용 검토.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스