참고X
알리바바, 실시간 음성 모델 'Qwen-Audio-3.1-Realtime' 출시
발화 중 듣기 및 도구 사용이 가능한 실시간 음성 에이전트 구축 가능. API로 즉시 이용 가능.
요약
알리바바가 실시간 음성 상호작용에 특화된 새로운 모델인 Qwen-Audio-3.1-Realtime을 공개했습니다. 이 모델은 사용자와 대화하는 도중에도 상황을 듣고, 도구를 활용하며, 언제 말하고 멈춰야 할지 스스로 판단하는 기능을 갖췄습니다. 특히 배경 소음에 대한 불필요한 반응률을 이전 모델 대비 73%에서 13%로 크게 낮춰 사용자 편의성을 높였습니다. 사용자의 요구사항 변화에 유연하게 대응하고 자연스러운 대화를 처리하는 것을 목표로 설계되었습니다. 현재 개발자들은 API를 통해 해당 모델을 직접 사용할 수 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @mark_k: Alibaba just released Qwen-Audio-3.1-Realtime, a voice model built to do more than answer quickly. It can listen while speaking, u
원문 보기 ↗