속보AI타임스
OpenAI, 전이중 음성 모델 'GPT-Live-1' API 출시
STT·추론·TTS를 단일 모델로 통합해 지연 최소화. 음성 상담·예약 에이전트 아키텍처 재설계 검토 필요.
요약
오픈AI가 10일(현지시간) 사람과 실시간 대화가 가능한 전이중(full-duplex) 음성 모델 'GPT-라이브-1(GPT-Live-1)'을 API로 공식 출시했다. 기존의 복잡한 음성인식, 추론, 음성합성 과정을 하나의 모델로 통합해 대화 지연 시간을 획기적으로 줄였다. 이번 API 출시를 통해 개발자들은 지연 없는 자연스러운 소통이 가능한 전화 상담이나 예약용 음성 에이전트를 더 쉽게 구현할 수 있게 됐다. 실시간으로 상대방의 말을 들으면서 동시에 응답할 수 있어 대화의 끊김 없는 처리가 가능하다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 오픈AI, 전이중 음성 모델 'GPT-라이브-1' API 출시..."실시간 대화 에이전트 구현"
원문 보기 ↗