메뉴

#실시간 스트리밍

TD
The Decoder 53일 전
IMP 8

0.4초마다 침묵과 발언을 결정하는 오픈소스 음성 AI

중국, 홍콩, 싱가포르 연구진이 대화, 번역, 전사, 일상 소리 인식을 하나로 통합한 새로운 오픈소스 음성 AI 모델을 발표했습니다. 이 모델은 오디오 스트림을 0.4초 단위로 나누어 실시간으로 청취와 발화를 병렬 처리하며, 반응 대기 시간을 최소화합니다. 결과적으로 최신 상용 모델들을 능가하는 주변 소리 탐지 및 처리 능력을 보여줍니다.

음성 AI 실시간 스트리밍 오픈소스 모델