MP
MarkTechPost • 24일 전
IMP 6
메타, 음성 인식·화자 구분 하나로 통합한 'Muse Voice Transcribe' 공개
메타 슈퍼인텔리전스 연구소(Meta Superintelligence Labs)가 스트리밍 음성 인식(ASR), 화자 분리(Diarization), 발화 종료 감지(Endpointing)를 단일 자기회귀(autoregressive) 모델로 통합한 'Muse Voice Transcribe'를 공개했습니다. 기존 음성 시스템이 세 개의 모델을 연결해 지연과 장애 지점을 키웠다면, 이 모델은 하나로 통합해 실시간 처리에 유리합니다.
음성인식 메타 실시간처리