메뉴

#WER

HN
Hacker News • 8일 전
IMP 6

칸토(Canto): 실제 환경에 최적화된 음성 인식 모델

Wispr AI Lab이 실시간 받아쓰기용 음성 인식 모델 '칸토(Canto)'를 공개했습니다. 잡음, 저볼륨, 짧은 발화 등 실제 사용 환경의 받아쓰기 평가에서 Google, OpenAI, AssemblyAI, Deepgram 등 경쟁 모델 대비 최저 단어 오류율(WER)을 기록했습니다. 공개 벤치마크에서도 LibriSpeech 최저 오류율에并列했으며, 실시간 저지연 응용에 적합한 모델이라는 점이 의미 있습니다.

음성 인식 받아쓰기 Wispr Flow