메뉴
BL
MarkTechPost • 7일 전

SpaceXAI, 음성인식 정밀도 2배 개선한 'Grok Voice Transcribe 2.0' 출시

IMP
7/10
핵심 요약

SpaceXAI가 배치 및 스트리밍 오디오용 음성-텍스트 변환(Speech-to-Text) 모델 'Grok Voice Transcribe 2.0'을 출시했습니다. 19개 언어에서 짧은 구문 단어 오류율이 20.6%에서 6.8%로 대폭 감소했으며, 가격은 기존과 동일하게 배치 시간당 $0.10, 스트리밍 시간당 $0.20입니다. 동일한 비용으로 정확도가 크게 향상되어 음성 처리 서비스 구축 실무자에게 중요한 소식입니다.

번역된 본문

SpaceXAI가 배치 및 스트리밍 오디오를 위한 최신 음성-텍스트 변환 모델 'Grok Voice Transcribe 2.0'을 출시했다. 회사에 따르면 동일한 가격으로 버전 1.0 대비 두 배의 정확도를 자랑한다. 19개 언어에 걸친 짧은 구문 단어 오류율(word error rate)이 20.6%에서 6.8%로 낮아졌다. 가격은 배치 처리 시간당 0.10달러, 스트리밍 시간당 0.20달러로 유지된다. 이 모델은 오늘부터 Grok Voice API를 통해 이용할 수 있다.

원문 보기
원문 보기 (영어)
SpaceXAI has released Grok Voice Transcribe 2.0, its newest speech-to-text model for batch and streaming audio. The company says it is twice as accurate as version 1.0 at the same price. Short-phrase word error rate across 19 languages fell from 20.6% to 6.8%. Pricing stays at $0.10 per hour for batch and $0.20 for streaming. The model is available today through the Grok Voice API. The post SpaceXAI Releases Grok Voice Transcribe 2.0: A Speech-to-Text API Claiming 2x Accuracy Over 1.0 at $0.10 per Hour appeared first on MarkTechPost.