BL
MarkTechPost • 3일 전
큐타이, 강화학습으로 음성 수학을 푸는 음성 네이티브 모델 'Voice of Reason' 공개
IMP 7/10
핵심 요약
프랑스 연구소 큐타이(Kyutai)가 GLM-4-Voice-9B 기반의 오픈 웨이트 음성 대 음성(speech-to-speech) 모델 'Voice of Reason' 2종을 공개했습니다. 지도 미세조정(SFT)과 강화학습(RL)을 통해 음성 기반 GSM8K 수학 정답률을 27.3%에서 77.1%로 끌어올렸으며, 전사(transcription)나 텍스트 LLM 없이 순수 음성만으로 추론합니다. 두 체크포인트는 허깅페이스에 공개되어 있고 H100 GPU 한 장으로 실행 가능합니다.
번역된 본문
큐타이(Kyutai)는 GLM-4-Voice-9B를 기반으로 구축된 두 개의 오픈 웨이트 음성 대 음성(speech-to-speech) 모델, 'Voice of Reason'을 공개했습니다. 지도 미세조정(SFT)과 강화학습(REINFORCEMENT LEARNING)을 적용해 음성으로 제시되는 수학 벤치마크 GSM8K의 정확도를 27.3%에서 77.1%까지 향상시켰습니다. 이 모델에는 전사(transcription) 단계가 없으며, 과정에 텍스트 LLM도 포함되지 않습니다. 두 체크포인트는 모두 허깅페이스(Hugging Face)에서 공개되어 있으며, H100 GPU 한 장으로 실행할 수 있습니다.
원문 보기 (영어)
Kyutai has released Voice of Reason, 2 open-weight speech-to-speech models built on GLM-4-Voice-9B. Supervised fine-tuning and reinforcement learning lift spoken GSM8K accuracy from 27.3% to 77.1%. There is no transcription step and no text LLM in the loop. Both checkpoints are on Hugging Face and run on a single H100.
The post Kyutai Releases Voice of Reason: A Speech-Native Model that Solves Spoken Math with Reinforcement Learning appeared first on MarkTechPost.