BL
MarkTechPost • 47일 전
엔비디아, 0.45초 지연 실시간 음성 대화 AI 모델 공개
IMP 7/10
핵심 요약
엔비디아가 약 448ms(0.448초)의 저지연으로 실시간 통화가 가능한 오픈소스 풀 듀플렉스 음성 대화 AI '네모트론랩스 보이스챗 11B(NemotronLabs VoiceChat 11B)'를 공개했습니다. 이 모델은 대화 중 끊김 없이 즉각적으로 반응하며 외부 도구를 실시간으로 호출(Live Tool Calling)할 수 있어, 향후 자연스러운 반응 속도가 필수적인 고성능 실시간 음성 비서 및 AI 상담원 구축에 매우 유용하게 활용될 전망입니다.
번역된 본문
엔비디아(NVIDIA)가 448 밀리초(ms)의 저지연 및 외부 도구 실시간 호출(Live Tool Calling) 기능을 갖춘 오픈소스 기반의 풀 듀플렉스(full-duplex) 음성 대화 모델인 '네모트론랩스 보이스챗 11B(NemotronLabs VoiceChat 11B)'를 출시했습니다.
'엔비디아, 약 450ms의 빠른 응답 속도와 실시간 도구 호출을 지원하는 오픈 풀 듀플렉스 음성 대화 모델 네모트론랩스 보이스챗 11B 출시'라는 제목의 해당 기사는 MarkTechPost를 통해 가장 먼저 공개되었습니다.
원문 보기 (영어)
NVIDIA releases NemotronLabs VoiceChat 11B, an open full-duplex speech-to-speech model with 448 ms latency and live tool calling.
The post NVIDIA Releases NemotronLabs VoiceChat 11B: An Open Full-Duplex Speech-to-Speech Model with ~450 ms Turn-Taking and Live Tool Calling appeared first on MarkTechPost.