메뉴
BL
MarkTechPost 8일 전

알리바바 통이랩, 16개국어 지원 TTS 모델 출시

IMP
7/10
핵심 요약

알리바바 통이( Tongyi ) 연구소가 실시간 상호작용용인 Flash와 고품질 생성용인 Plus, 두 가지 버전의 텍스트 음성 변환(TTS) 모델 'Qwen-Audio-3.0-TTS'를 출시했습니다. 이 모델들은 알리바바 클라우드를 통해 호스팅되는 API 형태로 제공되며, 현업 개발자들이 실제 서비스 환경에서 직면하는 다양한 문제(다국어 지원 등) 해결에 초점을 맞췄다는 점이 특징입니다.

번역된 본문

알리바바의 통이(Tongyi) 연구소가 상용 환경에 최적화된 텍스트 음성 변환(TTS) 시스템인 Qwen-Audio-3.0-TTS를 출시했습니다. 이 모델은 동일한 계열에서 파생된 두 가지 변형으로 제공됩니다. Flash 버전은 실시간 상호작용에 초점을 맞추고 있으며, Plus 버전은 고품질 음성 생성을 표적으로 합니다. 두 모델 모두 다운로드 가능한 가중치(weights) 형태가 아닌, 알리바바 클라우드 모델 스튜디오(Alibaba Cloud Model Studio)를 통해 호스팅되는 모델로 제공됩니다. 이번 출시는 실제 서비스 환경에서 개발자들이 부딪히는 네 가지 핵심 문제, 즉 더 폭넓은 [...] (해결)에 초점을 맞추고 있습니다.

'알리바바 통이랩, 16개 언어를 지원하는 플래시 및 플러스 등급의 호스팅 텍스트 음성 변환 모델 Qwen-Audio-3.0-TTS 출시'라는 제목의 해당 글은 마크테크포스트(MarkTechPost)에 처음 게재되었습니다.

원문 보기
원문 보기 (영어)
Alibaba’s Tongyi Lab has released Qwen-Audio-3.0-TTS, a production-oriented text-to-speech (TTS) system. The model ships in two variants from the same lineage. Flash targets real-time interaction. Plus targets high-quality generation. Both are delivered as hosted models through Alibaba Cloud Model Studio, not as downloadable weights. The release focuses on four things developers hit in production: broader […] The post Alibaba’s Tongyi Lab Releases Qwen-Audio-3.0-TTS, a Hosted Text-to-Speech Model in Flash and Plus Tiers Across 16 Languages appeared first on MarkTechPost.