BL
MarkTechPost • 8일 전
알리바바 Qwen, 에이전틱 오디오·영상 이해 특화 'Qwen3.8-Omni-Flash' 공개
IMP 7/10
핵심 요약
알리바바의 Qwen 팀이 오디오와 영상을 이해하고 작업을 계획하며 도구를 호출할 수 있는 100만 토큰 컨텍스트의 옴니모달 모델 Qwen3.8-Omni-Flash를 공개했습니다. OmniVideoBench 벤치마크에서 약 45.7% 적은 토큰을 사용해 효율성을 크게 개선했으며, 에이전틱(Agentic) 음성·영상 이해와 도구 사용에 중점을 둔 것이 특징입니다.
번역된 본문
알리바바의 Qwen3.8-Omni-Flash는 오디오와 영상을 이해하고, 작업을 계획하며, 도구를 호출할 수 있는 모델로, OmniVideoBench에서 약 45.7% 적은 토큰을 사용하는 것으로 보고되었습니다.
이 글 '알리바바 Qwen, 에이전틱 오디오·영상 이해 및 도구 사용 중심의 100만 컨텍스트 옴니모달 모델 Qwen3.8-Omni-Flash 출시'는 MarkTechPost에 처음 게재되었습니다.
원문 보기 (영어)
Alibaba's Qwen3.8-Omni-Flash understands audio and video, plans tasks, calls tools, and reports about 45.7% fewer tokens on OmniVideoBench.
The post Alibaba Qwen Releases Qwen3.8-Omni-Flash: A 1M-Context Omni-Modal Model Built Around Agentic Audio-Video Understanding and Tool Use appeared first on MarkTechPost.