메뉴

#알리바바

TD
The Decoder • 2일 전
IMP 7

알리바바, Qwen Audio 3.1 출시… AI 오디오 가격 최대 95% 인하

알리바바의 AI팀 Qwen이 음성 인식(ASR), 음성 합성(TTS), 실시간 상호작용용 모델 5종으로 구성된 Qwen-Audio-3.1을 공개했습니다. 다국어·방언 인식 개선, 감정·환경음 감지, 텍스트 프롬프트만으로 감정과 스타일 제어, 동시 듣기·말하기 지원 등이 핵심 기능입니다. 아울러 TTS 약 70%, 실시간 약 85%, ASR 최대 95% 가격을 인하해 AI 오디오 시장에서 공격적인 경쟁에 나섰습니다.

음성인식 음성합성 알리바바
MP
MarkTechPost • 4일 전
IMP 6

알리바바, 이미지 생성·편집 통합 오픈 모델 '큐웬-이미지 2.1' 공개

알리바바 큐웬(Qwen) 팀이 70억 파라미터의 확산 트랜스포머 기반 이미지 생성·편집 모델 '큐웴-이미지 2.1'을 공개했습니다. 이 모델은 하나의 체크포인트로 텍스트-이미지 생성, 다중 참조 편집, 네이티브 RGBA 투명도 지원까지 처리하며, 프리픽스 KV 캐시를 통해 최대 10장의 참조 이미지를 활용한 편집 속도를 높였습니다. 가중치는 공개되어 있지만 상업적 사용은 별도 라이선스가 필요합니다.

알리바바 큐웬 오픈소스 모델
TD
The Decoder • 5일 전
IMP 7

알리바바 오픈 웨이트 Qwen-Image-2.1, 70억 파라미터로 폐쇄형 모델 능가 주장

알리바바 Qwen 팀은 이미지 생성·편집용 오픈 웨이트 모델 Qwen-Image-2.1을 공개했습니다. 70억 파라미터의 경량 모델임에도 자체 벤치마크에서 대부분의 폐쇄형 모델을 능가한다고 주장하며, RTX 3090급 소비자 GPU에서도 구동 가능합니다. 투명 이미지(RGBA) 생성과 최대 10장의 참조 이미지 활용이 특징이지만, 연구 라이선스로 상업적 사용은 별도 허가가 필요합니다.

알리바바 Qwen 이미지 생성
MP
MarkTechPost • 6일 전
IMP 7

알리바바 큐웬, 실시간 통역 모델 '큐웬3.8-라이브트랜슬레이트' 공개

알리바바 큐웨(Qwen) 팀이 새로운 인터리브(Interleave) 아키텍처 기반의 실시간 동시통역 모델 '큐웬3.8-라이브트랜슬레이트'를 공개했습니다. 평균 지연시간(LAAL)을 2.8초에서 2.3초로 단축했으며, 60개 언어를 이해하고 29개 언어로 말할 수 있습니다. 안정적인 음성 클로닝을 동반한 실시간 화자 구분, 동기화된 이중언어 표시, 이름·용어에 대한 긴 문맥 기반 모호성 해소 기능도 함께 제공됩니다.

실시간 통역 음성 번역 알리바바
MP
MarkTechPost • 8일 전
IMP 7

알리바바 Qwen, 에이전틱 오디오·영상 이해 특화 'Qwen3.8-Omni-Flash' 공개

알리바바의 Qwen 팀이 오디오와 영상을 이해하고 작업을 계획하며 도구를 호출할 수 있는 100만 토큰 컨텍스트의 옴니모달 모델 Qwen3.8-Omni-Flash를 공개했습니다. OmniVideoBench 벤치마크에서 약 45.7% 적은 토큰을 사용해 효율성을 크게 개선했으며, 에이전틱(Agentic) 음성·영상 이해와 도구 사용에 중점을 둔 것이 특징입니다.

다중모달 알리바바 Qwen
TD
The Decoder • 18일 전
IMP 7

알리바바 Qwen-Drive 1.0, 주행·설명 하나의 AI로…단, 설명과 조작이 안 맞을 수도

알리바바가 자율주행용 멀티모달 모델 Qwen-Drive 1.0을 공개했다. Qwen3.5-4B를 기반으로 3D 공간 지각 모듈과 경로 계획 전문가(Planning Expert) 모듈을 추가해, 하나의 모델로 주행 시스템과 콕핏 어시스턴트를 모두 수행한다. 시뮬레이션에서 차선 이탈률을 24%에서 12%로 줄였으나, 모델의 설명이 실제 주행 결정과 항상 일치하지는 않는 한계가 있다.

자율주행 멀티모달 알리바바
MP
MarkTechPost • 30일 전
IMP 8

알리바바 Qwen3.8-Flash-Next 공개, Qwen4 아키텍처 예고

알리바바 Qwen 팀이 오픈 웨이트 멀티모달 MoE 모델 'Qwen3.8-Flash-Next'(총 180B 파라미터, 토큰당 6B 활성)를 공개하며 Qwen4 아키텍처를 미리 선보였다. Gated DeltaNet과 희소 어텐션 하이브리드, N-gram 임베딩, Muon 옵티마이저 등 4가지 구조적 변화가 적용됐으며, Qwen3.7-Plus 대비 학습 비용 1/9을 주장한다. 단, FP8 체크포인트만 172.78 GiB로 자체 호스팅 요구 사양이 상당하다.

Qwen 알리바바 MoE
TD
The Decoder • 30일 전
IMP 8

알리바바, '궁극의 비용 효율' 노린 Qwen3.8-Flash-Next 공개

알리바바 Qwen 팀이 총 1,250억 파라미터 중 토큰당 60억만 활성화하는 멀티모달 MoE 모델 Qwen3.8-Flash-Next를 공개했습니다. 이 모델은 Qwen4의 아키텍처 프리뷰 성격으로, 학습 비용의 약 9분의 1로 기존 Qwen3.7-Plus를 능가하는 성능을 보이며 코딩·업무 작업에서 특히 강세를 보입니다. 입력 토큰 100만 개당 0.16달러의 공격적 가격 책정으로 OpenAI와 Anthropic에 대한 가격 압박을 더욱 높이고 있습니다.

알리바바 Qwen MoE
TD
The Decoder • 32일 전
IMP 7

알리바바 Wan3.0, 텍스트·이미지·문서로 최대 30초 AI 영상 생성

알리바바가 공개한 영상 생성 모델 Wan3.0 베타는 최대 30초 영상을 만들 수 있으며, 텍스트뿐 아니라 이미지, PDF, 웹페이지, 파워포인트까지 입력으로 활용할 수 있습니다. 얼굴이나 UI 왜곡 등 기존 AI 영상의 문제를 개선해 참조 자료의 디테일을 일관되게 유지하는 것이 강점이며, 영화 제작부터 마케팅, 자율주행·로봇 학습용 시뮬레이션까지 폭넓은 활용이 기대됩니다.

알리바바 Wan3.0 AI 영상 생성
TD
The Decoder • 50일 전
IMP 7

알리바바 큐웬3.8 맥스, 클로드와 동급...하지만 비용·환각 문제는 여전

알리바바의 최신 모델인 Qwen3.8 Max가 지능 지수에서 Claude Opus 4.8과 맞먹는 수준으로 성능이 크게 향상되었습니다. 하지만 과도한 토큰 처리량 증가로 인해 오히려 작업당 비용은 크게 상승했으며, 모르는 질문을 억지로 추측하면서 환각(Hallucination) 현상도 급증한 한계를 보입니다.

알리바바 큐웬 인공지능모델
TD
The Decoder • 53일 전
IMP 6

알리바바 신규 Qwen 모델, '일 대신 취미 즐기세요' 마케팅 화제

알리바바가 새로운 AI 모델 Qwen 3.8을 발표하면서 기존 빅테크들과는 다른 긍정적인 마케팅 전략을 취하고 있어 주목됩니다. 직장인들의 일자리를 위협하는 공포 마케팅 대신, AI가 대신 일하는 동안 인간은 취미를 즐기라는 부드러운 메시지를 내세우고 있습니다. 현재까지 AI가 노동 시장이나 생산성에 미친 실질적인 영향은 미미하지만, 상장 기업 입장에서 긍정적 이미지를 구축하기 위해 이러한 완화된 톤앤매너를 채택한 것으로 분석됩니다.

알리바바 큐웬 AI마케팅
TD
The Decoder • 54일 전
IMP 8

알리바바 2.4조 매개변수 Qwen3.8-Max 공개

알리바바가 장기적인 복잡 과제를 자율적으로 수행하는 2.4조 개 매개변수의 오픈 웨이트 언어 모델 Qwen3.8-Max를 공개했습니다. 이 모델은 16일간의 자율 소프트웨어 개발, 연구 논문 재현 및 성능 개선, 자동화된 칩 설계 등을 통해 서방 국가 최고 수준 모델들과 필적하는 성능을 입증했습니다. 모델 웨이트는 다음 주 공개될 예정입니다.

알리바바 대규모언어모델 오픈소스
MP
MarkTechPost • 54일 전
IMP 8

알리바바, 2.4조 매개변수 Qwen3.8-Max 공개

알리바바의 Qwen 팀이 2.4조 개의 매개변수를 가진 MoE(Mixture of Experts) 모델인 Qwen3.8-Max를 정식 출시했습니다. 이 모델은 텍스트, 이미지, 비디오 입력을 지원하며 최대 100만 토큰의 컨텍스트를 처리할 수 있고, 다음 주에 오픈 웨이트(Open Weights) 공개를 예고하여 AI 업계의 높은 관심을 끌고 있습니다.

알리바바 Qwen MoE 모델
TD
The Decoder • 67일 전
IMP 7

알리바바 '큐원 오디오 3.0', TTS 리더보드 1위 달성

알리바바의 새로운 텍스트 음성 변환(TTS) 모델인 Qwen-Audio-3.0-TTS-Plus가 인공지능 벤치마크 플랫폼의 오디오 리더보드에서 경쟁 모델들을 제치고 1위를 차지했습니다. 이 모델은 16개 국어를 지원하며, 태그를 통한 감정 표현과 뛰어난 목소리 복제 능력을 자랑하지만 생성 속도 측면에서는 경쟁사에 다소 뒤처진다는 특징이 있습니다.

알리바바 TTS 음성-합성
MP
MarkTechPost • 67일 전
IMP 7

알리바바 통이랩, 16개국어 지원 TTS 모델 출시

알리바바 통이( Tongyi ) 연구소가 실시간 상호작용용인 Flash와 고품질 생성용인 Plus, 두 가지 버전의 텍스트 음성 변환(TTS) 모델 'Qwen-Audio-3.0-TTS'를 출시했습니다. 이 모델들은 알리바바 클라우드를 통해 호스팅되는 API 형태로 제공되며, 현업 개발자들이 실제 서비스 환경에서 직면하는 다양한 문제(다국어 지원 등) 해결에 초점을 맞췄다는 점이 특징입니다.

알리바바 통이랩 텍스트음성변환
MP
MarkTechPost • 68일 전
IMP 8

알리바바, 2.4조 매개변수 Qwen3.8-Max 프리뷰 공개

알리바바의 Qwen 팀이 2.4조 개의 매개변수를 가진 멀티모달 MoE 모델인 Qwen3.8-Max-Preview를 공개했습니다. 해당 모델은 토큰(Token) 플랫폼 등에서 정가의 10% 가격으로 테스트가 가능하지만, 벤치마크 점수나 라이선스 등 핵심 스펙은 아직 공개되지 않아 기술적 검증이 필요한 상태입니다.

알리바바 Qwen AI모델
TD
The Decoder • 68일 전
IMP 8

알리바바 Qwen 3.8 공개, "Fable 5 다음으로 뛰어나"

알리바바가 2.4조 개 매개변수를 갖춘 최신 오픈 웨이트(open-weight) 모델인 Qwen 3.8을 공개했습니다. 이 모델은 특히 코딩 및 복잡한 데이터 분석 작업에서 기존 모델을 크게 앞지르며, 급부상하는 경쟁사 Moonshot AI의 Kimi K3 모델을 견제하는 전략적 목적을 띠고 있습니다. 아직 오픈 웨이트는 공개되지 않았으나 곧 풀릴 예정입니다.

알리바바 Qwen 오픈소스
TC
TechCrunch AI • 71일 전
IMP 8

애플 인텔리전스, 알리바바·바이두와 손잡고 중국 상륙

애플의 생성형 AI 서비스인 '애플 인텔리전스'가 알리바바와 바이두의 협력을 통해 중국 시장에 공식 출시될 예정입니다. 중국 당국의 규제 승인을 받은 이번 조치는 애플이 핵심 시장인 중국에서 AI 경쟁력을 확보하고 폰 판매고를 이어가는 데 매우 중요한 이정표가 됩니다. 알리바바의 통합 AI 모델인 큐원(Qwen)과 바이두의 AI 기능이 iOS, macOS 등 애플의 주요 운영체제에 결합되어 한국을 포함한 글로벌 빅테크들의 중국 AI 생태계 파트너십 양상을 보여줍니다.

애플 애플인텔리전스 알리바바
TC
TechCrunch AI • 72일 전
IMP 8

애플, 알리바바와 손잡고 중국서 AI 서비스 출시 승인

중국 당국의 규제 승인에 따라 애플의 생성형 AI '애플 인텔리전스'가 알리바바의 '큐원(Qwen)' 모델을 통합하여 중국 시장에 공식 출시됩니다. 이는 핵심 시장인 중국에서 AI 생태계를 본격 확보하려는 애플의 중요한 전략적 이정표로 평가받으며, 알리바바의 주가 동반 상승을 이끌고 있습니다.

애플 알리바바 애플인텔리전스
TC
TechCrunch AI • 83일 전
IMP 7

알리바바, 직원들의 Claude Code 사용 전면 금지

중국의 거대 기업 알리바바가 자사 직원들의 Anthropic Claude Code 사용을 금지하고 사내 도구인 Qoder 사용을 지시했습니다. 이는 Anthropic이 중국 업체의 모델 접근을 원천 차단하기 위해 비공식 접속을 막는 실험을 진행한 것과 맞물려 발생한 조치입니다. AI 기술 유출(증류) 방지 및 미중 기술 규제에 따른 기업의 보안 대응 양상을 보여주는 사례로 평가받습니다.

알리바바 Claude Code Anthropic
MP
MarkTechPost • 85일 전
IMP 7

알리바바 '페이지 에이전트' 자연어로 웹을 조종하다

알리바바가 자바스크립트 기반의 '페이지 에이전트(Page Agent)'를 공개했습니다. 이 에이전트는 스크린샷이나 멀티모달 모델 없이 웹 페이지의 DOM을 텍스트로 읽어들여 자연어 명령으로 클릭이나 타이핑 등의 웹 조작을 수행합니다. 백엔드 수정 없이도 기존 웹사이트에 쉽게 통합할 수 있어, 차세대 웹 자동화 및 인터페이스 제어 기술로서 의미가 큽니다.

알리바바 GUI-에이전트 웹-자동화
HN
Hacker News • 113일 전
IMP 8

알리바이, AI 기반 코드 리뷰 CLI 오픈소스 공개

알리바이 그룹이 사내 수만 명의 개발자를 통해 검증된 AI 코드 리뷰 CLI 도구를 오픈소스로 공개했습니다. 이 도구는 기존 범용 에이전트의 한계인 불안정한 품질과 위치 오류를 극복하기 위해, 엔지니어링 기반의 결정론적 하드 컨스트레인트와 LLM 에이전트의 동적 의사결정을 결합한 하이브리드 방식을 채택한 것이 특징입니다.

코드 리뷰 오픈소스 알리바바
MP
MarkTechPost • 116일 전
IMP 7

알리바바 Qwen3.7-Plus 공개

알리바바의 Qwen 팀이 자체 AI 플랫폼인 바이리안(Bailian)에 새로운 멀티모달 에이전트 모델인 Qwen3.7-Plus를 출시했습니다. 이 모델은 이미지와 비디오를 이해하는 시각 능력뿐만 아니라, 자가 프로그래밍 및 도구 호출(Tool Invocation) 기능을 탑재하여 독립적인 작업 수행 능력을 갖췄습니다. 이를 통해 복잡한 작업을 자율적으로 처리할 수 있는 고도화된 AI 에이전트 시장의 경쟁력이 한층 더 강화되었습니다.

알리바바 Qwen 멀티모달
TD
The Decoder • 126일 전
IMP 8

알리바바 AI, 35시간 자율 구동으로 자체 칩 코드 최적화

알리바바의 Qwen 팀이 장시간 자율 작업에 특화된 새로운 AI 모델 'Qwen3.7-Max'를 공개했습니다. 이 모델은 학습되지 않은 자체 반도체 칩 환경에서 35시간 동안 자율적으로 코드를 수정하여 기존 대비 평균 10배의 실행 속도 향상을 달성하며 뛰어난 코딩 에이전트 성능을 입증했습니다. 특히 자체 학습 과정에서 부정 행위를 감시하는 등 고도화된 AI 에이전트 시스템의 가능성을 보여준다는 점에서 중요하게 평가받습니다.

알리바바 Qwen3.7-Max 자율 AI 에이전트
LL
r/LocalLLaMA • 128일 전
IMP 7

큐원(Qwen), 270억 매개변수(27B) 모델 추가 공개 유력

오픈소스 AI 모델 분야에서 두각을 나타내고 있는 알리바바의 큐원(Qwen)이 270억(27B) 매개변수 규모의 새로운 모델을 출시할 가능성이 높습니다. 이는 기존 라인업의 빈자리를 채울 중요한 릴리즈로, AI 실무자들에게 오픈소스 기반의 강력한 중형급 모델 선택지를 제공할 것으로 보입니다. 정확한 출시 일정 및 로드맵은 현재 내부 조율 중인 것으로 전해집니다.

qwen llm 오픈소스
TD
The Decoder • 134일 전
IMP 8

알리바바 Qwen-Image-2.0, 압축률 2배 향상 및 생성 스텝 40→4 단축

알리바바가 발표한 'Qwen-Image-2.0' 기술 보고서에 따르면, 새로운 VAE(변이형 오토인코더) 도입으로 공간적 압축률을 16배로 2배 향상시키고, 트랜스포머 아키텍처 최적화를 통해 이미지 생성 스텝을 기존 40단계에서 단 4단계로 줄였습니다. 이를 통해 고품질의 복잡한 이미지를 훨씬 더 빠르고 적은 컴퓨팅 자원으로 생성할 수 있게 되어, 실무적인 이미지 생성 파이프라인의 효율성을 획기적으로 높였다는 점에서 중요합니다.

이미지 생성 알리바바 모델 아키텍처
TD
The Decoder • 153일 전
IMP 7

알리바바 Qwen3.6-27B, 더 큰 모델 능가하는 코딩 성능

알리바바가 270억 파라미터의 새로운 오픈소스 밀집(Dense) 언어 모델인 Qwen3.6-27B를 공개했습니다. 이 모델은 3,970억 파라미터의 거대한 이전 버전을 거의 모든 코딩 벤치마크에서 압도하며, 훨씬 가벼운 크기로도 뛰어난 성능을 발휘합니다. 개발자들은 복잡한 MoE 구조 없이도 강력한 코딩 및 멀티모달 추론 성능을 활용할 수 있게 되었습니다.

Qwen 오픈소스 코딩 벤치마크
MP
MarkTechPost • 156일 전
IMP 8

알리바바, 에이전트 코딩 397B급 뛰어넘는 27B 모델 공개

알리바바 큐웨인(Qwen) 팀이 27B(270억 파라미터) 크기의 오픈 웨이트 밀집(Dense) 언어 모델인 Qwen3.6-27B를 새롭게 발표했습니다. 이 모델은 에이전트 기반 코딩(Agentic Coding) 벤치마크에서 3970억 파라미터 규모의 초대형 MoE 모델을 능가하는 압도적인 성능을 보여줍니다. 특히 기존의 자기 주의 메커니즘(Self-attention)과 선형 주의(Linear attention)를 결합한 하이브리드 아키텍처를 채택해 실무 개발 효율성을 크게 높일 수 있어 주목받습니다.

알리바바 오픈소스 모델 코딩 에이전트
TD
The Decoder • 161일 전
IMP 8

알리바바 Qwen3.6, 구글 Gemma 4 능가

알리바바가 350억 파라미터의 새로운 오픈소스 AI 모델 'Qwen3.6-35B-A3B'를 공개했습니다. 이 모델은 Mixture-of-Experts 기술을 적용해 연산 비용을 줄이면서도 코딩 및 추론 벤치마크에서 구글의 Gemma 4를 압도했으며, 클로드 소네 4.5와도 대등한 성능을 발휘합니다. 사용자는 Qwen Studio, API, 또는 허깅페이스를 통해 즉시 이 모델을 활용할 수 있습니다.

알리바바 Qwen3.6 오픈소스 모델
LL
r/LocalLLaMA • 162일 전
IMP 6

알리바바 '큐웬 3.6-35B-A3B' 모델 공개

알리바바가 오픈소스 AI 커뮤니티에 350억 매개변수(35B) 규모의 새로운 언어 모델인 Qwen3.6-35B-A3B를 공개했습니다. 이 모델은 소스코드와 AI 허깅페이스(Hugging Face)를 통해 다운로드 및 활용이 가능합니다. 실무자들에게는 고성능 오픈소스 대안을 모색하거나 파인튜닝 기반으로 활용할 수 있는 중요한 기회가 될 것으로 보입니다.

알리바바 큐웬 오픈소스 모델