메뉴
BL
MarkTechPost • 4일 전

알리바바, 이미지 생성·편집 통합 오픈 모델 '큐웬-이미지 2.1' 공개

IMP
6/10
핵심 요약

알리바바 큐웬(Qwen) 팀이 70억 파라미터의 확산 트랜스포머 기반 이미지 생성·편집 모델 '큐웴-이미지 2.1'을 공개했습니다. 이 모델은 하나의 체크포인트로 텍스트-이미지 생성, 다중 참조 편집, 네이티브 RGBA 투명도 지원까지 처리하며, 프리픽스 KV 캐시를 통해 최대 10장의 참조 이미지를 활용한 편집 속도를 높였습니다. 가중치는 공개되어 있지만 상업적 사용은 별도 라이선스가 필요합니다.

번역된 본문

알리바바의 큐웬(Qwen) 팀이 큐웬-이미지 2.1(Qwen-Image-2.1)을 공개했습니다. 이는 하나의 체크포인트로 텍스트-이미지 생성, 다중 참조 편집, 네이티브 RGBA 투명도 처리를 모두 지원하는 70억(7B) 파라미터 규모의 확산 트랜스포머(diffusion transformer)입니다. 프리픽스 KV 캐시(prefix KV cache) 기능 덕분에 최대 10장의 참조 이미지를 사용하는 편집 작업을 빠르게 수행할 수 있습니다. 모델 가중치는 공개되어 있지만, 상업적 활용에는 큐웬으로부터 별도의 라이선스를 받아야 합니다.

원문 보기
원문 보기 (영어)
Alibaba's Qwen team has released Qwen-Image-2.1, a 7B diffusion transformer that handles text-to-image generation, multi-reference editing, and native RGBA transparency in one checkpoint. A prefix KV cache speeds up edits with up to 10 reference images. The weights are public, but commercial use requires a separate license from Qwen. The post Alibaba Qwen Releases Qwen-Image-2.1: A 7B Open-Weight Model for Image Generation and Editing appeared first on MarkTechPost.