메뉴

영상 생성

30개 소식

AI 영상 생성 기술

AI 모델코딩 에이전트오픈소스이미지 생성영상 생성정책/규제비즈니스연구
TD
The Decoder 5일 전
IMP 8

블랙 포레스트 랩스, 네이티브 오디오 영상 생성 최초 공개

독일 AI 기업 블랙 포레스트 랩스(Black Forest Labs)가 이미지, 비디오, 오디오를 동시에 학습하는 멀티모달 기반 모델 'Flux 3'를 공개했습니다. 이 모델은 최장 20초의 네이티브 오디오가 포함된 영상을 생성하며, 경쟁 모델들을 압도하는 성능을 보여줍니다. 또한 아우디(Audi) 등에 적용되는 로봇 공학용 비디오 액션 모델까지 선보이며 실제 산업 활용도를 높였다는 점에서 중요합니다.

멀티모달 비디오생성 오디오생성
HN
Hacker News 7일 전
IMP 5

AI 애니메이션은 어떻게 만들어지는가

Z세대와 알파세대 타겟의 AI 애니메이션 제작 과정에서 가장 중요한 각색 단계의 실무 접근법을 공유합니다. 시청자의 몰입을 이끄는 핵심 요소 하나를 바탕으로 20분 분량의 에피소드를 압축하며, 기획과 집필에는 LLM을 배제하고 철저히 인간 작가진에 의존합니다.

AI 애니메이션 스토리 각색 작가진
TD
The Decoder 8일 전
IMP 8

영화 '디스트릭트 9' 감독, AI로만 제작한 첫 단편 영화 공개

할리우드 감독 닐 블롬캠프가 AI 비디오 생성 모델(Seedance 2.0)만을 활용해 제작한 13분 분량의 SF 호러 단편 영화 '나이트본'을 공개했습니다. 이는 텍스트 프롬프트를 통해 프레임 단위로 연출한 작품으로, 그가 전통적 방식을 넘어 AI 제작 방식의 장편 영화 제작에 나서며 전용 스튜디오를 설립했다는 점에서 업계에 큰 반향을 일으키고 있습니다. 창작 산업 내 여전한 저작권 및 일자리 논란 속에서도 AI가 주요 영화 제작 도구로 자리 잡아가는 중요한 사례로 평가받습니다.

AI 비디오 생성 닐 블롬캠프 씬앤스 2.0
TD
The Decoder 12일 전
IMP 8

넷플릭스 300편 AI 활용... 엔터테인먼트 제작 속도 혁신

넷플릭스가 약 300개의 작품 제작에 AI를 적극 활용하고 있다고 밝혔습니다. 주로 포스트프로덕션 단계에서 활용되며, 제작 기간을 절반으로 줄이고 비용을 획기적으로 절감하고 있습니다. 절감된 예산은 작품 축소가 아닌 더 많은 콘텐츠 제작에 재투자되며, AI가 창작자의 비전을 구현하는 혁신적인 도구로 자리 잡고 있습니다.

넷플릭스 AI비디오생성 엔터테인먼트
HN
Hacker News 12일 전
IMP 7

100달러로 AI 뮤직비디오 제작: 클로드 vs GPT 모델 비교

오가니제이션에서 자율형 AI 에이전트가 예산 내에서 뮤직비디오를 직접 제작하는 실험을 진행했습니다. 뮤직비디오 생성, ffmpeg 편집, 최종 컷 조립까지 모든 과정을 모델이 자율적으로 수행했습니다. Claude Fable 5와 GPT-5.6 Sol 모델의 작업 방식, 비용 효율성, 도구 활용 방식의 차이를 비교한 실무자 관점의 중요한 벤치마크 결과입니다.

AI 에이전트 뮤직비디오 생성 비디오 생성
TC
TechCrunch AI 12일 전
IMP 8

구글 비즈, 내 얼굴과 목소리로 AI 영상 제작 지원

구글은 업무용 프레젠테이션 툴이었던 '구글 비즈(Vids)'를 종합 영상 제작 플랫폼으로 전환한다고 발표했습니다. 사용자 셀카와 음성 녹음만으로 자신과 닮은 커스텀 디지털 아바타를 제작할 수 있으며, 멀티모달 AI 모델인 '제미니 옴니(Gemini Omni)'를 통해 사진과 텍스트를 결합해 영상을 쉽게 생성하고 편집할 수 있습니다. 이를 통해 헤이지엔(HeyGen)과 같은 기존 AI 영상 스타트업들과 본격적인 경쟁을 시작할 것으로 보입니다.

구글 비즈 AI 아바타 제미니 옴니
GB
Google AI Blog 12일 전
IMP 8

구글 비즈(Google Vids) 업데이트: 텍스트 영상 생성 및 나만의 아바타 도입

구글의 프레젠테이션 및 영상 제작 도구인 '비즈(Vids)'가 '제미니 오니(Gemini Omni)'와 개인 아바타 기능을 도입하며 영상 제작 및 편집 기능을 대폭 강화했습니다. 이제 일상적인 언어(텍스트 프롬프트)만으로 고품질 영상을 쉽게 생성하고 편집할 수 있으며, 별도의 카메라 촬영 없이도 자신과 닮은 디지털 아바타를 생성해 영상에 출연시킬 수 있습니다.

구글 비즈 제미니 오니 AI 비디오 생성
TC
TechCrunch AI 13일 전
IMP 7

AI 앱 'Reelful', 사진 보관함을 숏폼 영상으로 자동 변환

신규 iOS 앱 'Reelful'은 사용자의 사진 보관함에 있는 사진과 영상을 바탕으로, 프롬프트 입력 한 번이면 틱톡이나 인스타그램 릴스 형식의 완성된 숏폼 영상을 자동 제작해 줍니다. 사용자가 직접 복잡한 편집을 할 필요 없이 AI가 기획, 대본 작성, AI 성우(음성 복제) 적용은 물론 사진을 움직이는 영상으로 변환하는 작업까지 모두 수행합니다. 바쁜 창업자와 비즈니스 오너가 콘텐츠 제작에 드는 시간과 비용을 획기적으로 줄이며 온라인 브랜드를 쉽게 구축할 수 있도록 돕는 핵심적인 도구입니다.

AI 영상 생성 숏폼 콘텐츠 AI 에이전트
TD
The Decoder 14일 전
IMP 8

AI 비디오 스타트업 픽스버스, 20억 달러 가치 평가

싱가포르 기반 AI 비디오 생성 스타트업 픽스버스(PixVerse)가 시리즈 C 투자 라운드를 연장하여 4억 3,900만 달러를 유치하며 20억 달러 이상의 기업 가치를 인정받았습니다. 바이트댄스 출신 창업자의 정교한 데이터 라벨링 노하우를 바탕으로 높은 기술력을 입증하며, 치열한 AI 비디오 생성 모델 경쟁 시장에서 새로운 강자로 부상하고 있습니다.

AI 비디오 생성 픽스버스 시리즈 C 투자
TC
TechCrunch AI 15일 전
IMP 8

AI 비디오 스타트업 PixVerse, 4천억 투자 유치 및 2조 원 돌파

싱가포르 기반 AI 비디오 생성 스타트업 PixVerse가 시리즈 C 투자 라운드에서 총 4억 3,900만 달러를 유치하며 기업가치 20억 달러를 돌파했습니다. 이번 자금을 바탕으로 글로벌 시장 진출과 B2B 고객 확보에 나서며, 경쟁이 치열한 비디오 AI 시장에서 알리바이 등 대형 투자자들을 등에 업고 입지를 다질 예정입니다.

AI 비디오 생성 투자 유치 PixVerse
TC
TechCrunch AI 20일 전
IMP 8

구글 포토, AI 영상 편집 도구 '비디오 리믹스' 추가

구글 포토가 텍스트나 사진 등 다양한 입력을 바탕으로 영상을 순식간에 변환해 주는 새로운 AI 기능 '비디오 리믹스'를 도입했습니다. 이는 복잡한 영상 편집 툴 없이도 모바일 환경에서 몇 번의 터치만으로 고품질 영상 제작을 가능하게 하여 구글 생태계의 활용도를 높이는 중요한 업데이트입니다. 해당 기능은 미국, 한국 등 일부 국가의 구글 AI 구독자를 대상으로 순차적으로 제공됩니다.

구글 포토 비디오 리믹스 생성형 AI
TD
The Decoder 24일 전
IMP 8

할리우드, 바이트댄스 Seedance 사용 금지 요구하면서도 몰래 사용 중

바이트댄스의 AI 비디오 생성 도구 'Seedance'가 할리우드에서 저작권 침해 논란과 함께 뜨거운 화두다. 영화 협회(MPA)는 대규모 저작권 침해를 이유로 공식적으로 사용 중지를 요구했지만, 정작 현업에서는 현재 시장에서 가장 성능이 좋다는 평가를 받으며 '모르쇠' 방식으로 은밀히 사용되고 있다. 이는 최고의 기술력과 법적 리스크가 실무 현장에서 어떻게 충돌하는지 보여주는 중요한 사례다.

바이트댄스 AI 비디오 생성 할리우드
TD
The Decoder 26일 전
IMP 8

중국 AI 비디오 플랫폼 클링, 홍콩 IPO 앞두고 2조 원 유치

콰이쇼우(Kuaishou)의 AI 비디오 생성 부서인 클링(Kling)이 홍콩 증시 상장을 준비하며 약 20억 달러(한화 약 2조 7천억 원)의 자금을 유치했습니다. 이번 투자에는 텐센트 등 주요 기업들이 참여했으며, 클링의 기업가치는 180억 달러로 급등했습니다. 이는 미니맥스와 지푸 AI 등 다른 중국 AI 기업들에 이어 홍콩 증시에 AI 기업 상장이 이어지는 중요한 흐름으로, 글로벌 AI 비디오 시장 경쟁이 더욱 심화될 것임을 시사합니다.

클링 콰이쇼우 AI_비디오_생성
TD
The Decoder 35일 전
IMP 8

바이트댄스 시드댄스 2.5, AI 영상 생성 30초 벽을 깼다

바이트댄스가 '화산엔진(Volcano Engine)' 콘퍼런스에서 단일 클립으로 최대 30초의 영상을 생성하는 핵심 모델 '시드댄스(Seedance) 2.5'를 공개했습니다. 이 모델은 장면 전환과 템포 변화를 자연스럽게 구현하고 최대 50개의 참조 이미지와 오디오를 동시에 처리할 수 있어, 복잡한 영화 씬 제작에 매우 유용합니다. 이와 함께 기존 2.0 모델의 4K 지원, 저비용 언어 모델 '더우바오(Doubao) 2.1 Pro', 이미지 모델, 오디오 모델 등 총 5종의 새로운 AI 모델이 함께 발표되었습니다.

바이트댄스 시드댄스 AI비디오생성
TD
The Decoder 44일 전
IMP 8

마이크로소프트 '미라지', 잊지 않는 공간 기억력으로 비디오 생성 혁신

마이크로소프트와 여러 대학의 연구진이 발표한 새로운 비디오 세계 모델 '미라지(Mirage)'는 내부 잠재 공간(latent space)에 공간 기억을 저장하여 카메라가 길게 이동해도 장면의 구조가 일관되게 유지되도록 합니다. 기존 복잡한 3D 포인트 클라우드 방식을 건너뛰어 경쟁 모델 대비 최대 10.5배 빠른 속도와 55배 적은 메모리 사용량이라는 압도적인 효율성을 달성했습니다.

마이크로소프트 비디오 생성 공간 메모리
TC
TechCrunch AI 47일 전
IMP 7

인도 AI 스타트업 아바타르, 저렴하고 빠른 맞춤형 비디오 AI 공개

인도의 AI 스타트업 아바타르(Avataar)는 알리바바의 오픈소스 모델을 경량화해 인도의 문화적 맥락을 이해하는 초저가 비디오 생성 AI '바리야(Varya)'를 선보였습니다. 이 모델은 기존 모델 대비 10배 빠르고 20분의 1 수준의 저렴한 가격으로 제공되며, 인도 정부의 AI 플랫폼을 통해 오픈웨이트로 공개됩니다.

비디오 생성 AI 아바타르 인도 AI
TD
The Decoder 55일 전
IMP 7

xAI, 720p 이미지-비디오 변환 지원 '그록 이미지닌 1.5' 공개

일론 머스크의 AI 기업 xAI가 정지된 이미지 하나를 최대 720p 해상도의 짧은 동영상으로 변환해 주는 새로운 모델, '그록 이미지닌 비디오 1.5'를 프리뷰 버전으로 공개했습니다. 사용자는 텍스트 프롬프트를 통해 카메라 움직임과 분위기를 세밀하게 묘사할 수 있으며, 원본 이미지의 디테일과 조명을 유지한 채 장면이 자연스럽게 애니메이션화되는 것이 특징입니다. 이번 업데이트로 xAI는 Seedance, 구글 Veo 등 기존 비디오 AI 제공업체들과 직접적인 경쟁에 돌입하게 되었습니다.

xAI 이미지-비디오 변환 그록(Grok)
HN
Hacker News 61일 전
IMP 7

칸에서 '초청 상영'한 50만 달러 AI 영화의 진실

미국 AI 스타트업 힉스필드(Higgsfield)가 50만 달러를 들여 제작한 AI 장편 영화가 마치 공식 칸 영화제에서 초청 상영된 것처럼 마케팅하여 논란이 일었다. 실제 이 영화는 칸 영화제와는 별개의 상업 시장인 '영화시장(Marché du Film)'에서 유료로 상영된 것으로 확인되었으며, 이 사건은 과장된 AI 호프(Hype)가 어떻게 만들어지고 확산되는지를 보여주는 사례로 AI 업계의 윤리적 마케팅과 신뢰성에 대한 경각심을 일으키고 있다.

AI 영화 마케팅 논란 칸 영화제
AI
r/artificial 62일 전
IMP 8

더 이상 현실을 믿을 수 없다: AI가 완벽한 군중 씬을 생성하는 시대

AI가 수많은 군중과 대규모 공공 행사를 사실적으로 시뮬레이션할 수 있는 수준에 도달했습니다. 이제 중요한 것은 기술의 퀄리티 자체가 아니라, 사람들이 이를 창의적으로 활용하는 엄청난 속도입니다. 온라인상의 현실과 조작된 콘텐츠를 구분하기 점점 더 어려워질 것입니다.

딥페이크 생성형 AI 가짜 뉴스
SG
r/singularity 64일 전
IMP 9

새로운 제미나이 옴니, 경쟁작들을 압도하다

구글 딥마인드가 텍스트, 오디오, 비디오 등 모든 형태의 입력을 받아 고품질 비디오를 생성하고 자연어 대화로 편집할 수 있는 멀티모달 모델 '제미나이 옴니(Gemini Omni)'를 공개했습니다. 이 모델은 제미나이의 방대한 실세계 지식과 물리 법칙에 대한 이해를 바탕으로 단순한 사실적인 영상을 넘어 의미 있는 스토리텔링이 가능한 영상을 제작합니다. 실무자들에게 이는 복잡한 프롬프트 엔지니어링 없이도 아이디어를 시각화하고 일관된 영상을 제작할 수 있는 혁신적인 워크플로우를 제공한다는 점에서 매우 중요합니다.

구글 딥마인드 제미나이 옴니 비디오 생성
SG
r/singularity 66일 전
IMP 9

생성형 AI(클링), 실제 TV 및 영화 제작 본격 도입

할리우드 작품 'House of David'가 산업계 최초로 AI 비디오 생성 기술(클링)을 공식 도입하여 전 세계 4,400만 명의 시청자를 확보하며 아마존 프라임 비디오 미국 1위를 기록했습니다. 이는 생성형 AI가 단순 실험 단계를 넘어 상업용 방송 및 영화 제작 파이프라인에 본격적으로 편입되었음을 보여주는 중요한 이정표입니다.

AI 비디오 생성 클링 할리우드
SG
r/singularity 66일 전
IMP 6

AI로 제작한 '콘스탄티노폴리스 함락' 15분 시네마틱 영화

AI 영상 제작 기술을 활용해 1453년 콘스탄티노폴리스 함락을 다룬 15분 분량의 시네마틱 역사 영화가 제작되어 화제를 모으고 있습니다. 단순한 다큐멘터리가 아닌 실제 전쟁 영화 같은 몰입감을 선사하며, 테우토부르크 숲의 전투(36만 뷰), 비엔나 전투(10만 뷰) 등에 이어 AI 역사 영화 제작의 가능성을 입증했다는 점에서 의미가 깊습니다.

AI 영상 제작 역사 콘텐츠 시네마틱
OA
r/OpenAI 66일 전
IMP 6

다중 캐릭터 AI 모션캡처 실험 영상 'Talk'

사라 실킨(Sara Silkin)이 뛰어난 안무자 '지바로(Jibaro)'와 협업하여 다중 캐릭터 기반의 AI 모션캡처 실험 영상 'Talk'를 제작했습니다. AI 기술을 활용해 복잡한 캐릭터의 움직임을 자연스럽게 구현해 낸 것이 이번 프로젝트의 핵심입니다. 제작자는 댓글창을 통해 해당 영상을 완성할 수 있었던 구체적인 제작 과정과 기술적 디테일을 공유할 예정입니다.

AI 모션캡처 영상 제작 안무
WR
Wired AI 68일 전
IMP 7

구글 제미나이로 복제한 내 AI 아바타, 소름 돋도록 똑같다

구글 제미나이(Gemini) 앱의 신규 '아바타(Avatar)' 기능을 통해 사용자의 외모와 목소리를 닮은 AI 딥페이크 영상을 생성해 보았습니다. 단 5분 만에 얼굴 스캔을 통해 디지털 복제인간을 만들어냈으며, 실제와 소름 돋도록 유사한 퀄리티에 동시에 놀라움과 거부감을 느꼈습니다. 이 기능은 오픈AI 소라(Sora)와 유사하지만 본인의 아바타로만 영상을 제작할 수 있다는 강력한 안전장치를 두고 있다는 점이 특징입니다.

제미나이 구글 AI 아바타
HN
Hacker News 70일 전
IMP 8

구글 제미나이 옴니(Gemini Omni) 발표

구글이 텍스트, 이미지, 오디오 등 모든 형태의 입력을 조합해 자연어 대화만으로 영상을 생성하고 편집할 수 있는 멀티모달 AI 모델 '제미나이 옴니(Gemini Omni)'를 공개했습니다. 이 모델은 물리법칙이나 역사적 사실에 대한 세계 지식을 바탕으로 일관성 있는 스토리텔링이 가능하며, 복잡한 영상 편집 과정을 단계적인 대화를 통해 수행할 수 있다는 점이 가장 큰 특징입니다. 실무자 관점에서 프롬프트 가이드와 안전성 평제(Red Teaming)를 거쳐 배포되었으며, 영상 생성 및 편집 파이프라인의 혁신을 가져올 중요한 릴리즈입니다.

영상 생성 멀티모달 AI 제미나이 옴니
TC
TechCrunch AI 70일 전
IMP 8

구글 '제미나이 오mni': 이미지·음성·텍스트를 영상으로

구글이 '제미나이 오mni(Gemini Omni)' 모델을 발표하며 텍스트, 이미지, 오디오를 결합해 물리 법칙과 문맥을 이해하는 고품질 비디오를 생성하는 기능을 선보였습니다. 첫 모델인 '오mni 플래시'는 최대 10초의 영상을 만들 수 있으며, 개인화된 디지털 아바타와 딥페이크 방지용 워터마크 기능도 포함되어 있어 소비자 친화적인 멀티모달 AI 시장을 선도하려는 구글의 의도를 보여줍니다.

구글 제미나이 멀티모달
WR
Wired AI 70일 전
IMP 8

구글, 본인 딥페이크를 쉽게 만드는 신기능 공개

구글이 연례 개발자 회의인 I/O에서 AI 영상 및 이미지 생성 툴인 'Flow'에 자신의 외형을 그대로 구현한 '아바타(Avatar)' 기능을 추가했습니다. 새롭게 탑재된 'Omni Flash' 모델을 통해 사용자는 별도의 촬영 없이도 자신과 똑같이 생긴 AI 딥페이크를 영상 속에 자연스럽게 등장시킬 수 있습니다. 이는 차세대 콘텐츠 크리에이터를 위한 도구를 넘어, 자연어 기반의 에이전트 및 '바이브 코딩(Vibe Coding)'을 대중화하려는 구글의 포괄적인 AI 전략의 일환입니다.

구글 딥페이크 비디오 생성
SG
r/singularity 71일 전
IMP 5

제미나이 옴니(Gemini Omni)가 생성한 영상 공개

X(옛 트위터)에 '제미나이 옴니(Gemini Omni)' 모델을 통해 생성된 것으로 보이는 영상이 공유되었습니다. 게시자는 해당 영상의 실제 생성 출처를 첫 번째 답글에서 확인할 수 있다고 안내했습니다. 실무자들에게 멀티모달 AI의 영상 생성 역량 및 진위를 파악하는 데 중요한 참고 자료가 됩니다.

제미나이 영상 생성 멀티모달 AI
TC
TechCrunch AI 74일 전
IMP 8

영화 제작자 돕던 런웨이, 구글 제칠 차세대 AI 준비한다

AI 영상 생성 스타트업 런웨이(Runway)는 단순한 텍스트 기반 언어 모델을 넘어, 세상의 물리적 법칙을 시뮬레이션하는 '세계 모델(World Model)'을 AI의 차세대 발전 방향으로 삼고 구글 등 거대 기업과 경쟁하고 있습니다. 최근 첫 세계 모델을 출시하며 로봇 공학, 신약 개발 등 인류의 난제 해결을 위한 '디지털 우주 트윈' 구축에 나섰다는 점에서 산업계에 큰 파장을 일으킬 주요 행보로 평가받습니다.

런웨이 세계 모델 AI 영상 생성
SG
r/singularity 78일 전
IMP 7

유출된 제미나이 옴니 vs 곧 폐지되는 소라 2

최근 유출된 구글의 '제미나이 옴니(Gemini Omni)' 영상 생성 모델과 현재 API로만 제공되며 곧 완전히 폐지될 예정인 오픈AI의 '소라 2(Sora 2)'의 성능을 직접 비교한 글입니다. 작성자는 두 모델에 최대한 동일한 프롬프트를 입력하여 스파게티 식사 장면, 애니메이션 액션, 칠판 수식 증명 등의 영상을 생성했으며, 독자들에게 어느 모델의 결과물이 더 뛰어난지 평가를 요청하고 있습니다.

영상 생성 AI 제미나이 옴니 소라 2