메뉴

영상 생성

30개 소식

AI 영상 생성 기술

AI 모델코딩 에이전트오픈소스이미지 생성영상 생성정책/규제비즈니스연구
HN
Hacker News • 1일 전
IMP 6

오퍼스 5.5, 설명 영상 제작에 탁월해

Claude Opus 5.5를 활용해 URL이나 프롬프트 하나만으로 편집 없는 MP4 설명 영상을 한 번의 실행으로 생성하는 도구가 공개되었습니다. 서버리스 에이전트가 웹페이지를 읽고 HTML로 영상을 '코드로 작성'한 뒤, 가상 시계 기반의 결정론적 렌더링으로 매번 동일한 결과를 출력하는 것이 핵심입니다. 비디오 생성 모델 없이 코드 렌더링 방식만으로 재현 가능한 영상을 만든다는 점이 주목할 만합니다.

Claude Opus 5.5 서버리스 에이전트 코드 기반 영상 생성
TD
The Decoder • 3일 전
IMP 6

배양 뉴런에서 얻은 소프트웨어 레이어, AI 영상 생성 5배 빠르고 80% 저렴

샌프란시스코 스타트업 The Biological Computing Co.(TBC)가 AWS와 손잡고 실제 신경세포 측정에서 도출한 '뉴럴 다이내믹스 어댑터'를 적용한 최초의 '뉴런 유래' 텍스트-to-비디오 모델을 출시한다고 발표했습니다. 뇌세포가 직접 연산하는 게 아니라, 4,096개 전극 칩 위에서 배양한 피질 뉴런의 신호 확산·소멸 패턴을 측정해 아주 작은 소프트웨어 모듈(기존 모델 대비 크기 0.1% 미만 증가)로 만들어 기존 확산 모델에 삽입하는 방식입니다. 이를 통해 기반 모델 대비 5배 빠르고 80% 저렴한 추론, 더 나은 품질을 목표로 하며, 현재는 조기 액세스 신청만 가능한 계획 단계입니다.

생체 컴퓨팅 텍스트-to-비디오 AWS
TD
The Decoder • 4일 전
IMP 7

바이트댄스, 시나리오부터 화면까지 AI 단막극 제작 플랫폼 '드라매직' 출시

바이트댄스가 대본 분석, 캐릭터 생성, 스토리보드, 영상 미리보기까지 전 과정을 아우르는 AI 단막극 제작 플랫폼 '드라매직(Dramagic)'을 출시했습니다. 중국에서는 2026년 1분기에만 약 12.8만 편의 숏드라마가 공개되었고 이 중 95%가 AI 생성으로, AI 영상 제작 비용이 기존의 약 10분의 1 수준으로 떨어지면서 시장이 급성장하고 있습니다. 다만 배우들이 해고 전 AI에 목소리와 초상권을 넘기도록 강요받는 등 고용 문제도 함께 대두되고 있습니다.

바이트댄스 AI영상생성 숏드라마
TD
The Decoder • 5일 전
IMP 7

Runway, 실시간 제어 가능한 AI 영상 생성 연구 공개

Runway가 프롬프트를 입력하고 기다리는 기존 방식 대신, 사용자가 말하는 대로 영상이 스트리밍되는 실시간 영상 생성 연구 결과를 공개했습니다. 회사의 첫 범용 세계 모델인 GWM-1을 기반으로 하며, 프레임 단위로 생성해 카메라 움직임이나 로봇 명령, 오디오로 제어할 수 있습니다. 대기 시간과 GPU 비용을 크게 줄일 수 있어 교육, 게임, 로보틱스 분야에서 활용이 기대되지만, 출시 일정은 아직 미정입니다.

Runway 실시간 영상 생성 세계 모델
GB
Google AI Blog • 16일 전
IMP 5

AI로 70년 부부의 사랑 이야기를 한 컷 한 컷 되살리다

구글 딥마인드(Google DeepMind)와 영화 제작진이 AI를 활용해 70년 넘게 결혼한 부부의 기억 속에만 존재하던, 기록되지 않은 과거 순간을 단편 다큐멘터리 'Love, Rendered'에서 재현했습니다. 이미지 복원 기술과 퍼포먼스 캡처(performance capture)를 결합해 노부부의 현재 습관과 몸짓을 젊은 시절의 모습에 입혀 진정성 있는 시각적 추억을 만들어냈습니다. 일반인도 Gemini 앱으로 가족 사진을 복원하고 색을 입힐 수 있습니다.

Google DeepMind 영상 생성 이미지 복원
MP
MarkTechPost • 27일 전
IMP 7

구글, 제미나이 옴니 1.1 플래시 출시…40초 장면 확장·4K 업스케일링 지원

구글이 네이티브 멀티모달 영상 생성·편집 모델의 프로덕션 업데이트인 제미나이 옴니 1.1 플래시(Gemini Omni 1.1 Flash)를 공개했습니다. 핵심 변화는 장면 확장 시 마지막 프레임 한 장 대신 최대 10초의 이전 컨텍스트를 참조하고, 첫·마지막 프레임을 고정해 카메라 움직임을 제어할 수 있으며, 참조용 영상 클립을 전달해 캐릭터 일관성을 유지할 수 있다는 점입니다.

구글 제미나이 영상생성
TD
The Decoder • 27일 전
IMP 8

AI 영상이 중국 연예산업 배우·라이버 대체已经开始

바이트댄스의 Seedance 2.0 출시 이후 AI 생성 영상이 중국 엔터테인먼트 산업에서 배우, 인플루언서, 라이브커머스 진행자들을 실제로 대체하고 있습니다. 2026년 1분기에 발표된 중국 쇼트드라마의 95%가 AI 생성물이었으며, AI 영상 제작비는 인간 배우를 쓸 때의 약 10% 수준입니다. 일부 배우는 해고 전에 자신의 목소리와 초상을 AI로 '증류'하도록 강요받고 있으며, AI 관련 노동 분쟁도 증가 추세입니다.

AI 영상 생성 중국 엔터테인먼트 ByteDance
HN
Hacker News • 29일 전
IMP 8

구글, 제미나이 옴니 1.1 플래시 출시

구글 딥마인드가 생성형 영상 모델 'Gemini Omni 1.1 Flash'의 프로덕션 준비 버전을 공개했습니다. 최대 40초까지 장면을 연장하고 시작·종료 프레임을 지정해 자연스러운 카메라 전환을 만들 수 있으며, 4K 업스케일링과 저해상도(360p) 프리뷰로 빠르고 저렴하게 프로토타이핑할 수 있습니다. 개발자는 Google AI Studio나 Gemini 엔터프라이즈 에이전트 플랫폼에서 API로 바로 사용할 수 있습니다.

제미나이 구글 딥마인드 생성형 영상
TD
The Decoder • 29일 전
IMP 6

구글 제미나이 옴니 1.1 플래시, AI 영상 생성 저렴·유연해진다

구글이 영상 생성 모델 '제미나이 옴니 플래시(Gemini Omni Flash)'를 1.1 버전으로 업데이트했습니다. 장면 확장 시 기존 영상 최대 10초를 분석해 시각적 일관성을 높였고, 스타일 참고 영상 업로드, 시작·종료 프레임 지정, 저렴한 360p 초안 모드 등이 추가됐습니다. 초당 0.03달러(360p)부터 0.30달러(4K)까지 단계별 과금으로 개발자 비용 부담이 크게 줄었습니다.

구글 제미나이 AI 영상 생성
HN
Hacker News • 30일 전
IMP 7

비디오 모델을 더 빠르고 잘 학습시키는 법

이 글은 이미지·비디오 생성 모델의 성능 향상이 아키텍처 변화가 아닌 데이터 개선(필터링, 어노테이션, 합성 데이터 생성)에서 비롯된다고 분석합니다. 특히 2024년 CPU 기반 전통적인 컴퓨터비전 알고리즘(PySceneDetect 등)으로 수백억 개의 이미지·비디오를 저비용으로 필터링한 실무 경험을 소개합니다. 자체 생성 모델을 학습시키려는 실무자에게 실용적인 가이드가 될 수 있습니다.

비디오 생성 데이터 필터링 디퓨전 모델
TD
The Decoder • 32일 전
IMP 7

알리바바 Wan3.0, 텍스트·이미지·문서로 최대 30초 AI 영상 생성

알리바바가 공개한 영상 생성 모델 Wan3.0 베타는 최대 30초 영상을 만들 수 있으며, 텍스트뿐 아니라 이미지, PDF, 웹페이지, 파워포인트까지 입력으로 활용할 수 있습니다. 얼굴이나 UI 왜곡 등 기존 AI 영상의 문제를 개선해 참조 자료의 디테일을 일관되게 유지하는 것이 강점이며, 영화 제작부터 마케팅, 자율주행·로봇 학습용 시뮬레이션까지 폭넓은 활용이 기대됩니다.

알리바바 Wan3.0 AI 영상 생성
TD
The Decoder • 39일 전
IMP 7

AI 영상 시장, 소라의 부진에서 벗어나 급성장

오픈AI '소라(Sora)' 발표 직후의 기대감이 꺾였던 AI 영상 시장이 할리우드 AI 스튜디오, 수십억 달러 규모 스타트업, 합성 인격 산업 등 완전한 상업 생태계로 재편되며 회복세를 보이고 있습니다. 넷플릭스는 2026년까지 1,000편 중 300편에 AI를 적용할 예정이며, Higgsfield는 연 매출 2천만 달러에서 7억 달러로 급성장해 기업가치 54억 달러를 기록했습니다. 제작비 절감 효과와 함께 배급·노동 갈등 등 새로운 산업 구도가 형성되는 중입니다.

AI 영상 할리우드 힉스필드
MP
MarkTechPost • 45일 전
IMP 8

LTX-2.5 공개: 로컬 환경에서 구동되는 차세대 영상 생성 모델

NVIDIA 하드웨어 가속을 지원하는 오픈 웨이트(Open Weights) 기반의 영상 생성 월드 모델, LTX-2.5가 공개되었습니다. 이 모델은 6.8초 길이의 영상과 네이티브 멀티샷(Native Multishot)을 지원하며, 출시일 당일부터 ComfyUI와 완벽하게 호환됩니다. 고성능 영상 제작 스택이 개인 데스크톱 환경에서도 구동될 수 있게 되었다는 점에서 실무자들에게 매우 중요한 의미를 갖습니다.

영상 생성 LTX-2.5 오픈소스
MP
MarkTechPost • 46일 전
IMP 7

ComfyUI API로 영상·오디오 생성 자동화하기

이 글은 ComfyUI를 헤드리스 백엔드(headless backend)로 활용하여 MiniMax-H3 멀티모달 파이프라인을 구축하는 방법을 설명합니다. 하드웨어 프로파일링부터 모델 다운로드, 동적 그래프 구성 및 영상·오디오 결합 디코딩까지 전 과정을 자동화하는 방법을 다루고 있어 실무 자동화에 유용합니다.

ComfyUI 멀티모odal 비디오 생성
TD
The Decoder • 51일 전
IMP 8

블랙포레스트랩스, FLUX 3 비디오 공개... 시드ance 2.0 능가

AI 기업 블랙포레스트랩스(Black Forest Labs)가 사운드가 포함된 최대 20초의 고화질 영상을 생성할 수 있는 'FLUX 3 Video' 모델을 정식 출시했습니다. 이 모델은 자체 평가 기준에서 경쟁 모델인 Seedance 2.0을 제치고 텍스트/이미지 투 비디오 부문 1위를 차지했습니다. 영상 생성 시 초 단위의 유료 과금제가 적용되며, 기본적으로 오디오 생성 기능이 포함되어 있습니다.

비디오 생성 인공지능 FLUX3
TD
The Decoder • 53일 전
IMP 8

중국 미니맥스 H3, 오픈 AI 비디오 모델 최초로 성능 1위 달성

중국의 AI 기업 미니맥스(MiniMax)가 공개한 비디오 생성 모델 'H3'가 오픈소스 모델 최초로 글로벌 AI 비디오 평가 순위 정상을 차지했습니다. 이 모델은 텍스트, 이미지, 오디오를 동시에 처리하여 입체 음향이 포함된 짧은 영상을 생성하며, 자체 데이터로 파인튜닝(미세조정)이 가능해 실무 적용 가치가 높습니다. 단, 고해상도 모듈 등 일부 핵심 기능은 비공개이며 연 매출 2,000만 달러 이하 기업에만 상업적 이용이 허용되는 라이선스 제약이 있습니다.

미니맥스 오픈소스 비디오 생성
TD
The Decoder • 55일 전
IMP 8

바이트댄스 '시드댄스 2.5', 오디오 내장 30초 영상 생성

바이트댄스가 비디오와 오디오를 한 번에 생성하는 새로운 AI 비디오 모델 '시드댄스(Seedance) 2.5'를 공개했습니다. 이 모델은 최대 30초 길이의 영상을 제작할 수 있으며, 구글의 제미나이 오mni 플래시(Gemini Omni Flash) 모델보다 뛰어난 길이와 확장성을 자랑합니다. 광고 및 영상 제작 실무자들은 이제 개별 클립을 이어 붙일 필요 없이 하나의 파이프라인을 통해 완성도 높은 단편 영화나 콘텐츠를 효율적으로 제작할 수 있게 되었습니다.

바이트댄스 AI 비디오 생성 시드댄스
TD
The Decoder • 64일 전
IMP 8

블랙 포레스트 랩스, 네이티브 오디오 영상 생성 최초 공개

독일 AI 기업 블랙 포레스트 랩스(Black Forest Labs)가 이미지, 비디오, 오디오를 동시에 학습하는 멀티모달 기반 모델 'Flux 3'를 공개했습니다. 이 모델은 최장 20초의 네이티브 오디오가 포함된 영상을 생성하며, 경쟁 모델들을 압도하는 성능을 보여줍니다. 또한 아우디(Audi) 등에 적용되는 로봇 공학용 비디오 액션 모델까지 선보이며 실제 산업 활용도를 높였다는 점에서 중요합니다.

멀티모달 비디오생성 오디오생성
HN
Hacker News • 66일 전
IMP 5

AI 애니메이션은 어떻게 만들어지는가

Z세대와 알파세대 타겟의 AI 애니메이션 제작 과정에서 가장 중요한 각색 단계의 실무 접근법을 공유합니다. 시청자의 몰입을 이끄는 핵심 요소 하나를 바탕으로 20분 분량의 에피소드를 압축하며, 기획과 집필에는 LLM을 배제하고 철저히 인간 작가진에 의존합니다.

AI 애니메이션 스토리 각색 작가진
TD
The Decoder • 67일 전
IMP 8

영화 '디스트릭트 9' 감독, AI로만 제작한 첫 단편 영화 공개

할리우드 감독 닐 블롬캠프가 AI 비디오 생성 모델(Seedance 2.0)만을 활용해 제작한 13분 분량의 SF 호러 단편 영화 '나이트본'을 공개했습니다. 이는 텍스트 프롬프트를 통해 프레임 단위로 연출한 작품으로, 그가 전통적 방식을 넘어 AI 제작 방식의 장편 영화 제작에 나서며 전용 스튜디오를 설립했다는 점에서 업계에 큰 반향을 일으키고 있습니다. 창작 산업 내 여전한 저작권 및 일자리 논란 속에서도 AI가 주요 영화 제작 도구로 자리 잡아가는 중요한 사례로 평가받습니다.

AI 비디오 생성 닐 블롬캠프 씬앤스 2.0
TD
The Decoder • 71일 전
IMP 8

넷플릭스 300편 AI 활용... 엔터테인먼트 제작 속도 혁신

넷플릭스가 약 300개의 작품 제작에 AI를 적극 활용하고 있다고 밝혔습니다. 주로 포스트프로덕션 단계에서 활용되며, 제작 기간을 절반으로 줄이고 비용을 획기적으로 절감하고 있습니다. 절감된 예산은 작품 축소가 아닌 더 많은 콘텐츠 제작에 재투자되며, AI가 창작자의 비전을 구현하는 혁신적인 도구로 자리 잡고 있습니다.

넷플릭스 AI비디오생성 엔터테인먼트
HN
Hacker News • 71일 전
IMP 7

100달러로 AI 뮤직비디오 제작: 클로드 vs GPT 모델 비교

오가니제이션에서 자율형 AI 에이전트가 예산 내에서 뮤직비디오를 직접 제작하는 실험을 진행했습니다. 뮤직비디오 생성, ffmpeg 편집, 최종 컷 조립까지 모든 과정을 모델이 자율적으로 수행했습니다. Claude Fable 5와 GPT-5.6 Sol 모델의 작업 방식, 비용 효율성, 도구 활용 방식의 차이를 비교한 실무자 관점의 중요한 벤치마크 결과입니다.

AI 에이전트 뮤직비디오 생성 비디오 생성
TC
TechCrunch AI • 71일 전
IMP 8

구글 비즈, 내 얼굴과 목소리로 AI 영상 제작 지원

구글은 업무용 프레젠테이션 툴이었던 '구글 비즈(Vids)'를 종합 영상 제작 플랫폼으로 전환한다고 발표했습니다. 사용자 셀카와 음성 녹음만으로 자신과 닮은 커스텀 디지털 아바타를 제작할 수 있으며, 멀티모달 AI 모델인 '제미니 옴니(Gemini Omni)'를 통해 사진과 텍스트를 결합해 영상을 쉽게 생성하고 편집할 수 있습니다. 이를 통해 헤이지엔(HeyGen)과 같은 기존 AI 영상 스타트업들과 본격적인 경쟁을 시작할 것으로 보입니다.

구글 비즈 AI 아바타 제미니 옴니
GB
Google AI Blog • 71일 전
IMP 8

구글 비즈(Google Vids) 업데이트: 텍스트 영상 생성 및 나만의 아바타 도입

구글의 프레젠테이션 및 영상 제작 도구인 '비즈(Vids)'가 '제미니 오니(Gemini Omni)'와 개인 아바타 기능을 도입하며 영상 제작 및 편집 기능을 대폭 강화했습니다. 이제 일상적인 언어(텍스트 프롬프트)만으로 고품질 영상을 쉽게 생성하고 편집할 수 있으며, 별도의 카메라 촬영 없이도 자신과 닮은 디지털 아바타를 생성해 영상에 출연시킬 수 있습니다.

구글 비즈 제미니 오니 AI 비디오 생성
TC
TechCrunch AI • 72일 전
IMP 7

AI 앱 'Reelful', 사진 보관함을 숏폼 영상으로 자동 변환

신규 iOS 앱 'Reelful'은 사용자의 사진 보관함에 있는 사진과 영상을 바탕으로, 프롬프트 입력 한 번이면 틱톡이나 인스타그램 릴스 형식의 완성된 숏폼 영상을 자동 제작해 줍니다. 사용자가 직접 복잡한 편집을 할 필요 없이 AI가 기획, 대본 작성, AI 성우(음성 복제) 적용은 물론 사진을 움직이는 영상으로 변환하는 작업까지 모두 수행합니다. 바쁜 창업자와 비즈니스 오너가 콘텐츠 제작에 드는 시간과 비용을 획기적으로 줄이며 온라인 브랜드를 쉽게 구축할 수 있도록 돕는 핵심적인 도구입니다.

AI 영상 생성 숏폼 콘텐츠 AI 에이전트
TD
The Decoder • 73일 전
IMP 8

AI 비디오 스타트업 픽스버스, 20억 달러 가치 평가

싱가포르 기반 AI 비디오 생성 스타트업 픽스버스(PixVerse)가 시리즈 C 투자 라운드를 연장하여 4억 3,900만 달러를 유치하며 20억 달러 이상의 기업 가치를 인정받았습니다. 바이트댄스 출신 창업자의 정교한 데이터 라벨링 노하우를 바탕으로 높은 기술력을 입증하며, 치열한 AI 비디오 생성 모델 경쟁 시장에서 새로운 강자로 부상하고 있습니다.

AI 비디오 생성 픽스버스 시리즈 C 투자
TC
TechCrunch AI • 74일 전
IMP 8

AI 비디오 스타트업 PixVerse, 4천억 투자 유치 및 2조 원 돌파

싱가포르 기반 AI 비디오 생성 스타트업 PixVerse가 시리즈 C 투자 라운드에서 총 4억 3,900만 달러를 유치하며 기업가치 20억 달러를 돌파했습니다. 이번 자금을 바탕으로 글로벌 시장 진출과 B2B 고객 확보에 나서며, 경쟁이 치열한 비디오 AI 시장에서 알리바이 등 대형 투자자들을 등에 업고 입지를 다질 예정입니다.

AI 비디오 생성 투자 유치 PixVerse
TC
TechCrunch AI • 79일 전
IMP 8

구글 포토, AI 영상 편집 도구 '비디오 리믹스' 추가

구글 포토가 텍스트나 사진 등 다양한 입력을 바탕으로 영상을 순식간에 변환해 주는 새로운 AI 기능 '비디오 리믹스'를 도입했습니다. 이는 복잡한 영상 편집 툴 없이도 모바일 환경에서 몇 번의 터치만으로 고품질 영상 제작을 가능하게 하여 구글 생태계의 활용도를 높이는 중요한 업데이트입니다. 해당 기능은 미국, 한국 등 일부 국가의 구글 AI 구독자를 대상으로 순차적으로 제공됩니다.

구글 포토 비디오 리믹스 생성형 AI
TD
The Decoder • 83일 전
IMP 8

할리우드, 바이트댄스 Seedance 사용 금지 요구하면서도 몰래 사용 중

바이트댄스의 AI 비디오 생성 도구 'Seedance'가 할리우드에서 저작권 침해 논란과 함께 뜨거운 화두다. 영화 협회(MPA)는 대규모 저작권 침해를 이유로 공식적으로 사용 중지를 요구했지만, 정작 현업에서는 현재 시장에서 가장 성능이 좋다는 평가를 받으며 '모르쇠' 방식으로 은밀히 사용되고 있다. 이는 최고의 기술력과 법적 리스크가 실무 현장에서 어떻게 충돌하는지 보여주는 중요한 사례다.

바이트댄스 AI 비디오 생성 할리우드
TD
The Decoder • 85일 전
IMP 8

중국 AI 비디오 플랫폼 클링, 홍콩 IPO 앞두고 2조 원 유치

콰이쇼우(Kuaishou)의 AI 비디오 생성 부서인 클링(Kling)이 홍콩 증시 상장을 준비하며 약 20억 달러(한화 약 2조 7천억 원)의 자금을 유치했습니다. 이번 투자에는 텐센트 등 주요 기업들이 참여했으며, 클링의 기업가치는 180억 달러로 급등했습니다. 이는 미니맥스와 지푸 AI 등 다른 중국 AI 기업들에 이어 홍콩 증시에 AI 기업 상장이 이어지는 중요한 흐름으로, 글로벌 AI 비디오 시장 경쟁이 더욱 심화될 것임을 시사합니다.

클링 콰이쇼우 AI_비디오_생성