메뉴

이미지 생성

30개 소식

AI 이미지 생성 기술

AI 모델코딩 에이전트오픈소스이미지 생성영상 생성정책/규제비즈니스연구
MP
MarkTechPost • 4일 전
IMP 6

알리바바, 이미지 생성·편집 통합 오픈 모델 '큐웬-이미지 2.1' 공개

알리바바 큐웬(Qwen) 팀이 70억 파라미터의 확산 트랜스포머 기반 이미지 생성·편집 모델 '큐웴-이미지 2.1'을 공개했습니다. 이 모델은 하나의 체크포인트로 텍스트-이미지 생성, 다중 참조 편집, 네이티브 RGBA 투명도 지원까지 처리하며, 프리픽스 KV 캐시를 통해 최대 10장의 참조 이미지를 활용한 편집 속도를 높였습니다. 가중치는 공개되어 있지만 상업적 사용은 별도 라이선스가 필요합니다.

알리바바 큐웬 오픈소스 모델
TD
The Decoder • 5일 전
IMP 7

알리바바 오픈 웨이트 Qwen-Image-2.1, 70억 파라미터로 폐쇄형 모델 능가 주장

알리바바 Qwen 팀은 이미지 생성·편집용 오픈 웨이트 모델 Qwen-Image-2.1을 공개했습니다. 70억 파라미터의 경량 모델임에도 자체 벤치마크에서 대부분의 폐쇄형 모델을 능가한다고 주장하며, RTX 3090급 소비자 GPU에서도 구동 가능합니다. 투명 이미지(RGBA) 생성과 최대 10장의 참조 이미지 활용이 특징이지만, 연구 라이선스로 상업적 사용은 별도 허가가 필요합니다.

알리바바 Qwen 이미지 생성
HN
Hacker News • 6일 전
IMP 3

AI가 만든 이미지를 구별할 수 있을까?

실제 사진과 AI 생성 이미지를 구별하는 60초 짜리 게임 형식의 인터랙티브 콘텐츠입니다. 이미지당 10초 안에 진짜 사진인지 AI 생성인지 판단해야 하며, 3연속 정답 시 콤보가 해금되는 등 게임적 요소가 있습니다. 생성형 AI 이미지의 사실성이 눈에 띄게 향상됨에 따라 인간의 육안 판별력이 얼마나 한계에 부딪히는지 체험하게 해주는 콘텐츠입니다.

AI 생성 이미지 딥페이크 이미지 판별
HN
Hacker News • 7일 전
IMP 4

AI 생성 포스터, 꼭 끔찍할 필요는 없다

AI가 생성한 지역 행사 포스터들이 대부분 똑같한 파스텔 톤의 '공예 박람회' 스타일로 만들어져 반복 노출로 인한 피로감을 준다는 문제의식에서 출발한 글입니다. 저자는 ChatGPT에 명시적으로 다른 디자인 스타일(바우하우스, 스위스 스타일 등)을 요청하면 훨씬 차별화된 결과물을 얻을 수 있음을 실험으로 보여줍니다. 핵심은 AI의 기본 스타일에 맡기지 않고 구체적인 스타일 지정과 피드백을 활용하는 프롬프팅 능력입니다.

AI 이미지 생성 프롬프팅 디자인
GB
Google AI Blog • 7일 전
IMP 5

구글 플로우로 패션의 미래를 함께 만들다

구글의 Envisioning Studio가 뉴욕 패션위크를 앞두고 패션 디자이너 제인 웨이드와 세르지오 허드슨과 협업해 Google Flow로 맞춤형 AI 도구를 제작했습니다. '스타일링 스위트'는 가상 모델에서 헤어·메이크업·의상을 큐레이션해 실물 샘플 제작 전 룩을 완성할 수 있게 했고, '런웨이 시각화' 도구는 예산 내에서 무대 조명과 소품을 시뮬레이션할 수 있게 했습니다. 이제 코딩 없이 자연어만으로 Google Flow에서 자신만의 디자인 도구를 만들 수 있습니다.

구글 플로우 생성형 AI 패션 디자인
HN
Hacker News • 9일 전
IMP 3

커피숍 주인, AI로 메뉴 포스터 만들었다가 분노한 DM 세례 받아

한 커피숍 주인이 AI(인공지능)로 메뉴 포스터를 제작했다가 고객들로부터 항의 메시지(DM)를 받은 사건을 Business Insider가 보도했습니다. AI 생성 콘텐츠에 대한 소비자들의 부정적 반응이 현실적인 비즈니스 리스크임을 보여주는 사례입니다.

AI 생성 이미지 비즈니스 소비자 반응
HN
Hacker News • 9일 전
IMP 7

텍스트-이미지 모델 학습 3.6배 빠르게 하기

Linum 개발팀이 VAE를 제거하고 압축을 DiT 자체에 통합한 JiT 기반의 새로운 인코더-디코더 구조(JiT-DDT)를 발표했습니다. 이를 통해 GPU 시간을 3.6배 절감하면서도 픽셀 수 4배의 이미지를 생성할 수 있었고, 코드와 모델 가중치는 Apache 2.0 라이선스로 공개되었습니다.

텍스트-이미지 생성 확산 모델 학습 효율화
TD
The Decoder • 16일 전
IMP 7

챗GPT 이미지 2.5: 더 빠르고 정확하지만 모두에게 같지는 않다

OpenAI가 ChatGPT Images 2.5를 출시하며 더 선명한 디테일, 정밀한 편집, 최대 50% 빨라진 생성 속도를 약속했습니다. 두 모델(GPT-Image-2.5 Flare와 Sunburst)이 API에 공개되었으며, 요청한 부분만 수정하는 편집 기능이 크게 개선되었습니다. 다만 품질 등급별 가격 차이가 크고, ChatGPT 사용자에게 두 모델이 어떻게 배분되는지는 불분명합니다.

OpenAI 이미지 생성 ChatGPT
HN
Hacker News • 17일 전
IMP 8

ChatGPT 이미지 2.5 출시

OpenAI가 더 선명한 디테일, 최대 50% 빨라진 생성 속도, 정밀한 편집 기능을 갖춘 새 이미지 모델 'ChatGPT Images 2.5'를 공개했습니다. 참조 사진 기반 충실도와 다중 턴 편집 일관성이 크게 향상됐으며, 개발자용으로는 GPT-Image-2.5 Flare와 Sunburst 두 모델이 API에 추가됐습니다. 채팅 내 스케치 도구, 템플릿, 이미지 댓글 등 창작 워크플로우 기능도 함께 도입됐습니다.

ChatGPT 이미지 생성 GPT-Image
TC
TechCrunch AI • 22일 전
IMP 5

AI 생성 메뉴판의 '똑같음' 문제

레스토랑과 카페 메뉴에 생성형 AI 일러스트가 확산되면서 모든 이미지가 지나치게 매끄럽고 대동소이한 미학을 보이는 문제가 나타나고 있다. 이는 AI 모델이 유사한 스타일의 대량 데이터로 학습되면서 ' convergence(수렴)' 현상을 일으키기 때문이며, AI 생성물이 다시 학습 데이터로 유입되면 모델 붕괴(model collapse) 위험도 커진다.

생성형AI 모델붕괴 이미지생성
TC
TechCrunch AI • 24일 전
IMP 7

구글, 캔바 대항마 '구글 픽스' 공개—디자인 대신 프롬프트

구글이 AI 이미지 생성·편집 도구 '구글 픽스(Google Pics)'를 출시해 캔바(Canva)와 어도비 익스프레스가 장악한 창작 디자인 시장에 진출합니다. 나노 바나나(Nano Banana) 이미지 생성 모델 기반으로, 워크스페이스 고객과 Google AI Pro/Ultra 구독자에게 순차 제공되며 Docs와 Slides에 먼저 통합됩니다. 기존 디자인 도구와 달리 처음부터 직접 디자인하는 것이 아니라 프롬프트로 생성하는 방식이라는 점이 핵심 차이입니다.

구글 이미지생성 나노바나나
GB
Google AI Blog • 24일 전
IMP 7

구글 Pics, 워크스페이스에서 손쉬운 AI 이미지 생성·편집

구글이 AI 이미지 생성·편집 도구 '구글 Pics'를 출시했습니다. 나노 바나나(Nano Banana) 모델 기반으로, 텍스트 프롬프트만으로 이미지를 생성하고 객체 분리, 이미지 내 텍스트 편집·번역 등 정밀한 편집이 가능합니다. 슬라이드, 닥스, 드라이브에 직접 통합되어 앱을 전환하지 않고도 작업할 수 있으며, Google AI Pro/Ultra 구독자와 대부분의 Workspace 비즈니스 고객에게 순차 제공됩니다.

구글 픽스 이미지 생성 나노 바나나
TD
The Decoder • 36일 전
IMP 6

오픈AI GPT-Image-2, 배경 없는 이미지 생성 지원

오픈AI가 GPT-Image-2 API에 투명 배경 생성 기능을 프리뷰로 공개했습니다. 생성 단계에서 알파 채널을 직접 반영하기 때문에 기존 배경 제거 방식보다 투명 유리나 가는 섬유 같은 까다로운 영역에서 더 좋은 결과를 냅니다. 전자상거래 제품 이미지, 발표자료 다이어그램, 아이콘·스티커 등 디자인 요소, 굿즈 아트워크 등에 활용할 수 있습니다.

OpenAI GPT-Image-2 이미지 생성
MP
MarkTechPost • 45일 전
IMP 7

샤오미, 객체 제거 평가지표 PROVE 공개

최근 디퓨전(Diffusion) 기반 객체 제거 AI 모델은 그림자나 반사광까지 자연스럽게 복원하는 수준으로 발전했지만, 기존 평가 지표들은 이를 제대로 평가하지 못하고 있습니다. 이에 샤오미 연구팀이 인간의 시각적 인식을 반영한 새로운 평가 지표(RC-S, RC-T)와 실제 비디오 데이터셋을 포함한 'PROVE' 벤치마크를 공개했습니다.

샤오미 객체제거 벤치마크
TD
The Decoder • 49일 전
IMP 8

엑스AI 이미지 2.0, 오픈AI 모델 제치고 벤치마크 2위

엑스AI(xAI)가 새로운 이미지 생성 모델인 '이매진 이미지 2.0(Imagine Image 2.0)'을 공개했습니다. 이 모델은 이미지 수정 및 텍스트-투-이미지 Arena 벤치마크에서 오픈AI의 GPT-Image-2에 이어 전 세계 2위를 차지할 만큼 뛰어난 성능을 입증했습니다. 기존보다 정교해진 지시사항 준수 능력과 함께, 부분 수정 및 전문적인 비디오 제작 기획을 위한 다양한 편집 툴을 제공하여 실무 작업 효율을 높인다는 점이 핵심입니다.

xAI 이미지 생성 오픈AI
HN
Hacker News • 51일 전
IMP 6

가우시안으로 그림 그리기

단순한 기계적 이미지 변환을 넘어, 이미지의 엣지(Edge) 정보를 활용해 붓터치 방향과 길이를 결정하는 디지털 페인팅 알고리즘을 소개합니다. 2D 가우시안 스플래팅(splatting)과 엣지 검출 기술을 결합하여, 기존의 느리고 결과물이 그림처럼 보이지 않던 경사 하강법(Gradient Descent) 방식의 한계를 극복했습니다.

디지털 페인팅 가우시안 스플래팅 이미지 처리
HN
Hacker News • 52일 전
IMP 5

AI 생성 이미지가 블로그 글을 안 읽게 만드는 이유

개인 블로그에 사용된 어색한 AI 생성 이미지가 독자의 신뢰를 떨어뜨리고 오히려 글을 읽기를 방해한다는 독자의 비판이 담겨 있습니다. 개인 블로거라면 완벽하지 않더라도 직접 그린 그림을 사용해 진정성 있는 인간의 생각을 담아내야 한다는 것이 핵심입니다. 이는 콘텐츠 소비에 있어 '인간의 진정성'이 AI의 완성도보다 더 중요해지는 시대적 변화를 시사합니다.

AI 이미지 블로깅 독자 신뢰
HN
Hacker News • 54일 전
IMP 4

나만의 AI 벤치마크: '합스부르크 턱을 가진 개구리 SVG 그려줘'

이 글은 Anthropic의 최신 AI 모델(claude-opus-5)이 복잡하고 특정적인 개념을 코드로 얼마나 잘 구현하는지 테스트하는 벤치마크 결과를 공유합니다. 프롬프트 요청대로 합스부르크 왕가의 특징적인 신체적 징후인 '돌출된 아래턱'을 가진 개구리 SVG 코드를 완벽하게 생성했습니다. 특히 AI가 단순한 도형을 넘어 해부학적 맥락에 맞는 주석과 디테일한 시각적 요소를 코드로 구현해 내는 능력을 보여줍니다.

인공지능 클로드 SVG생성
TD
The Decoder • 66일 전
IMP 8

알리바이 Qwen-Image-3.0 출시, 10픽셀 텍스트 완벽 렌더링

알리바이 Qwen 팀은 정보 밀집형 인포그래픽과 신문 레이아웃을 한 번에 생성하는 실용적인 이미지 생성 모델 'Qwen-Image-3.0'을 공개했습니다. 이 모델은 4,500 토큰의 프롬프트를 처리하여 10픽셀 수준의 작은 텍스트와 수학 공식(LaTeX)을 오차 없이 구현하며 12개 언어를 지원합니다. 현재는 초대받은 사용자만 API를 통해 접근할 수 있으며, 향후 Qwen Chat 등에 통합될 예정입니다.

알리바이 Qwen-Image-3.0 이미지 생성
TC
TechCrunch AI • 67일 전
IMP 6

어도비, AI로 사진을 평가하고 편집 제안하는 카메라 앱 기능 추가

어도비가 실험적인 iOS 카메라 앱인 '프로젝트 인디고(Project Indigo)'에 사진을 평가하고 편집 방향을 제안하는 새로운 AI 기능을 추가했습니다. 이번 업데이트에는 복잡한 프롬프트 입력 없이도 원터치로 작동하는 고급 사물 제거, 인공 심도 효과, 스타일 변환 기능 등이 포함되어 사진의 디테일을 높이는 데 유용합니다. 현재 'AI 플레이그라운드' 탭에서 테스트 중이며, 구글 제미나이(Gemini) 기반 모델이 탑재되었습니다.

어도비 AI카메라 이미지편집
HN
Hacker News • 72일 전
IMP 6

우리는 디자인에 AI를 사용하지 않습니다

한 타이포그래피 디자이너가 생성형 AI가 디자인 과정을 대체하는 것에 대한 강력한 반대 의견을 제시합니다. 글자는 수천 년간 이어져 온 인간의 역사와 문화의 산물인데, AI는 이를 단순히 과거 데이터의 재조합으로 전락시키며 인간의 창조적 마찰을 상실시킨다는 것입니다. 특히 소수 언어를 지원하는 타이포그래피 산업이 AI 부족으로 위기를 맞을 수 있다는 점을 강조하며 인간 중심의 디자인을 고수해야 한다고 역설합니다.

생성형AI 타이포그래피 디자인
TD
The Decoder • 73일 전
IMP 8

구글 검색, 원하는 이미지가 없으면 AI로 생성해 제공

구글이 검색 결과 내 AI 오버뷰(AI Overviews)에 텍스트를 통한 이미지 생성 기능을 직접 추가했습니다. 웹에서 찾는 이미지가 없을 경우 즉시 AI로 생성할 수 있지만, 외부 웹사이트의 트래픽 감소가 불가피해졌습니다. 이는 구글 검색이 본격적인 AI 우선(AI-first) 환경으로 전환되고 있음을 보여줍니다.

구글검색 AI오버뷰 이미지생성
TC
TechCrunch AI • 73일 전
IMP 7

구글 이미지, 발견 중심의 핀터레스트형 리디자인 공개

구글 이미지가 핀터레스트와 유사한 동적 갤러리 형태로 리디자인되며, 'For You' 맞춤 갤러리와 이미지 저장 기능을 통해 탐색 및 발견 중심의 경험을 제공합니다. 또한 검색 내 AI 오버뷰(AI Overviews)에 이미지 생성 기능을 직접 통합하여 사용자가 특정 이미지를 찾지 못했을 때 구글 생태계 내에서 AI로 시각화할 수 있도록 지원합니다. 이는 사용자의 플랫폼 체류 시간을 늘려 광고 수익을 증대하고, 외부 AI 서비스 이탈을 막으려는 구글의 전략입니다.

구글 이미지생성 AI오버뷰
GB
Google AI Blog • 73일 전
IMP 8

구글 이미지 25주년, 새로운 비주얼 서치 및 AI 이미지 생성 기능 도입

구글이 이미지 검색 서비스 출시 25주년을 맞아, 사용자의 관심사 기반 맞춤형 이미지 갤러리와 검색 내 AI 오버뷰(AI Overviews)를 통한 AI 이미지 생성 기능을 새롭게 선보입니다. 특히 최신 '나노 바나나(Nano Banana)' 모델을 적용해 텍스트 프롬프트만으로 고품질 이미지를 생성할 수 있게 되어, 검색 경험의 혁신이 기대됩니다. 이는 그동안 텍스트 중심이었던 검색 환경이 시각적 탐색 및 생성형 AI를 통해 직관적인 정보 전달 및 제작이 가능한 단계로 진화했음을 시사합니다.

구글 비주얼 검색 이미지 생성
40
404 Media • 74일 전
IMP 3

독자들이 보내준 역대 최악의 AI 포스터 모음

404 Media 기자가 독자들에게 'ChatGPT 포스터(전단지)' 사례를 공유해달라고 요청한 후, 끔찍하고 황당한 AI 생성 광고물 사례가 쏟아졌습니다. 실생활 곳곳에 무분별하게 사용된 저품질의 AI 이미지에 대한 대중의 강한 거부감과 불만이 확인된 사안입니다.

이미지 생성 챗gpt 이메일 마케팅
WR
Wired AI • 77일 전
IMP 8

새로운 체험형 갤러리가 AI 예술에 대한 인식을 바꿀 수도 있는 이유

세계 최초의 AI 미술관인 '데이터랜드(Dataland)'가 LA에 오픈하여, 기존의 단순한 프롬프트 기반 생성 AI를 넘어선 새로운 예술적 가능성을 제시합니다. 아티스트 레핀 아나돌은 스미소니언 등의 데이터를 기반으로 자체 거대 자연 모델(Large Nature Model)을 학습시키고, 관람객의 생체 데이터를 반영한 몰입형 설치 작품을 선보였습니다. 이는 기존 빅테크 기업들이 직면한 저작권 및 윤리적 논란에서 벗어나, 윤리적이고 지속 가능한 방식의 AI 예술 패러다임을 제시한다는 점에서 중요합니다.

AI 예술 생성형 AI 데이터랜드
TD
The Decoder • 79일 전
IMP 8

메타 '뮤즈 이미지' 기술적 호평, 인스타 사진 무단 활용 논란

메타가 자율적으로 코드를 작성하고 웹 검색을 수행하는 에이전트 기반의 첫 이미지 생성 모델인 '뮤즈 이미지(Muse Image)'를 공개했습니다. 이 모델은 우수한 성능을 인정받아 이미지 아레나 평가에서 오픈AI 모델 다음으로 2위를 차지했습니다. 그러나 사용자가 다른 사람의 인스타그램 아이디만 입력하면 동의 없이 해당 인물의 사진을 학습해 새 이미지를 생성하는 기능이 추가되어, 유럽 연합(EU) 등에서 심각한 프라이버시 및 GDPR 위반 논란이 예상됩니다.

메타 AI 에이전트 이미지 생성
TC
TechCrunch AI • 80일 전
IMP 7

메타, 새로운 AI 이미지 생성기 '뮤즈' 출시

메타가 전담 AI 조직인 메타 슈퍼인텔리전스 랩스를 통해 새로운 AI 이미지 생성기 '뮤즈 이미지(Muse Image)'를 무료로 출시했습니다. 이 도구는 메타 AI 앱, 인스타그램 스토리, 왓츠앱 등에서 사용 가능하며, 프롬프트 기반 이미지 생성 및 편집, 인테리어 아이디어 시각화 등의 기능을 제공합니다. 메타는 향후 AI 비디오 생성기인 '뮤즈 비디오'도 개발 중임을 밝혔습니다.

메타 AI이미지생성 뮤즈
WR
Wired AI • 80일 전
IMP 8

인스타그램 사진, 동의 없이 AI 이미지로 무단 사용됩니다

메타가 새로운 AI 이미지 생성 모델을 발표하며, 공개 계정의 인스타그램 사진을 기본적으로 다른 사용자의 AI 프롬프트에 활용할 수 있도록 기능을 도입했습니다. 개인정보 침해 우려가 크지만, 계정을 비공개로 전환하거나 설정에서 수동으로 '공유 및 재사용(Sharing and reuse)' 옵션을 꺼야만 이를 방지할 수 있습니다. 사용자에게 별도의 알림조차 가지 않는 이 기능은 즉각적인 설정 변경이 필요한 핵심 이슈입니다.

메타 인스타그램 AI 이미지 생성
TC
TechCrunch AI • 87일 전
IMP 6

구글, 더 빠르고 저렴한 이미지 생성 모델 '나노 바나나 2 라이트' 공개

구글이 이미지 1,000장당 0.034달러라는 저렴한 비용으로 4초 만에 고품질 이미지를 생성하는 신모델 '나노 바나나 2 라이트(Nano Banana 2 Lite)'를 공개했습니다. 대량의 이미지 생성 및 반복 작업이 필요한 실무자와 개발자들에게 빠르고 경제적인 작업 환경을 제공한다는 점에서 중요합니다. 이와 함께 동영상 생성 모델 '제미나이 옴니 플래시(Gemini Omni Flash)'의 광범위한 배포와 정적 이미지를 영상으로 변환하는 데모 앱도 함께 발표되었습니다.

구글 이미지생성 AI모델