AI 생성 메뉴판의 '똑같음' 문제
레스토랑과 카페 메뉴에 생성형 AI 일러스트가 확산되면서 모든 이미지가 지나치게 매끄럽고 대동소이한 미학을 보이는 문제가 나타나고 있다. 이는 AI 모델이 유사한 스타일의 대량 데이터로 학습되면서 ' convergence(수렴)' 현상을 일으키기 때문이며, AI 생성물이 다시 학습 데이터로 유입되면 모델 붕괴(model collapse) 위험도 커진다.
레스토랑과 카페 메뉴에 생성형 AI 일러스트가 확산되면서 모든 이미지가 지나치게 매끄럽고 대동소이한 미학을 보이는 문제가 나타나고 있다. 이는 AI 모델이 유사한 스타일의 대량 데이터로 학습되면서 ' convergence(수렴)' 현상을 일으키기 때문이며, AI 생성물이 다시 학습 데이터로 유입되면 모델 붕괴(model collapse) 위험도 커진다.
구글이 AI 이미지 생성·편집 도구 '구글 픽스(Google Pics)'를 출시해 캔바(Canva)와 어도비 익스프레스가 장악한 창작 디자인 시장에 진출합니다. 나노 바나나(Nano Banana) 이미지 생성 모델 기반으로, 워크스페이스 고객과 Google AI Pro/Ultra 구독자에게 순차 제공되며 Docs와 Slides에 먼저 통합됩니다. 기존 디자인 도구와 달리 처음부터 직접 디자인하는 것이 아니라 프롬프트로 생성하는 방식이라는 점이 핵심 차이입니다.
최근 디퓨전(Diffusion) 기반 객체 제거 AI 모델은 그림자나 반사광까지 자연스럽게 복원하는 수준으로 발전했지만, 기존 평가 지표들은 이를 제대로 평가하지 못하고 있습니다. 이에 샤오미 연구팀이 인간의 시각적 인식을 반영한 새로운 평가 지표(RC-S, RC-T)와 실제 비디오 데이터셋을 포함한 'PROVE' 벤치마크를 공개했습니다.
이 글은 Anthropic의 최신 AI 모델(claude-opus-5)이 복잡하고 특정적인 개념을 코드로 얼마나 잘 구현하는지 테스트하는 벤치마크 결과를 공유합니다. 프롬프트 요청대로 합스부르크 왕가의 특징적인 신체적 징후인 '돌출된 아래턱'을 가진 개구리 SVG 코드를 완벽하게 생성했습니다. 특히 AI가 단순한 도형을 넘어 해부학적 맥락에 맞는 주석과 디테일한 시각적 요소를 코드로 구현해 내는 능력을 보여줍니다.
구글이 검색 결과 내 AI 오버뷰(AI Overviews)에 텍스트를 통한 이미지 생성 기능을 직접 추가했습니다. 웹에서 찾는 이미지가 없을 경우 즉시 AI로 생성할 수 있지만, 외부 웹사이트의 트래픽 감소가 불가피해졌습니다. 이는 구글 검색이 본격적인 AI 우선(AI-first) 환경으로 전환되고 있음을 보여줍니다.
구글 이미지가 핀터레스트와 유사한 동적 갤러리 형태로 리디자인되며, 'For You' 맞춤 갤러리와 이미지 저장 기능을 통해 탐색 및 발견 중심의 경험을 제공합니다. 또한 검색 내 AI 오버뷰(AI Overviews)에 이미지 생성 기능을 직접 통합하여 사용자가 특정 이미지를 찾지 못했을 때 구글 생태계 내에서 AI로 시각화할 수 있도록 지원합니다. 이는 사용자의 플랫폼 체류 시간을 늘려 광고 수익을 증대하고, 외부 AI 서비스 이탈을 막으려는 구글의 전략입니다.
구글이 이미지 1,000장당 0.034달러라는 저렴한 비용으로 4초 만에 고품질 이미지를 생성하는 신모델 '나노 바나나 2 라이트(Nano Banana 2 Lite)'를 공개했습니다. 대량의 이미지 생성 및 반복 작업이 필요한 실무자와 개발자들에게 빠르고 경제적인 작업 환경을 제공한다는 점에서 중요합니다. 이와 함께 동영상 생성 모델 '제미나이 옴니 플래시(Gemini Omni Flash)'의 광범위한 배포와 정적 이미지를 영상으로 변환하는 데모 앱도 함께 발표되었습니다.
구글이 제미나이 앱의 개인화 AI 이미지 생성 기능을 미국의 모든 사용자에게 무료로 개방했습니다. 이 기능은 사용자의 구글 계정 데이터를 활용해 별도의 프롬프트 없이도 취향에 맞는 이미지를 자동으로 생성하는 것이 특징입니다. 이로써 기존 유료 구독자 전용이던 고급형(Personal Intelligence) 기능이 일반 사용자에게도 확대 제공되게 되었습니다.
본문은 고대 서사시 '오디세이'를 망가뜨린 웃기고 황당한 패러디 영화 포스터를 AI 이미지 생성 프롬프트로 만드는 내용입니다. 이 프롬프트는 잭 블랙을 오디세우스로, 드웨인 존슨을 제우스로, 테리 크루즈를 트로이의 헬렌으로 엉뚱하게 캐스팅하여 코믹한 재미를 줍니다. 누구도 진지하게 받아들이지 않을 가벼운 농담성 프롬프트로, 생성형 AI의 엔터테인먼트적 활용을 보여줍니다.
최근 Reddit에 GPT Image 2 모델을 사용해 2000년대 초반 디지털 카메라 감성의 극사실주의 거울 셀카를 생성한 결과물이 공유되었습니다. 복잡한 프롬프트를 통해 빛 질감, 노이즈, 자연스러운 털과 피부 표현까지 완벽하게 구현해 내어 이미지 생성 AI의 놀라운 퀄리티를 입증했습니다. 실제 사진과 구분하기 힘들 정도로 진보된 AI의 시각적 이해도와 구현 능력을 확인할 수 있는 사례입니다.
익명으로 등록된 'autobear'라는 이미지 생성 모델이 AI 텍스트-투-이미지(text-to-image) 분야에서 전례 없는 수준의 정확한 인포그래픽을 생성하여 화제가 되었습니다. 해당 모델은 기존 것으로 추정되는 'ductape'와는 다른 별개의 모델로 보이며, AI 이미지 생성의 한계를 뛰어넘는 텍스트 렌더링 및 구성 능력을 보여줍니다.