샌프란시스코, 2025년 8월 26일 – 구글 (Google)이 최신 AI 이미지 편집 모델 Gemini 2.5 Flash Image, 일명 ‘나노 바나나 (Nano Banana)’를 공개하며 이미지 생성 AI 시장에 큰 변화를 예고하고 있다. Gemini는 단순히 그림을 잘 그리는 AI가 아니라, 사용자가 아이디어를 발전시키고 결과물을 함께 완성할 수 있는 창의적 파트너로 설계됐다. 사용자는 여러 차례 수정과 피드백을 거치면서 점진적으로 결과물을 완성할 수 있다. 이전 대화 맥락을 기억하고 모호한 지시까지 창의적으로 해석하며 복잡한 이미지 편집 과제를 수행할 수 있는 것이 특징이다.
Gemini 2.5 Flash Image의 핵심 기능은 대화형 편집이다. 사용자가 한 번의 명령으로 끝내는 기존 AI 이미지 생성 방식과 달리, 다단계로 아이디어를 발전시킬 수 있다. 예를 들어, 특정 인물에게 옷을 입히고 스타일을 바꾸거나 배경과 포즈를 단계별로 변경하면서 이전 편집 내용을 기억해 자연스럽게 반영할 수 있다. 또한 다양한 장면에서도 동일 인물이나 캐릭터의 정체성을 유지하며, 여러 이미지를 합성하는 다중 이미지 융합, 손으로 그린 낙서나 도표를 분석해 작업을 수행하는 기능까지 갖추고 있다. 이러한 능력은 사용자가 완벽한 명령어를 고민하지 않아도 점진적으로 결과물의 완성도를 높일 수 있게 한다.
이번 모델은 제미나이 앱을 통해 무료로 사용할 수 있으며, API를 활용할 경우 이미지 한 장당 약 0.039달러라는 합리적인 가격에 제공된다. 구글은 대규모 사용자 환경에서도 안정적으로 인퍼런스를 제공할 수 있다고 밝히고 있으며, TPU 기반 컴퓨팅 자원을 활용해 비용과 성능을 최적화하고 있다. 개발자와 일반 사용자는 AI Studio와 API를 통해 Gemini를 활용할 수 있어 기술의 접근성을 크게 높였다.
Gemini의 공개는 디지털 이미지 편집 패러다임에도 큰 변화를 예고한다. 포토샵이 1990년 픽셀 편집 혁신을 가져왔듯이, Gemini는 AI 기반 대화형 창작 환경을 통해 더 쉽고 직관적인 편집을 가능하게 한다. 게임과 콘텐츠 산업에서는 영화 속 오브젝트를 게임용 3D 모델로 변환하거나, 캐릭터를 유지한 채 배경, 포즈, 아이템을 편집하는 등 실무적 활용도가 높다. 예를 들어, 게임 개발자는 영화 속 소품을 즉시 3D 모델로 변환해 게임 캐릭터에 적용할 수 있으며, 광고 업계에서는 모델 사진의 배경과 소품을 빠르게 바꿔 맞춤형 캠페인을 제작할 수 있다.
이번 모델은 기존 AI 이미지 생성기의 한계였던 정교한 통제 문제를 상당 부분 해결했다. 캐릭터의 표정과 포즈, 배경, 의상 등 세부 사항을 유지하면서 편집할 수 있어 사용자는 결과물을 보다 예측 가능하게 조정할 수 있다. 또한 여러 이미지를 통합하고 모호한 명령어를 창의적으로 해석하며, 다양한 장면에서도 캐릭터 일관성을 유지하는 기능은 실질적인 문제 해결 능력으로 이어진다.
산업 전문가들은 Gemini가 단순한 도구가 아니라 사용자의 의도를 이해하고 함께 창작 과정을 수행하는 창의적 파트너라고 평가한다. 특히 게임, 영화, 광고, 교육 콘텐츠 제작 등 다양한 분야에서 제작 효율과 창의성 향상에 기여할 것으로 예상된다. 실시간으로 수정과 편집이 가능한 기능은 기존에는 수시간에서 수일이 걸리던 작업을 단 몇 분 안에 끝낼 수 있게 한다.
Gemini 2.5 Flash Image의 등장은 서비스형 소프트웨어에서 사용자의 창작 의도를 이해하고 함께 실행하는 에이전틱 AI 시대로의 전환을 가속화할 전망이다. 구글 관계자는 “누구나 Gemini와 함께 복잡한 편집 작업을 손쉽게 수행하고, 점차 완성도를 높이는 창작 경험을 누릴 수 있다”고 밝혔다. 이번 공개는 AI 이미지 편집 시장 경쟁의 새로운 기준을 세우는 사건으로 평가된다.
AI 관련 미래 전망
Gemini의 등장은 SaaS에서 Agentic AI로의 전환을 가속화할 전망이다. AI가 사용자의 창작 의도를 이해하고 함께 실행하는 에이전틱 AI 시대가 열리면서, 글로벌 이미지 편집 및 디지털 창작 환경 전반에 혁신적 변화를 가져올 것으로 예상된다.



















댓글
0