Google가 이미지 생성 AI “Nano Banana 2.1”을 발표했습니다. 2026년 5월에 공식적으로 출시된 “Nano Banana 2”의 업데이트 버전으로, Gemini 3.6 Flash를 기반으로 하는 것으로 Flash 수준의 속도와 비용 효율을 유지하면서 1K, 2K, 4K 해상도에서 비주얼 품질, 텍스트 렌더링, 멀티 터닝의 일관성, Google 검색의 그래운딩을 개선합니다. Gemini Nano Banana 2.1 | Gemini API | Google AI for Developers https://ai.google.dev/gemini-api/docs/models/gemini-nano-banana-2.1 Nano Banana 2.1 - 모델 카드 — Google DeepMind https://deepmind.google/models/model-cards/nano-banana-2-1/Nano Banana 2.1의 주요 업데이트 내용은 다음과 같습니다. • 1K, 2K, 4K의 출력 해상도(기본값은 1K)에서 화질과 현실감을 향상 • 2K 및 4K 해상도에서 와이드 애스펙트비와 패노라마 애스펙트비(1:4, 4:1, 1:8, 8:1)의 타일링 아티팩트를 수정
텍스트 렌더링 및 인포그래픽 레이아웃 정확도 향상 – 최대 14장의 참조 이미지를 지원하는 멀티 이미지 융합 (최대 4명의 캐릭터 일관성 및 최대 10개의 객체의 충실성) – Google 웹 검색 및 이미지 검색을 통한 근거화 – 구성 가능한 사고 수준 (minimal, medium, high) 또한, Gemini Nano Banana 2.1은 최신 고효율 이미지 생성 및 편집 모델로서, “Gemini 3 Pro Image(Nano Banana Pro)”의 보다 효율적인 대응 모델로서 기능할 예정입니다. 아래는 “텍스트에서 이미지로의 변환”에 있어서의 벤치마크를 Nano Banana 2.1(Thinking), Nano Banana 2.1(No Thinking), Gemini 3.1 Flash Image(Nano Banana 2 Thinking), Gemini 3 Pro Image(Nano Banana Pro)에서 비교한 결과입니다. 상위부터 “종합적인 선호도”, “인포그래픽 디자인”, “인포그래픽의 정확성” 점수로, 모두 Nano Banana 2.1(Thinking)이 우수한 성능을 발휘하고 있습니다.
다음은 편집 능력에 관한 벤치마크로, 위에서부터 “일반 편집”, “단일 문자 일관성”, “다중 문자 일관성”, “마스크/잉크 기반 편집”, “제품 일관성”, “형식화”, “다중 참조 편집”을 나타냅니다. 또한 Nano Banana 2.1(Thinking)이 모든 면에서 가장 우수한 점수를 기록했습니다.
한편, 알려진 제한 사항으로는 “작은 글자, 긴 문단, 페이지 길이에서 텍스트 렌더링 부족”, “입력 이미지와 생성된 출력 이미지 간에 문자 일관성이 항상 완벽하지 않다는 점”, “공간적 위치 관계(좌우 등)에 대해 간헐적으로 혼란이 발생”, “세계에 대한 지식, 3D 추론, 사실 인식과 같은 고도된 능력은 여전히 제한적” 등이 품질 개선의 여지가 언급되었습니다. 또한 Gemini 3.6 Flash의 지식 끊김 시점은 2026년 3월이며, 일부 도메인에서는 모델의 지식이 2025년 1월까지밖에 이용할 수 없는 경우도 있습니다. 제한 사항 등은 Nano Banana 2.1의 기반이 되는 Gemini 3.6 Flash 모델 카드에서 확인할 수 있습니다. Gemini 3.6 Flash - 모델 카드 — Google DeepMind https://deepmind.google/models/model-cards/gemini-3-6-flash/
원문 보기 | 출처: Gigazine