# 이미지 생성 및 편집 AI “Qwen-Image-2.1”을 무료 오픈 모델로 사용해 보았으며, 일본어 프롬프트 지원 및 투명 PNG 이미지 생성도 가능하다.

> https://bookfactory.kr/board/news/19055
> 게시판: 뉴스
> 작성자: tachikoma43
> 작성일: 2026-09-29T05:24:11.905Z

---

중국 기업 알리바바가 이미지 생성 AI “Qwen-Image-2.1”을 2026년 9월 20일에 공개했습니다. Qwen-Image 시리즈로는 오랜만에 공개되는 오픈 모델이며, 무료로 다운로드하여 ComfyUI 등의 실행 환경에서 이미지 생성 및 편집을 실행할 수 있습니다. “투명 PNG 생성 기능” 및 “여러 참조 이미지에 근거한 이미지 생성 기능” 등을 갖추고 있는 것으로 알려졌으므로, 실제로 PC에서 로컬로 실행해 보았습니다. Qwen-Image-2.1: Compact, Efficient, and Unified Image Creation https://qwen.ai/blog?id=qwen-image-2.1 Qwen/Qwen-Image-2.1 · Hugging Face https://huggingface.co/Qwen/Qwen-Image-2.1 Qwen-Image 시리즈는 초기 시절에는 오픈 모델로 출시되었지만, 2026년 2월에 등장하는 Qwen-Image-2.0 및 2026년 7월에 등장하는 Qwen-Image-3.0은 클로즈드 모델로 전개되었습니다. 이번에 등장한 Qwen-Image-2.1은 이전 버전으로 돌아간 모델이지만, 오픈 모델로서 공개되어 있으며, 무료로 다운로드하여 로컬에서 실행할 수 있습니다. 알리바바가 공개한 “다양한 이미지 생성 AI의 벤치마크 점수와 파라미터 수를 담은 그림”이 아래에 있습니다. Qwen-Image-2.1은 2026년 1월에 등장한 Qwen-Image-2512보다 작고, 70억 파라미터 규모의 모델이지만, 클로즈드 모델인 Google의 Nano Banana 2.0 및 OpenAI의 GPT-Image-1.5보다 성능이 우수하다고 평가됩니다.

이미 ComfyUI에서 사용 가능해졌으므로 사용해 보려고 합니다. 먼저 템플릿 목록에서 “Qwen Image 2.1：텍스트에서 이미지로”를 찾아 클릭합니다.

“모델이 부족하다”는 오류가 표시되므로 “상세 보기”를 클릭합니다.

diffusion model의 “qwen_image_2.1_int8_convrot.safetensors”, 텍스트 인코더의 “qwen3vl_8b_int8_convrot.safetensors”, VAE의 “qwen_image_2.1_vae_bf16.safetensors”를 다운로드하도록 유도되므로 “모두 다운로드”를 클릭합니다.

다운로드가 완료되면 ComfyUI를 재시작하거나 화면을 업데이트합니다. 그 다음으로, 프롬프트 입력란에 이미지 설명을 입력하고 “실행”을 클릭하면 이미지를 생성할 수 있습니다. 프롬프트는 일본어로도 OK입니다.

사진. 실외기(室外기)에 앉은 메이드(メイドさん). 일본인 여성. 머리카락은 붉은색 울프컷(ウルフカット)이다. 롤리팝 캔디(ロリポップキャンディ)를 물고 신문을 읽는다. 신문 헤드라인(見出し)은 “GIGAZINE”이며, “이미지 생성 AI Qwen-Image-2.0 등장(画像生成AI Qwen-Image-2.0登場)”이라고 쓰여 있다.

이 이미지는 “인간이 상당히 현실적인 것이 특징이지만, 신문 글자 지시(文字의 지시)는 제대로 지켜지지 않았으며, 실외기도 歪(위로)이다.”라는 프롬프트로 생성되었다.

같은 프롬프트에서 시드 값을 변경하여 생성하면서 “이미지 생성 AI Qwen-Image-2.0이 등장함”이라는 텍스트가 올바르게 반영되었습니다. ChatGPT나 Gemini와 같은 온라인 서비스와 비교했을 때 품질은 다소 낮지만, 생성 횟수가 무제한이므로 시드 값을 변경하면서 여러 번 생성하면 “맞는” 이미지를 생성할 수 있는 경우가 있습니다.

참고로, “그래픽 카드: Intel Arc Pro B70 Creator 32GB”, “CPU: AMD Ryzen 5 7600X”라는 구성의 PC를 사용하여 “해상도: 1024×1024 픽셀”, “단계 수: 25”라는 설정으로 생성한 결과, 첫 번째 이미지 생성에는 약 45초, 2번째 이후 생성에는 약 30초가 소요되었습니다.

Qwen-Image-2.1은 투명 PNG 이미지 생성에도 대응합니다. 특히 복잡한 설정은 필요 없으며, 프롬프트에 “투명 PNG”와 같은 단어를 포함하면 OK입니다.

“투명 PNG. 뭉툭한 간지메 maid의 전체 일러스트. 머리카락은 검은색의 짧게 자른 스타일이며, 오렌지색 “G” 모양의 헤어핀을 착용하고 있습니다. 일직선으로 서서 정면을 향한 자세. 배경은 투명”이라는 프롬프트로 생성한 이미지는 다음과 같습니다. 아래 이미지는 기사에 맞게 축소되어 투명 상태가 손실되었지만, 이미지를 클릭하면 원본 투명 PNG 이미지를 확인할 수 있습니다.

GIMP에서 열어보면 이런 느낌입니다. 배경이 확실하게 투명하게 처리되었습니다.

Qwen-Image-2.1의 이미지 편집 기능도 시험해 보았습니다. ComfyUI 템플릿 목록에서 “Qwen Image 2.1: 이미지 편집”을 찾아 클릭했습니다.

원본 이미지와 텍스트 프롬프트를 입력하여 생성합니다. 이번에는 Alibaba의 Qwen-Image-2.1 발표 블로그에 게시된 아이캐치 이미지와, 앞서 생성한 투명 PNG 이미지를 함께 사용하여 ‘대규모 강당에서의 제품 발표회 장면. 1장의 이미지를 대형 스크린에 표시. 발표자는 2장의 이미지에 있는 메이드복을 입은 여성. 메이드가 무대 위에서 대형 스크린을 가리키는 모습. 메이드의 대사로 “스고이!”라는 텍스트 박스를 추가합니다.’라는 텍스트를 입력했습니다.

생성 결과는 다음과 같습니다. “스크린이 곡선인데 텍스트가 곡선이 아닌 문제”, “아이캐치 이미지의 좌측 구조물이 깨진 문제”, “팔이 너무 많다”는 문제 등이 있지만, 대체로 지시대로 생성되었습니다.

하지만 위의 프롬프트에서는 성공 이미지가 나오는 확률이 낮아, 여러 장을 생성하여 성공 이미지를 선택해야 했습니다. 실패 이미지의 예시는 다음과 같습니다. 로컬 이미지 생성 커뮤니티에서는 “LLM을 사용하여 프롬프트를 이미지 생성 AI에 적합한 형태로 정제하는” 프롬프트 엔한서(Prompt Enhancer) 기법이 유행하고 있으므로, Qwen-Image-2.1에서도 프롬프트 엔한서 사용을 고려하는 것이 좋겠습니다.

참고: Qwen-Image-2.1의 라이선스에는 상업적 이용을 금지하는 조항이 포함되어 있지만, 알리바바의 공식 X 계정은 “Qwen-Image-2.1으로 생성한 이미지의 권리는 사용자에게 속한다”고 명확히 밝히고 있습니다.

안녕하세요, 질문해 주셔서 감사합니다! 👋 간단한 확인 사항입니다: 출력물은 라이선스된 재료의 일부가 아닙니다. 사용자는 모델을 사용하여 생성한 이미지 및 기타 콘텐츠에 대한 권리를 보유합니다.

[원문 보기](https://gigazine.net/news/20260924-qwen-image-2-1/) | 출처: Gigazine