# 컴피 UI: 최신 Qwen-Image-2.1 출시!

> https://bookfactory.kr/board/news/19694
> 게시판: 뉴스
> 작성자: admin
> 작성일: 2026-10-03T00:11:04.307Z

---

![見出し画像](https://assets.st-note.com/production/uploads/images/315904162/rectangle_large_type_2_d72dfbb6ad623e4939a02bec95a321ef.png?width=1280)

No. 212026/9/21 현재

네, 그럼 시작합니다. 여러분 안녕하세요, 저녁 인사드립니다.

장인 정신입니다.

이번에는 AI 직인님과 함께 진행하겠습니다.

새로운 이미지 생성 모델이 출시되었습니다. 이번에 직접 사용해 본 것은 알리바바의 Qwen 팀이 공개한 “Qwen-Image-2.1”입니다.

생성 및 이미지 편집 모두 이 한 툴로 완결 가능하며, 배경 투명화 커팅아웃이 처음부터 가능하다는 소식에 ComfyUI 환경을 직접 설치하여 꼼꼼히 검증해 보았습니다.

솔직하게 느껴본 촉감과, 움직일 때 주의해야 할 점을 기록해둡니다.

제 환경

CPU: 라이젠 7 9800X3D
GPU: 라데온 RX 9070 XT (16GB)
RAM: 32GB

현재 검증 결과입니다.

### 30GB를 넘는다는 소문과 실제 다운로드 용량

도입 전에 정보를 탐색하던 단계에서는 “모델 한 세트로 33GB에 육박하는 크기”라는 이야기를 접했고, 역시 저장 공간과 VRAM을 효율적으로 관리하는 데 어려움이 예상되었습니다. BF16(양자화되지 않은)의 원본 모델을 그대로 로딩하면, 본체만으로 약 14GB, 텍스트 인코더(Qwen3-VL 계열)로 약 17GB로, 확실히 상당한 크기를 차지합니다.

그러나 실제로 ComfyUI의 공식 템플릿을 열어보니 놀라울 뿐더러 기대했던 만큼 흥미롭지 않았습니다.

![画像](https://assets.st-note.com/img/1789957257-d9g1x8tHSAFziOrs2GTfKn5w.png?width=1200)

화면 오른쪽의 부족 모델 목록에 나타난 것은 사전에 최적화된 INT8 양자화 버전(int8_convrot)의 집합입니다.

- VAE: 약 544MB
- 텍스트 인코더 (Qwen3-VL 8B INT8): 약 8.71GB
- 생성 모델 본체 (INT8): 약 6.78GB

총 16.1GB 정도입니다.

이 환경이라면 VRAM 16GB 정도면 충분하며, ComfyUI의 지능형 메모리 회피(오프로딩) 기능 덕분에 멈추지 않고 부드럽게 작동해 줍니다. 공식의 “모두 다운로드” 버튼 하나만 누르기만 하면 작업 공간이 깔끔하게 준비되는 점이 매우 유익합니다.

### 프롬프트 작성 방식: FLUX 시리즈에 합류하는 “단어의 데시트”

프롬프트 처리 방식에 대해서는 최근 유행하는 FLUX와 유사한 설계 철학입니다. 과거의 Stable Diffusion처럼 “1girl, sunglasses, masterpiece...”와 같이 단어 태그를 쪼개어 나열하는 주문식 방식이 아닌, 풍경을 자연스러운 문장으로 전달하는 스타일이 전제됩니다.

피사체가 어떤 자세로, 어떤 질감의 옷을 입고, 빛이 어디에서 쏟아져 들어오는지”를 논리적인 문장으로 구성하는 것이 가장 직접적으로 결과를 반영됩니다.

공식 초기 프롬프트(prompt)를 살펴보면, 옷의 입체적인 구조, 선글라스 렌즈의 두께, 배경의 기하학적인 무늬에 이르기까지 모든 것이 글자 그대로 도면을 그리는 것처럼 매우 상세하게 스케치되어 있습니다.

또한, 부정 프롬프트의 전용 영역을 맴도는 것보다, 문장의 끝에 “텍스트나 로고는 절대 포함하지 않는다 (no text, no words)”라고 명확하게 지시하는 방식이 효과적인 점 역시 최근의 거대 모델들이 보여주는 솔직한 작동 방식입니다.

FLUX 등을 자주 사용하시는 분이라면, 구도나 질감과 같은 표현을 언어화하는 평소 프롬프트 방식 그대로, 자연스럽게 손에 익숙해지실 거라 생각합니다.

### 실제로 Qwen-Image-2.1을 활용하여 생성 검증을 수행했습니다.

이제 Qwen Image-2.1 T2I와 Qwen Image-2.1 이미지 편집의 검증을 진행해 보겠습니다. 먼저 T2I부터 시작합니다.

![画像](https://assets.st-note.com/img/1789958506-iXj6nSp5WJoRwfkxdYlqLD9u.png?width=1200)

생성 시간은 1메가픽셀, 1:1 정사각형 비율로 첫 번째 약 37초, 이후 약 15초 정도입니다.

2메가픽셀, 와이드스크린(16:9) 화면으로 첫 촬영 시 약 129초, 2회차 이후부터는 약 65초입니다.

Qwen-Image-2.1의 묘사력, 질감, 조명, 공간 표현을 모두 2메가픽셀, 16:9 비율로 생성했습니다.

![画像](https://assets.st-note.com/img/1789959783-1G60UwxylIc83Lj4XHsdeSKE.png?width=1200)

![画像](https://assets.st-note.com/img/1789959885-sQH9zSfUcXwnamiIGDuFkY7P.png?width=1200)

![画像](https://assets.st-note.com/img/1789959915-PC1890B74eDHaStgO3uZhow2.png?width=1200)

![画像](https://assets.st-note.com/img/1789959944-rLYbUoD5kQF6hs3wECtcjiKG.png?width=1200)

![画像](https://assets.st-note.com/img/1789959975-CuZic2UBd9QIvl7xft4R0FYH.png?width=1200)

### 배경 잘라내기 및 투명 효과 프롬프트

Qwen-Image-2.1은 “알파 채널(투명 PNG)”의 직접 생성에 대응하며, “투명 배경” 또는 “순수한 투명 배경 위에 격리”라는 지시를 입력하면 배경이 완전히 제거된 자료(스티커·자산용)로 출력됩니다.

![画像](https://assets.st-note.com/img/1789960087-OTfPAkL1X7HcqYUNdsC6hQDB.png?width=1200)

머리카락 끝과 헝클어진 머리카락의 미세한 절단 및 투과 정밀도를 테스트

![画像](https://assets.st-note.com/img/1789960245-JOSh1wPCkaY3d6xz7GWgIU9f.png?width=1200)

배경이 없어서 이해하기 어렵습니다.

![画像](https://assets.st-note.com/img/1789960390-ZtzSYBu24sjfDP8vNrXeGybL.png?width=1200)

![画像](https://assets.st-note.com/img/1789961001-lM9FxZvCmXI2HUTjzGKOcy4w.png?width=1200)

### 이미지 편집을 활용한 착용 효과 연출

이 기능을 사용하면 자신의 사진에 다른 이미지나 일러스트를 합성하여 마치 자신이 그 자리에 있는 것처럼 착용 사진을 만들 수 있습니다. 예를 들어, 좋아하는 패션 잡지 표지에 자신의 사진을 합성하거나, 애니메이션 캐릭터의 옷을 입혀 착용하는 것도 가능합니다.

이 기능을 사용하려면 먼저 자신의 사진을 촬영하거나, 앨범에서 선택해야 합니다. 다음으로, 합성하고 싶은 이미지를 앱에서 선택하여 자신의 사진에 겹쳐서 조정합니다. 배경색을 조정하거나, 이미지의 크기나 위치를 조정하여 더욱 현실적인 착용 사진을 만들 수 있습니다.

이 기능은 패션이나 미용에 관심 있는 사람뿐만 아니라, 창의적인 표현을 하고 싶은 사람에게도 추천합니다. 자신의 상상력을 자유롭게 표현하고, 독특한 착용 사진을 만들어 보세요.

Qwen-Image-2.1의 최대 특징은 이미지 생성뿐만 아니라, 지시문(프롬프트)에 따라 이미지 편집(In-painting, 이미지-투-이미지 방식 포함)이 단일 모델에서 가능하다는 점입니다.

공식 튜토리얼에 있는 테스트 이미지

![画像](https://assets.st-note.com/img/1789961705-k6TfUl3YdRDuPwBMoNSK0mAs.png?width=1200)

샘플 프롬프트: <image1>의 캐릭터와 자세를 변경하지 않고, <image2>의 이 빛 청색 데님 셔츠를 캐릭터에 착용합니다. 원래의 얼굴 특징, 머리, 몸매, 자세를 유지하며, 데님 셔츠가 자연스럽게 몸에 맞도록 합니다. 현실적인 데님 소재 질감, 자연스러운 옷 주름을 유지하며, 원래 배경과 조명을 그대로 사용합니다. 고품격 패션 에디토리얼 사진, 선명한 디테일을 유지합니다.

그 캐릭터와 포즈를 그대로 유지하고, <image2>의 라이트 블루 데님 셔츠를 그 캐릭터에게 입혀 주세요. 원래의 얼굴, 머리 스타일, 체형, 포즈는 그대로 두고, 데님 셔츠를 몸에 자연스럽게 맞게 하며, 현실적인 데님 소재의 질감과 자연스러운 옷의 주름을 표현해 주세요. 배경과 조명은 원래대로 유지하며, 하이 패션 잡지 같은 사진의 완성도와 세부까지 선명하게 묘사하는 것을 요구합니다.

이 공식 샘플에서 이 방법을 사용하면 남성이 함께 하고 포즈도 같다면 오른쪽 이미지(사진)가 나오네요. 예상대로!

![画像](https://assets.st-note.com/img/1789962070-MrvWawsLZ0t1NJkiDn9TElde.png?width=1200)

이건 비교 대상이 될 수 없으니,

![画像](https://assets.st-note.com/img/1789962327-wWRbmnerjgf82F1akO5H0pqV.png?width=1200)

극단적으로, 이 조합으로 동일한 프롬프트로 생성했습니다.

![画像](https://assets.st-note.com/img/1789964995-7mHMPtyEx0kOvD3A1lfR4cBG.png?width=1200)

또 한 번의 변화구로,

![画像](https://assets.st-note.com/img/1789962601-GE1Yj3Qb4WXsxwM8mP2TqS9A.png?width=1200)

원래 이미지는 뒷모습이었다. 오른쪽 셔츠는 등면이 보이지 않는 상태로 생성되었다.

![画像](https://assets.st-note.com/img/1789963460-lUHPzQZFsmdCWbXviDBJxRVr.png?width=1200)

정말 멋지네요! 상반신은 데님 셔츠만 입을 거라 생각했는데, 공조복과 셔츠를 별개의 아이템으로 보면서 파란색 셔츠만 데님 셔츠로 교체해서 왔습니다.

물론, 프롬프트로 냉기모복도 제거할 수 있고 자유롭게 조절할 수 있습니다. 놀라운 점은 지정된 곳 외에는 달라지지 않았다는 것입니다. 이미지를 2장 나란히 비교해 보았지만, 지정된 곳 이외에는 동일합니다.

### 도구로서의 사용성과 주의사항

도구로서 접근한다면 몇 가지 고려해야 할 사항들이 있습니다.

- 이번에는 “Qwen Research License”가 적용되어 연구 및 비상업적 목적으로만 사용이 제한됩니다. 업무 현장에서 결과물에 직접 사용하는 등 상업적 이용에는 별도의 라이선스 확인이 필요하므로, 자신의 제작 실험이나 검증 용도로만 활용하는 것이 안전합니다.
- 생성 속도와 해상도는 네이티브 2K(2048×2048)까지 충분한 성능을 보이지만, 단계 수가 40前後로 진행하면 상당한 시간이 소요됩니다. 우선 1024×1024 정도로 구도를 먼저 확인하고 결함이 없는지 확인한 후, 여기서 좋은 결과를 얻을 수 있겠다는 의도적인 작업 시점에만 해상도를 높이는 방식이 현실적입니다.

### 요약: “Qwen-Image-2.1”이라는 도구

실제로 꽤나 활용해 보았지만, 솔직히 말해서 “도구로서의 완성도가 한 단계 높아졌다”는 것이 현장의 실제적인 감동입니다. 그래요! “도구”죠. 지금까지의 이미지 생성으로 놀던 방식이 아닌, 이미지 편집 소프트나 앱에 훨씬 가까워진 느낌입니다.

단순히 아름다운 그림만 만들어내는 AI는 지금의 AI 모두 훌륭하지만, 처음부터 배경을 깔끔하게 제거해주는 투명 PNG 출력이나, 지정한 옷만만 쨍하게 자연스럽게 교체해주는 편집 정확도는 마치 장인의 “작업의 부담”을 온전히 줄여주는 실용성의 결정체였습니다.

30GB를 넘는다는 예상에 놀랐지만, 실제로 실행해보니 INT8로 약 16GB였습니다. 16GB 클래스 환경에서도 ComfyUI가 확실하게 실용적인 수준으로 잘 돌아갔다는 것은 정말 기쁜 반전이었습니다.

현재는 라이선스적으로 “현장 즉 투입”은 어렵지만, 개인 제작이나 프로토타입, 소재 제작의 조력자로서 흠 잡을 데 없는 최고 수준의 잠재력을 가지고 있습니다.

관심 있으신 분들은 꼭 ComfyUI 작업대에 불러서 이 솔직한 사용감을 직접 느껴보세요!

자, 여기까지 하겠습니다. 수고하셨습니다. 이 글이 “이해하기 쉬웠어요!” 또는 “유용했어요!”라고 생각하셨다면, 꼭 “좋아요”를 누르고 팔로우해주세요. 아니, 적어도 “❤️” 하나라도 눌러주시면 큰 힘이 될 거예요!

이 글을 읽어주신 모든 분들께 진심으로 감사드립니다.

장인 정신!

**출처:** [note 원문](https://note.com/chic_sage5875/n/n1e42f06cc610)

*번역: Gemma 3(.44) 초벌 + 교정 34청크*

[원문 보기](https://note.com/chic_sage5875/n/n1e42f06cc610) | 출처: note.com